{"as_of":"2026-08-22T09:33:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b5820df162d375b29b769d92378789cb66fe375ead77e2d953848e67a550510e","coverage":[{"denominator":33,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":33,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T12:31:13.039058Z","state":"measured"},{"denominator":37,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":37,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-22T06:32:14.747728+00:00","state":"measured"},{"denominator":4,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":4,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T15:47:22.541050Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T09:07:47.605932Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2504.12643","last_updated":"2025-06-06T08:55:27Z","snapshot_observed_at":"2026-08-22T05:08:58.036751Z","submitted_at":"2025-04-17T05:05:31Z","title":"RoPETR: Improving Temporal Camera-Only 3D Detection by Integrating Enhanced Rotary Position Embedding","version":3},"cited_work":{"arxiv_id":"2504.12643","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.12643","snapshot_observed_at":"2026-07-03T09:07:47.605932Z","title":"RoPETR: Improving temporal camera-only 3D detection by integrating enhanced rotary position embedding","venue":null,"work_id":"d22800ea-6375-4b9a-8252-7d949eb757c8","year":2025},"citing_paper":{"arxiv_id":"2510.26641","last_updated":"2026-04-09T21:40:47Z","snapshot_observed_at":"2026-08-15T22:09:41.056120Z","submitted_at":"2025-10-30T16:08:25Z","title":"All You Need for Object Detection: From Pixels, Points, and Prompts to Next-Gen Fusion and Multimodal LLMs/VLMs in Autonomous Vehicles","version":4},"reference_index":171,"source":"pdf_text","source_observed_at":"2026-05-18T02:59:09.920153Z"},"links":{"cited_paper":"/paper/2504.12643","citing_paper":"/paper/2510.26641"},"observation_digest":"sha256:6324ef594ce94e7ad69d36d3b7a27f0c91f9dfeb8c8b9ee6f4892fdb313a7dce","observation_id":"8e6a1fb8-13d2-4046-b779-4e9983f90928","resolution":{"observed_at":"2026-05-18T03:00:48.115163Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.12643","last_updated":"2025-06-06T08:55:27Z","snapshot_observed_at":"2026-08-22T05:08:58.036751Z","submitted_at":"2025-04-17T05:05:31Z","title":"RoPETR: Improving Temporal Camera-Only 3D Detection by Integrating Enhanced Rotary Position Embedding","version":3},"cited_work":{"arxiv_id":"2504.12643","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.12643","snapshot_observed_at":"2026-07-03T09:07:47.605932Z","title":"RoPETR: Improving temporal camera-only 3D detection by integrating enhanced rotary position embedding","venue":null,"work_id":"d22800ea-6375-4b9a-8252-7d949eb757c8","year":2025},"citing_paper":{"arxiv_id":"2604.10391","last_updated":"2026-04-12T00:46:51Z","snapshot_observed_at":"2026-08-13T16:13:38.625590Z","submitted_at":"2026-04-12T00:46:51Z","title":"FishRoPE: Projective Rotary Position Embeddings for Omnidirectional Visual Perception","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-10T16:33:42.210621Z"},"links":{"cited_paper":"/paper/2504.12643","citing_paper":"/paper/2604.10391"},"observation_digest":"sha256:9b8114d5042a4fc68a5672ca50966f8d68ad843466ee5e6be7a7b5e6eee2714e","observation_id":"3e694238-4615-413f-8ce7-c29aabe9e826","resolution":{"observed_at":"2026-05-11T08:40:59.288451Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.12643","last_updated":"2025-06-06T08:55:27Z","snapshot_observed_at":"2026-08-22T05:08:58.036751Z","submitted_at":"2025-04-17T05:05:31Z","title":"RoPETR: Improving Temporal Camera-Only 3D Detection by Integrating Enhanced Rotary Position Embedding","version":3},"cited_work":{"arxiv_id":"2504.12643","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.12643","snapshot_observed_at":"2026-07-03T09:07:47.605932Z","title":"RoPETR: Improving temporal camera-only 3D detection by integrating enhanced rotary position embedding","venue":null,"work_id":"d22800ea-6375-4b9a-8252-7d949eb757c8","year":2025},"citing_paper":{"arxiv_id":"2606.12146","last_updated":"2026-06-10T14:38:00Z","snapshot_observed_at":"2026-07-06T23:51:07.629939Z","submitted_at":"2026-06-10T14:38:00Z","title":"nD-RoPE: A Generalized RoPE for n-Dimensional Position Embedding","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-27T10:33:48.336183Z"},"links":{"cited_paper":"/paper/2504.12643","citing_paper":"/paper/2606.12146"},"observation_digest":"sha256:abd29dcbaaa36a4f1df4bbaa22f670c6a35026489e7ea663853ad4dfdecdd052","observation_id":"aa928c84-18cb-4912-9763-f00664ae0883","resolution":{"observed_at":"2026-07-03T09:07:47.607418Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.12643","last_updated":"2025-06-06T08:55:27Z","snapshot_observed_at":"2026-08-22T05:08:58.036751Z","submitted_at":"2025-04-17T05:05:31Z","title":"RoPETR: Improving Temporal Camera-Only 3D Detection by Integrating Enhanced Rotary Position Embedding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.12643","snapshot_observed_at":"2026-08-15T15:47:22.541050Z","title":"Ropetr: Improving temporal camera-only 3d detection by integrating enhanced rotary position embedding.arXiv preprint arXiv:2504.12643, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.13147","last_updated":"2026-08-13T12:17:50Z","snapshot_observed_at":"2026-08-19T00:54:40.079550Z","submitted_at":"2026-08-13T12:17:50Z","title":"Geometry-Grounded Unified 3D Perception for Autonomous Driving","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T15:47:22.541050Z"},"links":{"cited_paper":"/paper/2504.12643","citing_paper":"/paper/2608.13147"},"observation_digest":"sha256:5e4ee4b1c8f3489bb9c69b4a83c8f87c87373778de462ae93192c68d19a08503","observation_id":"6feaab0d-b9aa-40d5-869a-666f6e2fb0f1","resolution":{"observed_at":"2026-08-15T15:47:22.541050Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2504.12643/citation-record","integrity":"/paper/2504.12643/integrity","json":"/paper/2504.12643/citation-record.json","paper":"/paper/2504.12643"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:31:12.923890Z","title":"nuscenes: A multimodal dataset for autonomous driving","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2504.12643","last_updated":"2025-06-06T08:55:27Z","snapshot_observed_at":"2026-08-22T05:08:58.036751Z","submitted_at":"2025-04-17T05:05:31Z","title":"RoPETR: Improving Temporal Camera-Only 3D Detection by Integrating Enhanced Rotary Position Embedding","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-16T12:31:12.923890Z"},"links":{"citing_paper":"/paper/2504.12643"},"observation_digest":"sha256:4d2246df07e17e14adff8856168048610d547f6542a6036319d3f6a5f73a0291","observation_id":"fb46d675-e91e-4eb3-8425-724be831a97e","resolution":{"observed_at":"2026-08-16T12:31:12.923890Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:31:12.928528Z","title":"End-to-end object detection with transformers","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2504.12643","last_updated":"2025-06-06T08:55:27Z","snapshot_observed_at":"2026-08-22T05:08:58.036751Z","submitted_at":"2025-04-17T05:05:31Z","title":"RoPETR: Improving Temporal Camera-Only 3D Detection by Integrating Enhanced Rotary Position Embedding","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-16T12:31:12.928528Z"},"links":{"citing_paper":"/paper/2504.12643"},"observation_digest":"sha256:fdd494d09872ae15ffae4d783b1605671bbfe9b784c7a89d2f9c897dfd5eb73f","observation_id":"94618c66-406d-48be-9e9f-b80079e435ea","resolution":{"observed_at":"2026-08-16T12:31:12.928528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:31:13.350144Z","title":"Depth- net: A recurrent neural network architecture for monocular depth pre- diction","venue":null,"work_id":"5bf2a381-ee64-41c0-a388-2d47e474efe3","year":2018},"citing_paper":{"arxiv_id":"2504.12643","last_updated":"2025-06-06T08:55:27Z","snapshot_observed_at":"2026-08-22T05:08:58.036751Z","submitted_at":"2025-04-17T05:05:31Z","title":"RoPETR: Improving Temporal Camera-Only 3D Detection by Integrating Enhanced Rotary Position Embedding","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-16T12:31:12.932469Z"},"links":{"citing_paper":"/paper/2504.12643"},"observation_digest":"sha256:50130f5cd8c02e9a6f0bd35c20e25945cd0a45988d9457c863c68de360a034b6","observation_id":"eaf8c4e2-904e-44ed-b695-0a14abf048c3","resolution":{"observed_at":"2026-08-16T12:31:13.353642Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-08-16T09:25:53.087782Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-16T12:31:12.935996Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale.arXiv preprint arXiv:2010.11929, 2020","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2504.12643","last_updated":"2025-06-06T08:55:27Z","snapshot_observed_at":"2026-08-22T05:08:58.036751Z","submitted_at":"2025-04-17T05:05:31Z","title":"RoPETR: Improving Temporal Camera-Only 3D Detection by Integrating Enhanced Rotary Position Embedding","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-16T12:31:12.935996Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2504.12643"},"observation_digest":"sha256:c8674b065cc6b7384681d68f7c255040dbe3fa20154bb4b14121df4236ec2c4b","observation_id":"d387582d-2282-4530-994d-29c340be15b3","resolution":{"observed_at":"2026-08-16T12:31:12.935996Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:31:13.340673Z","title":"Mask r-cnn","venue":null,"work_id":"f8cb880a-471f-4fa4-85f8-e56d4ea02d2a","year":2017},"citing_paper":{"arxiv_id":"2504.12643","last_updated":"2025-06-06T08:55:27Z","snapshot_observed_at":"2026-08-22T05:08:58.036751Z","submitted_at":"2025-04-17T05:05:31Z","title":"RoPETR: Improving Temporal Camera-Only 3D Detection by Integrating Enhanced Rotary Position Embedding","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-16T12:31:12.940295Z"},"links":{"citing_paper":"/paper/2504.12643"},"observation_digest":"sha256:d766fe10b767a6ba9a66d4552708751a7d523d164639f356c2f44880a819f267","observation_id":"1269e6c6-b826-4999-85b7-0b80a1ced1f0","resolution":{"observed_at":"2026-08-16T12:31:13.344022Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:31:12.943785Z","title":"Deep residual learning for image recognition","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2504.12643","last_updated":"2025-06-06T08:55:27Z","snapshot_observed_at":"2026-08-22T05:08:58.036751Z","submitted_at":"2025-04-17T05:05:31Z","title":"RoPETR: Improving Temporal Camera-Only 3D Detection by Integrating Enhanced Rotary Position Embedding","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-16T12:31:12.943785Z"},"links":{"citing_paper":"/paper/2504.12643"},"observation_digest":"sha256:ecec1127a190cde2c1615c8dfe7c291c3556d505079405c68e598ecbac9a50ac","observation_id":"46522b9b-9e03-4758-a20b-1586aee442da","resolution":{"observed_at":"2026-08-16T12:31:12.943785Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.17054","last_updated":"2022-06-16T09:44:08Z","snapshot_observed_at":"2026-08-16T17:10:15.129652Z","submitted_at":"2022-03-31T14:21:19Z","title":"BEVDet4D: Exploit Temporal Cues in Multi-camera 3D Object Detection","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.17054","snapshot_observed_at":"2026-08-16T12:31:12.947420Z","title":"Bevdet4d: Exploit temporal cues in multi-camera 3d object detection.arXiv preprint arXiv:2203.17054, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.12643","last_updated":"2025-06-06T08:55:27Z","snapshot_observed_at":"2026-08-22T05:08:58.036751Z","submitted_at":"2025-04-17T05:05:31Z","title":"RoPETR: Improving Temporal Camera-Only 3D Detection by Integrating Enhanced Rotary Position Embedding","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-16T12:31:12.947420Z"},"links":{"cited_paper":"/paper/2203.17054","citing_paper":"/paper/2504.12643"},"observation_digest":"sha256:28abb2ab1a87bca9d864ad3ce1d6f285e61b8cd57de3bbff5a6b813ec9df81b0","observation_id":"390f478b-4e6a-478c-958e-6c34bc5f527f","resolution":{"observed_at":"2026-08-16T12:31:12.947420Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11790","last_updated":"2022-06-16T09:15:52Z","snapshot_observed_at":"2026-08-17T05:15:58.663240Z","submitted_at":"2021-12-22T10:48:06Z","title":"BEVDet: High-performance Multi-camera 3D Object Detection in Bird-Eye-View","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.11790","snapshot_observed_at":"2026-08-16T12:31:12.951291Z","title":"Bevdet: High-performance multi-camera 3d object detection in bird-eye- view.arXiv preprint arXiv:2112.11790, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.12643","last_updated":"2025-06-06T08:55:27Z","snapshot_observed_at":"2026-08-22T05:08:58.036751Z","submitted_at":"2025-04-17T05:05:31Z","title":"RoPETR: Improving Temporal Camera-Only 3D Detection by Integrating Enhanced Rotary Position Embedding","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-16T12:31:12.951291Z"},"links":{"cited_paper":"/paper/2112.11790","citing_paper":"/paper/2504.12643"},"observation_digest":"sha256:bbce867221b711c2b667454f197447c7e293a21e82087fef018169fca9b8584c","observation_id":"4dbb71f6-931f-4756-9602-5163d1428bab","resolution":{"observed_at":"2026-08-16T12:31:12.951291Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:31:13.325364Z","title":"Centermask: Real-time anchor-free instance segmentation","venue":null,"work_id":"e480ceb0-917b-49ee-9cf9-a52a522c1750","year":2020},"citing_paper":{"arxiv_id":"2504.12643","last_updated":"2025-06-06T08:55:27Z","snapshot_observed_at":"2026-08-22T05:08:58.036751Z","submitted_at":"2025-04-17T05:05:31Z","title":"RoPETR: Improving Temporal Camera-Only 3D Detection by Integrating Enhanced Rotary Position Embedding","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-16T12:31:12.955516Z"},"links":{"citing_paper":"/paper/2504.12643"},"observation_digest":"sha256:c730ad93246931c4e2b5d3dd13feca5a1497e5f336c69eb063c4a23689ed6158","observation_id":"d868bfcd-8eaa-4d63-a08e-404394841377","resolution":{"observed_at":"2026-08-16T12:31:13.328844Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:31:12.958838Z","title":"Dn-detr: Accelerate detr training by introducing query denoising","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.12643","last_updated":"2025-06-06T08:55:27Z","snapshot_observed_at":"2026-08-22T05:08:58.036751Z","submitted_at":"2025-04-17T05:05:31Z","title":"RoPETR: Improving Temporal Camera-Only 3D Detection by Integrating Enhanced Rotary Position Embedding","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-16T12:31:12.958838Z"},"links":{"citing_paper":"/paper/2504.12643"},"observation_digest":"sha256:3a1553a11e7eb7819e622ce5ff24b20ef74a0df0308328c12b18edbbe8619940","observation_id":"30cf1ba1-34a8-4243-80c3-1f4532ca93f4","resolution":{"observed_at":"2026-08-16T12:31:12.958838Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:31:12.962243Z","title":"Bevstereo: Enhancing depth estimation in multi-view 3d object detection with temporal stereo","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.12643","last_updated":"2025-06-06T08:55:27Z","snapshot_observed_at":"2026-08-22T05:08:58.036751Z","submitted_at":"2025-04-17T05:05:31Z","title":"RoPETR: Improving Temporal Camera-Only 3D Detection by Integrating Enhanced Rotary Position Embedding","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-16T12:31:12.962243Z"},"links":{"citing_paper":"/paper/2504.12643"},"observation_digest":"sha256:ba8d28c248019b8d124f24b7737bf603cd1c45212eb0633db59967b2774afc81","observation_id":"c60288ff-cc17-44fb-a910-25ff7d279868","resolution":{"observed_at":"2026-08-16T12:31:12.962243Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:31:12.965448Z","title":"Bevdepth: Acquisition of reliable depth for multi-view 3d object detection","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.12643","last_updated":"2025-06-06T08:55:27Z","snapshot_observed_at":"2026-08-22T05:08:58.036751Z","submitted_at":"2025-04-17T05:05:31Z","title":"RoPETR: Improving Temporal Camera-Only 3D Detection by Integrating Enhanced Rotary Position Embedding","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-16T12:31:12.965448Z"},"links":{"citing_paper":"/paper/2504.12643"},"observation_digest":"sha256:6f7a8e7195c759e3db135495b4493f8dc110fedefcf923fd1aa9a20ab1b06225","observation_id":"8e029934-c678-4306-8dcc-df96470957bd","resolution":{"observed_at":"2026-08-16T12:31:12.965448Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:31:12.968653Z","title":"Bevformer: learning bird’s-eye-view representation from lidar-camera via spatiotemporal transformers.IEEE Transactions on Pattern Analysis and Machine Intelligence, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.12643","last_updated":"2025-06-06T08:55:27Z","snapshot_observed_at":"2026-08-22T05:08:58.036751Z","submitted_at":"2025-04-17T05:05:31Z","title":"RoPETR: Improving Temporal Camera-Only 3D Detection by Integrating Enhanced Rotary Position Embedding","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-16T12:31:12.968653Z"},"links":{"citing_paper":"/paper/2504.12643"},"observation_digest":"sha256:5b5f288c43112151a8a0e44303a1f6b079abdd340cd494b8c8f40acbbe2b6f49","observation_id":"407501c6-4017-4a1c-a9f1-acbd026d3a3b","resolution":{"observed_at":"2026-08-16T12:31:12.968653Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:31:13.293646Z","title":"Fb-bev: Bev representation from forward-backward view transformations","venue":null,"work_id":"0ff6aabb-56e1-4d1e-af26-3e9e09b3d7ac","year":2023},"citing_paper":{"arxiv_id":"2504.12643","last_updated":"2025-06-06T08:55:27Z","snapshot_observed_at":"2026-08-22T05:08:58.036751Z","submitted_at":"2025-04-17T05:05:31Z","title":"RoPETR: Improving Temporal Camera-Only 3D Detection by Integrating Enhanced Rotary Position Embedding","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-16T12:31:12.971859Z"},"links":{"citing_paper":"/paper/2504.12643"},"observation_digest":"sha256:1ef27d12ed01b45bb8e902a7bebd483b28461f2ad0a8e0369fc75c01f51fb96b","observation_id":"6b5c746b-e9d3-416b-90c0-6444f2720dd5","resolution":{"observed_at":"2026-08-16T12:31:13.297400Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.11722","last_updated":"2023-11-20T12:37:58Z","snapshot_observed_at":"2026-08-19T18:41:45.557666Z","submitted_at":"2023-11-20T12:37:58Z","title":"Sparse4D v3: Advancing End-to-End 3D Detection and Tracking","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.11722","snapshot_observed_at":"2026-08-16T12:31:12.975240Z","title":"Sparse4d v3: Advancing end-to-end 3d detection and tracking.arXiv preprint arXiv:2311.11722, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.12643","last_updated":"2025-06-06T08:55:27Z","snapshot_observed_at":"2026-08-22T05:08:58.036751Z","submitted_at":"2025-04-17T05:05:31Z","title":"RoPETR: Improving Temporal Camera-Only 3D Detection by Integrating Enhanced Rotary Position Embedding","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-16T12:31:12.975240Z"},"links":{"cited_paper":"/paper/2311.11722","citing_paper":"/paper/2504.12643"},"observation_digest":"sha256:c3490e1808cf7ea64c1ce2f435b2dac87899e1d1525e5386892b54615f2ff046","observation_id":"5df66585-8fb0-4d19-a709-e5b485013974","resolution":{"observed_at":"2026-08-16T12:31:12.975240Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:31:13.282565Z","title":"Ray denoising: Depth-aware hard negative sampling for multi-view 3d object detection","venue":null,"work_id":"212acbec-96ad-4291-b64e-74ddddef5fd3","year":2024},"citing_paper":{"arxiv_id":"2504.12643","last_updated":"2025-06-06T08:55:27Z","snapshot_observed_at":"2026-08-22T05:08:58.036751Z","submitted_at":"2025-04-17T05:05:31Z","title":"RoPETR: Improving Temporal Camera-Only 3D Detection by Integrating Enhanced Rotary Position Embedding","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-16T12:31:12.978848Z"},"links":{"citing_paper":"/paper/2504.12643"},"observation_digest":"sha256:4e285d3ff03eeaa2eb97783897894e27883bd0a4c58b7543271bbc525119c949","observation_id":"7f0829d4-77ff-4efc-9c91-4c8cb81474a3","resolution":{"observed_at":"2026-08-16T12:31:13.286531Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:31:13.270176Z","title":"Petr: Position embedding transformation for multi-view 3d object detection","venue":null,"work_id":"e9031208-6282-4937-b8dc-52c8260ebdc8","year":2022},"citing_paper":{"arxiv_id":"2504.12643","last_updated":"2025-06-06T08:55:27Z","snapshot_observed_at":"2026-08-22T05:08:58.036751Z","submitted_at":"2025-04-17T05:05:31Z","title":"RoPETR: Improving Temporal Camera-Only 3D Detection by Integrating Enhanced Rotary Position Embedding","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-16T12:31:12.982077Z"},"links":{"citing_paper":"/paper/2504.12643"},"observation_digest":"sha256:32918e5cc228e5e6cc28fbc45f0ea39254f6b652cfaa447ffa1919a3cbab0f5e","observation_id":"87715754-8943-4aae-88c8-01a1c5ce74ed","resolution":{"observed_at":"2026-08-16T12:31:13.274340Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:31:12.985353Z","title":"Petrv2: A unified framework for 3d perception from multi-camera images","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.12643","last_updated":"2025-06-06T08:55:27Z","snapshot_observed_at":"2026-08-22T05:08:58.036751Z","submitted_at":"2025-04-17T05:05:31Z","title":"RoPETR: Improving Temporal Camera-Only 3D Detection by Integrating Enhanced Rotary Position Embedding","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-16T12:31:12.985353Z"},"links":{"citing_paper":"/paper/2504.12643"},"observation_digest":"sha256:09a7181bed21787eff675ab7b99f30a0355efa58d84a58c348344fbe376e28c5","observation_id":"a76c5e66-7113-4a57-8910-33be968292d7","resolution":{"observed_at":"2026-08-16T12:31:12.985353Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:31:13.252823Z","title":"Is pseudo-lidar needed for monocular 3d object detection? InProceed- ings of the IEEE/CVF International Conference on Computer Vision, pages 3142–3152, 2021","venue":null,"work_id":"cd52e96b-23d9-4886-88cc-2366eabace7e","year":2021},"citing_paper":{"arxiv_id":"2504.12643","last_updated":"2025-06-06T08:55:27Z","snapshot_observed_at":"2026-08-22T05:08:58.036751Z","submitted_at":"2025-04-17T05:05:31Z","title":"RoPETR: Improving Temporal Camera-Only 3D Detection by Integrating Enhanced Rotary Position Embedding","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-16T12:31:12.988703Z"},"links":{"citing_paper":"/paper/2504.12643"},"observation_digest":"sha256:5f5121a93058f3ac8f7c02d1043fc6ad9544c38ca34560664895ad66b24746c8","observation_id":"479f4040-112c-4d32-8a47-7b1e4ac34396","resolution":{"observed_at":"2026-08-16T12:31:13.256846Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.02443","last_updated":"2022-10-05T17:59:51Z","snapshot_observed_at":"2026-08-16T16:26:38.412937Z","submitted_at":"2022-10-05T17:59:51Z","title":"Time Will Tell: New Outlooks and A Baseline for Temporal Multi-View 3D Object Detection","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.02443","snapshot_observed_at":"2026-08-16T12:31:12.991943Z","title":"Time will tell: New outlooks and a baseline for temporal multi-view 3d object detection.arXiv preprint arXiv:2210.02443, 2022","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.12643","last_updated":"2025-06-06T08:55:27Z","snapshot_observed_at":"2026-08-22T05:08:58.036751Z","submitted_at":"2025-04-17T05:05:31Z","title":"RoPETR: Improving Temporal Camera-Only 3D Detection by Integrating Enhanced Rotary Position Embedding","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-16T12:31:12.991943Z"},"links":{"cited_paper":"/paper/2210.02443","citing_paper":"/paper/2504.12643"},"observation_digest":"sha256:a16a308e7e55edac80201bd0922fc73aa86b0afa086b51c9f978f122a40f2f78","observation_id":"72c76f90-3020-457f-b63a-8cba2af2e600","resolution":{"observed_at":"2026-08-16T12:31:12.991943Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:31:12.995985Z","title":"Lift, splat, shoot: Encoding images from arbitrary camera rigs by implicitly unprojecting to 3d","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2504.12643","last_updated":"2025-06-06T08:55:27Z","snapshot_observed_at":"2026-08-22T05:08:58.036751Z","submitted_at":"2025-04-17T05:05:31Z","title":"RoPETR: Improving Temporal Camera-Only 3D Detection by Integrating Enhanced Rotary Position Embedding","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-16T12:31:12.995985Z"},"links":{"citing_paper":"/paper/2504.12643"},"observation_digest":"sha256:31c514ceb0cc4f39962bd3038cf52fc9f7ebaaaf862c0eecfafd1406b6465678","observation_id":"dff3b5ec-ffb0-4ac9-a1a9-02398ea3bb4d","resolution":{"observed_at":"2026-08-16T12:31:12.995985Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:31:13.236106Z","title":"Hop: History-and-order aware pre-training for vision-and- language navigation","venue":null,"work_id":"53b815cf-26f3-4633-a710-037ac10aa2a2","year":2022},"citing_paper":{"arxiv_id":"2504.12643","last_updated":"2025-06-06T08:55:27Z","snapshot_observed_at":"2026-08-22T05:08:58.036751Z","submitted_at":"2025-04-17T05:05:31Z","title":"RoPETR: Improving Temporal Camera-Only 3D Detection by Integrating Enhanced Rotary Position Embedding","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-16T12:31:12.999475Z"},"links":{"citing_paper":"/paper/2504.12643"},"observation_digest":"sha256:d20fc9a93c74a53ce915793da7f39c7768d1dddb234ba80ce0cd507395e96de7","observation_id":"64520385-94a6-4531-b72a-90eaf33e1688","resolution":{"observed_at":"2026-08-16T12:31:13.239710Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:31:13.003266Z","title":"3dppe: 3d point positional encoding for transformer-based multi-camera 3d object detection","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.12643","last_updated":"2025-06-06T08:55:27Z","snapshot_observed_at":"2026-08-22T05:08:58.036751Z","submitted_at":"2025-04-17T05:05:31Z","title":"RoPETR: Improving Temporal Camera-Only 3D Detection by Integrating Enhanced Rotary Position Embedding","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-16T12:31:13.003266Z"},"links":{"citing_paper":"/paper/2504.12643"},"observation_digest":"sha256:331fac1f09393afec82e498ddd7d349613b2403b18dff46f192501cf3c1987e7","observation_id":"096686c3-83e6-4724-b16d-1bec388896de","resolution":{"observed_at":"2026-08-16T12:31:13.003266Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:31:13.006723Z","title":"Sparse r-cnn: End-to-end object detection with learnable proposals","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.12643","last_updated":"2025-06-06T08:55:27Z","snapshot_observed_at":"2026-08-22T05:08:58.036751Z","submitted_at":"2025-04-17T05:05:31Z","title":"RoPETR: Improving Temporal Camera-Only 3D Detection by Integrating Enhanced Rotary Position Embedding","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-16T12:31:13.006723Z"},"links":{"citing_paper":"/paper/2504.12643"},"observation_digest":"sha256:6cd6dde255eafb2f36726f5f443b63525abd5480ea772da63f2deae39c07b998","observation_id":"4ac30dd9-fa0c-491d-9a47-3fedd8e08557","resolution":{"observed_at":"2026-08-16T12:31:13.006723Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:31:13.010141Z","title":"Attention is all you need.Advances in neural information processing systems, 30, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2504.12643","last_updated":"2025-06-06T08:55:27Z","snapshot_observed_at":"2026-08-22T05:08:58.036751Z","submitted_at":"2025-04-17T05:05:31Z","title":"RoPETR: Improving Temporal Camera-Only 3D Detection by Integrating Enhanced Rotary Position Embedding","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-16T12:31:13.010141Z"},"links":{"citing_paper":"/paper/2504.12643"},"observation_digest":"sha256:dcd320a3e7fd68c8e651712f66632e32b58ffffc9e9ee674d95bf9be3e2fc5ae","observation_id":"cf36e4a8-a98d-465c-9f1b-1a5ebd7ece3b","resolution":{"observed_at":"2026-08-16T12:31:13.010141Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-08-06T05:35:29.109022Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-16T12:31:13.013670Z","title":"Qwen2- vl: Enhancing vision-language model’s perception of the world at any resolution.arXiv preprint arXiv:2409.12191, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.12643","last_updated":"2025-06-06T08:55:27Z","snapshot_observed_at":"2026-08-22T05:08:58.036751Z","submitted_at":"2025-04-17T05:05:31Z","title":"RoPETR: Improving Temporal Camera-Only 3D Detection by Integrating Enhanced Rotary Position Embedding","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-16T12:31:13.013670Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2504.12643"},"observation_digest":"sha256:a4d473e1359f6b8a5677bc4299ea97211534458624fb68c1cf20eefa651ff21f","observation_id":"fb9d6c59-df5f-4164-9b00-46b490f67b65","resolution":{"observed_at":"2026-08-16T12:31:13.013670Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:31:13.017367Z","title":"Exploring object-centric temporal modeling for efficient multi-view 3d object detection","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.12643","last_updated":"2025-06-06T08:55:27Z","snapshot_observed_at":"2026-08-22T05:08:58.036751Z","submitted_at":"2025-04-17T05:05:31Z","title":"RoPETR: Improving Temporal Camera-Only 3D Detection by Integrating Enhanced Rotary Position Embedding","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-16T12:31:13.017367Z"},"links":{"citing_paper":"/paper/2504.12643"},"observation_digest":"sha256:c24a695ec4c7ea2cb18c97efca262389b5b0a86ddb19061760c0f404f1d02e88","observation_id":"12e6f7eb-4256-4d91-be54-5e1617e9e38a","resolution":{"observed_at":"2026-08-16T12:31:13.017367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:31:13.198020Z","title":"Detr3d: 3d object detection from multi- view images via 3d-to-2d queries","venue":null,"work_id":"396e6c8d-afe8-45ea-a417-9c0b6997b6d1","year":2022},"citing_paper":{"arxiv_id":"2504.12643","last_updated":"2025-06-06T08:55:27Z","snapshot_observed_at":"2026-08-22T05:08:58.036751Z","submitted_at":"2025-04-17T05:05:31Z","title":"RoPETR: Improving Temporal Camera-Only 3D Detection by Integrating Enhanced Rotary Position Embedding","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-16T12:31:13.020598Z"},"links":{"citing_paper":"/paper/2504.12643"},"observation_digest":"sha256:aacf65a87543cfc0f2d5920b05d18cd8ec7da031fed7adb250eac2f01a0dbd7a","observation_id":"5f569149-3038-4d92-a5c3-26e21f6242de","resolution":{"observed_at":"2026-08-16T12:31:13.201882Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:31:13.185250Z","title":"Object as query: Lifting any 2d object detector to 3d detection","venue":null,"work_id":"8f7f38d0-2fa6-4717-a46f-82393718ae44","year":2023},"citing_paper":{"arxiv_id":"2504.12643","last_updated":"2025-06-06T08:55:27Z","snapshot_observed_at":"2026-08-22T05:08:58.036751Z","submitted_at":"2025-04-17T05:05:31Z","title":"RoPETR: Improving Temporal Camera-Only 3D Detection by Integrating Enhanced Rotary Position Embedding","version":3},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-16T12:31:13.024301Z"},"links":{"citing_paper":"/paper/2504.12643"},"observation_digest":"sha256:8f2eb1a5360a9264af1b48cce4cebda4bfedff1ffb29815e768ddab3f1be0a17","observation_id":"2040c045-dc32-4e66-89bb-724a055d1808","resolution":{"observed_at":"2026-08-16T12:31:13.189385Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:31:13.168947Z","title":"Cape: Camera view position embedding for multi-view 3d object detection","venue":null,"work_id":"32739f51-dbbe-4714-adce-dcc1d08b945c","year":2023},"citing_paper":{"arxiv_id":"2504.12643","last_updated":"2025-06-06T08:55:27Z","snapshot_observed_at":"2026-08-22T05:08:58.036751Z","submitted_at":"2025-04-17T05:05:31Z","title":"RoPETR: Improving Temporal Camera-Only 3D Detection by Integrating Enhanced Rotary Position Embedding","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-16T12:31:13.027712Z"},"links":{"citing_paper":"/paper/2504.12643"},"observation_digest":"sha256:96a4a06a63b2082e372908624b51c3afea7463b8d654aaf4f6b6f95aa13e39e0","observation_id":"a4777d53-db04-4c46-9b5b-d02c4e96d1ff","resolution":{"observed_at":"2026-08-16T12:31:13.174620Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.03605","last_updated":"2022-07-11T10:30:29Z","snapshot_observed_at":"2026-08-18T07:50:02.322273Z","submitted_at":"2022-03-07T18:55:26Z","title":"DINO: DETR with Improved DeNoising Anchor Boxes for End-to-End Object Detection","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.03605","snapshot_observed_at":"2026-08-16T12:31:13.031248Z","title":"Dino: Detr with improved denoising anchor boxes for end-to-end object detection.arXiv preprint arXiv:2203.03605, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.12643","last_updated":"2025-06-06T08:55:27Z","snapshot_observed_at":"2026-08-22T05:08:58.036751Z","submitted_at":"2025-04-17T05:05:31Z","title":"RoPETR: Improving Temporal Camera-Only 3D Detection by Integrating Enhanced Rotary Position Embedding","version":3},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-16T12:31:13.031248Z"},"links":{"cited_paper":"/paper/2203.03605","citing_paper":"/paper/2504.12643"},"observation_digest":"sha256:aa501e4ccbee6147263fcc69713258da7989e03404ee897d29d69235b49a8f2d","observation_id":"d3eaa36a-d12c-4b38-bbb2-b313807620e6","resolution":{"observed_at":"2026-08-16T12:31:13.031248Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1908.09492","last_updated":"2019-08-26T06:27:01Z","snapshot_observed_at":"2026-08-21T15:32:01.283228Z","submitted_at":"2019-08-26T06:27:01Z","title":"Class-balanced Grouping and Sampling for Point Cloud 3D Object Detection","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1908.09492","snapshot_observed_at":"2026-08-16T12:31:13.035327Z","title":"Class-balanced grouping and sampling for point cloud 3d object detection.arXiv preprint arXiv:1908.09492, 2019","venue":null,"work_id":null,"year":1908},"citing_paper":{"arxiv_id":"2504.12643","last_updated":"2025-06-06T08:55:27Z","snapshot_observed_at":"2026-08-22T05:08:58.036751Z","submitted_at":"2025-04-17T05:05:31Z","title":"RoPETR: Improving Temporal Camera-Only 3D Detection by Integrating Enhanced Rotary Position Embedding","version":3},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-16T12:31:13.035327Z"},"links":{"cited_paper":"/paper/1908.09492","citing_paper":"/paper/2504.12643"},"observation_digest":"sha256:75a7d77bd0ee894227526f53d0cf5de2ccef1108302f5230f6b8f683aecf82a6","observation_id":"1285a2ac-a99b-4565-9bb6-da9b1bd61062","resolution":{"observed_at":"2026-08-16T12:31:13.035327Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.04159","last_updated":"2021-03-18T03:14:26Z","snapshot_observed_at":"2026-08-13T17:54:01.724774Z","submitted_at":"2020-10-08T17:59:21Z","title":"Deformable DETR: Deformable Transformers for End-to-End Object Detection","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.04159","snapshot_observed_at":"2026-08-16T12:31:13.039058Z","title":"Deformable detr: Deformable transformers for end-to-end object detection.arXiv preprint arXiv:2010.04159, 2020","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2504.12643","last_updated":"2025-06-06T08:55:27Z","snapshot_observed_at":"2026-08-22T05:08:58.036751Z","submitted_at":"2025-04-17T05:05:31Z","title":"RoPETR: Improving Temporal Camera-Only 3D Detection by Integrating Enhanced Rotary Position Embedding","version":3},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-16T12:31:13.039058Z"},"links":{"cited_paper":"/paper/2010.04159","citing_paper":"/paper/2504.12643"},"observation_digest":"sha256:1173d84fa1ced6786cfa24d073a1164c0a3fd3689e0956325c9106538204831e","observation_id":"aecf5d2a-f789-4ec2-971c-c21aaf1d3641","resolution":{"observed_at":"2026-08-16T12:31:13.039058Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2504.12643","last_updated":"2025-06-06T08:55:27Z","latest_version":3,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-22T05:08:58.036751Z","submitted_at":"2025-04-17T05:05:31Z","title":"RoPETR: Improving Temporal Camera-Only 3D Detection by Integrating Enhanced Rotary Position Embedding"},"reference_resolution":{"displayed":33,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":22,"verified_exact":0,"verified_fuzzy":11},"total_outbound_references":33},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"thesis":"As of 22 August 2026, this Paper Citation Record lists 33 of 33 outbound references and 4 inbound Pith citation observations for arXiv:2504.12643."}