{"as_of":"2026-08-08T18:55:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b64fddbc4ba5ed3e44fcf5cbd86e6f9af63356cbff9651bce04cca0cd84f6f05","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":39,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":39,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":39,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":39,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T10:27:09.618142Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-02T22:57:26.467411Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2203.17054","last_updated":"2022-06-16T09:44:08Z","snapshot_observed_at":"2026-07-06T12:55:16.868412Z","submitted_at":"2022-03-31T14:21:19Z","title":"BEVDet4D: Exploit Temporal Cues in Multi-camera 3D Object Detection","version":3},"cited_work":{"arxiv_id":"2203.17054","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2203.17054","snapshot_observed_at":"2026-07-02T22:57:26.467411Z","title":"In","venue":null,"work_id":"5cc5e399-47d4-43a4-ba7e-18e4a17a7bcb","year":2022},"citing_paper":{"arxiv_id":"2505.17732","last_updated":"2026-04-08T21:19:36Z","snapshot_observed_at":"2026-08-05T23:20:30.395593Z","submitted_at":"2025-05-23T10:52:34Z","title":"RQR3D: Reparametrizing the regression targets for BEV-based 3D object detection","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-19T13:42:03.676206Z"},"links":{"cited_paper":"/paper/2203.17054","citing_paper":"/paper/2505.17732"},"observation_digest":"sha256:f454ef91d56b6dbe5322089c051904a877f8b6cdd3998cccf54ade4852dcb10e","observation_id":"8890d705-0e20-4dc6-a034-30ac64eb493e","resolution":{"observed_at":"2026-05-19T13:42:19.192034Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.17054","last_updated":"2022-06-16T09:44:08Z","snapshot_observed_at":"2026-07-06T12:55:16.868412Z","submitted_at":"2022-03-31T14:21:19Z","title":"BEVDet4D: Exploit Temporal Cues in Multi-camera 3D Object Detection","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.17054","snapshot_observed_at":"2026-08-07T10:27:09.618142Z","title":"Bevdet4d: Exploit tempo- ral cues in multi-camera 3d object detection.arXiv preprint arXiv:/2203.17054, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.05473","last_updated":"2025-06-05T18:00:11Z","snapshot_observed_at":"2026-08-07T10:18:24.067035Z","submitted_at":"2025-06-05T18:00:11Z","title":"S2GO: Streaming Sparse Gaussian Occupancy Prediction","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T10:27:09.618142Z"},"links":{"cited_paper":"/paper/2203.17054","citing_paper":"/paper/2506.05473"},"observation_digest":"sha256:c059bdeab378c4e634a90f16cbfe51a9651df3f6ab49760a02b1bc746cc4d5a5","observation_id":"b7976c3c-add3-4e97-928a-0d782da86e59","resolution":{"observed_at":"2026-08-07T10:27:09.618142Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.17054","last_updated":"2022-06-16T09:44:08Z","snapshot_observed_at":"2026-07-06T12:55:16.868412Z","submitted_at":"2022-03-31T14:21:19Z","title":"BEVDet4D: Exploit Temporal Cues in Multi-camera 3D Object Detection","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.17054","snapshot_observed_at":"2026-08-07T04:35:23.660995Z","title":"Bevdet4d: Exploit tempo- ral cues in multi-camera 3d object detection","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.10242","last_updated":"2025-06-11T23:49:56Z","snapshot_observed_at":"2026-08-08T04:44:48.116605Z","submitted_at":"2025-06-11T23:49:56Z","title":"DySS: Dynamic Queries and State-Space Learning for Efficient 3D Object Detection from Multi-Camera Videos","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T04:35:23.660995Z"},"links":{"cited_paper":"/paper/2203.17054","citing_paper":"/paper/2506.10242"},"observation_digest":"sha256:3bcf0f4d807395723fe82088b7c0d220417db958a326851d825915e840f7b20e","observation_id":"0fabe1e0-660c-48a4-b6ff-2cceceddac60","resolution":{"observed_at":"2026-08-07T04:35:23.660995Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.17054","last_updated":"2022-06-16T09:44:08Z","snapshot_observed_at":"2026-07-06T12:55:16.868412Z","submitted_at":"2022-03-31T14:21:19Z","title":"BEVDet4D: Exploit Temporal Cues in Multi-camera 3D Object Detection","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.17054","snapshot_observed_at":"2026-08-06T21:42:17.901920Z","title":"Bevdet4d: Exploit tempo- ral cues in multi-camera 3d object detection","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.23565","last_updated":"2025-06-30T07:18:17Z","snapshot_observed_at":"2026-08-06T21:35:40.325751Z","submitted_at":"2025-06-30T07:18:17Z","title":"OcRFDet: Object-Centric Radiance Fields for Multi-View 3D Object Detection in Autonomous Driving","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T21:42:17.901920Z"},"links":{"cited_paper":"/paper/2203.17054","citing_paper":"/paper/2506.23565"},"observation_digest":"sha256:322165854791508bd7c98771e4e7a8211c20d1fc084c9d7fcecfff63131a9eed","observation_id":"ebcf1f09-43aa-4a9b-a37e-a50f4285e233","resolution":{"observed_at":"2026-08-06T21:42:17.901920Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.17054","last_updated":"2022-06-16T09:44:08Z","snapshot_observed_at":"2026-07-06T12:55:16.868412Z","submitted_at":"2022-03-31T14:21:19Z","title":"BEVDet4D: Exploit Temporal Cues in Multi-camera 3D Object Detection","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.17054","snapshot_observed_at":"2026-08-06T20:57:37.317659Z","title":"Huang and G","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.01397","last_updated":"2025-07-28T12:57:34Z","snapshot_observed_at":"2026-08-06T20:49:59.377882Z","submitted_at":"2025-07-02T06:26:17Z","title":"Coherent Online Road Topology Estimation and Reasoning with Standard-Definition Maps","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T20:57:37.317659Z"},"links":{"cited_paper":"/paper/2203.17054","citing_paper":"/paper/2507.01397"},"observation_digest":"sha256:f1c6e43c9716cdde9cbedc729400e4463321e3d8daea3505a94782c060ded2e3","observation_id":"10ae71cd-4009-4aea-bb65-9ea64ea79992","resolution":{"observed_at":"2026-08-06T20:57:37.317659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.17054","last_updated":"2022-06-16T09:44:08Z","snapshot_observed_at":"2026-07-06T12:55:16.868412Z","submitted_at":"2022-03-31T14:21:19Z","title":"BEVDet4D: Exploit Temporal Cues in Multi-camera 3D Object Detection","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.17054","snapshot_observed_at":"2026-08-06T18:17:12.640163Z","title":"Bevdet4d: Exploit temporal cues in multi- camera 3d object detection,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.08644","last_updated":"2025-07-11T14:48:59Z","snapshot_observed_at":"2026-08-06T18:11:30.114161Z","submitted_at":"2025-07-11T14:48:59Z","title":"OnlineBEV: Recurrent Temporal Fusion in Bird's Eye View Representations for Multi-Camera 3D Perception","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T18:17:12.640163Z"},"links":{"cited_paper":"/paper/2203.17054","citing_paper":"/paper/2507.08644"},"observation_digest":"sha256:c1ba5eab4b9e51b0c71327d8f780c6711fc26c54216054c86c687f63101b14ec","observation_id":"85ede152-4c04-4152-996b-13f239d0f802","resolution":{"observed_at":"2026-08-06T18:17:12.640163Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.17054","last_updated":"2022-06-16T09:44:08Z","snapshot_observed_at":"2026-07-06T12:55:16.868412Z","submitted_at":"2022-03-31T14:21:19Z","title":"BEVDet4D: Exploit Temporal Cues in Multi-camera 3D Object Detection","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.17054","snapshot_observed_at":"2026-08-06T18:06:06.368344Z","title":"Bevdet4d: Exploit temporal cues in multi- camera 3d object detection,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.09214","last_updated":"2025-08-19T07:26:24Z","snapshot_observed_at":"2026-08-08T02:57:22.520268Z","submitted_at":"2025-07-12T09:10:29Z","title":"Stereo-based 3D Anomaly Object Detection for Autonomous Driving: A New Dataset and Baseline","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T18:06:06.368344Z"},"links":{"cited_paper":"/paper/2203.17054","citing_paper":"/paper/2507.09214"},"observation_digest":"sha256:cdd71e874e92652d1033b4559a72dc2016c0d0f978e9ef059023a39c27cac4b0","observation_id":"87c0d22f-f53f-41d9-afbd-10063522f317","resolution":{"observed_at":"2026-08-06T18:06:06.368344Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.17054","last_updated":"2022-06-16T09:44:08Z","snapshot_observed_at":"2026-07-06T12:55:16.868412Z","submitted_at":"2022-03-31T14:21:19Z","title":"BEVDet4D: Exploit Temporal Cues in Multi-camera 3D Object Detection","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.17054","snapshot_observed_at":"2026-08-06T15:02:26.090384Z","title":"Bevdet4d: Exploit tempo- ral cues in multi-camera 3d object detection","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.17083","last_updated":"2025-07-22T23:49:40Z","snapshot_observed_at":"2026-08-06T14:54:50.526814Z","submitted_at":"2025-07-22T23:49:40Z","title":"SDGOCC: Semantic and Depth-Guided Bird's-Eye View Transformation for 3D Multimodal Occupancy Prediction","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:26.090384Z"},"links":{"cited_paper":"/paper/2203.17054","citing_paper":"/paper/2507.17083"},"observation_digest":"sha256:13f21fc9eb76099cb47e519ff2aba9e623e16e35ca31597c878c0bd5c4a03a35","observation_id":"1626483d-ab53-4bba-8454-6e01abd0501d","resolution":{"observed_at":"2026-08-06T15:02:26.090384Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.17054","last_updated":"2022-06-16T09:44:08Z","snapshot_observed_at":"2026-07-06T12:55:16.868412Z","submitted_at":"2022-03-31T14:21:19Z","title":"BEVDet4D: Exploit Temporal Cues in Multi-camera 3D Object Detection","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.17054","snapshot_observed_at":"2026-08-06T13:49:02.337985Z","title":"Bevdet4d: Exploit temporal cues in multi-camera 3d object detection","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.20217","last_updated":"2025-07-29T02:24:52Z","snapshot_observed_at":"2026-08-06T18:51:15.303728Z","submitted_at":"2025-07-27T10:47:00Z","title":"Humanoid Occupancy: Enabling A Generalized Multimodal Occupancy Perception System on Humanoid Robots","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T13:49:02.337985Z"},"links":{"cited_paper":"/paper/2203.17054","citing_paper":"/paper/2507.20217"},"observation_digest":"sha256:9b4f897b2ea3ed29dd808018e493e837411b3011f5bcd9c3ad014fa00af8e92f","observation_id":"9b07261d-d4e0-4cab-9cbf-826e984f2e9d","resolution":{"observed_at":"2026-08-06T13:49:02.337985Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.17054","last_updated":"2022-06-16T09:44:08Z","snapshot_observed_at":"2026-07-06T12:55:16.868412Z","submitted_at":"2022-03-31T14:21:19Z","title":"BEVDet4D: Exploit Temporal Cues in Multi-camera 3D Object Detection","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.17054","snapshot_observed_at":"2026-08-06T13:46:40.675283Z","title":"Bevdet4d: Exploit temporal cues in multi-camera 3d object detection","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.20224","last_updated":"2025-07-27T11:09:27Z","snapshot_observed_at":"2026-08-06T13:46:38.672903Z","submitted_at":"2025-07-27T11:09:27Z","title":"MambaMap: Online Vectorized HD Map Construction using State Space Model","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T13:46:40.675283Z"},"links":{"cited_paper":"/paper/2203.17054","citing_paper":"/paper/2507.20224"},"observation_digest":"sha256:adad635acd8c56d2de1b71d4a534f44380853307d899e20afcf99b36353c6db4","observation_id":"b1822f51-91e7-40cd-9c58-ec0ba4a54145","resolution":{"observed_at":"2026-08-06T13:46:40.675283Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.17054","last_updated":"2022-06-16T09:44:08Z","snapshot_observed_at":"2026-07-06T12:55:16.868412Z","submitted_at":"2022-03-31T14:21:19Z","title":"BEVDet4D: Exploit Temporal Cues in Multi-camera 3D Object Detection","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.17054","snapshot_observed_at":"2026-08-06T13:10:19.623400Z","title":"Bevdet4d: Exploit temporal cues in multi-camera 3d object detection,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.20963","last_updated":"2025-07-28T16:18:29Z","snapshot_observed_at":"2026-08-08T04:44:48.616625Z","submitted_at":"2025-07-28T16:18:29Z","title":"GTAD: Global Temporal Aggregation Denoising Learning for 3D Semantic Occupancy Prediction","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T13:10:19.623400Z"},"links":{"cited_paper":"/paper/2203.17054","citing_paper":"/paper/2507.20963"},"observation_digest":"sha256:ef09eb426d2845d5a8fa0fe7eaf365ef9c828af0e3731832162fbafeaaed2e11","observation_id":"c1a9020e-40b5-4820-a9cc-0f5bae69602c","resolution":{"observed_at":"2026-08-06T13:10:19.623400Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.17054","last_updated":"2022-06-16T09:44:08Z","snapshot_observed_at":"2026-07-06T12:55:16.868412Z","submitted_at":"2022-03-31T14:21:19Z","title":"BEVDet4D: Exploit Temporal Cues in Multi-camera 3D Object Detection","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.17054","snapshot_observed_at":"2026-08-06T12:56:39.607296Z","title":"Bevdet4d: Exploit temporal cues in multi- camera 3d object detection,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.21358","last_updated":"2025-08-03T22:46:43Z","snapshot_observed_at":"2026-08-08T13:43:37.629989Z","submitted_at":"2025-07-28T21:56:43Z","title":"Collaborative Perceiver: Elevating Vision-based 3D Object Detection via Local Density-Aware Spatial Occupancy","version":4},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T12:56:39.607296Z"},"links":{"cited_paper":"/paper/2203.17054","citing_paper":"/paper/2507.21358"},"observation_digest":"sha256:3a1c94c16451cff411f1c3b2eb9c0dfcffbac60160dfcf05257b11b24e47e684","observation_id":"59b3930e-5851-4035-a5c6-46ec339b2804","resolution":{"observed_at":"2026-08-06T12:56:39.607296Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.17054","last_updated":"2022-06-16T09:44:08Z","snapshot_observed_at":"2026-07-06T12:55:16.868412Z","submitted_at":"2022-03-31T14:21:19Z","title":"BEVDet4D: Exploit Temporal Cues in Multi-camera 3D Object Detection","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.17054","snapshot_observed_at":"2026-08-06T10:15:57.120743Z","title":"Bevdet4d: Exploit tempo- ral cues in multi-camera 3d object detection","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.00359","last_updated":"2025-08-01T06:45:12Z","snapshot_observed_at":"2026-08-06T10:15:55.398532Z","submitted_at":"2025-08-01T06:45:12Z","title":"CoST: Efficient Collaborative Perception From Unified Spatiotemporal Perspective","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T10:15:57.120743Z"},"links":{"cited_paper":"/paper/2203.17054","citing_paper":"/paper/2508.00359"},"observation_digest":"sha256:7d0530e773e7669d9dc7e14286b5d5481614446113f04347ef36a60b485b5677","observation_id":"cb059e11-1aee-4f79-a00d-e0d25d2cef96","resolution":{"observed_at":"2026-08-06T10:15:57.120743Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.17054","last_updated":"2022-06-16T09:44:08Z","snapshot_observed_at":"2026-07-06T12:55:16.868412Z","submitted_at":"2022-03-31T14:21:19Z","title":"BEVDet4D: Exploit Temporal Cues in Multi-camera 3D Object Detection","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.17054","snapshot_observed_at":"2026-08-05T23:50:10.517234Z","title":"Bevdet4d: Exploit temporal cues in multi- camera 3d object detection,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.04696","last_updated":"2025-08-06T17:57:58Z","snapshot_observed_at":"2026-08-07T23:22:21.667628Z","submitted_at":"2025-08-06T17:57:58Z","title":"Achieving Precise and Reliable Locomotion with Differentiable Simulation-Based System Identification","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-05T23:50:10.517234Z"},"links":{"cited_paper":"/paper/2203.17054","citing_paper":"/paper/2508.04696"},"observation_digest":"sha256:33fb7f5b5badf281d2a37377462aaa9398d6f79bb76316db23c52676e1d5b4de","observation_id":"e4f6aed5-2e3d-4895-a9c1-2191e7ca27b2","resolution":{"observed_at":"2026-08-05T23:50:10.517234Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.17054","last_updated":"2022-06-16T09:44:08Z","snapshot_observed_at":"2026-07-06T12:55:16.868412Z","submitted_at":"2022-03-31T14:21:19Z","title":"BEVDet4D: Exploit Temporal Cues in Multi-camera 3D Object Detection","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.17054","snapshot_observed_at":"2026-08-05T23:53:11.708615Z","title":"Bevdet4d: Exploit temporal cues in multi- camera 3d object detection,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.04702","last_updated":"2025-08-06T17:59:37Z","snapshot_observed_at":"2026-08-08T12:41:28.737292Z","submitted_at":"2025-08-06T17:59:37Z","title":"BEVCon: Advancing Bird's Eye View Perception with Contrastive Learning","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-05T23:53:11.708615Z"},"links":{"cited_paper":"/paper/2203.17054","citing_paper":"/paper/2508.04702"},"observation_digest":"sha256:2cdcf1badd519b2673c8551ab8d6ef1455adbe34bdcb8e89111977983345b2cd","observation_id":"bc63eeae-ee63-4f84-babf-efa83278935c","resolution":{"observed_at":"2026-08-05T23:53:11.708615Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.17054","last_updated":"2022-06-16T09:44:08Z","snapshot_observed_at":"2026-07-06T12:55:16.868412Z","submitted_at":"2022-03-31T14:21:19Z","title":"BEVDet4D: Exploit Temporal Cues in Multi-camera 3D Object Detection","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.17054","snapshot_observed_at":"2026-08-05T23:51:19.368461Z","title":"Bevdet4d: Exploit temporal cues in multi-camera 3d object detection","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.04705","last_updated":"2025-08-06T17:59:52Z","snapshot_observed_at":"2026-08-08T04:44:47.310441Z","submitted_at":"2025-08-06T17:59:52Z","title":"Occupancy Learning with Spatiotemporal Memory","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-05T23:51:19.368461Z"},"links":{"cited_paper":"/paper/2203.17054","citing_paper":"/paper/2508.04705"},"observation_digest":"sha256:c2676e8f2cf7bd52caa47ea79ad40c7443be44c6cbc6bb043078d138c6f58481","observation_id":"78d68892-603d-4433-8161-3bc79b45bdf2","resolution":{"observed_at":"2026-08-05T23:51:19.368461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.17054","last_updated":"2022-06-16T09:44:08Z","snapshot_observed_at":"2026-07-06T12:55:16.868412Z","submitted_at":"2022-03-31T14:21:19Z","title":"BEVDet4D: Exploit Temporal Cues in Multi-camera 3D Object Detection","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.17054","snapshot_observed_at":"2026-08-05T22:06:49.694862Z","title":"arXiv preprint arXiv:2203.17054 (2022)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.07560","last_updated":"2025-08-11T02:40:46Z","snapshot_observed_at":"2026-08-07T04:31:51.628723Z","submitted_at":"2025-08-11T02:40:46Z","title":"Progressive Bird's Eye View Perception for Safety-Critical Autonomous Driving: A Comprehensive Survey","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-05T22:06:49.694862Z"},"links":{"cited_paper":"/paper/2203.17054","citing_paper":"/paper/2508.07560"},"observation_digest":"sha256:35bffd5f1e75845c8fedd1efe6df35b3728b4cf62dbf954b5b2ac3aa80e250eb","observation_id":"c7583e36-205d-4000-9082-99aa78d219b4","resolution":{"observed_at":"2026-08-05T22:06:49.694862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.17054","last_updated":"2022-06-16T09:44:08Z","snapshot_observed_at":"2026-07-06T12:55:16.868412Z","submitted_at":"2022-03-31T14:21:19Z","title":"BEVDet4D: Exploit Temporal Cues in Multi-camera 3D Object Detection","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.17054","snapshot_observed_at":"2026-08-05T19:23:16.568675Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.12684","last_updated":"2025-08-18T07:37:14Z","snapshot_observed_at":"2026-08-05T19:23:06.131671Z","submitted_at":"2025-08-18T07:37:14Z","title":"Refine-and-Contrast: Adaptive Instance-Aware BEV Representations for Multi-UAV Collaborative Object Detection","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-05T19:23:16.568675Z"},"links":{"cited_paper":"/paper/2203.17054","citing_paper":"/paper/2508.12684"},"observation_digest":"sha256:95116a74da592f3e00cadefea9b251b55434a0dc77cbb170c353e21f90fc02e6","observation_id":"17ca58bc-2274-4db5-b58c-38f610885cdd","resolution":{"observed_at":"2026-08-05T19:23:16.568675Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.17054","last_updated":"2022-06-16T09:44:08Z","snapshot_observed_at":"2026-07-06T12:55:16.868412Z","submitted_at":"2022-03-31T14:21:19Z","title":"BEVDet4D: Exploit Temporal Cues in Multi-camera 3D Object Detection","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.17054","snapshot_observed_at":"2026-08-05T10:31:52.089443Z","title":"CoRR abs/2203.17054 (2022)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.03999","last_updated":"2025-09-04T08:27:54Z","snapshot_observed_at":"2026-08-05T10:31:50.987692Z","submitted_at":"2025-09-04T08:27:54Z","title":"SliceSemOcc: Vertical Slice Based Multimodal 3D Semantic Occupancy Representation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T10:31:52.089443Z"},"links":{"cited_paper":"/paper/2203.17054","citing_paper":"/paper/2509.03999"},"observation_digest":"sha256:ee7072abc4b1f15b699a7a61b2519cb130f8393ef03440a46ca011ac46f5b0ef","observation_id":"295c045b-5794-479e-bc60-63612ad267d3","resolution":{"observed_at":"2026-08-05T10:31:52.089443Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.17054","last_updated":"2022-06-16T09:44:08Z","snapshot_observed_at":"2026-07-06T12:55:16.868412Z","submitted_at":"2022-03-31T14:21:19Z","title":"BEVDet4D: Exploit Temporal Cues in Multi-camera 3D Object Detection","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.17054","snapshot_observed_at":"2026-08-04T20:48:55.880088Z","title":"Bevdet4d: Exploit tempo- ral cues in multi-camera 3d object detection.arXiv preprint arXiv:2203.17054, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.08388","last_updated":"2025-09-10T08:29:22Z","snapshot_observed_at":"2026-08-04T20:48:53.241357Z","submitted_at":"2025-09-10T08:29:22Z","title":"Semantic Causality-Aware Vision-Based 3D Occupancy Prediction","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-04T20:48:55.880088Z"},"links":{"cited_paper":"/paper/2203.17054","citing_paper":"/paper/2509.08388"},"observation_digest":"sha256:331fc16eae53ae0154cfd8512fd67f91a203ed2b1c6b7cb3dd5798407fb46718","observation_id":"f8767f04-c054-408f-aea1-c1aaad7cb360","resolution":{"observed_at":"2026-08-04T20:48:55.880088Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.17054","last_updated":"2022-06-16T09:44:08Z","snapshot_observed_at":"2026-07-06T12:55:16.868412Z","submitted_at":"2022-03-31T14:21:19Z","title":"BEVDet4D: Exploit Temporal Cues in Multi-camera 3D Object Detection","version":3},"cited_work":{"arxiv_id":"2203.17054","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2203.17054","snapshot_observed_at":"2026-07-02T22:57:26.467411Z","title":"In","venue":null,"work_id":"5cc5e399-47d4-43a4-ba7e-18e4a17a7bcb","year":2022},"citing_paper":{"arxiv_id":"2512.08237","last_updated":"2026-05-19T02:33:35Z","snapshot_observed_at":"2026-08-03T18:47:31.399133Z","submitted_at":"2025-12-09T04:37:46Z","title":"Fast-BEV++: Fast by Algorithm, Deployable by Design","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-21T18:42:37.182403Z"},"links":{"cited_paper":"/paper/2203.17054","citing_paper":"/paper/2512.08237"},"observation_digest":"sha256:e7a38d403d1d23938e98972d6cad9a85d89a5b007674785dc28d7a32fbbfcef9","observation_id":"11f064bc-2e4f-4e1c-a241-c775aa5d2392","resolution":{"observed_at":"2026-05-21T18:44:18.878388Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.17054","last_updated":"2022-06-16T09:44:08Z","snapshot_observed_at":"2026-07-06T12:55:16.868412Z","submitted_at":"2022-03-31T14:21:19Z","title":"BEVDet4D: Exploit Temporal Cues in Multi-camera 3D Object Detection","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.17054","snapshot_observed_at":"2026-08-02T20:31:09.417456Z","title":"BEVDet4D: Exploit temporal cues in multi- camera 3D object detection,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2602.23172","last_updated":"2026-06-18T17:46:09Z","snapshot_observed_at":"2026-08-02T20:31:05.364767Z","submitted_at":"2026-02-26T16:34:49Z","title":"Latent Gaussian Splatting for 4D Panoptic Occupancy Tracking","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-02T20:31:09.417456Z"},"links":{"cited_paper":"/paper/2203.17054","citing_paper":"/paper/2602.23172"},"observation_digest":"sha256:08fdd5f6b1f9f2ec42439bac8054ad227ccde93755bd867f23d1e5404959f440","observation_id":"dd7b1934-3133-4fdd-8de2-963aacc2db86","resolution":{"observed_at":"2026-08-02T20:31:09.417456Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.17054","last_updated":"2022-06-16T09:44:08Z","snapshot_observed_at":"2026-07-06T12:55:16.868412Z","submitted_at":"2022-03-31T14:21:19Z","title":"BEVDet4D: Exploit Temporal Cues in Multi-camera 3D Object Detection","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.17054","snapshot_observed_at":"2026-08-02T20:21:28.661125Z","title":"Bevdet4d: Exploit tempo- ral cues in multi-camera 3d object detection.arXiv preprint arXiv:2203.17054, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2602.23499","last_updated":"2026-06-09T07:27:50Z","snapshot_observed_at":"2026-08-06T08:18:27.268856Z","submitted_at":"2026-02-26T21:16:20Z","title":"TaCarla: A comprehensive benchmarking dataset for end-to-end autonomous driving","version":4},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-02T20:21:28.661125Z"},"links":{"cited_paper":"/paper/2203.17054","citing_paper":"/paper/2602.23499"},"observation_digest":"sha256:ed3e5fe7626b80c7ebd71a9cd08a85b2a94c9353b0e19a129f7f8f06cd9d18db","observation_id":"77b4256c-e00b-400c-a45f-d6bde4094ff2","resolution":{"observed_at":"2026-08-02T20:21:28.661125Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.17054","last_updated":"2022-06-16T09:44:08Z","snapshot_observed_at":"2026-07-06T12:55:16.868412Z","submitted_at":"2022-03-31T14:21:19Z","title":"BEVDet4D: Exploit Temporal Cues in Multi-camera 3D Object Detection","version":3},"cited_work":{"arxiv_id":"2203.17054","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2203.17054","snapshot_observed_at":"2026-07-02T22:57:26.467411Z","title":"In","venue":null,"work_id":"5cc5e399-47d4-43a4-ba7e-18e4a17a7bcb","year":2022},"citing_paper":{"arxiv_id":"2604.02930","last_updated":"2026-04-03T09:58:42Z","snapshot_observed_at":"2026-07-06T22:52:10.923214Z","submitted_at":"2026-04-03T09:58:42Z","title":"BEVPredFormer: Spatio-temporal Attention for BEV Instance Prediction in Autonomous Driving","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-13T20:00:21.130075Z"},"links":{"cited_paper":"/paper/2203.17054","citing_paper":"/paper/2604.02930"},"observation_digest":"sha256:db62303b423d0e78d0891e4d9627a4c9fcd00cd87fa88fdbd91388c40d59916d","observation_id":"90f4d2a0-1ca7-47da-9f9b-a7acaf415e0c","resolution":{"observed_at":"2026-05-13T20:03:12.421418Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.17054","last_updated":"2022-06-16T09:44:08Z","snapshot_observed_at":"2026-07-06T12:55:16.868412Z","submitted_at":"2022-03-31T14:21:19Z","title":"BEVDet4D: Exploit Temporal Cues in Multi-camera 3D Object Detection","version":3},"cited_work":{"arxiv_id":"2203.17054","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2203.17054","snapshot_observed_at":"2026-07-02T22:57:26.467411Z","title":"In","venue":null,"work_id":"5cc5e399-47d4-43a4-ba7e-18e4a17a7bcb","year":2022},"citing_paper":{"arxiv_id":"2604.04797","last_updated":"2026-04-06T16:03:21Z","snapshot_observed_at":"2026-07-06T22:53:41.734429Z","submitted_at":"2026-04-06T16:03:21Z","title":"Multi-Modal Sensor Fusion using Hybrid Attention for Autonomous Driving","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-10T18:43:52.542973Z"},"links":{"cited_paper":"/paper/2203.17054","citing_paper":"/paper/2604.04797"},"observation_digest":"sha256:7387ebd830852e3b72681d7d63d7edcd996c8966a2b6506a46ac58ac443e9a3d","observation_id":"898eeb3c-cdb8-4a89-b8b4-ff77aa335108","resolution":{"observed_at":"2026-05-11T00:00:56.827152Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.17054","last_updated":"2022-06-16T09:44:08Z","snapshot_observed_at":"2026-07-06T12:55:16.868412Z","submitted_at":"2022-03-31T14:21:19Z","title":"BEVDet4D: Exploit Temporal Cues in Multi-camera 3D Object Detection","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.17054","snapshot_observed_at":"2026-07-15T11:39:16.503017Z","title":"arXiv preprint arXiv:2203.17054 (2022)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2604.05447","last_updated":"2026-07-14T14:29:09Z","snapshot_observed_at":"2026-08-02T21:17:28.989539Z","submitted_at":"2026-04-07T05:31:51Z","title":"Kerr-Schild Double Copy of the Randall-Sundrum Black String","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-15T11:39:16.503017Z"},"links":{"cited_paper":"/paper/2203.17054","citing_paper":"/paper/2604.05447"},"observation_digest":"sha256:704a2ff6ca0947b20a49c75c737a9ba7ed20248dbe8364c10cfc3d077fdf0ca9","observation_id":"4237b1da-8769-4cdb-8105-30a5567f00d2","resolution":{"observed_at":"2026-07-15T11:39:16.503017Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.17054","last_updated":"2022-06-16T09:44:08Z","snapshot_observed_at":"2026-07-06T12:55:16.868412Z","submitted_at":"2022-03-31T14:21:19Z","title":"BEVDet4D: Exploit Temporal Cues in Multi-camera 3D Object Detection","version":3},"cited_work":{"arxiv_id":"2203.17054","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2203.17054","snapshot_observed_at":"2026-07-02T22:57:26.467411Z","title":"In","venue":null,"work_id":"5cc5e399-47d4-43a4-ba7e-18e4a17a7bcb","year":2022},"citing_paper":{"arxiv_id":"2604.05449","last_updated":"2026-04-07T05:33:54Z","snapshot_observed_at":"2026-08-02T13:37:32.642986Z","submitted_at":"2026-04-07T05:33:54Z","title":"Not All Agents Matter: From Global Attention Dilution to Risk-Prioritized Game Planning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-10T18:50:48.512471Z"},"links":{"cited_paper":"/paper/2203.17054","citing_paper":"/paper/2604.05449"},"observation_digest":"sha256:12c99c830f689ecf867bcdaee9479f966ef74c1e0faa4025c941468db081a6da","observation_id":"1c070cf3-58f7-4b9a-bce0-186efcf7a60c","resolution":{"observed_at":"2026-05-10T23:50:54.275864Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.17054","last_updated":"2022-06-16T09:44:08Z","snapshot_observed_at":"2026-07-06T12:55:16.868412Z","submitted_at":"2022-03-31T14:21:19Z","title":"BEVDet4D: Exploit Temporal Cues in Multi-camera 3D Object Detection","version":3},"cited_work":{"arxiv_id":"2203.17054","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2203.17054","snapshot_observed_at":"2026-07-02T22:57:26.467411Z","title":"In","venue":null,"work_id":"5cc5e399-47d4-43a4-ba7e-18e4a17a7bcb","year":2022},"citing_paper":{"arxiv_id":"2604.14563","last_updated":"2026-04-16T02:46:53Z","snapshot_observed_at":"2026-07-06T23:02:18.425249Z","submitted_at":"2026-04-16T02:46:53Z","title":"Revisiting Token Compression for Accelerating ViT-based Sparse Multi-View 3D Object Detectors","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-10T11:31:52.126027Z"},"links":{"cited_paper":"/paper/2203.17054","citing_paper":"/paper/2604.14563"},"observation_digest":"sha256:c269c3168674167b3543e1f804418372d2eea0686fefc629ebbd6eafa6a11a17","observation_id":"0d973f6e-5e32-4795-93b8-9e6386a707ed","resolution":{"observed_at":"2026-05-10T11:35:18.971841Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.17054","last_updated":"2022-06-16T09:44:08Z","snapshot_observed_at":"2026-07-06T12:55:16.868412Z","submitted_at":"2022-03-31T14:21:19Z","title":"BEVDet4D: Exploit Temporal Cues in Multi-camera 3D Object Detection","version":3},"cited_work":{"arxiv_id":"2203.17054","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2203.17054","snapshot_observed_at":"2026-07-02T22:57:26.467411Z","title":"In","venue":null,"work_id":"5cc5e399-47d4-43a4-ba7e-18e4a17a7bcb","year":2022},"citing_paper":{"arxiv_id":"2604.17024","last_updated":"2026-04-18T15:14:11Z","snapshot_observed_at":"2026-08-02T11:14:25.634881Z","submitted_at":"2026-04-18T15:14:11Z","title":"CAM3DNet: Comprehensively mining the multi-scale features for 3D Object Detection with Multi-View Cameras","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-10T07:16:33.640040Z"},"links":{"cited_paper":"/paper/2203.17054","citing_paper":"/paper/2604.17024"},"observation_digest":"sha256:28b922d48d0dd00584380aa2eba7606adc761bea3355af47b184a99ef04a9d8b","observation_id":"eb24cb94-0ef5-49c6-b307-71b7c1154546","resolution":{"observed_at":"2026-05-10T07:16:54.754489Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.17054","last_updated":"2022-06-16T09:44:08Z","snapshot_observed_at":"2026-07-06T12:55:16.868412Z","submitted_at":"2022-03-31T14:21:19Z","title":"BEVDet4D: Exploit Temporal Cues in Multi-camera 3D Object Detection","version":3},"cited_work":{"arxiv_id":"2203.17054","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2203.17054","snapshot_observed_at":"2026-07-02T22:57:26.467411Z","title":"In","venue":null,"work_id":"5cc5e399-47d4-43a4-ba7e-18e4a17a7bcb","year":2022},"citing_paper":{"arxiv_id":"2604.18476","last_updated":"2026-04-20T16:28:01Z","snapshot_observed_at":"2026-08-03T00:20:08.083629Z","submitted_at":"2026-04-20T16:28:01Z","title":"SemLT3D: Semantic-Guided Expert Distillation for Camera-only Long-Tailed 3D Object Detection","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-10T05:53:11.157832Z"},"links":{"cited_paper":"/paper/2203.17054","citing_paper":"/paper/2604.18476"},"observation_digest":"sha256:f39c4bdff95372d8b3df2a4cd41bbfc2d3b47a8f3271d0bfc65bd3d8313b85ea","observation_id":"84742f9e-34e9-41f7-af52-a92753164701","resolution":{"observed_at":"2026-05-10T05:56:11.182187Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.17054","last_updated":"2022-06-16T09:44:08Z","snapshot_observed_at":"2026-07-06T12:55:16.868412Z","submitted_at":"2022-03-31T14:21:19Z","title":"BEVDet4D: Exploit Temporal Cues in Multi-camera 3D Object Detection","version":3},"cited_work":{"arxiv_id":"2203.17054","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2203.17054","snapshot_observed_at":"2026-07-02T22:57:26.467411Z","title":"In","venue":null,"work_id":"5cc5e399-47d4-43a4-ba7e-18e4a17a7bcb","year":2022},"citing_paper":{"arxiv_id":"2605.01924","last_updated":"2026-05-03T15:10:38Z","snapshot_observed_at":"2026-07-06T23:15:07.159340Z","submitted_at":"2026-05-03T15:10:38Z","title":"SimPB++: Simultaneously Detecting 2D and 3D Objects from Multiple Cameras","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-09T17:22:01.467937Z"},"links":{"cited_paper":"/paper/2203.17054","citing_paper":"/paper/2605.01924"},"observation_digest":"sha256:2cb9a10e6b512f66c863c2a0409c92b36ff0220eec1926b0618c109edc499a5f","observation_id":"718e5ec5-7f3f-4b6c-8930-462e5938dc0c","resolution":{"observed_at":"2026-05-11T16:21:07.804426Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.17054","last_updated":"2022-06-16T09:44:08Z","snapshot_observed_at":"2026-07-06T12:55:16.868412Z","submitted_at":"2022-03-31T14:21:19Z","title":"BEVDet4D: Exploit Temporal Cues in Multi-camera 3D Object Detection","version":3},"cited_work":{"arxiv_id":"2203.17054","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2203.17054","snapshot_observed_at":"2026-07-02T22:57:26.467411Z","title":"In","venue":null,"work_id":"5cc5e399-47d4-43a4-ba7e-18e4a17a7bcb","year":2022},"citing_paper":{"arxiv_id":"2605.12218","last_updated":"2026-06-23T16:43:57Z","snapshot_observed_at":"2026-07-06T23:23:59.123377Z","submitted_at":"2026-05-12T14:55:32Z","title":"Learning Ego-Centric BEV Representations from a Perspective-Privileged View: Cross-View Supervision for Online HD Map Construction","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-13T06:43:43.368458Z"},"links":{"cited_paper":"/paper/2203.17054","citing_paper":"/paper/2605.12218"},"observation_digest":"sha256:c4bcbc50b1ca510c2994afa6dd567862a31d598836f6af19045807b92c6aec91","observation_id":"c6bf9f85-bda2-4d0f-ab00-bc20423524b6","resolution":{"observed_at":"2026-05-13T06:47:27.429764Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.17054","last_updated":"2022-06-16T09:44:08Z","snapshot_observed_at":"2026-07-06T12:55:16.868412Z","submitted_at":"2022-03-31T14:21:19Z","title":"BEVDet4D: Exploit Temporal Cues in Multi-camera 3D Object Detection","version":3},"cited_work":{"arxiv_id":"2203.17054","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2203.17054","snapshot_observed_at":"2026-07-02T22:57:26.467411Z","title":"In","venue":null,"work_id":"5cc5e399-47d4-43a4-ba7e-18e4a17a7bcb","year":2022},"citing_paper":{"arxiv_id":"2605.12218","last_updated":"2026-06-23T16:43:57Z","snapshot_observed_at":"2026-07-06T23:23:59.123377Z","submitted_at":"2026-05-12T14:55:32Z","title":"Learning Ego-Centric BEV Representations from a Perspective-Privileged View: Cross-View Supervision for Online HD Map Construction","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-30T22:24:43.568498Z"},"links":{"cited_paper":"/paper/2203.17054","citing_paper":"/paper/2605.12218"},"observation_digest":"sha256:306c40dcc410493e2d9c419932481f63e3ca682a7dce17d035510fa2d106615a","observation_id":"b0e463c0-acb6-48c6-8835-2186dcfd3630","resolution":{"observed_at":"2026-06-30T22:25:06.738475Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.17054","last_updated":"2022-06-16T09:44:08Z","snapshot_observed_at":"2026-07-06T12:55:16.868412Z","submitted_at":"2022-03-31T14:21:19Z","title":"BEVDet4D: Exploit Temporal Cues in Multi-camera 3D Object Detection","version":3},"cited_work":{"arxiv_id":"2203.17054","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2203.17054","snapshot_observed_at":"2026-07-02T22:57:26.467411Z","title":"In","venue":null,"work_id":"5cc5e399-47d4-43a4-ba7e-18e4a17a7bcb","year":2022},"citing_paper":{"arxiv_id":"2606.08680","last_updated":"2026-06-07T15:32:10Z","snapshot_observed_at":"2026-08-07T09:46:13.197765Z","submitted_at":"2026-06-07T15:32:10Z","title":"Distortion-Aware PETR for BEV Object Detection with Mixed Pinhole-Fisheye Cameras","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-27T18:32:39.515923Z"},"links":{"cited_paper":"/paper/2203.17054","citing_paper":"/paper/2606.08680"},"observation_digest":"sha256:07cf585646986fa393939bc36a4fdd329627495161ab35261ec0136526976b79","observation_id":"154c6c02-dd51-4aed-843b-5a07b8d65315","resolution":{"observed_at":"2026-07-02T22:57:26.468940Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.17054","last_updated":"2022-06-16T09:44:08Z","snapshot_observed_at":"2026-07-06T12:55:16.868412Z","submitted_at":"2022-03-31T14:21:19Z","title":"BEVDet4D: Exploit Temporal Cues in Multi-camera 3D Object Detection","version":3},"cited_work":{"arxiv_id":"2203.17054","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2203.17054","snapshot_observed_at":"2026-07-02T22:57:26.467411Z","title":"In","venue":null,"work_id":"5cc5e399-47d4-43a4-ba7e-18e4a17a7bcb","year":2022},"citing_paper":{"arxiv_id":"2606.30754","last_updated":"2026-06-29T18:00:42Z","snapshot_observed_at":"2026-08-02T04:01:57.680474Z","submitted_at":"2026-06-29T18:00:42Z","title":"Streaming Gaussian Encoding for 4D Panoptic Occupancy Tracking","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-01T06:28:47.232989Z"},"links":{"cited_paper":"/paper/2203.17054","citing_paper":"/paper/2606.30754"},"observation_digest":"sha256:cbad972914a862be289e95be11ad715a81a76fa632daed7119c24fda9c520fc5","observation_id":"28f76f7f-1339-4ac5-bf0a-bdc58c86ef18","resolution":{"observed_at":"2026-07-01T09:35:39.835819Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.17054","last_updated":"2022-06-16T09:44:08Z","snapshot_observed_at":"2026-07-06T12:55:16.868412Z","submitted_at":"2022-03-31T14:21:19Z","title":"BEVDet4D: Exploit Temporal Cues in Multi-camera 3D Object Detection","version":3},"cited_work":{"arxiv_id":"2203.17054","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2203.17054","snapshot_observed_at":"2026-07-02T22:57:26.467411Z","title":"In","venue":null,"work_id":"5cc5e399-47d4-43a4-ba7e-18e4a17a7bcb","year":2022},"citing_paper":{"arxiv_id":"2607.00746","last_updated":"2026-07-01T10:28:15Z","snapshot_observed_at":"2026-08-07T08:58:21.795085Z","submitted_at":"2026-07-01T10:28:15Z","title":"GaussianFusion: Unified 3D Gaussian Representation for Multi-Modal Fusion Perception","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-02T14:29:03.775107Z"},"links":{"cited_paper":"/paper/2203.17054","citing_paper":"/paper/2607.00746"},"observation_digest":"sha256:d74b34c04d5166b8ff01f7f805e9579059763715897d81c64189b7b919d3e182","observation_id":"9e318ac0-4c2c-42fa-a8a8-f4ff66054f2f","resolution":{"observed_at":"2026-07-02T14:37:03.163337Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.17054","last_updated":"2022-06-16T09:44:08Z","snapshot_observed_at":"2026-07-06T12:55:16.868412Z","submitted_at":"2022-03-31T14:21:19Z","title":"BEVDet4D: Exploit Temporal Cues in Multi-camera 3D Object Detection","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.17054","snapshot_observed_at":"2026-07-11T23:42:57.473601Z","title":"arXiv preprint arXiv:2203.17054 (2022)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.03822","last_updated":"2026-07-04T11:12:42Z","snapshot_observed_at":"2026-08-07T06:37:45.335496Z","submitted_at":"2026-07-04T11:12:42Z","title":"FDR-Occ: Factorized Dense Routing for Full-Spectrum 3D Occupancy Prediction","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-11T23:42:57.473601Z"},"links":{"cited_paper":"/paper/2203.17054","citing_paper":"/paper/2607.03822"},"observation_digest":"sha256:fcafc95c00f64211b4db93516fcef93de43d9c026475da5f2c329279c2124522","observation_id":"74a501ec-7800-463c-96a9-043e409f705a","resolution":{"observed_at":"2026-07-11T23:42:57.473601Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.17054","last_updated":"2022-06-16T09:44:08Z","snapshot_observed_at":"2026-07-06T12:55:16.868412Z","submitted_at":"2022-03-31T14:21:19Z","title":"BEVDet4D: Exploit Temporal Cues in Multi-camera 3D Object Detection","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.17054","snapshot_observed_at":"2026-08-01T09:00:04.359824Z","title":"arxiv 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.20947","last_updated":"2026-07-23T05:56:42Z","snapshot_observed_at":"2026-08-02T15:11:59.322052Z","submitted_at":"2026-07-23T05:56:42Z","title":"RECO: Region-Aware Compensation for Extrinsic Perturbations in Roadside 3D Detection","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-01T09:00:04.359824Z"},"links":{"cited_paper":"/paper/2203.17054","citing_paper":"/paper/2607.20947"},"observation_digest":"sha256:6c30678157cb64253e528e0ab62a66cff405f60a3dcdec176b4fed4bfe210e4e","observation_id":"c023a5b5-bcf6-4cb1-86ef-0f1b30c56280","resolution":{"observed_at":"2026-08-01T09:00:04.359824Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.17054","last_updated":"2022-06-16T09:44:08Z","snapshot_observed_at":"2026-07-06T12:55:16.868412Z","submitted_at":"2022-03-31T14:21:19Z","title":"BEVDet4D: Exploit Temporal Cues in Multi-camera 3D Object Detection","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.17054","snapshot_observed_at":"2026-07-30T20:32:28.512306Z","title":"arXiv preprint arXiv:2203.17054 (2022)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.23511","last_updated":"2026-07-26T07:20:57Z","snapshot_observed_at":"2026-08-07T10:31:03.611159Z","submitted_at":"2026-07-26T07:20:57Z","title":"MOJITO: Modal Joint Learning for Unified End-to-End Autonomous Driving","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-30T20:32:28.512306Z"},"links":{"cited_paper":"/paper/2203.17054","citing_paper":"/paper/2607.23511"},"observation_digest":"sha256:d11f9832551319e6be6da65773bfce8f51be0100c5f2e5163478a4ff2afae198","observation_id":"10dafbcf-c168-43d9-b0f2-54a9eba7b58e","resolution":{"observed_at":"2026-07-30T20:32:28.512306Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2203.17054/citation-record","integrity":"/paper/2203.17054/integrity","json":"/paper/2203.17054/citation-record.json","paper":"/paper/2203.17054"},"outbound":[],"paper":{"arxiv_id":"2203.17054","last_updated":"2022-06-16T09:44:08Z","latest_version":3,"primary_category":"cs.CV","snapshot_observed_at":"2026-07-06T12:55:16.868412Z","submitted_at":"2022-03-31T14:21:19Z","title":"BEVDet4D: Exploit Temporal Cues in Multi-camera 3D Object Detection"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 39 inbound Pith citation observations for arXiv:2203.17054."}