{"as_of":"2026-08-08T23:51:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3d60cb9b494c80eb7c469f3f7b715c6b99064ce611bc7c2da2c689efe5338742","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":35,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":35,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":35,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":35,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:12:10.063951Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":30,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2211.10581","last_updated":"2023-02-10T05:47:05Z","snapshot_observed_at":"2026-08-04T03:55:53.443868Z","submitted_at":"2022-11-19T04:20:57Z","title":"Sparse4D: Multi-view 3D Object Detection with Sparse Spatial-Temporal Fusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.10581","snapshot_observed_at":"2026-08-07T14:12:10.063951Z","title":"Sparse4d: Multi-view 3d object detection with sparse spatial-temporal fusion","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.19692","last_updated":"2025-05-26T08:50:15Z","snapshot_observed_at":"2026-08-07T14:05:44.925001Z","submitted_at":"2025-05-26T08:50:15Z","title":"DriveCamSim: Generalizable Camera Simulation via Explicit Camera Modeling for Autonomous Driving","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T14:12:10.063951Z"},"links":{"cited_paper":"/paper/2211.10581","citing_paper":"/paper/2505.19692"},"observation_digest":"sha256:5d4d87f20973f2b72b707dc7b6b248040851271095e2433489f0a16a66fce641","observation_id":"caad2c65-85f6-4bac-9d1e-fdea446c1587","resolution":{"observed_at":"2026-08-07T14:12:10.063951Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.10581","last_updated":"2023-02-10T05:47:05Z","snapshot_observed_at":"2026-08-04T03:55:53.443868Z","submitted_at":"2022-11-19T04:20:57Z","title":"Sparse4D: Multi-view 3D Object Detection with Sparse Spatial-Temporal Fusion","version":2},"cited_work":{"arxiv_id":"2211.10581","doi":"10.48550/arxiv.2211.10581","metadata_source":"arxiv_reference","pith_arxiv_id":"2211.10581","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Sparse4D: Multi-view 3D object detection with sparse spatial-temporal fusion","venue":"arXiv (Cornell University)","work_id":"44ddd7f0-b7cf-4298-a542-5f1c2981d4cd","year":2022},"citing_paper":{"arxiv_id":"2506.07002","last_updated":"2026-04-05T17:55:26Z","snapshot_observed_at":"2026-07-06T21:38:34.998414Z","submitted_at":"2025-06-08T05:19:02Z","title":"BePo: Dual Representation for 3D Occupancy Prediction","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-19T11:30:16.328722Z"},"links":{"cited_paper":"/paper/2211.10581","citing_paper":"/paper/2506.07002"},"observation_digest":"sha256:835652f16697cfc931759e538b92130ab03e5b497de547a1fe29bfc063dd333d","observation_id":"c8b447e5-ecec-4cf0-af6d-6a0a669ab594","resolution":{"observed_at":"2026-05-19T11:32:17.482712Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.10581","last_updated":"2023-02-10T05:47:05Z","snapshot_observed_at":"2026-08-04T03:55:53.443868Z","submitted_at":"2022-11-19T04:20:57Z","title":"Sparse4D: Multi-view 3D Object Detection with Sparse Spatial-Temporal Fusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.10581","snapshot_observed_at":"2026-08-07T04:53:40.820967Z","title":"Sparse4d: Multi-view 3d object detection with sparse spatial-temporal fusion.arXiv preprint arXiv:2211.10581, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.09417","last_updated":"2025-06-12T13:55:53Z","snapshot_observed_at":"2026-08-08T13:38:36.127007Z","submitted_at":"2025-06-11T06:03:03Z","title":"ODG: Occupancy Prediction Using Dual Gaussians","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:40.820967Z"},"links":{"cited_paper":"/paper/2211.10581","citing_paper":"/paper/2506.09417"},"observation_digest":"sha256:767adced8eaa0067d3f5d5f3dd3bdfe7bab082e59d0c6a94f6f4615676a6dc64","observation_id":"7c0c6943-9885-4c54-ab2e-7cf52723a020","resolution":{"observed_at":"2026-08-07T04:53:40.820967Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.10581","last_updated":"2023-02-10T05:47:05Z","snapshot_observed_at":"2026-08-04T03:55:53.443868Z","submitted_at":"2022-11-19T04:20:57Z","title":"Sparse4D: Multi-view 3D Object Detection with Sparse Spatial-Temporal Fusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.10581","snapshot_observed_at":"2026-08-07T04:35:23.703406Z","title":"Sparse4d: Multi-view 3d object detec- tion with sparse spatial-temporal fusion","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.10242","last_updated":"2025-06-11T23:49:56Z","snapshot_observed_at":"2026-08-08T04:44:48.116605Z","submitted_at":"2025-06-11T23:49:56Z","title":"DySS: Dynamic Queries and State-Space Learning for Efficient 3D Object Detection from Multi-Camera Videos","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T04:35:23.703406Z"},"links":{"cited_paper":"/paper/2211.10581","citing_paper":"/paper/2506.10242"},"observation_digest":"sha256:ae2ded5d03628c5cc8b020e877388514cf363352af29edcc6a2e505a4d5b907f","observation_id":"6be02f11-7fa4-40b4-ac06-aaf02d211a87","resolution":{"observed_at":"2026-08-07T04:35:23.703406Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.10581","last_updated":"2023-02-10T05:47:05Z","snapshot_observed_at":"2026-08-04T03:55:53.443868Z","submitted_at":"2022-11-19T04:20:57Z","title":"Sparse4D: Multi-view 3D Object Detection with Sparse Spatial-Temporal Fusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.10581","snapshot_observed_at":"2026-08-06T21:42:19.453913Z","title":"Sparse4d: Multi-view 3d object detec- tion with sparse spatial-temporal fusion","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.23565","last_updated":"2025-06-30T07:18:17Z","snapshot_observed_at":"2026-08-06T21:35:40.325751Z","submitted_at":"2025-06-30T07:18:17Z","title":"OcRFDet: Object-Centric Radiance Fields for Multi-View 3D Object Detection in Autonomous Driving","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T21:42:19.453913Z"},"links":{"cited_paper":"/paper/2211.10581","citing_paper":"/paper/2506.23565"},"observation_digest":"sha256:b12d02ca48b9c416f1e91fcab80c0af184a73b1c2bfffb12fca9fc9a78e3d2ae","observation_id":"aafc012a-6c9c-42ac-b814-6b89b1e1edb5","resolution":{"observed_at":"2026-08-06T21:42:19.453913Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.10581","last_updated":"2023-02-10T05:47:05Z","snapshot_observed_at":"2026-08-04T03:55:53.443868Z","submitted_at":"2022-11-19T04:20:57Z","title":"Sparse4D: Multi-view 3D Object Detection with Sparse Spatial-Temporal Fusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.10581","snapshot_observed_at":"2026-08-06T21:19:30.259711Z","title":"Sparse4d: Multi-view 3d object detec- tion with sparse spatial-temporal fusion","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.00603","last_updated":"2025-07-01T09:36:38Z","snapshot_observed_at":"2026-08-07T02:31:44.510306Z","submitted_at":"2025-07-01T09:36:38Z","title":"World4Drive: End-to-End Autonomous Driving via Intention-aware Physical Latent World Model","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:30.259711Z"},"links":{"cited_paper":"/paper/2211.10581","citing_paper":"/paper/2507.00603"},"observation_digest":"sha256:806d3702f653566357db5ae92db138cadf00a0ddde95004d67c39b0fcd7a43e4","observation_id":"76534d3f-2bfd-4c15-b5aa-f7dac4250ec9","resolution":{"observed_at":"2026-08-06T21:19:30.259711Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.10581","last_updated":"2023-02-10T05:47:05Z","snapshot_observed_at":"2026-08-04T03:55:53.443868Z","submitted_at":"2022-11-19T04:20:57Z","title":"Sparse4D: Multi-view 3D Object Detection with Sparse Spatial-Temporal Fusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.10581","snapshot_observed_at":"2026-08-06T20:57:38.997845Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.01397","last_updated":"2025-07-28T12:57:34Z","snapshot_observed_at":"2026-08-08T23:14:28.660079Z","submitted_at":"2025-07-02T06:26:17Z","title":"Coherent Online Road Topology Estimation and Reasoning with Standard-Definition Maps","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T20:57:38.997845Z"},"links":{"cited_paper":"/paper/2211.10581","citing_paper":"/paper/2507.01397"},"observation_digest":"sha256:734f697e54b56e753118bc18a7ee55f53305c8de1b38b4df13fd6852c39afdaf","observation_id":"2a0e437d-f3b9-4262-9c35-8453219f3330","resolution":{"observed_at":"2026-08-06T20:57:38.997845Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.10581","last_updated":"2023-02-10T05:47:05Z","snapshot_observed_at":"2026-08-04T03:55:53.443868Z","submitted_at":"2022-11-19T04:20:57Z","title":"Sparse4D: Multi-view 3D Object Detection with Sparse Spatial-Temporal Fusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.10581","snapshot_observed_at":"2026-08-06T19:32:33.897370Z","title":"Sparse4d: Multi-view 3d object detec- tion with sparse spatial-temporal fusion","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.05260","last_updated":"2025-07-07T17:59:58Z","snapshot_observed_at":"2026-08-08T11:05:11.106349Z","submitted_at":"2025-07-07T17:59:58Z","title":"Beyond One Shot, Beyond One Perspective: Cross-View and Long-Horizon Distillation for Better LiDAR Representations","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T19:32:33.897370Z"},"links":{"cited_paper":"/paper/2211.10581","citing_paper":"/paper/2507.05260"},"observation_digest":"sha256:24f58e0899edae6e128c15d8de213ec7abafcc44604176d42408793ce24403b2","observation_id":"61f230a0-9411-475a-9baf-c38d144490aa","resolution":{"observed_at":"2026-08-06T19:32:33.897370Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.10581","last_updated":"2023-02-10T05:47:05Z","snapshot_observed_at":"2026-08-04T03:55:53.443868Z","submitted_at":"2022-11-19T04:20:57Z","title":"Sparse4D: Multi-view 3D Object Detection with Sparse Spatial-Temporal Fusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.10581","snapshot_observed_at":"2026-08-06T18:17:13.548914Z","title":"Sparse4d: Multi-view 3d object detection with sparse spatial-temporal fusion,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.08644","last_updated":"2025-07-11T14:48:59Z","snapshot_observed_at":"2026-08-06T18:11:30.114161Z","submitted_at":"2025-07-11T14:48:59Z","title":"OnlineBEV: Recurrent Temporal Fusion in Bird's Eye View Representations for Multi-Camera 3D Perception","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T18:17:13.548914Z"},"links":{"cited_paper":"/paper/2211.10581","citing_paper":"/paper/2507.08644"},"observation_digest":"sha256:b9ec79650fca6747ef945bd5ec47ac3991eb24698010b154771c8d1dd95c8952","observation_id":"9786eb4d-cc41-404f-95a0-d80181a3cda6","resolution":{"observed_at":"2026-08-06T18:17:13.548914Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.10581","last_updated":"2023-02-10T05:47:05Z","snapshot_observed_at":"2026-08-04T03:55:53.443868Z","submitted_at":"2022-11-19T04:20:57Z","title":"Sparse4D: Multi-view 3D Object Detection with Sparse Spatial-Temporal Fusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.10581","snapshot_observed_at":"2026-08-06T14:48:19.159031Z","title":"Sparse4d: Multi-view 3d object detec- tion with sparse spatial-temporal fusion","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-08T11:05:06.768970Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.159031Z"},"links":{"cited_paper":"/paper/2211.10581","citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:1272684c1413c6dbf6664c9b67d70184d24da7ed5b77b50585cc6eab8fe3e128","observation_id":"2dd372dd-77ec-49ab-a405-34cc0db63d04","resolution":{"observed_at":"2026-08-06T14:48:19.159031Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.10581","last_updated":"2023-02-10T05:47:05Z","snapshot_observed_at":"2026-08-04T03:55:53.443868Z","submitted_at":"2022-11-19T04:20:57Z","title":"Sparse4D: Multi-view 3D Object Detection with Sparse Spatial-Temporal Fusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.10581","snapshot_observed_at":"2026-08-06T10:42:00.965776Z","title":"Sparse4d: Multi-view 3d object detec- tion with sparse spatial-temporal fusion.arXiv preprint arXiv:2211.10581, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.23567","last_updated":"2025-09-05T15:41:13Z","snapshot_observed_at":"2026-08-08T01:12:00.953493Z","submitted_at":"2025-07-31T13:56:41Z","title":"3D-MOOD: Lifting 2D to 3D for Monocular Open-Set Object Detection","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T10:42:00.965776Z"},"links":{"cited_paper":"/paper/2211.10581","citing_paper":"/paper/2507.23567"},"observation_digest":"sha256:5a5ef65e507401ce4695cf5db2ff5e11e1d71ccf3dd9a5ac3eef269b49e40837","observation_id":"534d9725-5280-45d3-aa1e-69eee1b9382e","resolution":{"observed_at":"2026-08-06T10:42:00.965776Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.10581","last_updated":"2023-02-10T05:47:05Z","snapshot_observed_at":"2026-08-04T03:55:53.443868Z","submitted_at":"2022-11-19T04:20:57Z","title":"Sparse4D: Multi-view 3D Object Detection with Sparse Spatial-Temporal Fusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.10581","snapshot_observed_at":"2026-08-06T10:15:57.161913Z","title":"Sparse4d: Multi-view 3d object detec- tion with sparse spatial-temporal fusion","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.00359","last_updated":"2025-08-01T06:45:12Z","snapshot_observed_at":"2026-08-06T10:15:55.398532Z","submitted_at":"2025-08-01T06:45:12Z","title":"CoST: Efficient Collaborative Perception From Unified Spatiotemporal Perspective","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T10:15:57.161913Z"},"links":{"cited_paper":"/paper/2211.10581","citing_paper":"/paper/2508.00359"},"observation_digest":"sha256:aa705efaca3e2d8f6204a0471b9bfed55de2ca2723571430809834df989c4b20","observation_id":"62927293-775f-4ffb-9136-65bbb4c001b3","resolution":{"observed_at":"2026-08-06T10:15:57.161913Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.10581","last_updated":"2023-02-10T05:47:05Z","snapshot_observed_at":"2026-08-04T03:55:53.443868Z","submitted_at":"2022-11-19T04:20:57Z","title":"Sparse4D: Multi-view 3D Object Detection with Sparse Spatial-Temporal Fusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.10581","snapshot_observed_at":"2026-08-05T23:50:07.394480Z","title":"Sparse4d: Multi-view 3d object detection with sparse spatial-temporal fusion,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.04696","last_updated":"2025-08-06T17:57:58Z","snapshot_observed_at":"2026-08-07T23:22:21.667628Z","submitted_at":"2025-08-06T17:57:58Z","title":"Achieving Precise and Reliable Locomotion with Differentiable Simulation-Based System Identification","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-05T23:50:07.394480Z"},"links":{"cited_paper":"/paper/2211.10581","citing_paper":"/paper/2508.04696"},"observation_digest":"sha256:1e4a7be64cda4cd51396a870a1e8b790ece6d27e15eb750d963e11cfff86a6d1","observation_id":"96f70bc3-027e-4821-a9a0-b9a040dadc68","resolution":{"observed_at":"2026-08-05T23:50:07.394480Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.10581","last_updated":"2023-02-10T05:47:05Z","snapshot_observed_at":"2026-08-04T03:55:53.443868Z","submitted_at":"2022-11-19T04:20:57Z","title":"Sparse4D: Multi-view 3D Object Detection with Sparse Spatial-Temporal Fusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.10581","snapshot_observed_at":"2026-08-05T23:53:11.647043Z","title":"Sparse4d: Multi-view 3d object detection with sparse spatial-temporal fusion,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.04702","last_updated":"2025-08-06T17:59:37Z","snapshot_observed_at":"2026-08-08T12:41:28.737292Z","submitted_at":"2025-08-06T17:59:37Z","title":"BEVCon: Advancing Bird's Eye View Perception with Contrastive Learning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-05T23:53:11.647043Z"},"links":{"cited_paper":"/paper/2211.10581","citing_paper":"/paper/2508.04702"},"observation_digest":"sha256:90281f3c7adec15f4a9ef8354316117dcb4bbed5194a563c334fb4175c171caa","observation_id":"3be86adc-6957-4195-83b5-20d95ed93dbd","resolution":{"observed_at":"2026-08-05T23:53:11.647043Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.10581","last_updated":"2023-02-10T05:47:05Z","snapshot_observed_at":"2026-08-04T03:55:53.443868Z","submitted_at":"2022-11-19T04:20:57Z","title":"Sparse4D: Multi-view 3D Object Detection with Sparse Spatial-Temporal Fusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.10581","snapshot_observed_at":"2026-08-05T23:51:19.799531Z","title":"Sparse4d: Multi-view 3d object detection with sparse spatial-temporal fusion","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.04705","last_updated":"2025-08-06T17:59:52Z","snapshot_observed_at":"2026-08-08T04:44:47.310441Z","submitted_at":"2025-08-06T17:59:52Z","title":"Occupancy Learning with Spatiotemporal Memory","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-05T23:51:19.799531Z"},"links":{"cited_paper":"/paper/2211.10581","citing_paper":"/paper/2508.04705"},"observation_digest":"sha256:dd46311bd317462583a98b01345229ee847da71cb7b74fd04aba2e428a3cc1b9","observation_id":"cd52c2aa-ee73-409f-bdf7-85f4638a0196","resolution":{"observed_at":"2026-08-05T23:51:19.799531Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.10581","last_updated":"2023-02-10T05:47:05Z","snapshot_observed_at":"2026-08-04T03:55:53.443868Z","submitted_at":"2022-11-19T04:20:57Z","title":"Sparse4D: Multi-view 3D Object Detection with Sparse Spatial-Temporal Fusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.10581","snapshot_observed_at":"2026-08-05T23:26:44.230034Z","title":"Sparse4d: Multi-view 3d object detec- tion with sparse spatial-temporal fusion","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.05402","last_updated":"2025-08-07T13:54:35Z","snapshot_observed_at":"2026-08-05T23:26:42.340650Z","submitted_at":"2025-08-07T13:54:35Z","title":"DistillDrive: End-to-End Multi-Mode Autonomous Driving Distillation by Isomorphic Hetero-Source Planning Model","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-05T23:26:44.230034Z"},"links":{"cited_paper":"/paper/2211.10581","citing_paper":"/paper/2508.05402"},"observation_digest":"sha256:31799000cfe0078a0ba1f400a132a8af44c5b36680e7e8b6a5d2444b9b413400","observation_id":"4ed98399-edad-4706-bfcf-982c23df6aba","resolution":{"observed_at":"2026-08-05T23:26:44.230034Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.10581","last_updated":"2023-02-10T05:47:05Z","snapshot_observed_at":"2026-08-04T03:55:53.443868Z","submitted_at":"2022-11-19T04:20:57Z","title":"Sparse4D: Multi-view 3D Object Detection with Sparse Spatial-Temporal Fusion","version":2},"cited_work":{"arxiv_id":"2211.10581","doi":"10.48550/arxiv.2211.10581","metadata_source":"arxiv_reference","pith_arxiv_id":"2211.10581","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Sparse4D: Multi-view 3D object detection with sparse spatial-temporal fusion","venue":"arXiv (Cornell University)","work_id":"44ddd7f0-b7cf-4298-a542-5f1c2981d4cd","year":2022},"citing_paper":{"arxiv_id":"2511.22039","last_updated":"2026-04-14T12:13:24Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-27T02:48:45Z","title":"SparseWorld-TC: Trajectory-Conditioned Sparse Occupancy World Model","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-17T05:26:34.859975Z"},"links":{"cited_paper":"/paper/2211.10581","citing_paper":"/paper/2511.22039"},"observation_digest":"sha256:1ad7d99eb0b74a9dd5d177785ffed9481d02fdaf7376b6407cd96e8f7a98c9ab","observation_id":"de3b3e95-adab-4aa8-ad54-cdac000e2bd2","resolution":{"observed_at":"2026-05-17T05:29:04.972209Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.10581","last_updated":"2023-02-10T05:47:05Z","snapshot_observed_at":"2026-08-04T03:55:53.443868Z","submitted_at":"2022-11-19T04:20:57Z","title":"Sparse4D: Multi-view 3D Object Detection with Sparse Spatial-Temporal Fusion","version":2},"cited_work":{"arxiv_id":"2211.10581","doi":"10.48550/arxiv.2211.10581","metadata_source":"arxiv_reference","pith_arxiv_id":"2211.10581","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Sparse4D: Multi-view 3D object detection with sparse spatial-temporal fusion","venue":"arXiv (Cornell University)","work_id":"44ddd7f0-b7cf-4298-a542-5f1c2981d4cd","year":2022},"citing_paper":{"arxiv_id":"2512.06838","last_updated":"2025-12-07T13:22:06Z","snapshot_observed_at":"2026-07-06T22:37:59.340166Z","submitted_at":"2025-12-07T13:22:06Z","title":"SparseCoop: Cooperative Perception with Kinematic-Grounded Queries","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-17T00:28:31.186458Z"},"links":{"cited_paper":"/paper/2211.10581","citing_paper":"/paper/2512.06838"},"observation_digest":"sha256:16ed0fe7b3eed4555832df47b49a6989f26c017a16dd3dd20359c29d37c9b245","observation_id":"6681cadb-dd19-463a-a6fa-58c11966bfe4","resolution":{"observed_at":"2026-05-17T00:28:44.681165Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.10581","last_updated":"2023-02-10T05:47:05Z","snapshot_observed_at":"2026-08-04T03:55:53.443868Z","submitted_at":"2022-11-19T04:20:57Z","title":"Sparse4D: Multi-view 3D Object Detection with Sparse Spatial-Temporal Fusion","version":2},"cited_work":{"arxiv_id":"2211.10581","doi":"10.48550/arxiv.2211.10581","metadata_source":"arxiv_reference","pith_arxiv_id":"2211.10581","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Sparse4D: Multi-view 3D object detection with sparse spatial-temporal fusion","venue":"arXiv (Cornell University)","work_id":"44ddd7f0-b7cf-4298-a542-5f1c2981d4cd","year":2022},"citing_paper":{"arxiv_id":"2601.01762","last_updated":"2026-06-16T06:55:19Z","snapshot_observed_at":"2026-08-07T10:50:29.315801Z","submitted_at":"2026-01-05T03:41:20Z","title":"AlignDrive: Aligned Lateral-Longitudinal Planning for End-to-End Autonomous Driving","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-16T18:39:49.416119Z"},"links":{"cited_paper":"/paper/2211.10581","citing_paper":"/paper/2601.01762"},"observation_digest":"sha256:334a039d0cbf37bbb49a237aeaa0eba721260f731e8c8e74caa71fc00723dd48","observation_id":"ff7fee24-e3bc-4574-bab9-1e32901973f2","resolution":{"observed_at":"2026-05-16T18:41:11.151641Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.10581","last_updated":"2023-02-10T05:47:05Z","snapshot_observed_at":"2026-08-04T03:55:53.443868Z","submitted_at":"2022-11-19T04:20:57Z","title":"Sparse4D: Multi-view 3D Object Detection with Sparse Spatial-Temporal Fusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.10581","snapshot_observed_at":"2026-08-03T12:48:35.490310Z","title":"Is ego status all you need for open-loop end-to-end autonomous driving? InProceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition, pp","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2601.01762","last_updated":"2026-06-16T06:55:19Z","snapshot_observed_at":"2026-08-07T10:50:29.315801Z","submitted_at":"2026-01-05T03:41:20Z","title":"AlignDrive: Aligned Lateral-Longitudinal Planning for End-to-End Autonomous Driving","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-03T12:48:35.490310Z"},"links":{"cited_paper":"/paper/2211.10581","citing_paper":"/paper/2601.01762"},"observation_digest":"sha256:c006c81df36193eeff612640ad5eeb5695a330c6ef593ac481a47b677bdf7dee","observation_id":"6c76b12c-9625-40cf-9c33-fe34c032eedc","resolution":{"observed_at":"2026-08-03T12:48:35.490310Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.10581","last_updated":"2023-02-10T05:47:05Z","snapshot_observed_at":"2026-08-04T03:55:53.443868Z","submitted_at":"2022-11-19T04:20:57Z","title":"Sparse4D: Multi-view 3D Object Detection with Sparse Spatial-Temporal Fusion","version":2},"cited_work":{"arxiv_id":"2211.10581","doi":"10.48550/arxiv.2211.10581","metadata_source":"arxiv_reference","pith_arxiv_id":"2211.10581","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Sparse4D: Multi-view 3D object detection with sparse spatial-temporal fusion","venue":"arXiv (Cornell University)","work_id":"44ddd7f0-b7cf-4298-a542-5f1c2981d4cd","year":2022},"citing_paper":{"arxiv_id":"2604.00813","last_updated":"2026-04-24T15:37:17Z","snapshot_observed_at":"2026-07-06T22:51:26.754746Z","submitted_at":"2026-04-01T12:21:26Z","title":"DVGT-2: Vision-Geometry-Action Model for Autonomous Driving at Scale","version":3},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-13T22:59:57.744015Z"},"links":{"cited_paper":"/paper/2211.10581","citing_paper":"/paper/2604.00813"},"observation_digest":"sha256:a2ca48100dab2906d51abeec41649c4528f62aada97bf538acfac02a6b230d97","observation_id":"5e3fa24f-662c-455f-9132-0792f1a7ecb6","resolution":{"observed_at":"2026-05-13T23:03:25.186832Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.10581","last_updated":"2023-02-10T05:47:05Z","snapshot_observed_at":"2026-08-04T03:55:53.443868Z","submitted_at":"2022-11-19T04:20:57Z","title":"Sparse4D: Multi-view 3D Object Detection with Sparse Spatial-Temporal Fusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.10581","snapshot_observed_at":"2026-07-15T11:39:16.503017Z","title":"CoRRabs/2211.10581(2022),�������� ���������������������������������","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2604.05447","last_updated":"2026-07-14T14:29:09Z","snapshot_observed_at":"2026-08-02T21:17:28.989539Z","submitted_at":"2026-04-07T05:31:51Z","title":"Kerr-Schild Double Copy of the Randall-Sundrum Black String","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-15T11:39:16.503017Z"},"links":{"cited_paper":"/paper/2211.10581","citing_paper":"/paper/2604.05447"},"observation_digest":"sha256:7d295b0b1160b403dc3d6538ed46703ad50b7033437e79388fafc49776853cb3","observation_id":"29787a8e-5489-4862-b0ec-856e0156e945","resolution":{"observed_at":"2026-07-15T11:39:16.503017Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.10581","last_updated":"2023-02-10T05:47:05Z","snapshot_observed_at":"2026-08-04T03:55:53.443868Z","submitted_at":"2022-11-19T04:20:57Z","title":"Sparse4D: Multi-view 3D Object Detection with Sparse Spatial-Temporal Fusion","version":2},"cited_work":{"arxiv_id":"2211.10581","doi":"10.48550/arxiv.2211.10581","metadata_source":"arxiv_reference","pith_arxiv_id":"2211.10581","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Sparse4D: Multi-view 3D object detection with sparse spatial-temporal fusion","venue":"arXiv (Cornell University)","work_id":"44ddd7f0-b7cf-4298-a542-5f1c2981d4cd","year":2022},"citing_paper":{"arxiv_id":"2604.05449","last_updated":"2026-04-07T05:33:54Z","snapshot_observed_at":"2026-08-02T13:37:32.642986Z","submitted_at":"2026-04-07T05:33:54Z","title":"Not All Agents Matter: From Global Attention Dilution to Risk-Prioritized Game Planning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-10T18:50:48.512471Z"},"links":{"cited_paper":"/paper/2211.10581","citing_paper":"/paper/2604.05449"},"observation_digest":"sha256:8e4456e4827f12d833d6e09d38a42c3aff6b2d9b021b0aff49920f7c780dc115","observation_id":"b8e1d8c8-9c7d-4c51-85b7-f8046af77dff","resolution":{"observed_at":"2026-05-10T20:00:46.394838Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.10581","last_updated":"2023-02-10T05:47:05Z","snapshot_observed_at":"2026-08-04T03:55:53.443868Z","submitted_at":"2022-11-19T04:20:57Z","title":"Sparse4D: Multi-view 3D Object Detection with Sparse Spatial-Temporal Fusion","version":2},"cited_work":{"arxiv_id":"2211.10581","doi":"10.48550/arxiv.2211.10581","metadata_source":"arxiv_reference","pith_arxiv_id":"2211.10581","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Sparse4D: Multi-view 3D object detection with sparse spatial-temporal fusion","venue":"arXiv (Cornell University)","work_id":"44ddd7f0-b7cf-4298-a542-5f1c2981d4cd","year":2022},"citing_paper":{"arxiv_id":"2604.13586","last_updated":"2026-04-15T07:44:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-15T07:44:01Z","title":"Efficient Multi-View 3D Object Detection by Dynamic Token Selection and Fine-Tuning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-10T13:35:18.317235Z"},"links":{"cited_paper":"/paper/2211.10581","citing_paper":"/paper/2604.13586"},"observation_digest":"sha256:ee41ea537ac87ffa582a9af3271793074a507253de5357de9b2797e6ea47f82f","observation_id":"9973b243-f541-4189-a2b5-0ce6b9507f60","resolution":{"observed_at":"2026-05-10T13:35:26.163159Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.10581","last_updated":"2023-02-10T05:47:05Z","snapshot_observed_at":"2026-08-04T03:55:53.443868Z","submitted_at":"2022-11-19T04:20:57Z","title":"Sparse4D: Multi-view 3D Object Detection with Sparse Spatial-Temporal Fusion","version":2},"cited_work":{"arxiv_id":"2211.10581","doi":"10.48550/arxiv.2211.10581","metadata_source":"arxiv_reference","pith_arxiv_id":"2211.10581","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Sparse4D: Multi-view 3D object detection with sparse spatial-temporal fusion","venue":"arXiv (Cornell University)","work_id":"44ddd7f0-b7cf-4298-a542-5f1c2981d4cd","year":2022},"citing_paper":{"arxiv_id":"2604.14563","last_updated":"2026-04-16T02:46:53Z","snapshot_observed_at":"2026-07-06T23:02:18.425249Z","submitted_at":"2026-04-16T02:46:53Z","title":"Revisiting Token Compression for Accelerating ViT-based Sparse Multi-View 3D Object Detectors","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-10T11:31:52.126027Z"},"links":{"cited_paper":"/paper/2211.10581","citing_paper":"/paper/2604.14563"},"observation_digest":"sha256:b6fb23382b5999ec5ffb526119ee3093d934529963cd4a159781e38810f65e31","observation_id":"4c9715a1-f6e6-44af-ad6f-3caf0dff36a2","resolution":{"observed_at":"2026-05-10T11:35:18.951421Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.10581","last_updated":"2023-02-10T05:47:05Z","snapshot_observed_at":"2026-08-04T03:55:53.443868Z","submitted_at":"2022-11-19T04:20:57Z","title":"Sparse4D: Multi-view 3D Object Detection with Sparse Spatial-Temporal Fusion","version":2},"cited_work":{"arxiv_id":"2211.10581","doi":"10.48550/arxiv.2211.10581","metadata_source":"arxiv_reference","pith_arxiv_id":"2211.10581","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Sparse4D: Multi-view 3D object detection with sparse spatial-temporal fusion","venue":"arXiv (Cornell University)","work_id":"44ddd7f0-b7cf-4298-a542-5f1c2981d4cd","year":2022},"citing_paper":{"arxiv_id":"2604.17024","last_updated":"2026-04-18T15:14:11Z","snapshot_observed_at":"2026-08-02T11:14:25.634881Z","submitted_at":"2026-04-18T15:14:11Z","title":"CAM3DNet: Comprehensively mining the multi-scale features for 3D Object Detection with Multi-View Cameras","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-10T07:16:33.640040Z"},"links":{"cited_paper":"/paper/2211.10581","citing_paper":"/paper/2604.17024"},"observation_digest":"sha256:0e4244c0f7505c339eccadac490f9a89a50faf255f49087a3172658d576d2498","observation_id":"00cd3527-241a-4e7d-b60c-8fe1093914eb","resolution":{"observed_at":"2026-05-10T07:16:54.742744Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.10581","last_updated":"2023-02-10T05:47:05Z","snapshot_observed_at":"2026-08-04T03:55:53.443868Z","submitted_at":"2022-11-19T04:20:57Z","title":"Sparse4D: Multi-view 3D Object Detection with Sparse Spatial-Temporal Fusion","version":2},"cited_work":{"arxiv_id":"2211.10581","doi":"10.48550/arxiv.2211.10581","metadata_source":"arxiv_reference","pith_arxiv_id":"2211.10581","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Sparse4D: Multi-view 3D object detection with sparse spatial-temporal fusion","venue":"arXiv (Cornell University)","work_id":"44ddd7f0-b7cf-4298-a542-5f1c2981d4cd","year":2022},"citing_paper":{"arxiv_id":"2604.18476","last_updated":"2026-04-20T16:28:01Z","snapshot_observed_at":"2026-08-03T00:20:08.083629Z","submitted_at":"2026-04-20T16:28:01Z","title":"SemLT3D: Semantic-Guided Expert Distillation for Camera-only Long-Tailed 3D Object Detection","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-10T05:53:11.157832Z"},"links":{"cited_paper":"/paper/2211.10581","citing_paper":"/paper/2604.18476"},"observation_digest":"sha256:116c6320d404bbbb7f126ba52998b247f92f198426ec1422ae3161508d3e4b59","observation_id":"4454cc97-b4cc-4985-ac3b-8ddb83eb9b7e","resolution":{"observed_at":"2026-05-10T05:56:11.195000Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.10581","last_updated":"2023-02-10T05:47:05Z","snapshot_observed_at":"2026-08-04T03:55:53.443868Z","submitted_at":"2022-11-19T04:20:57Z","title":"Sparse4D: Multi-view 3D Object Detection with Sparse Spatial-Temporal Fusion","version":2},"cited_work":{"arxiv_id":"2211.10581","doi":"10.48550/arxiv.2211.10581","metadata_source":"arxiv_reference","pith_arxiv_id":"2211.10581","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Sparse4D: Multi-view 3D object detection with sparse spatial-temporal fusion","venue":"arXiv (Cornell University)","work_id":"44ddd7f0-b7cf-4298-a542-5f1c2981d4cd","year":2022},"citing_paper":{"arxiv_id":"2605.01924","last_updated":"2026-05-03T15:10:38Z","snapshot_observed_at":"2026-07-06T23:15:07.159340Z","submitted_at":"2026-05-03T15:10:38Z","title":"SimPB++: Simultaneously Detecting 2D and 3D Objects from Multiple Cameras","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-09T17:22:01.467937Z"},"links":{"cited_paper":"/paper/2211.10581","citing_paper":"/paper/2605.01924"},"observation_digest":"sha256:c47ca4696544cb84a19205600d8ba13ca1fc8f9a63a66685486adef37a189603","observation_id":"26d31e85-b7b9-48db-b9c7-9d01cc062bf4","resolution":{"observed_at":"2026-05-11T16:21:07.770349Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.10581","last_updated":"2023-02-10T05:47:05Z","snapshot_observed_at":"2026-08-04T03:55:53.443868Z","submitted_at":"2022-11-19T04:20:57Z","title":"Sparse4D: Multi-view 3D Object Detection with Sparse Spatial-Temporal Fusion","version":2},"cited_work":{"arxiv_id":"2211.10581","doi":"10.48550/arxiv.2211.10581","metadata_source":"arxiv_reference","pith_arxiv_id":"2211.10581","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Sparse4D: Multi-view 3D object detection with sparse spatial-temporal fusion","venue":"arXiv (Cornell University)","work_id":"44ddd7f0-b7cf-4298-a542-5f1c2981d4cd","year":2022},"citing_paper":{"arxiv_id":"2605.11594","last_updated":"2026-05-12T06:20:59Z","snapshot_observed_at":"2026-08-08T17:38:06.227372Z","submitted_at":"2026-05-12T06:20:59Z","title":"PointForward: Feedforward Driving Reconstruction through Point-Aligned Representations","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-13T01:22:05.111224Z"},"links":{"cited_paper":"/paper/2211.10581","citing_paper":"/paper/2605.11594"},"observation_digest":"sha256:0237e26fe271c45bc87f053d1f967e8052043242cce4be6aebec4600e2fe8b6a","observation_id":"f10b4701-0645-4bab-a0f0-ad62b6f17d65","resolution":{"observed_at":"2026-05-13T01:27:02.681999Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.10581","last_updated":"2023-02-10T05:47:05Z","snapshot_observed_at":"2026-08-04T03:55:53.443868Z","submitted_at":"2022-11-19T04:20:57Z","title":"Sparse4D: Multi-view 3D Object Detection with Sparse Spatial-Temporal Fusion","version":2},"cited_work":{"arxiv_id":"2211.10581","doi":"10.48550/arxiv.2211.10581","metadata_source":"arxiv_reference","pith_arxiv_id":"2211.10581","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Sparse4D: Multi-view 3D object detection with sparse spatial-temporal fusion","venue":"arXiv (Cornell University)","work_id":"44ddd7f0-b7cf-4298-a542-5f1c2981d4cd","year":2022},"citing_paper":{"arxiv_id":"2605.16911","last_updated":"2026-05-16T09:51:04Z","snapshot_observed_at":"2026-07-06T23:27:57.805018Z","submitted_at":"2026-05-16T09:51:04Z","title":"VGGT-Occ: Geometry-Grounded and Density-Aware Gated Fusion for 3D Occupancy Prediction","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-19T21:19:17.894557Z"},"links":{"cited_paper":"/paper/2211.10581","citing_paper":"/paper/2605.16911"},"observation_digest":"sha256:d7e46ae5029d9eaa213b1f928ccebfe8a7a1cfeac6feb2a6c5fbf6fbb06794c1","observation_id":"b4ffba30-365c-430e-9bfc-a74e08b413df","resolution":{"observed_at":"2026-05-19T21:22:48.050739Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.10581","last_updated":"2023-02-10T05:47:05Z","snapshot_observed_at":"2026-08-04T03:55:53.443868Z","submitted_at":"2022-11-19T04:20:57Z","title":"Sparse4D: Multi-view 3D Object Detection with Sparse Spatial-Temporal Fusion","version":2},"cited_work":{"arxiv_id":"2211.10581","doi":"10.48550/arxiv.2211.10581","metadata_source":"arxiv_reference","pith_arxiv_id":"2211.10581","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Sparse4D: Multi-view 3D object detection with sparse spatial-temporal fusion","venue":"arXiv (Cornell University)","work_id":"44ddd7f0-b7cf-4298-a542-5f1c2981d4cd","year":2022},"citing_paper":{"arxiv_id":"2605.30307","last_updated":"2026-05-28T17:51:38Z","snapshot_observed_at":"2026-08-02T22:39:52.853482Z","submitted_at":"2026-05-28T17:51:38Z","title":"Grounded 3D-Aware Spatial Vision-Language Modeling","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-06-29T08:08:36.012761Z"},"links":{"cited_paper":"/paper/2211.10581","citing_paper":"/paper/2605.30307"},"observation_digest":"sha256:e87d03b724aedae0889869144bf75fd0530fd3b1614bbc72c40e9274d75c22c1","observation_id":"7a862818-12c8-42b0-adb5-184ae6fd829b","resolution":{"observed_at":"2026-06-29T08:13:15.330446Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.10581","last_updated":"2023-02-10T05:47:05Z","snapshot_observed_at":"2026-08-04T03:55:53.443868Z","submitted_at":"2022-11-19T04:20:57Z","title":"Sparse4D: Multi-view 3D Object Detection with Sparse Spatial-Temporal Fusion","version":2},"cited_work":{"arxiv_id":"2211.10581","doi":"10.48550/arxiv.2211.10581","metadata_source":"arxiv_reference","pith_arxiv_id":"2211.10581","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Sparse4D: Multi-view 3D object detection with sparse spatial-temporal fusion","venue":"arXiv (Cornell University)","work_id":"44ddd7f0-b7cf-4298-a542-5f1c2981d4cd","year":2022},"citing_paper":{"arxiv_id":"2605.30983","last_updated":"2026-05-29T08:18:44Z","snapshot_observed_at":"2026-08-03T07:34:39.547714Z","submitted_at":"2026-05-29T08:18:44Z","title":"Can BEV Perception Gracefully Degrade under Sensor Failures?","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-28T22:56:38.949269Z"},"links":{"cited_paper":"/paper/2211.10581","citing_paper":"/paper/2605.30983"},"observation_digest":"sha256:d3b1eb42a327b2de56135a942b3db2ee7139bb6bd33966a4ca8925d272eee453","observation_id":"b799f7e1-8fa0-4b3a-a272-62aa5a0a3ab1","resolution":{"observed_at":"2026-06-28T23:02:46.952347Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.10581","last_updated":"2023-02-10T05:47:05Z","snapshot_observed_at":"2026-08-04T03:55:53.443868Z","submitted_at":"2022-11-19T04:20:57Z","title":"Sparse4D: Multi-view 3D Object Detection with Sparse Spatial-Temporal Fusion","version":2},"cited_work":{"arxiv_id":"2211.10581","doi":"10.48550/arxiv.2211.10581","metadata_source":"arxiv_reference","pith_arxiv_id":"2211.10581","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Sparse4D: Multi-view 3D object detection with sparse spatial-temporal fusion","venue":"arXiv (Cornell University)","work_id":"44ddd7f0-b7cf-4298-a542-5f1c2981d4cd","year":2022},"citing_paper":{"arxiv_id":"2606.12396","last_updated":"2026-06-10T17:57:06Z","snapshot_observed_at":"2026-07-06T23:51:17.719874Z","submitted_at":"2026-06-10T17:57:06Z","title":"VLGA: Vision-Language-Geometry-Action Models for Autonomous Driving","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-27T09:40:51.407286Z"},"links":{"cited_paper":"/paper/2211.10581","citing_paper":"/paper/2606.12396"},"observation_digest":"sha256:5c69900a09e375b53ef3c7a8fa6bc8bc6b4d4c8b68d8727b78ece92bfdd176f1","observation_id":"f63e57b2-601c-4692-8b53-939a903aac68","resolution":{"observed_at":"2026-07-03T11:08:03.433200Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.10581","last_updated":"2023-02-10T05:47:05Z","snapshot_observed_at":"2026-08-04T03:55:53.443868Z","submitted_at":"2022-11-19T04:20:57Z","title":"Sparse4D: Multi-view 3D Object Detection with Sparse Spatial-Temporal Fusion","version":2},"cited_work":{"arxiv_id":"2211.10581","doi":"10.48550/arxiv.2211.10581","metadata_source":"arxiv_reference","pith_arxiv_id":"2211.10581","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Sparse4D: Multi-view 3D object detection with sparse spatial-temporal fusion","venue":"arXiv (Cornell University)","work_id":"44ddd7f0-b7cf-4298-a542-5f1c2981d4cd","year":2022},"citing_paper":{"arxiv_id":"2606.25736","last_updated":"2026-06-24T12:03:54Z","snapshot_observed_at":"2026-08-08T11:59:14.055897Z","submitted_at":"2026-06-24T12:03:54Z","title":"UniTeD: Unified Temporal Diffusion for Joint Perception and Planning in Autonomous Driving","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-06-25T21:12:59.598842Z"},"links":{"cited_paper":"/paper/2211.10581","citing_paper":"/paper/2606.25736"},"observation_digest":"sha256:4c78cd430cec68fd678e488a642590985316d2e72cc076580c8d1d8477526da0","observation_id":"e299f2d5-2fbc-4b56-aa65-40f92e64929e","resolution":{"observed_at":"2026-07-04T19:30:08.081546Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.10581","last_updated":"2023-02-10T05:47:05Z","snapshot_observed_at":"2026-08-04T03:55:53.443868Z","submitted_at":"2022-11-19T04:20:57Z","title":"Sparse4D: Multi-view 3D Object Detection with Sparse Spatial-Temporal Fusion","version":2},"cited_work":{"arxiv_id":"2211.10581","doi":"10.48550/arxiv.2211.10581","metadata_source":"arxiv_reference","pith_arxiv_id":"2211.10581","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Sparse4D: Multi-view 3D object detection with sparse spatial-temporal fusion","venue":"arXiv (Cornell University)","work_id":"44ddd7f0-b7cf-4298-a542-5f1c2981d4cd","year":2022},"citing_paper":{"arxiv_id":"2606.30754","last_updated":"2026-06-29T18:00:42Z","snapshot_observed_at":"2026-08-02T04:01:57.680474Z","submitted_at":"2026-06-29T18:00:42Z","title":"Streaming Gaussian Encoding for 4D Panoptic Occupancy Tracking","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-01T06:28:47.232989Z"},"links":{"cited_paper":"/paper/2211.10581","citing_paper":"/paper/2606.30754"},"observation_digest":"sha256:db516813d50e3ae1b0a8fc2d1feaabdb1629f21cfe7cfbdfd27fb4a79d0bec9b","observation_id":"dc465aec-17f7-4849-ad76-891a0bc7d093","resolution":{"observed_at":"2026-07-01T09:35:39.853979Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2211.10581/citation-record","integrity":"/paper/2211.10581/integrity","json":"/paper/2211.10581/citation-record.json","paper":"/paper/2211.10581"},"outbound":[],"paper":{"arxiv_id":"2211.10581","last_updated":"2023-02-10T05:47:05Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-04T03:55:53.443868Z","submitted_at":"2022-11-19T04:20:57Z","title":"Sparse4D: Multi-view 3D Object Detection with Sparse Spatial-Temporal Fusion"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 35 inbound Pith citation observations for arXiv:2211.10581."}