{"as_of":"2026-08-11T20:12:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:057b7f04aa185e8809b64a5800cc646e8f378c250e62bfb610c5c587518c4aa3","coverage":[{"denominator":31,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":31,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T07:18:13.529114Z","state":"measured"},{"denominator":31,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":31,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2601.20720/citation-record","integrity":"/paper/2601.20720/integrity","json":"/paper/2601.20720/citation-record.json","paper":"/paper/2601.20720"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T07:18:11.314563Z","title":"Forecasting from lidar via future object detection,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2601.20720","last_updated":"2026-07-20T17:11:32Z","snapshot_observed_at":"2026-08-05T23:53:07.554126Z","submitted_at":"2026-01-28T15:53:32Z","title":"Li-ViP3D++: Query-Gated Deformable Camera-LiDAR Fusion for End-to-End Perception and Trajectory Prediction","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-03T07:18:11.314563Z"},"links":{"citing_paper":"/paper/2601.20720"},"observation_digest":"sha256:68d4ac996ff4e2e6d8e1c379a955e567b5edf083d381e81ffa8fd5fa0b6baf93","observation_id":"0de3cb7f-176e-4e89-b880-0a7f744f5f25","resolution":{"observed_at":"2026-08-03T07:18:11.314563Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T07:18:11.322937Z","title":"Seeing through fog without seeing fog: Deep multi- modal sensor fusion in unseen adverse weather,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2601.20720","last_updated":"2026-07-20T17:11:32Z","snapshot_observed_at":"2026-08-05T23:53:07.554126Z","submitted_at":"2026-01-28T15:53:32Z","title":"Li-ViP3D++: Query-Gated Deformable Camera-LiDAR Fusion for End-to-End Perception and Trajectory Prediction","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-03T07:18:11.322937Z"},"links":{"citing_paper":"/paper/2601.20720"},"observation_digest":"sha256:acb850340b880b4f190c9e98a002c403f9df145972467d4de8981d5e663cfdc1","observation_id":"69e146d6-e0cb-48dc-be44-e19aba22054f","resolution":{"observed_at":"2026-08-03T07:18:11.322937Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T07:18:11.330001Z","title":"Are we ready for autonomous driving? the kitti vision benchmark suite,","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2601.20720","last_updated":"2026-07-20T17:11:32Z","snapshot_observed_at":"2026-08-05T23:53:07.554126Z","submitted_at":"2026-01-28T15:53:32Z","title":"Li-ViP3D++: Query-Gated Deformable Camera-LiDAR Fusion for End-to-End Perception and Trajectory Prediction","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-03T07:18:11.330001Z"},"links":{"citing_paper":"/paper/2601.20720"},"observation_digest":"sha256:9142f1b1dd5d15567d0b63ceccd06123880d18f38bd93cac2db798c9ba027a92","observation_id":"77600e78-c334-4f4e-b532-242c9cf672cf","resolution":{"observed_at":"2026-08-03T07:18:11.330001Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T07:18:11.342424Z","title":"End-to-end object detection with transformers,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2601.20720","last_updated":"2026-07-20T17:11:32Z","snapshot_observed_at":"2026-08-05T23:53:07.554126Z","submitted_at":"2026-01-28T15:53:32Z","title":"Li-ViP3D++: Query-Gated Deformable Camera-LiDAR Fusion for End-to-End Perception and Trajectory Prediction","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-03T07:18:11.342424Z"},"links":{"citing_paper":"/paper/2601.20720"},"observation_digest":"sha256:c17ced594fc1a3c66e96efc0c67b33e7bde486a6455f6fab14cb17afb92cc994","observation_id":"668d88de-cff7-4078-937b-fcec0009b7c3","resolution":{"observed_at":"2026-08-03T07:18:11.342424Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T07:18:11.353622Z","title":"Detr3d: 3d object detection from multi-view images via 3d-to-2d queries,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2601.20720","last_updated":"2026-07-20T17:11:32Z","snapshot_observed_at":"2026-08-05T23:53:07.554126Z","submitted_at":"2026-01-28T15:53:32Z","title":"Li-ViP3D++: Query-Gated Deformable Camera-LiDAR Fusion for End-to-End Perception and Trajectory Prediction","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-03T07:18:11.353622Z"},"links":{"citing_paper":"/paper/2601.20720"},"observation_digest":"sha256:e53a6551d036c672a51d7a8c46c7be6a958fdecc827b25852a394e89a15e2a6d","observation_id":"e47102d4-8c3d-4d8e-be86-eacf33b79103","resolution":{"observed_at":"2026-08-03T07:18:11.353622Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T07:18:11.362175Z","title":"Vip3d: End-to-end visual trajectory prediction via 3d agent queries,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2601.20720","last_updated":"2026-07-20T17:11:32Z","snapshot_observed_at":"2026-08-05T23:53:07.554126Z","submitted_at":"2026-01-28T15:53:32Z","title":"Li-ViP3D++: Query-Gated Deformable Camera-LiDAR Fusion for End-to-End Perception and Trajectory Prediction","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-03T07:18:11.362175Z"},"links":{"citing_paper":"/paper/2601.20720"},"observation_digest":"sha256:17a8b2c4a42af89910100f005f400a4d49db24b8a34572dcd1be1d8c3dd41a7c","observation_id":"2d4a59d9-4057-4716-95cc-a460314428e6","resolution":{"observed_at":"2026-08-03T07:18:11.362175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T07:18:11.377559Z","title":"Social robots for road safety: Pedestrian crossing assis- tance use-case,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.20720","last_updated":"2026-07-20T17:11:32Z","snapshot_observed_at":"2026-08-05T23:53:07.554126Z","submitted_at":"2026-01-28T15:53:32Z","title":"Li-ViP3D++: Query-Gated Deformable Camera-LiDAR Fusion for End-to-End Perception and Trajectory Prediction","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-03T07:18:11.377559Z"},"links":{"citing_paper":"/paper/2601.20720"},"observation_digest":"sha256:f1d5402d9d2ba0c4261710b9c687de2f5fd8ff3e76356a148423999391319e77","observation_id":"8039f8fe-8058-481b-9fb3-4826ea758338","resolution":{"observed_at":"2026-08-03T07:18:11.377559Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T07:18:11.389879Z","title":"Robots for safer pedestrian crossing on two-lane roads,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.20720","last_updated":"2026-07-20T17:11:32Z","snapshot_observed_at":"2026-08-05T23:53:07.554126Z","submitted_at":"2026-01-28T15:53:32Z","title":"Li-ViP3D++: Query-Gated Deformable Camera-LiDAR Fusion for End-to-End Perception and Trajectory Prediction","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-03T07:18:11.389879Z"},"links":{"citing_paper":"/paper/2601.20720"},"observation_digest":"sha256:1fd1159c71f9da2c404da454cbf1cbe9e83f77d8cfd460739961725daf7a2a9e","observation_id":"8773a968-d809-4815-bc8d-b441c5b5a8e4","resolution":{"observed_at":"2026-08-03T07:18:11.389879Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T07:18:11.403909Z","title":"Li-vip3d: Enhancing end- to-end perception and prediction with camera-lidar fusion,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.20720","last_updated":"2026-07-20T17:11:32Z","snapshot_observed_at":"2026-08-05T23:53:07.554126Z","submitted_at":"2026-01-28T15:53:32Z","title":"Li-ViP3D++: Query-Gated Deformable Camera-LiDAR Fusion for End-to-End Perception and Trajectory Prediction","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-03T07:18:11.403909Z"},"links":{"citing_paper":"/paper/2601.20720"},"observation_digest":"sha256:3bab84ec6a8a51c57db97437d70a61f10ef54f7e1857bf9855c0833d2d21e6dd","observation_id":"fb9de17c-e1e1-4fa4-a454-a13aa69d579c","resolution":{"observed_at":"2026-08-03T07:18:11.403909Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T07:18:11.416888Z","title":"A survey on trajectory-prediction methods for autonomous driving,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2601.20720","last_updated":"2026-07-20T17:11:32Z","snapshot_observed_at":"2026-08-05T23:53:07.554126Z","submitted_at":"2026-01-28T15:53:32Z","title":"Li-ViP3D++: Query-Gated Deformable Camera-LiDAR Fusion for End-to-End Perception and Trajectory Prediction","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-03T07:18:11.416888Z"},"links":{"citing_paper":"/paper/2601.20720"},"observation_digest":"sha256:35f5ba75468e895267128b9589fe4a18a5111dcda94057bfb8812c13a46bbfe7","observation_id":"6d1d12ee-48cf-48bf-bc93-abb620d81b57","resolution":{"observed_at":"2026-08-03T07:18:11.416888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.08113","last_updated":"2024-09-26T16:14:54Z","snapshot_observed_at":"2026-07-06T18:29:30.075334Z","submitted_at":"2024-06-12T11:50:51Z","title":"Valeo4Cast: A Modular Approach to End-to-End Forecasting","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.08113","snapshot_observed_at":"2026-08-03T07:18:11.440399Z","title":"Va- leo4cast: A modular approach to end-to-end forecasting,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2601.20720","last_updated":"2026-07-20T17:11:32Z","snapshot_observed_at":"2026-08-05T23:53:07.554126Z","submitted_at":"2026-01-28T15:53:32Z","title":"Li-ViP3D++: Query-Gated Deformable Camera-LiDAR Fusion for End-to-End Perception and Trajectory Prediction","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-03T07:18:11.440399Z"},"links":{"cited_paper":"/paper/2406.08113","citing_paper":"/paper/2601.20720"},"observation_digest":"sha256:f4b8571a13b7569046887104f8d532d5a75c91cb020e718ba7846906a3bfe0b8","observation_id":"94904278-f1d1-4ab0-b326-373ccf381d06","resolution":{"observed_at":"2026-08-03T07:18:11.440399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.15615","last_updated":"2023-11-27T08:25:23Z","snapshot_observed_at":"2026-08-09T22:26:28.650829Z","submitted_at":"2023-11-27T08:25:23Z","title":"Technical Report for Argoverse Challenges on Unified Sensor-based Detection, Tracking, and Forecasting","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.15615","snapshot_observed_at":"2026-08-03T07:18:11.458959Z","title":"Technical report for argoverse challenges on unified sensor-based detection, tracking, and forecasting,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2601.20720","last_updated":"2026-07-20T17:11:32Z","snapshot_observed_at":"2026-08-05T23:53:07.554126Z","submitted_at":"2026-01-28T15:53:32Z","title":"Li-ViP3D++: Query-Gated Deformable Camera-LiDAR Fusion for End-to-End Perception and Trajectory Prediction","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-03T07:18:11.458959Z"},"links":{"cited_paper":"/paper/2311.15615","citing_paper":"/paper/2601.20720"},"observation_digest":"sha256:9a80fd4fbeb9529b1398eb22ff3f51d37cd0300be150e07f72bb1f2623b99762","observation_id":"1f6a93c5-af34-450d-ad05-2d0b39b46414","resolution":{"observed_at":"2026-08-03T07:18:11.458959Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T07:18:11.478445Z","title":"Motion forecasting via coordinate transfor- mations and object trajectory modifications,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2601.20720","last_updated":"2026-07-20T17:11:32Z","snapshot_observed_at":"2026-08-05T23:53:07.554126Z","submitted_at":"2026-01-28T15:53:32Z","title":"Li-ViP3D++: Query-Gated Deformable Camera-LiDAR Fusion for End-to-End Perception and Trajectory Prediction","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-03T07:18:11.478445Z"},"links":{"citing_paper":"/paper/2601.20720"},"observation_digest":"sha256:a7d0eb757dff7cc04b14faa362978ed356da08925d2462252f9a22779e20e3a5","observation_id":"9980985e-030f-4741-bf3f-3a26d18124da","resolution":{"observed_at":"2026-08-03T07:18:11.478445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T07:18:11.544263Z","title":"Towards motion forecasting with real-world perception inputs: Are end-to-end approaches competitive?","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2601.20720","last_updated":"2026-07-20T17:11:32Z","snapshot_observed_at":"2026-08-05T23:53:07.554126Z","submitted_at":"2026-01-28T15:53:32Z","title":"Li-ViP3D++: Query-Gated Deformable Camera-LiDAR Fusion for End-to-End Perception and Trajectory Prediction","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-03T07:18:11.544263Z"},"links":{"citing_paper":"/paper/2601.20720"},"observation_digest":"sha256:efc1d0f0778dc7b5f2cb122f9f18fe02f18a88f809e4905c1a9ae390111b2e28","observation_id":"6148d1b8-66ac-49a0-8732-6e0cc04bc58d","resolution":{"observed_at":"2026-08-03T07:18:11.544263Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T07:18:11.626508Z","title":"Single-filter cnn for vehicle recognition,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2601.20720","last_updated":"2026-07-20T17:11:32Z","snapshot_observed_at":"2026-08-05T23:53:07.554126Z","submitted_at":"2026-01-28T15:53:32Z","title":"Li-ViP3D++: Query-Gated Deformable Camera-LiDAR Fusion for End-to-End Perception and Trajectory Prediction","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-03T07:18:11.626508Z"},"links":{"citing_paper":"/paper/2601.20720"},"observation_digest":"sha256:212d1a26041402ec4fa8c94b4a1c2ded2e76cfd97815b61a46eabfb1fde3139c","observation_id":"daaba4f8-5ca7-4605-87fb-70b382a5bdad","resolution":{"observed_at":"2026-08-03T07:18:11.626508Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T07:18:11.702506Z","title":"Ultra- fast visible lane distance estimation using a single camera,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2601.20720","last_updated":"2026-07-20T17:11:32Z","snapshot_observed_at":"2026-08-05T23:53:07.554126Z","submitted_at":"2026-01-28T15:53:32Z","title":"Li-ViP3D++: Query-Gated Deformable Camera-LiDAR Fusion for End-to-End Perception and Trajectory Prediction","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-03T07:18:11.702506Z"},"links":{"citing_paper":"/paper/2601.20720"},"observation_digest":"sha256:a379368147f2771e12a6b088dc252c62aab836d0d8c9433fc393481ad2854715","observation_id":"7b06148e-a0df-40a4-ba20-d46172b69610","resolution":{"observed_at":"2026-08-03T07:18:11.702506Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T07:18:11.825882Z","title":"Fast and furious: Real time end- to-end 3d detection, tracking and motion forecasting with a single convolutional net,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2601.20720","last_updated":"2026-07-20T17:11:32Z","snapshot_observed_at":"2026-08-05T23:53:07.554126Z","submitted_at":"2026-01-28T15:53:32Z","title":"Li-ViP3D++: Query-Gated Deformable Camera-LiDAR Fusion for End-to-End Perception and Trajectory Prediction","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-03T07:18:11.825882Z"},"links":{"citing_paper":"/paper/2601.20720"},"observation_digest":"sha256:ff7f730c7ba3cbb971ded2d4f4b93247fe4d410588c57779cc8d88f687e9f94d","observation_id":"bb997230-a5d3-4cab-9c5e-941a37cc1b87","resolution":{"observed_at":"2026-08-03T07:18:11.825882Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T07:18:11.973506Z","title":"Intentnet: Learning to predict intention from raw sensor data,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2601.20720","last_updated":"2026-07-20T17:11:32Z","snapshot_observed_at":"2026-08-05T23:53:07.554126Z","submitted_at":"2026-01-28T15:53:32Z","title":"Li-ViP3D++: Query-Gated Deformable Camera-LiDAR Fusion for End-to-End Perception and Trajectory Prediction","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-03T07:18:11.973506Z"},"links":{"citing_paper":"/paper/2601.20720"},"observation_digest":"sha256:7fbdb92b4e65026451f3ce87c5e19582d919542ac0526c40f6d3ed9a3fed7a3f","observation_id":"c77f471a-9d84-4a3b-bb8f-d170e9279039","resolution":{"observed_at":"2026-08-03T07:18:11.973506Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T07:18:12.026580Z","title":"Pnpnet: End-to-end perception and prediction with tracking in the loop,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2601.20720","last_updated":"2026-07-20T17:11:32Z","snapshot_observed_at":"2026-08-05T23:53:07.554126Z","submitted_at":"2026-01-28T15:53:32Z","title":"Li-ViP3D++: Query-Gated Deformable Camera-LiDAR Fusion for End-to-End Perception and Trajectory Prediction","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-03T07:18:12.026580Z"},"links":{"citing_paper":"/paper/2601.20720"},"observation_digest":"sha256:26a6c908185a033ea560abb25c7769ff117164a89f73a800418adad58b564e09","observation_id":"0a25815a-75b8-4843-ac7c-039b8ecaeee2","resolution":{"observed_at":"2026-08-03T07:18:12.026580Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T07:18:12.235822Z","title":"End-to-end interpretable neural motion planner,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2601.20720","last_updated":"2026-07-20T17:11:32Z","snapshot_observed_at":"2026-08-05T23:53:07.554126Z","submitted_at":"2026-01-28T15:53:32Z","title":"Li-ViP3D++: Query-Gated Deformable Camera-LiDAR Fusion for End-to-End Perception and Trajectory Prediction","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-03T07:18:12.235822Z"},"links":{"citing_paper":"/paper/2601.20720"},"observation_digest":"sha256:3b1b912547cc327dda349739490346235e023c5073d41a4bcac2d236c70e0565","observation_id":"461fcf43-bf31-4e6d-80f6-87d62e3464f2","resolution":{"observed_at":"2026-08-03T07:18:12.235822Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T07:18:12.370403Z","title":"Bevfusion: Multi-task multi-sensor fusion with unified bird’s-eye view representation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2601.20720","last_updated":"2026-07-20T17:11:32Z","snapshot_observed_at":"2026-08-05T23:53:07.554126Z","submitted_at":"2026-01-28T15:53:32Z","title":"Li-ViP3D++: Query-Gated Deformable Camera-LiDAR Fusion for End-to-End Perception and Trajectory Prediction","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-03T07:18:12.370403Z"},"links":{"citing_paper":"/paper/2601.20720"},"observation_digest":"sha256:af6b970c51891db5a9a5eafc3128c0573f9e2d47b171b5b437cf6e2f40ac9153","observation_id":"ea4bcd53-d12a-4318-b9a4-832befe4a716","resolution":{"observed_at":"2026-08-03T07:18:12.370403Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T07:18:12.518345Z","title":"Lift, splat, shoot: Encoding images from arbitrary camera rigs by implicitly unprojecting to 3d,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2601.20720","last_updated":"2026-07-20T17:11:32Z","snapshot_observed_at":"2026-08-05T23:53:07.554126Z","submitted_at":"2026-01-28T15:53:32Z","title":"Li-ViP3D++: Query-Gated Deformable Camera-LiDAR Fusion for End-to-End Perception and Trajectory Prediction","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-03T07:18:12.518345Z"},"links":{"citing_paper":"/paper/2601.20720"},"observation_digest":"sha256:799f9fbb8a8ea5943cd88cfaac39a21031d16d8d674a12cd2d88175fe474e6bd","observation_id":"4f54b488-4d82-4c96-807c-fa0fd3912d7b","resolution":{"observed_at":"2026-08-03T07:18:12.518345Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T07:18:12.681843Z","title":"Lgmmfusion: A lidar-guided multi-modal fusion framework for en- hanced 3d object detection,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.20720","last_updated":"2026-07-20T17:11:32Z","snapshot_observed_at":"2026-08-05T23:53:07.554126Z","submitted_at":"2026-01-28T15:53:32Z","title":"Li-ViP3D++: Query-Gated Deformable Camera-LiDAR Fusion for End-to-End Perception and Trajectory Prediction","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-03T07:18:12.681843Z"},"links":{"citing_paper":"/paper/2601.20720"},"observation_digest":"sha256:577b959af12361cf8950c91aefc99dd36356c8d98d764ec03e74a05d9d2da867","observation_id":"26fa7183-a344-4d4b-9045-1cb1fd47093f","resolution":{"observed_at":"2026-08-03T07:18:12.681843Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T07:18:12.808053Z","title":"Roboformer: A robust multi-modal transformer for 3d object detection in autonomous driving,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2601.20720","last_updated":"2026-07-20T17:11:32Z","snapshot_observed_at":"2026-08-05T23:53:07.554126Z","submitted_at":"2026-01-28T15:53:32Z","title":"Li-ViP3D++: Query-Gated Deformable Camera-LiDAR Fusion for End-to-End Perception and Trajectory Prediction","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-03T07:18:12.808053Z"},"links":{"citing_paper":"/paper/2601.20720"},"observation_digest":"sha256:f85590971626fdf2e0c0bace90c2907504016d6e0f50154678c5151af3c3d8fb","observation_id":"543dbfe0-1e8d-45d7-8dc3-e71598590fe9","resolution":{"observed_at":"2026-08-03T07:18:12.808053Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T07:18:12.901818Z","title":"Intrinsically explainable deep learning architecture for semantic seg- mentation of histological structures in heart tissue,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2601.20720","last_updated":"2026-07-20T17:11:32Z","snapshot_observed_at":"2026-08-05T23:53:07.554126Z","submitted_at":"2026-01-28T15:53:32Z","title":"Li-ViP3D++: Query-Gated Deformable Camera-LiDAR Fusion for End-to-End Perception and Trajectory Prediction","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-03T07:18:12.901818Z"},"links":{"citing_paper":"/paper/2601.20720"},"observation_digest":"sha256:3e6dbf037986b8dfcdbe85309238b868f1d1f6bef84a7a706db6d6e59545027e","observation_id":"816fad43-443e-4c59-aaed-098061e8fb90","resolution":{"observed_at":"2026-08-03T07:18:12.901818Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T07:18:13.037567Z","title":"Cafuser: Condition-aware multimodal fusion for robust semantic perception of driving scenes,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.20720","last_updated":"2026-07-20T17:11:32Z","snapshot_observed_at":"2026-08-05T23:53:07.554126Z","submitted_at":"2026-01-28T15:53:32Z","title":"Li-ViP3D++: Query-Gated Deformable Camera-LiDAR Fusion for End-to-End Perception and Trajectory Prediction","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-03T07:18:13.037567Z"},"links":{"citing_paper":"/paper/2601.20720"},"observation_digest":"sha256:9ef4e5e159e15f223e14e79ea368943cc2db66bb8ab452d548126db33afcf374","observation_id":"6158916a-4692-4b78-bf4a-38a761d957e2","resolution":{"observed_at":"2026-08-03T07:18:13.037567Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T07:18:13.204355Z","title":"nuscenes: A multimodal dataset for autonomous driving,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2601.20720","last_updated":"2026-07-20T17:11:32Z","snapshot_observed_at":"2026-08-05T23:53:07.554126Z","submitted_at":"2026-01-28T15:53:32Z","title":"Li-ViP3D++: Query-Gated Deformable Camera-LiDAR Fusion for End-to-End Perception and Trajectory Prediction","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-03T07:18:13.204355Z"},"links":{"citing_paper":"/paper/2601.20720"},"observation_digest":"sha256:089ee3d735f595e1e0c1531ddd6412b557b204623498fcb7a732c12d2cb3e610","observation_id":"ea80a45b-0784-45da-9621-51582eb1d0d7","resolution":{"observed_at":"2026-08-03T07:18:13.204355Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T07:18:13.317717Z","title":"Deep residual learning for image recognition,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2601.20720","last_updated":"2026-07-20T17:11:32Z","snapshot_observed_at":"2026-08-05T23:53:07.554126Z","submitted_at":"2026-01-28T15:53:32Z","title":"Li-ViP3D++: Query-Gated Deformable Camera-LiDAR Fusion for End-to-End Perception and Trajectory Prediction","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-03T07:18:13.317717Z"},"links":{"citing_paper":"/paper/2601.20720"},"observation_digest":"sha256:562c95cc32003cb2c1dd1e708b4e8a43c88c16e45291fc3d0735947af94f13b7","observation_id":"6ea9da1b-6c6f-4555-a8cd-fdbc03b8b4f0","resolution":{"observed_at":"2026-08-03T07:18:13.317717Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T07:18:13.364913Z","title":"Pointpillars: Fast encoders for object detection from point clouds,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2601.20720","last_updated":"2026-07-20T17:11:32Z","snapshot_observed_at":"2026-08-05T23:53:07.554126Z","submitted_at":"2026-01-28T15:53:32Z","title":"Li-ViP3D++: Query-Gated Deformable Camera-LiDAR Fusion for End-to-End Perception and Trajectory Prediction","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-03T07:18:13.364913Z"},"links":{"citing_paper":"/paper/2601.20720"},"observation_digest":"sha256:98b097fccb133f651127ca85d53345bc3a17236004a5b54b17b0abe4a19bbb54","observation_id":"ed508f42-e6ed-4bd5-b88b-b030284d9349","resolution":{"observed_at":"2026-08-03T07:18:13.364913Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T07:18:13.447293Z","title":"Motr: End-to-end multiple-object tracking with transformer,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2601.20720","last_updated":"2026-07-20T17:11:32Z","snapshot_observed_at":"2026-08-05T23:53:07.554126Z","submitted_at":"2026-01-28T15:53:32Z","title":"Li-ViP3D++: Query-Gated Deformable Camera-LiDAR Fusion for End-to-End Perception and Trajectory Prediction","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-03T07:18:13.447293Z"},"links":{"citing_paper":"/paper/2601.20720"},"observation_digest":"sha256:55237340e03bb20239f4396b34c28e397c50a51da03859125188843ccbc5c666","observation_id":"be32bded-a03e-47aa-9f6e-c95c0ddcc4ca","resolution":{"observed_at":"2026-08-03T07:18:13.447293Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T07:18:13.529114Z","title":"Vectornet: Encoding hd maps and agent dynamics from vectorized rep- resentation,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2601.20720","last_updated":"2026-07-20T17:11:32Z","snapshot_observed_at":"2026-08-05T23:53:07.554126Z","submitted_at":"2026-01-28T15:53:32Z","title":"Li-ViP3D++: Query-Gated Deformable Camera-LiDAR Fusion for End-to-End Perception and Trajectory Prediction","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-03T07:18:13.529114Z"},"links":{"citing_paper":"/paper/2601.20720"},"observation_digest":"sha256:c172c34c62b40c94ad85fde0a00ace5ecebbbc13071745170a8182149764bf24","observation_id":"cb1b743b-dbf3-473d-b6ec-1d14aa87f699","resolution":{"observed_at":"2026-08-03T07:18:13.529114Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2601.20720","last_updated":"2026-07-20T17:11:32Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-05T23:53:07.554126Z","submitted_at":"2026-01-28T15:53:32Z","title":"Li-ViP3D++: Query-Gated Deformable Camera-LiDAR Fusion for End-to-End Perception and Trajectory Prediction"},"reference_resolution":{"displayed":31,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":31,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":31},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 31 of 31 outbound references and 0 inbound Pith citation observations for arXiv:2601.20720."}