{"as_of":"2026-08-07T22:13:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9a4bd64ddf6d1ca0b209342325dc9d8d47590aab19ed2204b57c74c39cf52cde","coverage":[{"denominator":83,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":83,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T18:52:27.737199Z","state":"measured"},{"denominator":83,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":83,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2508.13995/citation-record","integrity":"/paper/2508.13995/integrity","json":"/paper/2508.13995/citation-record.json","paper":"/paper/2508.13995"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:52:24.729523Z","title":"Uno: Unsupervised occupancy fields for perception and forecasting","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.13995","last_updated":"2025-08-19T16:40:29Z","snapshot_observed_at":"2026-08-07T14:43:04.726857Z","submitted_at":"2025-08-19T16:40:29Z","title":"Self-Supervised Sparse Sensor Fusion for Long Range Perception","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T18:52:24.729523Z"},"links":{"citing_paper":"/paper/2508.13995"},"observation_digest":"sha256:f91ba909acd3c9e9f2ea9388a678895c0f3e3e07817274735e99cae277d54de3","observation_id":"1eee6d17-c040-4f69-a948-946178519fd7","resolution":{"observed_at":"2026-08-05T18:52:24.729523Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02073","last_updated":"2025-04-21T12:09:08Z","snapshot_observed_at":"2026-08-02T06:32:26.688405Z","submitted_at":"2024-10-02T22:42:20Z","title":"Depth Pro: Sharp Monocular Metric Depth in Less Than a Second","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.02073","snapshot_observed_at":"2026-08-05T18:52:24.848933Z","title":"Depth pro: Sharp monocular metric depth in less than a second","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.13995","last_updated":"2025-08-19T16:40:29Z","snapshot_observed_at":"2026-08-07T14:43:04.726857Z","submitted_at":"2025-08-19T16:40:29Z","title":"Self-Supervised Sparse Sensor Fusion for Long Range Perception","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-05T18:52:24.848933Z"},"links":{"cited_paper":"/paper/2410.02073","citing_paper":"/paper/2508.13995"},"observation_digest":"sha256:eaa89e266d5b2c17556fd468dccb34bcb4b02197e45a25b7dfa0763d5d123fe0","observation_id":"dca6c33d-754f-4376-8e9f-3e71dc6faaa8","resolution":{"observed_at":"2026-08-05T18:52:24.848933Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:52:24.929704Z","title":"Also: Automotive lidar self- supervision by occupancy estimation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.13995","last_updated":"2025-08-19T16:40:29Z","snapshot_observed_at":"2026-08-07T14:43:04.726857Z","submitted_at":"2025-08-19T16:40:29Z","title":"Self-Supervised Sparse Sensor Fusion for Long Range Perception","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-05T18:52:24.929704Z"},"links":{"citing_paper":"/paper/2508.13995"},"observation_digest":"sha256:df86b33b4b289ef4f18cf0e81bfec22f7e3fb114f6aa61ee34a40a8ea1cb42d9","observation_id":"c3f70d51-4616-4349-a7e3-a1a60f8095e5","resolution":{"observed_at":"2026-08-05T18:52:24.929704Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:52:24.987686Z","title":"Cross-spectral gated-rgb stereo depth estimation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.13995","last_updated":"2025-08-19T16:40:29Z","snapshot_observed_at":"2026-08-07T14:43:04.726857Z","submitted_at":"2025-08-19T16:40:29Z","title":"Self-Supervised Sparse Sensor Fusion for Long Range Perception","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T18:52:24.987686Z"},"links":{"citing_paper":"/paper/2508.13995"},"observation_digest":"sha256:a449b1bdd7eb9c8d6aa3de198000d7b042705a6eaf050b4d9ef8ac1269d65a83","observation_id":"a59f47bf-3cdb-4b7a-8434-27e1d7850b57","resolution":{"observed_at":"2026-08-05T18:52:24.987686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:52:28.738750Z","title":"Lang, Sourabh V ora, Venice Erin Liong, Qiang Xu, Anush Krishnan, Yu Pan, Gi- ancarlo Baldan, and Oscar Beijbom","venue":null,"work_id":"e6493935-880f-4491-a7ea-20795fb2ebc2","year":2020},"citing_paper":{"arxiv_id":"2508.13995","last_updated":"2025-08-19T16:40:29Z","snapshot_observed_at":"2026-08-07T14:43:04.726857Z","submitted_at":"2025-08-19T16:40:29Z","title":"Self-Supervised Sparse Sensor Fusion for Long Range Perception","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T18:52:25.028613Z"},"links":{"citing_paper":"/paper/2508.13995"},"observation_digest":"sha256:60222a481add84f660fe30b3f80d4cc3a51dcdf7e46b7b10ec4b41feb450e921","observation_id":"e2147bb3-aedd-44a3-90be-101715aadb72","resolution":{"observed_at":"2026-08-05T18:52:28.742466Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.17099","last_updated":"2023-03-30T02:18:07Z","snapshot_observed_at":"2026-07-06T15:09:53.824070Z","submitted_at":"2023-03-30T02:18:07Z","title":"BEVFusion4D: Learning LiDAR-Camera Fusion Under Bird's-Eye-View via Cross-Modality Guidance and Temporal Aggregation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.17099","snapshot_observed_at":"2026-08-05T18:52:25.144131Z","title":"Bevfusion4d: Learn- ing lidar-camera fusion under bird’s-eye-view via cross- modality guidance and temporal aggregation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.13995","last_updated":"2025-08-19T16:40:29Z","snapshot_observed_at":"2026-08-07T14:43:04.726857Z","submitted_at":"2025-08-19T16:40:29Z","title":"Self-Supervised Sparse Sensor Fusion for Long Range Perception","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-05T18:52:25.144131Z"},"links":{"cited_paper":"/paper/2303.17099","citing_paper":"/paper/2508.13995"},"observation_digest":"sha256:cc5af68d829a09f432664a18581744fdf31b27f30a02676ea86ac742826fccb0","observation_id":"440ee4ea-6653-4886-897c-65094a7938e8","resolution":{"observed_at":"2026-08-05T18:52:25.144131Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:52:28.726416Z","title":"Monoscene: Monoc- ular 3d semantic scene completion","venue":null,"work_id":"936d1ddf-ccb5-489b-9c83-368ce22a97c1","year":2022},"citing_paper":{"arxiv_id":"2508.13995","last_updated":"2025-08-19T16:40:29Z","snapshot_observed_at":"2026-08-07T14:43:04.726857Z","submitted_at":"2025-08-19T16:40:29Z","title":"Self-Supervised Sparse Sensor Fusion for Long Range Perception","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T18:52:25.261019Z"},"links":{"citing_paper":"/paper/2508.13995"},"observation_digest":"sha256:2657d2a3012f4d080eab76e3b33636155e5a49d419779ae1dc8c5af8ee157a02","observation_id":"61e1e338-26cf-46fa-bce8-c713e1a8f2e8","resolution":{"observed_at":"2026-08-05T18:52:28.730198Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:52:28.714241Z","title":"Ar- goverse: 3d tracking and forecasting with rich maps","venue":null,"work_id":"f41d9ff3-0206-4913-ab07-ed26484f2a35","year":2019},"citing_paper":{"arxiv_id":"2508.13995","last_updated":"2025-08-19T16:40:29Z","snapshot_observed_at":"2026-08-07T14:43:04.726857Z","submitted_at":"2025-08-19T16:40:29Z","title":"Self-Supervised Sparse Sensor Fusion for Long Range Perception","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T18:52:25.345862Z"},"links":{"citing_paper":"/paper/2508.13995"},"observation_digest":"sha256:23af18620501a0bd6780c6baaccac95df402a76236e526b6fb8286f5df4f2c9c","observation_id":"d76194d3-f969-4299-a7ce-1127e98a06ec","resolution":{"observed_at":"2026-08-05T18:52:28.718068Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2003.04297","last_updated":"2020-03-09T17:56:49Z","snapshot_observed_at":"2026-07-06T09:03:25.467987Z","submitted_at":"2020-03-09T17:56:49Z","title":"Improved Baselines with Momentum Contrastive Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2003.04297","snapshot_observed_at":"2026-08-05T18:52:25.425562Z","title":"Improved baselines with momentum contrastive learning","venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2508.13995","last_updated":"2025-08-19T16:40:29Z","snapshot_observed_at":"2026-08-07T14:43:04.726857Z","submitted_at":"2025-08-19T16:40:29Z","title":"Self-Supervised Sparse Sensor Fusion for Long Range Perception","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T18:52:25.425562Z"},"links":{"cited_paper":"/paper/2003.04297","citing_paper":"/paper/2508.13995"},"observation_digest":"sha256:3d4424ecc01773e815606a313cc078eef6ddc09adb7a719c0f9ed9947fa06e8a","observation_id":"a7c15fc0-87eb-4f0b-b647-3e74c9dc49b8","resolution":{"observed_at":"2026-08-05T18:52:25.425562Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04805","last_updated":"2019-05-24T20:37:26Z","snapshot_observed_at":"2026-07-30T09:12:38.100527Z","submitted_at":"2018-10-11T00:50:01Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.04805","snapshot_observed_at":"2026-08-05T18:52:25.538703Z","title":"Bert: Pre-training of deep bidirectional transformers for language understanding","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2508.13995","last_updated":"2025-08-19T16:40:29Z","snapshot_observed_at":"2026-08-07T14:43:04.726857Z","submitted_at":"2025-08-19T16:40:29Z","title":"Self-Supervised Sparse Sensor Fusion for Long Range Perception","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T18:52:25.538703Z"},"links":{"cited_paper":"/paper/1810.04805","citing_paper":"/paper/2508.13995"},"observation_digest":"sha256:179766e9c63f96f7834482cd222f721d07f64a33e34c6b2c73d9f47e84aaff62","observation_id":"ebf39916-0a2c-4378-99e0-31022a440a85","resolution":{"observed_at":"2026-08-05T18:52:25.538703Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:52:28.701825Z","title":"Are we ready for autonomous driving? the kitti vision benchmark suite","venue":null,"work_id":"569aed08-d19d-4b37-a164-71ccda486f40","year":2012},"citing_paper":{"arxiv_id":"2508.13995","last_updated":"2025-08-19T16:40:29Z","snapshot_observed_at":"2026-08-07T14:43:04.726857Z","submitted_at":"2025-08-19T16:40:29Z","title":"Self-Supervised Sparse Sensor Fusion for Long Range Perception","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T18:52:25.619955Z"},"links":{"citing_paper":"/paper/2508.13995"},"observation_digest":"sha256:07d8d6e729585474da8741b9cf907b27113f3c4a827980ad0eafa87dc203c8d2","observation_id":"0545821a-594f-46ad-8296-c2d28077b8e0","resolution":{"observed_at":"2026-08-05T18:52:28.705902Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:52:28.687943Z","title":"Vip3d: End-to-end visual trajectory prediction via 3d agent queries","venue":null,"work_id":"652f21dd-e6ff-4426-a173-114982b977df","year":2023},"citing_paper":{"arxiv_id":"2508.13995","last_updated":"2025-08-19T16:40:29Z","snapshot_observed_at":"2026-08-07T14:43:04.726857Z","submitted_at":"2025-08-19T16:40:29Z","title":"Self-Supervised Sparse Sensor Fusion for Long Range Perception","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T18:52:25.680615Z"},"links":{"citing_paper":"/paper/2508.13995"},"observation_digest":"sha256:45e8b9f0b5dbc85dec41463c859269e98767a50fd8c8af98ee94ea44dbefb057","observation_id":"59bec3da-a7a2-4ed4-866b-09c0ec3de293","resolution":{"observed_at":"2026-08-05T18:52:28.692214Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:52:28.674340Z","title":"Momentum contrast for unsupervised visual rep- resentation learning","venue":null,"work_id":"1f1aacb5-6bff-4992-92f9-0d6229c8a04e","year":2020},"citing_paper":{"arxiv_id":"2508.13995","last_updated":"2025-08-19T16:40:29Z","snapshot_observed_at":"2026-08-07T14:43:04.726857Z","submitted_at":"2025-08-19T16:40:29Z","title":"Self-Supervised Sparse Sensor Fusion for Long Range Perception","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T18:52:25.750438Z"},"links":{"citing_paper":"/paper/2508.13995"},"observation_digest":"sha256:7e5c1d06e7b95955c086719ec4784ed3910b38fbf4b5aec22e75a416210aa0a3","observation_id":"c1cbee74-f6bc-4b9b-8b90-0a5a3c43d28b","resolution":{"observed_at":"2026-08-05T18:52:28.678321Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:52:28.661543Z","title":"Masked autoencoders are scalable vision learners","venue":null,"work_id":"5f6180b0-d5ce-4888-be78-ea12fcebdb9b","year":2022},"citing_paper":{"arxiv_id":"2508.13995","last_updated":"2025-08-19T16:40:29Z","snapshot_observed_at":"2026-08-07T14:43:04.726857Z","submitted_at":"2025-08-19T16:40:29Z","title":"Self-Supervised Sparse Sensor Fusion for Long Range Perception","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-05T18:52:25.848995Z"},"links":{"citing_paper":"/paper/2508.13995"},"observation_digest":"sha256:927141f344445492c767843f5e652953b9e32f3de6b2b68b08730beed2d77653","observation_id":"636e66ca-72b8-436e-9d84-bf1e3406da41","resolution":{"observed_at":"2026-08-05T18:52:28.665227Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:52:28.648865Z","title":"Masked autoencoder for self-supervised pre-training on lidar point clouds","venue":null,"work_id":"07a348d2-30db-4e9c-9626-55f2f1ac53e1","year":2023},"citing_paper":{"arxiv_id":"2508.13995","last_updated":"2025-08-19T16:40:29Z","snapshot_observed_at":"2026-08-07T14:43:04.726857Z","submitted_at":"2025-08-19T16:40:29Z","title":"Self-Supervised Sparse Sensor Fusion for Long Range Perception","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-05T18:52:25.929141Z"},"links":{"citing_paper":"/paper/2508.13995"},"observation_digest":"sha256:32d73b627dbde055a8a06baaa38cf14faf9bff143a2f7774d888fc2def3280a6","observation_id":"69fa5e09-b702-4bc3-a1ba-25cb2133dd00","resolution":{"observed_at":"2026-08-05T18:52:28.652872Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:52:28.636631Z","title":"Planning-oriented autonomous driving","venue":null,"work_id":"ec4b29cd-61da-45a3-9e77-de9cb305483d","year":2023},"citing_paper":{"arxiv_id":"2508.13995","last_updated":"2025-08-19T16:40:29Z","snapshot_observed_at":"2026-08-07T14:43:04.726857Z","submitted_at":"2025-08-19T16:40:29Z","title":"Self-Supervised Sparse Sensor Fusion for Long Range Perception","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-05T18:52:26.010895Z"},"links":{"citing_paper":"/paper/2508.13995"},"observation_digest":"sha256:2fb73485ed8fe35b3e745cdaa9b7f747fd6de81327a423af9efbcbebc7c183d4","observation_id":"478f47d2-885b-4cfc-adfc-c37cefa90d58","resolution":{"observed_at":"2026-08-05T18:52:28.640392Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:52:28.623859Z","title":"Tri-perspective view for vision- based 3d semantic occupancy prediction","venue":null,"work_id":"25ef3bbf-280c-4b96-857c-9fe4b6860628","year":2023},"citing_paper":{"arxiv_id":"2508.13995","last_updated":"2025-08-19T16:40:29Z","snapshot_observed_at":"2026-08-07T14:43:04.726857Z","submitted_at":"2025-08-19T16:40:29Z","title":"Self-Supervised Sparse Sensor Fusion for Long Range Perception","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-05T18:52:26.093402Z"},"links":{"citing_paper":"/paper/2508.13995"},"observation_digest":"sha256:cf1f7f99edf0f9f7205d4fe03b8504ab8c15a43864f9617dd4efd215a08754ea","observation_id":"7b31fd1e-5ae4-4334-ae76-fce200bd32d9","resolution":{"observed_at":"2026-08-05T18:52:28.627811Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:52:26.194192Z","title":"Selfocc: Self-supervised vision-based 3d oc- cupancy prediction","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.13995","last_updated":"2025-08-19T16:40:29Z","snapshot_observed_at":"2026-08-07T14:43:04.726857Z","submitted_at":"2025-08-19T16:40:29Z","title":"Self-Supervised Sparse Sensor Fusion for Long Range Perception","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-05T18:52:26.194192Z"},"links":{"citing_paper":"/paper/2508.13995"},"observation_digest":"sha256:fa54a8d053a92096954947e0a7217c3cc142f7a5ae41c50b6cbab669313a7f1a","observation_id":"5d2f8049-a0a9-4719-9811-38c4cf7a3871","resolution":{"observed_at":"2026-08-05T18:52:26.194192Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.17429","last_updated":"2024-05-27T17:59:51Z","snapshot_observed_at":"2026-08-07T00:24:39.148285Z","submitted_at":"2024-05-27T17:59:51Z","title":"GaussianFormer: Scene as Gaussians for Vision-Based 3D Semantic Occupancy Prediction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.17429","snapshot_observed_at":"2026-08-05T18:52:26.284839Z","title":"Gaussianformer: Scene as gaussians for vision-based 3d semantic occupancy prediction","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.13995","last_updated":"2025-08-19T16:40:29Z","snapshot_observed_at":"2026-08-07T14:43:04.726857Z","submitted_at":"2025-08-19T16:40:29Z","title":"Self-Supervised Sparse Sensor Fusion for Long Range Perception","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-05T18:52:26.284839Z"},"links":{"cited_paper":"/paper/2405.17429","citing_paper":"/paper/2508.13995"},"observation_digest":"sha256:8a659a71c1089a3b6b7c5544e79465fec7e7f9affc0d8db333feaf43c4e8fff9","observation_id":"cc4209f8-ef46-42e2-90cf-d11f8c9c5e40","resolution":{"observed_at":"2026-08-05T18:52:26.284839Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:52:28.602007Z","title":"Driveadapter: Breaking the coupling barrier of perception and planning in end-to-end autonomous driving","venue":null,"work_id":"d29d6222-7353-41d8-9b59-8f71cfe4d67d","year":2023},"citing_paper":{"arxiv_id":"2508.13995","last_updated":"2025-08-19T16:40:29Z","snapshot_observed_at":"2026-08-07T14:43:04.726857Z","submitted_at":"2025-08-19T16:40:29Z","title":"Self-Supervised Sparse Sensor Fusion for Long Range Perception","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-05T18:52:26.364396Z"},"links":{"citing_paper":"/paper/2508.13995"},"observation_digest":"sha256:061f446ac0d3c4b6eb32130afa70e30ec385784feb848f4629717b8c542db4f4","observation_id":"1815ad2e-48a3-4ee9-b4eb-8b6fd469f6e0","resolution":{"observed_at":"2026-08-05T18:52:28.606470Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:52:28.589155Z","title":"Think twice be- fore driving: Towards scalable decoders for end-to-end au- tonomous driving","venue":null,"work_id":"7c1f0b2d-749d-436e-b964-929aba2cb8d3","year":2023},"citing_paper":{"arxiv_id":"2508.13995","last_updated":"2025-08-19T16:40:29Z","snapshot_observed_at":"2026-08-07T14:43:04.726857Z","submitted_at":"2025-08-19T16:40:29Z","title":"Self-Supervised Sparse Sensor Fusion for Long Range Perception","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-05T18:52:26.440658Z"},"links":{"citing_paper":"/paper/2508.13995"},"observation_digest":"sha256:2f5c22adba94ea227c9420fbce09c491a05d2791585a0d9641a981660fa048a1","observation_id":"d01e81b0-3e9c-4143-8412-e74e015b6c7d","resolution":{"observed_at":"2026-08-05T18:52:28.593166Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:52:28.576903Z","title":"Vad: Vectorized scene representa- tion for efficient autonomous driving","venue":null,"work_id":"9aad83f1-0deb-49ba-b325-e8214bf0b937","year":2023},"citing_paper":{"arxiv_id":"2508.13995","last_updated":"2025-08-19T16:40:29Z","snapshot_observed_at":"2026-08-07T14:43:04.726857Z","submitted_at":"2025-08-19T16:40:29Z","title":"Self-Supervised Sparse Sensor Fusion for Long Range Perception","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-05T18:52:26.548285Z"},"links":{"citing_paper":"/paper/2508.13995"},"observation_digest":"sha256:ed194fea6312da8685af720ff60109c143b1f2864c50ff7cff581ac3600f80ed","observation_id":"5bba81a6-494f-49e2-9744-e89f31e87d50","resolution":{"observed_at":"2026-08-05T18:52:28.580649Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:52:26.646295Z","title":"Supervised contrastive learning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.13995","last_updated":"2025-08-19T16:40:29Z","snapshot_observed_at":"2026-08-07T14:43:04.726857Z","submitted_at":"2025-08-19T16:40:29Z","title":"Self-Supervised Sparse Sensor Fusion for Long Range Perception","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-05T18:52:26.646295Z"},"links":{"citing_paper":"/paper/2508.13995"},"observation_digest":"sha256:d98b26ec0b00997c75e6c8c054b72b8d018633f60963925e6e7a4ba821fa2be2","observation_id":"e01d680f-a309-4c1b-a583-a55575e01fc7","resolution":{"observed_at":"2026-08-05T18:52:26.646295Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:52:28.556214Z","title":"Point cloud forecasting as a proxy for 4d occupancy forecasting, 2023","venue":null,"work_id":"63d6ef1d-c5d0-4488-b521-c8b025cc8e15","year":2023},"citing_paper":{"arxiv_id":"2508.13995","last_updated":"2025-08-19T16:40:29Z","snapshot_observed_at":"2026-08-07T14:43:04.726857Z","submitted_at":"2025-08-19T16:40:29Z","title":"Self-Supervised Sparse Sensor Fusion for Long Range Perception","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-05T18:52:26.763011Z"},"links":{"citing_paper":"/paper/2508.13995"},"observation_digest":"sha256:da222bc9ff49b37909604b09bf8f82cbf32da480cecef5ea5ce2497257eb6018","observation_id":"130dd389-619f-40ba-bf0d-94654943ff8d","resolution":{"observed_at":"2026-08-05T18:52:28.560123Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:52:28.543713Z","title":"In defense of classical image processing: Fast depth completion on the cpu","venue":null,"work_id":"e2b1fc98-4198-468f-a33a-efc0dea215d5","year":2018},"citing_paper":{"arxiv_id":"2508.13995","last_updated":"2025-08-19T16:40:29Z","snapshot_observed_at":"2026-08-07T14:43:04.726857Z","submitted_at":"2025-08-19T16:40:29Z","title":"Self-Supervised Sparse Sensor Fusion for Long Range Perception","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-05T18:52:26.795741Z"},"links":{"citing_paper":"/paper/2508.13995"},"observation_digest":"sha256:7db817dc3b9101e11f3c9ed3d971d386b7a99bb0a80887d2d873f0cb948c9f79","observation_id":"7adf68c9-2496-45a4-bd0e-e01bb62fb011","resolution":{"observed_at":"2026-08-05T18:52:28.547879Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:52:28.531572Z","title":"Pointpillars: Fast encoders for object detection from point clouds","venue":null,"work_id":"47b0dfc3-2210-43e5-ae3e-9a3207d05dc5","year":2019},"citing_paper":{"arxiv_id":"2508.13995","last_updated":"2025-08-19T16:40:29Z","snapshot_observed_at":"2026-08-07T14:43:04.726857Z","submitted_at":"2025-08-19T16:40:29Z","title":"Self-Supervised Sparse Sensor Fusion for Long Range Perception","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-05T18:52:26.897605Z"},"links":{"citing_paper":"/paper/2508.13995"},"observation_digest":"sha256:56cc67a2e0c5c282ab7a8ca4aba7e4f1b27fc905ba871d7798402f891db69529","observation_id":"bd4736ca-fbae-4749-ae86-105af0b736ee","resolution":{"observed_at":"2026-08-05T18:52:28.535225Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2107.06307","last_updated":"2022-03-18T08:15:56Z","snapshot_observed_at":"2026-08-05T09:30:42.951825Z","submitted_at":"2021-07-13T18:06:46Z","title":"HDMapNet: An Online HD Map Construction and Evaluation Framework","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.06307","snapshot_observed_at":"2026-08-05T18:52:27.019756Z","title":"Hdmapnet: An online HD map construction and evaluation framework","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.13995","last_updated":"2025-08-19T16:40:29Z","snapshot_observed_at":"2026-08-07T14:43:04.726857Z","submitted_at":"2025-08-19T16:40:29Z","title":"Self-Supervised Sparse Sensor Fusion for Long Range Perception","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-05T18:52:27.019756Z"},"links":{"cited_paper":"/paper/2107.06307","citing_paper":"/paper/2508.13995"},"observation_digest":"sha256:3f0ade9fe534fe398ee87b2aa0c611813243bc39842768104d2a2d20e66185aa","observation_id":"b0ecae73-2bfa-4c28-8776-aa8eba2d81d5","resolution":{"observed_at":"2026-08-05T18:52:27.019756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:52:28.519250Z","title":"Unifying voxel-based representation with transformer for 3d object detection","venue":null,"work_id":"928ae467-3794-4416-96df-13c945c03f05","year":2022},"citing_paper":{"arxiv_id":"2508.13995","last_updated":"2025-08-19T16:40:29Z","snapshot_observed_at":"2026-08-07T14:43:04.726857Z","submitted_at":"2025-08-19T16:40:29Z","title":"Self-Supervised Sparse Sensor Fusion for Long Range Perception","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-05T18:52:27.160797Z"},"links":{"citing_paper":"/paper/2508.13995"},"observation_digest":"sha256:e18d63b2c968fef9364e56337bb7274d8d9198795a41df0e246a63743e710876","observation_id":"61f97867-cca1-438c-bf08-ccf84bd85a30","resolution":{"observed_at":"2026-08-05T18:52:28.523515Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:52:28.507789Z","title":"Fully sparse fusion for 3d object detection","venue":null,"work_id":"d0aa98a7-59c7-47a3-93af-52225ce2cbc5","year":2024},"citing_paper":{"arxiv_id":"2508.13995","last_updated":"2025-08-19T16:40:29Z","snapshot_observed_at":"2026-08-07T14:43:04.726857Z","submitted_at":"2025-08-19T16:40:29Z","title":"Self-Supervised Sparse Sensor Fusion for Long Range Perception","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-05T18:52:27.308011Z"},"links":{"citing_paper":"/paper/2508.13995"},"observation_digest":"sha256:af10695840e9b38e6612bd8ef412bacbe9419cf42d11d4fbd5e307dc00a06a50","observation_id":"cc4a4fee-af4a-4075-8aac-e0715361b87a","resolution":{"observed_at":"2026-08-05T18:52:28.511409Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:52:28.495327Z","title":"Bevformer: Learning bird’s-eye-view representation from multi-camera images via spatiotemporal transformers","venue":null,"work_id":"e35d062d-086a-4226-bcf6-b461070befea","year":2022},"citing_paper":{"arxiv_id":"2508.13995","last_updated":"2025-08-19T16:40:29Z","snapshot_observed_at":"2026-08-07T14:43:04.726857Z","submitted_at":"2025-08-19T16:40:29Z","title":"Self-Supervised Sparse Sensor Fusion for Long Range Perception","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-05T18:52:27.450332Z"},"links":{"citing_paper":"/paper/2508.13995"},"observation_digest":"sha256:6c7b3494a94422763d08804910c03f55527ca166037f945c628b1adfa90d1887","observation_id":"5675a01f-c119-4216-b44c-93eb6abdd98a","resolution":{"observed_at":"2026-08-05T18:52:28.499361Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:52:28.483353Z","title":"Bevfusion: A simple and robust lidar-camera fusion framework","venue":null,"work_id":"3523f259-6124-42b0-95be-926969e6e421","year":2022},"citing_paper":{"arxiv_id":"2508.13995","last_updated":"2025-08-19T16:40:29Z","snapshot_observed_at":"2026-08-07T14:43:04.726857Z","submitted_at":"2025-08-19T16:40:29Z","title":"Self-Supervised Sparse Sensor Fusion for Long Range Perception","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-05T18:52:27.547023Z"},"links":{"citing_paper":"/paper/2508.13995"},"observation_digest":"sha256:65d0c505cafb26dbd6731d62ddb1f2493bd2a449f46946a1c6ab9bafde434b37","observation_id":"367926e5-a4a6-4d3d-9c02-cb04a810c4af","resolution":{"observed_at":"2026-08-05T18:52:28.487141Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:52:28.471035Z","title":"Feature pyramid networks for object detection","venue":null,"work_id":"97e57100-d141-4eb4-be50-38b0f2528f3e","year":2017},"citing_paper":{"arxiv_id":"2508.13995","last_updated":"2025-08-19T16:40:29Z","snapshot_observed_at":"2026-08-07T14:43:04.726857Z","submitted_at":"2025-08-19T16:40:29Z","title":"Self-Supervised Sparse Sensor Fusion for Long Range Perception","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-05T18:52:27.550947Z"},"links":{"citing_paper":"/paper/2508.13995"},"observation_digest":"sha256:e06719d20802548828c9997f69f5100ff148fce90e20a21aa2e5fc730b6df934","observation_id":"883a59d8-422b-4908-8be1-96fdae0afc0c","resolution":{"observed_at":"2026-08-05T18:52:28.474847Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:52:28.458926Z","title":"Raft-stereo: Multilevel recurrent field transforms for stereo matching","venue":null,"work_id":"ff6948a5-8743-4739-b6df-2329acaba95d","year":2021},"citing_paper":{"arxiv_id":"2508.13995","last_updated":"2025-08-19T16:40:29Z","snapshot_observed_at":"2026-08-07T14:43:04.726857Z","submitted_at":"2025-08-19T16:40:29Z","title":"Self-Supervised Sparse Sensor Fusion for Long Range Perception","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-05T18:52:27.554581Z"},"links":{"citing_paper":"/paper/2508.13995"},"observation_digest":"sha256:38db20b4ed01c06f33ee28fd8203bfaa873eb92b62426db197c2b88da7d85aba","observation_id":"3d8de1a0-2b77-468a-9344-08c48a23f5eb","resolution":{"observed_at":"2026-08-05T18:52:28.462774Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:52:28.446715Z","title":"Sparsebev: High-performance sparse 3d object de- tection from multi-camera videos","venue":null,"work_id":"05eaf23f-767e-4b35-9d26-341c9a92009d","year":2023},"citing_paper":{"arxiv_id":"2508.13995","last_updated":"2025-08-19T16:40:29Z","snapshot_observed_at":"2026-08-07T14:43:04.726857Z","submitted_at":"2025-08-19T16:40:29Z","title":"Self-Supervised Sparse Sensor Fusion for Long Range Perception","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-05T18:52:27.558262Z"},"links":{"citing_paper":"/paper/2508.13995"},"observation_digest":"sha256:5180586ae9a9c20b47aacc79287cd97f1d98d378db588683037da01638549408","observation_id":"10344968-eb30-49d8-9c3d-7e345cd1b764","resolution":{"observed_at":"2026-08-05T18:52:28.450741Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:52:28.434341Z","title":"Petrv2: A unified framework for 3d perception from multi-camera images","venue":null,"work_id":"7589b915-e41f-4c9b-8dbe-6184e31b2d20","year":2023},"citing_paper":{"arxiv_id":"2508.13995","last_updated":"2025-08-19T16:40:29Z","snapshot_observed_at":"2026-08-07T14:43:04.726857Z","submitted_at":"2025-08-19T16:40:29Z","title":"Self-Supervised Sparse Sensor Fusion for Long Range Perception","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-05T18:52:27.561730Z"},"links":{"citing_paper":"/paper/2508.13995"},"observation_digest":"sha256:f5745e9133ad3f90c7aeff9ed009673682428d85ac7294b145f0acdde64f94ed","observation_id":"15e45356-94ab-4cf2-a4df-5c0949d078fc","resolution":{"observed_at":"2026-08-05T18:52:28.438297Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:52:28.421917Z","title":"Bevfusion: Multi-task multi-sensor fusion with unified bird’s-eye view representation","venue":null,"work_id":"d80fee2a-37d6-4232-a9d3-3d87e643fc98","year":2023},"citing_paper":{"arxiv_id":"2508.13995","last_updated":"2025-08-19T16:40:29Z","snapshot_observed_at":"2026-08-07T14:43:04.726857Z","submitted_at":"2025-08-19T16:40:29Z","title":"Self-Supervised Sparse Sensor Fusion for Long Range Perception","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-05T18:52:27.565213Z"},"links":{"citing_paper":"/paper/2508.13995"},"observation_digest":"sha256:8f38c5c1ea85fba07393a2e018fc83a438ace33584bea2ba2c40e94da5aa479f","observation_id":"e54dc721-0d74-41d4-9e80-8df5414ede57","resolution":{"observed_at":"2026-08-05T18:52:28.426309Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:52:28.409229Z","title":"One million scenes for autonomous driving: Once dataset,","venue":null,"work_id":"096f978d-51ba-47b6-b64b-7380c4cc116c","year":null},"citing_paper":{"arxiv_id":"2508.13995","last_updated":"2025-08-19T16:40:29Z","snapshot_observed_at":"2026-08-07T14:43:04.726857Z","submitted_at":"2025-08-19T16:40:29Z","title":"Self-Supervised Sparse Sensor Fusion for Long Range Perception","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-05T18:52:27.569272Z"},"links":{"citing_paper":"/paper/2508.13995"},"observation_digest":"sha256:4290f20d1a28c6c728aae74ff01354d4092266cecc3d6bbaa4c1c5c5609c41da","observation_id":"116c045a-c47e-466d-a5dd-b964415e45bc","resolution":{"observed_at":"2026-08-05T18:52:28.413133Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.07193","last_updated":"2024-02-02T10:24:09Z","snapshot_observed_at":"2026-08-06T05:58:29.182448Z","submitted_at":"2023-04-14T15:12:19Z","title":"DINOv2: Learning Robust Visual Features without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.07193","snapshot_observed_at":"2026-08-05T18:52:27.573265Z","title":"Dinov2: Learning robust visual features without supervision","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.13995","last_updated":"2025-08-19T16:40:29Z","snapshot_observed_at":"2026-08-07T14:43:04.726857Z","submitted_at":"2025-08-19T16:40:29Z","title":"Self-Supervised Sparse Sensor Fusion for Long Range Perception","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-05T18:52:27.573265Z"},"links":{"cited_paper":"/paper/2304.07193","citing_paper":"/paper/2508.13995"},"observation_digest":"sha256:39502886da5119b371aab85e5d30547d547ef0c3910f46b35314396a20dd2365","observation_id":"601a9628-f168-48c7-99bc-dcdc9d0616a7","resolution":{"observed_at":"2026-08-05T18:52:27.573265Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:52:28.395830Z","title":"Samfusion: Sensor-adaptive multi- modal fusion for 3d object detection in adverse weather","venue":null,"work_id":"f4a6812b-de58-412e-b445-d4b69c38f107","year":2024},"citing_paper":{"arxiv_id":"2508.13995","last_updated":"2025-08-19T16:40:29Z","snapshot_observed_at":"2026-08-07T14:43:04.726857Z","submitted_at":"2025-08-19T16:40:29Z","title":"Self-Supervised Sparse Sensor Fusion for Long Range Perception","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-05T18:52:27.577230Z"},"links":{"citing_paper":"/paper/2508.13995"},"observation_digest":"sha256:a449bb6c638f410cdc83c8f9ec710c4192e3c8d6f81f19572bd5d8e0df7201f8","observation_id":"1f0e6496-1084-4255-8e6c-ab502edf5d23","resolution":{"observed_at":"2026-08-05T18:52:28.399797Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:52:28.383656Z","title":"Non-local spatial propagation network for depth completion","venue":null,"work_id":"7d2b8f3c-593a-4233-91ae-ff816203aa01","year":2020},"citing_paper":{"arxiv_id":"2508.13995","last_updated":"2025-08-19T16:40:29Z","snapshot_observed_at":"2026-08-07T14:43:04.726857Z","submitted_at":"2025-08-19T16:40:29Z","title":"Self-Supervised Sparse Sensor Fusion for Long Range Perception","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-05T18:52:27.580892Z"},"links":{"citing_paper":"/paper/2508.13995"},"observation_digest":"sha256:312bdac940d4ab0c9bb01304dc94036452624fcb0e5734ad6298f2d128080202","observation_id":"a050477f-e3ea-41c1-b643-f21e2a5b764d","resolution":{"observed_at":"2026-08-05T18:52:28.387471Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:52:28.371499Z","title":"Bevsegformer: Bird’s eye view semantic segmentation from arbitrary camera rigs, 2022","venue":null,"work_id":"e089e112-915d-4b43-86e7-0ef8413f61a8","year":2022},"citing_paper":{"arxiv_id":"2508.13995","last_updated":"2025-08-19T16:40:29Z","snapshot_observed_at":"2026-08-07T14:43:04.726857Z","submitted_at":"2025-08-19T16:40:29Z","title":"Self-Supervised Sparse Sensor Fusion for Long Range Perception","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-05T18:52:27.584588Z"},"links":{"citing_paper":"/paper/2508.13995"},"observation_digest":"sha256:480f9f48bf239405adbf20fa675c58e653fafb633042db0532d64a7237d0d663","observation_id":"25118cb0-95c8-4445-b43c-59063556a8f3","resolution":{"observed_at":"2026-08-05T18:52:28.375394Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:52:28.358086Z","title":"Lift, splat, shoot: Encod- ing images from arbitrary camera rigs by implicitly unpro- jecting to 3d","venue":null,"work_id":"407ff4e0-ec13-4b53-aac4-ae413e17db57","year":2020},"citing_paper":{"arxiv_id":"2508.13995","last_updated":"2025-08-19T16:40:29Z","snapshot_observed_at":"2026-08-07T14:43:04.726857Z","submitted_at":"2025-08-19T16:40:29Z","title":"Self-Supervised Sparse Sensor Fusion for Long Range Perception","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-05T18:52:27.588126Z"},"links":{"citing_paper":"/paper/2508.13995"},"observation_digest":"sha256:0bed3b13631b8235cf21a34433d9eaa180acd21e7045d61da0e31e7949558415","observation_id":"310d18a1-ce0a-4d29-8fb5-245b9a506eab","resolution":{"observed_at":"2026-08-05T18:52:28.363387Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:52:28.346107Z","title":"Unidepth: Universal monocular metric depth estimation","venue":null,"work_id":"dd228f45-f625-423d-a0f0-4c25174cc234","year":2024},"citing_paper":{"arxiv_id":"2508.13995","last_updated":"2025-08-19T16:40:29Z","snapshot_observed_at":"2026-08-07T14:43:04.726857Z","submitted_at":"2025-08-19T16:40:29Z","title":"Self-Supervised Sparse Sensor Fusion for Long Range Perception","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-05T18:52:27.591580Z"},"links":{"citing_paper":"/paper/2508.13995"},"observation_digest":"sha256:7f2bdc1d94dd6748314de7e0a85c818fd99c52fce4e0216f38087180cc2ffdb7","observation_id":"99e6ae61-4db9-447b-a049-31db3ace98df","resolution":{"observed_at":"2026-08-05T18:52:28.349821Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:52:27.595146Z","title":"Pointnet: Deep learning on point sets for 3d classification and segmentation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.13995","last_updated":"2025-08-19T16:40:29Z","snapshot_observed_at":"2026-08-07T14:43:04.726857Z","submitted_at":"2025-08-19T16:40:29Z","title":"Self-Supervised Sparse Sensor Fusion for Long Range Perception","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-05T18:52:27.595146Z"},"links":{"citing_paper":"/paper/2508.13995"},"observation_digest":"sha256:0fe7093908247639ec3a3f41606ffc492dd1c2c0a32c039d6d7a93522e36a57a","observation_id":"85233097-7856-41ba-af9b-900da5904a5b","resolution":{"observed_at":"2026-08-05T18:52:27.595146Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:52:28.325180Z","title":"From points to parts: 3d object detec- tion from point cloud with part-aware and part-aggregation network, 2020","venue":null,"work_id":"9030db10-50b7-4470-ad96-01f7c82b7bea","year":2020},"citing_paper":{"arxiv_id":"2508.13995","last_updated":"2025-08-19T16:40:29Z","snapshot_observed_at":"2026-08-07T14:43:04.726857Z","submitted_at":"2025-08-19T16:40:29Z","title":"Self-Supervised Sparse Sensor Fusion for Long Range Perception","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-05T18:52:27.599123Z"},"links":{"citing_paper":"/paper/2508.13995"},"observation_digest":"sha256:6dc3d0e5beb24044e8d897617af1f25657737198dfbc7e78162d88fff3d6942d","observation_id":"0f3516e0-768e-4ce5-96ab-a8096ec037f3","resolution":{"observed_at":"2026-08-05T18:52:28.329369Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:52:28.312136Z","title":"Scalability in perception for au- tonomous driving: Waymo open dataset, 2020","venue":null,"work_id":"9509d3b3-f5ab-482a-a488-db8ab17743d2","year":2020},"citing_paper":{"arxiv_id":"2508.13995","last_updated":"2025-08-19T16:40:29Z","snapshot_observed_at":"2026-08-07T14:43:04.726857Z","submitted_at":"2025-08-19T16:40:29Z","title":"Self-Supervised Sparse Sensor Fusion for Long Range Perception","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-05T18:52:27.602649Z"},"links":{"citing_paper":"/paper/2508.13995"},"observation_digest":"sha256:729d59eae654497b6b3e634f868f3e5d8d511d7ded8b77e34139dcf125dd21d5","observation_id":"7d5dcc61-aa5a-468a-8a82-6e96c8bd142a","resolution":{"observed_at":"2026-08-05T18:52:28.316167Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:52:28.300047Z","title":"Learning guided convolutional network for depth comple- tion","venue":null,"work_id":"55ea1ce3-4fbe-49d8-89dd-1b7127713c2f","year":2020},"citing_paper":{"arxiv_id":"2508.13995","last_updated":"2025-08-19T16:40:29Z","snapshot_observed_at":"2026-08-07T14:43:04.726857Z","submitted_at":"2025-08-19T16:40:29Z","title":"Self-Supervised Sparse Sensor Fusion for Long Range Perception","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-05T18:52:27.606203Z"},"links":{"citing_paper":"/paper/2508.13995"},"observation_digest":"sha256:5443164bbffcb6dd349759afe694577564d293926c22167bff1ad309e0a9d977","observation_id":"d438004b-ac36-41e0-adbc-2b78c8ed9f7a","resolution":{"observed_at":"2026-08-05T18:52:28.303937Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:52:28.287998Z","title":"Sparseocc: Re- thinking sparse latent representation for vision-based seman- tic occupancy prediction","venue":null,"work_id":"384a69cf-a96d-430d-866e-e4ba339cfb77","year":2024},"citing_paper":{"arxiv_id":"2508.13995","last_updated":"2025-08-19T16:40:29Z","snapshot_observed_at":"2026-08-07T14:43:04.726857Z","submitted_at":"2025-08-19T16:40:29Z","title":"Self-Supervised Sparse Sensor Fusion for Long Range Perception","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-05T18:52:27.609543Z"},"links":{"citing_paper":"/paper/2508.13995"},"observation_digest":"sha256:2da2a438f18c48217384fb5bec70a5796e07ce9aac1319c4407221e20d452e1a","observation_id":"10b9a7ae-b2c1-437a-b3c7-ea913858375e","resolution":{"observed_at":"2026-08-05T18:52:28.291820Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:52:27.612897Z","title":"Raft: Recurrent all-pairs field transforms for optical flow","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.13995","last_updated":"2025-08-19T16:40:29Z","snapshot_observed_at":"2026-08-07T14:43:04.726857Z","submitted_at":"2025-08-19T16:40:29Z","title":"Self-Supervised Sparse Sensor Fusion for Long Range Perception","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-05T18:52:27.612897Z"},"links":{"citing_paper":"/paper/2508.13995"},"observation_digest":"sha256:9d128dd108a4cd0344a2dfd149473fde6b854a0fc1d818c8272fef0c624960d3","observation_id":"37aed49b-095e-4bf8-922e-db9e41e4f703","resolution":{"observed_at":"2026-08-05T18:52:27.612897Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:52:28.267622Z","title":"Vision-based intention and trajectory prediction in autonomous vehicles: A survey","venue":null,"work_id":"16af2161-e2f7-47bf-9b52-05513d7d2e95","year":2022},"citing_paper":{"arxiv_id":"2508.13995","last_updated":"2025-08-19T16:40:29Z","snapshot_observed_at":"2026-08-07T14:43:04.726857Z","submitted_at":"2025-08-19T16:40:29Z","title":"Self-Supervised Sparse Sensor Fusion for Long Range Perception","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-05T18:52:27.616455Z"},"links":{"citing_paper":"/paper/2508.13995"},"observation_digest":"sha256:3427d38dac2032773defe07ed860441b8d854fc900a3ca6d734da9665a3b0f2f","observation_id":"37d6793d-e196-4d74-a832-5b92437be3a8","resolution":{"observed_at":"2026-08-05T18:52:28.271591Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:52:28.255987Z","title":"Con- trastive multiview coding","venue":null,"work_id":"4c87ba58-c3d4-45c1-8423-abe5a96368ab","year":2020},"citing_paper":{"arxiv_id":"2508.13995","last_updated":"2025-08-19T16:40:29Z","snapshot_observed_at":"2026-08-07T14:43:04.726857Z","submitted_at":"2025-08-19T16:40:29Z","title":"Self-Supervised Sparse Sensor Fusion for Long Range Perception","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-05T18:52:27.620009Z"},"links":{"citing_paper":"/paper/2508.13995"},"observation_digest":"sha256:ecd5ee77636907dec3e151829bbe8255afd0fa7d6908536e535e664a18f10295","observation_id":"3a340c56-2522-418b-8a02-dc0923cc4c2c","resolution":{"observed_at":"2026-08-05T18:52:28.259632Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:52:28.244093Z","title":"Scene as occupancy","venue":null,"work_id":"cb7f0039-7598-4da3-b837-d4cfe330ac18","year":2023},"citing_paper":{"arxiv_id":"2508.13995","last_updated":"2025-08-19T16:40:29Z","snapshot_observed_at":"2026-08-07T14:43:04.726857Z","submitted_at":"2025-08-19T16:40:29Z","title":"Self-Supervised Sparse Sensor Fusion for Long Range Perception","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-05T18:52:27.623459Z"},"links":{"citing_paper":"/paper/2508.13995"},"observation_digest":"sha256:c8dfb9949e172e83fac97ea7f3de0f4ed1de0fc4ef087953734313947b3b43fe","observation_id":"3dc72c47-c341-45e5-aed8-2929305a47b1","resolution":{"observed_at":"2026-08-05T18:52:28.247723Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:52:28.231658Z","title":"Pointpainting: Sequential fusion for 3d object de- tection","venue":null,"work_id":"bd1a3af8-f5d7-4c5b-8814-5350448c8a32","year":null},"citing_paper":{"arxiv_id":"2508.13995","last_updated":"2025-08-19T16:40:29Z","snapshot_observed_at":"2026-08-07T14:43:04.726857Z","submitted_at":"2025-08-19T16:40:29Z","title":"Self-Supervised Sparse Sensor Fusion for Long Range Perception","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-05T18:52:27.627140Z"},"links":{"citing_paper":"/paper/2508.13995"},"observation_digest":"sha256:a70c70c893d039eb21aaac6e68afe3a6926378b2818d9cd84f661a0e9a998683","observation_id":"f3f402ae-44a0-4a6b-8158-9ada0aec3962","resolution":{"observed_at":"2026-08-05T18:52:28.235695Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:52:28.219341Z","title":"Gated stereo: Joint depth estimation from gated and wide-baseline active stereo cues","venue":null,"work_id":"0aac5f3f-6d38-4c68-82d0-31d987fa813c","year":2023},"citing_paper":{"arxiv_id":"2508.13995","last_updated":"2025-08-19T16:40:29Z","snapshot_observed_at":"2026-08-07T14:43:04.726857Z","submitted_at":"2025-08-19T16:40:29Z","title":"Self-Supervised Sparse Sensor Fusion for Long Range Perception","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-05T18:52:27.630902Z"},"links":{"citing_paper":"/paper/2508.13995"},"observation_digest":"sha256:9fd1622215775ee8b0a7204b0ced72cf3bd62759dcc58d8d2859934458e2622f","observation_id":"1b203f25-6afc-4c3a-841c-205ec09c3140","resolution":{"observed_at":"2026-08-05T18:52:28.223230Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:52:28.206857Z","title":"Pointaugmenting: Cross-modal augmentation for 3d object detection","venue":null,"work_id":"00f6e959-61f3-4d34-9247-fcda81e19474","year":2021},"citing_paper":{"arxiv_id":"2508.13995","last_updated":"2025-08-19T16:40:29Z","snapshot_observed_at":"2026-08-07T14:43:04.726857Z","submitted_at":"2025-08-19T16:40:29Z","title":"Self-Supervised Sparse Sensor Fusion for Long Range Perception","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-05T18:52:27.634459Z"},"links":{"citing_paper":"/paper/2508.13995"},"observation_digest":"sha256:a0dee9b799eec0dbf36f5c8760e82355ba6aca77ceb3d54dd92a1938169c1381","observation_id":"eab47fed-2d4b-4f53-971e-46fa3a7b4822","resolution":{"observed_at":"2026-08-05T18:52:28.210713Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:52:28.195128Z","title":"Waslander, Yue Wang, Sanja Fi- dler, Marco Pavone, and Peter Karkus","venue":null,"work_id":"2f7c5b25-8ce6-4c4a-a85f-cd114b0b00d4","year":2024},"citing_paper":{"arxiv_id":"2508.13995","last_updated":"2025-08-19T16:40:29Z","snapshot_observed_at":"2026-08-07T14:43:04.726857Z","submitted_at":"2025-08-19T16:40:29Z","title":"Self-Supervised Sparse Sensor Fusion for Long Range Perception","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-05T18:52:27.637953Z"},"links":{"citing_paper":"/paper/2508.13995"},"observation_digest":"sha256:4fc8610945b9c939e1933113bbba09f9a3c946143f28ed8c13ccb4b66fb32892","observation_id":"f33afc15-a103-47cc-88fb-67ed3c8c3eec","resolution":{"observed_at":"2026-08-05T18:52:28.198786Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:52:28.181905Z","title":"Openoccupancy: A large scale benchmark for surrounding semantic occupancy perception","venue":null,"work_id":"2c56ef33-1c02-473d-9db8-7a5c12f3a849","year":2023},"citing_paper":{"arxiv_id":"2508.13995","last_updated":"2025-08-19T16:40:29Z","snapshot_observed_at":"2026-08-07T14:43:04.726857Z","submitted_at":"2025-08-19T16:40:29Z","title":"Self-Supervised Sparse Sensor Fusion for Long Range Perception","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-05T18:52:27.641592Z"},"links":{"citing_paper":"/paper/2508.13995"},"observation_digest":"sha256:7dfa1c27bb89389cb332638e91dfd57f65cc9c631d1c28086d20b99ea1bb2416","observation_id":"b116c0e2-044b-4946-a9d4-60f1aa9d8ef5","resolution":{"observed_at":"2026-08-05T18:52:28.186587Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:52:28.168691Z","title":"Masked feature predic- tion for self-supervised visual pre-training","venue":null,"work_id":"b6ecd7b9-99cd-4654-b14e-d568c7fedd20","year":2022},"citing_paper":{"arxiv_id":"2508.13995","last_updated":"2025-08-19T16:40:29Z","snapshot_observed_at":"2026-08-07T14:43:04.726857Z","submitted_at":"2025-08-19T16:40:29Z","title":"Self-Supervised Sparse Sensor Fusion for Long Range Perception","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-05T18:52:27.645128Z"},"links":{"citing_paper":"/paper/2508.13995"},"observation_digest":"sha256:95f12843e9ab6a2f6e076381197b5b65704e84a8602c7fb7d9851e5a5b73f736","observation_id":"a97aae03-49a3-4d44-9166-110367d3d6c8","resolution":{"observed_at":"2026-08-05T18:52:28.172576Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:52:28.156717Z","title":"Surroundocc: Multi-camera 3d occu- pancy prediction for autonomous driving","venue":null,"work_id":"e0b9017b-9d62-435c-959b-318526379a3d","year":2023},"citing_paper":{"arxiv_id":"2508.13995","last_updated":"2025-08-19T16:40:29Z","snapshot_observed_at":"2026-08-07T14:43:04.726857Z","submitted_at":"2025-08-19T16:40:29Z","title":"Self-Supervised Sparse Sensor Fusion for Long Range Perception","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-05T18:52:27.649011Z"},"links":{"citing_paper":"/paper/2508.13995"},"observation_digest":"sha256:e5187008d9af3f612355ae3a2ba7774fd3840b1d052f10f890f17ec63ef854f5","observation_id":"d0682c65-b84a-49f7-9306-37b1f5dc862f","resolution":{"observed_at":"2026-08-05T18:52:28.160450Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:52:28.144244Z","title":"Inverting the pose forecasting pipeline with spf2: Sequential pointcloud forecasting for se- quential pose forecasting, 2020","venue":null,"work_id":"865610f9-ec0a-40af-9d91-5d57123944fa","year":2020},"citing_paper":{"arxiv_id":"2508.13995","last_updated":"2025-08-19T16:40:29Z","snapshot_observed_at":"2026-08-07T14:43:04.726857Z","submitted_at":"2025-08-19T16:40:29Z","title":"Self-Supervised Sparse Sensor Fusion for Long Range Perception","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-05T18:52:27.652602Z"},"links":{"citing_paper":"/paper/2508.13995"},"observation_digest":"sha256:ebfa945110b869b0380703feafa2c8d065e25ca796e4f88658501cc456934be8","observation_id":"17bc366e-ccef-4f04-8e4f-d251d02f2cd9","resolution":{"observed_at":"2026-08-05T18:52:28.148019Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:52:28.132110Z","title":null,"venue":null,"work_id":"ea108139-eb7a-4016-9426-38e7502f888b","year":2022},"citing_paper":{"arxiv_id":"2508.13995","last_updated":"2025-08-19T16:40:29Z","snapshot_observed_at":"2026-08-07T14:43:04.726857Z","submitted_at":"2025-08-19T16:40:29Z","title":"Self-Supervised Sparse Sensor Fusion for Long Range Perception","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-05T18:52:27.656522Z"},"links":{"citing_paper":"/paper/2508.13995"},"observation_digest":"sha256:967143c50b2e96482829e22afeee0483f6195ede9e21eb46e67cda036fc1f330","observation_id":"69aecadf-1236-4792-8bfb-b9514b54961e","resolution":{"observed_at":"2026-08-05T18:52:28.135878Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:52:28.119440Z","title":"Para-drive: Parallelized architecture for real- time autonomous driving","venue":null,"work_id":"5d03595f-1278-4a7c-ae38-89f2cef72284","year":2024},"citing_paper":{"arxiv_id":"2508.13995","last_updated":"2025-08-19T16:40:29Z","snapshot_observed_at":"2026-08-07T14:43:04.726857Z","submitted_at":"2025-08-19T16:40:29Z","title":"Self-Supervised Sparse Sensor Fusion for Long Range Perception","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-05T18:52:27.660058Z"},"links":{"citing_paper":"/paper/2508.13995"},"observation_digest":"sha256:c708bb674f8158491adc2832f11a4b8c431b76a52fc2d6ff306699cfd8ab0714","observation_id":"0d330bec-6055-4810-b1a6-0a488bf4d328","resolution":{"observed_at":"2026-08-05T18:52:28.123672Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:52:27.663533Z","title":"Argoverse 2: Next generation datasets for self-driving perception and fore- casting, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.13995","last_updated":"2025-08-19T16:40:29Z","snapshot_observed_at":"2026-08-07T14:43:04.726857Z","submitted_at":"2025-08-19T16:40:29Z","title":"Self-Supervised Sparse Sensor Fusion for Long Range Perception","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-05T18:52:27.663533Z"},"links":{"citing_paper":"/paper/2508.13995"},"observation_digest":"sha256:4edfc49dbc1f3a3afd9237adc9a95de94031f6387e5b1af1b6ea056c3719d861","observation_id":"5d167f64-9b02-4896-a576-dd76005e189e","resolution":{"observed_at":"2026-08-05T18:52:27.663533Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:52:28.098677Z","title":"Simmim: A simple framework for masked image modeling","venue":null,"work_id":"c75a467d-5593-4277-8680-fd02d9a388e4","year":2022},"citing_paper":{"arxiv_id":"2508.13995","last_updated":"2025-08-19T16:40:29Z","snapshot_observed_at":"2026-08-07T14:43:04.726857Z","submitted_at":"2025-08-19T16:40:29Z","title":"Self-Supervised Sparse Sensor Fusion for Long Range Perception","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-05T18:52:27.667215Z"},"links":{"citing_paper":"/paper/2508.13995"},"observation_digest":"sha256:ed09c626da4b8f6f5f0eb6114c10ccffd69021f94ebcfedba0cabbbd97947a3d","observation_id":"a9afadd6-f4e7-458e-8a75-a6e44877f09d","resolution":{"observed_at":"2026-08-05T18:52:28.102346Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:52:28.086779Z","title":"Iterative geometry encoding volume for stereo matching","venue":null,"work_id":"20eb262b-a9b0-4116-8a48-d8f04717089c","year":2023},"citing_paper":{"arxiv_id":"2508.13995","last_updated":"2025-08-19T16:40:29Z","snapshot_observed_at":"2026-08-07T14:43:04.726857Z","submitted_at":"2025-08-19T16:40:29Z","title":"Self-Supervised Sparse Sensor Fusion for Long Range Perception","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-05T18:52:27.670706Z"},"links":{"citing_paper":"/paper/2508.13995"},"observation_digest":"sha256:f9913fbb0fd089e00e09eeda7b0da068d64c1dc76b4c4f9466d3b7f5ce94ed14","observation_id":"f79bddf9-05f8-4a2a-ad40-84a5a809c8a8","resolution":{"observed_at":"2026-08-05T18:52:28.090673Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:52:28.075159Z","title":"Fusionpainting: Multimodal fusion with adaptive attention for 3d object detection","venue":null,"work_id":"3b1afcba-295b-47d5-9573-9d004c8cc185","year":2021},"citing_paper":{"arxiv_id":"2508.13995","last_updated":"2025-08-19T16:40:29Z","snapshot_observed_at":"2026-08-07T14:43:04.726857Z","submitted_at":"2025-08-19T16:40:29Z","title":"Self-Supervised Sparse Sensor Fusion for Long Range Perception","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-05T18:52:27.674240Z"},"links":{"citing_paper":"/paper/2508.13995"},"observation_digest":"sha256:ca678a5922d21174180a51603536afce8b29138a7272a692ec498bb4435355b5","observation_id":"8fa68420-b683-4e4a-9b0d-09038cb63d85","resolution":{"observed_at":"2026-08-05T18:52:28.078873Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:52:28.063192Z","title":"Unipad: A universal pre-training paradigm for autonomous driving","venue":null,"work_id":"29cd8508-62b8-4e23-af39-0e2bc594fe8a","year":2024},"citing_paper":{"arxiv_id":"2508.13995","last_updated":"2025-08-19T16:40:29Z","snapshot_observed_at":"2026-08-07T14:43:04.726857Z","submitted_at":"2025-08-19T16:40:29Z","title":"Self-Supervised Sparse Sensor Fusion for Long Range Perception","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-05T18:52:27.677886Z"},"links":{"citing_paper":"/paper/2508.13995"},"observation_digest":"sha256:0bef531e01fc7d171d574f75f3f90ca9c8ce1185ce3f841d9ac4b62e9e8b7934","observation_id":"d44fa221-6345-47ce-a6fd-d469d242dfbb","resolution":{"observed_at":"2026-08-05T18:52:28.067031Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:52:28.051385Z","title":"Depth anything: Unleashing the power of large-scale unlabeled data","venue":null,"work_id":"7e8460d1-c28b-483e-a176-72e2d04a38af","year":2024},"citing_paper":{"arxiv_id":"2508.13995","last_updated":"2025-08-19T16:40:29Z","snapshot_observed_at":"2026-08-07T14:43:04.726857Z","submitted_at":"2025-08-19T16:40:29Z","title":"Self-Supervised Sparse Sensor Fusion for Long Range Perception","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-05T18:52:27.681459Z"},"links":{"citing_paper":"/paper/2508.13995"},"observation_digest":"sha256:50cfdf3775a2fde33907b910214f5b5b3f7b2cc8d80748e9caaa8e96bb0046f0","observation_id":"a0625707-ad4a-435a-851d-862a9364d55e","resolution":{"observed_at":"2026-08-05T18:52:28.055121Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:52:28.039521Z","title":"Deepinteraction: 3d object detection via modality interaction","venue":null,"work_id":"5c1752ed-35b2-44b6-ac5b-acbeefe653ec","year":1992},"citing_paper":{"arxiv_id":"2508.13995","last_updated":"2025-08-19T16:40:29Z","snapshot_observed_at":"2026-08-07T14:43:04.726857Z","submitted_at":"2025-08-19T16:40:29Z","title":"Self-Supervised Sparse Sensor Fusion for Long Range Perception","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-05T18:52:27.685370Z"},"links":{"citing_paper":"/paper/2508.13995"},"observation_digest":"sha256:f01cc6f64c78ff3cf1dff1634ab08fa1f6038fa114b82096548255ec969c1318","observation_id":"cdd2ce0d-9d78-4447-a656-393db9b128b5","resolution":{"observed_at":"2026-08-05T18:52:28.043242Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:52:28.026780Z","title":"Visual point cloud forecasting enables scalable autonomous driving","venue":null,"work_id":"1e7e667b-771c-496a-8c72-f14790602762","year":2024},"citing_paper":{"arxiv_id":"2508.13995","last_updated":"2025-08-19T16:40:29Z","snapshot_observed_at":"2026-08-07T14:43:04.726857Z","submitted_at":"2025-08-19T16:40:29Z","title":"Self-Supervised Sparse Sensor Fusion for Long Range Perception","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-05T18:52:27.689114Z"},"links":{"citing_paper":"/paper/2508.13995"},"observation_digest":"sha256:fc02dcb615abdb18c97d273923a0488cf615acc89b3b90fda4eebf2be950a8dc","observation_id":"96734118-7ac5-4611-8d11-b80fce646efb","resolution":{"observed_at":"2026-08-05T18:52:28.030438Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:52:28.014417Z","title":"Is-fusion: Instance-scene collaborative fusion for multimodal 3d ob- ject detection","venue":null,"work_id":"d7af48b7-e22a-400c-be57-b1a81cab6a51","year":2024},"citing_paper":{"arxiv_id":"2508.13995","last_updated":"2025-08-19T16:40:29Z","snapshot_observed_at":"2026-08-07T14:43:04.726857Z","submitted_at":"2025-08-19T16:40:29Z","title":"Self-Supervised Sparse Sensor Fusion for Long Range Perception","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-05T18:52:27.693013Z"},"links":{"citing_paper":"/paper/2508.13995"},"observation_digest":"sha256:36087556d7a05fb3973acecc232ceabe5a0899a61decbcd7034fa029f36d8c58","observation_id":"ffe99fad-5290-4cf3-bb0d-ec9fdc761903","resolution":{"observed_at":"2026-08-05T18:52:28.018353Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:52:28.002312Z","title":"Multi- modal virtual point 3d detection","venue":null,"work_id":"7a6dadd9-69c7-43e8-b4b3-a53807c66648","year":2021},"citing_paper":{"arxiv_id":"2508.13995","last_updated":"2025-08-19T16:40:29Z","snapshot_observed_at":"2026-08-07T14:43:04.726857Z","submitted_at":"2025-08-19T16:40:29Z","title":"Self-Supervised Sparse Sensor Fusion for Long Range Perception","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-05T18:52:27.696812Z"},"links":{"citing_paper":"/paper/2508.13995"},"observation_digest":"sha256:4a92672c6e19ead64e7892b2bf8448bd63665b8a391dd552c3e883519590af40","observation_id":"46fd20d7-cae4-41e4-8aa0-2d3a6f758f00","resolution":{"observed_at":"2026-08-05T18:52:28.006035Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:52:27.989767Z","title":"Center- based 3d object detection and tracking, 2021","venue":null,"work_id":"4dc6846b-823b-447e-8568-f8613606aec0","year":2021},"citing_paper":{"arxiv_id":"2508.13995","last_updated":"2025-08-19T16:40:29Z","snapshot_observed_at":"2026-08-07T14:43:04.726857Z","submitted_at":"2025-08-19T16:40:29Z","title":"Self-Supervised Sparse Sensor Fusion for Long Range Perception","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-05T18:52:27.700613Z"},"links":{"citing_paper":"/paper/2508.13995"},"observation_digest":"sha256:66ebb1bc6f10a477c8371dfa17436a6201d87f1a0d3ca89a4039bd5cc2d96047","observation_id":"7f90ab9e-f56f-48ec-9409-851c32b1a09b","resolution":{"observed_at":"2026-08-05T18:52:27.994039Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:52:27.977229Z","title":"Metric3d: Towards zero-shot metric 3d prediction from a single image","venue":null,"work_id":"5195f5eb-7e70-4fc2-b794-da16713365bf","year":2023},"citing_paper":{"arxiv_id":"2508.13995","last_updated":"2025-08-19T16:40:29Z","snapshot_observed_at":"2026-08-07T14:43:04.726857Z","submitted_at":"2025-08-19T16:40:29Z","title":"Self-Supervised Sparse Sensor Fusion for Long Range Perception","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-05T18:52:27.704159Z"},"links":{"citing_paper":"/paper/2508.13995"},"observation_digest":"sha256:b781f49a6b969f9cb17e210a5a932686947df30ce220eb2fa458ea65ba04ee3d","observation_id":"9e86eefc-72bd-4210-80b2-5462a302a918","resolution":{"observed_at":"2026-08-05T18:52:27.981119Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:52:27.964073Z","title":"3d-cvf: Generating joint camera and lidar features us- ing cross-view spatial feature fusion for 3d object detection","venue":null,"work_id":"ac06e6da-aa61-4d68-902d-c210312afc8d","year":2020},"citing_paper":{"arxiv_id":"2508.13995","last_updated":"2025-08-19T16:40:29Z","snapshot_observed_at":"2026-08-07T14:43:04.726857Z","submitted_at":"2025-08-19T16:40:29Z","title":"Self-Supervised Sparse Sensor Fusion for Long Range Perception","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-05T18:52:27.707804Z"},"links":{"citing_paper":"/paper/2508.13995"},"observation_digest":"sha256:3a4848c3f5884b0af7fd0b8d0e21eeffabe1980c0c94ab1957c5206f95d47d3c","observation_id":"98727b3d-cd40-47e5-99d6-1b6f563018e8","resolution":{"observed_at":"2026-08-05T18:52:27.967952Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:52:27.951311Z","title":"Mutr3d: A multi-camera tracking frame- work via 3d-to-2d queries","venue":null,"work_id":"047fa60e-91aa-43a5-bd24-d67c0602f16a","year":2022},"citing_paper":{"arxiv_id":"2508.13995","last_updated":"2025-08-19T16:40:29Z","snapshot_observed_at":"2026-08-07T14:43:04.726857Z","submitted_at":"2025-08-19T16:40:29Z","title":"Self-Supervised Sparse Sensor Fusion for Long Range Perception","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-05T18:52:27.711335Z"},"links":{"citing_paper":"/paper/2508.13995"},"observation_digest":"sha256:983248a823246fa7c6666dc0f43decd69d4b9d9e23436cc46bb3fa6d837e9405","observation_id":"6f8fefac-c8e8-4211-abb3-33b3917b6646","resolution":{"observed_at":"2026-08-05T18:52:27.955478Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:52:27.938643Z","title":"Completionformer: Depth completion with convolutions and vision transform- ers","venue":null,"work_id":"80487b17-1c95-4cd6-8a7b-45741031c67e","year":null},"citing_paper":{"arxiv_id":"2508.13995","last_updated":"2025-08-19T16:40:29Z","snapshot_observed_at":"2026-08-07T14:43:04.726857Z","submitted_at":"2025-08-19T16:40:29Z","title":"Self-Supervised Sparse Sensor Fusion for Long Range Perception","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-05T18:52:27.714942Z"},"links":{"citing_paper":"/paper/2508.13995"},"observation_digest":"sha256:436774ba3c8c0ea353872fe9fcb3da156ae44095dcb38b1de971f7727767adae","observation_id":"3a5f268b-d805-44a2-8a52-b7b1d50e6132","resolution":{"observed_at":"2026-08-05T18:52:27.942396Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:52:27.925510Z","title":"Minimal gated unit for recurrent neural networks","venue":null,"work_id":"d4ef866a-55c1-458f-b9ce-bcd1f10cf740","year":2016},"citing_paper":{"arxiv_id":"2508.13995","last_updated":"2025-08-19T16:40:29Z","snapshot_observed_at":"2026-08-07T14:43:04.726857Z","submitted_at":"2025-08-19T16:40:29Z","title":"Self-Supervised Sparse Sensor Fusion for Long Range Perception","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-05T18:52:27.718694Z"},"links":{"citing_paper":"/paper/2508.13995"},"observation_digest":"sha256:ebde37b80c0fd0375432062ce6c738d2423ee0805e8f5b09505522bd0705cf75","observation_id":"39ed43a5-1e35-4543-91d3-c6de0151eb3e","resolution":{"observed_at":"2026-08-05T18:52:27.929664Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:52:27.912471Z","title":"Hermes: A unified self-driving world model for simultaneous 3d scene understanding and generation, 2025","venue":null,"work_id":"9e89ef10-58f3-4bda-ac23-e239b7d98482","year":2025},"citing_paper":{"arxiv_id":"2508.13995","last_updated":"2025-08-19T16:40:29Z","snapshot_observed_at":"2026-08-07T14:43:04.726857Z","submitted_at":"2025-08-19T16:40:29Z","title":"Self-Supervised Sparse Sensor Fusion for Long Range Perception","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-05T18:52:27.722195Z"},"links":{"citing_paper":"/paper/2508.13995"},"observation_digest":"sha256:f47f4f0928c92b8fa501b5da5649779d90522ae9f796432ae0d08bce59797488","observation_id":"0835b612-49fd-464a-9530-5bad27a8fe6b","resolution":{"observed_at":"2026-08-05T18:52:27.916501Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:52:27.725778Z","title":"V oxelnet: End-to-end learning for point cloud based 3d object detection","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2508.13995","last_updated":"2025-08-19T16:40:29Z","snapshot_observed_at":"2026-08-07T14:43:04.726857Z","submitted_at":"2025-08-19T16:40:29Z","title":"Self-Supervised Sparse Sensor Fusion for Long Range Perception","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-05T18:52:27.725778Z"},"links":{"citing_paper":"/paper/2508.13995"},"observation_digest":"sha256:2219ffa5f77fb4c23c226013c4a53af904a8bd449f0546520afcc732df00dcf1","observation_id":"d20f3871-a0b3-4cdd-ba6c-b6e8a037cc1a","resolution":{"observed_at":"2026-08-05T18:52:27.725778Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.09417","last_updated":"2024-11-14T02:00:33Z","snapshot_observed_at":"2026-07-06T17:16:59.193820Z","submitted_at":"2024-01-17T18:56:18Z","title":"Vision Mamba: Efficient Visual Representation Learning with Bidirectional State Space Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.09417","snapshot_observed_at":"2026-08-05T18:52:27.729370Z","title":"Vision mamba: Efficient visual representation learning with bidirectional state space model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.13995","last_updated":"2025-08-19T16:40:29Z","snapshot_observed_at":"2026-08-07T14:43:04.726857Z","submitted_at":"2025-08-19T16:40:29Z","title":"Self-Supervised Sparse Sensor Fusion for Long Range Perception","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-05T18:52:27.729370Z"},"links":{"cited_paper":"/paper/2401.09417","citing_paper":"/paper/2508.13995"},"observation_digest":"sha256:f3438eb4f1312d7225aed5f0421f9331308caba8a61a50a529bd357853593d2f","observation_id":"a8119ba0-2789-4247-a72d-a06b5699255b","resolution":{"observed_at":"2026-08-05T18:52:27.729370Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.04159","last_updated":"2021-03-18T03:14:26Z","snapshot_observed_at":"2026-07-06T10:02:45.105181Z","submitted_at":"2020-10-08T17:59:21Z","title":"Deformable DETR: Deformable Transformers for End-to-End Object Detection","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.04159","snapshot_observed_at":"2026-08-05T18:52:27.733428Z","title":"Deformable detr: Deformable trans- formers for end-to-end object detection","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2508.13995","last_updated":"2025-08-19T16:40:29Z","snapshot_observed_at":"2026-08-07T14:43:04.726857Z","submitted_at":"2025-08-19T16:40:29Z","title":"Self-Supervised Sparse Sensor Fusion for Long Range Perception","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-05T18:52:27.733428Z"},"links":{"cited_paper":"/paper/2010.04159","citing_paper":"/paper/2508.13995"},"observation_digest":"sha256:d7fd57402242c2e8473dd287c264cd4581488b59c03e506b5e4e1ba747771d1b","observation_id":"38b1325f-6cab-4d41-b77b-3a3d74607856","resolution":{"observed_at":"2026-08-05T18:52:27.733428Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:52:27.888515Z","title":"Ogni-dc: Robust depth com- pletion with optimization-guided neural iterations","venue":null,"work_id":"471b45b4-22ef-43c8-840a-58ac7b0950dd","year":2024},"citing_paper":{"arxiv_id":"2508.13995","last_updated":"2025-08-19T16:40:29Z","snapshot_observed_at":"2026-08-07T14:43:04.726857Z","submitted_at":"2025-08-19T16:40:29Z","title":"Self-Supervised Sparse Sensor Fusion for Long Range Perception","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-05T18:52:27.737199Z"},"links":{"citing_paper":"/paper/2508.13995"},"observation_digest":"sha256:91b26e67713a762c842803d7f991b0fad2a1ede5d2502181a44c6e09d4c1ea62","observation_id":"234c006f-1cf1-426e-a6d9-0418c7bf5296","resolution":{"observed_at":"2026-08-05T18:52:27.895144Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2508.13995","last_updated":"2025-08-19T16:40:29Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T14:43:04.726857Z","submitted_at":"2025-08-19T16:40:29Z","title":"Self-Supervised Sparse Sensor Fusion for Long Range Perception"},"reference_resolution":{"displayed":83,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":19,"verified_exact":0,"verified_fuzzy":64},"total_outbound_references":83},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 83 of 83 outbound references and 0 inbound Pith citation observations for arXiv:2508.13995."}