{"as_of":"2026-08-10T11:49:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:564657c5ab4a3af6137251ba0aedff158639c334d295065f2ef7731e95511d80","coverage":[{"denominator":54,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":54,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T20:49:00.822248Z","state":"measured"},{"denominator":54,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":54,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2509.08388/citation-record","integrity":"/paper/2509.08388/integrity","json":"/paper/2509.08388/citation-record.json","paper":"/paper/2509.08388"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:49:07.922236Z","title":"Se- mantickitti: A dataset for semantic scene understanding of lidar sequences","venue":null,"work_id":"0687c71c-5713-4948-8add-6a6eec3d3ef0","year":null},"citing_paper":{"arxiv_id":"2509.08388","last_updated":"2025-09-10T08:29:22Z","snapshot_observed_at":"2026-08-09T06:41:30.097348Z","submitted_at":"2025-09-10T08:29:22Z","title":"Semantic Causality-Aware Vision-Based 3D Occupancy Prediction","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-04T20:48:54.499137Z"},"links":{"citing_paper":"/paper/2509.08388"},"observation_digest":"sha256:feb7f1b170d76c2e34fcface2dfdeb434735906d0e3b91e4478337838a610515","observation_id":"7dc1e200-9e37-4cb6-93e6-fd404e3bedfa","resolution":{"observed_at":"2026-08-04T20:49:07.937347Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.17310","last_updated":"2024-07-25T07:47:11Z","snapshot_observed_at":"2026-08-05T15:06:06.140557Z","submitted_at":"2024-07-24T14:22:55Z","title":"LangOcc: Self-Supervised Open Vocabulary Occupancy Estimation via Volume Rendering","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.17310","snapshot_observed_at":"2026-08-04T20:48:54.584442Z","title":"Lan- gocc: Self-supervised open vocabulary occupancy estima- tion via volume rendering.arXiv preprint arXiv:2407.17310,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.08388","last_updated":"2025-09-10T08:29:22Z","snapshot_observed_at":"2026-08-09T06:41:30.097348Z","submitted_at":"2025-09-10T08:29:22Z","title":"Semantic Causality-Aware Vision-Based 3D Occupancy Prediction","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-04T20:48:54.584442Z"},"links":{"cited_paper":"/paper/2407.17310","citing_paper":"/paper/2509.08388"},"observation_digest":"sha256:9dcbbc48383b82d45e8a0419eb55d1051dee0e599d6481285877052c0d972627","observation_id":"7a44f044-5c4f-4736-9862-cc643b104772","resolution":{"observed_at":"2026-08-04T20:48:54.584442Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12792","last_updated":"2024-02-20T08:04:12Z","snapshot_observed_at":"2026-08-10T09:14:10.300859Z","submitted_at":"2024-02-20T08:04:12Z","title":"OccFlowNet: Towards Self-supervised Occupancy Estimation via Differentiable Rendering and Occupancy Flow","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.12792","snapshot_observed_at":"2026-08-04T20:48:54.724717Z","title":"Oc- cflownet: Towards self-supervised occupancy estimation via differentiable rendering and occupancy flow.arXiv preprint arXiv:2402.12792, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08388","last_updated":"2025-09-10T08:29:22Z","snapshot_observed_at":"2026-08-09T06:41:30.097348Z","submitted_at":"2025-09-10T08:29:22Z","title":"Semantic Causality-Aware Vision-Based 3D Occupancy Prediction","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-04T20:48:54.724717Z"},"links":{"cited_paper":"/paper/2402.12792","citing_paper":"/paper/2509.08388"},"observation_digest":"sha256:993278da8c09111209f4f7aa9a84c8de808f0fea7a4375e0a22627e9275d02f4","observation_id":"5e25ebf8-c0e2-4f0a-8999-267c2bb6e79a","resolution":{"observed_at":"2026-08-04T20:48:54.724717Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.17288","last_updated":"2025-08-25T07:44:26Z","snapshot_observed_at":"2026-08-07T17:52:50.015358Z","submitted_at":"2025-02-24T16:16:01Z","title":"GaussianFlowOcc: Sparse and Weakly Supervised Occupancy Estimation using Gaussian Splatting and Temporal Flow","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.17288","snapshot_observed_at":"2026-08-04T20:48:54.883942Z","title":"Gaussianflowocc: Sparse and weakly supervised occupancy estimation using gaussian splatting and temporal flow.arXiv preprint arXiv:2502.17288, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.08388","last_updated":"2025-09-10T08:29:22Z","snapshot_observed_at":"2026-08-09T06:41:30.097348Z","submitted_at":"2025-09-10T08:29:22Z","title":"Semantic Causality-Aware Vision-Based 3D Occupancy Prediction","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-04T20:48:54.883942Z"},"links":{"cited_paper":"/paper/2502.17288","citing_paper":"/paper/2509.08388"},"observation_digest":"sha256:da042d76cdb9da5e102d6f8d71dbc981843d23f983e98a440b827357d3141572","observation_id":"225153c6-21d9-4dcf-b4fe-e50c2ad3967c","resolution":{"observed_at":"2026-08-04T20:48:54.883942Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:49:07.735467Z","title":"nuscenes: A multi- modal dataset for autonomous driving","venue":null,"work_id":"26f9cd89-f73d-44e4-929c-e4e8348b937a","year":2020},"citing_paper":{"arxiv_id":"2509.08388","last_updated":"2025-09-10T08:29:22Z","snapshot_observed_at":"2026-08-09T06:41:30.097348Z","submitted_at":"2025-09-10T08:29:22Z","title":"Semantic Causality-Aware Vision-Based 3D Occupancy Prediction","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-04T20:48:55.000701Z"},"links":{"citing_paper":"/paper/2509.08388"},"observation_digest":"sha256:ff6a72238df3cdf014ca528c15a796e74bcb702076f550d8748c5b499ce7ea25","observation_id":"0eeb929b-bf4f-4a12-b3f9-c72d419e8339","resolution":{"observed_at":"2026-08-04T20:49:07.840074Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:49:07.588714Z","title":"Monoscene: Monoc- ular 3d semantic scene completion","venue":null,"work_id":"c74d0ff3-5cfc-4417-9ad8-4d4beee71b39","year":2022},"citing_paper":{"arxiv_id":"2509.08388","last_updated":"2025-09-10T08:29:22Z","snapshot_observed_at":"2026-08-09T06:41:30.097348Z","submitted_at":"2025-09-10T08:29:22Z","title":"Semantic Causality-Aware Vision-Based 3D Occupancy Prediction","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-04T20:48:55.178952Z"},"links":{"citing_paper":"/paper/2509.08388"},"observation_digest":"sha256:454e5f78ebe16d81024f9ed2649ea2f439a7a1e71567e7c66421077d4575eeb7","observation_id":"8d3fa602-e7c6-40ea-afc5-2087447d870a","resolution":{"observed_at":"2026-08-04T20:49:07.630351Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.07725","last_updated":"2025-09-10T08:15:43Z","snapshot_observed_at":"2026-08-09T19:33:39.266331Z","submitted_at":"2024-11-12T11:32:56Z","title":"ALOcc: Adaptive Lifting-Based 3D Semantic Occupancy and Cost Volume-Based Flow Predictions","version":2},"cited_work":{"arxiv_id":"2411.07725","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.07725","snapshot_observed_at":"2026-08-04T20:49:02.319801Z","title":"ALOcc: Adaptive Lifting-Based 3D Semantic Occupancy and Cost Volume-Based Flow Predictions","venue":"cs.CV","work_id":"7a070979-18d8-4893-98a6-75950084f798","year":2024},"citing_paper":{"arxiv_id":"2509.08388","last_updated":"2025-09-10T08:29:22Z","snapshot_observed_at":"2026-08-09T06:41:30.097348Z","submitted_at":"2025-09-10T08:29:22Z","title":"Semantic Causality-Aware Vision-Based 3D Occupancy Prediction","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-04T20:48:55.236473Z"},"links":{"cited_paper":"/paper/2411.07725","citing_paper":"/paper/2509.08388"},"observation_digest":"sha256:ca4cbf821f8bc29432c82cf205581d32e8698333e22a34f3bd232b61e29e7805","observation_id":"a6a7f8ec-50cc-4d7b-b18b-0388ea13cb2b","resolution":{"observed_at":"2026-08-04T20:49:02.433381Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.01436","last_updated":"2024-07-01T16:32:15Z","snapshot_observed_at":"2026-08-09T06:41:52.348615Z","submitted_at":"2024-07-01T16:32:15Z","title":"AdaOcc: Adaptive Forward View Transformation and Flow Modeling for 3D Occupancy and Flow Prediction","version":1},"cited_work":{"arxiv_id":"2407.01436","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.01436","snapshot_observed_at":"2026-08-04T20:49:02.167974Z","title":"AdaOcc: Adaptive Forward View Transformation and Flow Modeling for 3D Occupancy and Flow Prediction","venue":"cs.CV","work_id":"ffa6e815-8150-4b97-a31c-e518f8003f06","year":2024},"citing_paper":{"arxiv_id":"2509.08388","last_updated":"2025-09-10T08:29:22Z","snapshot_observed_at":"2026-08-09T06:41:30.097348Z","submitted_at":"2025-09-10T08:29:22Z","title":"Semantic Causality-Aware Vision-Based 3D Occupancy Prediction","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-04T20:48:55.347765Z"},"links":{"cited_paper":"/paper/2407.01436","citing_paper":"/paper/2509.08388"},"observation_digest":"sha256:b8e7f3ed471c8d78751b08ef0a303be33ebc5f4a214e1b32a96834c4b82a960d","observation_id":"93d7f249-f69f-4a01-96e4-35847e10cd43","resolution":{"observed_at":"2026-08-04T20:49:02.227948Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:49:07.399342Z","title":"Rethinking temporal fusion with a unified gradient descent view for 3d semantic occupancy prediction","venue":null,"work_id":"16d1f5b3-3538-46e2-8099-3b01fec4f378","year":2025},"citing_paper":{"arxiv_id":"2509.08388","last_updated":"2025-09-10T08:29:22Z","snapshot_observed_at":"2026-08-09T06:41:30.097348Z","submitted_at":"2025-09-10T08:29:22Z","title":"Semantic Causality-Aware Vision-Based 3D Occupancy Prediction","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-04T20:48:55.493164Z"},"links":{"citing_paper":"/paper/2509.08388"},"observation_digest":"sha256:ecc84fd148f115db42fd81e46381cf7c2022ed0ea1ce5a6dbdc7ae0efe290ea4","observation_id":"98d85e3c-4aac-42b2-82d7-292d24d29f00","resolution":{"observed_at":"2026-08-04T20:49:07.503123Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:49:07.218361Z","title":"3d sketch-aware semantic scene comple- tion via semi-supervised structure prior","venue":null,"work_id":"eaea5f05-01e7-4ab7-b8ef-2309209b14ab","year":2020},"citing_paper":{"arxiv_id":"2509.08388","last_updated":"2025-09-10T08:29:22Z","snapshot_observed_at":"2026-08-09T06:41:30.097348Z","submitted_at":"2025-09-10T08:29:22Z","title":"Semantic Causality-Aware Vision-Based 3D Occupancy Prediction","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-04T20:48:55.602300Z"},"links":{"citing_paper":"/paper/2509.08388"},"observation_digest":"sha256:7950e96200e8bca315c94e64fe734dd814d07c6480f5a145ac2861c638c248af","observation_id":"b47a8d1b-2dd3-4299-bb32-bc3ff1c70237","resolution":{"observed_at":"2026-08-04T20:49:07.312926Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1908.02729","last_updated":"2019-08-07T17:04:26Z","snapshot_observed_at":"2026-08-10T05:44:22.307760Z","submitted_at":"2019-08-07T17:04:26Z","title":"Robust Learning with Jacobian Regularization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1908.02729","snapshot_observed_at":"2026-08-04T20:48:55.744059Z","title":"Ro- bust learning with jacobian regularization.arXiv preprint arXiv:1908.02729, 2019","venue":null,"work_id":null,"year":1908},"citing_paper":{"arxiv_id":"2509.08388","last_updated":"2025-09-10T08:29:22Z","snapshot_observed_at":"2026-08-09T06:41:30.097348Z","submitted_at":"2025-09-10T08:29:22Z","title":"Semantic Causality-Aware Vision-Based 3D Occupancy Prediction","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-04T20:48:55.744059Z"},"links":{"cited_paper":"/paper/1908.02729","citing_paper":"/paper/2509.08388"},"observation_digest":"sha256:b62ca46719044473ba82a9a52e9e10fa44361305d1b7387980da16511e722f28","observation_id":"c52cad1b-51eb-4fe0-8f63-44a8216f63f3","resolution":{"observed_at":"2026-08-04T20:48:55.744059Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.17054","last_updated":"2022-06-16T09:44:08Z","snapshot_observed_at":"2026-07-06T12:55:16.868412Z","submitted_at":"2022-03-31T14:21:19Z","title":"BEVDet4D: Exploit Temporal Cues in Multi-camera 3D Object Detection","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.17054","snapshot_observed_at":"2026-08-04T20:48:55.880088Z","title":"Bevdet4d: Exploit tempo- ral cues in multi-camera 3d object detection.arXiv preprint arXiv:2203.17054, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.08388","last_updated":"2025-09-10T08:29:22Z","snapshot_observed_at":"2026-08-09T06:41:30.097348Z","submitted_at":"2025-09-10T08:29:22Z","title":"Semantic Causality-Aware Vision-Based 3D Occupancy Prediction","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-04T20:48:55.880088Z"},"links":{"cited_paper":"/paper/2203.17054","citing_paper":"/paper/2509.08388"},"observation_digest":"sha256:803809761f3b2ec127672c05cc8332e74908de52454e8ef5aad9d47812bbb830","observation_id":"f8767f04-c054-408f-aea1-c1aaad7cb360","resolution":{"observed_at":"2026-08-04T20:48:55.880088Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11790","last_updated":"2022-06-16T09:15:52Z","snapshot_observed_at":"2026-07-06T12:21:28.059661Z","submitted_at":"2021-12-22T10:48:06Z","title":"BEVDet: High-performance Multi-camera 3D Object Detection in Bird-Eye-View","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.11790","snapshot_observed_at":"2026-08-04T20:48:55.989005Z","title":"Bevdet: High-performance multi-camera 3d object de- tection in bird-eye-view.arXiv preprint arXiv:2112.11790,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.08388","last_updated":"2025-09-10T08:29:22Z","snapshot_observed_at":"2026-08-09T06:41:30.097348Z","submitted_at":"2025-09-10T08:29:22Z","title":"Semantic Causality-Aware Vision-Based 3D Occupancy Prediction","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-04T20:48:55.989005Z"},"links":{"cited_paper":"/paper/2112.11790","citing_paper":"/paper/2509.08388"},"observation_digest":"sha256:ca2601cbbc9d6d2f8e6f8767bf47884746d22cd65a320b7b76bc6ad079a15dae","observation_id":"d51538a2-2cba-4eef-95d9-6f6d7791bca1","resolution":{"observed_at":"2026-08-04T20:48:55.989005Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.07817","last_updated":"2023-03-02T16:41:45Z","snapshot_observed_at":"2026-07-06T14:52:11.722960Z","submitted_at":"2023-02-15T17:58:10Z","title":"Tri-Perspective View for Vision-Based 3D Semantic Occupancy Prediction","version":2},"cited_work":{"arxiv_id":"2302.07817","doi":null,"metadata_source":"pith","pith_arxiv_id":"2302.07817","snapshot_observed_at":"2026-08-04T20:49:01.928843Z","title":"Tri-Perspective View for Vision-Based 3D Semantic Occupancy Prediction","venue":"cs.CV","work_id":"ef633e9f-6e1a-4c7c-b1e0-88e7eb35e3c3","year":2023},"citing_paper":{"arxiv_id":"2509.08388","last_updated":"2025-09-10T08:29:22Z","snapshot_observed_at":"2026-08-09T06:41:30.097348Z","submitted_at":"2025-09-10T08:29:22Z","title":"Semantic Causality-Aware Vision-Based 3D Occupancy Prediction","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-04T20:48:56.156376Z"},"links":{"cited_paper":"/paper/2302.07817","citing_paper":"/paper/2509.08388"},"observation_digest":"sha256:b034f8a28532339a6b5e1864f50202ef4191588ff1786f4ed123f0e7ebf3be0c","observation_id":"5b036131-eccb-4e53-975a-0f71c15ef72a","resolution":{"observed_at":"2026-08-04T20:49:02.026240Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:49:06.955333Z","title":"Selfocc: Self-supervised vision-based 3d oc- cupancy prediction","venue":null,"work_id":"307f4795-300f-45c5-bb60-58b8e0db9aee","year":2024},"citing_paper":{"arxiv_id":"2509.08388","last_updated":"2025-09-10T08:29:22Z","snapshot_observed_at":"2026-08-09T06:41:30.097348Z","submitted_at":"2025-09-10T08:29:22Z","title":"Semantic Causality-Aware Vision-Based 3D Occupancy Prediction","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-04T20:48:56.363220Z"},"links":{"citing_paper":"/paper/2509.08388"},"observation_digest":"sha256:927b63743c0b329c02fd3168b6fee65f417a6148a84e3a3c62b737f8d83b7e81","observation_id":"838f42f5-08be-4ecb-b02a-496a4030c8a4","resolution":{"observed_at":"2026-08-04T20:49:07.112428Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:48:56.471770Z","title":"Gaussianformer: Scene as gaussians for vision-based 3d semantic occupancy prediction","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.08388","last_updated":"2025-09-10T08:29:22Z","snapshot_observed_at":"2026-08-09T06:41:30.097348Z","submitted_at":"2025-09-10T08:29:22Z","title":"Semantic Causality-Aware Vision-Based 3D Occupancy Prediction","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-04T20:48:56.471770Z"},"links":{"citing_paper":"/paper/2509.08388"},"observation_digest":"sha256:efc0e5473ca5dea8bebe0cc4639daf103e01151398cda52ce66ef477b73bcd75","observation_id":"0b6ec050-8d7e-48ce-811c-48ff668bdfd7","resolution":{"observed_at":"2026-08-04T20:48:56.471770Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.13193","last_updated":"2025-03-24T12:45:56Z","snapshot_observed_at":"2026-08-09T19:33:07.057918Z","submitted_at":"2024-12-17T18:59:46Z","title":"GaussTR: Foundation Model-Aligned Gaussian Transformer for Self-Supervised 3D Spatial Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.13193","snapshot_observed_at":"2026-08-04T20:48:56.621340Z","title":"Gausstr: Foundation model-aligned gaussian transformer for self-supervised 3d spatial understanding.arXiv preprint arXiv:2412.13193, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08388","last_updated":"2025-09-10T08:29:22Z","snapshot_observed_at":"2026-08-09T06:41:30.097348Z","submitted_at":"2025-09-10T08:29:22Z","title":"Semantic Causality-Aware Vision-Based 3D Occupancy Prediction","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-04T20:48:56.621340Z"},"links":{"cited_paper":"/paper/2412.13193","citing_paper":"/paper/2509.08388"},"observation_digest":"sha256:0bc70f8b0350f0253d378a4e6fb9e5ea890f4ccd9272e91c4930821815ba7151","observation_id":"54930c2a-cac2-4462-8824-bc3d6047ecfc","resolution":{"observed_at":"2026-08-04T20:48:56.621340Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:49:06.724820Z","title":"Layercam: Exploring hierarchical class activation maps for localization.IEEE Transactions on Image Processing, 30:5875–5888, 2021","venue":null,"work_id":"e8395fd3-013c-4cc9-bd87-aa5aa7b68594","year":2021},"citing_paper":{"arxiv_id":"2509.08388","last_updated":"2025-09-10T08:29:22Z","snapshot_observed_at":"2026-08-09T06:41:30.097348Z","submitted_at":"2025-09-10T08:29:22Z","title":"Semantic Causality-Aware Vision-Based 3D Occupancy Prediction","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-04T20:48:56.745577Z"},"links":{"citing_paper":"/paper/2509.08388"},"observation_digest":"sha256:e0870c491c14d4d91a7b909710c99da06054f471ee348960f03ebf42e34f5b18","observation_id":"11fce7a5-a896-4d12-9ac4-e6b502fa9675","resolution":{"observed_at":"2026-08-04T20:49:06.837693Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.08774","last_updated":"2025-02-27T11:57:16Z","snapshot_observed_at":"2026-07-06T20:05:32.369933Z","submitted_at":"2024-12-11T20:55:21Z","title":"ProtoOcc: Accurate, Efficient 3D Occupancy Prediction Using Dual Branch Encoder-Prototype Query Decoder","version":2},"cited_work":{"arxiv_id":"2412.08774","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.08774","snapshot_observed_at":"2026-08-04T20:49:01.755160Z","title":"ProtoOcc: Accurate, Efficient 3D Occupancy Prediction Using Dual Branch Encoder-Prototype Query Decoder","venue":"cs.CV","work_id":"6a69b7c9-832a-48c9-93ed-0b2223e0601d","year":2024},"citing_paper":{"arxiv_id":"2509.08388","last_updated":"2025-09-10T08:29:22Z","snapshot_observed_at":"2026-08-09T06:41:30.097348Z","submitted_at":"2025-09-10T08:29:22Z","title":"Semantic Causality-Aware Vision-Based 3D Occupancy Prediction","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-04T20:48:56.903171Z"},"links":{"cited_paper":"/paper/2412.08774","citing_paper":"/paper/2509.08388"},"observation_digest":"sha256:04e9a7379c31ac3494d886e0e862241aca3651e9e0540fb7b2b27081bdb922c1","observation_id":"68be6329-f766-42fb-8bfb-cd2b1dd572a1","resolution":{"observed_at":"2026-08-04T20:49:01.835195Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:49:06.542180Z","title":"Rgbd based dimensional decomposition residual network for 3d semantic scene completion","venue":null,"work_id":"50283acb-2644-41a2-95b0-1661c96dbbb1","year":2019},"citing_paper":{"arxiv_id":"2509.08388","last_updated":"2025-09-10T08:29:22Z","snapshot_observed_at":"2026-08-09T06:41:30.097348Z","submitted_at":"2025-09-10T08:29:22Z","title":"Semantic Causality-Aware Vision-Based 3D Occupancy Prediction","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-04T20:48:57.007722Z"},"links":{"citing_paper":"/paper/2509.08388"},"observation_digest":"sha256:c6e7b6d9c3939257d915c90b4ccc20d844604ac1ab040562e9edf97695df801f","observation_id":"0dca0488-a8ab-4efc-b4cb-f1d522cd1ac0","resolution":{"observed_at":"2026-08-04T20:49:06.587757Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:49:06.416823Z","title":"Viewformer: Exploring spatiotem- poral modeling for multi-view 3d occupancy perception via view-guided transformers","venue":null,"work_id":"21fc3eec-4744-4702-8c64-9de9851d659f","year":2024},"citing_paper":{"arxiv_id":"2509.08388","last_updated":"2025-09-10T08:29:22Z","snapshot_observed_at":"2026-08-09T06:41:30.097348Z","submitted_at":"2025-09-10T08:29:22Z","title":"Semantic Causality-Aware Vision-Based 3D Occupancy Prediction","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-04T20:48:57.124768Z"},"links":{"citing_paper":"/paper/2509.08388"},"observation_digest":"sha256:d11b5eedd2516965deb7b16503092cd458c34c142093ee9cd9e24aab73d58a56","observation_id":"bef9fe0b-2813-4365-b932-b0e7635f5ef5","resolution":{"observed_at":"2026-08-04T20:49:06.481339Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2206.10092","last_updated":"2022-11-30T11:28:11Z","snapshot_observed_at":"2026-08-09T19:53:57.316379Z","submitted_at":"2022-06-21T03:21:18Z","title":"BEVDepth: Acquisition of Reliable Depth for Multi-view 3D Object Detection","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.10092","snapshot_observed_at":"2026-08-04T20:48:57.186218Z","title":"Bevdepth: Acquisition of reliable depth for multi-view 3d object detec- tion.arXiv preprint arXiv:2206.10092, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.08388","last_updated":"2025-09-10T08:29:22Z","snapshot_observed_at":"2026-08-09T06:41:30.097348Z","submitted_at":"2025-09-10T08:29:22Z","title":"Semantic Causality-Aware Vision-Based 3D Occupancy Prediction","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-04T20:48:57.186218Z"},"links":{"cited_paper":"/paper/2206.10092","citing_paper":"/paper/2509.08388"},"observation_digest":"sha256:60fee8f465ad12ac78e08b66b621e6402f4fbd53ac97c9555ec3dcc5b64a6b08","observation_id":"9d954fb7-7b22-4771-9ef7-3c2de795647e","resolution":{"observed_at":"2026-08-04T20:48:57.186218Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:49:06.147987Z","title":"Bevstereo: Enhancing depth estimation in multi-view 3d object detection with temporal stereo","venue":null,"work_id":"79656281-a6a4-454a-847f-ca986bdcc711","year":2023},"citing_paper":{"arxiv_id":"2509.08388","last_updated":"2025-09-10T08:29:22Z","snapshot_observed_at":"2026-08-09T06:41:30.097348Z","submitted_at":"2025-09-10T08:29:22Z","title":"Semantic Causality-Aware Vision-Based 3D Occupancy Prediction","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-04T20:48:57.319353Z"},"links":{"citing_paper":"/paper/2509.08388"},"observation_digest":"sha256:7c5f8e63255b99142a741da8fc3c28fdf2816996f5571a727be3fc539a002946","observation_id":"9eb4e4f9-34aa-4efd-8418-0c3309bb06f2","resolution":{"observed_at":"2026-08-04T20:49:06.267480Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:49:05.902789Z","title":"V oxformer: Sparse voxel transformer for camera- based 3d semantic scene completion","venue":null,"work_id":"6ce6b0f2-e26b-4c73-8eec-148ff2b62802","year":2023},"citing_paper":{"arxiv_id":"2509.08388","last_updated":"2025-09-10T08:29:22Z","snapshot_observed_at":"2026-08-09T06:41:30.097348Z","submitted_at":"2025-09-10T08:29:22Z","title":"Semantic Causality-Aware Vision-Based 3D Occupancy Prediction","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-04T20:48:57.421830Z"},"links":{"citing_paper":"/paper/2509.08388"},"observation_digest":"sha256:d17d8065608bbec4775173a3a6bd9015ce518c77e15719aed2714408989713e0","observation_id":"1edfbb9f-a5ff-4ed0-a327-c1d22306f0a8","resolution":{"observed_at":"2026-08-04T20:49:05.961251Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:49:05.621922Z","title":"Fast-bev: A fast and strong bird’s- eye view perception baseline.IEEE Transactions on Pattern Analysis and Machine Intelligence, 2024","venue":null,"work_id":"7574ea84-28a2-4a0a-908c-ab6f3565555c","year":2024},"citing_paper":{"arxiv_id":"2509.08388","last_updated":"2025-09-10T08:29:22Z","snapshot_observed_at":"2026-08-09T06:41:30.097348Z","submitted_at":"2025-09-10T08:29:22Z","title":"Semantic Causality-Aware Vision-Based 3D Occupancy Prediction","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-04T20:48:57.512146Z"},"links":{"citing_paper":"/paper/2509.08388"},"observation_digest":"sha256:f4d312747bad9545a659fee24c6ac2f18b0516e77670b04db5d53343d397c83c","observation_id":"6002a124-b07f-4420-9ad6-7280a4a3e744","resolution":{"observed_at":"2026-08-04T20:49:05.749588Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.17270","last_updated":"2022-07-13T06:57:28Z","snapshot_observed_at":"2026-08-10T01:37:48.916044Z","submitted_at":"2022-03-31T17:59:01Z","title":"BEVFormer: Learning Bird's-Eye-View Representation from Multi-Camera Images via Spatiotemporal Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.17270","snapshot_observed_at":"2026-08-04T20:48:57.622231Z","title":"Bevformer: Learning bird’s-eye-view representation from multi-camera images via spatiotemporal transformers.arXiv preprint arXiv:2203.17270, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.08388","last_updated":"2025-09-10T08:29:22Z","snapshot_observed_at":"2026-08-09T06:41:30.097348Z","submitted_at":"2025-09-10T08:29:22Z","title":"Semantic Causality-Aware Vision-Based 3D Occupancy Prediction","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-04T20:48:57.622231Z"},"links":{"cited_paper":"/paper/2203.17270","citing_paper":"/paper/2509.08388"},"observation_digest":"sha256:c8c9ed7dadfe901876423a27e739f62e59fa3798b473be28c72a58abbb17833b","observation_id":"6ded0fc4-1f91-46a2-8582-bb5106ccb31b","resolution":{"observed_at":"2026-08-04T20:48:57.622231Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.01492","last_updated":"2023-07-04T05:55:54Z","snapshot_observed_at":"2026-08-10T11:08:06.350383Z","submitted_at":"2023-07-04T05:55:54Z","title":"FB-OCC: 3D Occupancy Prediction based on Forward-Backward View Transformation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.01492","snapshot_observed_at":"2026-08-04T20:48:57.743557Z","title":"Fb-occ: 3d occupancy prediction based on forward-backward view transformation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.08388","last_updated":"2025-09-10T08:29:22Z","snapshot_observed_at":"2026-08-09T06:41:30.097348Z","submitted_at":"2025-09-10T08:29:22Z","title":"Semantic Causality-Aware Vision-Based 3D Occupancy Prediction","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-04T20:48:57.743557Z"},"links":{"cited_paper":"/paper/2307.01492","citing_paper":"/paper/2509.08388"},"observation_digest":"sha256:a2304316dd4a9c68bcd9eb2e2cd8c4c1b5ed8a9667db146ceb3101aae573d7c3","observation_id":"0dc3bfe8-710c-4869-85a0-9c839baa9086","resolution":{"observed_at":"2026-08-04T20:48:57.743557Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:49:05.406502Z","title":"Fb-bev: Bev representation from forward-backward view transformations","venue":null,"work_id":"590c2f4e-dbf9-441a-9471-c47a42c5e439","year":2023},"citing_paper":{"arxiv_id":"2509.08388","last_updated":"2025-09-10T08:29:22Z","snapshot_observed_at":"2026-08-09T06:41:30.097348Z","submitted_at":"2025-09-10T08:29:22Z","title":"Semantic Causality-Aware Vision-Based 3D Occupancy Prediction","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-04T20:48:57.906142Z"},"links":{"citing_paper":"/paper/2509.08388"},"observation_digest":"sha256:3543d171aa1439b2cc3d31971f56ae30b5a8d6a6e7b86cdc6cbff0972e414c9b","observation_id":"9df8f515-28a9-407e-9696-75871fd81937","resolution":{"observed_at":"2026-08-04T20:49:05.465911Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:49:05.157524Z","title":"Cascadeflow: 3d occupancy and flow prediction with cascaded sparsity sampling refine- ment framework.CVPR 2024 Autonomous Grand Challenge Track On Occupancy and Flow, 2024","venue":null,"work_id":"8823023e-4b69-4ab5-8700-9b42ea25573a","year":2024},"citing_paper":{"arxiv_id":"2509.08388","last_updated":"2025-09-10T08:29:22Z","snapshot_observed_at":"2026-08-09T06:41:30.097348Z","submitted_at":"2025-09-10T08:29:22Z","title":"Semantic Causality-Aware Vision-Based 3D Occupancy Prediction","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-04T20:48:58.028676Z"},"links":{"citing_paper":"/paper/2509.08388"},"observation_digest":"sha256:7a8b45b7fc75ce4884af13990372e3885651945d3ab0cbdf2432f00fd01beefc","observation_id":"6eecf2c2-2049-4f2f-9596-b42862eec58d","resolution":{"observed_at":"2026-08-04T20:49:05.229285Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:49:04.905234Z","title":"Fully sparse 3d occupancy prediction","venue":null,"work_id":"bad241c5-7e6f-4ebf-b9d5-780b4f3a82bb","year":null},"citing_paper":{"arxiv_id":"2509.08388","last_updated":"2025-09-10T08:29:22Z","snapshot_observed_at":"2026-08-09T06:41:30.097348Z","submitted_at":"2025-09-10T08:29:22Z","title":"Semantic Causality-Aware Vision-Based 3D Occupancy Prediction","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-04T20:48:58.197965Z"},"links":{"citing_paper":"/paper/2509.08388"},"observation_digest":"sha256:ff3fc27376b60b51b9902060926b18a86bcaee59228163b882bd92b7b56d43cf","observation_id":"b552b499-ecfa-4389-a7ae-4232f04b8221","resolution":{"observed_at":"2026-08-04T20:49:04.963653Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:49:04.705903Z","title":"Surroundsdf: Implicit 3d scene understanding based on signed distance field","venue":null,"work_id":"fb95f5ed-6bac-4257-825a-b25d1b562965","year":2024},"citing_paper":{"arxiv_id":"2509.08388","last_updated":"2025-09-10T08:29:22Z","snapshot_observed_at":"2026-08-09T06:41:30.097348Z","submitted_at":"2025-09-10T08:29:22Z","title":"Semantic Causality-Aware Vision-Based 3D Occupancy Prediction","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-04T20:48:58.309943Z"},"links":{"citing_paper":"/paper/2509.08388"},"observation_digest":"sha256:d6f952ae272b531ebcc1fe4fffe6f625213034d8eee3774c81bbc7bc06c7c42d","observation_id":"5ae28ea3-d4b0-4cef-8079-bec11dab974c","resolution":{"observed_at":"2026-08-04T20:49:04.842739Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:49:04.521606Z","title":"See and think: Disentangling semantic scene completion.Advances in Neural Information Processing Systems, 31, 2018","venue":null,"work_id":"2a2bf09b-5680-4397-a7d5-5e67a4669e68","year":2018},"citing_paper":{"arxiv_id":"2509.08388","last_updated":"2025-09-10T08:29:22Z","snapshot_observed_at":"2026-08-09T06:41:30.097348Z","submitted_at":"2025-09-10T08:29:22Z","title":"Semantic Causality-Aware Vision-Based 3D Occupancy Prediction","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-04T20:48:58.473981Z"},"links":{"citing_paper":"/paper/2509.08388"},"observation_digest":"sha256:9846b08683f50f48e76f321d332253c62a5bc496d3faf3684f6911be74574d0f","observation_id":"aeef4879-a272-49ce-b422-adde14d73d70","resolution":{"observed_at":"2026-08-04T20:49:04.584167Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.07587","last_updated":"2024-10-08T11:07:08Z","snapshot_observed_at":"2026-08-05T16:35:01.719928Z","submitted_at":"2024-07-10T12:20:11Z","title":"Let Occ Flow: Self-Supervised 3D Occupancy Flow Prediction","version":3},"cited_work":{"arxiv_id":"2407.07587","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.07587","snapshot_observed_at":"2026-08-04T20:49:01.537365Z","title":"Let Occ Flow: Self-Supervised 3D Occupancy Flow Prediction","venue":"cs.CV","work_id":"66f539b3-07f7-40c1-8538-21298005ee5f","year":2024},"citing_paper":{"arxiv_id":"2509.08388","last_updated":"2025-09-10T08:29:22Z","snapshot_observed_at":"2026-08-09T06:41:30.097348Z","submitted_at":"2025-09-10T08:29:22Z","title":"Semantic Causality-Aware Vision-Based 3D Occupancy Prediction","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-04T20:48:58.591854Z"},"links":{"cited_paper":"/paper/2407.07587","citing_paper":"/paper/2509.08388"},"observation_digest":"sha256:cb510d6fabf7a93e57a40632592fcbac2f1cd36033a2be4d5a09556cb4041f22","observation_id":"dd512924-6502-4325-baf3-0ca6b2a411e2","resolution":{"observed_at":"2026-08-04T20:49:01.586477Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-08-09T20:34:52.923500Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-04T20:48:58.682573Z","title":"Fixing weight decay regularization in adam.arXiv preprint arXiv:1711.05101,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.08388","last_updated":"2025-09-10T08:29:22Z","snapshot_observed_at":"2026-08-09T06:41:30.097348Z","submitted_at":"2025-09-10T08:29:22Z","title":"Semantic Causality-Aware Vision-Based 3D Occupancy Prediction","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-04T20:48:58.682573Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2509.08388"},"observation_digest":"sha256:964ecbfd1567aafc34d7cb1eed6ba79acef5c27ebe63dea3aead1c0b9b65a5da","observation_id":"93ee509b-0074-47a7-a9df-06223fd3c163","resolution":{"observed_at":"2026-08-04T20:48:58.682573Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.03774","last_updated":"2024-03-19T05:03:18Z","snapshot_observed_at":"2026-07-06T16:57:55.137830Z","submitted_at":"2023-12-06T02:52:54Z","title":"OctreeOcc: Efficient and Multi-Granularity Occupancy Prediction Using Octree Queries","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.03774","snapshot_observed_at":"2026-08-04T20:48:58.855288Z","title":"Oc- treeocc: Efficient and multi-granularity occupancy predic- tion using octree queries.arXiv preprint arXiv:2312.03774,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.08388","last_updated":"2025-09-10T08:29:22Z","snapshot_observed_at":"2026-08-09T06:41:30.097348Z","submitted_at":"2025-09-10T08:29:22Z","title":"Semantic Causality-Aware Vision-Based 3D Occupancy Prediction","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-04T20:48:58.855288Z"},"links":{"cited_paper":"/paper/2312.03774","citing_paper":"/paper/2509.08388"},"observation_digest":"sha256:e616500b7c8c82c9a290038aeabc993b0ed77ed36653fe5b4deef593321b8c0e","observation_id":"7808cc04-6f13-45f5-9775-b584ce46fbc2","resolution":{"observed_at":"2026-08-04T20:48:58.855288Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.01919","last_updated":"2024-04-11T10:38:33Z","snapshot_observed_at":"2026-08-10T09:36:12.952993Z","submitted_at":"2023-12-04T14:23:18Z","title":"COTR: Compact Occupancy TRansformer for Vision-based 3D Occupancy Prediction","version":2},"cited_work":{"arxiv_id":"2312.01919","doi":null,"metadata_source":"pith","pith_arxiv_id":"2312.01919","snapshot_observed_at":"2026-08-04T20:49:01.295512Z","title":"COTR: Compact Occupancy TRansformer for Vision-based 3D Occupancy Prediction","venue":"cs.CV","work_id":"debe44a9-cc7e-4c1d-b53f-316776f3031f","year":2023},"citing_paper":{"arxiv_id":"2509.08388","last_updated":"2025-09-10T08:29:22Z","snapshot_observed_at":"2026-08-09T06:41:30.097348Z","submitted_at":"2025-09-10T08:29:22Z","title":"Semantic Causality-Aware Vision-Based 3D Occupancy Prediction","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-04T20:48:58.958361Z"},"links":{"cited_paper":"/paper/2312.01919","citing_paper":"/paper/2509.08388"},"observation_digest":"sha256:68e6a23ee63faafcfc9dfa974b6d7aca98187133f643a5b0b18f94b3c93f7ba1","observation_id":"4d017477-cada-4500-988f-f61c8a86c1d5","resolution":{"observed_at":"2026-08-04T20:49:01.362499Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:49:04.358323Z","title":"Renderocc: Vision-centric 3d occupancy pre- diction with 2d rendering supervision","venue":null,"work_id":"a5f101ca-7659-41b3-9767-b7d2f593f5fe","year":2024},"citing_paper":{"arxiv_id":"2509.08388","last_updated":"2025-09-10T08:29:22Z","snapshot_observed_at":"2026-08-09T06:41:30.097348Z","submitted_at":"2025-09-10T08:29:22Z","title":"Semantic Causality-Aware Vision-Based 3D Occupancy Prediction","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-04T20:48:59.077255Z"},"links":{"citing_paper":"/paper/2509.08388"},"observation_digest":"sha256:86557f13f31dc115fadf92759192295c1c5b451ffa1fbc23aa58507536304caa","observation_id":"94e6b481-8b51-4fba-945e-01054b250c8b","resolution":{"observed_at":"2026-08-04T20:49:04.417130Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:49:04.160550Z","title":"Lift, splat, shoot: Encod- ing images from arbitrary camera rigs by implicitly unpro- jecting to 3d","venue":null,"work_id":"ce3bf7f1-2bbb-4c02-8719-dbf779a80a18","year":2020},"citing_paper":{"arxiv_id":"2509.08388","last_updated":"2025-09-10T08:29:22Z","snapshot_observed_at":"2026-08-09T06:41:30.097348Z","submitted_at":"2025-09-10T08:29:22Z","title":"Semantic Causality-Aware Vision-Based 3D Occupancy Prediction","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-04T20:48:59.194319Z"},"links":{"citing_paper":"/paper/2509.08388"},"observation_digest":"sha256:0bf046e77cb307ea7cc904e8af5c269e9ab769328b74dfa97a5aa04ffd22e3e3","observation_id":"2d45f1c1-b8fc-42ce-89f9-4b9c5cafee62","resolution":{"observed_at":"2026-08-04T20:49:04.216600Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:49:03.921268Z","title":"Occupancy as set of points","venue":null,"work_id":"8ae46d89-0cd6-45db-b5fd-1e79b7413a28","year":2024},"citing_paper":{"arxiv_id":"2509.08388","last_updated":"2025-09-10T08:29:22Z","snapshot_observed_at":"2026-08-09T06:41:30.097348Z","submitted_at":"2025-09-10T08:29:22Z","title":"Semantic Causality-Aware Vision-Based 3D Occupancy Prediction","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-04T20:48:59.310623Z"},"links":{"citing_paper":"/paper/2509.08388"},"observation_digest":"sha256:7247b00dba5236370fe47fc3c298ad2bb4be58719f4673d785d8ca95a079e3b8","observation_id":"ddb48f7d-3e1d-44fa-87a5-2c8be61991a4","resolution":{"observed_at":"2026-08-04T20:49:04.023636Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:49:03.538024Z","title":"Occ3d: A large-scale 3d occupancy prediction benchmark for autonomous driving.Advances in Neural Information Processing Systems, 36, 2024","venue":null,"work_id":"1836f7d6-f08a-4ab6-9d81-8494f7aa03fa","year":2024},"citing_paper":{"arxiv_id":"2509.08388","last_updated":"2025-09-10T08:29:22Z","snapshot_observed_at":"2026-08-09T06:41:30.097348Z","submitted_at":"2025-09-10T08:29:22Z","title":"Semantic Causality-Aware Vision-Based 3D Occupancy Prediction","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-04T20:48:59.414868Z"},"links":{"citing_paper":"/paper/2509.08388"},"observation_digest":"sha256:34060fd556bf301e5da1155ce6b2a482c4eb8be73dc0fc1816b3856c5dd4eea0","observation_id":"513b1713-1df3-4b59-baf7-eff3deff1213","resolution":{"observed_at":"2026-08-04T20:49:03.649569Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:49:03.241389Z","title":"Scene as occupancy","venue":null,"work_id":"f72ab372-622c-400b-96a3-78c5acd39cf1","year":2023},"citing_paper":{"arxiv_id":"2509.08388","last_updated":"2025-09-10T08:29:22Z","snapshot_observed_at":"2026-08-09T06:41:30.097348Z","submitted_at":"2025-09-10T08:29:22Z","title":"Semantic Causality-Aware Vision-Based 3D Occupancy Prediction","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-04T20:48:59.564782Z"},"links":{"citing_paper":"/paper/2509.08388"},"observation_digest":"sha256:685a21cf1edcae6c2a1c074d9ac4035e2fe61b3aa97afa0c22c3ddf5ed7d9fca","observation_id":"df904d36-bfbc-4660-8fae-975dda9eeff3","resolution":{"observed_at":"2026-08-04T20:49:03.344583Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:48:59.718389Z","title":"Attention is all you need.Advances in neural information processing systems, 30, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2509.08388","last_updated":"2025-09-10T08:29:22Z","snapshot_observed_at":"2026-08-09T06:41:30.097348Z","submitted_at":"2025-09-10T08:29:22Z","title":"Semantic Causality-Aware Vision-Based 3D Occupancy Prediction","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-04T20:48:59.718389Z"},"links":{"citing_paper":"/paper/2509.08388"},"observation_digest":"sha256:f12f844c131d113d2f63db70ac9621904470a65a3a788d432be02d7326ec558f","observation_id":"b984d593-c73e-41d1-9536-2283ec3e6741","resolution":{"observed_at":"2026-08-04T20:48:59.718389Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14160","last_updated":"2023-12-19T15:13:52Z","snapshot_observed_at":"2026-08-04T17:03:48.643939Z","submitted_at":"2023-05-23T15:26:20Z","title":"Label Words are Anchors: An Information Flow Perspective for Understanding In-Context Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.14160","snapshot_observed_at":"2026-08-04T20:48:59.844453Z","title":"Label words are an- chors: An information flow perspective for understanding in-context learning.arXiv preprint arXiv:2305.14160, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.08388","last_updated":"2025-09-10T08:29:22Z","snapshot_observed_at":"2026-08-09T06:41:30.097348Z","submitted_at":"2025-09-10T08:29:22Z","title":"Semantic Causality-Aware Vision-Based 3D Occupancy Prediction","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-04T20:48:59.844453Z"},"links":{"cited_paper":"/paper/2305.14160","citing_paper":"/paper/2509.08388"},"observation_digest":"sha256:55f9806f45b4e332ac29d814549dba3a7190f4c53fe1bc35734efa07e04ee0f9","observation_id":"fe512cfd-54da-4499-9888-9700cd979881","resolution":{"observed_at":"2026-08-04T20:48:59.844453Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.03991","last_updated":"2023-03-07T15:43:39Z","snapshot_observed_at":"2026-07-06T14:59:46.707335Z","submitted_at":"2023-03-07T15:43:39Z","title":"OpenOccupancy: A Large Scale Benchmark for Surrounding Semantic Occupancy Perception","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.03991","snapshot_observed_at":"2026-08-04T20:48:59.913958Z","title":"Openoccupancy: A large scale benchmark for surrounding semantic occupancy perception.arXiv preprint arXiv:2303.03991, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.08388","last_updated":"2025-09-10T08:29:22Z","snapshot_observed_at":"2026-08-09T06:41:30.097348Z","submitted_at":"2025-09-10T08:29:22Z","title":"Semantic Causality-Aware Vision-Based 3D Occupancy Prediction","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-04T20:48:59.913958Z"},"links":{"cited_paper":"/paper/2303.03991","citing_paper":"/paper/2509.08388"},"observation_digest":"sha256:b9c6b85eb08a83ff478eb53075b455247106357cd3ba126b71e6eb7dcc7a7732","observation_id":"046c0d9e-70d1-467c-9507-61bc66ccb0c0","resolution":{"observed_at":"2026-08-04T20:48:59.913958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.09551","last_updated":"2023-08-27T15:33:19Z","snapshot_observed_at":"2026-08-10T11:10:32.726285Z","submitted_at":"2023-03-16T17:59:08Z","title":"SurroundOcc: Multi-Camera 3D Occupancy Prediction for Autonomous Driving","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.09551","snapshot_observed_at":"2026-08-04T20:48:59.984035Z","title":"Surroundocc: Multi-camera 3d oc- cupancy prediction for autonomous driving.arXiv preprint arXiv:2303.09551, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.08388","last_updated":"2025-09-10T08:29:22Z","snapshot_observed_at":"2026-08-09T06:41:30.097348Z","submitted_at":"2025-09-10T08:29:22Z","title":"Semantic Causality-Aware Vision-Based 3D Occupancy Prediction","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-04T20:48:59.984035Z"},"links":{"cited_paper":"/paper/2303.09551","citing_paper":"/paper/2509.08388"},"observation_digest":"sha256:724d0cb0e5c46695915e9f9fbb9435641d9e36fc622fcb0d353d6a072a9f6246","observation_id":"29bb6d8d-7190-4750-ba1a-a677d9418fae","resolution":{"observed_at":"2026-08-04T20:48:59.984035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.07972","last_updated":"2025-03-04T12:53:32Z","snapshot_observed_at":"2026-08-09T17:04:10.954870Z","submitted_at":"2024-09-12T12:12:19Z","title":"Deep Height Decoupling for Precise Vision-based 3D Occupancy Prediction","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.07972","snapshot_observed_at":"2026-08-04T20:49:00.138246Z","title":"Deep height decoupling for pre- cise vision-based 3d occupancy prediction.arXiv preprint arXiv:2409.07972, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08388","last_updated":"2025-09-10T08:29:22Z","snapshot_observed_at":"2026-08-09T06:41:30.097348Z","submitted_at":"2025-09-10T08:29:22Z","title":"Semantic Causality-Aware Vision-Based 3D Occupancy Prediction","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-04T20:49:00.138246Z"},"links":{"cited_paper":"/paper/2409.07972","citing_paper":"/paper/2509.08388"},"observation_digest":"sha256:e4204d1d75a257fc6f11de6568e14f4c4fbc4db676353ba860dc058dee866900","observation_id":"287fdb31-db83-4a27-a59a-12204c2f1a27","resolution":{"observed_at":"2026-08-04T20:49:00.138246Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.11356","last_updated":"2025-02-13T05:20:48Z","snapshot_observed_at":"2026-08-10T11:06:50.221913Z","submitted_at":"2024-09-17T17:00:52Z","title":"RenderWorld: World Model with Self-Supervised 3D Label","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.11356","snapshot_observed_at":"2026-08-04T20:49:00.193227Z","title":"Renderworld: World model with self-supervised 3d label.arXiv preprint arXiv:2409.11356,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.08388","last_updated":"2025-09-10T08:29:22Z","snapshot_observed_at":"2026-08-09T06:41:30.097348Z","submitted_at":"2025-09-10T08:29:22Z","title":"Semantic Causality-Aware Vision-Based 3D Occupancy Prediction","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-04T20:49:00.193227Z"},"links":{"cited_paper":"/paper/2409.11356","citing_paper":"/paper/2509.08388"},"observation_digest":"sha256:e6156a07472abda11c2be5c97dc8374762fb4ba2bbe229d57e7c4741bea6b916","observation_id":"5ea04341-28ea-447d-b6c1-799087b87a69","resolution":{"observed_at":"2026-08-04T20:49:00.193227Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:49:03.008795Z","title":"Seman- tic 3d occupancy mapping through efficient high order crfs","venue":null,"work_id":"a8098529-b92b-43a8-aa6f-6b6d807e6b15","year":2017},"citing_paper":{"arxiv_id":"2509.08388","last_updated":"2025-09-10T08:29:22Z","snapshot_observed_at":"2026-08-09T06:41:30.097348Z","submitted_at":"2025-09-10T08:29:22Z","title":"Semantic Causality-Aware Vision-Based 3D Occupancy Prediction","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-04T20:49:00.324745Z"},"links":{"citing_paper":"/paper/2509.08388"},"observation_digest":"sha256:756176d1b57806196ea0f61839a25a3c4a9dc15e993aee9184a5a54ebdd4afa3","observation_id":"e425e5cb-4ead-4684-b53f-a1be186e896c","resolution":{"observed_at":"2026-08-04T20:49:03.060651Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12058","last_updated":"2023-11-18T15:28:09Z","snapshot_observed_at":"2026-07-06T16:50:10.189504Z","submitted_at":"2023-11-18T15:28:09Z","title":"FlashOcc: Fast and Memory-Efficient Occupancy Prediction via Channel-to-Height Plugin","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.12058","snapshot_observed_at":"2026-08-04T20:49:00.371105Z","title":"Flashocc: Fast and memory-efficient occupancy prediction via channel-to-height plugin.arXiv preprint arXiv:2311.12058, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.08388","last_updated":"2025-09-10T08:29:22Z","snapshot_observed_at":"2026-08-09T06:41:30.097348Z","submitted_at":"2025-09-10T08:29:22Z","title":"Semantic Causality-Aware Vision-Based 3D Occupancy Prediction","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-04T20:49:00.371105Z"},"links":{"cited_paper":"/paper/2311.12058","citing_paper":"/paper/2509.08388"},"observation_digest":"sha256:440abd1423fb8b3def0b2c05f4e62936fef94b6f88b372de86e21a02b5494159","observation_id":"57694599-9560-4a65-a03d-50eefd6d8eda","resolution":{"observed_at":"2026-08-04T20:49:00.371105Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.09243","last_updated":"2024-08-21T12:24:49Z","snapshot_observed_at":"2026-08-06T07:01:21.861896Z","submitted_at":"2023-12-14T18:58:52Z","title":"OccNeRF: Advancing 3D Occupancy Prediction in LiDAR-Free Environments","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.09243","snapshot_observed_at":"2026-08-04T20:49:00.461114Z","title":"Occnerf: Self- supervised multi-camera occupancy prediction with neural radiance fields.arXiv preprint arXiv:2312.09243, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.08388","last_updated":"2025-09-10T08:29:22Z","snapshot_observed_at":"2026-08-09T06:41:30.097348Z","submitted_at":"2025-09-10T08:29:22Z","title":"Semantic Causality-Aware Vision-Based 3D Occupancy Prediction","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-04T20:49:00.461114Z"},"links":{"cited_paper":"/paper/2312.09243","citing_paper":"/paper/2509.08388"},"observation_digest":"sha256:69ed799f4b9ed93cedf0055928d7bbece4ed64ed2a38c3572729bd91ecf48cc6","observation_id":"3a1d3050-d290-4fdf-9c96-7d8ff15c1c61","resolution":{"observed_at":"2026-08-04T20:49:00.461114Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.05976","last_updated":"2026-06-21T15:24:02Z","snapshot_observed_at":"2026-07-06T20:03:29.510169Z","submitted_at":"2024-12-08T15:49:35Z","title":"LightOcc: Lightweight Spatial Embedding for Efficient Vision-based 3D Occupancy Prediction","version":2},"cited_work":{"arxiv_id":"2412.05976","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.05976","snapshot_observed_at":"2026-08-04T20:49:00.965060Z","title":"LightOcc: Lightweight Spatial Embedding for Efficient Vision-based 3D Occupancy Prediction","venue":"cs.CV","work_id":"5ab477fc-1221-4667-8538-73b61e743d9a","year":2024},"citing_paper":{"arxiv_id":"2509.08388","last_updated":"2025-09-10T08:29:22Z","snapshot_observed_at":"2026-08-09T06:41:30.097348Z","submitted_at":"2025-09-10T08:29:22Z","title":"Semantic Causality-Aware Vision-Based 3D Occupancy Prediction","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-04T20:49:00.559278Z"},"links":{"cited_paper":"/paper/2412.05976","citing_paper":"/paper/2509.08388"},"observation_digest":"sha256:5cd961dc48906c325753b2a7bbae2a0b270ff031b2ddd19cc9b08364cb07b7ce","observation_id":"4dae1da8-d7e4-41f8-bd75-43e310339944","resolution":{"observed_at":"2026-08-04T20:49:01.027934Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.05316","last_updated":"2023-04-11T16:15:50Z","snapshot_observed_at":"2026-07-06T15:14:28.574778Z","submitted_at":"2023-04-11T16:15:50Z","title":"OccFormer: Dual-path Transformer for Vision-based 3D Semantic Occupancy Prediction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.05316","snapshot_observed_at":"2026-08-04T20:49:00.617025Z","title":"Occformer: Dual-path transformer for vision-based 3d semantic occu- pancy prediction.arXiv preprint arXiv:2304.05316, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.08388","last_updated":"2025-09-10T08:29:22Z","snapshot_observed_at":"2026-08-09T06:41:30.097348Z","submitted_at":"2025-09-10T08:29:22Z","title":"Semantic Causality-Aware Vision-Based 3D Occupancy Prediction","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-04T20:49:00.617025Z"},"links":{"cited_paper":"/paper/2304.05316","citing_paper":"/paper/2509.08388"},"observation_digest":"sha256:f79a9c6779299d91bcb9a20651bac59283defc1a905700b0326c739fa88aedae","observation_id":"16e145b0-7e9c-4bd6-8f66-5c7fe1173288","resolution":{"observed_at":"2026-08-04T20:49:00.617025Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:49:02.847701Z","title":"Veon: V ocabulary- enhanced occupancy prediction","venue":null,"work_id":"325ea338-dc29-41d5-937f-302f1e54fa73","year":2024},"citing_paper":{"arxiv_id":"2509.08388","last_updated":"2025-09-10T08:29:22Z","snapshot_observed_at":"2026-08-09T06:41:30.097348Z","submitted_at":"2025-09-10T08:29:22Z","title":"Semantic Causality-Aware Vision-Based 3D Occupancy Prediction","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-04T20:49:00.726687Z"},"links":{"citing_paper":"/paper/2509.08388"},"observation_digest":"sha256:d7c395b6e48fa6261eef3de577336b25ad9a67eedbb107ea58d8105338241898","observation_id":"54a482bc-88b0-40e5-bf07-408e70b4c5b1","resolution":{"observed_at":"2026-08-04T20:49:02.939771Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:49:02.613909Z","title":"Visual in-context learning for large vision-language models","venue":null,"work_id":"fde18169-3203-496b-a39c-ac5ab42f6f83","year":2024},"citing_paper":{"arxiv_id":"2509.08388","last_updated":"2025-09-10T08:29:22Z","snapshot_observed_at":"2026-08-09T06:41:30.097348Z","submitted_at":"2025-09-10T08:29:22Z","title":"Semantic Causality-Aware Vision-Based 3D Occupancy Prediction","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-04T20:49:00.822248Z"},"links":{"citing_paper":"/paper/2509.08388"},"observation_digest":"sha256:8b786f0e6d1431e9a7481de7cc809b674383ddf58a34ce33941388e8734ee7ec","observation_id":"20f7a775-39aa-45d6-9fec-9fbaf422651f","resolution":{"observed_at":"2026-08-04T20:49:02.698241Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2509.08388","last_updated":"2025-09-10T08:29:22Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-09T06:41:30.097348Z","submitted_at":"2025-09-10T08:29:22Z","title":"Semantic Causality-Aware Vision-Based 3D Occupancy Prediction"},"reference_resolution":{"displayed":54,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":22,"verified_exact":7,"verified_fuzzy":25},"total_outbound_references":54},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 54 of 54 outbound references and 0 inbound Pith citation observations for arXiv:2509.08388."}