{"as_of":"2026-08-20T09:09:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:224f44fea73ad59cdf839f4573eb306376be59df98c60437f3ba30920e464384","coverage":[{"denominator":103,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-11T14:25:21.264423Z","state":"measured"},{"denominator":100,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":100,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.04732/citation-record","integrity":"/paper/2607.04732/integrity","json":"/paper/2607.04732/citation-record.json","paper":"/paper/2607.04732"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T14:25:21.264423Z","title":"V oxnet: A 3d convolutional neural network for real-time object recognition,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2607.04732","last_updated":"2026-07-06T07:10:00Z","snapshot_observed_at":"2026-08-08T22:48:13.911536Z","submitted_at":"2026-07-06T07:10:00Z","title":"SparseOcc++: Geometry-Aware Sparse Latent Representation for Semantic Occupancy Prediction","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-11T14:25:21.264423Z"},"links":{"citing_paper":"/paper/2607.04732"},"observation_digest":"sha256:3e508334f7d50e7058727a19c09e249916058952172d5d6ab8ee380b411dc56f","observation_id":"1382a18b-9d3f-4516-a1b0-efdb9fd6aa6a","resolution":{"observed_at":"2026-07-11T14:25:21.264423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T14:25:21.264423Z","title":"Openoccupancy: A large scale benchmark for surrounding semantic occupancy perception,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.04732","last_updated":"2026-07-06T07:10:00Z","snapshot_observed_at":"2026-08-08T22:48:13.911536Z","submitted_at":"2026-07-06T07:10:00Z","title":"SparseOcc++: Geometry-Aware Sparse Latent Representation for Semantic Occupancy Prediction","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-11T14:25:21.264423Z"},"links":{"citing_paper":"/paper/2607.04732"},"observation_digest":"sha256:1f764caf8364810cd053490ac255fd6ae0f696405a4d6fae7e9d3ba450336546","observation_id":"a648a8b8-099a-4f6e-bd68-d4fd38fcfe6f","resolution":{"observed_at":"2026-07-11T14:25:21.264423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T14:25:21.264423Z","title":"Bevformer: Learning bird’s-eye-view representation from multi-camera images via spatiotemporal transformers,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.04732","last_updated":"2026-07-06T07:10:00Z","snapshot_observed_at":"2026-08-08T22:48:13.911536Z","submitted_at":"2026-07-06T07:10:00Z","title":"SparseOcc++: Geometry-Aware Sparse Latent Representation for Semantic Occupancy Prediction","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-11T14:25:21.264423Z"},"links":{"citing_paper":"/paper/2607.04732"},"observation_digest":"sha256:301af89335c462f9773b93dce416b0ca3ac1c217900394b22224737ba5de4c1f","observation_id":"94a93ed6-e6be-4aa3-aacb-17dffd7470a4","resolution":{"observed_at":"2026-07-11T14:25:21.264423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11790","last_updated":"2022-06-16T09:15:52Z","snapshot_observed_at":"2026-08-17T05:15:58.663240Z","submitted_at":"2021-12-22T10:48:06Z","title":"BEVDet: High-performance Multi-camera 3D Object Detection in Bird-Eye-View","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.11790","snapshot_observed_at":"2026-07-11T14:25:21.264423Z","title":"Bevdet: High-performance multi-camera 3d object detection in bird-eye-view,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.04732","last_updated":"2026-07-06T07:10:00Z","snapshot_observed_at":"2026-08-08T22:48:13.911536Z","submitted_at":"2026-07-06T07:10:00Z","title":"SparseOcc++: Geometry-Aware Sparse Latent Representation for Semantic Occupancy Prediction","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-11T14:25:21.264423Z"},"links":{"cited_paper":"/paper/2112.11790","citing_paper":"/paper/2607.04732"},"observation_digest":"sha256:2ced35099b599193f3f5cf67c6decd394890acb9f8ef7710c41e6567f6d68deb","observation_id":"7d4064a7-d3c7-41e6-a88b-0f5dfe6a9d38","resolution":{"observed_at":"2026-07-11T14:25:21.264423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T14:25:21.264423Z","title":"Tri-perspective view for vision-based 3d semantic occupancy prediction,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.04732","last_updated":"2026-07-06T07:10:00Z","snapshot_observed_at":"2026-08-08T22:48:13.911536Z","submitted_at":"2026-07-06T07:10:00Z","title":"SparseOcc++: Geometry-Aware Sparse Latent Representation for Semantic Occupancy Prediction","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-11T14:25:21.264423Z"},"links":{"citing_paper":"/paper/2607.04732"},"observation_digest":"sha256:384b7ed9b2d17185c99e82015293bfa9200e8ffb15d90e027631f4100f95d3f3","observation_id":"fe0f2a26-114d-4a05-ad57-2ab911444047","resolution":{"observed_at":"2026-07-11T14:25:21.264423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T14:25:21.264423Z","title":"Driveadapter: Breaking the coupling barrier of perception and planning in end-to-end autonomous driving,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.04732","last_updated":"2026-07-06T07:10:00Z","snapshot_observed_at":"2026-08-08T22:48:13.911536Z","submitted_at":"2026-07-06T07:10:00Z","title":"SparseOcc++: Geometry-Aware Sparse Latent Representation for Semantic Occupancy Prediction","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-11T14:25:21.264423Z"},"links":{"citing_paper":"/paper/2607.04732"},"observation_digest":"sha256:1068c494d64c4e4d12714c1efbc8bf2185b4f5433c6388b87ca0df6b82273da5","observation_id":"2e1ba811-9a59-474d-b3d4-f44ea6163c30","resolution":{"observed_at":"2026-07-11T14:25:21.264423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T14:25:21.264423Z","title":"Planning-oriented autonomous driving,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.04732","last_updated":"2026-07-06T07:10:00Z","snapshot_observed_at":"2026-08-08T22:48:13.911536Z","submitted_at":"2026-07-06T07:10:00Z","title":"SparseOcc++: Geometry-Aware Sparse Latent Representation for Semantic Occupancy Prediction","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-11T14:25:21.264423Z"},"links":{"citing_paper":"/paper/2607.04732"},"observation_digest":"sha256:93cb826513dd9315f26259e81b5fc2469fcb768691b22a3674c6660ddbc42e23","observation_id":"e760652f-70fc-49c1-a149-01988e3239b2","resolution":{"observed_at":"2026-07-11T14:25:21.264423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T14:25:21.264423Z","title":"Genad: Generative end-to-end autonomous driving,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.04732","last_updated":"2026-07-06T07:10:00Z","snapshot_observed_at":"2026-08-08T22:48:13.911536Z","submitted_at":"2026-07-06T07:10:00Z","title":"SparseOcc++: Geometry-Aware Sparse Latent Representation for Semantic Occupancy Prediction","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-11T14:25:21.264423Z"},"links":{"citing_paper":"/paper/2607.04732"},"observation_digest":"sha256:cda2a2ed6acb2d365425150d1b3c4849424be3af9111fa3efd4bb30204600efd","observation_id":"aa291c4d-6132-49c3-ad25-93e4f8eb5c95","resolution":{"observed_at":"2026-07-11T14:25:21.264423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T14:25:21.264423Z","title":"Lift, splat, shoot: Encoding images from arbitrary camera rigs by implicitly unprojecting to 3d,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.04732","last_updated":"2026-07-06T07:10:00Z","snapshot_observed_at":"2026-08-08T22:48:13.911536Z","submitted_at":"2026-07-06T07:10:00Z","title":"SparseOcc++: Geometry-Aware Sparse Latent Representation for Semantic Occupancy Prediction","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-11T14:25:21.264423Z"},"links":{"citing_paper":"/paper/2607.04732"},"observation_digest":"sha256:61176344caebfb920154ab1d760f68c61289d80f73ef6a542a2e35610c8b101c","observation_id":"241531b6-df7f-4eb5-addf-f7936da83e0b","resolution":{"observed_at":"2026-07-11T14:25:21.264423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.10092","last_updated":"2022-11-30T11:28:11Z","snapshot_observed_at":"2026-08-16T16:51:37.024159Z","submitted_at":"2022-06-21T03:21:18Z","title":"BEVDepth: Acquisition of Reliable Depth for Multi-view 3D Object Detection","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.10092","snapshot_observed_at":"2026-07-11T14:25:21.264423Z","title":"Bevdepth: Acquisition of reliable depth for multi-view 3d object detection,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.04732","last_updated":"2026-07-06T07:10:00Z","snapshot_observed_at":"2026-08-08T22:48:13.911536Z","submitted_at":"2026-07-06T07:10:00Z","title":"SparseOcc++: Geometry-Aware Sparse Latent Representation for Semantic Occupancy Prediction","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-11T14:25:21.264423Z"},"links":{"cited_paper":"/paper/2206.10092","citing_paper":"/paper/2607.04732"},"observation_digest":"sha256:0d2c99c765eb09cb399639c664e382f094fb493fb85379453c9ebfe71315e23f","observation_id":"aa295924-20b5-4a6a-a683-60dca48b1aa6","resolution":{"observed_at":"2026-07-11T14:25:21.264423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T14:25:21.264423Z","title":"Pointpillars: Fast encoders for object detection from point clouds,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.04732","last_updated":"2026-07-06T07:10:00Z","snapshot_observed_at":"2026-08-08T22:48:13.911536Z","submitted_at":"2026-07-06T07:10:00Z","title":"SparseOcc++: Geometry-Aware Sparse Latent Representation for Semantic Occupancy Prediction","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-11T14:25:21.264423Z"},"links":{"citing_paper":"/paper/2607.04732"},"observation_digest":"sha256:2ef151d10e2231311b855efd17591064078aac79808745e930e1ea0a3f9e722c","observation_id":"aeec11b5-7f9e-4b92-8451-769ec4322743","resolution":{"observed_at":"2026-07-11T14:25:21.264423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T14:25:21.264423Z","title":"Alleviating foreground sparsity for semi-supervised monocular 3d object detection,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.04732","last_updated":"2026-07-06T07:10:00Z","snapshot_observed_at":"2026-08-08T22:48:13.911536Z","submitted_at":"2026-07-06T07:10:00Z","title":"SparseOcc++: Geometry-Aware Sparse Latent Representation for Semantic Occupancy Prediction","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-11T14:25:21.264423Z"},"links":{"citing_paper":"/paper/2607.04732"},"observation_digest":"sha256:8855d60fadf36cc98e67bce89d163ea89d849016fbedbf2d94f98b3d4b7e8c8f","observation_id":"92b1006b-b5e6-4aca-ae92-0630d8684613","resolution":{"observed_at":"2026-07-11T14:25:21.264423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T14:25:21.264423Z","title":"Unidistill: A universal cross-modality knowledge distillation framework for 3d object detec- tion in bird’s-eye view,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.04732","last_updated":"2026-07-06T07:10:00Z","snapshot_observed_at":"2026-08-08T22:48:13.911536Z","submitted_at":"2026-07-06T07:10:00Z","title":"SparseOcc++: Geometry-Aware Sparse Latent Representation for Semantic Occupancy Prediction","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-11T14:25:21.264423Z"},"links":{"citing_paper":"/paper/2607.04732"},"observation_digest":"sha256:e83d9bf35a4e664f502df614e7d20db9504547230f72c67596769f1cff943c3d","observation_id":"67d0e02f-5061-480f-bcd7-841118e5d51f","resolution":{"observed_at":"2026-07-11T14:25:21.264423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T14:25:21.264423Z","title":"Bi-stream knowledge transfer for semi-supervised 3d point cloud object detection,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04732","last_updated":"2026-07-06T07:10:00Z","snapshot_observed_at":"2026-08-08T22:48:13.911536Z","submitted_at":"2026-07-06T07:10:00Z","title":"SparseOcc++: Geometry-Aware Sparse Latent Representation for Semantic Occupancy Prediction","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-11T14:25:21.264423Z"},"links":{"citing_paper":"/paper/2607.04732"},"observation_digest":"sha256:18aae9ef8f58ff90a7d3953e15b22f54ae386f61c45b0b0a34c2eaf69822421f","observation_id":"33062175-6948-4343-875f-99aeea393aec","resolution":{"observed_at":"2026-07-11T14:25:21.264423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T14:25:21.264423Z","title":"Litefusion: Taming 3d object detectors from vision-based to multi-modal with minimal adaptation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04732","last_updated":"2026-07-06T07:10:00Z","snapshot_observed_at":"2026-08-08T22:48:13.911536Z","submitted_at":"2026-07-06T07:10:00Z","title":"SparseOcc++: Geometry-Aware Sparse Latent Representation for Semantic Occupancy Prediction","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-11T14:25:21.264423Z"},"links":{"citing_paper":"/paper/2607.04732"},"observation_digest":"sha256:40602d80a53b8ce70fbc80b4849a2754f713fc684dfda9571567cfe9671b75f0","observation_id":"fb490652-fe55-40d8-a914-e70b8c1830a5","resolution":{"observed_at":"2026-07-11T14:25:21.264423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T14:25:21.264423Z","title":"Transfusion: Robust lidar-camera fusion for 3d object detection with transformers,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.04732","last_updated":"2026-07-06T07:10:00Z","snapshot_observed_at":"2026-08-08T22:48:13.911536Z","submitted_at":"2026-07-06T07:10:00Z","title":"SparseOcc++: Geometry-Aware Sparse Latent Representation for Semantic Occupancy Prediction","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-11T14:25:21.264423Z"},"links":{"citing_paper":"/paper/2607.04732"},"observation_digest":"sha256:2e2587dae9073b94ea7f1df6acbdfecadffb59becbf1378e8fddd12f68fefc41","observation_id":"6f030ab8-fa58-41c5-8ad1-62c0e6584441","resolution":{"observed_at":"2026-07-11T14:25:21.264423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T14:25:21.264423Z","title":"Second: Sparsely embedded convolutional detection,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.04732","last_updated":"2026-07-06T07:10:00Z","snapshot_observed_at":"2026-08-08T22:48:13.911536Z","submitted_at":"2026-07-06T07:10:00Z","title":"SparseOcc++: Geometry-Aware Sparse Latent Representation for Semantic Occupancy Prediction","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-11T14:25:21.264423Z"},"links":{"citing_paper":"/paper/2607.04732"},"observation_digest":"sha256:d0f8241bb4325d452bdc9bbaee227ce8a33482e07618653148b0363ecc723f62","observation_id":"e56acec8-2dd7-43f3-85e1-3fe26ea4a220","resolution":{"observed_at":"2026-07-11T14:25:21.264423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T14:25:21.264423Z","title":"Rclane: Relay chain prediction for lane detection,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.04732","last_updated":"2026-07-06T07:10:00Z","snapshot_observed_at":"2026-08-08T22:48:13.911536Z","submitted_at":"2026-07-06T07:10:00Z","title":"SparseOcc++: Geometry-Aware Sparse Latent Representation for Semantic Occupancy Prediction","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-11T14:25:21.264423Z"},"links":{"citing_paper":"/paper/2607.04732"},"observation_digest":"sha256:ec9add5022a6c30ec23d6e807fe05d0ece11798cc1c0a387de0c50f8657b6422","observation_id":"a80ab44a-4129-4552-a03c-d742fa0ac346","resolution":{"observed_at":"2026-07-11T14:25:21.264423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T14:25:21.264423Z","title":"Prototransfer: Cross-modal prototype transfer for point cloud segmentation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.04732","last_updated":"2026-07-06T07:10:00Z","snapshot_observed_at":"2026-08-08T22:48:13.911536Z","submitted_at":"2026-07-06T07:10:00Z","title":"SparseOcc++: Geometry-Aware Sparse Latent Representation for Semantic Occupancy Prediction","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-11T14:25:21.264423Z"},"links":{"citing_paper":"/paper/2607.04732"},"observation_digest":"sha256:068338168ae44fa40e59123c34f32880532a03d761b9e1bba73c9b5e5b2ec782","observation_id":"12736a21-f891-41ac-a5b6-e68d8ab85f46","resolution":{"observed_at":"2026-07-11T14:25:21.264423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T14:25:21.264423Z","title":"2dpass: 2d priors assisted semantic segmentation on lidar point clouds,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.04732","last_updated":"2026-07-06T07:10:00Z","snapshot_observed_at":"2026-08-08T22:48:13.911536Z","submitted_at":"2026-07-06T07:10:00Z","title":"SparseOcc++: Geometry-Aware Sparse Latent Representation for Semantic Occupancy Prediction","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-11T14:25:21.264423Z"},"links":{"citing_paper":"/paper/2607.04732"},"observation_digest":"sha256:b302e1234af962ba8380b8f41469f73e9fe071b835b102559a6bfa5224980036","observation_id":"69d00620-8475-4223-8384-6a6ba8c5acd5","resolution":{"observed_at":"2026-07-11T14:25:21.264423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T14:25:21.264423Z","title":"Uniseg: A unified multi-modal lidar segmentation network and the openpcseg codebase,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.04732","last_updated":"2026-07-06T07:10:00Z","snapshot_observed_at":"2026-08-08T22:48:13.911536Z","submitted_at":"2026-07-06T07:10:00Z","title":"SparseOcc++: Geometry-Aware Sparse Latent Representation for Semantic Occupancy Prediction","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-11T14:25:21.264423Z"},"links":{"citing_paper":"/paper/2607.04732"},"observation_digest":"sha256:78b9df194dc19a87d1fce9b1bcade81e2b1243402feac85fdb81b623d32f12d3","observation_id":"cb8ece5a-3740-451a-8482-dc14f9e5b3f0","resolution":{"observed_at":"2026-07-11T14:25:21.264423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T14:25:21.264423Z","title":"Mseg3d: Multi-modal 3d semantic segmentation for autonomous driving,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.04732","last_updated":"2026-07-06T07:10:00Z","snapshot_observed_at":"2026-08-08T22:48:13.911536Z","submitted_at":"2026-07-06T07:10:00Z","title":"SparseOcc++: Geometry-Aware Sparse Latent Representation for Semantic Occupancy Prediction","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-11T14:25:21.264423Z"},"links":{"citing_paper":"/paper/2607.04732"},"observation_digest":"sha256:0191140e0014ae47f34464ae57d32d06a7498909a56408fb1ce5b8beec197cdd","observation_id":"19dc819f-7a59-4ce0-8d9b-1bfd82a1c30a","resolution":{"observed_at":"2026-07-11T14:25:21.264423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T14:25:21.264423Z","title":"Surroundocc: Multi-camera 3d occupancy prediction for autonomous driving,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.04732","last_updated":"2026-07-06T07:10:00Z","snapshot_observed_at":"2026-08-08T22:48:13.911536Z","submitted_at":"2026-07-06T07:10:00Z","title":"SparseOcc++: Geometry-Aware Sparse Latent Representation for Semantic Occupancy Prediction","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-11T14:25:21.264423Z"},"links":{"citing_paper":"/paper/2607.04732"},"observation_digest":"sha256:55b87ca82417488af6cd481efa1e9badb1f82d04850b822e270110d4772e7d20","observation_id":"3b9d3774-c442-4eba-8fd4-9560d5100715","resolution":{"observed_at":"2026-07-11T14:25:21.264423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.03774","last_updated":"2024-03-19T05:03:18Z","snapshot_observed_at":"2026-08-16T14:37:17.411318Z","submitted_at":"2023-12-06T02:52:54Z","title":"OctreeOcc: Efficient and Multi-Granularity Occupancy Prediction Using Octree Queries","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.03774","snapshot_observed_at":"2026-07-11T14:25:21.264423Z","title":"Octreeocc: Efficient and multi-granularity occupancy prediction using octree queries,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.04732","last_updated":"2026-07-06T07:10:00Z","snapshot_observed_at":"2026-08-08T22:48:13.911536Z","submitted_at":"2026-07-06T07:10:00Z","title":"SparseOcc++: Geometry-Aware Sparse Latent Representation for Semantic Occupancy Prediction","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-07-11T14:25:21.264423Z"},"links":{"cited_paper":"/paper/2312.03774","citing_paper":"/paper/2607.04732"},"observation_digest":"sha256:2206dd9f32dbf3393331507034a9a5c446a43fcece6e21cbbc019becf1393cbb","observation_id":"9c916632-e8a6-46cd-b334-0e5131167ca5","resolution":{"observed_at":"2026-07-11T14:25:21.264423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T14:25:21.264423Z","title":"Opus: occupancy prediction using a sparse set,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.04732","last_updated":"2026-07-06T07:10:00Z","snapshot_observed_at":"2026-08-08T22:48:13.911536Z","submitted_at":"2026-07-06T07:10:00Z","title":"SparseOcc++: Geometry-Aware Sparse Latent Representation for Semantic Occupancy Prediction","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-07-11T14:25:21.264423Z"},"links":{"citing_paper":"/paper/2607.04732"},"observation_digest":"sha256:1d4129d2e3963be71c04458d38cb9e96f4ab82922c62faad4283c0ca39816fae","observation_id":"cef76927-aac6-4c42-9c07-e3ee31aabb33","resolution":{"observed_at":"2026-07-11T14:25:21.264423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T14:25:21.264423Z","title":"Sparseocc: Rethinking sparse latent representation for vision-based semantic occupancy prediction,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.04732","last_updated":"2026-07-06T07:10:00Z","snapshot_observed_at":"2026-08-08T22:48:13.911536Z","submitted_at":"2026-07-06T07:10:00Z","title":"SparseOcc++: Geometry-Aware Sparse Latent Representation for Semantic Occupancy Prediction","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-07-11T14:25:21.264423Z"},"links":{"citing_paper":"/paper/2607.04732"},"observation_digest":"sha256:8e1e7bd326ec016c3551ac8c5c4854efd597219c45036eca610db667bae4a666","observation_id":"00148afe-c708-488d-a015-e82905be5fe7","resolution":{"observed_at":"2026-07-11T14:25:21.264423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T14:25:21.264423Z","title":"Fully sparse 3d panoptic occupancy prediction,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.04732","last_updated":"2026-07-06T07:10:00Z","snapshot_observed_at":"2026-08-08T22:48:13.911536Z","submitted_at":"2026-07-06T07:10:00Z","title":"SparseOcc++: Geometry-Aware Sparse Latent Representation for Semantic Occupancy Prediction","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-07-11T14:25:21.264423Z"},"links":{"citing_paper":"/paper/2607.04732"},"observation_digest":"sha256:3301318d1a0e53892bd340de64cf18d61fee746c77a73acb9ac3e342189e0a7e","observation_id":"f03ac30e-34f2-421a-ae79-110b3de75d83","resolution":{"observed_at":"2026-07-11T14:25:21.264423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12058","last_updated":"2023-11-18T15:28:09Z","snapshot_observed_at":"2026-08-16T14:42:10.713390Z","submitted_at":"2023-11-18T15:28:09Z","title":"FlashOcc: Fast and Memory-Efficient Occupancy Prediction via Channel-to-Height Plugin","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.12058","snapshot_observed_at":"2026-07-11T14:25:21.264423Z","title":"Flashocc: Fast and memory-efficient occupancy prediction via channel-to-height plugin,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.04732","last_updated":"2026-07-06T07:10:00Z","snapshot_observed_at":"2026-08-08T22:48:13.911536Z","submitted_at":"2026-07-06T07:10:00Z","title":"SparseOcc++: Geometry-Aware Sparse Latent Representation for Semantic Occupancy Prediction","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-07-11T14:25:21.264423Z"},"links":{"cited_paper":"/paper/2311.12058","citing_paper":"/paper/2607.04732"},"observation_digest":"sha256:5ac76b806513617cb6d778ebd7cc6e0a9f739020e44a35240dc9049d6375076e","observation_id":"d91652bc-f2e6-4258-9e4d-f91e1e884bf6","resolution":{"observed_at":"2026-07-11T14:25:21.264423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.17429","last_updated":"2024-05-27T17:59:51Z","snapshot_observed_at":"2026-08-16T13:48:55.961375Z","submitted_at":"2024-05-27T17:59:51Z","title":"GaussianFormer: Scene as Gaussians for Vision-Based 3D Semantic Occupancy Prediction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.17429","snapshot_observed_at":"2026-07-11T14:25:21.264423Z","title":"Gaussianformer: Scene as gaussians for vision-based 3d semantic occupancy prediction,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.04732","last_updated":"2026-07-06T07:10:00Z","snapshot_observed_at":"2026-08-08T22:48:13.911536Z","submitted_at":"2026-07-06T07:10:00Z","title":"SparseOcc++: Geometry-Aware Sparse Latent Representation for Semantic Occupancy Prediction","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-07-11T14:25:21.264423Z"},"links":{"cited_paper":"/paper/2405.17429","citing_paper":"/paper/2607.04732"},"observation_digest":"sha256:368f386d54fa9b9a56d32b7a5cef89d5f1e38089f64ad0585817c189280fe146","observation_id":"7013b43e-4b58-4951-b374-4ac5f193a6a9","resolution":{"observed_at":"2026-07-11T14:25:21.264423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.04384","last_updated":"2024-12-06T15:43:40Z","snapshot_observed_at":"2026-08-19T18:24:47.566688Z","submitted_at":"2024-12-05T17:59:58Z","title":"GaussianFormer-2: Probabilistic Gaussian Superposition for Efficient 3D Occupancy Prediction","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.04384","snapshot_observed_at":"2026-07-11T14:25:21.264423Z","title":"Probabilistic gaussian superposition for efficient 3d occupancy prediction,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.04732","last_updated":"2026-07-06T07:10:00Z","snapshot_observed_at":"2026-08-08T22:48:13.911536Z","submitted_at":"2026-07-06T07:10:00Z","title":"SparseOcc++: Geometry-Aware Sparse Latent Representation for Semantic Occupancy Prediction","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-07-11T14:25:21.264423Z"},"links":{"cited_paper":"/paper/2412.04384","citing_paper":"/paper/2607.04732"},"observation_digest":"sha256:7e6acebae096a8b152f2b6dc6b60a6457ca731e07f5aab6d96a7555d118113c8","observation_id":"a39b90ab-4f01-4988-9118-3be089b3bbf3","resolution":{"observed_at":"2026-07-11T14:25:21.264423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.01492","last_updated":"2023-07-04T05:55:54Z","snapshot_observed_at":"2026-08-18T08:37:31.401379Z","submitted_at":"2023-07-04T05:55:54Z","title":"FB-OCC: 3D Occupancy Prediction based on Forward-Backward View Transformation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.01492","snapshot_observed_at":"2026-07-11T14:25:21.264423Z","title":"Fb-occ: 3d occupancy prediction based on forward-backward view transformation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.04732","last_updated":"2026-07-06T07:10:00Z","snapshot_observed_at":"2026-08-08T22:48:13.911536Z","submitted_at":"2026-07-06T07:10:00Z","title":"SparseOcc++: Geometry-Aware Sparse Latent Representation for Semantic Occupancy Prediction","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-07-11T14:25:21.264423Z"},"links":{"cited_paper":"/paper/2307.01492","citing_paper":"/paper/2607.04732"},"observation_digest":"sha256:61a75d0ca9c12d0cfce6a60e2fbd1abd72aed1ecb2366bc39f3ea7fcb35292fc","observation_id":"a53fac5c-a1f0-4388-b20f-e84d0b1c7a14","resolution":{"observed_at":"2026-07-11T14:25:21.264423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T14:25:21.264423Z","title":"Scene as occupancy,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.04732","last_updated":"2026-07-06T07:10:00Z","snapshot_observed_at":"2026-08-08T22:48:13.911536Z","submitted_at":"2026-07-06T07:10:00Z","title":"SparseOcc++: Geometry-Aware Sparse Latent Representation for Semantic Occupancy Prediction","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-07-11T14:25:21.264423Z"},"links":{"citing_paper":"/paper/2607.04732"},"observation_digest":"sha256:d320bf38c173da2f2196fe6ef7e536d6a3036f0c662403a02dbabfdd4b0f10b9","observation_id":"fb88f863-e690-4886-a2bd-7e1818cd6626","resolution":{"observed_at":"2026-07-11T14:25:21.264423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.14365","last_updated":"2023-12-13T17:41:17Z","snapshot_observed_at":"2026-08-16T15:37:11.389581Z","submitted_at":"2023-04-27T17:40:08Z","title":"Occ3D: A Large-Scale 3D Occupancy Prediction Benchmark for Autonomous Driving","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.14365","snapshot_observed_at":"2026-07-11T14:25:21.264423Z","title":"Occ3d: A large-scale 3d occupancy prediction benchmark for autonomous driving,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.04732","last_updated":"2026-07-06T07:10:00Z","snapshot_observed_at":"2026-08-08T22:48:13.911536Z","submitted_at":"2026-07-06T07:10:00Z","title":"SparseOcc++: Geometry-Aware Sparse Latent Representation for Semantic Occupancy Prediction","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-07-11T14:25:21.264423Z"},"links":{"cited_paper":"/paper/2304.14365","citing_paper":"/paper/2607.04732"},"observation_digest":"sha256:f5c5e1fa649d5f0dfd470d6fb67972708da79b082188eb0148f34c4c71070696","observation_id":"e7ab9ac1-c714-4419-83d1-726253fe4ebc","resolution":{"observed_at":"2026-07-11T14:25:21.264423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.13542","last_updated":"2024-09-01T03:33:26Z","snapshot_observed_at":"2026-08-16T16:57:23.820884Z","submitted_at":"2022-05-26T17:59:35Z","title":"BEVFusion: Multi-Task Multi-Sensor Fusion with Unified Bird's-Eye View Representation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.13542","snapshot_observed_at":"2026-07-11T14:25:21.264423Z","title":"Bevfusion: Multi-task multi-sensor fusion with unified bird’s-eye view representation,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.04732","last_updated":"2026-07-06T07:10:00Z","snapshot_observed_at":"2026-08-08T22:48:13.911536Z","submitted_at":"2026-07-06T07:10:00Z","title":"SparseOcc++: Geometry-Aware Sparse Latent Representation for Semantic Occupancy Prediction","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-07-11T14:25:21.264423Z"},"links":{"cited_paper":"/paper/2205.13542","citing_paper":"/paper/2607.04732"},"observation_digest":"sha256:41d6acf58a61e00dff951567c81955507bb16145a0e368c7b2fe12fc4b6b52ae","observation_id":"a97b4270-c7e9-4d6f-907f-77739bd8741a","resolution":{"observed_at":"2026-07-11T14:25:21.264423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.16896","last_updated":"2023-08-31T17:57:17Z","snapshot_observed_at":"2026-08-16T15:04:13.093588Z","submitted_at":"2023-08-31T17:57:17Z","title":"PointOcc: Cylindrical Tri-Perspective View for Point-based 3D Semantic Occupancy Prediction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.16896","snapshot_observed_at":"2026-07-11T14:25:21.264423Z","title":"Pointocc: Cylindrical tri-perspective view for point-based 3d semantic occupancy prediction,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.04732","last_updated":"2026-07-06T07:10:00Z","snapshot_observed_at":"2026-08-08T22:48:13.911536Z","submitted_at":"2026-07-06T07:10:00Z","title":"SparseOcc++: Geometry-Aware Sparse Latent Representation for Semantic Occupancy Prediction","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-07-11T14:25:21.264423Z"},"links":{"cited_paper":"/paper/2308.16896","citing_paper":"/paper/2607.04732"},"observation_digest":"sha256:418028aa21d44b2d89dfbdfc0c626cd461127f6eb99e850298805bbd49dbcba8","observation_id":"0fbbd99a-645e-42f8-8614-3570077e6851","resolution":{"observed_at":"2026-07-11T14:25:21.264423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T14:25:21.264423Z","title":"Spconv: Spatially sparse convolution library,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.04732","last_updated":"2026-07-06T07:10:00Z","snapshot_observed_at":"2026-08-08T22:48:13.911536Z","submitted_at":"2026-07-06T07:10:00Z","title":"SparseOcc++: Geometry-Aware Sparse Latent Representation for Semantic Occupancy Prediction","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-07-11T14:25:21.264423Z"},"links":{"citing_paper":"/paper/2607.04732"},"observation_digest":"sha256:87ed3c5bc8eaa2a663c91cdf6c3e78fd48c8abf1848c840903e05f2ace0450f6","observation_id":"ac6885a5-ac0c-4398-b443-b563f6795605","resolution":{"observed_at":"2026-07-11T14:25:21.264423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T14:25:21.264423Z","title":"Faster R-CNN: Towards real-time object detection with region proposal networks,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2607.04732","last_updated":"2026-07-06T07:10:00Z","snapshot_observed_at":"2026-08-08T22:48:13.911536Z","submitted_at":"2026-07-06T07:10:00Z","title":"SparseOcc++: Geometry-Aware Sparse Latent Representation for Semantic Occupancy Prediction","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-07-11T14:25:21.264423Z"},"links":{"citing_paper":"/paper/2607.04732"},"observation_digest":"sha256:46db4fcbd0095adc5305282ea8b1378ddcdcea7ad534967c2bec3b1521603ba4","observation_id":"e3f7fcd4-d5bb-4bf2-bb48-bbc6a5aed5cd","resolution":{"observed_at":"2026-07-11T14:25:21.264423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T14:25:21.264423Z","title":"Deepsdf: Learning continuous signed distance functions for shape representation,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.04732","last_updated":"2026-07-06T07:10:00Z","snapshot_observed_at":"2026-08-08T22:48:13.911536Z","submitted_at":"2026-07-06T07:10:00Z","title":"SparseOcc++: Geometry-Aware Sparse Latent Representation for Semantic Occupancy Prediction","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-07-11T14:25:21.264423Z"},"links":{"citing_paper":"/paper/2607.04732"},"observation_digest":"sha256:6e09f3a408cab4ed7586c43c900280edf9c533685a27e98f2ad0e5289bcb39b4","observation_id":"506954d4-26e8-4638-9b91-d321faacd097","resolution":{"observed_at":"2026-07-11T14:25:21.264423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T14:25:21.264423Z","title":"Occformer: Dual-path transformer for vision-based 3d semantic occupancy prediction,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.04732","last_updated":"2026-07-06T07:10:00Z","snapshot_observed_at":"2026-08-08T22:48:13.911536Z","submitted_at":"2026-07-06T07:10:00Z","title":"SparseOcc++: Geometry-Aware Sparse Latent Representation for Semantic Occupancy Prediction","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-07-11T14:25:21.264423Z"},"links":{"citing_paper":"/paper/2607.04732"},"observation_digest":"sha256:e5a05dec945384ae2980333f39ab3352ae216ba2ea6626c942779f732d7318a9","observation_id":"e430de2a-5782-4ced-a3fa-a9fe4704ce7c","resolution":{"observed_at":"2026-07-11T14:25:21.264423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T14:25:21.264423Z","title":"Semantickitti: A dataset for semantic scene understanding of lidar sequences,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.04732","last_updated":"2026-07-06T07:10:00Z","snapshot_observed_at":"2026-08-08T22:48:13.911536Z","submitted_at":"2026-07-06T07:10:00Z","title":"SparseOcc++: Geometry-Aware Sparse Latent Representation for Semantic Occupancy Prediction","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-07-11T14:25:21.264423Z"},"links":{"citing_paper":"/paper/2607.04732"},"observation_digest":"sha256:64c1cdeb1518bd00da56b153e6121139ee6cd6f5ad552458ab9babb9ae34d62a","observation_id":"0e761490-33fa-40ef-9d80-4a2f29e779ee","resolution":{"observed_at":"2026-07-11T14:25:21.264423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T14:25:21.264423Z","title":"Monoscene: Monocular 3d semantic scene completion,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.04732","last_updated":"2026-07-06T07:10:00Z","snapshot_observed_at":"2026-08-08T22:48:13.911536Z","submitted_at":"2026-07-06T07:10:00Z","title":"SparseOcc++: Geometry-Aware Sparse Latent Representation for Semantic Occupancy Prediction","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-07-11T14:25:21.264423Z"},"links":{"citing_paper":"/paper/2607.04732"},"observation_digest":"sha256:09e11c04fdf6aac146fc00589c5df56598e8461b1f4c7d90911810d3da1e573f","observation_id":"d694ba10-7cd2-4f7e-ae19-63386db2955c","resolution":{"observed_at":"2026-07-11T14:25:21.264423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T14:25:21.264423Z","title":"Nuscenes: A multimodal dataset for autonomous driving,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.04732","last_updated":"2026-07-06T07:10:00Z","snapshot_observed_at":"2026-08-08T22:48:13.911536Z","submitted_at":"2026-07-06T07:10:00Z","title":"SparseOcc++: Geometry-Aware Sparse Latent Representation for Semantic Occupancy Prediction","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-07-11T14:25:21.264423Z"},"links":{"citing_paper":"/paper/2607.04732"},"observation_digest":"sha256:a89a2f641f6d35d769e6430b99b3ab1f3471ef2144412e8ebe738bd3ea2a92fb","observation_id":"32a319b1-51b8-4e4e-a89c-90c5abf0805e","resolution":{"observed_at":"2026-07-11T14:25:21.264423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T14:25:21.264423Z","title":"Scalability in perception for autonomous driving: Waymo open dataset,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.04732","last_updated":"2026-07-06T07:10:00Z","snapshot_observed_at":"2026-08-08T22:48:13.911536Z","submitted_at":"2026-07-06T07:10:00Z","title":"SparseOcc++: Geometry-Aware Sparse Latent Representation for Semantic Occupancy Prediction","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-07-11T14:25:21.264423Z"},"links":{"citing_paper":"/paper/2607.04732"},"observation_digest":"sha256:167a0857a5e8abd809d9dfff65f5fc2944a2edad77cad6663f513ba266814932","observation_id":"c61abcb9-19b9-4696-99dd-3d12ae3efe0a","resolution":{"observed_at":"2026-07-11T14:25:21.264423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T14:25:21.264423Z","title":"Fastocc: Accelerating 3d occupancy prediction by fusing the 2d bird’s-eye view and perspective view,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.04732","last_updated":"2026-07-06T07:10:00Z","snapshot_observed_at":"2026-08-08T22:48:13.911536Z","submitted_at":"2026-07-06T07:10:00Z","title":"SparseOcc++: Geometry-Aware Sparse Latent Representation for Semantic Occupancy Prediction","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-07-11T14:25:21.264423Z"},"links":{"citing_paper":"/paper/2607.04732"},"observation_digest":"sha256:41e3ab83747abbe8d6d9af71a38c99d50c9d7bebfe694fa919a8130d5122f6e7","observation_id":"e14c47d0-4339-4119-8d67-5d212ac4d4ec","resolution":{"observed_at":"2026-07-11T14:25:21.264423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T14:25:21.264423Z","title":"Occrwkv: Rethinking efficient 3d semantic occupancy prediction with linear complexity,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04732","last_updated":"2026-07-06T07:10:00Z","snapshot_observed_at":"2026-08-08T22:48:13.911536Z","submitted_at":"2026-07-06T07:10:00Z","title":"SparseOcc++: Geometry-Aware Sparse Latent Representation for Semantic Occupancy Prediction","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-07-11T14:25:21.264423Z"},"links":{"citing_paper":"/paper/2607.04732"},"observation_digest":"sha256:6e19b6435c550784ab801ad8708a0db1d6f9ad8377f8c99d19f0e49829e96c00","observation_id":"751f3126-696e-4bff-abaf-91acf28ab386","resolution":{"observed_at":"2026-07-11T14:25:21.264423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T14:25:21.264423Z","title":"Panoocc: Unified occupancy representation for camera-based 3d panoptic segmentation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.04732","last_updated":"2026-07-06T07:10:00Z","snapshot_observed_at":"2026-08-08T22:48:13.911536Z","submitted_at":"2026-07-06T07:10:00Z","title":"SparseOcc++: Geometry-Aware Sparse Latent Representation for Semantic Occupancy Prediction","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-07-11T14:25:21.264423Z"},"links":{"citing_paper":"/paper/2607.04732"},"observation_digest":"sha256:a50793bfbc2c2442b11f5d3877bef9b5872fc5fb2b43055018401ac2a56f468e","observation_id":"9ec0ce62-44f0-485a-b19c-8a02ad7e30fb","resolution":{"observed_at":"2026-07-11T14:25:21.264423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T14:25:21.264423Z","title":"V oxelsplat: Dynamic gaussian splatting as an effective loss for occupancy and flow prediction,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04732","last_updated":"2026-07-06T07:10:00Z","snapshot_observed_at":"2026-08-08T22:48:13.911536Z","submitted_at":"2026-07-06T07:10:00Z","title":"SparseOcc++: Geometry-Aware Sparse Latent Representation for Semantic Occupancy Prediction","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-07-11T14:25:21.264423Z"},"links":{"citing_paper":"/paper/2607.04732"},"observation_digest":"sha256:c22bb6bdeaa3be102b29e86de52976521d5899bdabb52df251a11318d4e534d8","observation_id":"7ccaaac1-a7e9-4e75-9d82-77b9d9fc4f2f","resolution":{"observed_at":"2026-07-11T14:25:21.264423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T14:25:21.264423Z","title":"Gs-occ3d: Scaling vision-only occupancy reconstruction with gaussian splatting,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04732","last_updated":"2026-07-06T07:10:00Z","snapshot_observed_at":"2026-08-08T22:48:13.911536Z","submitted_at":"2026-07-06T07:10:00Z","title":"SparseOcc++: Geometry-Aware Sparse Latent Representation for Semantic Occupancy Prediction","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-07-11T14:25:21.264423Z"},"links":{"citing_paper":"/paper/2607.04732"},"observation_digest":"sha256:74adbe54c420e27017861a9e6e505bf82f366cb32b48b57a43bbcd0d633b62c7","observation_id":"9884028f-8e9d-43b7-a7d7-c2dd8813f31c","resolution":{"observed_at":"2026-07-11T14:25:21.264423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T14:25:21.264423Z","title":"Gauss- render: Learning 3d occupancy with gaussian rendering,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04732","last_updated":"2026-07-06T07:10:00Z","snapshot_observed_at":"2026-08-08T22:48:13.911536Z","submitted_at":"2026-07-06T07:10:00Z","title":"SparseOcc++: Geometry-Aware Sparse Latent Representation for Semantic Occupancy Prediction","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-07-11T14:25:21.264423Z"},"links":{"citing_paper":"/paper/2607.04732"},"observation_digest":"sha256:322ca1beb8a605b3bb875fc46cc2eb66de100a9475e0341e11401e71f2945280","observation_id":"8b135f5f-7360-4401-98fc-e6d24a3cb17f","resolution":{"observed_at":"2026-07-11T14:25:21.264423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T14:25:21.264423Z","title":"Gaussianworld: Gaussian world model for streaming 3d occupancy prediction,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04732","last_updated":"2026-07-06T07:10:00Z","snapshot_observed_at":"2026-08-08T22:48:13.911536Z","submitted_at":"2026-07-06T07:10:00Z","title":"SparseOcc++: Geometry-Aware Sparse Latent Representation for Semantic Occupancy Prediction","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-07-11T14:25:21.264423Z"},"links":{"citing_paper":"/paper/2607.04732"},"observation_digest":"sha256:b49c1520e7c8c1e48b816dff5eaf6163d188829132c2d877155b1f216c06bf9d","observation_id":"c6dcdea7-add6-49f8-84a0-8a4ffa969e2b","resolution":{"observed_at":"2026-07-11T14:25:21.264423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T14:25:21.264423Z","title":"Visionpad: A vision-centric pre-training paradigm for autonomous driving,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04732","last_updated":"2026-07-06T07:10:00Z","snapshot_observed_at":"2026-08-08T22:48:13.911536Z","submitted_at":"2026-07-06T07:10:00Z","title":"SparseOcc++: Geometry-Aware Sparse Latent Representation for Semantic Occupancy Prediction","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-07-11T14:25:21.264423Z"},"links":{"citing_paper":"/paper/2607.04732"},"observation_digest":"sha256:3e127da95543639d1b92b6c5e12b39aef41e108eb4c37eb30c951380f25dc0aa","observation_id":"2b3cbb6f-6d9f-4732-8ae3-296fa6df82d0","resolution":{"observed_at":"2026-07-11T14:25:21.264423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T14:25:21.264423Z","title":"Occmamba: Semantic occupancy prediction with state space models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04732","last_updated":"2026-07-06T07:10:00Z","snapshot_observed_at":"2026-08-08T22:48:13.911536Z","submitted_at":"2026-07-06T07:10:00Z","title":"SparseOcc++: Geometry-Aware Sparse Latent Representation for Semantic Occupancy Prediction","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-07-11T14:25:21.264423Z"},"links":{"citing_paper":"/paper/2607.04732"},"observation_digest":"sha256:6f15fb47386927d04c9eee1fd8d6f7de7423dbc7351e4cf2f132f2dc8298ceaf","observation_id":"d65dcf05-c239-48f8-a813-8a6386f56f5c","resolution":{"observed_at":"2026-07-11T14:25:21.264423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T14:25:21.264423Z","title":"Alocc: Adaptive lifting-based 3d semantic occupancy and cost volume-based flow predictions,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04732","last_updated":"2026-07-06T07:10:00Z","snapshot_observed_at":"2026-08-08T22:48:13.911536Z","submitted_at":"2026-07-06T07:10:00Z","title":"SparseOcc++: Geometry-Aware Sparse Latent Representation for Semantic Occupancy Prediction","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-07-11T14:25:21.264423Z"},"links":{"citing_paper":"/paper/2607.04732"},"observation_digest":"sha256:879b5972a4f482369092f19c1832675df687d7a01e317847fdcc3f2309c63062","observation_id":"3e1ceb30-5693-4eaa-80a9-252e4217caaa","resolution":{"observed_at":"2026-07-11T14:25:21.264423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2512.16919","last_updated":"2026-06-03T07:14:50Z","snapshot_observed_at":"2026-08-12T21:06:01.868549Z","submitted_at":"2025-12-18T18:59:57Z","title":"DVGT: Driving Visual Geometry Transformer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2512.16919","snapshot_observed_at":"2026-07-11T14:25:21.264423Z","title":"Dvgt: Driving visual geometry transformer,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04732","last_updated":"2026-07-06T07:10:00Z","snapshot_observed_at":"2026-08-08T22:48:13.911536Z","submitted_at":"2026-07-06T07:10:00Z","title":"SparseOcc++: Geometry-Aware Sparse Latent Representation for Semantic Occupancy Prediction","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-07-11T14:25:21.264423Z"},"links":{"cited_paper":"/paper/2512.16919","citing_paper":"/paper/2607.04732"},"observation_digest":"sha256:ecb535191fb0d4302d87e641e35e38bf9dffd11a6f09c31548218fab67badb00","observation_id":"fe755069-0659-4368-aad2-07223d763f2e","resolution":{"observed_at":"2026-07-11T14:25:21.264423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T14:25:21.264423Z","title":"Pop-3d: Open-vocabulary 3d occupancy prediction from images,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.04732","last_updated":"2026-07-06T07:10:00Z","snapshot_observed_at":"2026-08-08T22:48:13.911536Z","submitted_at":"2026-07-06T07:10:00Z","title":"SparseOcc++: Geometry-Aware Sparse Latent Representation for Semantic Occupancy Prediction","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-07-11T14:25:21.264423Z"},"links":{"citing_paper":"/paper/2607.04732"},"observation_digest":"sha256:13902cea423eeb37d1b13b80d8da8d5822cc47ae7f549f82315af75c761195ef","observation_id":"57517ae8-fbdc-42cc-bf56-03dbad4f51d7","resolution":{"observed_at":"2026-07-11T14:25:21.264423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T14:25:21.264423Z","title":"Veon: V ocabulary-enhanced occupancy prediction,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.04732","last_updated":"2026-07-06T07:10:00Z","snapshot_observed_at":"2026-08-08T22:48:13.911536Z","submitted_at":"2026-07-06T07:10:00Z","title":"SparseOcc++: Geometry-Aware Sparse Latent Representation for Semantic Occupancy Prediction","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-07-11T14:25:21.264423Z"},"links":{"citing_paper":"/paper/2607.04732"},"observation_digest":"sha256:dd60f2e7f25b05f1627e04cbcbc4cc4889faa05c6dd28d8ecc662430ca70e98b","observation_id":"f5f680eb-b7ef-4b72-bcb3-b451a4d22579","resolution":{"observed_at":"2026-07-11T14:25:21.264423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T14:25:21.264423Z","title":"Language driven occupancy prediction,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04732","last_updated":"2026-07-06T07:10:00Z","snapshot_observed_at":"2026-08-08T22:48:13.911536Z","submitted_at":"2026-07-06T07:10:00Z","title":"SparseOcc++: Geometry-Aware Sparse Latent Representation for Semantic Occupancy Prediction","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-07-11T14:25:21.264423Z"},"links":{"citing_paper":"/paper/2607.04732"},"observation_digest":"sha256:8ed85435a980bf62283ee8f49877064bc4bd044159d903958af2ea32d75552d6","observation_id":"02d82072-4a17-4e31-b0bb-5c0009e26a10","resolution":{"observed_at":"2026-07-11T14:25:21.264423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T14:25:21.264423Z","title":"Panoocc: Unified occupancy representation for camera-based 3d panoptic segmentation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.04732","last_updated":"2026-07-06T07:10:00Z","snapshot_observed_at":"2026-08-08T22:48:13.911536Z","submitted_at":"2026-07-06T07:10:00Z","title":"SparseOcc++: Geometry-Aware Sparse Latent Representation for Semantic Occupancy Prediction","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-07-11T14:25:21.264423Z"},"links":{"citing_paper":"/paper/2607.04732"},"observation_digest":"sha256:eea7d546c1a2a589c74961601e06d453485a51c3a4e73f2221e8ab20ab142c93","observation_id":"623ed1bf-43c3-4df2-87b1-f1b53d2b05e2","resolution":{"observed_at":"2026-07-11T14:25:21.264423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T14:25:21.264423Z","title":"Geocc: Geometrically enhanced 3d occupancy network with implicit-explicit depth fusion and contextual self-supervision,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04732","last_updated":"2026-07-06T07:10:00Z","snapshot_observed_at":"2026-08-08T22:48:13.911536Z","submitted_at":"2026-07-06T07:10:00Z","title":"SparseOcc++: Geometry-Aware Sparse Latent Representation for Semantic Occupancy Prediction","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-07-11T14:25:21.264423Z"},"links":{"citing_paper":"/paper/2607.04732"},"observation_digest":"sha256:fc44dd622c6f2df8523e8fa6bf67aa12d196e287235cd00036087340b24e381c","observation_id":"3cd1a2ed-4a83-400b-ab76-07ac66c1e5a7","resolution":{"observed_at":"2026-07-11T14:25:21.264423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T14:25:21.264423Z","title":"Selfocc: Self- supervised vision-based 3d occupancy prediction,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.04732","last_updated":"2026-07-06T07:10:00Z","snapshot_observed_at":"2026-08-08T22:48:13.911536Z","submitted_at":"2026-07-06T07:10:00Z","title":"SparseOcc++: Geometry-Aware Sparse Latent Representation for Semantic Occupancy Prediction","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-07-11T14:25:21.264423Z"},"links":{"citing_paper":"/paper/2607.04732"},"observation_digest":"sha256:6e315d3b6c3b6810660b4008bfd3393e66c23f99861b4091b1f73e7b7aad91ce","observation_id":"29790ecc-b5e6-456b-b59d-d55cf0fad340","resolution":{"observed_at":"2026-07-11T14:25:21.264423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T14:25:21.264423Z","title":"Gaussianocc: Fully self-supervised and efficient 3d occupancy estimation with gaussian splatting,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04732","last_updated":"2026-07-06T07:10:00Z","snapshot_observed_at":"2026-08-08T22:48:13.911536Z","submitted_at":"2026-07-06T07:10:00Z","title":"SparseOcc++: Geometry-Aware Sparse Latent Representation for Semantic Occupancy Prediction","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-07-11T14:25:21.264423Z"},"links":{"citing_paper":"/paper/2607.04732"},"observation_digest":"sha256:8a2fc6b0cc8731e8bc1bf2df29f9c061303191d564de8686078fe77fc49bc2dc","observation_id":"c9be86af-b12b-47fe-bacc-e80c6296c495","resolution":{"observed_at":"2026-07-11T14:25:21.264423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T14:25:21.264423Z","title":"Gausstr: Foundation model-aligned gaussian transformer for self-supervised 3d spatial understanding,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04732","last_updated":"2026-07-06T07:10:00Z","snapshot_observed_at":"2026-08-08T22:48:13.911536Z","submitted_at":"2026-07-06T07:10:00Z","title":"SparseOcc++: Geometry-Aware Sparse Latent Representation for Semantic Occupancy Prediction","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-07-11T14:25:21.264423Z"},"links":{"citing_paper":"/paper/2607.04732"},"observation_digest":"sha256:459a14849df028affdb0f0991ac0f23ab6e22d9a69f8f5feee2699c86b1d0717","observation_id":"d5dbeff6-2082-436b-9a7d-32371637bbb5","resolution":{"observed_at":"2026-07-11T14:25:21.264423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T14:25:21.264423Z","title":"Lidar-camera continuous fusion in voxelized grid for semantic scene completion,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.04732","last_updated":"2026-07-06T07:10:00Z","snapshot_observed_at":"2026-08-08T22:48:13.911536Z","submitted_at":"2026-07-06T07:10:00Z","title":"SparseOcc++: Geometry-Aware Sparse Latent Representation for Semantic Occupancy Prediction","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-07-11T14:25:21.264423Z"},"links":{"citing_paper":"/paper/2607.04732"},"observation_digest":"sha256:e06df62728dcb0047c27d8b7581545a561ab775d0ba0223016953b08a0928c1e","observation_id":"87aa57ba-0a60-4329-b30d-c4620cf49d43","resolution":{"observed_at":"2026-07-11T14:25:21.264423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T14:25:21.264423Z","title":"Self-supervised sparse sensor fusion for long range per- ception,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04732","last_updated":"2026-07-06T07:10:00Z","snapshot_observed_at":"2026-08-08T22:48:13.911536Z","submitted_at":"2026-07-06T07:10:00Z","title":"SparseOcc++: Geometry-Aware Sparse Latent Representation for Semantic Occupancy Prediction","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-07-11T14:25:21.264423Z"},"links":{"citing_paper":"/paper/2607.04732"},"observation_digest":"sha256:ea93ea58b6ace05f996fd4b2b6e825b54953e76a2a3a5175a0342e9a7460445f","observation_id":"de8ba51a-60ee-4a75-8981-be37421a897b","resolution":{"observed_at":"2026-07-11T14:25:21.264423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T14:25:21.264423Z","title":"Riocc: Efficient cross-modal fusion transformer with collaborative feature refinement for 3d semantic occupancy prediction,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04732","last_updated":"2026-07-06T07:10:00Z","snapshot_observed_at":"2026-08-08T22:48:13.911536Z","submitted_at":"2026-07-06T07:10:00Z","title":"SparseOcc++: Geometry-Aware Sparse Latent Representation for Semantic Occupancy Prediction","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-07-11T14:25:21.264423Z"},"links":{"citing_paper":"/paper/2607.04732"},"observation_digest":"sha256:d265643fcfe0c249ebc2f51150f489e52fc3818adbe91e433df1975ffd3c2a3b","observation_id":"e299ae53-ca79-44f1-8ef9-d763d8a428e2","resolution":{"observed_at":"2026-07-11T14:25:21.264423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T14:25:21.264423Z","title":"Sgformer: Satellite- ground fusion for 3d semantic scene completion,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04732","last_updated":"2026-07-06T07:10:00Z","snapshot_observed_at":"2026-08-08T22:48:13.911536Z","submitted_at":"2026-07-06T07:10:00Z","title":"SparseOcc++: Geometry-Aware Sparse Latent Representation for Semantic Occupancy Prediction","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-07-11T14:25:21.264423Z"},"links":{"citing_paper":"/paper/2607.04732"},"observation_digest":"sha256:546445e4e70b6b8fac7f603f67e1a140bb12c627961c18ba7465953394079fb9","observation_id":"22ce5c5d-57d2-48d4-aa11-d88df385f4a3","resolution":{"observed_at":"2026-07-11T14:25:21.264423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2510.18313","last_updated":"2026-06-29T02:20:45Z","snapshot_observed_at":"2026-08-20T02:45:24.652206Z","submitted_at":"2025-10-21T05:49:01Z","title":"OmniNWM: Omniscient Driving Navigation World Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2510.18313","snapshot_observed_at":"2026-07-11T14:25:21.264423Z","title":"Omninwm: Omniscient driving navigation world models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04732","last_updated":"2026-07-06T07:10:00Z","snapshot_observed_at":"2026-08-08T22:48:13.911536Z","submitted_at":"2026-07-06T07:10:00Z","title":"SparseOcc++: Geometry-Aware Sparse Latent Representation for Semantic Occupancy Prediction","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-07-11T14:25:21.264423Z"},"links":{"cited_paper":"/paper/2510.18313","citing_paper":"/paper/2607.04732"},"observation_digest":"sha256:142b1a78797dc207b6945a1071e7e07727e0d0791ad862c8630da3feb8331abd","observation_id":"c0b823e3-4feb-4f75-952c-313ce8b8b691","resolution":{"observed_at":"2026-07-11T14:25:21.264423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T14:25:21.264423Z","title":"Oc- cgen: Generative multi-modal 3d occupancy prediction for autonomous driving,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.04732","last_updated":"2026-07-06T07:10:00Z","snapshot_observed_at":"2026-08-08T22:48:13.911536Z","submitted_at":"2026-07-06T07:10:00Z","title":"SparseOcc++: Geometry-Aware Sparse Latent Representation for Semantic Occupancy Prediction","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-07-11T14:25:21.264423Z"},"links":{"citing_paper":"/paper/2607.04732"},"observation_digest":"sha256:d8cd78b8eeaf0cbc5e78fa9651970a41b17ae971a278fa3786b571da8be746a2","observation_id":"f648a7a4-ce1b-400c-b99c-7a38b58766e7","resolution":{"observed_at":"2026-07-11T14:25:21.264423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T14:25:21.264423Z","title":"Occworld: Learning a 3d occupancy world model for autonomous driving,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.04732","last_updated":"2026-07-06T07:10:00Z","snapshot_observed_at":"2026-08-08T22:48:13.911536Z","submitted_at":"2026-07-06T07:10:00Z","title":"SparseOcc++: Geometry-Aware Sparse Latent Representation for Semantic Occupancy Prediction","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-07-11T14:25:21.264423Z"},"links":{"citing_paper":"/paper/2607.04732"},"observation_digest":"sha256:fd3d27c7438c4d2e29c3c7367b45bb6f6b7dfc59b3223f9c66f93242e0c3d396","observation_id":"d48bb5ca-20a4-4aab-ac7b-96fb05d0d49f","resolution":{"observed_at":"2026-07-11T14:25:21.264423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T14:25:21.264423Z","title":"Scpnet: Semantic scene completion on point cloud,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.04732","last_updated":"2026-07-06T07:10:00Z","snapshot_observed_at":"2026-08-08T22:48:13.911536Z","submitted_at":"2026-07-06T07:10:00Z","title":"SparseOcc++: Geometry-Aware Sparse Latent Representation for Semantic Occupancy Prediction","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-07-11T14:25:21.264423Z"},"links":{"citing_paper":"/paper/2607.04732"},"observation_digest":"sha256:a7de7678f334c010791fa49923345124d7ed3048fde8501b22883972e5b2b7ab","observation_id":"432179f4-b584-4eb0-985b-e32209ec5c65","resolution":{"observed_at":"2026-07-11T14:25:21.264423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T14:25:21.264423Z","title":"V oxformer: Sparse voxel transformer for camera- based 3d semantic scene completion,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.04732","last_updated":"2026-07-06T07:10:00Z","snapshot_observed_at":"2026-08-08T22:48:13.911536Z","submitted_at":"2026-07-06T07:10:00Z","title":"SparseOcc++: Geometry-Aware Sparse Latent Representation for Semantic Occupancy Prediction","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-07-11T14:25:21.264423Z"},"links":{"citing_paper":"/paper/2607.04732"},"observation_digest":"sha256:a6bee6c6a617478971be040b2a6773e54f9ecedf55fed18a2808ddb890c02409","observation_id":"63c5f99c-8b68-46a6-8aed-6a9fe764d9d4","resolution":{"observed_at":"2026-07-11T14:25:21.264423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09117","last_updated":"2023-06-15T13:23:57Z","snapshot_observed_at":"2026-08-20T01:33:51.369236Z","submitted_at":"2023-06-15T13:23:57Z","title":"UniOcc: Unifying Vision-Centric 3D Occupancy Prediction with Geometric and Semantic Rendering","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.09117","snapshot_observed_at":"2026-07-11T14:25:21.264423Z","title":"Uniocc: Unifying vision-centric 3d occupancy prediction with geometric and semantic rendering,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.04732","last_updated":"2026-07-06T07:10:00Z","snapshot_observed_at":"2026-08-08T22:48:13.911536Z","submitted_at":"2026-07-06T07:10:00Z","title":"SparseOcc++: Geometry-Aware Sparse Latent Representation for Semantic Occupancy Prediction","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-07-11T14:25:21.264423Z"},"links":{"cited_paper":"/paper/2306.09117","citing_paper":"/paper/2607.04732"},"observation_digest":"sha256:56ecf541327224f5c893171acce5e453b93ca1066435858a132466bd615dd584","observation_id":"4ef4f540-6435-4fe1-a991-9f919cc25a32","resolution":{"observed_at":"2026-07-11T14:25:21.264423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T14:25:21.264423Z","title":"Renderocc: Vision-centric 3d occupancy prediction with 2d rendering supervision,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.04732","last_updated":"2026-07-06T07:10:00Z","snapshot_observed_at":"2026-08-08T22:48:13.911536Z","submitted_at":"2026-07-06T07:10:00Z","title":"SparseOcc++: Geometry-Aware Sparse Latent Representation for Semantic Occupancy Prediction","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-07-11T14:25:21.264423Z"},"links":{"citing_paper":"/paper/2607.04732"},"observation_digest":"sha256:b0bf86ee252e8e3f8d2383f19898f14cbaf74f574b0a7827af9833010a680e88","observation_id":"8a323a59-5681-4a77-a294-97207c05fc47","resolution":{"observed_at":"2026-07-11T14:25:21.264423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.09243","last_updated":"2024-08-21T12:24:49Z","snapshot_observed_at":"2026-08-16T14:34:38.939009Z","submitted_at":"2023-12-14T18:58:52Z","title":"OccNeRF: Advancing 3D Occupancy Prediction in LiDAR-Free Environments","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.09243","snapshot_observed_at":"2026-07-11T14:25:21.264423Z","title":"Occnerf: Self-supervised multi-camera occupancy prediction with neural radiance fields,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.04732","last_updated":"2026-07-06T07:10:00Z","snapshot_observed_at":"2026-08-08T22:48:13.911536Z","submitted_at":"2026-07-06T07:10:00Z","title":"SparseOcc++: Geometry-Aware Sparse Latent Representation for Semantic Occupancy Prediction","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-07-11T14:25:21.264423Z"},"links":{"cited_paper":"/paper/2312.09243","citing_paper":"/paper/2607.04732"},"observation_digest":"sha256:2b3b2524eb995ac692aa6005a64f7446ea5882979235f4edf74bb280d9067864","observation_id":"ef593d26-d8dd-4bb6-ba70-c43df2f22c4b","resolution":{"observed_at":"2026-07-11T14:25:21.264423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T14:25:21.264423Z","title":"3d gaussian splatting for real-time radiance field rendering","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.04732","last_updated":"2026-07-06T07:10:00Z","snapshot_observed_at":"2026-08-08T22:48:13.911536Z","submitted_at":"2026-07-06T07:10:00Z","title":"SparseOcc++: Geometry-Aware Sparse Latent Representation for Semantic Occupancy Prediction","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-07-11T14:25:21.264423Z"},"links":{"citing_paper":"/paper/2607.04732"},"observation_digest":"sha256:4b04b7bb009ce72882840d478b590e474acf3615b040fed57fdbc97a31085202","observation_id":"eaebbd75-f122-499a-b71f-97a4a0b46201","resolution":{"observed_at":"2026-07-11T14:25:21.264423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T14:25:21.264423Z","title":"V oxelnet: End-to-end learning for point cloud based 3d object detection,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.04732","last_updated":"2026-07-06T07:10:00Z","snapshot_observed_at":"2026-08-08T22:48:13.911536Z","submitted_at":"2026-07-06T07:10:00Z","title":"SparseOcc++: Geometry-Aware Sparse Latent Representation for Semantic Occupancy Prediction","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-07-11T14:25:21.264423Z"},"links":{"citing_paper":"/paper/2607.04732"},"observation_digest":"sha256:43ae7456a17056c2273f0efa200c325bb7271f434ee384ad7f704563ca5e62dc","observation_id":"7ce7f450-38aa-476a-a440-503c3ae63089","resolution":{"observed_at":"2026-07-11T14:25:21.264423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T14:25:21.264423Z","title":"Semantic scene completion from a single depth image,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.04732","last_updated":"2026-07-06T07:10:00Z","snapshot_observed_at":"2026-08-08T22:48:13.911536Z","submitted_at":"2026-07-06T07:10:00Z","title":"SparseOcc++: Geometry-Aware Sparse Latent Representation for Semantic Occupancy Prediction","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-07-11T14:25:21.264423Z"},"links":{"citing_paper":"/paper/2607.04732"},"observation_digest":"sha256:dad4d25e5917b591383002865c606f648200158c36c37f2f672631f9e4cf25f0","observation_id":"f8815b70-167e-417a-9f4c-173d1141a068","resolution":{"observed_at":"2026-07-11T14:25:21.264423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T14:25:21.264423Z","title":"Semantic scene completion using local deep implicit functions on lidar data,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.04732","last_updated":"2026-07-06T07:10:00Z","snapshot_observed_at":"2026-08-08T22:48:13.911536Z","submitted_at":"2026-07-06T07:10:00Z","title":"SparseOcc++: Geometry-Aware Sparse Latent Representation for Semantic Occupancy Prediction","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-07-11T14:25:21.264423Z"},"links":{"citing_paper":"/paper/2607.04732"},"observation_digest":"sha256:8a0bfb3a80fa3877a81d207a3a64de7529f5e02268f57f356447657850e7bc13","observation_id":"29ab9b63-13ac-46b5-bded-0a7b2c96d276","resolution":{"observed_at":"2026-07-11T14:25:21.264423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T14:25:21.264423Z","title":"Deep residual learning for image recognition,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.04732","last_updated":"2026-07-06T07:10:00Z","snapshot_observed_at":"2026-08-08T22:48:13.911536Z","submitted_at":"2026-07-06T07:10:00Z","title":"SparseOcc++: Geometry-Aware Sparse Latent Representation for Semantic Occupancy Prediction","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-07-11T14:25:21.264423Z"},"links":{"citing_paper":"/paper/2607.04732"},"observation_digest":"sha256:22e39e2f1c847c61391577763a19617c7c95c10d0e86d95025b4509bf8e83bb3","observation_id":"9c5dd09b-eaa2-467c-a062-8563a1344d1a","resolution":{"observed_at":"2026-07-11T14:25:21.264423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T14:25:21.264423Z","title":"Feature pyramid networks for object detection,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.04732","last_updated":"2026-07-06T07:10:00Z","snapshot_observed_at":"2026-08-08T22:48:13.911536Z","submitted_at":"2026-07-06T07:10:00Z","title":"SparseOcc++: Geometry-Aware Sparse Latent Representation for Semantic Occupancy Prediction","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-07-11T14:25:21.264423Z"},"links":{"citing_paper":"/paper/2607.04732"},"observation_digest":"sha256:4e6dbfbebb81d2650ae4501252681f2f3f818d62a3e7361dc2b51e12c6fbce2f","observation_id":"6ec59f0a-60fb-468e-b999-327cf1d49b9b","resolution":{"observed_at":"2026-07-11T14:25:21.264423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T14:25:21.264423Z","title":"Deformable DETR: Deformable transformers for end-to-end object detection,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.04732","last_updated":"2026-07-06T07:10:00Z","snapshot_observed_at":"2026-08-08T22:48:13.911536Z","submitted_at":"2026-07-06T07:10:00Z","title":"SparseOcc++: Geometry-Aware Sparse Latent Representation for Semantic Occupancy Prediction","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-07-11T14:25:21.264423Z"},"links":{"citing_paper":"/paper/2607.04732"},"observation_digest":"sha256:444d633d1eab475e8e3a7ccef99d4992b534a4332a09c3ab7e49cf2330c4b6b6","observation_id":"09b1c40c-d05f-4ef4-bc87-873c551dfa40","resolution":{"observed_at":"2026-07-11T14:25:21.264423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T14:25:21.264423Z","title":"Metabev: Solving sensor failures for 3d detection and map segmentation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.04732","last_updated":"2026-07-06T07:10:00Z","snapshot_observed_at":"2026-08-08T22:48:13.911536Z","submitted_at":"2026-07-06T07:10:00Z","title":"SparseOcc++: Geometry-Aware Sparse Latent Representation for Semantic Occupancy Prediction","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-07-11T14:25:21.264423Z"},"links":{"citing_paper":"/paper/2607.04732"},"observation_digest":"sha256:f143b67661c3d803690ce5b23dd4bb38c82676f378c4bfddb914ccd1a5e2a7da","observation_id":"8456e1e1-76a0-4b0e-aae4-2a9af20feb74","resolution":{"observed_at":"2026-07-11T14:25:21.264423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.04050","last_updated":"2022-08-17T03:28:41Z","snapshot_observed_at":"2026-08-16T17:16:10.166687Z","submitted_at":"2022-03-08T12:39:51Z","title":"BEVSegFormer: Bird's Eye View Semantic Segmentation From Arbitrary Camera Rigs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.04050","snapshot_observed_at":"2026-07-11T14:25:21.264423Z","title":"Bevsegformer: Bird’s eye view semantic segmentation from arbitrary camera rigs,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.04732","last_updated":"2026-07-06T07:10:00Z","snapshot_observed_at":"2026-08-08T22:48:13.911536Z","submitted_at":"2026-07-06T07:10:00Z","title":"SparseOcc++: Geometry-Aware Sparse Latent Representation for Semantic Occupancy Prediction","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-07-11T14:25:21.264423Z"},"links":{"cited_paper":"/paper/2203.04050","citing_paper":"/paper/2607.04732"},"observation_digest":"sha256:3ea9512f85e4dacdc035990d3f67b44e8f0c8e6958228a3ba0766a07b26b3f63","observation_id":"47f94dd8-a12b-4a53-8951-ce0068c27eb0","resolution":{"observed_at":"2026-07-11T14:25:21.264423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T14:25:21.264423Z","title":"Cross-view transformers for real-time map-view semantic segmentation,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.04732","last_updated":"2026-07-06T07:10:00Z","snapshot_observed_at":"2026-08-08T22:48:13.911536Z","submitted_at":"2026-07-06T07:10:00Z","title":"SparseOcc++: Geometry-Aware Sparse Latent Representation for Semantic Occupancy Prediction","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-07-11T14:25:21.264423Z"},"links":{"citing_paper":"/paper/2607.04732"},"observation_digest":"sha256:32f24faacbddd044e4b207b6f368e1bbeec99f6fd29ca8e9b1e8c205544b2cf3","observation_id":"20970c24-27eb-4c36-a8cc-212c343dd517","resolution":{"observed_at":"2026-07-11T14:25:21.264423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T14:25:21.264423Z","title":"Predicting semantic map representations from images using pyramid occupancy networks,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.04732","last_updated":"2026-07-06T07:10:00Z","snapshot_observed_at":"2026-08-08T22:48:13.911536Z","submitted_at":"2026-07-06T07:10:00Z","title":"SparseOcc++: Geometry-Aware Sparse Latent Representation for Semantic Occupancy Prediction","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-07-11T14:25:21.264423Z"},"links":{"citing_paper":"/paper/2607.04732"},"observation_digest":"sha256:843f9c9fa6be783150a66db71bacc4972cf32cbce6e80684be5543dc9971411c","observation_id":"6411e868-3b41-4977-a64c-460ace60827c","resolution":{"observed_at":"2026-07-11T14:25:21.264423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T14:25:21.264423Z","title":"Fiery: future instance prediction in bird’s- eye view from surround monocular cameras,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.04732","last_updated":"2026-07-06T07:10:00Z","snapshot_observed_at":"2026-08-08T22:48:13.911536Z","submitted_at":"2026-07-06T07:10:00Z","title":"SparseOcc++: Geometry-Aware Sparse Latent Representation for Semantic Occupancy Prediction","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-07-11T14:25:21.264423Z"},"links":{"citing_paper":"/paper/2607.04732"},"observation_digest":"sha256:69122cd3a26bd26921cce6be9ef074121cda6f0440b049a1603f2cc13dbc24ee","observation_id":"1c2d0a4e-7395-4584-9a3b-59e8a940c2d9","resolution":{"observed_at":"2026-07-11T14:25:21.264423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T14:25:21.264423Z","title":"Fully sparse 3d object detection,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.04732","last_updated":"2026-07-06T07:10:00Z","snapshot_observed_at":"2026-08-08T22:48:13.911536Z","submitted_at":"2026-07-06T07:10:00Z","title":"SparseOcc++: Geometry-Aware Sparse Latent Representation for Semantic Occupancy Prediction","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-07-11T14:25:21.264423Z"},"links":{"citing_paper":"/paper/2607.04732"},"observation_digest":"sha256:8a52a179a3f36ff01e6807027873902cd822857e7285c26179ae637df0041abe","observation_id":"210365a3-e105-434e-b4db-d2e47a881031","resolution":{"observed_at":"2026-07-11T14:25:21.264423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T14:25:21.264423Z","title":"Super sparse 3d object detection,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.04732","last_updated":"2026-07-06T07:10:00Z","snapshot_observed_at":"2026-08-08T22:48:13.911536Z","submitted_at":"2026-07-06T07:10:00Z","title":"SparseOcc++: Geometry-Aware Sparse Latent Representation for Semantic Occupancy Prediction","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-07-11T14:25:21.264423Z"},"links":{"citing_paper":"/paper/2607.04732"},"observation_digest":"sha256:3845c94b299fde7877b72a983ead16a32bc877b5d2f64c332586cfcb6b963f4e","observation_id":"60a094e3-d045-4376-a13f-29d833c240b8","resolution":{"observed_at":"2026-07-11T14:25:21.264423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T14:25:21.264423Z","title":"Fsd v2: Improving fully sparse 3d object detection with virtual voxels,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.04732","last_updated":"2026-07-06T07:10:00Z","snapshot_observed_at":"2026-08-08T22:48:13.911536Z","submitted_at":"2026-07-06T07:10:00Z","title":"SparseOcc++: Geometry-Aware Sparse Latent Representation for Semantic Occupancy Prediction","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-07-11T14:25:21.264423Z"},"links":{"citing_paper":"/paper/2607.04732"},"observation_digest":"sha256:dd02b4f4d5bd30eb1cb07252c415560b64547431bace1e036a1726efcd5a8eb2","observation_id":"9d9214e5-1f24-43d1-997e-e503a5457de3","resolution":{"observed_at":"2026-07-11T14:25:21.264423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T14:25:21.264423Z","title":"Cylindrical and asymmetrical 3d convolution networks for lidar segmentation,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.04732","last_updated":"2026-07-06T07:10:00Z","snapshot_observed_at":"2026-08-08T22:48:13.911536Z","submitted_at":"2026-07-06T07:10:00Z","title":"SparseOcc++: Geometry-Aware Sparse Latent Representation for Semantic Occupancy Prediction","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-07-11T14:25:21.264423Z"},"links":{"citing_paper":"/paper/2607.04732"},"observation_digest":"sha256:6cab38da1ba1c572310706cbad7c1b1909089175399dcb56f6fcc428f987b405","observation_id":"72a604bd-1eb6-4336-b8a8-f285308d9d22","resolution":{"observed_at":"2026-07-11T14:25:21.264423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T14:25:21.264423Z","title":"Masked-attention mask transformer for universal image segmenta- tion,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.04732","last_updated":"2026-07-06T07:10:00Z","snapshot_observed_at":"2026-08-08T22:48:13.911536Z","submitted_at":"2026-07-06T07:10:00Z","title":"SparseOcc++: Geometry-Aware Sparse Latent Representation for Semantic Occupancy Prediction","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-07-11T14:25:21.264423Z"},"links":{"citing_paper":"/paper/2607.04732"},"observation_digest":"sha256:877da0eb6de1c23ce67188a3d1d2e1ebea3d2a6777b1f9706993c717a0cdc32b","observation_id":"55314d62-1777-4359-82a1-9fd24c0a3c0b","resolution":{"observed_at":"2026-07-11T14:25:21.264423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T14:25:21.264423Z","title":"Deformable detr: Deformable transformers for end-to-end object detection,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.04732","last_updated":"2026-07-06T07:10:00Z","snapshot_observed_at":"2026-08-08T22:48:13.911536Z","submitted_at":"2026-07-06T07:10:00Z","title":"SparseOcc++: Geometry-Aware Sparse Latent Representation for Semantic Occupancy Prediction","version":1},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-07-11T14:25:21.264423Z"},"links":{"citing_paper":"/paper/2607.04732"},"observation_digest":"sha256:be7acaf8e27ce423ed5f7ff095e457f73fe1d047abcf68bb1e2094ddec860f55","observation_id":"efcdea88-7841-4ffe-967c-edf82e580f59","resolution":{"observed_at":"2026-07-11T14:25:21.264423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T14:25:21.264423Z","title":"U-net: Convolutional net- works for biomedical image segmentation,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2607.04732","last_updated":"2026-07-06T07:10:00Z","snapshot_observed_at":"2026-08-08T22:48:13.911536Z","submitted_at":"2026-07-06T07:10:00Z","title":"SparseOcc++: Geometry-Aware Sparse Latent Representation for Semantic Occupancy Prediction","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-07-11T14:25:21.264423Z"},"links":{"citing_paper":"/paper/2607.04732"},"observation_digest":"sha256:c4feed72b5c779e93e9abab1890abb5079c3229a0bb4e1f79e1b3389c9a48e04","observation_id":"0b912cfc-1941-4bd3-883c-178d6ba9fb5d","resolution":{"observed_at":"2026-07-11T14:25:21.264423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T14:25:21.264423Z","title":"Lidar r-cnn: An efficient and universal 3d object detector,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.04732","last_updated":"2026-07-06T07:10:00Z","snapshot_observed_at":"2026-08-08T22:48:13.911536Z","submitted_at":"2026-07-06T07:10:00Z","title":"SparseOcc++: Geometry-Aware Sparse Latent Representation for Semantic Occupancy Prediction","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-07-11T14:25:21.264423Z"},"links":{"citing_paper":"/paper/2607.04732"},"observation_digest":"sha256:bb0e311f62913cc137594ef26ff08fa02552830b01add996383393724376a713","observation_id":"8cddd96a-1f58-48d8-b7c5-462f177bfeac","resolution":{"observed_at":"2026-07-11T14:25:21.264423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T14:25:21.264423Z","title":"Lmscnet: Lightweight multiscale 3d semantic completion,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.04732","last_updated":"2026-07-06T07:10:00Z","snapshot_observed_at":"2026-08-08T22:48:13.911536Z","submitted_at":"2026-07-06T07:10:00Z","title":"SparseOcc++: Geometry-Aware Sparse Latent Representation for Semantic Occupancy Prediction","version":1},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-07-11T14:25:21.264423Z"},"links":{"citing_paper":"/paper/2607.04732"},"observation_digest":"sha256:c6ff9abbcecafbbd013a2cdf2f02ec618a351cd520d4f85feaa784472ba8d2a2","observation_id":"d2393926-8e45-48dc-9e63-1a6edfb199b5","resolution":{"observed_at":"2026-07-11T14:25:21.264423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T14:25:21.264423Z","title":"3d sketch-aware semantic scene completion via semi-supervised structure prior,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.04732","last_updated":"2026-07-06T07:10:00Z","snapshot_observed_at":"2026-08-08T22:48:13.911536Z","submitted_at":"2026-07-06T07:10:00Z","title":"SparseOcc++: Geometry-Aware Sparse Latent Representation for Semantic Occupancy Prediction","version":1},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-07-11T14:25:21.264423Z"},"links":{"citing_paper":"/paper/2607.04732"},"observation_digest":"sha256:7a87a75fcaf20ae58c27682103b2a0d2f1a03b6c664bfcee01a8b35982daf7cf","observation_id":"9b9ceadf-15f1-48b4-a924-3cb8bcf58309","resolution":{"observed_at":"2026-07-11T14:25:21.264423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T14:25:21.264423Z","title":"Anisotropic convolutional networks for 3d semantic scene completion,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.04732","last_updated":"2026-07-06T07:10:00Z","snapshot_observed_at":"2026-08-08T22:48:13.911536Z","submitted_at":"2026-07-06T07:10:00Z","title":"SparseOcc++: Geometry-Aware Sparse Latent Representation for Semantic Occupancy Prediction","version":1},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-07-11T14:25:21.264423Z"},"links":{"citing_paper":"/paper/2607.04732"},"observation_digest":"sha256:51375558c9b9902e7ee49f2cf65a744d22a1a58c6091ebe8ceca2b863a18333d","observation_id":"ec50653d-e605-4d19-a8f4-e0c253c61d29","resolution":{"observed_at":"2026-07-11T14:25:21.264423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T14:25:21.264423Z","title":"Sparse single sweep lidar point cloud segmentation via learning contextual shape priors from scene completion,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.04732","last_updated":"2026-07-06T07:10:00Z","snapshot_observed_at":"2026-08-08T22:48:13.911536Z","submitted_at":"2026-07-06T07:10:00Z","title":"SparseOcc++: Geometry-Aware Sparse Latent Representation for Semantic Occupancy Prediction","version":1},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-07-11T14:25:21.264423Z"},"links":{"citing_paper":"/paper/2607.04732"},"observation_digest":"sha256:f3eed41eb314d7efe580db561d035507ddf6dcd0d110f2aa2c67cf07212caaff","observation_id":"99527943-f1e5-49b5-bca3-e29364bfed25","resolution":{"observed_at":"2026-07-11T14:25:21.264423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T14:25:21.264423Z","title":"Ndc- scene: Boost monocular 3d semantic scene completion in normalized device coordinates space,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.04732","last_updated":"2026-07-06T07:10:00Z","snapshot_observed_at":"2026-08-08T22:48:13.911536Z","submitted_at":"2026-07-06T07:10:00Z","title":"SparseOcc++: Geometry-Aware Sparse Latent Representation for Semantic Occupancy Prediction","version":1},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-07-11T14:25:21.264423Z"},"links":{"citing_paper":"/paper/2607.04732"},"observation_digest":"sha256:89ef9bc34e772cf71e01df639db5538d46028a0342404e547fb243fec57582e6","observation_id":"3d0d4e30-388c-4468-93b3-57ada69402f0","resolution":{"observed_at":"2026-07-11T14:25:21.264423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T14:25:21.264423Z","title":"Symphonize 3d semantic scene completion with contextual instance queries,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.04732","last_updated":"2026-07-06T07:10:00Z","snapshot_observed_at":"2026-08-08T22:48:13.911536Z","submitted_at":"2026-07-06T07:10:00Z","title":"SparseOcc++: Geometry-Aware Sparse Latent Representation for Semantic Occupancy Prediction","version":1},"reference_index":101,"source":"pdf_text","source_observed_at":"2026-07-11T14:25:21.264423Z"},"links":{"citing_paper":"/paper/2607.04732"},"observation_digest":"sha256:eb16dc101696b2464fc307441235eb5b29b6496057ef337ae594d8811c074aad","observation_id":"d7212622-155b-4a1e-8486-5c029bd3c08f","resolution":{"observed_at":"2026-07-11T14:25:21.264423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.04732","last_updated":"2026-07-06T07:10:00Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-08T22:48:13.911536Z","submitted_at":"2026-07-06T07:10:00Z","title":"SparseOcc++: Geometry-Aware Sparse Latent Representation for Semantic Occupancy Prediction"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":100,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":103},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 100 of 103 outbound references and 0 inbound Pith citation observations for arXiv:2607.04732."}