{"as_of":"2026-08-16T00:29:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d85bffba992dfb729f00ba53414b4307b74637ed4d3352f542fff0eeb6508809","coverage":[{"denominator":45,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":45,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T15:02:26.182884Z","state":"measured"},{"denominator":45,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":45,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.17083/citation-record","integrity":"/paper/2507.17083/integrity","json":"/paper/2507.17083/citation-record.json","paper":"/paper/2507.17083"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:02:26.773258Z","title":"Radardistill: Boosting radar-based ob- ject detection performance via knowledge distillation from lidar features","venue":null,"work_id":"d16abdbc-8189-466e-b662-4ecf20da45c3","year":2024},"citing_paper":{"arxiv_id":"2507.17083","last_updated":"2025-07-22T23:49:40Z","snapshot_observed_at":"2026-08-12T19:51:49.113889Z","submitted_at":"2025-07-22T23:49:40Z","title":"SDGOCC: Semantic and Depth-Guided Bird's-Eye View Transformation for 3D Multimodal Occupancy Prediction","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:26.070155Z"},"links":{"citing_paper":"/paper/2507.17083"},"observation_digest":"sha256:b8db4f6f093769a77f952b9f3c2f902fdeed95f7c55ae0d9bf0905caff8d031f","observation_id":"02fa4386-ec37-4bf0-96e1-344ae21e7688","resolution":{"observed_at":"2026-08-06T15:02:26.776042Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:02:26.073303Z","title":"Monoscene: Monoc- ular 3d semantic scene completion","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.17083","last_updated":"2025-07-22T23:49:40Z","snapshot_observed_at":"2026-08-12T19:51:49.113889Z","submitted_at":"2025-07-22T23:49:40Z","title":"SDGOCC: Semantic and Depth-Guided Bird's-Eye View Transformation for 3D Multimodal Occupancy Prediction","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:26.073303Z"},"links":{"citing_paper":"/paper/2507.17083"},"observation_digest":"sha256:4f612f28416b487b98fc1be377b651fbf0559883c6dc9b6582c6c132bf5ce186","observation_id":"21df1903-fa2d-421a-8941-df763354f747","resolution":{"observed_at":"2026-08-06T15:02:26.073303Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:02:26.759373Z","title":"Eliminating cross-modal conflicts in bev space for lidar-camera 3d object detection","venue":null,"work_id":"79c71f47-6d8c-42a7-a5b8-e45aed7c6960","year":2024},"citing_paper":{"arxiv_id":"2507.17083","last_updated":"2025-07-22T23:49:40Z","snapshot_observed_at":"2026-08-12T19:51:49.113889Z","submitted_at":"2025-07-22T23:49:40Z","title":"SDGOCC: Semantic and Depth-Guided Bird's-Eye View Transformation for 3D Multimodal Occupancy Prediction","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:26.075949Z"},"links":{"citing_paper":"/paper/2507.17083"},"observation_digest":"sha256:e2b225f1caa0b81a8060c568e1f3eff7a5966b044b8d416de35e31d9f86a1fbc","observation_id":"53f71aa2-4e2e-4f94-8577-74eddfdc52a4","resolution":{"observed_at":"2026-08-06T15:02:26.762147Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:02:26.751361Z","title":"Neighborhood attention transformer","venue":null,"work_id":"d369f213-ac02-439d-8d9e-ba42febf2da6","year":2023},"citing_paper":{"arxiv_id":"2507.17083","last_updated":"2025-07-22T23:49:40Z","snapshot_observed_at":"2026-08-12T19:51:49.113889Z","submitted_at":"2025-07-22T23:49:40Z","title":"SDGOCC: Semantic and Depth-Guided Bird's-Eye View Transformation for 3D Multimodal Occupancy Prediction","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:26.079146Z"},"links":{"citing_paper":"/paper/2507.17083"},"observation_digest":"sha256:9b50030a3fd06e4c6a0b026bb81e2325d4243ab9a55585f19b414658176daf7b","observation_id":"42b077de-260f-4eb4-8847-b3d07a5040ac","resolution":{"observed_at":"2026-08-06T15:02:26.754154Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:02:26.081998Z","title":"Deep residual learning for image recognition","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.17083","last_updated":"2025-07-22T23:49:40Z","snapshot_observed_at":"2026-08-12T19:51:49.113889Z","submitted_at":"2025-07-22T23:49:40Z","title":"SDGOCC: Semantic and Depth-Guided Bird's-Eye View Transformation for 3D Multimodal Occupancy Prediction","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:26.081998Z"},"links":{"citing_paper":"/paper/2507.17083"},"observation_digest":"sha256:7932afee826866d2cb4da99ac5a72ca72a018f3fc547079156b160d17fc55811","observation_id":"e59a50ac-e7ca-4c84-9d6b-276021025a75","resolution":{"observed_at":"2026-08-06T15:02:26.081998Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.02710","last_updated":"2024-03-05T07:01:53Z","snapshot_observed_at":"2026-08-13T04:03:21.003519Z","submitted_at":"2024-03-05T07:01:53Z","title":"FastOcc: Accelerating 3D Occupancy Prediction by Fusing the 2D Bird's-Eye View and Perspective View","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.02710","snapshot_observed_at":"2026-08-06T15:02:26.084921Z","title":"Fas- tocc: Accelerating 3d occupancy prediction by fusing the 2d bird’s-eye view and perspective view","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.17083","last_updated":"2025-07-22T23:49:40Z","snapshot_observed_at":"2026-08-12T19:51:49.113889Z","submitted_at":"2025-07-22T23:49:40Z","title":"SDGOCC: Semantic and Depth-Guided Bird's-Eye View Transformation for 3D Multimodal Occupancy Prediction","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:26.084921Z"},"links":{"cited_paper":"/paper/2403.02710","citing_paper":"/paper/2507.17083"},"observation_digest":"sha256:ab04125c0b3591c1dd375f5d1604b2277faa0fbb59026c6b684c00746542c7a4","observation_id":"39bafd76-6cdb-4c66-9084-1e6bcddfda39","resolution":{"observed_at":"2026-08-06T15:02:26.084921Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:02:26.737728Z","title":"Planning-oriented autonomous driving","venue":null,"work_id":"11220c83-b19b-4920-b528-9f5ed477c0d8","year":2023},"citing_paper":{"arxiv_id":"2507.17083","last_updated":"2025-07-22T23:49:40Z","snapshot_observed_at":"2026-08-12T19:51:49.113889Z","submitted_at":"2025-07-22T23:49:40Z","title":"SDGOCC: Semantic and Depth-Guided Bird's-Eye View Transformation for 3D Multimodal Occupancy Prediction","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:26.087972Z"},"links":{"citing_paper":"/paper/2507.17083"},"observation_digest":"sha256:1418f057ab6c2de26a9e5e6ed36593dbcdcf08daadbfda9782233fec78ba5b40","observation_id":"8d308416-2f01-4547-a2e9-42cd7f370b2b","resolution":{"observed_at":"2026-08-06T15:02:26.740428Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.17054","last_updated":"2022-06-16T09:44:08Z","snapshot_observed_at":"2026-08-14T23:33:45.566779Z","submitted_at":"2022-03-31T14:21:19Z","title":"BEVDet4D: Exploit Temporal Cues in Multi-camera 3D Object Detection","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.17054","snapshot_observed_at":"2026-08-06T15:02:26.090384Z","title":"Bevdet4d: Exploit tempo- ral cues in multi-camera 3d object detection","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.17083","last_updated":"2025-07-22T23:49:40Z","snapshot_observed_at":"2026-08-12T19:51:49.113889Z","submitted_at":"2025-07-22T23:49:40Z","title":"SDGOCC: Semantic and Depth-Guided Bird's-Eye View Transformation for 3D Multimodal Occupancy Prediction","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:26.090384Z"},"links":{"cited_paper":"/paper/2203.17054","citing_paper":"/paper/2507.17083"},"observation_digest":"sha256:5e5661e649f0af87ae1e8d97ecb1f4ea7e0878852c89565f9af1bda20e897bfa","observation_id":"1626483d-ab53-4bba-8454-6e01abd0501d","resolution":{"observed_at":"2026-08-06T15:02:26.090384Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:02:26.729696Z","title":"Tri-perspective view for vision- based 3d semantic occupancy prediction","venue":null,"work_id":"032cb9f9-31ba-48b4-b80f-44579f2b2072","year":2023},"citing_paper":{"arxiv_id":"2507.17083","last_updated":"2025-07-22T23:49:40Z","snapshot_observed_at":"2026-08-12T19:51:49.113889Z","submitted_at":"2025-07-22T23:49:40Z","title":"SDGOCC: Semantic and Depth-Guided Bird's-Eye View Transformation for 3D Multimodal Occupancy Prediction","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:26.093120Z"},"links":{"citing_paper":"/paper/2507.17083"},"observation_digest":"sha256:8c0baf3a4355eb1712650aa6f52e50d535562bf3b48f2bfb19718749b6839db7","observation_id":"3bcb9d54-9eab-445c-8ecb-4847d2abc3b5","resolution":{"observed_at":"2026-08-06T15:02:26.732543Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:02:26.721609Z","title":"Driveadapter: Breaking the coupling barrier of perception and planning in end-to-end autonomous driving","venue":null,"work_id":"17acfe76-5e7a-456c-944a-699d9b873879","year":2023},"citing_paper":{"arxiv_id":"2507.17083","last_updated":"2025-07-22T23:49:40Z","snapshot_observed_at":"2026-08-12T19:51:49.113889Z","submitted_at":"2025-07-22T23:49:40Z","title":"SDGOCC: Semantic and Depth-Guided Bird's-Eye View Transformation for 3D Multimodal Occupancy Prediction","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:26.095465Z"},"links":{"citing_paper":"/paper/2507.17083"},"observation_digest":"sha256:343311db180bd9aa177bcab94e4b06d79554a3afbc74d7b21866202d9c947b34","observation_id":"8c0f7b05-d6e5-4f7c-b275-6a5090854b48","resolution":{"observed_at":"2026-08-06T15:02:26.724505Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:02:26.713527Z","title":"Spherical transformer for lidar-based 3d recognition","venue":null,"work_id":"f9735b33-1363-436b-81e1-45cd4f20d824","year":2023},"citing_paper":{"arxiv_id":"2507.17083","last_updated":"2025-07-22T23:49:40Z","snapshot_observed_at":"2026-08-12T19:51:49.113889Z","submitted_at":"2025-07-22T23:49:40Z","title":"SDGOCC: Semantic and Depth-Guided Bird's-Eye View Transformation for 3D Multimodal Occupancy Prediction","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:26.097852Z"},"links":{"citing_paper":"/paper/2507.17083"},"observation_digest":"sha256:1eeb313b8bd7089454754b2a49d1b322d5796e31f2c12e165c7e0d6b35c1e918","observation_id":"84b9f8ac-72e6-4435-98c9-3ead6e66bf7a","resolution":{"observed_at":"2026-08-06T15:02:26.716249Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:02:26.705158Z","title":"Mseg3d: Multi-modal 3d semantic segmentation for autonomous driv- ing","venue":null,"work_id":"5007c5cc-d178-4c57-ab54-847faba7c283","year":null},"citing_paper":{"arxiv_id":"2507.17083","last_updated":"2025-07-22T23:49:40Z","snapshot_observed_at":"2026-08-12T19:51:49.113889Z","submitted_at":"2025-07-22T23:49:40Z","title":"SDGOCC: Semantic and Depth-Guided Bird's-Eye View Transformation for 3D Multimodal Occupancy Prediction","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:26.100401Z"},"links":{"citing_paper":"/paper/2507.17083"},"observation_digest":"sha256:0c7a52b56b396746f618a0b91d3a6082fca1da401f01eac9b5c6afaf87115395","observation_id":"73564b7a-88d3-4a2e-b657-5384bc25cb43","resolution":{"observed_at":"2026-08-06T15:02:26.707834Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:02:26.697329Z","title":"V oxformer: Sparse voxel transformer for camera- based 3d semantic scene completion","venue":null,"work_id":"510b9316-92c3-4a52-8361-a41653b76dc3","year":2023},"citing_paper":{"arxiv_id":"2507.17083","last_updated":"2025-07-22T23:49:40Z","snapshot_observed_at":"2026-08-12T19:51:49.113889Z","submitted_at":"2025-07-22T23:49:40Z","title":"SDGOCC: Semantic and Depth-Guided Bird's-Eye View Transformation for 3D Multimodal Occupancy Prediction","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:26.102962Z"},"links":{"citing_paper":"/paper/2507.17083"},"observation_digest":"sha256:d110e10af2879e261e14679cf0f3c5de66c50d64511d4c9461db318f810b2997","observation_id":"db783286-9f4e-47df-a5c3-66dd23963fd0","resolution":{"observed_at":"2026-08-06T15:02:26.699972Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:02:26.689243Z","title":"Bevformer: Learning bird’s-eye-view representation from multi-camera images via spatiotemporal transformers","venue":null,"work_id":"e3305c51-8b7a-4657-8552-b4d7469d37e9","year":2022},"citing_paper":{"arxiv_id":"2507.17083","last_updated":"2025-07-22T23:49:40Z","snapshot_observed_at":"2026-08-12T19:51:49.113889Z","submitted_at":"2025-07-22T23:49:40Z","title":"SDGOCC: Semantic and Depth-Guided Bird's-Eye View Transformation for 3D Multimodal Occupancy Prediction","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:26.105283Z"},"links":{"citing_paper":"/paper/2507.17083"},"observation_digest":"sha256:fc056b5eac5165b92ebc44fbb63253f277bfa2a9b2e4c28dcff29b41ed2569b2","observation_id":"9aa35d05-3e6a-4988-81b2-5a64930b5a01","resolution":{"observed_at":"2026-08-06T15:02:26.692203Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.01492","last_updated":"2023-07-04T05:55:54Z","snapshot_observed_at":"2026-08-14T23:33:23.220819Z","submitted_at":"2023-07-04T05:55:54Z","title":"FB-OCC: 3D Occupancy Prediction based on Forward-Backward View Transformation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.01492","snapshot_observed_at":"2026-08-06T15:02:26.107630Z","title":"Fb-occ: 3d occupancy prediction based on forward-backward view transformation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.17083","last_updated":"2025-07-22T23:49:40Z","snapshot_observed_at":"2026-08-12T19:51:49.113889Z","submitted_at":"2025-07-22T23:49:40Z","title":"SDGOCC: Semantic and Depth-Guided Bird's-Eye View Transformation for 3D Multimodal Occupancy Prediction","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:26.107630Z"},"links":{"cited_paper":"/paper/2307.01492","citing_paper":"/paper/2507.17083"},"observation_digest":"sha256:0c60c926a080ca1b4307811aa93835747275b039f348279e4e161c322a275f0d","observation_id":"1394cfdd-33f8-426e-b789-df4450df5866","resolution":{"observed_at":"2026-08-06T15:02:26.107630Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:02:26.681364Z","title":"Fb-bev: Bev representation from forward-backward view transformations","venue":null,"work_id":"ed8577d3-4cc4-4930-ba3b-ce1d40052e55","year":2023},"citing_paper":{"arxiv_id":"2507.17083","last_updated":"2025-07-22T23:49:40Z","snapshot_observed_at":"2026-08-12T19:51:49.113889Z","submitted_at":"2025-07-22T23:49:40Z","title":"SDGOCC: Semantic and Depth-Guided Bird's-Eye View Transformation for 3D Multimodal Occupancy Prediction","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:26.110308Z"},"links":{"citing_paper":"/paper/2507.17083"},"observation_digest":"sha256:ffc25ab70eec0290f046c54bf45f5eed571ebafba5261a7eb6f28784f62f3206","observation_id":"3f98daa5-c0d1-4a04-9ede-1ae572e925c7","resolution":{"observed_at":"2026-08-06T15:02:26.684079Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:02:26.673428Z","title":"Bevfusion: A simple and robust lidar-camera fusion framework","venue":null,"work_id":"0c3599c2-edae-455e-8b3a-b0c3607de722","year":2022},"citing_paper":{"arxiv_id":"2507.17083","last_updated":"2025-07-22T23:49:40Z","snapshot_observed_at":"2026-08-12T19:51:49.113889Z","submitted_at":"2025-07-22T23:49:40Z","title":"SDGOCC: Semantic and Depth-Guided Bird's-Eye View Transformation for 3D Multimodal Occupancy Prediction","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:26.112732Z"},"links":{"citing_paper":"/paper/2507.17083"},"observation_digest":"sha256:0d4b9cd5e7124d2081a23f60f3cc39c3fdc99646d8729548efefce55b0876cee","observation_id":"b97a40e4-ad80-455c-b7a7-a60ae7e2d748","resolution":{"observed_at":"2026-08-06T15:02:26.676154Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:02:26.115220Z","title":"Feature pyra- mid networks for object detection","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.17083","last_updated":"2025-07-22T23:49:40Z","snapshot_observed_at":"2026-08-12T19:51:49.113889Z","submitted_at":"2025-07-22T23:49:40Z","title":"SDGOCC: Semantic and Depth-Guided Bird's-Eye View Transformation for 3D Multimodal Occupancy Prediction","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:26.115220Z"},"links":{"citing_paper":"/paper/2507.17083"},"observation_digest":"sha256:3f167ae2675c8d22b5c814976c7148b6ea18636f519da8016641164bd4e7a5c0","observation_id":"a2dc1a7d-4afd-4911-81a6-ee688088bca3","resolution":{"observed_at":"2026-08-06T15:02:26.115220Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:02:26.117662Z","title":"Swin transformer: Hierarchical vision transformer using shifted windows","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.17083","last_updated":"2025-07-22T23:49:40Z","snapshot_observed_at":"2026-08-12T19:51:49.113889Z","submitted_at":"2025-07-22T23:49:40Z","title":"SDGOCC: Semantic and Depth-Guided Bird's-Eye View Transformation for 3D Multimodal Occupancy Prediction","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:26.117662Z"},"links":{"citing_paper":"/paper/2507.17083"},"observation_digest":"sha256:e78e1c83eb219b641cf0adac71976bcdcc7c802ad6c9b16f0e71335b563123b4","observation_id":"2a08f964-4591-4643-a641-b035b4e52f46","resolution":{"observed_at":"2026-08-06T15:02:26.117662Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:02:26.654892Z","title":"Bevfusion: Multi- task multi-sensor fusion with unified bird’s-eye view repre- sentation","venue":null,"work_id":"152fede0-86cc-4cff-bb2c-21533f876305","year":2023},"citing_paper":{"arxiv_id":"2507.17083","last_updated":"2025-07-22T23:49:40Z","snapshot_observed_at":"2026-08-12T19:51:49.113889Z","submitted_at":"2025-07-22T23:49:40Z","title":"SDGOCC: Semantic and Depth-Guided Bird's-Eye View Transformation for 3D Multimodal Occupancy Prediction","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:26.120215Z"},"links":{"citing_paper":"/paper/2507.17083"},"observation_digest":"sha256:e318e8850ddfc3dacc239d15b57fc280c7e174dbac56191b4ac7b68f98bcfa21","observation_id":"06ec9d29-34fb-45ed-b330-866a364465ec","resolution":{"observed_at":"2026-08-06T15:02:26.657731Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:02:26.646912Z","title":"Cotr: Compact occupancy transformer for vision-based 3d occupancy prediction","venue":null,"work_id":"0bcdf637-6004-4ed6-bc96-815dd9dff5ba","year":2024},"citing_paper":{"arxiv_id":"2507.17083","last_updated":"2025-07-22T23:49:40Z","snapshot_observed_at":"2026-08-12T19:51:49.113889Z","submitted_at":"2025-07-22T23:49:40Z","title":"SDGOCC: Semantic and Depth-Guided Bird's-Eye View Transformation for 3D Multimodal Occupancy Prediction","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:26.122499Z"},"links":{"citing_paper":"/paper/2507.17083"},"observation_digest":"sha256:8715dc0e90661282d534a572f4cddd722a862ec827f27c83cca282d61003f7a1","observation_id":"273917fa-0fd8-4e6e-bae8-a9e027331828","resolution":{"observed_at":"2026-08-06T15:02:26.649592Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.01644","last_updated":"2024-05-09T05:20:54Z","snapshot_observed_at":"2026-08-13T04:04:30.583225Z","submitted_at":"2024-03-03T23:46:06Z","title":"OccFusion: Multi-Sensor Fusion Framework for 3D Semantic Occupancy Prediction","version":4},"cited_work":{"arxiv_id":"2403.01644","doi":null,"metadata_source":"pith","pith_arxiv_id":"2403.01644","snapshot_observed_at":"2026-08-06T15:02:26.500482Z","title":"OccFusion: Multi-Sensor Fusion Framework for 3D Semantic Occupancy Prediction","venue":"cs.CV","work_id":"d18d06d3-f657-48c6-bdf0-95ff46562d7b","year":2024},"citing_paper":{"arxiv_id":"2507.17083","last_updated":"2025-07-22T23:49:40Z","snapshot_observed_at":"2026-08-12T19:51:49.113889Z","submitted_at":"2025-07-22T23:49:40Z","title":"SDGOCC: Semantic and Depth-Guided Bird's-Eye View Transformation for 3D Multimodal Occupancy Prediction","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:26.124912Z"},"links":{"cited_paper":"/paper/2403.01644","citing_paper":"/paper/2507.17083"},"observation_digest":"sha256:ea0c38f8b1d083a93d6a12c6540a4834da413b6633e8dfe2f003536d866a2c74","observation_id":"ab2088fc-de90-4cfd-9529-f75145573868","resolution":{"observed_at":"2026-08-06T15:02:26.503455Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:02:26.638299Z","title":"Occfusion: Multi-sensor fusion framework for 3d semantic occupancy prediction","venue":null,"work_id":"3edbb46d-89a5-4cac-98c4-1b685885c959","year":2024},"citing_paper":{"arxiv_id":"2507.17083","last_updated":"2025-07-22T23:49:40Z","snapshot_observed_at":"2026-08-12T19:51:49.113889Z","submitted_at":"2025-07-22T23:49:40Z","title":"SDGOCC: Semantic and Depth-Guided Bird's-Eye View Transformation for 3D Multimodal Occupancy Prediction","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:26.127624Z"},"links":{"citing_paper":"/paper/2507.17083"},"observation_digest":"sha256:bfba9d9ef935a53c7a61783d6c563dbe55111842e95ade9c9e5bcf12a7da6dc9","observation_id":"1851f30c-2a3b-47fe-ac9e-2a112deba3f3","resolution":{"observed_at":"2026-08-06T15:02:26.641085Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:02:26.630286Z","title":"Co-occ: Coupling explicit feature fusion with volume rendering regularization for multi-modal 3d semantic occupancy prediction","venue":null,"work_id":"eec7820d-de70-450e-98c9-7d8c71a0c17b","year":2024},"citing_paper":{"arxiv_id":"2507.17083","last_updated":"2025-07-22T23:49:40Z","snapshot_observed_at":"2026-08-12T19:51:49.113889Z","submitted_at":"2025-07-22T23:49:40Z","title":"SDGOCC: Semantic and Depth-Guided Bird's-Eye View Transformation for 3D Multimodal Occupancy Prediction","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:26.129954Z"},"links":{"citing_paper":"/paper/2507.17083"},"observation_digest":"sha256:9f3cc6f74b394fa8fb6b934ec82f0145765a4240931c4a039d053f1d24a851bc","observation_id":"354ac7c1-78bc-42b8-ae39-0a3378dd5cf2","resolution":{"observed_at":"2026-08-06T15:02:26.633035Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.09502","last_updated":"2024-03-04T15:16:27Z","snapshot_observed_at":"2026-08-15T14:34:45.754055Z","submitted_at":"2023-09-18T06:08:15Z","title":"RenderOcc: Vision-Centric 3D Occupancy Prediction with 2D Rendering Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.09502","snapshot_observed_at":"2026-08-06T15:02:26.132280Z","title":"Renderocc: Vision-centric 3d occupancy prediction with 2d rendering supervision","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.17083","last_updated":"2025-07-22T23:49:40Z","snapshot_observed_at":"2026-08-12T19:51:49.113889Z","submitted_at":"2025-07-22T23:49:40Z","title":"SDGOCC: Semantic and Depth-Guided Bird's-Eye View Transformation for 3D Multimodal Occupancy Prediction","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:26.132280Z"},"links":{"cited_paper":"/paper/2309.09502","citing_paper":"/paper/2507.17083"},"observation_digest":"sha256:a65286a06bc54624c95c5c50ac230611b52ff438bbe5bf7f980cc5e6cb7a4949","observation_id":"0c2d60c9-fbf3-4553-ad36-8b97eb600b0d","resolution":{"observed_at":"2026-08-06T15:02:26.132280Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09117","last_updated":"2023-06-15T13:23:57Z","snapshot_observed_at":"2026-08-14T22:26:59.755332Z","submitted_at":"2023-06-15T13:23:57Z","title":"UniOcc: Unifying Vision-Centric 3D Occupancy Prediction with Geometric and Semantic Rendering","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.09117","snapshot_observed_at":"2026-08-06T15:02:26.134927Z","title":"Uniocc: Unifying vision-centric 3d oc- cupancy prediction with geometric and semantic rendering","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.17083","last_updated":"2025-07-22T23:49:40Z","snapshot_observed_at":"2026-08-12T19:51:49.113889Z","submitted_at":"2025-07-22T23:49:40Z","title":"SDGOCC: Semantic and Depth-Guided Bird's-Eye View Transformation for 3D Multimodal Occupancy Prediction","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:26.134927Z"},"links":{"cited_paper":"/paper/2306.09117","citing_paper":"/paper/2507.17083"},"observation_digest":"sha256:e5ed60e381c60d70ed692c4d3b96ea3836b13611d7d061ae5479250710b66175","observation_id":"3339fc4f-62ce-4175-897a-28c17822c672","resolution":{"observed_at":"2026-08-06T15:02:26.134927Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:02:26.137905Z","title":"Lift, splat, shoot: Encoding images from arbitrary camera rigs by implicitly unproject- ing to 3d","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.17083","last_updated":"2025-07-22T23:49:40Z","snapshot_observed_at":"2026-08-12T19:51:49.113889Z","submitted_at":"2025-07-22T23:49:40Z","title":"SDGOCC: Semantic and Depth-Guided Bird's-Eye View Transformation for 3D Multimodal Occupancy Prediction","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:26.137905Z"},"links":{"citing_paper":"/paper/2507.17083"},"observation_digest":"sha256:b991caeb42efee797a2632eecc0d64ae3974270a75be545a2145a2afaef0f1bc","observation_id":"580549b8-db09-4fc0-b0b0-228680518bbc","resolution":{"observed_at":"2026-08-06T15:02:26.137905Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:02:26.617252Z","title":"Categorical depth distribution network for monocular 3d object detection","venue":null,"work_id":"57a1cf2a-7884-4a84-aae3-903bd9d8f032","year":2021},"citing_paper":{"arxiv_id":"2507.17083","last_updated":"2025-07-22T23:49:40Z","snapshot_observed_at":"2026-08-12T19:51:49.113889Z","submitted_at":"2025-07-22T23:49:40Z","title":"SDGOCC: Semantic and Depth-Guided Bird's-Eye View Transformation for 3D Multimodal Occupancy Prediction","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:26.140487Z"},"links":{"citing_paper":"/paper/2507.17083"},"observation_digest":"sha256:d0fc49c4e905aa84c16f7b4daed9a73b703724eddc3462c74e6bda10e11ac3cf","observation_id":"02016d2e-d014-42e0-83f1-1a2e010b85c4","resolution":{"observed_at":"2026-08-06T15:02:26.619811Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.11848","last_updated":"2025-03-13T06:23:17Z","snapshot_observed_at":"2026-08-15T06:26:12.908289Z","submitted_at":"2024-03-18T15:00:38Z","title":"GraphBEV: Towards Robust BEV Feature Alignment for Multi-Modal 3D Object Detection","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.11848","snapshot_observed_at":"2026-08-06T15:02:26.142839Z","title":"Graphbev: To- wards robust bev feature alignment for multi-modal 3d ob- ject detection","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.17083","last_updated":"2025-07-22T23:49:40Z","snapshot_observed_at":"2026-08-12T19:51:49.113889Z","submitted_at":"2025-07-22T23:49:40Z","title":"SDGOCC: Semantic and Depth-Guided Bird's-Eye View Transformation for 3D Multimodal Occupancy Prediction","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:26.142839Z"},"links":{"cited_paper":"/paper/2403.11848","citing_paper":"/paper/2507.17083"},"observation_digest":"sha256:d2dd74b2b52ce43eb7ab083ee9513819b47ca343e4dce48e3b4b8f437c9bc598","observation_id":"39ba0bab-93ba-4dc2-9ab4-f29c5eae4bd0","resolution":{"observed_at":"2026-08-06T15:02:26.142839Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:02:26.609000Z","title":"Occ3d: A large-scale 3d occupancy prediction benchmark for autonomous driving","venue":null,"work_id":"4593a7fa-3ec0-487f-ac59-457076353522","year":2024},"citing_paper":{"arxiv_id":"2507.17083","last_updated":"2025-07-22T23:49:40Z","snapshot_observed_at":"2026-08-12T19:51:49.113889Z","submitted_at":"2025-07-22T23:49:40Z","title":"SDGOCC: Semantic and Depth-Guided Bird's-Eye View Transformation for 3D Multimodal Occupancy Prediction","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:26.145408Z"},"links":{"citing_paper":"/paper/2507.17083"},"observation_digest":"sha256:2ebc1d149baad91b46aaf74f81972e3e91ea1e949f935635193c45c225dcb334","observation_id":"7681ecf1-dfc4-4c09-a80d-a64c49eac145","resolution":{"observed_at":"2026-08-06T15:02:26.611695Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.15014","last_updated":"2024-04-23T13:20:09Z","snapshot_observed_at":"2026-08-13T08:54:23.376684Z","submitted_at":"2024-04-23T13:20:09Z","title":"OccGen: Generative Multi-modal 3D Occupancy Prediction for Autonomous Driving","version":1},"cited_work":{"arxiv_id":"2404.15014","doi":null,"metadata_source":"pith","pith_arxiv_id":"2404.15014","snapshot_observed_at":"2026-08-06T15:02:26.465435Z","title":"OccGen: Generative Multi-modal 3D Occupancy Prediction for Autonomous Driving","venue":"cs.CV","work_id":"9378827b-8d6e-4f08-84a5-5db7f0f1633b","year":2024},"citing_paper":{"arxiv_id":"2507.17083","last_updated":"2025-07-22T23:49:40Z","snapshot_observed_at":"2026-08-12T19:51:49.113889Z","submitted_at":"2025-07-22T23:49:40Z","title":"SDGOCC: Semantic and Depth-Guided Bird's-Eye View Transformation for 3D Multimodal Occupancy Prediction","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:26.147823Z"},"links":{"cited_paper":"/paper/2404.15014","citing_paper":"/paper/2507.17083"},"observation_digest":"sha256:cb8448581a6d5c2ffdba1bdf06b57dfa466bcbe34305ed6767e37a87f0ce8991","observation_id":"a0c42405-fe64-423f-9591-fd432714f86f","resolution":{"observed_at":"2026-08-06T15:02:26.468675Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:02:26.601572Z","title":"Openoccupancy: A large scale benchmark for surrounding semantic occupancy perception","venue":null,"work_id":"a9202486-3159-480f-a36e-962c2a0ae347","year":2023},"citing_paper":{"arxiv_id":"2507.17083","last_updated":"2025-07-22T23:49:40Z","snapshot_observed_at":"2026-08-12T19:51:49.113889Z","submitted_at":"2025-07-22T23:49:40Z","title":"SDGOCC: Semantic and Depth-Guided Bird's-Eye View Transformation for 3D Multimodal Occupancy Prediction","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:26.150577Z"},"links":{"citing_paper":"/paper/2507.17083"},"observation_digest":"sha256:da6e71758859f3f9e1c3dd88c4d92ce73ef4247a9cc7100bf955dc1cc120605b","observation_id":"001c65b3-01d0-4285-80fd-c6ac5ed9c1c6","resolution":{"observed_at":"2026-08-06T15:02:26.604122Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:02:26.593898Z","title":"Panoocc: Unified occupancy representation for camera-based 3d panoptic segmentation","venue":null,"work_id":"4c21e43f-9283-41e8-b90d-65d8167c135d","year":2024},"citing_paper":{"arxiv_id":"2507.17083","last_updated":"2025-07-22T23:49:40Z","snapshot_observed_at":"2026-08-12T19:51:49.113889Z","submitted_at":"2025-07-22T23:49:40Z","title":"SDGOCC: Semantic and Depth-Guided Bird's-Eye View Transformation for 3D Multimodal Occupancy Prediction","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:26.153008Z"},"links":{"citing_paper":"/paper/2507.17083"},"observation_digest":"sha256:33aca40d0deaa81cc39cc224db676e896fb3ea17df7ad2a3b2f652424a4995e1","observation_id":"98a6c91c-8f93-443b-a234-dad97575d404","resolution":{"observed_at":"2026-08-06T15:02:26.596643Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2102.07064","last_updated":"2022-04-06T13:13:12Z","snapshot_observed_at":"2026-08-12T19:48:44.490943Z","submitted_at":"2021-02-14T03:52:34Z","title":"NeRF--: Neural Radiance Fields Without Known Camera Parameters","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2102.07064","snapshot_observed_at":"2026-08-06T15:02:26.155376Z","title":"Nerf–: Neural radiance fields without known camera parameters","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.17083","last_updated":"2025-07-22T23:49:40Z","snapshot_observed_at":"2026-08-12T19:51:49.113889Z","submitted_at":"2025-07-22T23:49:40Z","title":"SDGOCC: Semantic and Depth-Guided Bird's-Eye View Transformation for 3D Multimodal Occupancy Prediction","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:26.155376Z"},"links":{"cited_paper":"/paper/2102.07064","citing_paper":"/paper/2507.17083"},"observation_digest":"sha256:e880b904d7d0f53951d4838069baaded9e29a1a42176d221a7f71a2af432e95e","observation_id":"d8a67ff8-efeb-4c89-bfbc-f0e8ca34bbc1","resolution":{"observed_at":"2026-08-06T15:02:26.155376Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:02:26.585359Z","title":"Surroundocc: Multi-camera 3d occu- pancy prediction for autonomous driving","venue":null,"work_id":"239dd41f-e749-4e8e-97cd-0ac09dcd6174","year":2023},"citing_paper":{"arxiv_id":"2507.17083","last_updated":"2025-07-22T23:49:40Z","snapshot_observed_at":"2026-08-12T19:51:49.113889Z","submitted_at":"2025-07-22T23:49:40Z","title":"SDGOCC: Semantic and Depth-Guided Bird's-Eye View Transformation for 3D Multimodal Occupancy Prediction","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:26.157969Z"},"links":{"citing_paper":"/paper/2507.17083"},"observation_digest":"sha256:c6139867fb724d44fa7bbb20df7232cc9f5cc7cfba5c73b5b08d6b40eac94fca","observation_id":"c9131247-7502-4f71-84fa-c03ae8e20961","resolution":{"observed_at":"2026-08-06T15:02:26.588364Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.07746","last_updated":"2025-03-26T08:48:13Z","snapshot_observed_at":"2026-08-13T00:55:58.174751Z","submitted_at":"2024-03-12T15:28:51Z","title":"Unleashing HyDRa: Hybrid Fusion, Depth Consistency and Radar for Unified 3D Perception","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.07746","snapshot_observed_at":"2026-08-06T15:02:26.160447Z","title":"Unleashing hydra: Hybrid fusion, depth consis- tency and radar for unified 3d perception","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.17083","last_updated":"2025-07-22T23:49:40Z","snapshot_observed_at":"2026-08-12T19:51:49.113889Z","submitted_at":"2025-07-22T23:49:40Z","title":"SDGOCC: Semantic and Depth-Guided Bird's-Eye View Transformation for 3D Multimodal Occupancy Prediction","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:26.160447Z"},"links":{"cited_paper":"/paper/2403.07746","citing_paper":"/paper/2507.17083"},"observation_digest":"sha256:78a45acbb39ac24562aaf332f877b51357a9d89cb52c11e4425c9f1527e3d42b","observation_id":"9db273bc-05f2-4e8e-9412-5d1bb1838811","resolution":{"observed_at":"2026-08-06T15:02:26.160447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:02:26.577211Z","title":"Point transformer v3: Simpler faster stronger","venue":null,"work_id":"e12307a6-0a26-4eab-b49e-0e6533441c81","year":2024},"citing_paper":{"arxiv_id":"2507.17083","last_updated":"2025-07-22T23:49:40Z","snapshot_observed_at":"2026-08-12T19:51:49.113889Z","submitted_at":"2025-07-22T23:49:40Z","title":"SDGOCC: Semantic and Depth-Guided Bird's-Eye View Transformation for 3D Multimodal Occupancy Prediction","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:26.162971Z"},"links":{"citing_paper":"/paper/2507.17083"},"observation_digest":"sha256:cc39d874724e1da1d937e4e54180c69917571b95c283a5549ec8f4a3cdaadf61","observation_id":"2c6b91a8-70a4-4b77-940e-0168da57beab","resolution":{"observed_at":"2026-08-06T15:02:26.579822Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:02:26.569166Z","title":"Sparsefusion: Fusing multi-modal sparse rep- resentations for multi-sensor 3d object detection","venue":null,"work_id":"e19ad147-0588-4a15-a46e-7c3df09733c6","year":2023},"citing_paper":{"arxiv_id":"2507.17083","last_updated":"2025-07-22T23:49:40Z","snapshot_observed_at":"2026-08-12T19:51:49.113889Z","submitted_at":"2025-07-22T23:49:40Z","title":"SDGOCC: Semantic and Depth-Guided Bird's-Eye View Transformation for 3D Multimodal Occupancy Prediction","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:26.165232Z"},"links":{"citing_paper":"/paper/2507.17083"},"observation_digest":"sha256:1dc051b033166c02f0e692f322e3efe7b46ec9c7e848fa585e733a4301f4da83","observation_id":"cca32222-864b-4ca8-bf1e-4af40c14cccb","resolution":{"observed_at":"2026-08-06T15:02:26.571893Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:02:26.561010Z","title":"2dpass: 2d priors assisted semantic segmentation on lidar point clouds","venue":null,"work_id":"c6b6730e-353a-400a-b718-32fadd0ea973","year":2022},"citing_paper":{"arxiv_id":"2507.17083","last_updated":"2025-07-22T23:49:40Z","snapshot_observed_at":"2026-08-12T19:51:49.113889Z","submitted_at":"2025-07-22T23:49:40Z","title":"SDGOCC: Semantic and Depth-Guided Bird's-Eye View Transformation for 3D Multimodal Occupancy Prediction","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:26.167507Z"},"links":{"citing_paper":"/paper/2507.17083"},"observation_digest":"sha256:501afda692cdb786afd3e4e814da4538c677ca13a83e39886c477ad43b90768d","observation_id":"d070d97d-80cd-4a11-b3c0-31589c7b4c96","resolution":{"observed_at":"2026-08-06T15:02:26.563655Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2409.19972","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:02:26.434865Z","title":"Daocc: 3d ob- ject detection assisted multi-sensor fusion for 3d occupancy prediction","venue":null,"work_id":"3c88a857-a54d-460f-9443-660f3d87171b","year":2024},"citing_paper":{"arxiv_id":"2507.17083","last_updated":"2025-07-22T23:49:40Z","snapshot_observed_at":"2026-08-12T19:51:49.113889Z","submitted_at":"2025-07-22T23:49:40Z","title":"SDGOCC: Semantic and Depth-Guided Bird's-Eye View Transformation for 3D Multimodal Occupancy Prediction","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:26.169919Z"},"links":{"citing_paper":"/paper/2507.17083"},"observation_digest":"sha256:0891538f8ae958c591904220688960271de46a2f3d17f331b2863b519ca61e9d","observation_id":"d6a25de3-68ff-404c-9008-a8dfd5eefbd6","resolution":{"observed_at":"2026-08-06T15:02:26.440926Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:02:26.553055Z","title":"Is-fusion: Instance-scene collaborative fusion for multimodal 3d ob- ject detection","venue":null,"work_id":"5c6a567c-221f-4f96-98f3-6f90097c1756","year":2024},"citing_paper":{"arxiv_id":"2507.17083","last_updated":"2025-07-22T23:49:40Z","snapshot_observed_at":"2026-08-12T19:51:49.113889Z","submitted_at":"2025-07-22T23:49:40Z","title":"SDGOCC: Semantic and Depth-Guided Bird's-Eye View Transformation for 3D Multimodal Occupancy Prediction","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:26.172767Z"},"links":{"citing_paper":"/paper/2507.17083"},"observation_digest":"sha256:3c6ecd308461f56bada74174f3365f44019770c5910d638ca14e56c25a763dda","observation_id":"fccf08b9-4da8-406c-a562-d7bfd51fe424","resolution":{"observed_at":"2026-08-06T15:02:26.555711Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12058","last_updated":"2023-11-18T15:28:09Z","snapshot_observed_at":"2026-08-15T01:54:21.892037Z","submitted_at":"2023-11-18T15:28:09Z","title":"FlashOcc: Fast and Memory-Efficient Occupancy Prediction via Channel-to-Height Plugin","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.12058","snapshot_observed_at":"2026-08-06T15:02:26.175148Z","title":"Flashocc: Fast and memory-efficient occupancy prediction via channel-to-height plugin","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.17083","last_updated":"2025-07-22T23:49:40Z","snapshot_observed_at":"2026-08-12T19:51:49.113889Z","submitted_at":"2025-07-22T23:49:40Z","title":"SDGOCC: Semantic and Depth-Guided Bird's-Eye View Transformation for 3D Multimodal Occupancy Prediction","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:26.175148Z"},"links":{"cited_paper":"/paper/2311.12058","citing_paper":"/paper/2507.17083"},"observation_digest":"sha256:94ded1a24dd5db1200190eaa52385081bddcb6f06a7bf816815c05bae5435543","observation_id":"5afb2614-caf9-4676-ac63-d918772edbaa","resolution":{"observed_at":"2026-08-06T15:02:26.175148Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:02:26.544746Z","title":"Radocc: Learning cross-modality occupancy knowledge through ren- dering assisted distillation","venue":null,"work_id":"fd5c842b-737d-46b5-9185-32fb11dfaeb4","year":2024},"citing_paper":{"arxiv_id":"2507.17083","last_updated":"2025-07-22T23:49:40Z","snapshot_observed_at":"2026-08-12T19:51:49.113889Z","submitted_at":"2025-07-22T23:49:40Z","title":"SDGOCC: Semantic and Depth-Guided Bird's-Eye View Transformation for 3D Multimodal Occupancy Prediction","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:26.177772Z"},"links":{"citing_paper":"/paper/2507.17083"},"observation_digest":"sha256:2c41ed2eaed63c6f594f28521e81cad083483364fc8fbd426ffc787eded123c8","observation_id":"dec5ddd9-3931-4ea0-8e68-c96475264124","resolution":{"observed_at":"2026-08-06T15:02:26.547862Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:02:26.180349Z","title":"Occformer: Dual-path transformer for vision-based 3d semantic occu- pancy prediction","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.17083","last_updated":"2025-07-22T23:49:40Z","snapshot_observed_at":"2026-08-12T19:51:49.113889Z","submitted_at":"2025-07-22T23:49:40Z","title":"SDGOCC: Semantic and Depth-Guided Bird's-Eye View Transformation for 3D Multimodal Occupancy Prediction","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:26.180349Z"},"links":{"citing_paper":"/paper/2507.17083"},"observation_digest":"sha256:7221b10675241d26593abab61d76889f3d7b763137e6bae9477146001085eaf3","observation_id":"80e8e675-f923-41e6-9d9e-fc66b11e1c33","resolution":{"observed_at":"2026-08-06T15:02:26.180349Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:02:26.182884Z","title":"Cylindrical and asymmetrical 3d convolution networks for lidar seg- mentation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.17083","last_updated":"2025-07-22T23:49:40Z","snapshot_observed_at":"2026-08-12T19:51:49.113889Z","submitted_at":"2025-07-22T23:49:40Z","title":"SDGOCC: Semantic and Depth-Guided Bird's-Eye View Transformation for 3D Multimodal Occupancy Prediction","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T15:02:26.182884Z"},"links":{"citing_paper":"/paper/2507.17083"},"observation_digest":"sha256:c5d28fa0aba4020a47649fa62b1ad32dcb8b8160b9f51de4fc33fa9684f799be","observation_id":"74aab6b7-16cc-4638-9e25-64790cbb45f3","resolution":{"observed_at":"2026-08-06T15:02:26.182884Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.17083","last_updated":"2025-07-22T23:49:40Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-12T19:51:49.113889Z","submitted_at":"2025-07-22T23:49:40Z","title":"SDGOCC: Semantic and Depth-Guided Bird's-Eye View Transformation for 3D Multimodal Occupancy Prediction"},"reference_resolution":{"displayed":45,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":16,"verified_exact":3,"verified_fuzzy":26},"total_outbound_references":45},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 45 of 45 outbound references and 0 inbound Pith citation observations for arXiv:2507.17083."}