{"as_of":"2026-08-17T16:24:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:607a545bf0f824ad48bffcc39890c1561bda9003263802ab23eb0fb071fe78f4","coverage":[{"denominator":49,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":49,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T18:03:32.139207Z","state":"measured"},{"denominator":49,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":49,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.19188/citation-record","integrity":"/paper/2507.19188/integrity","json":"/paper/2507.19188/citation-record.json","paper":"/paper/2507.19188"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:03:31.453830Z","title":"Se- mantickitti: A dataset for semantic scene understanding of lidar sequences","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.19188","last_updated":"2025-07-25T11:57:18Z","snapshot_observed_at":"2026-08-16T18:13:37.057956Z","submitted_at":"2025-07-25T11:57:18Z","title":"VisHall3D: Monocular Semantic Scene Completion from Reconstructing the Visible Regions to Hallucinating the Invisible Regions","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T18:03:31.453830Z"},"links":{"citing_paper":"/paper/2507.19188"},"observation_digest":"sha256:4aee56693d1daa2772d4dc49520e0a0a4e1ebffd5901edd7f3d4300250607d4d","observation_id":"3fd24042-94ef-48ba-9644-8f93b7d9b22c","resolution":{"observed_at":"2026-08-15T18:03:31.453830Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:03:33.537689Z","title":"Cascade r-cnn: High quality object detection and instance segmentation.IEEE transactions on pattern analysis and machine intelligence, 43(5):1483–1498, 2019","venue":null,"work_id":"4c18fc05-e42b-4a32-8ffa-70e1d6d75fba","year":2019},"citing_paper":{"arxiv_id":"2507.19188","last_updated":"2025-07-25T11:57:18Z","snapshot_observed_at":"2026-08-16T18:13:37.057956Z","submitted_at":"2025-07-25T11:57:18Z","title":"VisHall3D: Monocular Semantic Scene Completion from Reconstructing the Visible Regions to Hallucinating the Invisible Regions","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T18:03:31.500896Z"},"links":{"citing_paper":"/paper/2507.19188"},"observation_digest":"sha256:33af2d5ad803c5ab57ac61c421fa2bfbce63546dfe5555e3a97d435e515c2684","observation_id":"5316296d-2071-4a79-a62e-df6640ca9116","resolution":{"observed_at":"2026-08-15T18:03:33.541695Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:03:33.524362Z","title":"Monoscene: Monoc- ular 3d semantic scene completion","venue":null,"work_id":"a0e52b07-ff05-4fcb-bdc3-fe83d8cfc3b5","year":2022},"citing_paper":{"arxiv_id":"2507.19188","last_updated":"2025-07-25T11:57:18Z","snapshot_observed_at":"2026-08-16T18:13:37.057956Z","submitted_at":"2025-07-25T11:57:18Z","title":"VisHall3D: Monocular Semantic Scene Completion from Reconstructing the Visible Regions to Hallucinating the Invisible Regions","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T18:03:31.539974Z"},"links":{"citing_paper":"/paper/2507.19188"},"observation_digest":"sha256:3982700d7c5a247092338d20dd865be04881d716dae246e2e97159eaaff1ebac","observation_id":"d9371193-a320-44b5-bb61-844344c6ddd3","resolution":{"observed_at":"2026-08-15T18:03:33.528840Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:03:31.546518Z","title":"End-to- end object detection with transformers","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.19188","last_updated":"2025-07-25T11:57:18Z","snapshot_observed_at":"2026-08-16T18:13:37.057956Z","submitted_at":"2025-07-25T11:57:18Z","title":"VisHall3D: Monocular Semantic Scene Completion from Reconstructing the Visible Regions to Hallucinating the Invisible Regions","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T18:03:31.546518Z"},"links":{"citing_paper":"/paper/2507.19188"},"observation_digest":"sha256:8f82d4ec6f101756d8c784b611810111939ef973baa22d25314220120f86c217","observation_id":"55482347-e13d-41bb-907d-cc803fe5ef52","resolution":{"observed_at":"2026-08-15T18:03:31.546518Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:03:33.503716Z","title":"Epro-pnp: Generalized end-to-end prob- abilistic perspective-n-points for monocular object pose es- timation","venue":null,"work_id":"7096ed0b-1ac2-416c-96c5-49dad95ab01e","year":null},"citing_paper":{"arxiv_id":"2507.19188","last_updated":"2025-07-25T11:57:18Z","snapshot_observed_at":"2026-08-16T18:13:37.057956Z","submitted_at":"2025-07-25T11:57:18Z","title":"VisHall3D: Monocular Semantic Scene Completion from Reconstructing the Visible Regions to Hallucinating the Invisible Regions","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T18:03:31.551103Z"},"links":{"citing_paper":"/paper/2507.19188"},"observation_digest":"sha256:aad823cdb0f32966e09542aaa049dd1a3c5b4fbca3f780934791cea2af9aa336","observation_id":"dadc0834-7949-4e12-b69a-267821e6dc18","resolution":{"observed_at":"2026-08-15T18:03:33.508720Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:03:33.490039Z","title":"S3cnet: A sparse semantic scene completion net- work for lidar point clouds","venue":null,"work_id":"a9f7606e-dae1-40db-8b51-19140602fc87","year":2021},"citing_paper":{"arxiv_id":"2507.19188","last_updated":"2025-07-25T11:57:18Z","snapshot_observed_at":"2026-08-16T18:13:37.057956Z","submitted_at":"2025-07-25T11:57:18Z","title":"VisHall3D: Monocular Semantic Scene Completion from Reconstructing the Visible Regions to Hallucinating the Invisible Regions","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T18:03:31.554819Z"},"links":{"citing_paper":"/paper/2507.19188"},"observation_digest":"sha256:fbabf7ddb26cd8e8df4e5f77124d76211bfa146d37c88bff23259370bde31ba6","observation_id":"088bfbd8-34b0-4b63-93f5-3b777fe962d5","resolution":{"observed_at":"2026-08-15T18:03:33.494607Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:03:31.558499Z","title":"Fast r-cnn","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.19188","last_updated":"2025-07-25T11:57:18Z","snapshot_observed_at":"2026-08-16T18:13:37.057956Z","submitted_at":"2025-07-25T11:57:18Z","title":"VisHall3D: Monocular Semantic Scene Completion from Reconstructing the Visible Regions to Hallucinating the Invisible Regions","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T18:03:31.558499Z"},"links":{"citing_paper":"/paper/2507.19188"},"observation_digest":"sha256:1ad238242910e5a7cf3a6dc9d2fd65bc0ab3d1f8fe2e53bb29d75afd456e48a5","observation_id":"117c5474-eedd-4263-9d33-884a55133418","resolution":{"observed_at":"2026-08-15T18:03:31.558499Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:03:31.562284Z","title":"Deep residual learning for image recognition","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.19188","last_updated":"2025-07-25T11:57:18Z","snapshot_observed_at":"2026-08-16T18:13:37.057956Z","submitted_at":"2025-07-25T11:57:18Z","title":"VisHall3D: Monocular Semantic Scene Completion from Reconstructing the Visible Regions to Hallucinating the Invisible Regions","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T18:03:31.562284Z"},"links":{"citing_paper":"/paper/2507.19188"},"observation_digest":"sha256:69bd0fcc63faa1a343fbb2944b39760079d579bcefe77e491d4b444a0b0d094a","observation_id":"5a354be0-fc69-4b0d-abb0-4454258fb6e7","resolution":{"observed_at":"2026-08-15T18:03:31.562284Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:03:31.566214Z","title":"Masked autoencoders are scalable vision learners","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.19188","last_updated":"2025-07-25T11:57:18Z","snapshot_observed_at":"2026-08-16T18:13:37.057956Z","submitted_at":"2025-07-25T11:57:18Z","title":"VisHall3D: Monocular Semantic Scene Completion from Reconstructing the Visible Regions to Hallucinating the Invisible Regions","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T18:03:31.566214Z"},"links":{"citing_paper":"/paper/2507.19188"},"observation_digest":"sha256:9d4aa6ec5b7fed36fd9c7d260f215ffa185cc859cdb26ff987f4b08aaf2a3bf9","observation_id":"d4d7881e-8865-4e50-a5a5-f238bc94e31a","resolution":{"observed_at":"2026-08-15T18:03:31.566214Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:03:33.388642Z","title":"Arbitrary style transfer in real-time with adaptive instance normalization","venue":null,"work_id":"1bab9013-1996-4c97-b3bf-7d70a1a1df16","year":2017},"citing_paper":{"arxiv_id":"2507.19188","last_updated":"2025-07-25T11:57:18Z","snapshot_observed_at":"2026-08-16T18:13:37.057956Z","submitted_at":"2025-07-25T11:57:18Z","title":"VisHall3D: Monocular Semantic Scene Completion from Reconstructing the Visible Regions to Hallucinating the Invisible Regions","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T18:03:31.569569Z"},"links":{"citing_paper":"/paper/2507.19188"},"observation_digest":"sha256:d52524c6a0b3eed0720408b4362549548116a57a4ede115faed20aad75d00bc9","observation_id":"290a6b74-3196-4ef6-84ac-d388c0de4c73","resolution":{"observed_at":"2026-08-15T18:03:33.423058Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:03:33.307953Z","title":"Tri-perspective view for vision- based 3d semantic occupancy prediction","venue":null,"work_id":"f885a6a6-1de8-4e5a-b557-478cdb2df1fa","year":2023},"citing_paper":{"arxiv_id":"2507.19188","last_updated":"2025-07-25T11:57:18Z","snapshot_observed_at":"2026-08-16T18:13:37.057956Z","submitted_at":"2025-07-25T11:57:18Z","title":"VisHall3D: Monocular Semantic Scene Completion from Reconstructing the Visible Regions to Hallucinating the Invisible Regions","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T18:03:31.572669Z"},"links":{"citing_paper":"/paper/2507.19188"},"observation_digest":"sha256:2ca1007a171b7dbccb679d1065f5ffc8a712fc8d0c9421461f0235790f665402","observation_id":"b9937226-3d54-45d7-9b10-7ff22319d304","resolution":{"observed_at":"2026-08-15T18:03:33.345524Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:03:33.245238Z","title":"Sym- phonize 3d semantic scene completion with contextual in- stance queries","venue":null,"work_id":"fa494fb4-b3bd-4af6-83dc-c36b5c3e7e1f","year":2024},"citing_paper":{"arxiv_id":"2507.19188","last_updated":"2025-07-25T11:57:18Z","snapshot_observed_at":"2026-08-16T18:13:37.057956Z","submitted_at":"2025-07-25T11:57:18Z","title":"VisHall3D: Monocular Semantic Scene Completion from Reconstructing the Visible Regions to Hallucinating the Invisible Regions","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T18:03:31.575812Z"},"links":{"citing_paper":"/paper/2507.19188"},"observation_digest":"sha256:79d3acb44c6062723dd28a54dc123a9b42ade87592b9bf7fafbfad45b750491f","observation_id":"6345334e-0094-441a-b6e7-c384ed271140","resolution":{"observed_at":"2026-08-15T18:03:33.248737Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.12501","last_updated":"2024-09-03T10:12:34Z","snapshot_observed_at":"2026-08-16T13:59:38.065928Z","submitted_at":"2024-04-18T20:43:33Z","title":"SPIdepth: Strengthened Pose Information for Self-supervised Monocular Depth Estimation","version":3},"cited_work":{"arxiv_id":"2404.12501","doi":null,"metadata_source":"pith","pith_arxiv_id":"2404.12501","snapshot_observed_at":"2026-08-15T18:03:32.261879Z","title":"SPIdepth: Strengthened Pose Information for Self-supervised Monocular Depth Estimation","venue":"cs.CV","work_id":"710820f2-e9c5-44d7-a6fd-a703bbe12f04","year":2024},"citing_paper":{"arxiv_id":"2507.19188","last_updated":"2025-07-25T11:57:18Z","snapshot_observed_at":"2026-08-16T18:13:37.057956Z","submitted_at":"2025-07-25T11:57:18Z","title":"VisHall3D: Monocular Semantic Scene Completion from Reconstructing the Visible Regions to Hallucinating the Invisible Regions","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T18:03:31.581096Z"},"links":{"cited_paper":"/paper/2404.12501","citing_paper":"/paper/2507.19188"},"observation_digest":"sha256:06296395c2f6a475bb90e9587a583c7fd9ab4bc4ac3842410d35426a3d0e307c","observation_id":"4ce8e6ef-c217-431d-834f-fa4d59d419a9","resolution":{"observed_at":"2026-08-15T18:03:32.268432Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.13959","last_updated":"2024-05-06T15:14:22Z","snapshot_observed_at":"2026-08-16T15:45:38.834701Z","submitted_at":"2023-03-24T12:33:44Z","title":"Bridging Stereo Geometry and BEV Representation with Reliable Mutual Interaction for Semantic Scene Completion","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.13959","snapshot_observed_at":"2026-08-15T18:03:31.584891Z","title":"Bridging stereo geometry and bev repre- sentation with reliable mutual interaction for semantic scene completion.arXiv preprint arXiv:2303.13959, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.19188","last_updated":"2025-07-25T11:57:18Z","snapshot_observed_at":"2026-08-16T18:13:37.057956Z","submitted_at":"2025-07-25T11:57:18Z","title":"VisHall3D: Monocular Semantic Scene Completion from Reconstructing the Visible Regions to Hallucinating the Invisible Regions","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T18:03:31.584891Z"},"links":{"cited_paper":"/paper/2303.13959","citing_paper":"/paper/2507.19188"},"observation_digest":"sha256:c786577b85c10fb12b8e9d1ca40ea4c94782d2dbbaab204ab12fc24b8a08412d","observation_id":"2c06876a-3c24-42ed-b03f-68a917754ad5","resolution":{"observed_at":"2026-08-15T18:03:31.584891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.02077","last_updated":"2024-11-06T05:11:24Z","snapshot_observed_at":"2026-08-16T13:37:49.846435Z","submitted_at":"2024-07-02T09:11:17Z","title":"Hierarchical Temporal Context Learning for Camera-based Semantic Scene Completion","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.02077","snapshot_observed_at":"2026-08-15T18:03:31.588648Z","title":"Hierarchical temporal context learning for camera-based semantic scene comple- tion.arXiv preprint arXiv:2407.02077, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.19188","last_updated":"2025-07-25T11:57:18Z","snapshot_observed_at":"2026-08-16T18:13:37.057956Z","submitted_at":"2025-07-25T11:57:18Z","title":"VisHall3D: Monocular Semantic Scene Completion from Reconstructing the Visible Regions to Hallucinating the Invisible Regions","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T18:03:31.588648Z"},"links":{"cited_paper":"/paper/2407.02077","citing_paper":"/paper/2507.19188"},"observation_digest":"sha256:492e7b90fd249c5bb8b21382e6905fe2f9f51968fd253fa2016910a6226b5677","observation_id":"45421922-21a0-4b3b-bcf1-7cd49da8c14f","resolution":{"observed_at":"2026-08-15T18:03:31.588648Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:03:33.233801Z","title":"Mask dino: Towards a unified transformer-based framework for object detection and segmentation","venue":null,"work_id":"464b771f-9f20-4ec7-b22b-9b4352c24f1a","year":2023},"citing_paper":{"arxiv_id":"2507.19188","last_updated":"2025-07-25T11:57:18Z","snapshot_observed_at":"2026-08-16T18:13:37.057956Z","submitted_at":"2025-07-25T11:57:18Z","title":"VisHall3D: Monocular Semantic Scene Completion from Reconstructing the Visible Regions to Hallucinating the Invisible Regions","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T18:03:31.591991Z"},"links":{"citing_paper":"/paper/2507.19188"},"observation_digest":"sha256:e19c11aa876d960fbaeb0f4eead4235a0e4f734e1a96d08288f199b2a497d611","observation_id":"2f844a04-52e8-4fa4-b180-d88ff6d6f7fb","resolution":{"observed_at":"2026-08-15T18:03:33.237575Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:03:33.219919Z","title":"Dfa3d: 3d deformable attention for 2d-to-3d feature lifting","venue":null,"work_id":"f620a973-b2da-4704-97dc-98ab0e9d2211","year":2023},"citing_paper":{"arxiv_id":"2507.19188","last_updated":"2025-07-25T11:57:18Z","snapshot_observed_at":"2026-08-16T18:13:37.057956Z","submitted_at":"2025-07-25T11:57:18Z","title":"VisHall3D: Monocular Semantic Scene Completion from Reconstructing the Visible Regions to Hallucinating the Invisible Regions","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T18:03:31.595439Z"},"links":{"citing_paper":"/paper/2507.19188"},"observation_digest":"sha256:1fda2b7c3911357a742e197eda80b317e0847e5c87b9105f1af04d0dafd608d6","observation_id":"2fbdf735-8c4d-4dda-8204-1f308535e0b2","resolution":{"observed_at":"2026-08-15T18:03:33.224904Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:03:33.207262Z","title":"Depth based semantic scene completion with position importance aware loss.IEEE Robotics and Automation Letters, 5(1):219–226, 2019","venue":null,"work_id":"ba0be8c0-d5f9-4416-bb8f-53a66f85d603","year":2019},"citing_paper":{"arxiv_id":"2507.19188","last_updated":"2025-07-25T11:57:18Z","snapshot_observed_at":"2026-08-16T18:13:37.057956Z","submitted_at":"2025-07-25T11:57:18Z","title":"VisHall3D: Monocular Semantic Scene Completion from Reconstructing the Visible Regions to Hallucinating the Invisible Regions","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T18:03:31.598910Z"},"links":{"citing_paper":"/paper/2507.19188"},"observation_digest":"sha256:401496dbf1c87d20c62d664e7bc2ea7e41813b3c1c788005872464134ffe0319","observation_id":"63c73258-2446-4fc8-a55f-81708923869c","resolution":{"observed_at":"2026-08-15T18:03:33.211621Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:03:33.195902Z","title":"Anisotropic convolutional networks for 3d semantic scene completion","venue":null,"work_id":"ff5ef0e6-1db8-4aaf-a8ca-271e51f2914e","year":2020},"citing_paper":{"arxiv_id":"2507.19188","last_updated":"2025-07-25T11:57:18Z","snapshot_observed_at":"2026-08-16T18:13:37.057956Z","submitted_at":"2025-07-25T11:57:18Z","title":"VisHall3D: Monocular Semantic Scene Completion from Reconstructing the Visible Regions to Hallucinating the Invisible Regions","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T18:03:31.602127Z"},"links":{"citing_paper":"/paper/2507.19188"},"observation_digest":"sha256:c140d78d56260ae40f0d9ef5ee5cf5fd9ef7b50fc7de909a2bf4192609788383","observation_id":"a4720678-437f-4337-9e15-321387fec12b","resolution":{"observed_at":"2026-08-15T18:03:33.199784Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:03:33.183817Z","title":"V oxformer: Sparse voxel transformer for camera- based 3d semantic scene completion","venue":null,"work_id":"043ef475-2494-4b1e-a683-fe5b234debda","year":2023},"citing_paper":{"arxiv_id":"2507.19188","last_updated":"2025-07-25T11:57:18Z","snapshot_observed_at":"2026-08-16T18:13:37.057956Z","submitted_at":"2025-07-25T11:57:18Z","title":"VisHall3D: Monocular Semantic Scene Completion from Reconstructing the Visible Regions to Hallucinating the Invisible Regions","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T18:03:31.605409Z"},"links":{"citing_paper":"/paper/2507.19188"},"observation_digest":"sha256:8ab0a28c09dfee5a6bc02c172cb427fdaad15b846e9dea828a53f250ca787ddd","observation_id":"498edc93-fea1-4919-b21e-98eb6554131f","resolution":{"observed_at":"2026-08-15T18:03:33.188409Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:03:33.118996Z","title":"Ss- cbench: A large-scale 3d semantic scene completion bench- mark for autonomous driving","venue":null,"work_id":"6ae77972-527c-4eee-b84f-7496d071e638","year":null},"citing_paper":{"arxiv_id":"2507.19188","last_updated":"2025-07-25T11:57:18Z","snapshot_observed_at":"2026-08-16T18:13:37.057956Z","submitted_at":"2025-07-25T11:57:18Z","title":"VisHall3D: Monocular Semantic Scene Completion from Reconstructing the Visible Regions to Hallucinating the Invisible Regions","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T18:03:31.609037Z"},"links":{"citing_paper":"/paper/2507.19188"},"observation_digest":"sha256:b4d2118f694ed52dbaed4c7b97ed0bc46e6d065b51f0dac313d9b2f56c7e1517","observation_id":"cc156780-ced0-45eb-87f9-c268855a91c4","resolution":{"observed_at":"2026-08-15T18:03:33.174733Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:03:32.903411Z","title":"Bevformer: Learning bird’s-eye-view representation from multi-camera images via spatiotemporal transformers","venue":null,"work_id":"f72f6a4c-0d4e-49c3-94cc-2d2d5977ccc6","year":null},"citing_paper":{"arxiv_id":"2507.19188","last_updated":"2025-07-25T11:57:18Z","snapshot_observed_at":"2026-08-16T18:13:37.057956Z","submitted_at":"2025-07-25T11:57:18Z","title":"VisHall3D: Monocular Semantic Scene Completion from Reconstructing the Visible Regions to Hallucinating the Invisible Regions","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T18:03:31.612519Z"},"links":{"citing_paper":"/paper/2507.19188"},"observation_digest":"sha256:5d1e68987e0e6d37703f992d19737ccd0bca9c8302ee4fd21e05acdfdd9d0ad3","observation_id":"d8e210f2-cefa-4c73-875b-007bec49bd41","resolution":{"observed_at":"2026-08-15T18:03:33.007002Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:03:32.842396Z","title":"Diversity matters: Fully exploiting depth clues for reliable monocular 3d object detection","venue":null,"work_id":"8a3f7b6f-4df0-4bc8-86a9-d61d2a9d58b8","year":2022},"citing_paper":{"arxiv_id":"2507.19188","last_updated":"2025-07-25T11:57:18Z","snapshot_observed_at":"2026-08-16T18:13:37.057956Z","submitted_at":"2025-07-25T11:57:18Z","title":"VisHall3D: Monocular Semantic Scene Completion from Reconstructing the Visible Regions to Hallucinating the Invisible Regions","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T18:03:31.615989Z"},"links":{"citing_paper":"/paper/2507.19188"},"observation_digest":"sha256:6c288c93324225f3b3d7068bcb7f67e99d27143116fd4932b9bedc32f0ccef50","observation_id":"fd158001-c122-4c08-9881-e95e4569d4e5","resolution":{"observed_at":"2026-08-15T18:03:32.846568Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.01492","last_updated":"2023-07-04T05:55:54Z","snapshot_observed_at":"2026-08-16T15:18:56.935168Z","submitted_at":"2023-07-04T05:55:54Z","title":"FB-OCC: 3D Occupancy Prediction based on Forward-Backward View Transformation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.01492","snapshot_observed_at":"2026-08-15T18:03:31.619484Z","title":"Fb-occ: 3d occupancy prediction based on forward-backward view transformation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.19188","last_updated":"2025-07-25T11:57:18Z","snapshot_observed_at":"2026-08-16T18:13:37.057956Z","submitted_at":"2025-07-25T11:57:18Z","title":"VisHall3D: Monocular Semantic Scene Completion from Reconstructing the Visible Regions to Hallucinating the Invisible Regions","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T18:03:31.619484Z"},"links":{"cited_paper":"/paper/2307.01492","citing_paper":"/paper/2507.19188"},"observation_digest":"sha256:61b1a0c21558959dcf0e3e34b0cac17bca32eeebfe97c14eab3b063ba0406f07","observation_id":"3a68e6fc-a8cc-4de8-a6a1-7382e9e63375","resolution":{"observed_at":"2026-08-15T18:03:31.619484Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:03:32.831704Z","title":"Kitti-360: A novel dataset and benchmarks for urban scene understanding in 2d and 3d.IEEE Transactions on Pattern Analysis and Machine Intelligence, 45(3):3292–3310, 2022","venue":null,"work_id":"82521616-f66a-4f0d-8f93-5f3e221ecc95","year":2022},"citing_paper":{"arxiv_id":"2507.19188","last_updated":"2025-07-25T11:57:18Z","snapshot_observed_at":"2026-08-16T18:13:37.057956Z","submitted_at":"2025-07-25T11:57:18Z","title":"VisHall3D: Monocular Semantic Scene Completion from Reconstructing the Visible Regions to Hallucinating the Invisible Regions","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T18:03:31.623380Z"},"links":{"citing_paper":"/paper/2507.19188"},"observation_digest":"sha256:07f355225bec0b675590f256e3c11fd382ea0ed59b432976d169b815db47c60d","observation_id":"8e701c10-cc30-4361-ae56-fc98f44bc44d","resolution":{"observed_at":"2026-08-15T18:03:32.835632Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.18140","last_updated":"2024-02-28T08:03:34Z","snapshot_observed_at":"2026-08-16T18:13:29.672838Z","submitted_at":"2024-02-28T08:03:34Z","title":"OccTransformer: Improving BEVFormer for 3D camera-only occupancy prediction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.18140","snapshot_observed_at":"2026-08-15T18:03:31.682905Z","title":"Occtransformer: Improving bev- former for 3d camera-only occupancy prediction.arXiv preprint arXiv:2402.18140, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.19188","last_updated":"2025-07-25T11:57:18Z","snapshot_observed_at":"2026-08-16T18:13:37.057956Z","submitted_at":"2025-07-25T11:57:18Z","title":"VisHall3D: Monocular Semantic Scene Completion from Reconstructing the Visible Regions to Hallucinating the Invisible Regions","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T18:03:31.682905Z"},"links":{"cited_paper":"/paper/2402.18140","citing_paper":"/paper/2507.19188"},"observation_digest":"sha256:4a132af2691cd4393506c63965cdbc82af1ac6fb4467b64b9b36127f9a6a55ce","observation_id":"23550225-e687-40c3-8b0b-d23a57a57f65","resolution":{"observed_at":"2026-08-15T18:03:31.682905Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:03:32.819463Z","title":"Autoshape: Real-time shape-aware monoc- ular 3d object detection","venue":null,"work_id":"8244aeba-a9ec-4742-8128-93f35fc02879","year":2021},"citing_paper":{"arxiv_id":"2507.19188","last_updated":"2025-07-25T11:57:18Z","snapshot_observed_at":"2026-08-16T18:13:37.057956Z","submitted_at":"2025-07-25T11:57:18Z","title":"VisHall3D: Monocular Semantic Scene Completion from Reconstructing the Visible Regions to Hallucinating the Invisible Regions","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T18:03:31.717877Z"},"links":{"citing_paper":"/paper/2507.19188"},"observation_digest":"sha256:e8e45fb412c63906f242e3fe2b0de94b1141a133c2d6a029488ab3f1efe32339","observation_id":"580cae1b-a202-4945-80a0-a77578edb8c6","resolution":{"observed_at":"2026-08-15T18:03:32.823456Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:03:32.807112Z","title":"M3dssd: Monocular 3d single stage object detector","venue":null,"work_id":"6da20312-a700-4362-a193-22a02e265fcd","year":2021},"citing_paper":{"arxiv_id":"2507.19188","last_updated":"2025-07-25T11:57:18Z","snapshot_observed_at":"2026-08-16T18:13:37.057956Z","submitted_at":"2025-07-25T11:57:18Z","title":"VisHall3D: Monocular Semantic Scene Completion from Reconstructing the Visible Regions to Hallucinating the Invisible Regions","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T18:03:31.766956Z"},"links":{"citing_paper":"/paper/2507.19188"},"observation_digest":"sha256:b745730bb39835c430acb49172b46f6a6fd8098e96566e10cbed22ab1eca6a67","observation_id":"b6adeb6f-0797-40dd-b559-2a3bb607ae3f","resolution":{"observed_at":"2026-08-15T18:03:32.811900Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13540","last_updated":"2023-02-27T06:35:03Z","snapshot_observed_at":"2026-08-16T15:52:32.847801Z","submitted_at":"2023-02-27T06:35:03Z","title":"OccDepth: A Depth-Aware Method for 3D Semantic Scene Completion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13540","snapshot_observed_at":"2026-08-15T18:03:31.837079Z","title":"Occdepth: A depth-aware method for 3d semantic scene completion","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.19188","last_updated":"2025-07-25T11:57:18Z","snapshot_observed_at":"2026-08-16T18:13:37.057956Z","submitted_at":"2025-07-25T11:57:18Z","title":"VisHall3D: Monocular Semantic Scene Completion from Reconstructing the Visible Regions to Hallucinating the Invisible Regions","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T18:03:31.837079Z"},"links":{"cited_paper":"/paper/2302.13540","citing_paper":"/paper/2507.19188"},"observation_digest":"sha256:dd15d95a28bd7ddd400d563c80c36d8877e5949393f9273a54e0249a66e5477c","observation_id":"449c183c-f8a5-4464-908c-2847680c801d","resolution":{"observed_at":"2026-08-15T18:03:31.837079Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:03:32.794285Z","title":"Lift, splat, shoot: Encoding images from arbitrary camera rigs by implicitly unproject- ing to 3d","venue":null,"work_id":"386577d1-054c-48f5-a092-839dca3813f8","year":2020},"citing_paper":{"arxiv_id":"2507.19188","last_updated":"2025-07-25T11:57:18Z","snapshot_observed_at":"2026-08-16T18:13:37.057956Z","submitted_at":"2025-07-25T11:57:18Z","title":"VisHall3D: Monocular Semantic Scene Completion from Reconstructing the Visible Regions to Hallucinating the Invisible Regions","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T18:03:31.924494Z"},"links":{"citing_paper":"/paper/2507.19188"},"observation_digest":"sha256:680fbf248285a1e86724758d7e5909adc59119a4d2368ec9be52cfdf8afdf466","observation_id":"60f16613-2c57-40e7-9f8a-7e6d5c57f39a","resolution":{"observed_at":"2026-08-15T18:03:32.798999Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:03:32.006787Z","title":"Semantic scene completion using local deep implicit functions on lidar data.IEEE transactions on pattern analysis and machine intelligence, 44(10):7205– 7218, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.19188","last_updated":"2025-07-25T11:57:18Z","snapshot_observed_at":"2026-08-16T18:13:37.057956Z","submitted_at":"2025-07-25T11:57:18Z","title":"VisHall3D: Monocular Semantic Scene Completion from Reconstructing the Visible Regions to Hallucinating the Invisible Regions","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T18:03:32.006787Z"},"links":{"citing_paper":"/paper/2507.19188"},"observation_digest":"sha256:06ce0077dd8641574dc2460b9853d14e5b94fedfae46754d175e239f2516ad4c","observation_id":"dfb7c8d6-825f-4668-9aa7-53fa65ee359b","resolution":{"observed_at":"2026-08-15T18:03:32.006787Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:03:32.776159Z","title":"Lmscnet: Lightweight multiscale 3d semantic com- pletion","venue":null,"work_id":"f519dd9a-8096-4fc8-a9ba-f3c7b0b0742d","year":2020},"citing_paper":{"arxiv_id":"2507.19188","last_updated":"2025-07-25T11:57:18Z","snapshot_observed_at":"2026-08-16T18:13:37.057956Z","submitted_at":"2025-07-25T11:57:18Z","title":"VisHall3D: Monocular Semantic Scene Completion from Reconstructing the Visible Regions to Hallucinating the Invisible Regions","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-15T18:03:32.037846Z"},"links":{"citing_paper":"/paper/2507.19188"},"observation_digest":"sha256:145576e9c29eb078bd0e24e4dddc1cba58d81f459da376c9f17f7de3b01e2df7","observation_id":"17d056ca-fadf-43fa-9951-e46a5cf58744","resolution":{"observed_at":"2026-08-15T18:03:32.780144Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:03:32.764760Z","title":"Mobilestereonet: Towards lightweight deep net- works for stereo matching","venue":null,"work_id":"5e655644-29d7-4e2f-ada4-95176894698b","year":2022},"citing_paper":{"arxiv_id":"2507.19188","last_updated":"2025-07-25T11:57:18Z","snapshot_observed_at":"2026-08-16T18:13:37.057956Z","submitted_at":"2025-07-25T11:57:18Z","title":"VisHall3D: Monocular Semantic Scene Completion from Reconstructing the Visible Regions to Hallucinating the Invisible Regions","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-15T18:03:32.074939Z"},"links":{"citing_paper":"/paper/2507.19188"},"observation_digest":"sha256:ece1539a0635493b241f0ac79eabda343b0d126fe87e492a06c6d0f2f019acf0","observation_id":"510687f7-cef2-40fc-b6bb-04392a01995f","resolution":{"observed_at":"2026-08-15T18:03:32.768509Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:03:32.753375Z","title":"Semantic scene com- pletion from a single depth image","venue":null,"work_id":"1d2cf4d4-fc3c-42d8-9919-085f89268376","year":2017},"citing_paper":{"arxiv_id":"2507.19188","last_updated":"2025-07-25T11:57:18Z","snapshot_observed_at":"2026-08-16T18:13:37.057956Z","submitted_at":"2025-07-25T11:57:18Z","title":"VisHall3D: Monocular Semantic Scene Completion from Reconstructing the Visible Regions to Hallucinating the Invisible Regions","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-15T18:03:32.078505Z"},"links":{"citing_paper":"/paper/2507.19188"},"observation_digest":"sha256:4f0d1e64cb71df8cb2b01827e85bf26a859593f8178ca03300e86dca5fcb5570","observation_id":"ea7234ba-cf01-4870-baae-9b9d11a5a52d","resolution":{"observed_at":"2026-08-15T18:03:32.757040Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:03:32.712415Z","title":"Sparse r-cnn: End-to-end ob- ject detection with learnable proposals","venue":null,"work_id":"dc3f03be-cd11-4352-8604-29bc03d053bd","year":2021},"citing_paper":{"arxiv_id":"2507.19188","last_updated":"2025-07-25T11:57:18Z","snapshot_observed_at":"2026-08-16T18:13:37.057956Z","submitted_at":"2025-07-25T11:57:18Z","title":"VisHall3D: Monocular Semantic Scene Completion from Reconstructing the Visible Regions to Hallucinating the Invisible Regions","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-15T18:03:32.082300Z"},"links":{"citing_paper":"/paper/2507.19188"},"observation_digest":"sha256:a630769d49fa88d0ae0bd1e4733b009f05f2ca9d329c2f4a357836d265a9e557","observation_id":"8b2c6904-c2f7-469c-ac76-958b3f9e6ec7","resolution":{"observed_at":"2026-08-15T18:03:32.744867Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:03:32.537270Z","title":"Not all voxels are equal: Hardness-aware semantic scene completion with self- distillation","venue":null,"work_id":"446111fe-866d-4d09-88e7-eb2e20b9cd5a","year":2024},"citing_paper":{"arxiv_id":"2507.19188","last_updated":"2025-07-25T11:57:18Z","snapshot_observed_at":"2026-08-16T18:13:37.057956Z","submitted_at":"2025-07-25T11:57:18Z","title":"VisHall3D: Monocular Semantic Scene Completion from Reconstructing the Visible Regions to Hallucinating the Invisible Regions","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-15T18:03:32.086054Z"},"links":{"citing_paper":"/paper/2507.19188"},"observation_digest":"sha256:a04e0b94f23aab1ab39f55c5f97f67c9b7390f1727fb6d5c606b2bd7891375b7","observation_id":"d7d8d1a5-7d95-42a6-9989-ae22ac63cb97","resolution":{"observed_at":"2026-08-15T18:03:32.623252Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:03:32.524142Z","title":"H2gformer: Horizontal-to-global voxel transformer for 3d semantic scene completion","venue":null,"work_id":"9e39d43a-9a83-4fd2-bfa8-dda78b38fea1","year":2024},"citing_paper":{"arxiv_id":"2507.19188","last_updated":"2025-07-25T11:57:18Z","snapshot_observed_at":"2026-08-16T18:13:37.057956Z","submitted_at":"2025-07-25T11:57:18Z","title":"VisHall3D: Monocular Semantic Scene Completion from Reconstructing the Visible Regions to Hallucinating the Invisible Regions","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-15T18:03:32.090049Z"},"links":{"citing_paper":"/paper/2507.19188"},"observation_digest":"sha256:739fa67f7b45b7cab6b204f0b0d2687152e0ca479cb5f48d9bf9799dfe6059f9","observation_id":"563bbb0e-996c-49b7-8b33-f22d088d9fac","resolution":{"observed_at":"2026-08-15T18:03:32.529078Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:03:32.511339Z","title":"Surroundocc: Multi-camera 3d occu- pancy prediction for autonomous driving","venue":null,"work_id":"ee517e0c-677f-4d69-a7eb-4601e4517cc2","year":2023},"citing_paper":{"arxiv_id":"2507.19188","last_updated":"2025-07-25T11:57:18Z","snapshot_observed_at":"2026-08-16T18:13:37.057956Z","submitted_at":"2025-07-25T11:57:18Z","title":"VisHall3D: Monocular Semantic Scene Completion from Reconstructing the Visible Regions to Hallucinating the Invisible Regions","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-15T18:03:32.093848Z"},"links":{"citing_paper":"/paper/2507.19188"},"observation_digest":"sha256:51e77b4a0ce2add8d3e81dd70912da660ee44e6f815517febbe2905575a0ff8f","observation_id":"f3c998ad-ef98-4da1-a23b-0fde0348a9a2","resolution":{"observed_at":"2026-08-15T18:03:32.515297Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:03:32.500210Z","title":"Instance-aware monocular 3d semantic scene comple- tion.IEEE Transactions on Intelligent Transportation Sys- tems, 25(7):6543–6554, 2024","venue":null,"work_id":"77f92710-e69d-4d12-817d-989c54575d47","year":2024},"citing_paper":{"arxiv_id":"2507.19188","last_updated":"2025-07-25T11:57:18Z","snapshot_observed_at":"2026-08-16T18:13:37.057956Z","submitted_at":"2025-07-25T11:57:18Z","title":"VisHall3D: Monocular Semantic Scene Completion from Reconstructing the Visible Regions to Hallucinating the Invisible Regions","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-15T18:03:32.097697Z"},"links":{"citing_paper":"/paper/2507.19188"},"observation_digest":"sha256:b43386212fb450ab9e2304bf45f1b3255c7eaa6f6ea6b3a8c90f472f12354cb9","observation_id":"c8a8642d-0d71-4cae-90c5-fd3008381272","resolution":{"observed_at":"2026-08-15T18:03:32.504086Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:03:32.489166Z","title":"Sparse single sweep lidar point cloud segmentation via learning contextual shape priors from scene completion","venue":null,"work_id":"c0cf693f-5810-460a-ad05-bb489eb2775b","year":2021},"citing_paper":{"arxiv_id":"2507.19188","last_updated":"2025-07-25T11:57:18Z","snapshot_observed_at":"2026-08-16T18:13:37.057956Z","submitted_at":"2025-07-25T11:57:18Z","title":"VisHall3D: Monocular Semantic Scene Completion from Reconstructing the Visible Regions to Hallucinating the Invisible Regions","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-15T18:03:32.100669Z"},"links":{"citing_paper":"/paper/2507.19188"},"observation_digest":"sha256:a87962d38db97a90b668b62c9316c5616272687d37e8e5af8bb925d48a7163a9","observation_id":"057b078f-2783-456c-8c60-9bdeec435e14","resolution":{"observed_at":"2026-08-15T18:03:32.492770Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.17084","last_updated":"2024-11-25T23:13:35Z","snapshot_observed_at":"2026-08-16T14:39:49.338989Z","submitted_at":"2023-11-28T01:47:51Z","title":"DepthSSC: Monocular 3D Semantic Scene Completion via Depth-Spatial Alignment and Voxel Adaptation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.17084","snapshot_observed_at":"2026-08-15T18:03:32.104420Z","title":"Depthssc: Depth- spatial alignment and dynamic voxel resolution for monoc- ular 3d semantic scene completion.arXiv preprint arXiv:2311.17084, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.19188","last_updated":"2025-07-25T11:57:18Z","snapshot_observed_at":"2026-08-16T18:13:37.057956Z","submitted_at":"2025-07-25T11:57:18Z","title":"VisHall3D: Monocular Semantic Scene Completion from Reconstructing the Visible Regions to Hallucinating the Invisible Regions","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-15T18:03:32.104420Z"},"links":{"cited_paper":"/paper/2311.17084","citing_paper":"/paper/2507.19188"},"observation_digest":"sha256:c90b1a69dfe846ae57ca59a2d136a79c2261e4d6b9d49fc6bc483f9bd5e53fc4","observation_id":"afdc7ac4-0d75-46e5-8a98-0cc42593b004","resolution":{"observed_at":"2026-08-15T18:03:32.104420Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:03:32.477686Z","title":"Ndc-scene: Boost monocular 3d semantic scene completion in normalized de- vice coordinates space","venue":null,"work_id":"ab706aec-18f5-437e-97d7-3f295b3872f5","year":2023},"citing_paper":{"arxiv_id":"2507.19188","last_updated":"2025-07-25T11:57:18Z","snapshot_observed_at":"2026-08-16T18:13:37.057956Z","submitted_at":"2025-07-25T11:57:18Z","title":"VisHall3D: Monocular Semantic Scene Completion from Reconstructing the Visible Regions to Hallucinating the Invisible Regions","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-15T18:03:32.108675Z"},"links":{"citing_paper":"/paper/2507.19188"},"observation_digest":"sha256:7f97d8e127f68882204ed3de478af5d3bace02cca42b2340f3b4917ebc4c3fdf","observation_id":"d5fcc943-dd21-4211-ac76-835e9f71d76c","resolution":{"observed_at":"2026-08-15T18:03:32.481641Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:03:32.464223Z","title":"Context and geometry aware voxel transformer for semantic scene completion","venue":null,"work_id":"3137b28d-5cb1-4e6d-8102-ff4699e07f59","year":2024},"citing_paper":{"arxiv_id":"2507.19188","last_updated":"2025-07-25T11:57:18Z","snapshot_observed_at":"2026-08-16T18:13:37.057956Z","submitted_at":"2025-07-25T11:57:18Z","title":"VisHall3D: Monocular Semantic Scene Completion from Reconstructing the Visible Regions to Hallucinating the Invisible Regions","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-15T18:03:32.112665Z"},"links":{"citing_paper":"/paper/2507.19188"},"observation_digest":"sha256:b9ab4f31525789646b70a915683650550a40d850f0d73206202059adab9f31b3","observation_id":"24fb81ba-868b-4be3-ba1b-dccd5dfdbd13","resolution":{"observed_at":"2026-08-15T18:03:32.468105Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:03:32.116204Z","title":"Monodetr: Depth- guided transformer for monocular 3d object detection","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.19188","last_updated":"2025-07-25T11:57:18Z","snapshot_observed_at":"2026-08-16T18:13:37.057956Z","submitted_at":"2025-07-25T11:57:18Z","title":"VisHall3D: Monocular Semantic Scene Completion from Reconstructing the Visible Regions to Hallucinating the Invisible Regions","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-15T18:03:32.116204Z"},"links":{"citing_paper":"/paper/2507.19188"},"observation_digest":"sha256:1da7036479ab37e4ceebbd86f61a84a74f5cdf73c3d6e4599a9f097868ab5b7b","observation_id":"23348d6e-d61a-4b72-b26a-f708df0d8f7b","resolution":{"observed_at":"2026-08-15T18:03:32.116204Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:03:32.446637Z","title":"Objects are differ- ent: Flexible monocular 3d object detection","venue":null,"work_id":"435476be-3fa6-424b-8510-1d2729d2ab00","year":2021},"citing_paper":{"arxiv_id":"2507.19188","last_updated":"2025-07-25T11:57:18Z","snapshot_observed_at":"2026-08-16T18:13:37.057956Z","submitted_at":"2025-07-25T11:57:18Z","title":"VisHall3D: Monocular Semantic Scene Completion from Reconstructing the Visible Regions to Hallucinating the Invisible Regions","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-15T18:03:32.122039Z"},"links":{"citing_paper":"/paper/2507.19188"},"observation_digest":"sha256:faa459e70c732ef392e67b1e21c625ef9229c904013cca2705a75a66e88cfa7b","observation_id":"d1691aa4-d92f-4389-8beb-0ecf1961a911","resolution":{"observed_at":"2026-08-15T18:03:32.450534Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:03:32.125757Z","title":"Occformer: Dual-path transformer for vision-based 3d semantic occu- pancy prediction","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.19188","last_updated":"2025-07-25T11:57:18Z","snapshot_observed_at":"2026-08-16T18:13:37.057956Z","submitted_at":"2025-07-25T11:57:18Z","title":"VisHall3D: Monocular Semantic Scene Completion from Reconstructing the Visible Regions to Hallucinating the Invisible Regions","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-15T18:03:32.125757Z"},"links":{"citing_paper":"/paper/2507.19188"},"observation_digest":"sha256:0ec44b89711058ed334356ddeba2e58e05d99ddbc53a4291002f40482ae64bce","observation_id":"5806ed3e-b085-406e-9d3d-32b994865e0e","resolution":{"observed_at":"2026-08-15T18:03:32.125757Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:03:32.324321Z","title":"Monoocc: Digging into monocular semantic occu- pancy prediction","venue":null,"work_id":"029f86c7-456e-4243-b98a-0a82bdac0155","year":2024},"citing_paper":{"arxiv_id":"2507.19188","last_updated":"2025-07-25T11:57:18Z","snapshot_observed_at":"2026-08-16T18:13:37.057956Z","submitted_at":"2025-07-25T11:57:18Z","title":"VisHall3D: Monocular Semantic Scene Completion from Reconstructing the Visible Regions to Hallucinating the Invisible Regions","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-15T18:03:32.130056Z"},"links":{"citing_paper":"/paper/2507.19188"},"observation_digest":"sha256:50c34389a7fc3bcdc3d310e5cae1da665e2deffe13c6c4b9da15a09fe939f0ae","observation_id":"7e336697-b38e-4946-8f45-8230c5668618","resolution":{"observed_at":"2026-08-15T18:03:32.431581Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1904.07850","last_updated":"2019-04-25T16:20:02Z","snapshot_observed_at":"2026-08-14T16:45:31.678245Z","submitted_at":"2019-04-16T17:54:26Z","title":"Objects as Points","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.07850","snapshot_observed_at":"2026-08-15T18:03:32.133540Z","title":"Ob- jects as points.arXiv preprint arXiv:1904.07850, 2019","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"2507.19188","last_updated":"2025-07-25T11:57:18Z","snapshot_observed_at":"2026-08-16T18:13:37.057956Z","submitted_at":"2025-07-25T11:57:18Z","title":"VisHall3D: Monocular Semantic Scene Completion from Reconstructing the Visible Regions to Hallucinating the Invisible Regions","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-15T18:03:32.133540Z"},"links":{"cited_paper":"/paper/1904.07850","citing_paper":"/paper/2507.19188"},"observation_digest":"sha256:577a20f308e6c3c3d17ff27612bc4c6ed576ccd73eb27af560d5b204d671d6f5","observation_id":"a1efe672-2761-41e2-994d-a98ecde66b7b","resolution":{"observed_at":"2026-08-15T18:03:32.133540Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.04159","last_updated":"2021-03-18T03:14:26Z","snapshot_observed_at":"2026-08-13T17:54:01.724774Z","submitted_at":"2020-10-08T17:59:21Z","title":"Deformable DETR: Deformable Transformers for End-to-End Object Detection","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.04159","snapshot_observed_at":"2026-08-15T18:03:32.139207Z","title":"Deformable detr: Deformable trans- formers for end-to-end object detection.arXiv preprint arXiv:2010.04159, 2020","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2507.19188","last_updated":"2025-07-25T11:57:18Z","snapshot_observed_at":"2026-08-16T18:13:37.057956Z","submitted_at":"2025-07-25T11:57:18Z","title":"VisHall3D: Monocular Semantic Scene Completion from Reconstructing the Visible Regions to Hallucinating the Invisible Regions","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-15T18:03:32.139207Z"},"links":{"cited_paper":"/paper/2010.04159","citing_paper":"/paper/2507.19188"},"observation_digest":"sha256:0fd750e282238747fbdf7b2321841e4af34f53a177641ae4f54bb61aedf2a050","observation_id":"65620872-528c-4979-99cc-e5fc9213e059","resolution":{"observed_at":"2026-08-15T18:03:32.139207Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.19188","last_updated":"2025-07-25T11:57:18Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-16T18:13:37.057956Z","submitted_at":"2025-07-25T11:57:18Z","title":"VisHall3D: Monocular Semantic Scene Completion from Reconstructing the Visible Regions to Hallucinating the Invisible Regions"},"reference_resolution":{"displayed":49,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":16,"verified_exact":1,"verified_fuzzy":32},"total_outbound_references":49},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 49 of 49 outbound references and 0 inbound Pith citation observations for arXiv:2507.19188."}