{"as_of":"2026-08-07T19:45:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:1fa135d23db8831c2a695288df892a64ba773c597527c25abc198e288200a9b6","coverage":[{"denominator":41,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":41,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T16:25:08.938621Z","state":"measured"},{"denominator":41,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":41,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.13801/citation-record","integrity":"/paper/2507.13801/integrity","json":"/paper/2507.13801/citation-record.json","paper":"/paper/2507.13801"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:25:09.491693Z","title":"Semantickitti: A dataset for semantic scene understanding of lidar sequences,","venue":null,"work_id":"7780286e-1ebb-4bba-8a9a-8213e6ccff0a","year":2019},"citing_paper":{"arxiv_id":"2507.13801","last_updated":"2025-07-18T10:24:58Z","snapshot_observed_at":"2026-08-06T16:14:05.172181Z","submitted_at":"2025-07-18T10:24:58Z","title":"One Step Closer: Creating the Future to Boost Monocular Semantic Scene Completion","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T16:25:05.932564Z"},"links":{"citing_paper":"/paper/2507.13801"},"observation_digest":"sha256:22732333d6e6ca537006eae6ddf61a45cb03eb096553fc245deee1e039311004","observation_id":"9e0ef205-5f0f-4b79-999c-e40fede37fdf","resolution":{"observed_at":"2026-08-06T16:25:09.495868Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:25:09.477747Z","title":"Sscbench: A large-scale 3d semantic scene completion benchmark for autonomous driving,","venue":null,"work_id":"0e4ab1b7-563c-47be-8d3f-af22191b2a04","year":2024},"citing_paper":{"arxiv_id":"2507.13801","last_updated":"2025-07-18T10:24:58Z","snapshot_observed_at":"2026-08-06T16:14:05.172181Z","submitted_at":"2025-07-18T10:24:58Z","title":"One Step Closer: Creating the Future to Boost Monocular Semantic Scene Completion","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T16:25:06.030124Z"},"links":{"citing_paper":"/paper/2507.13801"},"observation_digest":"sha256:0e4cb1fe575ba62d722fe39e071de0615336e1c781e055b94c4514635c7d06d1","observation_id":"3e0f2737-86e0-4692-9a3b-5a4423d1a2db","resolution":{"observed_at":"2026-08-06T16:25:09.482329Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:25:06.116771Z","title":"Kitti-360: A novel dataset and benchmarks for urban scene understanding in 2d and 3d,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.13801","last_updated":"2025-07-18T10:24:58Z","snapshot_observed_at":"2026-08-06T16:14:05.172181Z","submitted_at":"2025-07-18T10:24:58Z","title":"One Step Closer: Creating the Future to Boost Monocular Semantic Scene Completion","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T16:25:06.116771Z"},"links":{"citing_paper":"/paper/2507.13801"},"observation_digest":"sha256:22cedfc0bb79d7ba48959b8649cfb90da472d8cf947eb5574474e22052795d5f","observation_id":"5a56f0d2-eca1-4ec1-81bf-7cffc2cd5cf4","resolution":{"observed_at":"2026-08-06T16:25:06.116771Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:25:09.454284Z","title":"Semantic scene completion from a single depth image,","venue":null,"work_id":"38f2a432-2b13-4444-89ac-b22796c6f204","year":2017},"citing_paper":{"arxiv_id":"2507.13801","last_updated":"2025-07-18T10:24:58Z","snapshot_observed_at":"2026-08-06T16:14:05.172181Z","submitted_at":"2025-07-18T10:24:58Z","title":"One Step Closer: Creating the Future to Boost Monocular Semantic Scene Completion","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T16:25:06.220737Z"},"links":{"citing_paper":"/paper/2507.13801"},"observation_digest":"sha256:c6b0866c831f13656cc079fabe5efe583f0121f77d5e9bb8215767c86c63afe6","observation_id":"47d99d8d-c7bb-4bff-9405-8e741d9a0406","resolution":{"observed_at":"2026-08-06T16:25:09.458605Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:25:09.439793Z","title":"Lmscnet: Lightweight multiscale 3d semantic completion,","venue":null,"work_id":"bd984a26-f8af-4e8c-8353-bfeea1efa541","year":2020},"citing_paper":{"arxiv_id":"2507.13801","last_updated":"2025-07-18T10:24:58Z","snapshot_observed_at":"2026-08-06T16:14:05.172181Z","submitted_at":"2025-07-18T10:24:58Z","title":"One Step Closer: Creating the Future to Boost Monocular Semantic Scene Completion","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T16:25:06.321513Z"},"links":{"citing_paper":"/paper/2507.13801"},"observation_digest":"sha256:c7ce2c2360b29e824ce67287499027db359831d75244f0d19713d3f36713d882","observation_id":"304e4f16-e4ff-4b36-bbe5-8a8438414b2e","resolution":{"observed_at":"2026-08-06T16:25:09.444184Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:25:09.426222Z","title":"Sparse single sweep lidar point cloud segmentation via learning contextual shape priors from scene completion,","venue":null,"work_id":"ada45816-2af6-416e-aa80-65e07881bcb9","year":2021},"citing_paper":{"arxiv_id":"2507.13801","last_updated":"2025-07-18T10:24:58Z","snapshot_observed_at":"2026-08-06T16:14:05.172181Z","submitted_at":"2025-07-18T10:24:58Z","title":"One Step Closer: Creating the Future to Boost Monocular Semantic Scene Completion","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T16:25:06.418869Z"},"links":{"citing_paper":"/paper/2507.13801"},"observation_digest":"sha256:111b004314bc1c01365cea5c81edbb4c2ec9a2b8d89376fb73e2cab0a6e38664","observation_id":"f71bdece-a9b4-41dc-bf6e-e6ba3975ba0c","resolution":{"observed_at":"2026-08-06T16:25:09.430315Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.13959","last_updated":"2024-05-06T15:14:22Z","snapshot_observed_at":"2026-07-06T15:07:37.299096Z","submitted_at":"2023-03-24T12:33:44Z","title":"Bridging Stereo Geometry and BEV Representation with Reliable Mutual Interaction for Semantic Scene Completion","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.13959","snapshot_observed_at":"2026-08-06T16:25:06.553649Z","title":"Bridging stereo geometry and bev representation with reliable mutual interaction for semantic scene completion,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.13801","last_updated":"2025-07-18T10:24:58Z","snapshot_observed_at":"2026-08-06T16:14:05.172181Z","submitted_at":"2025-07-18T10:24:58Z","title":"One Step Closer: Creating the Future to Boost Monocular Semantic Scene Completion","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T16:25:06.553649Z"},"links":{"cited_paper":"/paper/2303.13959","citing_paper":"/paper/2507.13801"},"observation_digest":"sha256:7bb4c689ef888a201eb61ffa95a654fa17d115489c4b09df6c3e3bce9a7a3e04","observation_id":"e7496204-ba20-4f45-b62b-75212f62632b","resolution":{"observed_at":"2026-08-06T16:25:06.553649Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.02077","last_updated":"2024-11-06T05:11:24Z","snapshot_observed_at":"2026-07-06T18:40:10.103133Z","submitted_at":"2024-07-02T09:11:17Z","title":"Hierarchical Temporal Context Learning for Camera-based Semantic Scene Completion","version":4},"cited_work":{"arxiv_id":"2407.02077","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.02077","snapshot_observed_at":"2026-08-06T16:25:09.025681Z","title":"Hierarchical Temporal Context Learning for Camera-based Semantic Scene Completion","venue":"cs.CV","work_id":"35f324dd-cdcc-4de4-989e-ce1814b76cce","year":2024},"citing_paper":{"arxiv_id":"2507.13801","last_updated":"2025-07-18T10:24:58Z","snapshot_observed_at":"2026-08-06T16:14:05.172181Z","submitted_at":"2025-07-18T10:24:58Z","title":"One Step Closer: Creating the Future to Boost Monocular Semantic Scene Completion","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T16:25:06.693012Z"},"links":{"cited_paper":"/paper/2407.02077","citing_paper":"/paper/2507.13801"},"observation_digest":"sha256:af19181e1ef35dbc433d87f19fc979d01dff7e14608f56ebf1cfdd3d991ecc1e","observation_id":"2bdcee4a-7924-4b8f-b9f2-62b5a8eff7f5","resolution":{"observed_at":"2026-08-06T16:25:09.030125Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:25:06.820851Z","title":"Tri-perspective view for vision-based 3d semantic occupancy prediction,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.13801","last_updated":"2025-07-18T10:24:58Z","snapshot_observed_at":"2026-08-06T16:14:05.172181Z","submitted_at":"2025-07-18T10:24:58Z","title":"One Step Closer: Creating the Future to Boost Monocular Semantic Scene Completion","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T16:25:06.820851Z"},"links":{"citing_paper":"/paper/2507.13801"},"observation_digest":"sha256:87ab29526a53ff2c01f4aaa1eccb4e00622014e21311632b2406b0c19dc04cc3","observation_id":"1478643b-78ae-4a3c-b033-c471df660cfc","resolution":{"observed_at":"2026-08-06T16:25:06.820851Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:25:06.915204Z","title":"Monoscene: Monocular 3d semantic scene completion,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.13801","last_updated":"2025-07-18T10:24:58Z","snapshot_observed_at":"2026-08-06T16:14:05.172181Z","submitted_at":"2025-07-18T10:24:58Z","title":"One Step Closer: Creating the Future to Boost Monocular Semantic Scene Completion","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T16:25:06.915204Z"},"links":{"citing_paper":"/paper/2507.13801"},"observation_digest":"sha256:4124afbf46c8ee710a68dbb07f63c647f3df71bc0b8f6ad25d9e8f6034ed60b2","observation_id":"8eedf067-3c1c-4384-a032-033d2ed5c4e1","resolution":{"observed_at":"2026-08-06T16:25:06.915204Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:25:09.394780Z","title":"Ndc- scene: Boost monocular 3d semantic scene completion in normalized device coordinates space,","venue":null,"work_id":"e349f198-b43c-4d90-854b-fe3bdb95b922","year":2023},"citing_paper":{"arxiv_id":"2507.13801","last_updated":"2025-07-18T10:24:58Z","snapshot_observed_at":"2026-08-06T16:14:05.172181Z","submitted_at":"2025-07-18T10:24:58Z","title":"One Step Closer: Creating the Future to Boost Monocular Semantic Scene Completion","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T16:25:06.977804Z"},"links":{"citing_paper":"/paper/2507.13801"},"observation_digest":"sha256:801680d5bfc1dc3531901589bc6766393b3afc5654915e9b4738a811dca2b853","observation_id":"dbc4ac43-1153-439a-81ac-a8aa2461520f","resolution":{"observed_at":"2026-08-06T16:25:09.398640Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:25:09.381358Z","title":"Symphonize 3d semantic scene completion with contextual instance queries,","venue":null,"work_id":"c54714a7-fabc-4738-9e00-b90bb33ef5af","year":2024},"citing_paper":{"arxiv_id":"2507.13801","last_updated":"2025-07-18T10:24:58Z","snapshot_observed_at":"2026-08-06T16:14:05.172181Z","submitted_at":"2025-07-18T10:24:58Z","title":"One Step Closer: Creating the Future to Boost Monocular Semantic Scene Completion","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T16:25:07.059126Z"},"links":{"citing_paper":"/paper/2507.13801"},"observation_digest":"sha256:1f287bad956a84e990abbd4c3cb199b1c3e0897ab7e6fe60978c3425888790c1","observation_id":"a66d3407-f266-47d4-8e92-2d4af133639e","resolution":{"observed_at":"2026-08-06T16:25:09.385584Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:25:09.368110Z","title":"V oxformer: Sparse voxel transformer for camera-based 3d semantic scene completion,","venue":null,"work_id":"36fbcf3c-6681-4699-8ad5-919afe5cae6c","year":2023},"citing_paper":{"arxiv_id":"2507.13801","last_updated":"2025-07-18T10:24:58Z","snapshot_observed_at":"2026-08-06T16:14:05.172181Z","submitted_at":"2025-07-18T10:24:58Z","title":"One Step Closer: Creating the Future to Boost Monocular Semantic Scene Completion","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T16:25:07.191692Z"},"links":{"citing_paper":"/paper/2507.13801"},"observation_digest":"sha256:9d295f39168a9cb5a32744bc121c7a593fc8a7766e018a562542bae9f562ceaf","observation_id":"53f271f2-dd1b-44a6-a797-55170a542207","resolution":{"observed_at":"2026-08-06T16:25:09.372455Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:25:09.355184Z","title":"H2gformer: Horizontal-to-global voxel trans- former for 3d semantic scene completion,","venue":null,"work_id":"d55bde14-159e-44be-9335-56a7dd9bc47c","year":2024},"citing_paper":{"arxiv_id":"2507.13801","last_updated":"2025-07-18T10:24:58Z","snapshot_observed_at":"2026-08-06T16:14:05.172181Z","submitted_at":"2025-07-18T10:24:58Z","title":"One Step Closer: Creating the Future to Boost Monocular Semantic Scene Completion","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T16:25:07.247991Z"},"links":{"citing_paper":"/paper/2507.13801"},"observation_digest":"sha256:f09348a76eaea7228153470ca0688fc4a8d1f4e824da5c2bf2f271d2158bc694","observation_id":"b477e43c-2c4d-441d-926d-f8442f3d0a4d","resolution":{"observed_at":"2026-08-06T16:25:09.359077Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:25:07.337117Z","title":"Monoocc: Digging into monocular semantic occupancy prediction,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.13801","last_updated":"2025-07-18T10:24:58Z","snapshot_observed_at":"2026-08-06T16:14:05.172181Z","submitted_at":"2025-07-18T10:24:58Z","title":"One Step Closer: Creating the Future to Boost Monocular Semantic Scene Completion","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T16:25:07.337117Z"},"links":{"citing_paper":"/paper/2507.13801"},"observation_digest":"sha256:40fe0219be9f4583acf289b324a7d419d4ad762c84f071b85700df31e1e6cdcb","observation_id":"4f46b258-37a5-4979-a118-0ba0fb1b5936","resolution":{"observed_at":"2026-08-06T16:25:07.337117Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:25:09.333294Z","title":"Anisotropic convolu- tional networks for 3d semantic scene completion,","venue":null,"work_id":"12cb7acd-071b-4ca4-906e-feadd0241fb2","year":2020},"citing_paper":{"arxiv_id":"2507.13801","last_updated":"2025-07-18T10:24:58Z","snapshot_observed_at":"2026-08-06T16:14:05.172181Z","submitted_at":"2025-07-18T10:24:58Z","title":"One Step Closer: Creating the Future to Boost Monocular Semantic Scene Completion","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T16:25:07.444842Z"},"links":{"citing_paper":"/paper/2507.13801"},"observation_digest":"sha256:86a5ab513a7669dbf3731a3955a05aaedac2545fd3756e074dea4861eb7baec3","observation_id":"2300a368-de2f-48cd-abdf-59452f9a2904","resolution":{"observed_at":"2026-08-06T16:25:09.337256Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:25:09.321220Z","title":"S3cnet: A sparse semantic scene completion network for lidar point clouds,","venue":null,"work_id":"5f20ff3d-8cde-4a1c-843a-ee6624d44101","year":2021},"citing_paper":{"arxiv_id":"2507.13801","last_updated":"2025-07-18T10:24:58Z","snapshot_observed_at":"2026-08-06T16:14:05.172181Z","submitted_at":"2025-07-18T10:24:58Z","title":"One Step Closer: Creating the Future to Boost Monocular Semantic Scene Completion","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T16:25:07.557135Z"},"links":{"citing_paper":"/paper/2507.13801"},"observation_digest":"sha256:0b1d93e0024c91f2ff94d07251d576161ffb6f1e25366b044bfddb92db716245","observation_id":"f84733af-f97e-4b8c-a7a1-d9fce64c7b76","resolution":{"observed_at":"2026-08-06T16:25:09.325138Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:25:09.308037Z","title":"Bevformer: learning bird’s-eye-view representation from lidar-camera via spatiotemporal transformers,","venue":null,"work_id":"42cc23ba-1644-4da9-b886-f911e68a6b06","year":2024},"citing_paper":{"arxiv_id":"2507.13801","last_updated":"2025-07-18T10:24:58Z","snapshot_observed_at":"2026-08-06T16:14:05.172181Z","submitted_at":"2025-07-18T10:24:58Z","title":"One Step Closer: Creating the Future to Boost Monocular Semantic Scene Completion","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T16:25:07.617314Z"},"links":{"citing_paper":"/paper/2507.13801"},"observation_digest":"sha256:c35640cf5077cf1df2942ebfd882b4502823c6689480997c85dea8b8caddd915","observation_id":"0b19aad3-4f30-4dd8-a59d-e4eb697d3d72","resolution":{"observed_at":"2026-08-06T16:25:09.311935Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:25:09.295060Z","title":"Cvt-occ: Cost volume temporal fusion for 3d occupancy prediction,","venue":null,"work_id":"3ec3ed09-aca8-45ec-9f66-615bc2a3dea7","year":2024},"citing_paper":{"arxiv_id":"2507.13801","last_updated":"2025-07-18T10:24:58Z","snapshot_observed_at":"2026-08-06T16:14:05.172181Z","submitted_at":"2025-07-18T10:24:58Z","title":"One Step Closer: Creating the Future to Boost Monocular Semantic Scene Completion","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T16:25:07.694999Z"},"links":{"citing_paper":"/paper/2507.13801"},"observation_digest":"sha256:57a29e6d95b81392765fd30cbee404674f05764597e12c785781b1506cfb4906","observation_id":"aeab451d-d043-474c-842f-0ae0eeadb150","resolution":{"observed_at":"2026-08-06T16:25:09.299436Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:25:09.281741Z","title":"Not all voxels are equal: Hardness-aware semantic scene completion with self-distillation,","venue":null,"work_id":"26fae0ab-c3d6-4116-8f40-84b8fcc6d2c0","year":2024},"citing_paper":{"arxiv_id":"2507.13801","last_updated":"2025-07-18T10:24:58Z","snapshot_observed_at":"2026-08-06T16:14:05.172181Z","submitted_at":"2025-07-18T10:24:58Z","title":"One Step Closer: Creating the Future to Boost Monocular Semantic Scene Completion","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T16:25:07.819271Z"},"links":{"citing_paper":"/paper/2507.13801"},"observation_digest":"sha256:26ac052e9e575b584bce6ad2f166f6a13f8bc12a3fb4928814076646520d0cf0","observation_id":"2eeb92dc-efc1-4bad-8f31-12c3ed48f41a","resolution":{"observed_at":"2026-08-06T16:25:09.286348Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:25:09.268895Z","title":"Optimizing video prediction via video frame interpolation,","venue":null,"work_id":"e5844792-fd54-4640-ade5-3cc2c719f165","year":2022},"citing_paper":{"arxiv_id":"2507.13801","last_updated":"2025-07-18T10:24:58Z","snapshot_observed_at":"2026-08-06T16:14:05.172181Z","submitted_at":"2025-07-18T10:24:58Z","title":"One Step Closer: Creating the Future to Boost Monocular Semantic Scene Completion","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T16:25:07.871397Z"},"links":{"citing_paper":"/paper/2507.13801"},"observation_digest":"sha256:4e3c9de4f3d4ef70f70a7e263a2f67805aa995ac603956c87a39f01f6c812784","observation_id":"d01bd9e4-db5d-4bf3-8f5d-92f6289b8f06","resolution":{"observed_at":"2026-08-06T16:25:09.272974Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:25:09.254918Z","title":"A dynamic multi- scale voxel flow network for video prediction,","venue":null,"work_id":"a8366718-e7dc-48ce-8a07-50a98304771b","year":2023},"citing_paper":{"arxiv_id":"2507.13801","last_updated":"2025-07-18T10:24:58Z","snapshot_observed_at":"2026-08-06T16:14:05.172181Z","submitted_at":"2025-07-18T10:24:58Z","title":"One Step Closer: Creating the Future to Boost Monocular Semantic Scene Completion","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T16:25:07.988219Z"},"links":{"citing_paper":"/paper/2507.13801"},"observation_digest":"sha256:c774eeae25463297300cd2a98d01b33e797fb2fad8b09c40a73dca74c4918055","observation_id":"2c89f6e4-6a80-4ac7-abd1-b128d951c7cd","resolution":{"observed_at":"2026-08-06T16:25:09.259700Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:25:09.241274Z","title":"Channel attention is all you need for video frame interpolation,","venue":null,"work_id":"aaceac80-e0ad-4c86-a526-bbc58dbc009a","year":2020},"citing_paper":{"arxiv_id":"2507.13801","last_updated":"2025-07-18T10:24:58Z","snapshot_observed_at":"2026-08-06T16:14:05.172181Z","submitted_at":"2025-07-18T10:24:58Z","title":"One Step Closer: Creating the Future to Boost Monocular Semantic Scene Completion","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T16:25:08.062047Z"},"links":{"citing_paper":"/paper/2507.13801"},"observation_digest":"sha256:948a2cb5f4af0268c76381f8b56b9057c995700a88e296b9c616465b0d1df72e","observation_id":"1fe07b18-30a1-4d59-b8d1-aa99e7a6a18b","resolution":{"observed_at":"2026-08-06T16:25:09.245246Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:25:09.228312Z","title":"Video frame interpolation with transformer,","venue":null,"work_id":"42a75d1c-c2ed-4c19-9e10-8aa41ee0ff51","year":2022},"citing_paper":{"arxiv_id":"2507.13801","last_updated":"2025-07-18T10:24:58Z","snapshot_observed_at":"2026-08-06T16:14:05.172181Z","submitted_at":"2025-07-18T10:24:58Z","title":"One Step Closer: Creating the Future to Boost Monocular Semantic Scene Completion","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T16:25:08.112215Z"},"links":{"citing_paper":"/paper/2507.13801"},"observation_digest":"sha256:dbc96f62af85ab46321e3debd42b4deb3905982963b2a6b1ba04b3ae0e112b61","observation_id":"390eb626-8262-440b-9e3d-906b64ef1351","resolution":{"observed_at":"2026-08-06T16:25:09.232308Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.09303","last_updated":"2022-11-09T10:35:59Z","snapshot_observed_at":"2026-07-06T12:49:07.094216Z","submitted_at":"2022-03-17T13:08:28Z","title":"MSPred: Video Prediction at Multiple Spatio-Temporal Scales with Hierarchical Recurrent Networks","version":4},"cited_work":{"arxiv_id":"2203.09303","doi":null,"metadata_source":"pith","pith_arxiv_id":"2203.09303","snapshot_observed_at":"2026-08-06T16:25:09.002495Z","title":"MSPred: Video Prediction at Multiple Spatio-Temporal Scales with Hierarchical Recurrent Networks","venue":"cs.CV","work_id":"56512a71-e473-4426-9d07-bfd4bcf4247a","year":2022},"citing_paper":{"arxiv_id":"2507.13801","last_updated":"2025-07-18T10:24:58Z","snapshot_observed_at":"2026-08-06T16:14:05.172181Z","submitted_at":"2025-07-18T10:24:58Z","title":"One Step Closer: Creating the Future to Boost Monocular Semantic Scene Completion","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T16:25:08.192578Z"},"links":{"cited_paper":"/paper/2203.09303","citing_paper":"/paper/2507.13801"},"observation_digest":"sha256:75891b7071af6a3c2e2f305efc07c4eca4354c0df6fc69f32a0a2e0840aa4fd4","observation_id":"2d8e3293-e6d5-4f2d-aebb-7bb1c3db90e0","resolution":{"observed_at":"2026-08-06T16:25:09.009113Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:25:09.214722Z","title":"Biformer: Learning bilateral motion estimation via bilateral transformer for 4k video frame interpolation,","venue":null,"work_id":"2bdae91b-2b0b-4280-967d-b1c1eda45dfa","year":2023},"citing_paper":{"arxiv_id":"2507.13801","last_updated":"2025-07-18T10:24:58Z","snapshot_observed_at":"2026-08-06T16:14:05.172181Z","submitted_at":"2025-07-18T10:24:58Z","title":"One Step Closer: Creating the Future to Boost Monocular Semantic Scene Completion","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T16:25:08.316194Z"},"links":{"citing_paper":"/paper/2507.13801"},"observation_digest":"sha256:c1759cbfed84e22130ce84ddd801a2b2e346aca8a45608d30b4eb535eb748ed9","observation_id":"98e10096-ac9c-4b75-8534-e5bbf8f523e5","resolution":{"observed_at":"2026-08-06T16:25:09.218779Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:25:09.201361Z","title":"Stochastic latent residual video prediction,","venue":null,"work_id":"3a868019-813b-4004-aba3-b8a6dc40ff5f","year":2020},"citing_paper":{"arxiv_id":"2507.13801","last_updated":"2025-07-18T10:24:58Z","snapshot_observed_at":"2026-08-06T16:14:05.172181Z","submitted_at":"2025-07-18T10:24:58Z","title":"One Step Closer: Creating the Future to Boost Monocular Semantic Scene Completion","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T16:25:08.474135Z"},"links":{"citing_paper":"/paper/2507.13801"},"observation_digest":"sha256:8b7a5000e318c6d090bfe834e8efaaa190fab903f027740b0d809bd624a296e3","observation_id":"81887d27-5aee-4736-a3f9-2c9d57d050bc","resolution":{"observed_at":"2026-08-06T16:25:09.205350Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:25:09.187991Z","title":"Greedy hierarchical variational autoencoders for large-scale video predic- tion,","venue":null,"work_id":"e96fcf23-ea86-4b66-9794-b123edb37489","year":2021},"citing_paper":{"arxiv_id":"2507.13801","last_updated":"2025-07-18T10:24:58Z","snapshot_observed_at":"2026-08-06T16:14:05.172181Z","submitted_at":"2025-07-18T10:24:58Z","title":"One Step Closer: Creating the Future to Boost Monocular Semantic Scene Completion","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T16:25:08.665012Z"},"links":{"citing_paper":"/paper/2507.13801"},"observation_digest":"sha256:043acabf2926c34e68a48bd67722abeff2b225f2c2a3c717fcefeab466398af1","observation_id":"508fc455-a2b1-435d-8099-4d7cc65b6e5f","resolution":{"observed_at":"2026-08-06T16:25:09.191966Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:25:08.723595Z","title":"Denoising diffusion probabilistic models,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.13801","last_updated":"2025-07-18T10:24:58Z","snapshot_observed_at":"2026-08-06T16:14:05.172181Z","submitted_at":"2025-07-18T10:24:58Z","title":"One Step Closer: Creating the Future to Boost Monocular Semantic Scene Completion","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T16:25:08.723595Z"},"links":{"citing_paper":"/paper/2507.13801"},"observation_digest":"sha256:7157b6a1b0ad4f933da2049187fcd774658ab84b243a71fe741819aa0fd4efd4","observation_id":"f2d20e65-af8c-4812-8f0e-78ab6a0534b0","resolution":{"observed_at":"2026-08-06T16:25:08.723595Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:25:08.837571Z","title":"High-resolution image synthesis with latent diffusion models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.13801","last_updated":"2025-07-18T10:24:58Z","snapshot_observed_at":"2026-08-06T16:14:05.172181Z","submitted_at":"2025-07-18T10:24:58Z","title":"One Step Closer: Creating the Future to Boost Monocular Semantic Scene Completion","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T16:25:08.837571Z"},"links":{"citing_paper":"/paper/2507.13801"},"observation_digest":"sha256:43a6fe002e63e477aec76415e12f304ac546d54129d865d17f8162d9458001bc","observation_id":"835c5feb-9252-4fa7-b0ca-a3cefa28125e","resolution":{"observed_at":"2026-08-06T16:25:08.837571Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:25:09.153606Z","title":"Align your latents: High-resolution video synthe- sis with latent diffusion models,","venue":null,"work_id":"d848d3a7-e3e7-4f97-99ec-3b2495633b54","year":2023},"citing_paper":{"arxiv_id":"2507.13801","last_updated":"2025-07-18T10:24:58Z","snapshot_observed_at":"2026-08-06T16:14:05.172181Z","submitted_at":"2025-07-18T10:24:58Z","title":"One Step Closer: Creating the Future to Boost Monocular Semantic Scene Completion","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T16:25:08.896916Z"},"links":{"citing_paper":"/paper/2507.13801"},"observation_digest":"sha256:f8ec47391dcbc824a2038451f08177274acd7a093279ad03e7401d3090503ea3","observation_id":"fbeb3f95-6ba7-4166-b779-38ac242142e6","resolution":{"observed_at":"2026-08-06T16:25:09.160622Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:25:08.901046Z","title":"Surroundocc: Multi-camera 3d occupancy prediction for autonomous driving,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.13801","last_updated":"2025-07-18T10:24:58Z","snapshot_observed_at":"2026-08-06T16:14:05.172181Z","submitted_at":"2025-07-18T10:24:58Z","title":"One Step Closer: Creating the Future to Boost Monocular Semantic Scene Completion","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T16:25:08.901046Z"},"links":{"citing_paper":"/paper/2507.13801"},"observation_digest":"sha256:ecc33b23b0ab4322dcad3d95ae164cebb64788be51c9d5133cd61153f7d722de","observation_id":"c442eb49-fb8c-4e83-a434-78b243bb5416","resolution":{"observed_at":"2026-08-06T16:25:08.901046Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:25:09.129040Z","title":"Occformer: Dual-path transformer for vision-based 3d semantic occupancy prediction,","venue":null,"work_id":"bd858bb0-6306-4783-bb73-d673f4481c24","year":2023},"citing_paper":{"arxiv_id":"2507.13801","last_updated":"2025-07-18T10:24:58Z","snapshot_observed_at":"2026-08-06T16:14:05.172181Z","submitted_at":"2025-07-18T10:24:58Z","title":"One Step Closer: Creating the Future to Boost Monocular Semantic Scene Completion","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T16:25:08.905520Z"},"links":{"citing_paper":"/paper/2507.13801"},"observation_digest":"sha256:f01bb1e461d0282e99dcf6390a40ee9000b849d15bf630117819024758d8896d","observation_id":"ce253b94-2838-4da4-8cf0-d3defecceb2c","resolution":{"observed_at":"2026-08-06T16:25:09.133305Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:25:09.116154Z","title":"Instance-aware monocular 3d semantic scene completion,","venue":null,"work_id":"12667703-13b1-4dde-913a-894577f4083c","year":2024},"citing_paper":{"arxiv_id":"2507.13801","last_updated":"2025-07-18T10:24:58Z","snapshot_observed_at":"2026-08-06T16:14:05.172181Z","submitted_at":"2025-07-18T10:24:58Z","title":"One Step Closer: Creating the Future to Boost Monocular Semantic Scene Completion","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T16:25:08.909810Z"},"links":{"citing_paper":"/paper/2507.13801"},"observation_digest":"sha256:0f29d91d092e0599fe52b96fc9679da568c37030105a288c978121f009c62829","observation_id":"d2314277-fb76-4aa2-b918-1588755c7e63","resolution":{"observed_at":"2026-08-06T16:25:09.120071Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.17084","last_updated":"2024-11-25T23:13:35Z","snapshot_observed_at":"2026-07-06T16:53:58.875152Z","submitted_at":"2023-11-28T01:47:51Z","title":"DepthSSC: Monocular 3D Semantic Scene Completion via Depth-Spatial Alignment and Voxel Adaptation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.17084","snapshot_observed_at":"2026-08-06T16:25:08.913706Z","title":"Depthssc: Depth-spatial alignment and dynamic voxel resolution for monocular 3d semantic scene completion,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.13801","last_updated":"2025-07-18T10:24:58Z","snapshot_observed_at":"2026-08-06T16:14:05.172181Z","submitted_at":"2025-07-18T10:24:58Z","title":"One Step Closer: Creating the Future to Boost Monocular Semantic Scene Completion","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T16:25:08.913706Z"},"links":{"cited_paper":"/paper/2311.17084","citing_paper":"/paper/2507.13801"},"observation_digest":"sha256:2785490f2b911616c6008bf018f593764ff02552285f54deb0db71f6f5f50469","observation_id":"a5cfd230-18bb-4222-97b4-e568103c057f","resolution":{"observed_at":"2026-08-06T16:25:08.913706Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:25:09.102802Z","title":"Batch normalization: Accelerating deep network training by reducing internal covariate shift,","venue":null,"work_id":"54cb69bd-65df-4e2e-bdfb-fbffd29790f5","year":2015},"citing_paper":{"arxiv_id":"2507.13801","last_updated":"2025-07-18T10:24:58Z","snapshot_observed_at":"2026-08-06T16:14:05.172181Z","submitted_at":"2025-07-18T10:24:58Z","title":"One Step Closer: Creating the Future to Boost Monocular Semantic Scene Completion","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T16:25:08.918292Z"},"links":{"citing_paper":"/paper/2507.13801"},"observation_digest":"sha256:da2cee9df79b66165e86b24e6db317acb41a847f31e62edfc257f8e0d8a6e597","observation_id":"e9d93671-cc20-468e-b978-90c5307d3882","resolution":{"observed_at":"2026-08-06T16:25:09.106765Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:25:09.089321Z","title":"Arbitrary style transfer in real-time with adaptive instance normalization,","venue":null,"work_id":"e4b1f756-ca48-42d3-9316-ab5da93902f6","year":2017},"citing_paper":{"arxiv_id":"2507.13801","last_updated":"2025-07-18T10:24:58Z","snapshot_observed_at":"2026-08-06T16:14:05.172181Z","submitted_at":"2025-07-18T10:24:58Z","title":"One Step Closer: Creating the Future to Boost Monocular Semantic Scene Completion","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T16:25:08.922503Z"},"links":{"citing_paper":"/paper/2507.13801"},"observation_digest":"sha256:9a58f9ba3729b2d6c7a8e9fc5e5c54c38de6c25768dcfc29e8dfe04d94969c33","observation_id":"ebdbca57-617c-4ef2-9a03-83889e5622e2","resolution":{"observed_at":"2026-08-06T16:25:09.093608Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:25:09.076242Z","title":"Deepvo: Towards end-to-end visual odometry with deep recurrent convolutional neural networks,","venue":null,"work_id":"cd62919e-44e2-44d1-a139-318d3bc7765d","year":2017},"citing_paper":{"arxiv_id":"2507.13801","last_updated":"2025-07-18T10:24:58Z","snapshot_observed_at":"2026-08-06T16:14:05.172181Z","submitted_at":"2025-07-18T10:24:58Z","title":"One Step Closer: Creating the Future to Boost Monocular Semantic Scene Completion","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T16:25:08.926348Z"},"links":{"citing_paper":"/paper/2507.13801"},"observation_digest":"sha256:a34e654d65627888ac739cb13867ecccc258f9f84a1f490d5f06e4b3b1c2f2a5","observation_id":"66e20640-e86b-458d-868a-efbd004766a5","resolution":{"observed_at":"2026-08-06T16:25:09.080246Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-06T16:25:08.930474Z","title":"Decoupled weight decay regularization,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.13801","last_updated":"2025-07-18T10:24:58Z","snapshot_observed_at":"2026-08-06T16:14:05.172181Z","submitted_at":"2025-07-18T10:24:58Z","title":"One Step Closer: Creating the Future to Boost Monocular Semantic Scene Completion","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T16:25:08.930474Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2507.13801"},"observation_digest":"sha256:d50fd0d22618157c6a98b0b24e0e1052de579093db5378cfbd76d7b6bfe0146e","observation_id":"ecfa9947-5e0c-4fba-bec4-e7e99e7f8c02","resolution":{"observed_at":"2026-08-06T16:25:08.930474Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:25:08.934868Z","title":"Deep residual learning for image recognition,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.13801","last_updated":"2025-07-18T10:24:58Z","snapshot_observed_at":"2026-08-06T16:14:05.172181Z","submitted_at":"2025-07-18T10:24:58Z","title":"One Step Closer: Creating the Future to Boost Monocular Semantic Scene Completion","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T16:25:08.934868Z"},"links":{"citing_paper":"/paper/2507.13801"},"observation_digest":"sha256:012fd5192a4dddd338aec8ef3d36cdf6bb87c6452f4eab1ab71ca69507a9ac4f","observation_id":"dea03f3e-0aec-4853-8f26-4c838700f1b1","resolution":{"observed_at":"2026-08-06T16:25:08.934868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:25:09.054179Z","title":"Mask dino: Towards a unified transformer-based framework for object detection and segmentation,","venue":null,"work_id":"c877d9e9-e563-451c-b21b-f8dbc8e6614f","year":2023},"citing_paper":{"arxiv_id":"2507.13801","last_updated":"2025-07-18T10:24:58Z","snapshot_observed_at":"2026-08-06T16:14:05.172181Z","submitted_at":"2025-07-18T10:24:58Z","title":"One Step Closer: Creating the Future to Boost Monocular Semantic Scene Completion","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T16:25:08.938621Z"},"links":{"citing_paper":"/paper/2507.13801"},"observation_digest":"sha256:e67aaa7b814cfcf7a788ac37f4cff34fac28c453fe22e9b0be97970226ecbe0b","observation_id":"a990026f-c5b2-4c94-a8a9-c3e0d57925e5","resolution":{"observed_at":"2026-08-06T16:25:09.058392Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.13801","last_updated":"2025-07-18T10:24:58Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-06T16:14:05.172181Z","submitted_at":"2025-07-18T10:24:58Z","title":"One Step Closer: Creating the Future to Boost Monocular Semantic Scene Completion"},"reference_resolution":{"displayed":41,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":11,"verified_exact":2,"verified_fuzzy":28},"total_outbound_references":41},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 41 of 41 outbound references and 0 inbound Pith citation observations for arXiv:2507.13801."}