{"as_of":"2026-08-08T07:19:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ecb7113f326d2ef90f1a8f95fb98b04ef7cf7befcb966e29f328a5e843248ff6","coverage":[{"denominator":128,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T19:14:03.715451Z","state":"measured"},{"denominator":100,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":100,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.06230/citation-record","integrity":"/paper/2507.06230/integrity","json":"/paper/2507.06230/citation-record.json","paper":"/paper/2507.06230"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:13:54.484724Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.06230","last_updated":"2025-07-25T14:31:34Z","snapshot_observed_at":"2026-08-07T14:43:47.586033Z","submitted_at":"2025-07-08T17:59:50Z","title":"Feed-Forward SceneDINO for Unsupervised Semantic Scene Completion","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-06T19:13:54.484724Z"},"links":{"citing_paper":"/paper/2507.06230"},"observation_digest":"sha256:b3a1a147c042592da3efebeb8ab891b2de60fb67215af7ca122250c0a858eb7a","observation_id":"0216e32d-15b9-40a8-8b1c-37dfc73f8510","resolution":{"observed_at":"2026-08-06T19:13:54.484724Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:13:54.636069Z","title":"Self-supervised augmentation consistency for adapting semantic segmentation","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.06230","last_updated":"2025-07-25T14:31:34Z","snapshot_observed_at":"2026-08-07T14:43:47.586033Z","submitted_at":"2025-07-08T17:59:50Z","title":"Feed-Forward SceneDINO for Unsupervised Semantic Scene Completion","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-06T19:13:54.636069Z"},"links":{"citing_paper":"/paper/2507.06230"},"observation_digest":"sha256:56746cec1f46aab2bb69320c176e2adde18288b80047c550f589290e971229c1","observation_id":"cb8efee0-51de-45dd-84a1-55bb28b5c8ec","resolution":{"observed_at":"2026-08-06T19:13:54.636069Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:13:54.829626Z","title":"Self-labelling via simultaneous clustering and representation learning","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.06230","last_updated":"2025-07-25T14:31:34Z","snapshot_observed_at":"2026-08-07T14:43:47.586033Z","submitted_at":"2025-07-08T17:59:50Z","title":"Feed-Forward SceneDINO for Unsupervised Semantic Scene Completion","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-06T19:13:54.829626Z"},"links":{"citing_paper":"/paper/2507.06230"},"observation_digest":"sha256:fcf6d3254b10df7bc5ecf8739dfc82623f8f16b743c4c2b289f32f44918598eb","observation_id":"b662a3e6-d7be-46c9-97c8-db5eb4733345","resolution":{"observed_at":"2026-08-06T19:13:54.829626Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:13:54.969642Z","title":"Devon Hjelm, and William Buchwalter","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.06230","last_updated":"2025-07-25T14:31:34Z","snapshot_observed_at":"2026-08-07T14:43:47.586033Z","submitted_at":"2025-07-08T17:59:50Z","title":"Feed-Forward SceneDINO for Unsupervised Semantic Scene Completion","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-06T19:13:54.969642Z"},"links":{"citing_paper":"/paper/2507.06230"},"observation_digest":"sha256:8c1874d25b7fdb8b683ec0780ca02b6f15b2c50c2ad9c17fb703771975b34631","observation_id":"e3e4d215-e7fb-404e-ba8c-06d20466b64b","resolution":{"observed_at":"2026-08-06T19:13:54.969642Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:13:55.136168Z","title":"VICRegL : S elf-supervised learning of local visual features","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.06230","last_updated":"2025-07-25T14:31:34Z","snapshot_observed_at":"2026-08-07T14:43:47.586033Z","submitted_at":"2025-07-08T17:59:50Z","title":"Feed-Forward SceneDINO for Unsupervised Semantic Scene Completion","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-06T19:13:55.136168Z"},"links":{"citing_paper":"/paper/2507.06230"},"observation_digest":"sha256:571eac1d8453d4c58c2e201a10b4839f222ea25c0a34dd0f1db53c7d04abe6f3","observation_id":"9b3a3229-e84b-4084-9eb7-ebb214cae906","resolution":{"observed_at":"2026-08-06T19:13:55.136168Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:13:55.293996Z","title":"VICR eg: V ariance-invariance-covariance regularization for self-supervised learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.06230","last_updated":"2025-07-25T14:31:34Z","snapshot_observed_at":"2026-08-07T14:43:47.586033Z","submitted_at":"2025-07-08T17:59:50Z","title":"Feed-Forward SceneDINO for Unsupervised Semantic Scene Completion","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-06T19:13:55.293996Z"},"links":{"citing_paper":"/paper/2507.06230"},"observation_digest":"sha256:3db3df84d119d1ec5a751ac00334e52d42d97547fa3dffd5a8678df1f3cc2a7b","observation_id":"8c2bf662-d7f2-4ed9-9644-88e6fb82cea6","resolution":{"observed_at":"2026-08-06T19:13:55.293996Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:13:55.429159Z","title":"Semantic scene completion via integrating instances and scene in-the-loop","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.06230","last_updated":"2025-07-25T14:31:34Z","snapshot_observed_at":"2026-08-07T14:43:47.586033Z","submitted_at":"2025-07-08T17:59:50Z","title":"Feed-Forward SceneDINO for Unsupervised Semantic Scene Completion","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-06T19:13:55.429159Z"},"links":{"citing_paper":"/paper/2507.06230"},"observation_digest":"sha256:acca0ed21e9060ba3196bc34e34b7d0b4f154f43cfed0c4f738e8cf8fb5e287d","observation_id":"807136d1-11de-4bea-98cd-acf3f1516d79","resolution":{"observed_at":"2026-08-06T19:13:55.429159Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:13:55.666212Z","title":"G \\'o mez Rodr \\' guez, Jos \\'e M","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.06230","last_updated":"2025-07-25T14:31:34Z","snapshot_observed_at":"2026-08-07T14:43:47.586033Z","submitted_at":"2025-07-08T17:59:50Z","title":"Feed-Forward SceneDINO for Unsupervised Semantic Scene Completion","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-06T19:13:55.666212Z"},"links":{"citing_paper":"/paper/2507.06230"},"observation_digest":"sha256:11898dc627bb7e9e13dad40bc473c3b3454c592694c63fd46a88aeed2ae6a139","observation_id":"43f0c14e-abc6-4f50-9995-e4ea3aef0385","resolution":{"observed_at":"2026-08-06T19:13:55.666212Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:13:55.866101Z","title":"Monoscene: Monocular 3D semantic scene completion","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.06230","last_updated":"2025-07-25T14:31:34Z","snapshot_observed_at":"2026-08-07T14:43:47.586033Z","submitted_at":"2025-07-08T17:59:50Z","title":"Feed-Forward SceneDINO for Unsupervised Semantic Scene Completion","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-06T19:13:55.866101Z"},"links":{"citing_paper":"/paper/2507.06230"},"observation_digest":"sha256:3123cad5ac5fcfd110d2a0400d8b3335158080c2baefd4057b2676caca225c72","observation_id":"d83371b6-0c31-4577-914e-31587d285d97","resolution":{"observed_at":"2026-08-06T19:13:55.866101Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:13:56.078209Z","title":"Unsupervised learning of visual features by contrasting cluster assignments","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.06230","last_updated":"2025-07-25T14:31:34Z","snapshot_observed_at":"2026-08-07T14:43:47.586033Z","submitted_at":"2025-07-08T17:59:50Z","title":"Feed-Forward SceneDINO for Unsupervised Semantic Scene Completion","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-06T19:13:56.078209Z"},"links":{"citing_paper":"/paper/2507.06230"},"observation_digest":"sha256:d83c80d2a5a211018c49f6b151f10fe37fe9fbbc30ab315ae4ab4b6408b1b994","observation_id":"f90c0a67-e0a1-4d6d-a4f9-5e00536ca80a","resolution":{"observed_at":"2026-08-06T19:13:56.078209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:13:56.214075Z","title":"Deep clustering for unsupervised learning of visual features","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.06230","last_updated":"2025-07-25T14:31:34Z","snapshot_observed_at":"2026-08-07T14:43:47.586033Z","submitted_at":"2025-07-08T17:59:50Z","title":"Feed-Forward SceneDINO for Unsupervised Semantic Scene Completion","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-06T19:13:56.214075Z"},"links":{"citing_paper":"/paper/2507.06230"},"observation_digest":"sha256:75c3a396379694658c149df1c4e3b938f56a0b73baec5e71cbefeed1c73e0eac","observation_id":"3b70080e-bb66-4b59-a500-a35946d40bd7","resolution":{"observed_at":"2026-08-06T19:13:56.214075Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:13:56.418076Z","title":"Emerging properties in self-supervised vision transformers","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.06230","last_updated":"2025-07-25T14:31:34Z","snapshot_observed_at":"2026-08-07T14:43:47.586033Z","submitted_at":"2025-07-08T17:59:50Z","title":"Feed-Forward SceneDINO for Unsupervised Semantic Scene Completion","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-06T19:13:56.418076Z"},"links":{"citing_paper":"/paper/2507.06230"},"observation_digest":"sha256:6c09da512b67f5a84c60b841f1d5dc0376992f1861cb49bb9e2c134dac00bcbd","observation_id":"1f57f0f2-4658-46fd-9d7a-4c0e56198354","resolution":{"observed_at":"2026-08-06T19:13:56.418076Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2003.04297","last_updated":"2020-03-09T17:56:49Z","snapshot_observed_at":"2026-07-06T09:03:25.467987Z","submitted_at":"2020-03-09T17:56:49Z","title":"Improved Baselines with Momentum Contrastive Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2003.04297","snapshot_observed_at":"2026-08-06T19:13:56.578924Z","title":"Improved baselines with momentum contrastive learning","venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2507.06230","last_updated":"2025-07-25T14:31:34Z","snapshot_observed_at":"2026-08-07T14:43:47.586033Z","submitted_at":"2025-07-08T17:59:50Z","title":"Feed-Forward SceneDINO for Unsupervised Semantic Scene Completion","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-06T19:13:56.578924Z"},"links":{"cited_paper":"/paper/2003.04297","citing_paper":"/paper/2507.06230"},"observation_digest":"sha256:99be4a873aa4f1010add6440bf127abf3b9d01f5d96c32a097cddf0837623aea","observation_id":"2c37c8ed-4768-4058-a649-e4d304f0524f","resolution":{"observed_at":"2026-08-06T19:13:56.578924Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:13:56.716463Z","title":"3d sketch-aware semantic scene completion via semi-supervised structure prior","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.06230","last_updated":"2025-07-25T14:31:34Z","snapshot_observed_at":"2026-08-07T14:43:47.586033Z","submitted_at":"2025-07-08T17:59:50Z","title":"Feed-Forward SceneDINO for Unsupervised Semantic Scene Completion","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-06T19:13:56.716463Z"},"links":{"citing_paper":"/paper/2507.06230"},"observation_digest":"sha256:8bea5642ad8b05ee13f7258f33b2bdcb087f399cf742e34d3fa7108aebf4b4c3","observation_id":"371838e7-016a-4648-866a-921e21322775","resolution":{"observed_at":"2026-08-06T19:13:56.716463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:13:56.986279Z","title":"An empirical study of training self-supervised vision transformers","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.06230","last_updated":"2025-07-25T14:31:34Z","snapshot_observed_at":"2026-08-07T14:43:47.586033Z","submitted_at":"2025-07-08T17:59:50Z","title":"Feed-Forward SceneDINO for Unsupervised Semantic Scene Completion","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-06T19:13:56.986279Z"},"links":{"citing_paper":"/paper/2507.06230"},"observation_digest":"sha256:e853435c1900944219a6711a44ef5db8709599a77d8a97151b73d384ea61d56c","observation_id":"b5e888e6-69f0-4378-9535-586c4712b17a","resolution":{"observed_at":"2026-08-06T19:13:56.986279Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:13:57.157847Z","title":"MVSplat360 : F eed-forward 360 scene synthesis from sparse views","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.06230","last_updated":"2025-07-25T14:31:34Z","snapshot_observed_at":"2026-08-07T14:43:47.586033Z","submitted_at":"2025-07-08T17:59:50Z","title":"Feed-Forward SceneDINO for Unsupervised Semantic Scene Completion","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-06T19:13:57.157847Z"},"links":{"citing_paper":"/paper/2507.06230"},"observation_digest":"sha256:910047c077954ec24b5081a5bda38bc6b6024d600c720dec2eb1023ca3e61bf7","observation_id":"56ec4456-4b38-47b6-9f00-e6a2be4fd58d","resolution":{"observed_at":"2026-08-06T19:13:57.157847Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:13:57.347787Z","title":"S3CNet : A sparse semantic scene completion network for LiDAR point clouds","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.06230","last_updated":"2025-07-25T14:31:34Z","snapshot_observed_at":"2026-08-07T14:43:47.586033Z","submitted_at":"2025-07-08T17:59:50Z","title":"Feed-Forward SceneDINO for Unsupervised Semantic Scene Completion","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-06T19:13:57.347787Z"},"links":{"citing_paper":"/paper/2507.06230"},"observation_digest":"sha256:558d17f97baccad210a54c0a63018d525347321bfe44b58a07dcc72e239caa95","observation_id":"920aa8cb-bd61-4e85-9048-8fa368ea12c0","resolution":{"observed_at":"2026-08-06T19:13:57.347787Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:13:57.495631Z","title":"Pi C I E : U nsupervised semantic segmentation using invariance and equivariance in clustering","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.06230","last_updated":"2025-07-25T14:31:34Z","snapshot_observed_at":"2026-08-07T14:43:47.586033Z","submitted_at":"2025-07-08T17:59:50Z","title":"Feed-Forward SceneDINO for Unsupervised Semantic Scene Completion","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-06T19:13:57.495631Z"},"links":{"citing_paper":"/paper/2507.06230"},"observation_digest":"sha256:9f6b6258f9bf2101358af4f588305298b77e1b785839546b8d98e8794481207b","observation_id":"10286872-b6ec-407a-925a-c68bd982f727","resolution":{"observed_at":"2026-08-06T19:13:57.495631Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:13:57.634714Z","title":"3D U-Net : L earning dense volumetric segmentation from sparse annotation","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.06230","last_updated":"2025-07-25T14:31:34Z","snapshot_observed_at":"2026-08-07T14:43:47.586033Z","submitted_at":"2025-07-08T17:59:50Z","title":"Feed-Forward SceneDINO for Unsupervised Semantic Scene Completion","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-06T19:13:57.634714Z"},"links":{"citing_paper":"/paper/2507.06230"},"observation_digest":"sha256:fc231138c476cc4fe28332f67c0353886615bffa88ba523ebfbd75182984a794","observation_id":"31f70fdc-4941-4648-aa24-5e8d4fa1579b","resolution":{"observed_at":"2026-08-06T19:13:57.634714Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:13:57.765184Z","title":"The Cityscapes dataset for semantic urban scene understanding","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.06230","last_updated":"2025-07-25T14:31:34Z","snapshot_observed_at":"2026-08-07T14:43:47.586033Z","submitted_at":"2025-07-08T17:59:50Z","title":"Feed-Forward SceneDINO for Unsupervised Semantic Scene Completion","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-06T19:13:57.765184Z"},"links":{"citing_paper":"/paper/2507.06230"},"observation_digest":"sha256:272387716b42dc90eddc377ecf0452ce41956ac08090a7ba81158ed1a01e7f1b","observation_id":"f87af9eb-c482-42e2-bfea-0232ed068249","resolution":{"observed_at":"2026-08-06T19:13:57.765184Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.08769","last_updated":"2025-06-30T10:48:00Z","snapshot_observed_at":"2026-08-07T23:42:04.302844Z","submitted_at":"2025-02-12T20:17:10Z","title":"Cluster and Predict Latent Patches for Improved Masked Image Modeling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.08769","snapshot_observed_at":"2026-08-06T19:13:57.887170Z","title":"Cluster and predict latent patches for improved masked image modeling","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.06230","last_updated":"2025-07-25T14:31:34Z","snapshot_observed_at":"2026-08-07T14:43:47.586033Z","submitted_at":"2025-07-08T17:59:50Z","title":"Feed-Forward SceneDINO for Unsupervised Semantic Scene Completion","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-06T19:13:57.887170Z"},"links":{"cited_paper":"/paper/2502.08769","citing_paper":"/paper/2507.06230"},"observation_digest":"sha256:27d87c4138c03a1f6b595a1556d8e79e3575ec15c403dded4c1b4c8dde698cce","observation_id":"c4e2b4b3-0965-4f08-9eee-0052b9bee9ca","resolution":{"observed_at":"2026-08-06T19:13:57.887170Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:13:57.995077Z","title":"ImageNet : A large-scale hierarchical image database","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2507.06230","last_updated":"2025-07-25T14:31:34Z","snapshot_observed_at":"2026-08-07T14:43:47.586033Z","submitted_at":"2025-07-08T17:59:50Z","title":"Feed-Forward SceneDINO for Unsupervised Semantic Scene Completion","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-06T19:13:57.995077Z"},"links":{"citing_paper":"/paper/2507.06230"},"observation_digest":"sha256:865188e85678dfbd1bdde3b23b7a8a6804c4210caf4cf279cc517a0aa1f8be28","observation_id":"2043c1f1-5f81-4e1d-8dec-8a3b0571b4d9","resolution":{"observed_at":"2026-08-06T19:13:57.995077Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:13:58.119350Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2507.06230","last_updated":"2025-07-25T14:31:34Z","snapshot_observed_at":"2026-08-07T14:43:47.586033Z","submitted_at":"2025-07-08T17:59:50Z","title":"Feed-Forward SceneDINO for Unsupervised Semantic Scene Completion","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-06T19:13:58.119350Z"},"links":{"citing_paper":"/paper/2507.06230"},"observation_digest":"sha256:ea5d59e0381cdae472b2da8bea98783e604c38365e468d429924bb8fcca215e2","observation_id":"120c34d2-ed32-4cb9-bb07-40c60463d830","resolution":{"observed_at":"2026-08-06T19:13:58.119350Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:13:58.215786Z","title":"An image is worth 16 16 words: T ransformers for image recognition at scale","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.06230","last_updated":"2025-07-25T14:31:34Z","snapshot_observed_at":"2026-08-07T14:43:47.586033Z","submitted_at":"2025-07-08T17:59:50Z","title":"Feed-Forward SceneDINO for Unsupervised Semantic Scene Completion","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-06T19:13:58.215786Z"},"links":{"citing_paper":"/paper/2507.06230"},"observation_digest":"sha256:2e9a7fbfa228f7f5e3b8899663de7be48715c17bb6685ed0b5e6e8ebd1869f4f","observation_id":"89cc8794-efc0-4de0-b4ab-6d62b96fe679","resolution":{"observed_at":"2026-08-06T19:13:58.215786Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:13:58.286631Z","title":"Hospedales","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.06230","last_updated":"2025-07-25T14:31:34Z","snapshot_observed_at":"2026-08-07T14:43:47.586033Z","submitted_at":"2025-07-08T17:59:50Z","title":"Feed-Forward SceneDINO for Unsupervised Semantic Scene Completion","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-06T19:13:58.286631Z"},"links":{"citing_paper":"/paper/2507.06230"},"observation_digest":"sha256:e6de7efd489ec3f0ced3691b118f8f9a565739aac6ef5084a8664d9ade50351b","observation_id":"4741b0ad-a796-4a9a-b551-297a7d055a24","resolution":{"observed_at":"2026-08-06T19:13:58.286631Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:13:58.387130Z","title":"Brandt, Axel Feldmann, Zhoutong Zhang, and William T","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.06230","last_updated":"2025-07-25T14:31:34Z","snapshot_observed_at":"2026-08-07T14:43:47.586033Z","submitted_at":"2025-07-08T17:59:50Z","title":"Feed-Forward SceneDINO for Unsupervised Semantic Scene Completion","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-06T19:13:58.387130Z"},"links":{"citing_paper":"/paper/2507.06230"},"observation_digest":"sha256:732b56d2898512ca8c933871eee4ce6059d99aa5035c35f78750c446db918890","observation_id":"5616fa0a-bd4f-4f52-ac89-b1de9a493464","resolution":{"observed_at":"2026-08-06T19:13:58.387130Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:13:58.504552Z","title":"Vision meets robotics: T he KITTI dataset","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2507.06230","last_updated":"2025-07-25T14:31:34Z","snapshot_observed_at":"2026-08-07T14:43:47.586033Z","submitted_at":"2025-07-08T17:59:50Z","title":"Feed-Forward SceneDINO for Unsupervised Semantic Scene Completion","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-06T19:13:58.504552Z"},"links":{"citing_paper":"/paper/2507.06230"},"observation_digest":"sha256:4f817d0f04c1d1d744f2e684d083335d269590ba12fda9ea497092a75dc1922d","observation_id":"dcc95275-27c8-4bc3-96f9-9c4489d862f0","resolution":{"observed_at":"2026-08-06T19:13:58.504552Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:13:58.643911Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.06230","last_updated":"2025-07-25T14:31:34Z","snapshot_observed_at":"2026-08-07T14:43:47.586033Z","submitted_at":"2025-07-08T17:59:50Z","title":"Feed-Forward SceneDINO for Unsupervised Semantic Scene Completion","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-06T19:13:58.643911Z"},"links":{"citing_paper":"/paper/2507.06230"},"observation_digest":"sha256:89bc92ca95cc4a1d27443e4292df9d6299567637e94f77d1c2903c2dc3c353d8","observation_id":"d442769d-b7b3-4c41-9558-422d7eedd6e0","resolution":{"observed_at":"2026-08-06T19:13:58.643911Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:13:58.770779Z","title":"Richemond, Elena Buchatskaya, Carl Doersch, Bernardo Avila Pires, et al","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.06230","last_updated":"2025-07-25T14:31:34Z","snapshot_observed_at":"2026-08-07T14:43:47.586033Z","submitted_at":"2025-07-08T17:59:50Z","title":"Feed-Forward SceneDINO for Unsupervised Semantic Scene Completion","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-06T19:13:58.770779Z"},"links":{"citing_paper":"/paper/2507.06230"},"observation_digest":"sha256:258aad7dd0b1471f55750f0955df081b97752f6e3328700128d73a3aec41fc2f","observation_id":"276ffbee-5b10-4c17-aef3-3a0494c28241","resolution":{"observed_at":"2026-08-06T19:13:58.770779Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:13:58.849762Z","title":"Siamese Masked Autoencoders","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.06230","last_updated":"2025-07-25T14:31:34Z","snapshot_observed_at":"2026-08-07T14:43:47.586033Z","submitted_at":"2025-07-08T17:59:50Z","title":"Feed-Forward SceneDINO for Unsupervised Semantic Scene Completion","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-06T19:13:58.849762Z"},"links":{"citing_paper":"/paper/2507.06230"},"observation_digest":"sha256:327da667b010562859853658370abb75a8c7fe7da9055be4652af5d438761870","observation_id":"2c90ba19-63e6-4c91-a714-e2f7fb9b3a92","resolution":{"observed_at":"2026-08-06T19:13:58.849762Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:13:58.963029Z","title":"Semantic abstraction: O pen-world 3D scene understanding from 2D vision-language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.06230","last_updated":"2025-07-25T14:31:34Z","snapshot_observed_at":"2026-08-07T14:43:47.586033Z","submitted_at":"2025-07-08T17:59:50Z","title":"Feed-Forward SceneDINO for Unsupervised Semantic Scene Completion","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-06T19:13:58.963029Z"},"links":{"citing_paper":"/paper/2507.06230"},"observation_digest":"sha256:c778a8c484c1637b4d0b32cc72704f780340b36aa80d2859ee33d0476d772a2c","observation_id":"63d95bdb-7ad8-4006-9f10-540e76059b80","resolution":{"observed_at":"2026-08-06T19:13:58.963029Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:13:59.085443Z","title":"Boosting unsupervised semantic segmentation with principal mask proposals","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.06230","last_updated":"2025-07-25T14:31:34Z","snapshot_observed_at":"2026-08-07T14:43:47.586033Z","submitted_at":"2025-07-08T17:59:50Z","title":"Feed-Forward SceneDINO for Unsupervised Semantic Scene Completion","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-06T19:13:59.085443Z"},"links":{"citing_paper":"/paper/2507.06230"},"observation_digest":"sha256:a6eeae86412ea9f7c62ed04b1b213148ba6a9652ed3e68157b457854bb437d0a","observation_id":"71d8949e-84a7-4b29-b28a-75867cb7633b","resolution":{"observed_at":"2026-08-06T19:13:59.085443Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:13:59.187729Z","title":"Scene-centric unsupervised panoptic segmentation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.06230","last_updated":"2025-07-25T14:31:34Z","snapshot_observed_at":"2026-08-07T14:43:47.586033Z","submitted_at":"2025-07-08T17:59:50Z","title":"Feed-Forward SceneDINO for Unsupervised Semantic Scene Completion","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-06T19:13:59.187729Z"},"links":{"citing_paper":"/paper/2507.06230"},"observation_digest":"sha256:78a44a95549bd0a24d153ac41432c12640a8c2495a5bb1db48dad5fab61a7bba","observation_id":"f428b63f-245d-4edd-b44f-8242c2b3a5af","resolution":{"observed_at":"2026-08-06T19:13:59.187729Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:13:59.302795Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.06230","last_updated":"2025-07-25T14:31:34Z","snapshot_observed_at":"2026-08-07T14:43:47.586033Z","submitted_at":"2025-07-08T17:59:50Z","title":"Feed-Forward SceneDINO for Unsupervised Semantic Scene Completion","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-06T19:13:59.302795Z"},"links":{"citing_paper":"/paper/2507.06230"},"observation_digest":"sha256:4a0b29898d66d74e9d0bcd59bc856e36bfc8f0e235702c4484a64eb7d30c2245","observation_id":"556d0600-5ac6-4810-8b75-a0d77f857835","resolution":{"observed_at":"2026-08-06T19:13:59.302795Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:13:59.379026Z","title":"Boosting self-supervision for single-view scene completion via knowledge distillation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.06230","last_updated":"2025-07-25T14:31:34Z","snapshot_observed_at":"2026-08-07T14:43:47.586033Z","submitted_at":"2025-07-08T17:59:50Z","title":"Feed-Forward SceneDINO for Unsupervised Semantic Scene Completion","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-06T19:13:59.379026Z"},"links":{"citing_paper":"/paper/2507.06230"},"observation_digest":"sha256:e5476b4ff8eb657923adee8c6db3ff58f7bae77d0a7ff00ab1b99fd6c1a0859d","observation_id":"0b04343b-4489-4a4e-9ed8-9b59e3cae712","resolution":{"observed_at":"2026-08-06T19:13:59.379026Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:13:59.490116Z","title":"Image-based 3D object reconstruction: S tate-of-the-art and trends in the deep learning era","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.06230","last_updated":"2025-07-25T14:31:34Z","snapshot_observed_at":"2026-08-07T14:43:47.586033Z","submitted_at":"2025-07-08T17:59:50Z","title":"Feed-Forward SceneDINO for Unsupervised Semantic Scene Completion","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-06T19:13:59.490116Z"},"links":{"citing_paper":"/paper/2507.06230"},"observation_digest":"sha256:1105e01bb05c0b50929dd4c5a89f27ef3cd9efaaab035b5836cf72f4fdac9aa6","observation_id":"4a442888-2323-4b63-92b6-1736161fc0b9","resolution":{"observed_at":"2026-08-06T19:13:59.490116Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:13:59.571441Z","title":"InfoSeg : U nsupervised semantic image segmentation with mutual information maximization","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.06230","last_updated":"2025-07-25T14:31:34Z","snapshot_observed_at":"2026-08-07T14:43:47.586033Z","submitted_at":"2025-07-08T17:59:50Z","title":"Feed-Forward SceneDINO for Unsupervised Semantic Scene Completion","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-06T19:13:59.571441Z"},"links":{"citing_paper":"/paper/2507.06230"},"observation_digest":"sha256:323d9a6b751c3e7a9cc0a1cfbf53e7536606bc292ae2a0ccae35461464beb057","observation_id":"27142428-b960-4502-9f4a-380aa8327f76","resolution":{"observed_at":"2026-08-06T19:13:59.571441Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:13:59.659176Z","title":"Multiple view geometry in computer vision","venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2507.06230","last_updated":"2025-07-25T14:31:34Z","snapshot_observed_at":"2026-08-07T14:43:47.586033Z","submitted_at":"2025-07-08T17:59:50Z","title":"Feed-Forward SceneDINO for Unsupervised Semantic Scene Completion","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-06T19:13:59.659176Z"},"links":{"citing_paper":"/paper/2507.06230"},"observation_digest":"sha256:ec39b1440f6e1aebf76a4c441f4edf710b7329a0c0c512e55e6bbdab9ccd25f3","observation_id":"d59592f1-8779-4933-bb6a-ed49aeede7a0","resolution":{"observed_at":"2026-08-06T19:13:59.659176Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:13:59.732952Z","title":"S4C : S elf-supervised semantic scene completion with neural fields","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.06230","last_updated":"2025-07-25T14:31:34Z","snapshot_observed_at":"2026-08-07T14:43:47.586033Z","submitted_at":"2025-07-08T17:59:50Z","title":"Feed-Forward SceneDINO for Unsupervised Semantic Scene Completion","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-06T19:13:59.732952Z"},"links":{"citing_paper":"/paper/2507.06230"},"observation_digest":"sha256:1ad10f57d76d8507b4277b99059f143af8f10400742a58002a270c63679bc56e","observation_id":"de8143f7-47ad-4ce4-bc49-64f33cb26485","resolution":{"observed_at":"2026-08-06T19:13:59.732952Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:13:59.810387Z","title":"Momentum contrast for unsupervised visual representation learning","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.06230","last_updated":"2025-07-25T14:31:34Z","snapshot_observed_at":"2026-08-07T14:43:47.586033Z","submitted_at":"2025-07-08T17:59:50Z","title":"Feed-Forward SceneDINO for Unsupervised Semantic Scene Completion","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-06T19:13:59.810387Z"},"links":{"citing_paper":"/paper/2507.06230"},"observation_digest":"sha256:f22bbe4e3453cdc72ca4359b234d11cebf744b41922398c73c50aab0013ed8f7","observation_id":"aebfbe0e-6d0f-449f-97d0-3a698056ed80","resolution":{"observed_at":"2026-08-06T19:13:59.810387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:13:59.907025Z","title":"Masked autoencoders are scalable vision learners","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.06230","last_updated":"2025-07-25T14:31:34Z","snapshot_observed_at":"2026-08-07T14:43:47.586033Z","submitted_at":"2025-07-08T17:59:50Z","title":"Feed-Forward SceneDINO for Unsupervised Semantic Scene Completion","version":2},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-06T19:13:59.907025Z"},"links":{"citing_paper":"/paper/2507.06230"},"observation_digest":"sha256:e8da2aabe54e9f40009e37b70a2629868819cfb0b9f0f70e76d59a3caee32d60","observation_id":"0ef76b27-4215-44ec-90cb-6e97ce103089","resolution":{"observed_at":"2026-08-06T19:13:59.907025Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:13:59.968959Z","title":"Data-efficient image pecognition with contrastive predictive coding","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.06230","last_updated":"2025-07-25T14:31:34Z","snapshot_observed_at":"2026-08-07T14:43:47.586033Z","submitted_at":"2025-07-08T17:59:50Z","title":"Feed-Forward SceneDINO for Unsupervised Semantic Scene Completion","version":2},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-06T19:13:59.968959Z"},"links":{"citing_paper":"/paper/2507.06230"},"observation_digest":"sha256:588e764b3c920c2ca6c74923c45ab9b252ecf1129851c10285202c720ccc1b5b","observation_id":"c0790ad5-45f4-4e70-8753-aab1fcf1f247","resolution":{"observed_at":"2026-08-06T19:13:59.968959Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:14:00.044460Z","title":"Devon Hjelm, Alex Fedorov, Samuel Lavoie-Marchildon, Karan Grewal, Phil Bachman, Adam Trischler, and Yoshua Bengio","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.06230","last_updated":"2025-07-25T14:31:34Z","snapshot_observed_at":"2026-08-07T14:43:47.586033Z","submitted_at":"2025-07-08T17:59:50Z","title":"Feed-Forward SceneDINO for Unsupervised Semantic Scene Completion","version":2},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-06T19:14:00.044460Z"},"links":{"citing_paper":"/paper/2507.06230"},"observation_digest":"sha256:6bc386f8a4fc6d58c2db535c1dfb103ee18addce1737694f2b6f3c1e85b7ed5e","observation_id":"9b1be25f-7e90-4af6-a0e4-874745229c66","resolution":{"observed_at":"2026-08-06T19:14:00.044460Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:14:00.105652Z","title":"Metric3D v2 : A versatile monocular geometric foundation model for zero-shot metric depth and surface normal estimation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.06230","last_updated":"2025-07-25T14:31:34Z","snapshot_observed_at":"2026-08-07T14:43:47.586033Z","submitted_at":"2025-07-08T17:59:50Z","title":"Feed-Forward SceneDINO for Unsupervised Semantic Scene Completion","version":2},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-06T19:14:00.105652Z"},"links":{"citing_paper":"/paper/2507.06230"},"observation_digest":"sha256:a9e18e99682f1e99a0cf7b162943b3300861dc88b0627a913065416344fd0b3b","observation_id":"31950dd9-d65d-4fc0-b293-8a9da6ff453d","resolution":{"observed_at":"2026-08-06T19:14:00.105652Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:14:00.177423Z","title":"Segment3D : L earning fine-grained class-agnostic 3D segmentation without manual labels","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.06230","last_updated":"2025-07-25T14:31:34Z","snapshot_observed_at":"2026-08-07T14:43:47.586033Z","submitted_at":"2025-07-08T17:59:50Z","title":"Feed-Forward SceneDINO for Unsupervised Semantic Scene Completion","version":2},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-06T19:14:00.177423Z"},"links":{"citing_paper":"/paper/2507.06230"},"observation_digest":"sha256:789765e4365e0e3c979c6cd6a709db2646103f2faa536b0e056d1298eff165cc","observation_id":"a510b04e-7166-442a-9c8f-0ed812ba4329","resolution":{"observed_at":"2026-08-06T19:14:00.177423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:14:00.212945Z","title":"Tri-perspective view for vision-based 3D semantic occupancy prediction","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.06230","last_updated":"2025-07-25T14:31:34Z","snapshot_observed_at":"2026-08-07T14:43:47.586033Z","submitted_at":"2025-07-08T17:59:50Z","title":"Feed-Forward SceneDINO for Unsupervised Semantic Scene Completion","version":2},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-06T19:14:00.212945Z"},"links":{"citing_paper":"/paper/2507.06230"},"observation_digest":"sha256:bb4a991b35bcf17e330ec3f7f69a2afaa0ae39fdc565ad7ea514009485b10c9a","observation_id":"38ce3c1a-f3b2-4dcb-96f7-f0649348e70f","resolution":{"observed_at":"2026-08-06T19:14:00.212945Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:14:00.340988Z","title":"SelfOcc : S elf-supervised vision-based 3D occupancy prediction","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.06230","last_updated":"2025-07-25T14:31:34Z","snapshot_observed_at":"2026-08-07T14:43:47.586033Z","submitted_at":"2025-07-08T17:59:50Z","title":"Feed-Forward SceneDINO for Unsupervised Semantic Scene Completion","version":2},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-06T19:14:00.340988Z"},"links":{"citing_paper":"/paper/2507.06230"},"observation_digest":"sha256:bcfb4eca6940e341fdc2bf05dbf266db1b36e8200dff37f1dc4d9567faefc1d7","observation_id":"4ae1c8ca-d7fd-41da-b316-323ec822d14c","resolution":{"observed_at":"2026-08-06T19:14:00.340988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:14:00.386686Z","title":"Computer vision for autonomous vehicles: P roblems, datasets and state of the art","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.06230","last_updated":"2025-07-25T14:31:34Z","snapshot_observed_at":"2026-08-07T14:43:47.586033Z","submitted_at":"2025-07-08T17:59:50Z","title":"Feed-Forward SceneDINO for Unsupervised Semantic Scene Completion","version":2},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-06T19:14:00.386686Z"},"links":{"citing_paper":"/paper/2507.06230"},"observation_digest":"sha256:03354df23b0c8b4f66d738b3e28acbd02c3955cbabded3c0c79ba34b3a34937c","observation_id":"c43ab758-7a4a-4c72-b26a-deb8c31fbbf4","resolution":{"observed_at":"2026-08-06T19:14:00.386686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:14:00.430794Z","title":"Henriques, and Andrea Vedaldi","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.06230","last_updated":"2025-07-25T14:31:34Z","snapshot_observed_at":"2026-08-07T14:43:47.586033Z","submitted_at":"2025-07-08T17:59:50Z","title":"Feed-Forward SceneDINO for Unsupervised Semantic Scene Completion","version":2},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-06T19:14:00.430794Z"},"links":{"citing_paper":"/paper/2507.06230"},"observation_digest":"sha256:14116c0b3baaba082f567ff2393eb0047b787ba8b7ce0342e95964dd5b12f065","observation_id":"f32e9f56-3010-4a26-b8a8-4faf98938fe1","resolution":{"observed_at":"2026-08-06T19:14:00.430794Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.13193","last_updated":"2025-03-24T12:45:56Z","snapshot_observed_at":"2026-07-06T20:08:48.064792Z","submitted_at":"2024-12-17T18:59:46Z","title":"GaussTR: Foundation Model-Aligned Gaussian Transformer for Self-Supervised 3D Spatial Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.13193","snapshot_observed_at":"2026-08-06T19:14:00.502414Z","title":"GaussTR : F oundation model-aligned G aussian transformer for self-supervised 3D spatial understanding","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.06230","last_updated":"2025-07-25T14:31:34Z","snapshot_observed_at":"2026-08-07T14:43:47.586033Z","submitted_at":"2025-07-08T17:59:50Z","title":"Feed-Forward SceneDINO for Unsupervised Semantic Scene Completion","version":2},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-06T19:14:00.502414Z"},"links":{"cited_paper":"/paper/2412.13193","citing_paper":"/paper/2507.06230"},"observation_digest":"sha256:ce5a08c226124545978c7ca08db0dae12421425de551f44180cbfa73f0e6b3c3","observation_id":"3249057c-9f4e-4ef9-a0d8-40b18edebd2b","resolution":{"observed_at":"2026-08-06T19:14:00.502414Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:14:00.609374Z","title":"LERF : L anguage embedded radiance fields","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.06230","last_updated":"2025-07-25T14:31:34Z","snapshot_observed_at":"2026-08-07T14:43:47.586033Z","submitted_at":"2025-07-08T17:59:50Z","title":"Feed-Forward SceneDINO for Unsupervised Semantic Scene Completion","version":2},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-06T19:14:00.609374Z"},"links":{"citing_paper":"/paper/2507.06230"},"observation_digest":"sha256:f99dbe95bbb7b8a175512f26fb6be270865d6c603d7b2a6003d2a0677edaaaf8","observation_id":"55986484-8fa4-4327-933e-11d7df2089b1","resolution":{"observed_at":"2026-08-06T19:14:00.609374Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:14:20.879300Z","title":"EAGLE: E igen aggregation learning for object-centric unsupervised semantic segmentation","venue":null,"work_id":"1ea9cbdf-07b3-40a6-8461-5c249d2d9544","year":2024},"citing_paper":{"arxiv_id":"2507.06230","last_updated":"2025-07-25T14:31:34Z","snapshot_observed_at":"2026-08-07T14:43:47.586033Z","submitted_at":"2025-07-08T17:59:50Z","title":"Feed-Forward SceneDINO for Unsupervised Semantic Scene Completion","version":2},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-06T19:14:00.667349Z"},"links":{"citing_paper":"/paper/2507.06230"},"observation_digest":"sha256:be900fe9ce09ac90d60d35e87d25becfe389cb35062abe57a1b47739d20393e8","observation_id":"993faf30-cb2a-4920-8b44-12c3730b2896","resolution":{"observed_at":"2026-08-06T19:14:20.989422Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:14:20.665160Z","title":"Kingma and Jimmy Lei Ba","venue":null,"work_id":"30e0a077-741f-445e-ab63-5dc07e9fff87","year":2015},"citing_paper":{"arxiv_id":"2507.06230","last_updated":"2025-07-25T14:31:34Z","snapshot_observed_at":"2026-08-07T14:43:47.586033Z","submitted_at":"2025-07-08T17:59:50Z","title":"Feed-Forward SceneDINO for Unsupervised Semantic Scene Completion","version":2},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-06T19:14:00.705862Z"},"links":{"citing_paper":"/paper/2507.06230"},"observation_digest":"sha256:1fcbca4ea632c0eba00c8c30794c83463be63dcc1381eb0a152420abaa66a31d","observation_id":"cc3e99e5-3966-4d2a-8893-0c4dacc99e4c","resolution":{"observed_at":"2026-08-06T19:14:20.763700Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:14:20.468258Z","title":"Berg, Wan-Yen Lo, Piotr Doll \\'a r, and Ross Girshick","venue":null,"work_id":"813c2fb2-5215-41aa-a7c5-c8a825e94f68","year":2023},"citing_paper":{"arxiv_id":"2507.06230","last_updated":"2025-07-25T14:31:34Z","snapshot_observed_at":"2026-08-07T14:43:47.586033Z","submitted_at":"2025-07-08T17:59:50Z","title":"Feed-Forward SceneDINO for Unsupervised Semantic Scene Completion","version":2},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-06T19:14:00.760496Z"},"links":{"citing_paper":"/paper/2507.06230"},"observation_digest":"sha256:2d756efa1dc859d0d149c4ce7e468feb94000abdf25b69be6b87d7fb38e5a65c","observation_id":"03ff1912-8c0c-4c5e-8451-f1a394684e85","resolution":{"observed_at":"2026-08-06T19:14:20.551215Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:14:20.291605Z","title":"Decomposing NeRF for editing via feature field distillation","venue":null,"work_id":"cf371e80-4626-42cd-a6c9-96ee7d315821","year":2022},"citing_paper":{"arxiv_id":"2507.06230","last_updated":"2025-07-25T14:31:34Z","snapshot_observed_at":"2026-08-07T14:43:47.586033Z","submitted_at":"2025-07-08T17:59:50Z","title":"Feed-Forward SceneDINO for Unsupervised Semantic Scene Completion","version":2},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-06T19:14:00.797325Z"},"links":{"citing_paper":"/paper/2507.06230"},"observation_digest":"sha256:50a6ecadc3e79f6b5d7c9acc98a4b80d24932bc8b9f8eaa61eb6a672b7704c4f","observation_id":"fc1be73d-d43d-4d35-8605-8a09a7046c55","resolution":{"observed_at":"2026-08-06T19:14:20.399476Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:14:20.080406Z","title":"Uncovering the inner workings of STEGO for safe unsupervised semantic segmentation","venue":null,"work_id":"fba7a55c-4c11-485a-a216-878949d1ad12","year":2023},"citing_paper":{"arxiv_id":"2507.06230","last_updated":"2025-07-25T14:31:34Z","snapshot_observed_at":"2026-08-07T14:43:47.586033Z","submitted_at":"2025-07-08T17:59:50Z","title":"Feed-Forward SceneDINO for Unsupervised Semantic Scene Completion","version":2},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-06T19:14:00.868022Z"},"links":{"citing_paper":"/paper/2507.06230"},"observation_digest":"sha256:91fa07934876539fa49c20a296244d0be3900d2548ed6eabceabde9b794542e1","observation_id":"3f5256a5-e6ea-4f75-b648-7fa911ff8dd9","resolution":{"observed_at":"2026-08-06T19:14:20.170357Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:14:19.892506Z","title":"a henb \\","venue":null,"work_id":"2ffa1a7c-4138-437e-9de8-ef9b4bda047b","year":2011},"citing_paper":{"arxiv_id":"2507.06230","last_updated":"2025-07-25T14:31:34Z","snapshot_observed_at":"2026-08-07T14:43:47.586033Z","submitted_at":"2025-07-08T17:59:50Z","title":"Feed-Forward SceneDINO for Unsupervised Semantic Scene Completion","version":2},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-06T19:14:00.905664Z"},"links":{"citing_paper":"/paper/2507.06230"},"observation_digest":"sha256:2504ecf40000a0ef311f58fa4812bccdba90815c4525e5af9d5f6a7becf2e8d8","observation_id":"b29d3777-e7df-43f7-bee2-27434d097b61","resolution":{"observed_at":"2026-08-06T19:14:19.969984Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:14:19.724150Z","title":null,"venue":null,"work_id":"d8d87595-48ca-4b99-992e-855d46bf9047","year":1955},"citing_paper":{"arxiv_id":"2507.06230","last_updated":"2025-07-25T14:31:34Z","snapshot_observed_at":"2026-08-07T14:43:47.586033Z","submitted_at":"2025-07-08T17:59:50Z","title":"Feed-Forward SceneDINO for Unsupervised Semantic Scene Completion","version":2},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-06T19:14:00.967664Z"},"links":{"citing_paper":"/paper/2507.06230"},"observation_digest":"sha256:5dc398981be7fbe41938259a55a7bd724313b8ad1a2f25b5246d33138fb375a5","observation_id":"dd53ba43-4bf8-41d4-b1fc-16a8b2e84011","resolution":{"observed_at":"2026-08-06T19:14:19.794779Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:14:19.511230Z","title":null,"venue":null,"work_id":"6a3a047b-33ee-49e3-a222-d58fe9ef5d70","year":2019},"citing_paper":{"arxiv_id":"2507.06230","last_updated":"2025-07-25T14:31:34Z","snapshot_observed_at":"2026-08-07T14:43:47.586033Z","submitted_at":"2025-07-08T17:59:50Z","title":"Feed-Forward SceneDINO for Unsupervised Semantic Scene Completion","version":2},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-06T19:14:01.041394Z"},"links":{"citing_paper":"/paper/2507.06230"},"observation_digest":"sha256:a5009f6148a3ddeb6f56964f9883a86060be287104b8918da0a4a3f01cca9d58","observation_id":"1060251b-2d20-4326-8de8-eb288c2cc3fd","resolution":{"observed_at":"2026-08-06T19:14:19.612888Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:14:19.294034Z","title":"Anisotropic convolutional networks for 3D semantic scene completion","venue":null,"work_id":"50face87-508a-49f9-9ee1-b22900e92f53","year":2020},"citing_paper":{"arxiv_id":"2507.06230","last_updated":"2025-07-25T14:31:34Z","snapshot_observed_at":"2026-08-07T14:43:47.586033Z","submitted_at":"2025-07-08T17:59:50Z","title":"Feed-Forward SceneDINO for Unsupervised Semantic Scene Completion","version":2},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-06T19:14:01.087414Z"},"links":{"citing_paper":"/paper/2507.06230"},"observation_digest":"sha256:0cbf3ada69e45f29c519164ea95f04eeb040feb692574124262d704f9663f621","observation_id":"d60f7ce5-3f62-4a10-ae3c-ab6c44946e3c","resolution":{"observed_at":"2026-08-06T19:14:19.402568Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:14:18.978697Z","title":"Depth based semantic scene completion with position importance aware loss","venue":null,"work_id":"88148237-7255-4e6e-8b17-5fe549fae58a","year":2020},"citing_paper":{"arxiv_id":"2507.06230","last_updated":"2025-07-25T14:31:34Z","snapshot_observed_at":"2026-08-07T14:43:47.586033Z","submitted_at":"2025-07-08T17:59:50Z","title":"Feed-Forward SceneDINO for Unsupervised Semantic Scene Completion","version":2},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-06T19:14:01.131241Z"},"links":{"citing_paper":"/paper/2507.06230"},"observation_digest":"sha256:e7fca314928b9288115eebb8febb0503b515a771c2ca32fe823c61656e0b559b","observation_id":"c1a1924b-7203-4ce7-a0a9-0740b6f63e7e","resolution":{"observed_at":"2026-08-06T19:14:19.136549Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:14:18.795344Z","title":"Prototypical contrastive learning of unsupervised representations","venue":null,"work_id":"7449cb09-9928-4a5a-ac4d-751e25d6e625","year":2021},"citing_paper":{"arxiv_id":"2507.06230","last_updated":"2025-07-25T14:31:34Z","snapshot_observed_at":"2026-08-07T14:43:47.586033Z","submitted_at":"2025-07-08T17:59:50Z","title":"Feed-Forward SceneDINO for Unsupervised Semantic Scene Completion","version":2},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-06T19:14:01.185539Z"},"links":{"citing_paper":"/paper/2507.06230"},"observation_digest":"sha256:a3c22bfe5fdae7306dc19b364bd92c39f8b06a1b258eace2e998482ff49d5d29","observation_id":"6b3b05b1-def7-48f0-a7ad-dcdc37883de4","resolution":{"observed_at":"2026-08-06T19:14:18.869443Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.14798","last_updated":"2021-11-29T18:50:09Z","snapshot_observed_at":"2026-08-08T01:36:46.856492Z","submitted_at":"2021-11-29T18:50:09Z","title":"Semi-supervised Implicit Scene Completion from Sparse LiDAR","version":1},"cited_work":{"arxiv_id":"2111.14798","doi":null,"metadata_source":"pith","pith_arxiv_id":"2111.14798","snapshot_observed_at":"2026-08-06T19:14:06.509912Z","title":"Semi-supervised Implicit Scene Completion from Sparse LiDAR","venue":"cs.CV","work_id":"ec051b1b-d8e3-4df5-a35b-c5817039b905","year":2021},"citing_paper":{"arxiv_id":"2507.06230","last_updated":"2025-07-25T14:31:34Z","snapshot_observed_at":"2026-08-07T14:43:47.586033Z","submitted_at":"2025-07-08T17:59:50Z","title":"Feed-Forward SceneDINO for Unsupervised Semantic Scene Completion","version":2},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-06T19:14:01.252777Z"},"links":{"cited_paper":"/paper/2111.14798","citing_paper":"/paper/2507.06230"},"observation_digest":"sha256:74a2bc0c2d7c5384450c2906012cc2bc201352b803a353aec28c23c0e249a6e2","observation_id":"22ac76c8-d169-418b-854f-139c10e02ded","resolution":{"observed_at":"2026-08-06T19:14:06.625355Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:14:18.597087Z","title":"Choy, Chaowei Xiao, Jos \\' e M","venue":null,"work_id":"362733e8-c889-4919-a883-0d435d29f992","year":2023},"citing_paper":{"arxiv_id":"2507.06230","last_updated":"2025-07-25T14:31:34Z","snapshot_observed_at":"2026-08-07T14:43:47.586033Z","submitted_at":"2025-07-08T17:59:50Z","title":"Feed-Forward SceneDINO for Unsupervised Semantic Scene Completion","version":2},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-06T19:14:01.317743Z"},"links":{"citing_paper":"/paper/2507.06230"},"observation_digest":"sha256:ed68c91259159ec9034ede634b1ee901e96b4a1bf0084e136e48ec18b84452e7","observation_id":"8fc9799c-7045-4720-8cef-2b5d06d50e9e","resolution":{"observed_at":"2026-08-06T19:14:18.679903Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:14:18.442440Z","title":"SSCBench : A large-scale 3D semantic scene completion benchmark for autonomous driving","venue":null,"work_id":"638e755b-9adf-46c6-a007-d04f3fe0d448","year":2024},"citing_paper":{"arxiv_id":"2507.06230","last_updated":"2025-07-25T14:31:34Z","snapshot_observed_at":"2026-08-07T14:43:47.586033Z","submitted_at":"2025-07-08T17:59:50Z","title":"Feed-Forward SceneDINO for Unsupervised Semantic Scene Completion","version":2},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-06T19:14:01.373056Z"},"links":{"citing_paper":"/paper/2507.06230"},"observation_digest":"sha256:59623a8c0818f09c08a6f37b559a7b54e7bef1b43868582c7e010f1251be1fde","observation_id":"3df8b178-c3ff-4c41-a24c-e7808b346422","resolution":{"observed_at":"2026-08-06T19:14:18.516286Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.01492","last_updated":"2023-07-04T05:55:54Z","snapshot_observed_at":"2026-07-06T15:50:02.603016Z","submitted_at":"2023-07-04T05:55:54Z","title":"FB-OCC: 3D Occupancy Prediction based on Forward-Backward View Transformation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.01492","snapshot_observed_at":"2026-08-06T19:14:01.431897Z","title":"\\' A lvarez","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.06230","last_updated":"2025-07-25T14:31:34Z","snapshot_observed_at":"2026-08-07T14:43:47.586033Z","submitted_at":"2025-07-08T17:59:50Z","title":"Feed-Forward SceneDINO for Unsupervised Semantic Scene Completion","version":2},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-06T19:14:01.431897Z"},"links":{"cited_paper":"/paper/2307.01492","citing_paper":"/paper/2507.06230"},"observation_digest":"sha256:5fd1b39cdac1e4ac91b50c5516ae9174d1a8d6e09913660e68b545396974dba9","observation_id":"e6d147ca-d9e0-4be8-b448-d9e170610a72","resolution":{"observed_at":"2026-08-06T19:14:01.431897Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:14:18.220073Z","title":"KITTI-360: A novel dataset and benchmarks for urban scene understanding in 2D and 3D","venue":null,"work_id":"d374493f-9308-43b3-afdf-08626818fc2f","year":2023},"citing_paper":{"arxiv_id":"2507.06230","last_updated":"2025-07-25T14:31:34Z","snapshot_observed_at":"2026-08-07T14:43:47.586033Z","submitted_at":"2025-07-08T17:59:50Z","title":"Feed-Forward SceneDINO for Unsupervised Semantic Scene Completion","version":2},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-06T19:14:01.489711Z"},"links":{"citing_paper":"/paper/2507.06230"},"observation_digest":"sha256:0d2f86e9114f342c70c44e5d55af964aacfbcc0a698511c6bf57b41b54af8f02","observation_id":"75efc581-b215-4372-aec4-440b9f438f98","resolution":{"observed_at":"2026-08-06T19:14:18.359863Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:14:18.040459Z","title":"Lawrence Zitnick","venue":null,"work_id":"8df30f8c-20ad-4b5a-8848-b9d080c61411","year":2024},"citing_paper":{"arxiv_id":"2507.06230","last_updated":"2025-07-25T14:31:34Z","snapshot_observed_at":"2026-08-07T14:43:47.586033Z","submitted_at":"2025-07-08T17:59:50Z","title":"Feed-Forward SceneDINO for Unsupervised Semantic Scene Completion","version":2},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-06T19:14:01.551465Z"},"links":{"citing_paper":"/paper/2507.06230"},"observation_digest":"sha256:2ca892734dc2a8c1a10bb0925ecd60af3d7f98f7ba4209c8ed08f0788ea8d949","observation_id":"f8cbb656-83a7-4ccb-b2cd-9d586e32529d","resolution":{"observed_at":"2026-08-06T19:14:18.135124Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:14:17.864621Z","title":"See and think: Disentangling semantic scene completion","venue":null,"work_id":"9562a4b1-90fc-48d2-87e0-f9cabbad8a2d","year":2018},"citing_paper":{"arxiv_id":"2507.06230","last_updated":"2025-07-25T14:31:34Z","snapshot_observed_at":"2026-08-07T14:43:47.586033Z","submitted_at":"2025-07-08T17:59:50Z","title":"Feed-Forward SceneDINO for Unsupervised Semantic Scene Completion","version":2},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-06T19:14:01.620506Z"},"links":{"citing_paper":"/paper/2507.06230"},"observation_digest":"sha256:5c895de601068efb1b0f00e77a140e0278cb171b778d9396744aa40577ecb37f","observation_id":"631b8b12-b037-4915-96c7-49eb5d03f350","resolution":{"observed_at":"2026-08-06T19:14:17.961217Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:14:17.699263Z","title":"Least squares quantization in PCM","venue":null,"work_id":"edc00bb8-9f09-4be8-8ad3-c1e058265ac2","year":1982},"citing_paper":{"arxiv_id":"2507.06230","last_updated":"2025-07-25T14:31:34Z","snapshot_observed_at":"2026-08-07T14:43:47.586033Z","submitted_at":"2025-07-08T17:59:50Z","title":"Feed-Forward SceneDINO for Unsupervised Semantic Scene Completion","version":2},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-06T19:14:01.677929Z"},"links":{"citing_paper":"/paper/2507.06230"},"observation_digest":"sha256:907bf1cc8064d01bc52fca5f803f5d38548fe3b09d02ce9958702c84e1959fb6","observation_id":"fa8b0f60-cf8b-4e33-bcec-af88bc55b418","resolution":{"observed_at":"2026-08-06T19:14:17.775536Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:14:17.542499Z","title":"A review of 3D reconstruction techniques in civil engineering and their applications","venue":null,"work_id":"40503789-7865-44af-973a-4c2ecb0a7683","year":2018},"citing_paper":{"arxiv_id":"2507.06230","last_updated":"2025-07-25T14:31:34Z","snapshot_observed_at":"2026-08-07T14:43:47.586033Z","submitted_at":"2025-07-08T17:59:50Z","title":"Feed-Forward SceneDINO for Unsupervised Semantic Scene Completion","version":2},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-06T19:14:01.743699Z"},"links":{"citing_paper":"/paper/2507.06230"},"observation_digest":"sha256:cc6aaa9a015837932cf859e2d84a0d4cd9811bb4bebcdd429ca5953c5515ef30","observation_id":"629a0d91-0f92-4568-a373-ec62820b7cc9","resolution":{"observed_at":"2026-08-06T19:14:17.607160Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:14:17.367988Z","title":"Some methods for classification and analysis of multivariate observations","venue":null,"work_id":"d8d90554-9d5e-4e53-a85b-a123b44ccdbc","year":1967},"citing_paper":{"arxiv_id":"2507.06230","last_updated":"2025-07-25T14:31:34Z","snapshot_observed_at":"2026-08-07T14:43:47.586033Z","submitted_at":"2025-07-08T17:59:50Z","title":"Feed-Forward SceneDINO for Unsupervised Semantic Scene Completion","version":2},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-06T19:14:01.797655Z"},"links":{"citing_paper":"/paper/2507.06230"},"observation_digest":"sha256:eaa349754ea24ea2d740f7753cf1b90fcc3298a3aa8fbe1d453dd37455c40c1b","observation_id":"92f3b1b8-55ff-4c27-af65-e3d9255174c3","resolution":{"observed_at":"2026-08-06T19:14:17.447652Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:14:17.148597Z","title":"Optical models for direct volume rendering","venue":null,"work_id":"573200e0-f18e-4d54-855d-957f5e2468b0","year":1995},"citing_paper":{"arxiv_id":"2507.06230","last_updated":"2025-07-25T14:31:34Z","snapshot_observed_at":"2026-08-07T14:43:47.586033Z","submitted_at":"2025-07-08T17:59:50Z","title":"Feed-Forward SceneDINO for Unsupervised Semantic Scene Completion","version":2},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-06T19:14:01.847804Z"},"links":{"citing_paper":"/paper/2507.06230"},"observation_digest":"sha256:3c63745e6351a50a190315ab3033311d4a4a3c67cd274f68b030de926f9ee439","observation_id":"2ff955f4-7a86-4b90-85d7-1fd7f08c0b80","resolution":{"observed_at":"2026-08-06T19:14:17.250851Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:14:16.937795Z","title":"Feature-realistic neural fusion for real-time, open set scene understanding","venue":null,"work_id":"edbb0ac9-35da-4cd0-b7c5-3763e44f8622","year":2023},"citing_paper":{"arxiv_id":"2507.06230","last_updated":"2025-07-25T14:31:34Z","snapshot_observed_at":"2026-08-07T14:43:47.586033Z","submitted_at":"2025-07-08T17:59:50Z","title":"Feed-Forward SceneDINO for Unsupervised Semantic Scene Completion","version":2},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-06T19:14:01.914944Z"},"links":{"citing_paper":"/paper/2507.06230"},"observation_digest":"sha256:0322bcd5aaccfbb994744a3aa89b76d7f68e07bffa4236664c38c1fedfa42db5","observation_id":"6d4593d9-60c7-4777-b9b5-bf0948d83a78","resolution":{"observed_at":"2026-08-06T19:14:17.028191Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13540","last_updated":"2023-02-27T06:35:03Z","snapshot_observed_at":"2026-08-04T09:40:33.174673Z","submitted_at":"2023-02-27T06:35:03Z","title":"OccDepth: A Depth-Aware Method for 3D Semantic Scene Completion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13540","snapshot_observed_at":"2026-08-06T19:14:01.993869Z","title":"Occdepth: A depth-aware method for 3D semantic scene completion","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.06230","last_updated":"2025-07-25T14:31:34Z","snapshot_observed_at":"2026-08-07T14:43:47.586033Z","submitted_at":"2025-07-08T17:59:50Z","title":"Feed-Forward SceneDINO for Unsupervised Semantic Scene Completion","version":2},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-06T19:14:01.993869Z"},"links":{"cited_paper":"/paper/2302.13540","citing_paper":"/paper/2507.06230"},"observation_digest":"sha256:4d2d128b7b57feeba709636f360c912d0da124636a44c998ec1f91f58290f8fd","observation_id":"69f7788d-8d90-4f07-b6eb-07c9d8fc8d32","resolution":{"observed_at":"2026-08-06T19:14:01.993869Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:14:16.777926Z","title":"Srinivasan, Matthew Tancik, Jonathan T","venue":null,"work_id":"8b73a019-1f8e-41e3-bec0-1bf123474b58","year":2021},"citing_paper":{"arxiv_id":"2507.06230","last_updated":"2025-07-25T14:31:34Z","snapshot_observed_at":"2026-08-07T14:43:47.586033Z","submitted_at":"2025-07-08T17:59:50Z","title":"Feed-Forward SceneDINO for Unsupervised Semantic Scene Completion","version":2},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-08-06T19:14:02.058780Z"},"links":{"citing_paper":"/paper/2507.06230"},"observation_digest":"sha256:2ec0007d30046124f9641302008251e3b102e64c8e69d7076fba6dff36008434","observation_id":"74070b4e-7fb2-4248-90b8-93a6223b0c57","resolution":{"observed_at":"2026-08-06T19:14:16.859732Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:14:16.524109Z","title":"Deep learning for monocular depth estimation: A review","venue":null,"work_id":"f0bc8566-f55b-47a8-9359-9ebadfddfd9f","year":2021},"citing_paper":{"arxiv_id":"2507.06230","last_updated":"2025-07-25T14:31:34Z","snapshot_observed_at":"2026-08-07T14:43:47.586033Z","submitted_at":"2025-07-08T17:59:50Z","title":"Feed-Forward SceneDINO for Unsupervised Semantic Scene Completion","version":2},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-08-06T19:14:02.116647Z"},"links":{"citing_paper":"/paper/2507.06230"},"observation_digest":"sha256:cbb574e81c25ee44268b10f4f8de9ba52d5df2c4080298c1b887338e7513841e","observation_id":"47e30808-9f61-45e9-90e2-f6404ee15114","resolution":{"observed_at":"2026-08-06T19:14:16.625795Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:14:16.349007Z","title":"Oswald, Alexander Kirillov, Cees G","venue":null,"work_id":"f436dac9-3ee0-45ce-b1e1-40fec0e64d1d","year":2024},"citing_paper":{"arxiv_id":"2507.06230","last_updated":"2025-07-25T14:31:34Z","snapshot_observed_at":"2026-08-07T14:43:47.586033Z","submitted_at":"2025-07-08T17:59:50Z","title":"Feed-Forward SceneDINO for Unsupervised Semantic Scene Completion","version":2},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-08-06T19:14:02.166413Z"},"links":{"citing_paper":"/paper/2507.06230"},"observation_digest":"sha256:18d6251919edb715453e3967aa99cc1d6110a46c41d663dbdfa2e48549395ee1","observation_id":"d514610d-10b3-4186-8f15-ca74b8049cf5","resolution":{"observed_at":"2026-08-06T19:14:16.427940Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:14:16.160154Z","title":"Unsupervised universal image segmentation","venue":null,"work_id":"9695d6d7-b6f1-4432-baf7-3df70541426a","year":2024},"citing_paper":{"arxiv_id":"2507.06230","last_updated":"2025-07-25T14:31:34Z","snapshot_observed_at":"2026-08-07T14:43:47.586033Z","submitted_at":"2025-07-08T17:59:50Z","title":"Feed-Forward SceneDINO for Unsupervised Semantic Scene Completion","version":2},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-08-06T19:14:02.217209Z"},"links":{"citing_paper":"/paper/2507.06230"},"observation_digest":"sha256:f34c387c5a4ac8abb692c84ac23285e805dbfe4b15630434ff113e9979529f9b","observation_id":"94728290-bf82-4120-ad56-6128abc6d5f3","resolution":{"observed_at":"2026-08-06T19:14:16.262416Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:14:15.940625Z","title":"Unsupervised learning of visual representations by solving jigsaw puzzles","venue":null,"work_id":"c50fcf81-c542-4f3c-8eec-b6292ee91b62","year":2016},"citing_paper":{"arxiv_id":"2507.06230","last_updated":"2025-07-25T14:31:34Z","snapshot_observed_at":"2026-08-07T14:43:47.586033Z","submitted_at":"2025-07-08T17:59:50Z","title":"Feed-Forward SceneDINO for Unsupervised Semantic Scene Completion","version":2},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-08-06T19:14:02.268321Z"},"links":{"citing_paper":"/paper/2507.06230"},"observation_digest":"sha256:63395897fc65023cdcae74bf5a81dcafc8653eba39284bf6f601697c1acfa8bf","observation_id":"2941bb65-5756-4b96-a365-3275f5ccb4c1","resolution":{"observed_at":"2026-08-06T19:14:16.051331Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:14:15.769096Z","title":"Vo, Marc Szafraniec, Vasil Khalidov, Pierre Fernandez, Daniel Haziza, Francisco Massa, Alaaeldin El-Nouby, et al","venue":null,"work_id":"35701fd0-161c-41ab-97c7-2764b57ff9c4","year":2024},"citing_paper":{"arxiv_id":"2507.06230","last_updated":"2025-07-25T14:31:34Z","snapshot_observed_at":"2026-08-07T14:43:47.586033Z","submitted_at":"2025-07-08T17:59:50Z","title":"Feed-Forward SceneDINO for Unsupervised Semantic Scene Completion","version":2},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-08-06T19:14:02.327121Z"},"links":{"citing_paper":"/paper/2507.06230"},"observation_digest":"sha256:d3acc5f805d31271010e0caf44ce65de3bed2beb0c39210ba4a7313352987bb3","observation_id":"e75c315d-4f95-4d06-b827-3f6d80659fe7","resolution":{"observed_at":"2026-08-06T19:14:15.849524Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:14:15.541746Z","title":"A review of geometry recovery from a single image focusing on curved object reconstruction","venue":null,"work_id":"7e436936-b42f-4e61-a5ea-0167faad0e82","year":2013},"citing_paper":{"arxiv_id":"2507.06230","last_updated":"2025-07-25T14:31:34Z","snapshot_observed_at":"2026-08-07T14:43:47.586033Z","submitted_at":"2025-07-08T17:59:50Z","title":"Feed-Forward SceneDINO for Unsupervised Semantic Scene Completion","version":2},"reference_index":82,"source":"arxiv_source","source_observed_at":"2026-08-06T19:14:02.388386Z"},"links":{"citing_paper":"/paper/2507.06230"},"observation_digest":"sha256:e0e1e1da4a2c8295a805217336c73084954168077e450679d62fbadadc109e3d","observation_id":"29833ed8-7b4e-4910-9451-d551c06a4ba7","resolution":{"observed_at":"2026-08-06T19:14:15.660324Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:14:15.348733Z","title":"RenderOcc : V ision-centric 3D occupancy prediction with 2D rendering supervision","venue":null,"work_id":"2c8a330a-72fd-4170-8e85-731afb36eb40","year":2024},"citing_paper":{"arxiv_id":"2507.06230","last_updated":"2025-07-25T14:31:34Z","snapshot_observed_at":"2026-08-07T14:43:47.586033Z","submitted_at":"2025-07-08T17:59:50Z","title":"Feed-Forward SceneDINO for Unsupervised Semantic Scene Completion","version":2},"reference_index":83,"source":"arxiv_source","source_observed_at":"2026-08-06T19:14:02.448927Z"},"links":{"citing_paper":"/paper/2507.06230"},"observation_digest":"sha256:f7b11e5b3fe99bd5d473e5a9084260fd65d7c02506b228fc0e8d12a86de3851f","observation_id":"5b46dfb4-e96c-4720-b34e-4e4da2f0cdbe","resolution":{"observed_at":"2026-08-06T19:14:15.439663Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:14:15.176448Z","title":"OpenScene : 3D scene understanding with open vocabularies","venue":null,"work_id":"d9c0c180-f157-4a15-b87d-a7e009963d18","year":2023},"citing_paper":{"arxiv_id":"2507.06230","last_updated":"2025-07-25T14:31:34Z","snapshot_observed_at":"2026-08-07T14:43:47.586033Z","submitted_at":"2025-07-08T17:59:50Z","title":"Feed-Forward SceneDINO for Unsupervised Semantic Scene Completion","version":2},"reference_index":84,"source":"arxiv_source","source_observed_at":"2026-08-06T19:14:02.516685Z"},"links":{"citing_paper":"/paper/2507.06230"},"observation_digest":"sha256:8f8f20813efbf8df63353fe178afda53f725e60c32fa777163ba1ffb22f139ba","observation_id":"3fad6c70-23af-4ece-80de-8305bd24620a","resolution":{"observed_at":"2026-08-06T19:14:15.257823Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:14:14.994413Z","title":"Vision transformers for dense prediction","venue":null,"work_id":"1a3dc137-85e6-4567-8407-c141263fd177","year":2021},"citing_paper":{"arxiv_id":"2507.06230","last_updated":"2025-07-25T14:31:34Z","snapshot_observed_at":"2026-08-07T14:43:47.586033Z","submitted_at":"2025-07-08T17:59:50Z","title":"Feed-Forward SceneDINO for Unsupervised Semantic Scene Completion","version":2},"reference_index":85,"source":"arxiv_source","source_observed_at":"2026-08-06T19:14:02.590808Z"},"links":{"citing_paper":"/paper/2507.06230"},"observation_digest":"sha256:54f2f04e050d5a9ebfe5e2adeb69fb5db0a1470ceafa8ea0dc5fa974af6cba9c","observation_id":"d778e3c1-3a8b-45ea-8362-56a6a8b475b6","resolution":{"observed_at":"2026-08-06T19:14:15.075745Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00714","last_updated":"2024-10-28T16:37:57Z","snapshot_observed_at":"2026-07-06T18:55:41.459417Z","submitted_at":"2024-08-01T17:00:08Z","title":"SAM 2: Segment Anything in Images and Videos","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00714","snapshot_observed_at":"2026-08-06T19:14:02.664836Z","title":"SAM 2 : S egment anything in images and videos","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.06230","last_updated":"2025-07-25T14:31:34Z","snapshot_observed_at":"2026-08-07T14:43:47.586033Z","submitted_at":"2025-07-08T17:59:50Z","title":"Feed-Forward SceneDINO for Unsupervised Semantic Scene Completion","version":2},"reference_index":86,"source":"arxiv_source","source_observed_at":"2026-08-06T19:14:02.664836Z"},"links":{"cited_paper":"/paper/2408.00714","citing_paper":"/paper/2507.06230"},"observation_digest":"sha256:c3fcb598a7aca1411230063fb47ef3e368cdd84a59f9f1bf03dd93431e6c4a96","observation_id":"b9a72777-3313-4b4a-ab20-059fddcfab52","resolution":{"observed_at":"2026-08-06T19:14:02.664836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:14:14.798194Z","title":"Richter and Stefan Roth","venue":null,"work_id":"fc7594d6-83dd-4e42-b971-420283cc700a","year":1936},"citing_paper":{"arxiv_id":"2507.06230","last_updated":"2025-07-25T14:31:34Z","snapshot_observed_at":"2026-08-07T14:43:47.586033Z","submitted_at":"2025-07-08T17:59:50Z","title":"Feed-Forward SceneDINO for Unsupervised Semantic Scene Completion","version":2},"reference_index":87,"source":"arxiv_source","source_observed_at":"2026-08-06T19:14:02.742923Z"},"links":{"citing_paper":"/paper/2507.06230"},"observation_digest":"sha256:d21a3d3eef145339531e00f017d64417ab2bbee78a51ecd5cdde1f6326a9274c","observation_id":"aede0d31-7abb-470a-b708-99981d2bf330","resolution":{"observed_at":"2026-08-06T19:14:14.904270Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:14:14.600274Z","title":"Rist, David Emmerichs, Markus Enzweiler, and Dariu M","venue":null,"work_id":"8aaf80a6-fb85-4dcc-9ed9-c960a8d3b1dc","year":2022},"citing_paper":{"arxiv_id":"2507.06230","last_updated":"2025-07-25T14:31:34Z","snapshot_observed_at":"2026-08-07T14:43:47.586033Z","submitted_at":"2025-07-08T17:59:50Z","title":"Feed-Forward SceneDINO for Unsupervised Semantic Scene Completion","version":2},"reference_index":88,"source":"arxiv_source","source_observed_at":"2026-08-06T19:14:02.810494Z"},"links":{"citing_paper":"/paper/2507.06230"},"observation_digest":"sha256:1d77ecb074c44dc1a7ad71285eea899d76a7d3eade9612e6984c3c37e017848f","observation_id":"376506b5-1d68-40c7-a257-329433f64925","resolution":{"observed_at":"2026-08-06T19:14:14.654639Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:14:14.314688Z","title":"LMSCNet : L ightweight multiscale 3D semantic completion","venue":null,"work_id":"a7b897d9-22f8-4777-9445-d11494ad4c56","year":2020},"citing_paper":{"arxiv_id":"2507.06230","last_updated":"2025-07-25T14:31:34Z","snapshot_observed_at":"2026-08-07T14:43:47.586033Z","submitted_at":"2025-07-08T17:59:50Z","title":"Feed-Forward SceneDINO for Unsupervised Semantic Scene Completion","version":2},"reference_index":89,"source":"arxiv_source","source_observed_at":"2026-08-06T19:14:02.870462Z"},"links":{"citing_paper":"/paper/2507.06230"},"observation_digest":"sha256:41d9bfc1b8d97c29a944822eea4a9293250649bd6c350eb9539d4f39fefe31e9","observation_id":"7f3146d1-2a4c-4cb4-bebb-87ec69ae49d5","resolution":{"observed_at":"2026-08-06T19:14:14.514421Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:14:14.083339Z","title":"3D semantic scene completion: A survey","venue":null,"work_id":"ce6164be-df85-47e0-95ba-73497a342665","year":1978},"citing_paper":{"arxiv_id":"2507.06230","last_updated":"2025-07-25T14:31:34Z","snapshot_observed_at":"2026-08-07T14:43:47.586033Z","submitted_at":"2025-07-08T17:59:50Z","title":"Feed-Forward SceneDINO for Unsupervised Semantic Scene Completion","version":2},"reference_index":90,"source":"arxiv_source","source_observed_at":"2026-08-06T19:14:02.929505Z"},"links":{"citing_paper":"/paper/2507.06230"},"observation_digest":"sha256:a45f844a4be85b5a1817d1358d57678550c0eeea6182b928f6a92c7e57c9e85a","observation_id":"48e36a5c-1dd4-4293-a3be-a11b0744804f","resolution":{"observed_at":"2026-08-06T19:14:14.204852Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:14:13.923860Z","title":"Schönberger and Jan-Michael Frahm","venue":null,"work_id":"6f3afe73-c1d3-44be-a6f2-43595e1e3ccd","year":2016},"citing_paper":{"arxiv_id":"2507.06230","last_updated":"2025-07-25T14:31:34Z","snapshot_observed_at":"2026-08-07T14:43:47.586033Z","submitted_at":"2025-07-08T17:59:50Z","title":"Feed-Forward SceneDINO for Unsupervised Semantic Scene Completion","version":2},"reference_index":91,"source":"arxiv_source","source_observed_at":"2026-08-06T19:14:02.997107Z"},"links":{"citing_paper":"/paper/2507.06230"},"observation_digest":"sha256:3e312d3958cf218b989b6843b073187242b1eefb3e21523c4a29212a4eee5346","observation_id":"6cac415b-fa6c-41c9-9399-5bc2990cddaf","resolution":{"observed_at":"2026-08-06T19:14:14.004376Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:14:13.735589Z","title":"Web-scale k -means clustering","venue":null,"work_id":"47766042-c337-440f-b14e-8c1c95e5faca","year":2010},"citing_paper":{"arxiv_id":"2507.06230","last_updated":"2025-07-25T14:31:34Z","snapshot_observed_at":"2026-08-07T14:43:47.586033Z","submitted_at":"2025-07-08T17:59:50Z","title":"Feed-Forward SceneDINO for Unsupervised Semantic Scene Completion","version":2},"reference_index":92,"source":"arxiv_source","source_observed_at":"2026-08-06T19:14:03.082790Z"},"links":{"citing_paper":"/paper/2507.06230"},"observation_digest":"sha256:31976afa3466a3546ecea94b4e9a186d6c7d9a59a4e113c65e80f95c6d3a01c8","observation_id":"cd244087-c41e-4200-bc97-5b23488d9b5b","resolution":{"observed_at":"2026-08-06T19:14:13.823117Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:14:13.554675Z","title":"Leveraging hidden positives for unsupervised semantic segmentation","venue":null,"work_id":"00ccf146-36e1-4a5e-8004-dbaa8341be9e","year":2023},"citing_paper":{"arxiv_id":"2507.06230","last_updated":"2025-07-25T14:31:34Z","snapshot_observed_at":"2026-08-07T14:43:47.586033Z","submitted_at":"2025-07-08T17:59:50Z","title":"Feed-Forward SceneDINO for Unsupervised Semantic Scene Completion","version":2},"reference_index":93,"source":"arxiv_source","source_observed_at":"2026-08-06T19:14:03.150815Z"},"links":{"citing_paper":"/paper/2507.06230"},"observation_digest":"sha256:89b2ea15ad3c40a78cbd3df52e18e50f8b2bbe788b8a8ca1300514c22af92021","observation_id":"803f5948-fa9e-4bd3-9119-82d40fb71d9f","resolution":{"observed_at":"2026-08-06T19:14:13.644898Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:14:13.372766Z","title":"CLIP-Fields : W eakly supervised semantic fields for robotic memory","venue":null,"work_id":"739764cf-9cef-4c09-b181-ff696ff31d1c","year":2023},"citing_paper":{"arxiv_id":"2507.06230","last_updated":"2025-07-25T14:31:34Z","snapshot_observed_at":"2026-08-07T14:43:47.586033Z","submitted_at":"2025-07-08T17:59:50Z","title":"Feed-Forward SceneDINO for Unsupervised Semantic Scene Completion","version":2},"reference_index":94,"source":"arxiv_source","source_observed_at":"2026-08-06T19:14:03.220417Z"},"links":{"citing_paper":"/paper/2507.06230"},"observation_digest":"sha256:d94ea49d53c54242e91a2da4448daab8295ac326f55fe226b9bf98912ae7048f","observation_id":"477507c6-2942-4870-828a-73f3e0734170","resolution":{"observed_at":"2026-08-06T19:14:13.468787Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:14:13.198710Z","title":"Distilled feature fields enable few-shot language-guided manipulation","venue":null,"work_id":"d90d637d-7e5d-4cd8-93b9-06febc06c4c1","year":2023},"citing_paper":{"arxiv_id":"2507.06230","last_updated":"2025-07-25T14:31:34Z","snapshot_observed_at":"2026-08-07T14:43:47.586033Z","submitted_at":"2025-07-08T17:59:50Z","title":"Feed-Forward SceneDINO for Unsupervised Semantic Scene Completion","version":2},"reference_index":95,"source":"arxiv_source","source_observed_at":"2026-08-06T19:14:03.291199Z"},"links":{"citing_paper":"/paper/2507.06230"},"observation_digest":"sha256:e93ea1729fc57c27e07a95ff47aaa5b250ea87e8b99542e278421d6e883c382e","observation_id":"53224538-2e53-40ac-b5dd-51df881c2d5a","resolution":{"observed_at":"2026-08-06T19:14:13.273828Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:14:12.973552Z","title":"Unsupervised semantic segmentation through depth-guided feature correlation and sampling","venue":null,"work_id":"fc5c1188-9117-4911-a139-f1e307ea4c06","year":2024},"citing_paper":{"arxiv_id":"2507.06230","last_updated":"2025-07-25T14:31:34Z","snapshot_observed_at":"2026-08-07T14:43:47.586033Z","submitted_at":"2025-07-08T17:59:50Z","title":"Feed-Forward SceneDINO for Unsupervised Semantic Scene Completion","version":2},"reference_index":96,"source":"arxiv_source","source_observed_at":"2026-08-06T19:14:03.357927Z"},"links":{"citing_paper":"/paper/2507.06230"},"observation_digest":"sha256:520d02399c523c5fc73fa8d58162b19e998855092dc5e63a70aee7cab0da31e8","observation_id":"4de392a6-9208-4795-8d30-2f5872c6e100","resolution":{"observed_at":"2026-08-06T19:14:13.109436Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:14:12.767256Z","title":"Chang, Manolis Savva, and Thomas A","venue":null,"work_id":"03d630ed-be4b-49a5-97c3-814efacab21a","year":2017},"citing_paper":{"arxiv_id":"2507.06230","last_updated":"2025-07-25T14:31:34Z","snapshot_observed_at":"2026-08-07T14:43:47.586033Z","submitted_at":"2025-07-08T17:59:50Z","title":"Feed-Forward SceneDINO for Unsupervised Semantic Scene Completion","version":2},"reference_index":97,"source":"arxiv_source","source_observed_at":"2026-08-06T19:14:03.445290Z"},"links":{"citing_paper":"/paper/2507.06230"},"observation_digest":"sha256:6399bf9065e31b254f0ed8dceda3ce6fecaca8d6ced27932aebdd6e1a673b305","observation_id":"d5c99fd9-cff8-4d08-b7d8-36185f20745d","resolution":{"observed_at":"2026-08-06T19:14:12.842297Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04343","last_updated":"2025-06-01T06:23:12Z","snapshot_observed_at":"2026-07-06T18:26:42.010940Z","submitted_at":"2024-06-06T17:59:56Z","title":"Flash3D: Feed-Forward Generalisable 3D Scene Reconstruction from a Single Image","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04343","snapshot_observed_at":"2026-08-06T19:14:03.529310Z","title":"Henriques, Christian Rupprecht, and Andrea Vedaldi","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.06230","last_updated":"2025-07-25T14:31:34Z","snapshot_observed_at":"2026-08-07T14:43:47.586033Z","submitted_at":"2025-07-08T17:59:50Z","title":"Feed-Forward SceneDINO for Unsupervised Semantic Scene Completion","version":2},"reference_index":98,"source":"arxiv_source","source_observed_at":"2026-08-06T19:14:03.529310Z"},"links":{"cited_paper":"/paper/2406.04343","citing_paper":"/paper/2507.06230"},"observation_digest":"sha256:f19182cd9e673e0d8b1947445753d43b19715230a822e22802fd12290a9a9c64","observation_id":"63f526e3-14ec-4921-bddb-ea08a321e455","resolution":{"observed_at":"2026-08-06T19:14:03.529310Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:14:12.534124Z","title":"Sumner, Marc Pollefeys, Federico Tombari, and Francis Engelmann","venue":null,"work_id":"fcb6b24a-ebf6-423f-808f-723a9812006a","year":2023},"citing_paper":{"arxiv_id":"2507.06230","last_updated":"2025-07-25T14:31:34Z","snapshot_observed_at":"2026-08-07T14:43:47.586033Z","submitted_at":"2025-07-08T17:59:50Z","title":"Feed-Forward SceneDINO for Unsupervised Semantic Scene Completion","version":2},"reference_index":99,"source":"arxiv_source","source_observed_at":"2026-08-06T19:14:03.634412Z"},"links":{"citing_paper":"/paper/2507.06230"},"observation_digest":"sha256:0900b7b94261a0bb4d0be5504ad7172430671d3fb4aadd49f46f94d22f7f1f44","observation_id":"4239b79c-b33b-48d0-a136-e3af6c965109","resolution":{"observed_at":"2026-08-06T19:14:12.651484Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:14:12.313673Z","title":"RAFT : R ecurrent all-pairs field transforms for optical flow","venue":null,"work_id":"8997a667-7e34-46de-88cf-f5dcfb86ad16","year":2020},"citing_paper":{"arxiv_id":"2507.06230","last_updated":"2025-07-25T14:31:34Z","snapshot_observed_at":"2026-08-07T14:43:47.586033Z","submitted_at":"2025-07-08T17:59:50Z","title":"Feed-Forward SceneDINO for Unsupervised Semantic Scene Completion","version":2},"reference_index":100,"source":"arxiv_source","source_observed_at":"2026-08-06T19:14:03.715451Z"},"links":{"citing_paper":"/paper/2507.06230"},"observation_digest":"sha256:e0ec748614ec767f791e633f4be63be422c84d66e561b3dcf8bb9cabdf7d8678","observation_id":"d0ca2162-2fd3-4bdd-a1c7-99517cae6a9f","resolution":{"observed_at":"2026-08-06T19:14:12.384922Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.06230","last_updated":"2025-07-25T14:31:34Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T14:43:47.586033Z","submitted_at":"2025-07-08T17:59:50Z","title":"Feed-Forward SceneDINO for Unsupervised Semantic Scene Completion"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":57,"verified_exact":1,"verified_fuzzy":42},"total_outbound_references":128},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 100 of 128 outbound references and 0 inbound Pith citation observations for arXiv:2507.06230."}