{"as_of":"2026-08-09T12:09:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5c5044db43d00ad34bd03fe348fcd0da6664a118e29c93df45389e850b611b8e","coverage":[{"denominator":67,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":67,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T20:48:50.959250Z","state":"measured"},{"denominator":69,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":69,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T22:57:42.119019Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-06T14:22:13.516252Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-08T20:41:48.070033Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.04981","snapshot_observed_at":"2026-08-06T22:57:42.119019Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.20134","last_updated":"2025-06-25T05:05:09Z","snapshot_observed_at":"2026-08-09T01:32:22.356049Z","submitted_at":"2025-06-25T05:05:09Z","title":"From 2D to 3D Cognition: A Brief Survey of General World Models","version":1},"reference_index":196,"source":"pdf_text","source_observed_at":"2026-08-06T22:57:42.119019Z"},"links":{"cited_paper":"/paper/2502.04981","citing_paper":"/paper/2506.20134"},"observation_digest":"sha256:bfdcdebe1c2c5c6472d897ae26b86c02323166baceda7adbc7360a765ad67b72","observation_id":"bc6fadf5-44f1-4144-8b88-cebd7e6d8922","resolution":{"observed_at":"2026-08-06T22:57:42.119019Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-08T20:41:48.070033Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"cited_work":{"arxiv_id":"2502.04981","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.04981","snapshot_observed_at":"2026-08-06T14:22:13.516252Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","venue":"cs.CV","work_id":"d90208e3-8b46-45c0-8ade-c3f7dab8513d","year":2025},"citing_paper":{"arxiv_id":"2507.19451","last_updated":"2025-08-02T16:10:54Z","snapshot_observed_at":"2026-08-09T02:33:58.088487Z","submitted_at":"2025-07-25T17:33:23Z","title":"GS-Occ3D: Scaling Vision-only Occupancy Reconstruction with Gaussian Splatting","version":3},"reference_index":109,"source":"pdf_text","source_observed_at":"2026-08-06T14:22:13.492041Z"},"links":{"cited_paper":"/paper/2502.04981","citing_paper":"/paper/2507.19451"},"observation_digest":"sha256:b411fd4968d5839fbcca624a9440907b47d90a0d91807199cfed3f60ef2eeea7","observation_id":"8b676b73-18d7-4026-b4b1-490e6a04f247","resolution":{"observed_at":"2026-08-06T14:22:13.520963Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2502.04981/citation-record","integrity":"/paper/2502.04981/integrity","json":"/paper/2502.04981/citation-record.json","paper":"/paper/2502.04981"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2005.00928","last_updated":"2020-05-31T16:59:40Z","snapshot_observed_at":"2026-07-06T09:17:07.789326Z","submitted_at":"2020-05-02T21:45:27Z","title":"Quantifying Attention Flow in Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.00928","snapshot_observed_at":"2026-08-08T20:48:50.724239Z","title":"Quantifying atten- tion flow in transformers","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-08T20:41:48.070033Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.724239Z"},"links":{"cited_paper":"/paper/2005.00928","citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:c1cf11aa450846f68c1e315d36b1fe6957fda2342a8f80dc8f19b58bccb94900","observation_id":"0ebbbca7-d98b-4828-a18f-a5f9d9f62c76","resolution":{"observed_at":"2026-08-08T20:48:50.724239Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:48:51.649887Z","title":"Se- mantickitti: A dataset for semantic scene understanding of lidar sequences","venue":null,"work_id":"fe852cbe-9705-4184-9e40-3de1b57c14c8","year":2019},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-08T20:41:48.070033Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.728621Z"},"links":{"citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:0e6ab82bc7aeea80dd0ffc21893e628182d12762416b9f1423f7cf9dd151d0e9","observation_id":"363d3ee0-9aa6-42ad-8360-0881d58418f1","resolution":{"observed_at":"2026-08-08T20:48:51.653912Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.17310","last_updated":"2024-07-25T07:47:11Z","snapshot_observed_at":"2026-08-05T15:06:06.140557Z","submitted_at":"2024-07-24T14:22:55Z","title":"LangOcc: Self-Supervised Open Vocabulary Occupancy Estimation via Volume Rendering","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.17310","snapshot_observed_at":"2026-08-08T20:48:50.732356Z","title":"Lan- gocc: Self-supervised open vocabulary occupancy estima- tion via volume rendering.arXiv preprint arXiv:2407.17310,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-08T20:41:48.070033Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.732356Z"},"links":{"cited_paper":"/paper/2407.17310","citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:903b77cbaf5a69afb9ac231149ddadd02e087a5671370b9785e1c1853f2902a7","observation_id":"efa2c7d9-e2f8-4109-813f-4b3735ed7c8e","resolution":{"observed_at":"2026-08-08T20:48:50.732356Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12792","last_updated":"2024-02-20T08:04:12Z","snapshot_observed_at":"2026-08-06T21:20:51.317324Z","submitted_at":"2024-02-20T08:04:12Z","title":"OccFlowNet: Towards Self-supervised Occupancy Estimation via Differentiable Rendering and Occupancy Flow","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.12792","snapshot_observed_at":"2026-08-08T20:48:50.736268Z","title":"Oc- cflownet: Towards self-supervised occupancy estimation via differentiable rendering and occupancy flow","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-08T20:41:48.070033Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.736268Z"},"links":{"cited_paper":"/paper/2402.12792","citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:300af437df1d428b6b4b480a704c4eac0283f0b5e1391a3d7d883e1cba7ff65e","observation_id":"68974260-58e8-4cb0-8d3e-08ae547d8ee2","resolution":{"observed_at":"2026-08-08T20:48:50.736268Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:48:51.638491Z","title":"Monoscene: Monoc- ular 3d semantic scene completion","venue":null,"work_id":"ef12cc98-1b12-45e4-8b39-eccf1ec8627c","year":2022},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-08T20:41:48.070033Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.740298Z"},"links":{"citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:b31858f94a4dad527835059517040b2cb40f14016fde0bd4370c556c8b8cc154","observation_id":"cd8daab9-1551-4f61-be30-df683c63b81a","resolution":{"observed_at":"2026-08-08T20:48:51.642454Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:48:51.627536Z","title":"Pointbev: A sparse approach for bev predictions","venue":null,"work_id":"295007c4-02f1-4084-80ef-001264e0585d","year":2024},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-08T20:41:48.070033Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.743884Z"},"links":{"citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:c99c2b57f416e1d16921f54fae4871c79413e15ced0bc3d3649cdf80a9ad86cb","observation_id":"60261df1-4f3a-47bd-b997-e04426a84774","resolution":{"observed_at":"2026-08-08T20:48:51.631447Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:48:51.616191Z","title":"Seal: Self- supervised embodied active learning using exploration and 3d consistency","venue":null,"work_id":"7890e4c0-bf53-4b5d-97c8-dac4b2f2bd0d","year":2021},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-08T20:41:48.070033Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.747537Z"},"links":{"citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:4117bdd17d0fdf96e69ad32096e2ab618b34fd563f6e1fc3f9eba025ffeca045","observation_id":"16df6a2f-c8ca-4181-a24a-5fffdf89eb96","resolution":{"observed_at":"2026-08-08T20:48:51.620162Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:48:51.604734Z","title":"V oxelnext: Fully sparse voxelnet for 3d object detection and tracking","venue":null,"work_id":"a4ee0534-05c0-41ad-8651-51bde852d2ea","year":2023},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-08T20:41:48.070033Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.751027Z"},"links":{"citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:af58bb186ed5379135ead5d20d03bb458e0f99e6b2d6ae95a2a981815c3be405","observation_id":"14530e2d-c362-44e0-bfdf-97d7cf080ce8","resolution":{"observed_at":"2026-08-08T20:48:51.608711Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:48:50.754330Z","title":"Internvl: Scaling up vision foundation mod- els and aligning for generic visual-linguistic tasks","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-08T20:41:48.070033Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.754330Z"},"links":{"citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:916e324173da3f54150b677ff4c2b756cc37bbf305dffb30ed9128d8d905d63e","observation_id":"3637c3b9-30f1-48fa-acbd-12fd8de8253d","resolution":{"observed_at":"2026-08-08T20:48:50.754330Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:48:51.586067Z","title":"Yolo-world: Real-time open- vocabulary object detection","venue":null,"work_id":"bfdf4b6c-850b-4cd4-978a-5a20bd40fb89","year":2024},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-08T20:41:48.070033Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.757604Z"},"links":{"citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:03f159500ce972011608eb192be1f3390c9f7888ae2c28433d5e32141ff7d57a","observation_id":"6552a8e2-d3f8-4f9a-8b31-a8d0aaf11794","resolution":{"observed_at":"2026-08-08T20:48:51.590249Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:48:51.574872Z","title":"A point set generation network for 3d object reconstruction from a single image","venue":null,"work_id":"8e7c979b-dece-4dfe-800d-8229d75cb67a","year":2017},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-08T20:41:48.070033Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.761097Z"},"links":{"citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:d26f10655d4b03040c4b005358f3c74ecc6b8d53c2764f1de03a9e29f75974ae","observation_id":"872cfebd-c95d-4d9e-a59e-c732805b836d","resolution":{"observed_at":"2026-08-08T20:48:51.578964Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.03175","last_updated":"2024-11-23T13:09:50Z","snapshot_observed_at":"2026-07-06T18:25:48.914502Z","submitted_at":"2024-06-05T12:07:39Z","title":"Dynamic 3D Gaussian Fields for Urban Areas","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.03175","snapshot_observed_at":"2026-08-08T20:48:50.764570Z","title":"Dy- namic 3d gaussian fields for urban areas","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-08T20:41:48.070033Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.764570Z"},"links":{"cited_paper":"/paper/2406.03175","citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:4d9aa6d0e5868a542a7ef8d8b038de54bbbeeef98e1c12e7bbba18abe89957a2","observation_id":"f73c8c7f-5033-4aaa-b22e-3aed6b224096","resolution":{"observed_at":"2026-08-08T20:48:50.764570Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:48:51.563837Z","title":"Gaussianocc: Fully self-supervised and effi- cient 3d occupancy estimation with gaussian splatting.arXiv e-prints, 2024","venue":null,"work_id":"90199226-c0c5-4d1a-bd8f-16fe10e4a5cc","year":2024},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-08T20:41:48.070033Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.768198Z"},"links":{"citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:5ad5b343689d7dbbc97cce062a6d86b97a004d19c4cc1932dda90b259d8b043e","observation_id":"9ab928a1-467c-406c-978a-5b5276f0be4a","resolution":{"observed_at":"2026-08-08T20:48:51.567838Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:48:51.552046Z","title":"A comprehensive framework for 3d occupancy estimation in autonomous driving","venue":null,"work_id":"0016c623-d39a-4d3f-863d-a5daa56a6544","year":2024},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-08T20:41:48.070033Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.771811Z"},"links":{"citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:d8ad03a2bc2128dc63d823b8809d3eb70926b97401e9b75a3280f9192ca7ff00","observation_id":"40e8d076-887c-4f97-8d78-3e7046b5183d","resolution":{"observed_at":"2026-08-08T20:48:51.556079Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:48:51.541167Z","title":"Simple-bev: What really matters for multi-sensor bev perception? In ICRA, pages 2759–2765","venue":null,"work_id":"a165c637-89bb-48de-8c62-2335f254f3aa","year":2023},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-08T20:41:48.070033Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.775485Z"},"links":{"citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:c61537fdc0fe8efea657647154d94c8c0a14b971503383da881852d1f8fcdeec","observation_id":"acf5e5ef-619d-4cc2-aa58-443372483634","resolution":{"observed_at":"2026-08-08T20:48:51.545131Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:48:51.530297Z","title":"Tri-perspective view for vision-based 3d se- mantic occupancy prediction","venue":null,"work_id":"4caaf969-bcaf-4683-baad-6d8dc71da366","year":null},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-08T20:41:48.070033Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.778707Z"},"links":{"citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:c94c511f3eca4ecdc35d8d7de3bdd64a9e791f0235f9a02112751ee9f3979d1f","observation_id":"46f8949a-4595-4543-9f9a-8d821dc87fe1","resolution":{"observed_at":"2026-08-08T20:48:51.534440Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:48:51.518780Z","title":"Selfocc: Self-supervised vision-based 3d oc- cupancy prediction","venue":null,"work_id":"6192342f-8e83-4422-8dff-a4eff73a426f","year":2024},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-08T20:41:48.070033Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.782163Z"},"links":{"citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:c2c57ae3f51f4c6dbd4231ac8ba7b44fbaad5c346c6061395933ed2d7623c9ea","observation_id":"4c6115fd-d6f2-45e3-ab19-90048d524e93","resolution":{"observed_at":"2026-08-08T20:48:51.523259Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:48:51.508239Z","title":"Segment anything in high qual- ity","venue":null,"work_id":"bf43dddf-5ece-425d-82eb-72c4a70597ae","year":2024},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-08T20:41:48.070033Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.785583Z"},"links":{"citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:8f1c940ef1fdf9cb3654ad3816db6048a980b9cf72410c63f96ad761283a4fd2","observation_id":"b9ba0290-b416-4906-8483-1e6fde5e1a8c","resolution":{"observed_at":"2026-08-08T20:48:51.511664Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:48:50.789080Z","title":"3d gaussian splatting for real-time radiance field rendering","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-08T20:41:48.070033Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.789080Z"},"links":{"citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:b22b7a9d200b3c100fc659e829594d4e316d5a9ee8b776bf2844c077ed28e2ca","observation_id":"4a42e28e-6000-4ca7-b56d-32c629911407","resolution":{"observed_at":"2026-08-08T20:48:50.789080Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:48:51.491812Z","title":"Segment any- thing","venue":null,"work_id":"0a2e6922-48a9-4976-ab0d-2206cd966528","year":2023},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-08T20:41:48.070033Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.793035Z"},"links":{"citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:c2b82f3d4ec365b8fe26d919735cb0b7f575a9a989e8db16ef7e74db9fbf480e","observation_id":"012631ac-3a0e-47b6-8839-4675370b0f1f","resolution":{"observed_at":"2026-08-08T20:48:51.495204Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15639","last_updated":"2023-02-23T19:14:52Z","snapshot_observed_at":"2026-07-06T13:58:22.032846Z","submitted_at":"2022-09-30T17:59:52Z","title":"F-VLM: Open-Vocabulary Object Detection upon Frozen Vision and Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.15639","snapshot_observed_at":"2026-08-08T20:48:50.796941Z","title":"F-vlm: Open-vocabulary object detec- tion upon frozen vision and language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-08T20:41:48.070033Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.796941Z"},"links":{"cited_paper":"/paper/2209.15639","citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:47db5dd8b4138e572174aacdca532cdedfbc1e3bc594958d5b3877b13416ad97","observation_id":"1b2a88f8-3331-4f65-b549-d1edd7db2922","resolution":{"observed_at":"2026-08-08T20:48:50.796941Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:48:50.800743Z","title":"Grounded language-image pre-training","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-08T20:41:48.070033Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.800743Z"},"links":{"citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:9c90d7dd57b31dfeead95e493b615e7843c5a8c5fe43fb6f63246d49bee83802","observation_id":"5dc41fca-e1cf-45af-ad03-555a9c7dc988","resolution":{"observed_at":"2026-08-08T20:48:50.800743Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:48:51.475770Z","title":"Unifying voxel-based representation with transformer for 3d object detection","venue":null,"work_id":"4d080a5c-824e-4891-ad74-32804d08e102","year":null},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-08T20:41:48.070033Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.803969Z"},"links":{"citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:b92c2e9b56c5bad1412d551c1f042f4de49907f093e4c1c300c7ce66c771bf1c","observation_id":"bc88f851-aba7-4281-9748-30fe11807407","resolution":{"observed_at":"2026-08-08T20:48:51.479149Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:48:51.465790Z","title":"V oxel field fusion for 3d object detection","venue":null,"work_id":"72fea361-8acd-4adb-bdf8-d7b9b42ec0ea","year":2022},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-08T20:41:48.070033Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.807392Z"},"links":{"citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:90960ae7fe943ca2b7d6a13b263400389435cf7ae08f952f55244122b88f738d","observation_id":"fc8f6f93-c473-4c5c-a950-704cd9979111","resolution":{"observed_at":"2026-08-08T20:48:51.469214Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:48:51.455049Z","title":"Fast-bev: A fast and strong bird’s-eye view perception baseline","venue":null,"work_id":"868b5ca3-bf56-463b-b3ff-4fb490560450","year":2024},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-08T20:41:48.070033Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.810846Z"},"links":{"citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:d451069f4da0ea9ee4633c52a762bff5b306316b2bf12a90401ae7bc415ed204","observation_id":"04850b70-b9d8-42cc-89e8-1d1e3af29e1d","resolution":{"observed_at":"2026-08-08T20:48:51.459203Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:48:50.814308Z","title":"Bevformer: Learning bird’s-eye-view representation from multi-camera images via spatiotemporal transformers","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-08T20:41:48.070033Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.814308Z"},"links":{"citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:37eb5fc8cc5b689a9a58c6c6a5589ac49ee1e22580b792d8a8f1c0d9fb4978d9","observation_id":"05d2b313-ff90-44af-9f53-f1582ebaae43","resolution":{"observed_at":"2026-08-08T20:48:50.814308Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.01492","last_updated":"2023-07-04T05:55:54Z","snapshot_observed_at":"2026-07-06T15:50:02.603016Z","submitted_at":"2023-07-04T05:55:54Z","title":"FB-OCC: 3D Occupancy Prediction based on Forward-Backward View Transformation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.01492","snapshot_observed_at":"2026-08-08T20:48:50.818612Z","title":"Fb-occ: 3d occupancy prediction based on forward-backward view transformation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-08T20:41:48.070033Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.818612Z"},"links":{"cited_paper":"/paper/2307.01492","citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:908dacd79fb5c99e586e3d33a355e493df7e2f87e7924680b2bbad91976341b3","observation_id":"fd31fb11-a82a-4bd5-94ef-5be6f521448f","resolution":{"observed_at":"2026-08-08T20:48:50.818612Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:48:51.437808Z","title":"Generative region-language pretraining for open-ended object detection","venue":null,"work_id":"ba01743c-fa4b-4e3e-abf8-f8638029907e","year":2024},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-08T20:41:48.070033Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.822650Z"},"links":{"citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:d9b2e723f005daedc4a94bf92e0f307ddf6188c178a41bec11b09bf042916c71","observation_id":"34fd9619-5f52-4d34-b1e0-e4b005e7328c","resolution":{"observed_at":"2026-08-08T20:48:51.441889Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.05963","last_updated":"2024-10-08T12:15:08Z","snapshot_observed_at":"2026-07-06T19:29:42.190813Z","submitted_at":"2024-10-08T12:15:08Z","title":"Training-Free Open-Ended Object Detection and Segmentation via Attention as Prompts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.05963","snapshot_observed_at":"2026-08-08T20:48:50.826026Z","title":"Training-free open-ended object detection and segmentation via attention as prompts","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-08T20:41:48.070033Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.826026Z"},"links":{"cited_paper":"/paper/2410.05963","citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:24e24840984971478697e6a1e673d49e3c3f365782bae93f4c624a71d0b8e393","observation_id":"75b5572e-7504-4007-8d20-c4e7427762e8","resolution":{"observed_at":"2026-08-08T20:48:50.826026Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.05499","last_updated":"2024-07-19T06:00:41Z","snapshot_observed_at":"2026-07-06T15:00:58.804337Z","submitted_at":"2023-03-09T18:52:16Z","title":"Grounding DINO: Marrying DINO with Grounded Pre-Training for Open-Set Object Detection","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.05499","snapshot_observed_at":"2026-08-08T20:48:50.830008Z","title":"Grounding dino: Marrying dino with grounded pre-training for open-set object detection","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-08T20:41:48.070033Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.830008Z"},"links":{"cited_paper":"/paper/2303.05499","citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:dcbe16e1d40406d0cf9187a6f0e47ace31948d0b62f32158da03f39a74ef4204","observation_id":"2bd136ec-4d68-4223-9aa5-9db4c29eedf0","resolution":{"observed_at":"2026-08-08T20:48:50.830008Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:48:50.833808Z","title":"Grounding dino: Marrying dino with grounded pre-training for open-set object detection","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-08T20:41:48.070033Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.833808Z"},"links":{"citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:dbff3ca849de2056a36bf0cb26187596d18843073c2341c67349dec3fd684997","observation_id":"8681004c-267e-4a4e-ae6c-1e82db332a09","resolution":{"observed_at":"2026-08-08T20:48:50.833808Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:48:51.421360Z","title":"Ovir-3d: Open-vocabulary 3d in- stance retrieval without training on 3d data","venue":null,"work_id":"ec5c3651-50b8-4f52-a899-8f5f1b36692e","year":2023},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-08T20:41:48.070033Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.837198Z"},"links":{"citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:a3219107c7b536a2a4c817c87aae576472d314e55f6e7f881f06ca57b04f522b","observation_id":"4502e5e2-7b68-44b1-8e07-59c302058249","resolution":{"observed_at":"2026-08-08T20:48:51.424860Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:48:51.411412Z","title":"Bev- guided multi-modality fusion for driving perception","venue":null,"work_id":"002f6649-5390-41c9-b195-8e805cb6fea2","year":2023},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-08T20:41:48.070033Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.840496Z"},"links":{"citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:80f73668bcb94dd9730a9d4370e7ebcfe602da3dbffbb44b4bbf45b06cfbc940","observation_id":"ae7a9c20-55ea-46fe-9c95-e063204e7bcb","resolution":{"observed_at":"2026-08-08T20:48:51.414913Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09117","last_updated":"2023-06-15T13:23:57Z","snapshot_observed_at":"2026-08-03T12:21:58.910868Z","submitted_at":"2023-06-15T13:23:57Z","title":"UniOcc: Unifying Vision-Centric 3D Occupancy Prediction with Geometric and Semantic Rendering","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.09117","snapshot_observed_at":"2026-08-08T20:48:50.843877Z","title":"Uniocc: Unifying vision-centric 3d oc- cupancy prediction with geometric and semantic rendering","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-08T20:41:48.070033Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.843877Z"},"links":{"cited_paper":"/paper/2306.09117","citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:e301fb1c70c5424a8d78b6ac1d94efa1d611b6106045047c7b7952fad8a15feb","observation_id":"45bc247b-1b9e-4bee-9ffe-1a9405655f1e","resolution":{"observed_at":"2026-08-08T20:48:50.843877Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:48:51.400940Z","title":"Renderocc: Vision-centric 3d occupancy predic- tion with 2d rendering supervision","venue":null,"work_id":"9f0b70c0-b97f-442d-9105-850aa6577ae8","year":2024},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-08T20:41:48.070033Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.848127Z"},"links":{"citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:0bce304d3419b35acae4a1052c6be9306de14b889af5838186a7b24be44fc8fc","observation_id":"27b5a7f9-c75a-4cad-afec-7b39faec5891","resolution":{"observed_at":"2026-08-08T20:48:51.404510Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:48:50.851433Z","title":"Unidepth: Universal monocular metric depth estimation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-08T20:41:48.070033Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.851433Z"},"links":{"citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:dcadab527a5d9eb584b3db7a86d8c34504074633321f37317840708a2d3a498d","observation_id":"ff91df43-bf24-4763-a594-af5217f14414","resolution":{"observed_at":"2026-08-08T20:48:50.851433Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:48:51.384792Z","title":"Langsplat: 3d language gaussian splatting","venue":null,"work_id":"e7d2ac30-5db2-4102-94df-2cf7ae557ea3","year":2024},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-08T20:41:48.070033Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.854689Z"},"links":{"citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:c50d14709c7d714410647031bcfa6928b24b71a84470d5c120ae0bf7426e751f","observation_id":"8cee80d3-2717-4712-b36e-a92e7e1d3eee","resolution":{"observed_at":"2026-08-08T20:48:51.388008Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:48:51.375223Z","title":"Occupancy anticipation for efficient exploration and navigation","venue":null,"work_id":"0751ac19-b18b-4faf-a230-aefaed56c51e","year":2020},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-08T20:41:48.070033Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.858127Z"},"links":{"citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:43167dcf1bb84a7b911902b8f9edcbe19394faa7fbcafc0287fd19801d6c32ec","observation_id":"72edf2c1-44ab-41a3-902e-686eadb44922","resolution":{"observed_at":"2026-08-08T20:48:51.378496Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:48:51.365483Z","title":"An exploration of embodied visual exploration","venue":null,"work_id":"1880f95c-ab17-4002-8004-baccfd25d2f7","year":2021},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-08T20:41:48.070033Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.861560Z"},"links":{"citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:974a1661de8cb710baabf83071a363f6053e28c8f7339e059f865461108328fc","observation_id":"44ee7f17-e675-4904-94c1-34c7d8f60ebe","resolution":{"observed_at":"2026-08-08T20:48:51.369210Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00714","last_updated":"2024-10-28T16:37:57Z","snapshot_observed_at":"2026-07-06T18:55:41.459417Z","submitted_at":"2024-08-01T17:00:08Z","title":"SAM 2: Segment Anything in Images and Videos","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00714","snapshot_observed_at":"2026-08-08T20:48:50.864869Z","title":"Sam 2: Segment anything in images and videos","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-08T20:41:48.070033Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.864869Z"},"links":{"cited_paper":"/paper/2408.00714","citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:bdc97bbcc9b47974284fea3bbe6869ada10274ba461747108e0471dee37c65d8","observation_id":"cbec6a56-a437-4105-b584-7d80edc186ab","resolution":{"observed_at":"2026-08-08T20:48:50.864869Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.14159","last_updated":"2024-01-25T13:12:09Z","snapshot_observed_at":"2026-07-06T17:20:25.138890Z","submitted_at":"2024-01-25T13:12:09Z","title":"Grounded SAM: Assembling Open-World Models for Diverse Visual Tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.14159","snapshot_observed_at":"2026-08-08T20:48:50.868716Z","title":"Grounded sam: Assembling open-world models for diverse visual tasks","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-08T20:41:48.070033Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.868716Z"},"links":{"cited_paper":"/paper/2401.14159","citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:6cb0c8e68c904fa5057e4c8b0ae87a22b90e015b44db512d5b3d36efab65db1a","observation_id":"b5618c75-ba58-47a0-9f65-9c8e90dfbbbb","resolution":{"observed_at":"2026-08-08T20:48:50.868716Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:48:51.355569Z","title":"Toward open set recogni- tion","venue":null,"work_id":"1ad12519-4777-42e3-af79-700a19181b18","year":2012},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-08T20:41:48.070033Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.872479Z"},"links":{"citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:5d7c47d7289af89ab3f425c9b9880b1980bb9148a19c72e492a0a218072ebd21","observation_id":"021fbf40-8309-444a-8c18-8dcb0345d550","resolution":{"observed_at":"2026-08-08T20:48:51.359318Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.04049","last_updated":"2024-07-04T16:46:22Z","snapshot_observed_at":"2026-08-07T08:28:43.686955Z","submitted_at":"2024-07-04T16:46:22Z","title":"Occupancy as Set of Points","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.04049","snapshot_observed_at":"2026-08-08T20:48:50.876193Z","title":"Occupancy as set of points","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-08T20:41:48.070033Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.876193Z"},"links":{"cited_paper":"/paper/2407.04049","citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:3ff1d19b03a233e9e858e9ab0b77c3eff5a8bcac7311f144345b2fe69dc8982e","observation_id":"176c8bbb-3410-4717-82fa-1f41a2310081","resolution":{"observed_at":"2026-08-08T20:48:50.876193Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.16133","last_updated":"2023-06-14T17:30:54Z","snapshot_observed_at":"2026-07-06T15:33:23.984280Z","submitted_at":"2023-05-25T15:07:25Z","title":"OVO: Open-Vocabulary Occupancy","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.16133","snapshot_observed_at":"2026-08-08T20:48:50.879865Z","title":"Ovo: Open-vocabulary occupancy","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-08T20:41:48.070033Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.879865Z"},"links":{"cited_paper":"/paper/2305.16133","citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:99d9e88bb67ac07cf4b0e460c930bae5957a221e1338c4bb581ce08376d97279","observation_id":"ef45b3f8-05bd-43bc-af56-551071fbdd1c","resolution":{"observed_at":"2026-08-08T20:48:50.879865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12753","last_updated":"2024-12-21T06:32:24Z","snapshot_observed_at":"2026-07-06T19:18:08.790424Z","submitted_at":"2024-09-19T13:16:04Z","title":"DrivingForward: Feed-forward 3D Gaussian Splatting for Driving Scene Reconstruction from Flexible Surround-view Input","version":2},"cited_work":{"arxiv_id":"2409.12753","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.12753","snapshot_observed_at":"2026-08-08T20:48:51.049675Z","title":"DrivingForward: Feed-forward 3D Gaussian Splatting for Driving Scene Reconstruction from Flexible Surround-view Input","venue":"cs.CV","work_id":"fa93a00d-0819-412d-b8e7-066e8217d280","year":2024},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-08T20:41:48.070033Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.883687Z"},"links":{"cited_paper":"/paper/2409.12753","citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:9ff8ab41248061a731b1612e276cbf3c1713d55ea1c3c8c1bc9dd7eac69f61a0","observation_id":"259f4773-d1ee-4e2d-8f65-06f5aa282026","resolution":{"observed_at":"2026-08-08T20:48:51.055857Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:48:51.345737Z","title":"Occ3d: A large-scale 3d occupancy prediction benchmark for autonomous driving","venue":null,"work_id":"6ffb1993-c857-44a3-8fb7-42f2b228cb3b","year":2024},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-08T20:41:48.070033Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.887368Z"},"links":{"citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:41afb37b20925126c89db1b627d1c5e34a9238d09d0c186743884cdad163e24e","observation_id":"18490f20-22f6-4b3f-b03e-ba9b7cbba544","resolution":{"observed_at":"2026-08-08T20:48:51.349308Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:48:51.336053Z","title":"Scene as occupancy","venue":null,"work_id":"8e39e601-5edf-415d-a9c4-dd9477dd2893","year":2023},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-08T20:41:48.070033Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.890508Z"},"links":{"citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:1fb64d08d020151ddc57849e9d25ce3ac3760fa9433a01ad0f3104926f96c955","observation_id":"3a69d98f-00f2-46d3-91ae-9459be769d44","resolution":{"observed_at":"2026-08-08T20:48:51.339378Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:48:51.326407Z","title":"Learning-based 3d occupancy prediction for autonomous navigation in occluded environments","venue":null,"work_id":"bd4517a0-265a-4f85-a380-8ab481d7544a","year":2021},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-08T20:41:48.070033Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.893897Z"},"links":{"citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:d26a7b83ac7226735ba8c37b48ed9065c1815ec91d3733ff067f91dba8b3d7b2","observation_id":"b9da35ea-2525-4124-a9af-681fa4314a89","resolution":{"observed_at":"2026-08-08T20:48:51.329805Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:48:51.315857Z","title":"Openoccupancy: A large scale benchmark for sur- rounding semantic occupancy perception","venue":null,"work_id":"88e57fbd-04ec-4886-9898-0bbcc7ebddc4","year":2023},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-08T20:41:48.070033Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.897237Z"},"links":{"citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:c35156a18d4f425b4ec0e2db7c4a79b219f825cc1a1b80f34c4c453ea7edb38b","observation_id":"ff532603-98d8-4bcd-ac38-7846151eabac","resolution":{"observed_at":"2026-08-08T20:48:51.319785Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:48:51.304675Z","title":"Panoocc: Unified occupancy representation for camera-based 3d panoptic segmentation","venue":null,"work_id":"e70288bb-0824-494b-99cf-862d8e0fcc31","year":2024},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-08T20:41:48.070033Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.900463Z"},"links":{"citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:0965987d726ccfb004822fcb48a4d7b15075c54fe4b51a23118c891607cceec3","observation_id":"ccbc12f5-a866-41f0-b268-b46d0ab77314","resolution":{"observed_at":"2026-08-08T20:48:51.308704Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:48:51.293424Z","title":"Surroundocc: Multi-camera 3d occu- pancy prediction for autonomous driving","venue":null,"work_id":"c0e5c449-cab1-47de-a8d1-d62683247ad5","year":2023},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-08T20:41:48.070033Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.903983Z"},"links":{"citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:2923982f7cce02f24163affe52f0278aba49114062661745b0e4999e4f0ba877","observation_id":"149cf87e-5580-49f5-9b83-cb7a89376486","resolution":{"observed_at":"2026-08-08T20:48:51.297483Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:48:51.283362Z","title":"Towards open vocabulary learning: A survey","venue":null,"work_id":"d372173a-427a-4580-8e07-2db0462d99ea","year":2024},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-08T20:41:48.070033Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.907362Z"},"links":{"citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:7534b65c399122091e90deeab0c48d377c353ffaffe9c8dd635eaa0734aae8ec","observation_id":"92254872-b683-421f-b406-1b8a3565eb74","resolution":{"observed_at":"2026-08-08T20:48:51.286790Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2105.09996","last_updated":"2021-09-30T22:43:19Z","snapshot_observed_at":"2026-08-09T10:51:26.347744Z","submitted_at":"2021-05-20T19:13:27Z","title":"VLM: Task-agnostic Video-Language Model Pre-training for Video Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2105.09996","snapshot_observed_at":"2026-08-08T20:48:50.910615Z","title":"Vlm: Task-agnostic video- language model pre-training for video understanding","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-08T20:41:48.070033Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.910615Z"},"links":{"cited_paper":"/paper/2105.09996","citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:3d26a9115f6ad731b33383bec907d78919483afaca9e392ee4bfa186bbba096c","observation_id":"44be1a16-d6c4-49e7-8b77-9b3ced128894","resolution":{"observed_at":"2026-08-08T20:48:50.910615Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.17707","last_updated":"2025-02-04T11:40:44Z","snapshot_observed_at":"2026-07-06T16:54:26.205948Z","submitted_at":"2023-11-29T15:11:03Z","title":"SAMPro3D: Locating SAM Prompts in 3D for Zero-Shot Instance Segmentation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.17707","snapshot_observed_at":"2026-08-08T20:48:50.914157Z","title":"Sampro3d: Locating sam prompts in 3d for zero-shot scene segmentation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-08T20:41:48.070033Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.914157Z"},"links":{"cited_paper":"/paper/2311.17707","citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:b1dd3b3ace514234f719017bdf73fd131ee9009367c02d0d52e5bd98cb2267cf","observation_id":"7397b869-ce68-4b24-bc86-38f30f5262df","resolution":{"observed_at":"2026-08-08T20:48:50.914157Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:48:51.273245Z","title":"Depth anything: Unleashing the power of large-scale unlabeled data","venue":null,"work_id":"5902da52-89a0-41d5-b98d-a184cc94b31e","year":2024},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-08T20:41:48.070033Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.917690Z"},"links":{"citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:93e6c2dfb5e67a3ba5dbe3a40cfdba488a814587b2efa3fd47d099e015bd8d88","observation_id":"ae2d79e7-2e48-4304-b2b1-afb1b31321f9","resolution":{"observed_at":"2026-08-08T20:48:51.276919Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12058","last_updated":"2023-11-18T15:28:09Z","snapshot_observed_at":"2026-07-06T16:50:10.189504Z","submitted_at":"2023-11-18T15:28:09Z","title":"FlashOcc: Fast and Memory-Efficient Occupancy Prediction via Channel-to-Height Plugin","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.12058","snapshot_observed_at":"2026-08-08T20:48:50.921031Z","title":"Flashocc: Fast and memory-efficient occupancy prediction via channel-to-height plugin","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-08T20:41:48.070033Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.921031Z"},"links":{"cited_paper":"/paper/2311.12058","citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:2b977b323d4ff6a30fce2116e3af44b8a3b79ec687f54fcbc088ce98b067e957","observation_id":"75ef95cd-0b93-4059-8640-4df25798e329","resolution":{"observed_at":"2026-08-08T20:48:50.921031Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:48:51.263522Z","title":"Mip-splatting: Alias-free 3d gaussian splat- ting","venue":null,"work_id":"7e9f411e-3365-43d2-a521-291addd2798e","year":2024},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-08T20:41:48.070033Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.924687Z"},"links":{"citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:4567511baaa8e7dfa4618ce879907c2fedea0a5e51244b0a8f0d6f6b04139d9e","observation_id":"1a294b78-3c4e-4ec4-bbca-8b9a85703393","resolution":{"observed_at":"2026-08-08T20:48:51.266876Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.14289","last_updated":"2023-07-01T07:26:22Z","snapshot_observed_at":"2026-08-08T16:17:33.420400Z","submitted_at":"2023-06-25T16:37:25Z","title":"Faster Segment Anything: Towards Lightweight SAM for Mobile Applications","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.14289","snapshot_observed_at":"2026-08-08T20:48:50.927878Z","title":"Faster segment anything: Towards lightweight sam for mo- bile applications","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-08T20:41:48.070033Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.927878Z"},"links":{"cited_paper":"/paper/2306.14289","citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:d23dd4cc94e26e9c36b213fea3e34ca31c1b2fb2883ca70a1086d8d00743190c","observation_id":"c127ef22-2971-432b-95dd-1a653525869b","resolution":{"observed_at":"2026-08-08T20:48:50.927878Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:48:51.252776Z","title":"Occnerf: Self- supervised multi-camera occupancy prediction with neural radiance fields","venue":null,"work_id":"73bc0a48-cad4-41f4-8125-eec7bc692d54","year":2023},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-08T20:41:48.070033Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.931716Z"},"links":{"citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:de1b73287dc60f8a888b9e57d0106265a9991ecfe30f126045d720b87764b825","observation_id":"3e29bdbd-5488-480d-b1ab-e62e58b2e79c","resolution":{"observed_at":"2026-08-08T20:48:51.256755Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.02245","last_updated":"2024-01-29T12:14:04Z","snapshot_observed_at":"2026-07-06T15:37:39.433980Z","submitted_at":"2023-06-04T03:09:21Z","title":"SAM3D: Zero-Shot 3D Object Detection via Segment Anything Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.02245","snapshot_observed_at":"2026-08-08T20:48:50.934951Z","title":"Sam3d: Zero-shot 3d object detection via segment anything model","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-08T20:41:48.070033Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.934951Z"},"links":{"cited_paper":"/paper/2306.02245","citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:8b8e4ccee9bece9ec3e4e48f948452f33e4176ebef91ac6428888aa7914398fe","observation_id":"d6082a33-428b-4efd-b9a6-c7662690ca45","resolution":{"observed_at":"2026-08-08T20:48:50.934951Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:48:51.241902Z","title":"A simple framework for open-vocabulary segmentation and detection","venue":null,"work_id":"f1717ab1-5546-4636-8b90-fc117d5e37be","year":2023},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-08T20:41:48.070033Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.938603Z"},"links":{"citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:727d13685b41d668ece6511d80e863e8c4775fa4a14e54b4cd160b2cd0cf7d61","observation_id":"7bed5d03-6f66-4a43-9b9b-bd51adf9e5ad","resolution":{"observed_at":"2026-08-08T20:48:51.245410Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:48:51.231635Z","title":"Occformer: Dual-path transformer for vision-based 3d semantic occu- pancy prediction","venue":null,"work_id":"de2407bc-b67c-48c0-aa8f-b97467b2e207","year":2023},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-08T20:41:48.070033Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.941849Z"},"links":{"citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:a90faf063c952fe22728bc21e6d0194591b73f3ba0a088a4ef94f31c326ab21c","observation_id":"df0793c7-b6f0-49d6-b683-54af6856508f","resolution":{"observed_at":"2026-08-08T20:48:51.235179Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:48:51.221445Z","title":"Lif-seg: Lidar and camera image fusion for 3d lidar semantic segmentation","venue":null,"work_id":"412e101b-45ff-4466-8c15-efa0a4df2a2e","year":2023},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-08T20:41:48.070033Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.945104Z"},"links":{"citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:517ad8e8d27ed2a28129437a9da54a23457bad4bd67e92e9155b5e2f92c03b5e","observation_id":"6a4da08e-c1d5-4653-9cac-a0d64cacc371","resolution":{"observed_at":"2026-08-08T20:48:51.225086Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:48:51.211105Z","title":"Fusion of 3d lidar and camera data for object detection in autonomous vehicle applications","venue":null,"work_id":"6608918c-a038-4e59-83f7-d53bfd690cd5","year":2020},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-08T20:41:48.070033Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.948381Z"},"links":{"citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:2636636df64ada275c878ee0279cb302f9d3521067fdaa595327f2a0d81f08ae","observation_id":"f76d3d72-780f-43a2-a577-a3353834c0cd","resolution":{"observed_at":"2026-08-08T20:48:51.214739Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.12156","last_updated":"2023-06-21T10:08:29Z","snapshot_observed_at":"2026-07-06T15:45:01.961896Z","submitted_at":"2023-06-21T10:08:29Z","title":"Fast Segment Anything","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.12156","snapshot_observed_at":"2026-08-08T20:48:50.952298Z","title":"Fast segment any- thing","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-08T20:41:48.070033Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.952298Z"},"links":{"cited_paper":"/paper/2306.12156","citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:09f00bc810c739edccf11ddeb60548a93afaaec0ed3336f4789def1720b37d07","observation_id":"378c12ce-98db-4d27-8978-e10e961668c1","resolution":{"observed_at":"2026-08-08T20:48:50.952298Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:48:51.200786Z","title":"Veon: V ocabulary- enhanced occupancy prediction","venue":null,"work_id":"7774ee29-e0ee-41b8-9c59-389a916a8f38","year":2025},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-08T20:41:48.070033Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.955773Z"},"links":{"citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:73e5149d6c758ea0930761d3530de3ad3ae86047ca8e612ac037c3011ff2bde6","observation_id":"d262675d-9802-463a-a15d-684735b033e4","resolution":{"observed_at":"2026-08-08T20:48:51.204351Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:48:50.959250Z","title":"Drivinggaussian: Composite gaussian splatting for surrounding dynamic au- tonomous driving scenes","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-08T20:41:48.070033Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.959250Z"},"links":{"citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:da2decc9e7966615cc87d6bb8eb49a5b604023a51429d8d0ad41d7ff7750df6b","observation_id":"0b321e15-4d84-4612-a200-aa7d70e1dab3","resolution":{"observed_at":"2026-08-08T20:48:50.959250Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","latest_version":3,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-08T20:41:48.070033Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting"},"reference_resolution":{"displayed":67,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":26,"verified_exact":1,"verified_fuzzy":40},"total_outbound_references":67},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 67 of 67 outbound references and 2 inbound Pith citation observations for arXiv:2502.04981."}