{"as_of":"2026-08-08T00:17:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:93cd1b7ff0355026c902276ef2f0e0cf4387665539de9d75855b75fef89a8e9d","coverage":[{"denominator":33,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":33,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T18:42:35.337862Z","state":"measured"},{"denominator":35,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":35,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T16:14:24.893121Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2603.06210","last_updated":"2026-07-22T08:10:14Z","snapshot_observed_at":"2026-08-02T18:42:31.711170Z","submitted_at":"2026-03-06T12:26:47Z","title":"VG3S: Visual Geometry Grounded Gaussian Splatting for Semantic Occupancy Prediction","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2603.06210","snapshot_observed_at":"2026-08-01T16:14:24.893121Z","title":"arXiv preprint arXiv:2603.06210 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18078","last_updated":"2026-07-20T15:46:30Z","snapshot_observed_at":"2026-08-06T18:08:43.304981Z","submitted_at":"2026-07-20T15:46:30Z","title":"VGOcc: Learning Visual-Geometric Gaussians for Vision-Centric 3D Driving Occupancy Prediction","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-01T16:14:24.893121Z"},"links":{"cited_paper":"/paper/2603.06210","citing_paper":"/paper/2607.18078"},"observation_digest":"sha256:1bf9e7467ce1b15619cbe66941e7731d509baea847bcce7e5e41b4a6dd0dced5","observation_id":"19445059-62fe-4b0b-acd9-c48489791544","resolution":{"observed_at":"2026-08-01T16:14:24.893121Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2603.06210","last_updated":"2026-07-22T08:10:14Z","snapshot_observed_at":"2026-08-02T18:42:31.711170Z","submitted_at":"2026-03-06T12:26:47Z","title":"VG3S: Visual Geometry Grounded Gaussian Splatting for Semantic Occupancy Prediction","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2603.06210","snapshot_observed_at":"2026-08-01T06:31:52.076033Z","title":"arXiv preprint arXiv:2603.06210 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.21896","last_updated":"2026-07-24T01:52:49Z","snapshot_observed_at":"2026-08-01T06:31:44.702781Z","submitted_at":"2026-07-24T01:52:49Z","title":"Learning Adaptive Semantic Gaussian Allocation for 3D Occupancy","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-01T06:31:52.076033Z"},"links":{"cited_paper":"/paper/2603.06210","citing_paper":"/paper/2607.21896"},"observation_digest":"sha256:457c3d4c84a8dc73ed02eb638af73545a2961b8cd6ff660bcc9280f917befb9e","observation_id":"d81e830c-6007-4d6a-ab59-fc13ec0cefa4","resolution":{"observed_at":"2026-08-01T06:31:52.076033Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2603.06210/citation-record","integrity":"/paper/2603.06210/integrity","json":"/paper/2603.06210/citation-record.json","paper":"/paper/2603.06210"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:42:32.350640Z","title":"Renderocc: Vision-centric 3d occupancy prediction with 2d rendering supervision,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.06210","last_updated":"2026-07-22T08:10:14Z","snapshot_observed_at":"2026-08-02T18:42:31.711170Z","submitted_at":"2026-03-06T12:26:47Z","title":"VG3S: Visual Geometry Grounded Gaussian Splatting for Semantic Occupancy Prediction","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-02T18:42:32.350640Z"},"links":{"citing_paper":"/paper/2603.06210"},"observation_digest":"sha256:1bccb4e888ade47d22763ee63509f62e218a0257897a583c2390b3a5d7bf0e26","observation_id":"f0f4c30d-cf07-468c-ad2f-2512b3ada71c","resolution":{"observed_at":"2026-08-02T18:42:32.350640Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:42:32.422501Z","title":"Sept: Standard-definition map enhanced scene perception and topology reasoning for autonomous driving,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.06210","last_updated":"2026-07-22T08:10:14Z","snapshot_observed_at":"2026-08-02T18:42:31.711170Z","submitted_at":"2026-03-06T12:26:47Z","title":"VG3S: Visual Geometry Grounded Gaussian Splatting for Semantic Occupancy Prediction","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-02T18:42:32.422501Z"},"links":{"citing_paper":"/paper/2603.06210"},"observation_digest":"sha256:d6e2efb2f90e9d9a3da634f6982c312ff56fb943311d6109d7c7825d6ec33ba6","observation_id":"2448474a-6b36-4ff0-840a-aa3d91b1cc30","resolution":{"observed_at":"2026-08-02T18:42:32.422501Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:42:32.505066Z","title":"Detr3d: 3d object detection from multi-view images via 3d-to-2d queries,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2603.06210","last_updated":"2026-07-22T08:10:14Z","snapshot_observed_at":"2026-08-02T18:42:31.711170Z","submitted_at":"2026-03-06T12:26:47Z","title":"VG3S: Visual Geometry Grounded Gaussian Splatting for Semantic Occupancy Prediction","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-02T18:42:32.505066Z"},"links":{"citing_paper":"/paper/2603.06210"},"observation_digest":"sha256:745977d037a6b363e2557ea62609d8b723ac2f4a867a1e3858891d12de0982ba","observation_id":"fcad1f68-76e1-44cd-8f72-e8a7797675e0","resolution":{"observed_at":"2026-08-02T18:42:32.505066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:42:32.586407Z","title":"Stereo neural vernier caliper,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2603.06210","last_updated":"2026-07-22T08:10:14Z","snapshot_observed_at":"2026-08-02T18:42:31.711170Z","submitted_at":"2026-03-06T12:26:47Z","title":"VG3S: Visual Geometry Grounded Gaussian Splatting for Semantic Occupancy Prediction","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-02T18:42:32.586407Z"},"links":{"citing_paper":"/paper/2603.06210"},"observation_digest":"sha256:d1815ab63aa851e924340dac76890959db4556284f1bf5addfe2d5ff04685685","observation_id":"37b3b5a8-8e5b-48b9-bd69-d89c53507a8a","resolution":{"observed_at":"2026-08-02T18:42:32.586407Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:42:32.672559Z","title":"Learning better represen- tations for crowded pedestrians in offboard lidar-camera 3d tracking- by-detection,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.06210","last_updated":"2026-07-22T08:10:14Z","snapshot_observed_at":"2026-08-02T18:42:31.711170Z","submitted_at":"2026-03-06T12:26:47Z","title":"VG3S: Visual Geometry Grounded Gaussian Splatting for Semantic Occupancy Prediction","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-02T18:42:32.672559Z"},"links":{"citing_paper":"/paper/2603.06210"},"observation_digest":"sha256:a2de49ee2d783dc4c9c57057d8651f8c2ffef7363db89f28fbac282f52838c9b","observation_id":"5f4f2555-8cfa-40da-86d4-a9ba1700f2ef","resolution":{"observed_at":"2026-08-02T18:42:32.672559Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:42:32.756999Z","title":"V oxformer: Sparse voxel transformer for camera- based 3d semantic scene completion,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.06210","last_updated":"2026-07-22T08:10:14Z","snapshot_observed_at":"2026-08-02T18:42:31.711170Z","submitted_at":"2026-03-06T12:26:47Z","title":"VG3S: Visual Geometry Grounded Gaussian Splatting for Semantic Occupancy Prediction","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-02T18:42:32.756999Z"},"links":{"citing_paper":"/paper/2603.06210"},"observation_digest":"sha256:d7927a7a24bbe427b74791f038bc6814036e05718fa664e8938884ff52ec55c5","observation_id":"a3dcdbcc-7e14-472a-babe-6add4b334fc6","resolution":{"observed_at":"2026-08-02T18:42:32.756999Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:42:32.907152Z","title":"Octnet: Learning deep 3d representations at high resolutions,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2603.06210","last_updated":"2026-07-22T08:10:14Z","snapshot_observed_at":"2026-08-02T18:42:31.711170Z","submitted_at":"2026-03-06T12:26:47Z","title":"VG3S: Visual Geometry Grounded Gaussian Splatting for Semantic Occupancy Prediction","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-02T18:42:32.907152Z"},"links":{"citing_paper":"/paper/2603.06210"},"observation_digest":"sha256:f5e62a04f9f613fdd1bd40720aa9c40dd4fde6e403aa6f234a1c30095d374731","observation_id":"3117190f-0b77-43f6-a3df-8bda5a17fd9e","resolution":{"observed_at":"2026-08-02T18:42:32.907152Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:42:33.025884Z","title":"Bevformer: Learning bird’s-eye-view representation from multi-camera images via spatiotemporal transformers,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2603.06210","last_updated":"2026-07-22T08:10:14Z","snapshot_observed_at":"2026-08-02T18:42:31.711170Z","submitted_at":"2026-03-06T12:26:47Z","title":"VG3S: Visual Geometry Grounded Gaussian Splatting for Semantic Occupancy Prediction","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-02T18:42:33.025884Z"},"links":{"citing_paper":"/paper/2603.06210"},"observation_digest":"sha256:336102a17eb37cd393e2f6feef35e349e6c63e1d4d83e03a3d8f815b2ccdc8f8","observation_id":"3c723844-6868-4fa0-8f6c-06dd6b51014c","resolution":{"observed_at":"2026-08-02T18:42:33.025884Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:42:33.117942Z","title":"Goirl: Graph-oriented inverse reinforcement learning for multimodal trajectory prediction,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.06210","last_updated":"2026-07-22T08:10:14Z","snapshot_observed_at":"2026-08-02T18:42:31.711170Z","submitted_at":"2026-03-06T12:26:47Z","title":"VG3S: Visual Geometry Grounded Gaussian Splatting for Semantic Occupancy Prediction","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-02T18:42:33.117942Z"},"links":{"citing_paper":"/paper/2603.06210"},"observation_digest":"sha256:fc12b603576034484165d8427ff296773e669f9518e76d1c6d942c0c1eaebb06","observation_id":"ed2a6685-3785-4133-9c3e-faa6f9017c7e","resolution":{"observed_at":"2026-08-02T18:42:33.117942Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:42:33.190453Z","title":"Gaussianformer: Scene as gaussians for vision-based 3d semantic occupancy predic- tion,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.06210","last_updated":"2026-07-22T08:10:14Z","snapshot_observed_at":"2026-08-02T18:42:31.711170Z","submitted_at":"2026-03-06T12:26:47Z","title":"VG3S: Visual Geometry Grounded Gaussian Splatting for Semantic Occupancy Prediction","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-02T18:42:33.190453Z"},"links":{"citing_paper":"/paper/2603.06210"},"observation_digest":"sha256:6f35aee381f3b47144fcf5efa83ffd27104e8931ac303c8864e46e3d7ca0450c","observation_id":"dce344da-3dae-43dc-9061-13373a78ff01","resolution":{"observed_at":"2026-08-02T18:42:33.190453Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:42:33.256694Z","title":"Gaussianformer-2: Probabilistic gaussian superposition for efficient 3d occupancy prediction,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.06210","last_updated":"2026-07-22T08:10:14Z","snapshot_observed_at":"2026-08-02T18:42:31.711170Z","submitted_at":"2026-03-06T12:26:47Z","title":"VG3S: Visual Geometry Grounded Gaussian Splatting for Semantic Occupancy Prediction","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-02T18:42:33.256694Z"},"links":{"citing_paper":"/paper/2603.06210"},"observation_digest":"sha256:66ce0c6fc30a2dc6df5b6c6821be212f6b14c9f194d04cf7bff791d3c33683f4","observation_id":"a350c00c-7292-4c83-92da-86b2ef99fcff","resolution":{"observed_at":"2026-08-02T18:42:33.256694Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:42:33.315727Z","title":"3d gaussian splatting for real-time radiance field rendering,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.06210","last_updated":"2026-07-22T08:10:14Z","snapshot_observed_at":"2026-08-02T18:42:31.711170Z","submitted_at":"2026-03-06T12:26:47Z","title":"VG3S: Visual Geometry Grounded Gaussian Splatting for Semantic Occupancy Prediction","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-02T18:42:33.315727Z"},"links":{"citing_paper":"/paper/2603.06210"},"observation_digest":"sha256:18dd6e72a7de46be770a65c7dfb602c4705d503a078d869c6f60cf39492da0d0","observation_id":"7360b3d1-4f13-400d-9c45-34aa060d13b2","resolution":{"observed_at":"2026-08-02T18:42:33.315727Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:42:33.368375Z","title":"Vggt: Visual geometry grounded transformer,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.06210","last_updated":"2026-07-22T08:10:14Z","snapshot_observed_at":"2026-08-02T18:42:31.711170Z","submitted_at":"2026-03-06T12:26:47Z","title":"VG3S: Visual Geometry Grounded Gaussian Splatting for Semantic Occupancy Prediction","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-02T18:42:33.368375Z"},"links":{"citing_paper":"/paper/2603.06210"},"observation_digest":"sha256:76beca3e4f83732ff1342312d931091d433083ba79b6682e7ae2763bd5787abe","observation_id":"5b4056a4-7a61-4a4d-bee0-9070a0b428fe","resolution":{"observed_at":"2026-08-02T18:42:33.368375Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:42:33.409683Z","title":"Occformer: Dual-path transformer for vision-based 3d semantic occupancy prediction,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.06210","last_updated":"2026-07-22T08:10:14Z","snapshot_observed_at":"2026-08-02T18:42:31.711170Z","submitted_at":"2026-03-06T12:26:47Z","title":"VG3S: Visual Geometry Grounded Gaussian Splatting for Semantic Occupancy Prediction","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-02T18:42:33.409683Z"},"links":{"citing_paper":"/paper/2603.06210"},"observation_digest":"sha256:94225b8a855961fe7e28b9f145957b5b3d218d1357debea15d4981064a15cbad","observation_id":"11b60ef3-49d6-44fb-a8d3-1b39359208d4","resolution":{"observed_at":"2026-08-02T18:42:33.409683Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:42:33.486416Z","title":"Surroundocc: Multi-camera 3d occupancy prediction for autonomous driving,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.06210","last_updated":"2026-07-22T08:10:14Z","snapshot_observed_at":"2026-08-02T18:42:31.711170Z","submitted_at":"2026-03-06T12:26:47Z","title":"VG3S: Visual Geometry Grounded Gaussian Splatting for Semantic Occupancy Prediction","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-02T18:42:33.486416Z"},"links":{"citing_paper":"/paper/2603.06210"},"observation_digest":"sha256:edd87abf200f40470dd3d90a02f4aecd649c5d0efadc0d59d0ec9eec3c227015","observation_id":"9d800a3a-4c34-4f64-85bb-bf47afff0b50","resolution":{"observed_at":"2026-08-02T18:42:33.486416Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:42:33.535253Z","title":"Tri-perspective view for vision-based 3d semantic occupancy prediction,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.06210","last_updated":"2026-07-22T08:10:14Z","snapshot_observed_at":"2026-08-02T18:42:31.711170Z","submitted_at":"2026-03-06T12:26:47Z","title":"VG3S: Visual Geometry Grounded Gaussian Splatting for Semantic Occupancy Prediction","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-02T18:42:33.535253Z"},"links":{"citing_paper":"/paper/2603.06210"},"observation_digest":"sha256:00b9779c0dfc63c8a7261d0180ff5e4c3269727394d44107cb318d40b51cec47","observation_id":"915e1c11-53df-417b-a472-cbe8005f810c","resolution":{"observed_at":"2026-08-02T18:42:33.535253Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:42:33.597710Z","title":"Nerf: Representing scenes as neural radiance fields for view synthesis,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2603.06210","last_updated":"2026-07-22T08:10:14Z","snapshot_observed_at":"2026-08-02T18:42:31.711170Z","submitted_at":"2026-03-06T12:26:47Z","title":"VG3S: Visual Geometry Grounded Gaussian Splatting for Semantic Occupancy Prediction","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-02T18:42:33.597710Z"},"links":{"citing_paper":"/paper/2603.06210"},"observation_digest":"sha256:62247fdc5939914a146db1bfa12f4b1b1a51cd312f1fc8863097badd9bf69b7b","observation_id":"ba129239-fb25-4493-99c7-3afb57683b65","resolution":{"observed_at":"2026-08-02T18:42:33.597710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:42:33.667281Z","title":"Emerging properties in self-supervised vision trans- formers,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2603.06210","last_updated":"2026-07-22T08:10:14Z","snapshot_observed_at":"2026-08-02T18:42:31.711170Z","submitted_at":"2026-03-06T12:26:47Z","title":"VG3S: Visual Geometry Grounded Gaussian Splatting for Semantic Occupancy Prediction","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-02T18:42:33.667281Z"},"links":{"citing_paper":"/paper/2603.06210"},"observation_digest":"sha256:e7df710b4fcf0fa99f8d69bd66efcf4c0d1c51e2646aba1eb866b77a90472f32","observation_id":"dcf4d44a-c27e-49d1-8f7c-0815ec2d3139","resolution":{"observed_at":"2026-08-02T18:42:33.667281Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.07193","last_updated":"2024-02-02T10:24:09Z","snapshot_observed_at":"2026-08-06T05:58:29.182448Z","submitted_at":"2023-04-14T15:12:19Z","title":"DINOv2: Learning Robust Visual Features without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.07193","snapshot_observed_at":"2026-08-02T18:42:33.717143Z","title":"Dinov2: Learning robust visual features without supervision,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.06210","last_updated":"2026-07-22T08:10:14Z","snapshot_observed_at":"2026-08-02T18:42:31.711170Z","submitted_at":"2026-03-06T12:26:47Z","title":"VG3S: Visual Geometry Grounded Gaussian Splatting for Semantic Occupancy Prediction","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-02T18:42:33.717143Z"},"links":{"cited_paper":"/paper/2304.07193","citing_paper":"/paper/2603.06210"},"observation_digest":"sha256:e26c999eb60491c163a406c30f7f6682c05388daef0a10340e055c41777b4d6c","observation_id":"d02a81e8-9be1-4a21-ae08-c889fd1c9914","resolution":{"observed_at":"2026-08-02T18:42:33.717143Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10104","last_updated":"2025-08-13T18:00:55Z","snapshot_observed_at":"2026-07-06T22:12:35.584339Z","submitted_at":"2025-08-13T18:00:55Z","title":"DINOv3","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.10104","snapshot_observed_at":"2026-08-02T18:42:33.794259Z","title":"Sim ´eoni, H","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.06210","last_updated":"2026-07-22T08:10:14Z","snapshot_observed_at":"2026-08-02T18:42:31.711170Z","submitted_at":"2026-03-06T12:26:47Z","title":"VG3S: Visual Geometry Grounded Gaussian Splatting for Semantic Occupancy Prediction","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-02T18:42:33.794259Z"},"links":{"cited_paper":"/paper/2508.10104","citing_paper":"/paper/2603.06210"},"observation_digest":"sha256:f3272bc357321a6af9b2438489b2d4e6a8257816556348c9ff9f66c1e196966b","observation_id":"d0ca6a89-3463-4442-b688-cb5f6aa4632e","resolution":{"observed_at":"2026-08-02T18:42:33.794259Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2512.16919","last_updated":"2026-06-03T07:14:50Z","snapshot_observed_at":"2026-08-04T02:28:30.870384Z","submitted_at":"2025-12-18T18:59:57Z","title":"DVGT: Driving Visual Geometry Transformer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2512.16919","snapshot_observed_at":"2026-08-02T18:42:33.849280Z","title":"Dvgt: Driving visual geometry transformer,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.06210","last_updated":"2026-07-22T08:10:14Z","snapshot_observed_at":"2026-08-02T18:42:31.711170Z","submitted_at":"2026-03-06T12:26:47Z","title":"VG3S: Visual Geometry Grounded Gaussian Splatting for Semantic Occupancy Prediction","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-02T18:42:33.849280Z"},"links":{"cited_paper":"/paper/2512.16919","citing_paper":"/paper/2603.06210"},"observation_digest":"sha256:2ac2894df3bc725edcd61073e93aba710679dca9497b445fdc6d3dd9edaf4d16","observation_id":"41f573b6-169d-488a-91a2-293a2f35732d","resolution":{"observed_at":"2026-08-02T18:42:33.849280Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:42:33.952726Z","title":"Dggt: Feedforward 4d reconstruction of dynamic driving scenes using unposed images,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.06210","last_updated":"2026-07-22T08:10:14Z","snapshot_observed_at":"2026-08-02T18:42:31.711170Z","submitted_at":"2026-03-06T12:26:47Z","title":"VG3S: Visual Geometry Grounded Gaussian Splatting for Semantic Occupancy Prediction","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-02T18:42:33.952726Z"},"links":{"citing_paper":"/paper/2603.06210"},"observation_digest":"sha256:3b040c33d8f2b4be269542b76fe287bd977288e1b5822100f80d85bfe18b5699","observation_id":"929624b6-9cc3-4bb1-a5fa-81f38f79d6da","resolution":{"observed_at":"2026-08-02T18:42:33.952726Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:42:34.007673Z","title":"Vg3t: Visual geometry grounded gaussian transformer,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.06210","last_updated":"2026-07-22T08:10:14Z","snapshot_observed_at":"2026-08-02T18:42:31.711170Z","submitted_at":"2026-03-06T12:26:47Z","title":"VG3S: Visual Geometry Grounded Gaussian Splatting for Semantic Occupancy Prediction","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-02T18:42:34.007673Z"},"links":{"citing_paper":"/paper/2603.06210"},"observation_digest":"sha256:8ded6591f6a7e6d6c50f3daffc578a8cdf0ba878489c91d7ca65aadc8cdb11d9","observation_id":"56251663-15f2-4963-b781-3d905b4f5afa","resolution":{"observed_at":"2026-08-02T18:42:34.007673Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:42:34.113149Z","title":"Vision transform- ers need registers,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.06210","last_updated":"2026-07-22T08:10:14Z","snapshot_observed_at":"2026-08-02T18:42:31.711170Z","submitted_at":"2026-03-06T12:26:47Z","title":"VG3S: Visual Geometry Grounded Gaussian Splatting for Semantic Occupancy Prediction","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-02T18:42:34.113149Z"},"links":{"citing_paper":"/paper/2603.06210"},"observation_digest":"sha256:718b60a4c45e1313dfbfeae505722a6c8ca65831e64fb46ba427d54ffd756ee1","observation_id":"3ceaab46-bf31-453a-923f-dbea86042c19","resolution":{"observed_at":"2026-08-02T18:42:34.113149Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:42:34.120032Z","title":"Vggsfm: Visual geometry grounded deep structure from motion,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.06210","last_updated":"2026-07-22T08:10:14Z","snapshot_observed_at":"2026-08-02T18:42:31.711170Z","submitted_at":"2026-03-06T12:26:47Z","title":"VG3S: Visual Geometry Grounded Gaussian Splatting for Semantic Occupancy Prediction","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-02T18:42:34.120032Z"},"links":{"citing_paper":"/paper/2603.06210"},"observation_digest":"sha256:01ba062d1e991af0f4f1c1cf13fd69483578dfe782dd590570bb479a8d3bf181","observation_id":"f607a997-82eb-4919-99f0-a39fd1a7b554","resolution":{"observed_at":"2026-08-02T18:42:34.120032Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:42:34.304009Z","title":"Squeeze-and-excitation networks,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2603.06210","last_updated":"2026-07-22T08:10:14Z","snapshot_observed_at":"2026-08-02T18:42:31.711170Z","submitted_at":"2026-03-06T12:26:47Z","title":"VG3S: Visual Geometry Grounded Gaussian Splatting for Semantic Occupancy Prediction","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-02T18:42:34.304009Z"},"links":{"citing_paper":"/paper/2603.06210"},"observation_digest":"sha256:2110eb9ae6db2dc247438a0f59ae7d87ec663a8a0a06e3b3f83a0a5c624b4df3","observation_id":"144e3fcd-d1aa-422a-822a-f1d22ebe48cb","resolution":{"observed_at":"2026-08-02T18:42:34.304009Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:42:34.520657Z","title":"Vision transformers for dense prediction,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2603.06210","last_updated":"2026-07-22T08:10:14Z","snapshot_observed_at":"2026-08-02T18:42:31.711170Z","submitted_at":"2026-03-06T12:26:47Z","title":"VG3S: Visual Geometry Grounded Gaussian Splatting for Semantic Occupancy Prediction","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-02T18:42:34.520657Z"},"links":{"citing_paper":"/paper/2603.06210"},"observation_digest":"sha256:843519b7a75270282c65bf2c43d9efe3d95b28b0e33c8d10b412990db0c7b908","observation_id":"215dfe88-ad47-458b-8081-6d7192dcd7f8","resolution":{"observed_at":"2026-08-02T18:42:34.520657Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:42:34.700673Z","title":"Viewformer: Exploring spatiotemporal modeling for multi-view 3d occupancy per- ception via view-guided transformers,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.06210","last_updated":"2026-07-22T08:10:14Z","snapshot_observed_at":"2026-08-02T18:42:31.711170Z","submitted_at":"2026-03-06T12:26:47Z","title":"VG3S: Visual Geometry Grounded Gaussian Splatting for Semantic Occupancy Prediction","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-02T18:42:34.700673Z"},"links":{"citing_paper":"/paper/2603.06210"},"observation_digest":"sha256:9e559bbf31ad892c980ca41968095bc27353a0adeff54c44e263bb8985332578","observation_id":"fb1450f3-50d4-4c80-a166-59de05e0d574","resolution":{"observed_at":"2026-08-02T18:42:34.700673Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:42:34.832353Z","title":"St-gs: Vision-based 3d semantic occupancy prediction with spatial-temporal gaussian splatting,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2603.06210","last_updated":"2026-07-22T08:10:14Z","snapshot_observed_at":"2026-08-02T18:42:31.711170Z","submitted_at":"2026-03-06T12:26:47Z","title":"VG3S: Visual Geometry Grounded Gaussian Splatting for Semantic Occupancy Prediction","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-02T18:42:34.832353Z"},"links":{"citing_paper":"/paper/2603.06210"},"observation_digest":"sha256:37af1fb158a82bc0d2d83f5e4a8e7844215d33fb62aa9747832645544aa13163","observation_id":"f63325c2-6fe8-4564-a1e6-4d874e05e902","resolution":{"observed_at":"2026-08-02T18:42:34.832353Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:42:34.979138Z","title":"The lov ´asz- softmax loss: A tractable surrogate for the optimization of the intersection-over-union measure in neural networks,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2603.06210","last_updated":"2026-07-22T08:10:14Z","snapshot_observed_at":"2026-08-02T18:42:31.711170Z","submitted_at":"2026-03-06T12:26:47Z","title":"VG3S: Visual Geometry Grounded Gaussian Splatting for Semantic Occupancy Prediction","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-02T18:42:34.979138Z"},"links":{"citing_paper":"/paper/2603.06210"},"observation_digest":"sha256:250528a78e6785c6beb5d791c44da3175991d0f3bd0d9d9b794affbf81122f0b","observation_id":"6db4e8ed-0706-4174-852f-f642ec0d66b0","resolution":{"observed_at":"2026-08-02T18:42:34.979138Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:42:35.107327Z","title":"Monoscene: Monocular 3d semantic scene completion,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2603.06210","last_updated":"2026-07-22T08:10:14Z","snapshot_observed_at":"2026-08-02T18:42:31.711170Z","submitted_at":"2026-03-06T12:26:47Z","title":"VG3S: Visual Geometry Grounded Gaussian Splatting for Semantic Occupancy Prediction","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-02T18:42:35.107327Z"},"links":{"citing_paper":"/paper/2603.06210"},"observation_digest":"sha256:d5e5198762e1466b5effd17ae3bffe824f134079a3a45862bbbd2f13f4bdf1df","observation_id":"1d42b9f7-b1e8-4ada-82ae-5be4b192d436","resolution":{"observed_at":"2026-08-02T18:42:35.107327Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:42:35.163729Z","title":"Atlas: End-to-end 3d scene reconstruction from posed images,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2603.06210","last_updated":"2026-07-22T08:10:14Z","snapshot_observed_at":"2026-08-02T18:42:31.711170Z","submitted_at":"2026-03-06T12:26:47Z","title":"VG3S: Visual Geometry Grounded Gaussian Splatting for Semantic Occupancy Prediction","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-02T18:42:35.163729Z"},"links":{"citing_paper":"/paper/2603.06210"},"observation_digest":"sha256:0d701c522c6be967c5ade2e06d7279b280ab81596a81f6fb2a8649487ad95493","observation_id":"d82eb386-dfa8-42f9-9fb2-aeb62d45028c","resolution":{"observed_at":"2026-08-02T18:42:35.163729Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:42:35.337862Z","title":"nuscenes: A multimodal dataset for autonomous driving,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2603.06210","last_updated":"2026-07-22T08:10:14Z","snapshot_observed_at":"2026-08-02T18:42:31.711170Z","submitted_at":"2026-03-06T12:26:47Z","title":"VG3S: Visual Geometry Grounded Gaussian Splatting for Semantic Occupancy Prediction","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-02T18:42:35.337862Z"},"links":{"citing_paper":"/paper/2603.06210"},"observation_digest":"sha256:a2bf6952382748364189bd6afc00bfecb31809200d39adf205b10ab2664c0e1f","observation_id":"8d962325-e58d-4617-b92f-61928e5248a8","resolution":{"observed_at":"2026-08-02T18:42:35.337862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2603.06210","last_updated":"2026-07-22T08:10:14Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-02T18:42:31.711170Z","submitted_at":"2026-03-06T12:26:47Z","title":"VG3S: Visual Geometry Grounded Gaussian Splatting for Semantic Occupancy Prediction"},"reference_resolution":{"displayed":33,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":33,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":33},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 33 of 33 outbound references and 2 inbound Pith citation observations for arXiv:2603.06210."}