{"as_of":"2026-08-08T01:12:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3389bad07fcec173466d9148dc08a235263aa469296bcb84ede49e19b47de6b3","coverage":[{"denominator":89,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":89,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T10:44:39.773683Z","state":"measured"},{"denominator":92,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":92,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T04:24:23.190818Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-06-29T13:33:27.972020Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-07T10:35:02.758982Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.04623","snapshot_observed_at":"2026-08-06T04:24:23.190818Z","title":"Voxdet: Rethinking 3d semantic occupancy prediction as dense object detection","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.03596","last_updated":"2025-08-05T16:01:00Z","snapshot_observed_at":"2026-08-07T10:46:52.112708Z","submitted_at":"2025-08-05T16:01:00Z","title":"MetaScope: Optics-Driven Neural Network for Ultra-Micro Metalens Endoscopy","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-06T04:24:23.190818Z"},"links":{"cited_paper":"/paper/2506.04623","citing_paper":"/paper/2508.03596"},"observation_digest":"sha256:cab0148d643bccab645f8fb854384ef66227d455a0491a777e1b5426c7ae0c92","observation_id":"b5aa5931-fd8a-4b3a-b488-054f74686891","resolution":{"observed_at":"2026-08-06T04:24:23.190818Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-07T10:35:02.758982Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"cited_work":{"arxiv_id":"2506.04623","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.04623","snapshot_observed_at":"2026-06-29T13:33:27.972020Z","title":"arXiv preprint arXiv:2506.04623 (2025) 1","venue":null,"work_id":"f5c5edcd-3f27-43f0-97cb-aec703fef003","year":2025},"citing_paper":{"arxiv_id":"2605.15424","last_updated":"2026-05-14T21:16:01Z","snapshot_observed_at":"2026-08-02T23:58:50.734903Z","submitted_at":"2026-05-14T21:16:01Z","title":"Social-Mamba: Socially-Aware Trajectory Forecasting with State-Space Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-19T15:18:45.615875Z"},"links":{"cited_paper":"/paper/2506.04623","citing_paper":"/paper/2605.15424"},"observation_digest":"sha256:3c55a9f15a6b0fcf57869f6468a8ef3cd417fc4ef8cc73bd11d728914f94b9f0","observation_id":"2784a536-a90b-420e-84b5-6bb658801eb9","resolution":{"observed_at":"2026-05-19T15:22:37.450789Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-07T10:35:02.758982Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"cited_work":{"arxiv_id":"2506.04623","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.04623","snapshot_observed_at":"2026-06-29T13:33:27.972020Z","title":"arXiv preprint arXiv:2506.04623 (2025) 1","venue":null,"work_id":"f5c5edcd-3f27-43f0-97cb-aec703fef003","year":2025},"citing_paper":{"arxiv_id":"2605.28587","last_updated":"2026-05-27T15:09:55Z","snapshot_observed_at":"2026-08-06T22:48:39.267770Z","submitted_at":"2026-05-27T15:09:55Z","title":"Deformable Gaussian Occupancy: Decoupling Rigid and Nonrigid Motion with Factorized Distillation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-29T13:30:35.054988Z"},"links":{"cited_paper":"/paper/2506.04623","citing_paper":"/paper/2605.28587"},"observation_digest":"sha256:5574b7bbb83215de1a26cc7787212e8283609795e26558e2dc794c824b86dbb0","observation_id":"940a0e24-81d7-4fc5-92b5-aca9263ea364","resolution":{"observed_at":"2026-06-29T13:33:27.973623Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.04623/citation-record","integrity":"/paper/2506.04623/integrity","json":"/paper/2506.04623/citation-record.json","paper":"/paper/2506.04623"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:32.706523Z","title":"Social lstm: Human trajectory prediction in crowded spaces","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-07T10:35:02.758982Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:32.706523Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:e3ce293b213c2631c0bb862cb636b9411b5d69254454f776a05e2821087f3875","observation_id":"7de0928d-67e1-4a9c-b88d-a6cb4452b422","resolution":{"observed_at":"2026-08-07T10:44:32.706523Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.16129","last_updated":"2025-03-26T02:31:32Z","snapshot_observed_at":"2026-08-04T12:44:32.343454Z","submitted_at":"2024-11-25T06:33:43Z","title":"Three Cars Approaching within 100m! Enhancing Distant Geometry by Tri-Axis Voxel Scanning for Camera-based Semantic Scene Completion","version":2},"cited_work":{"arxiv_id":"2411.16129","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.16129","snapshot_observed_at":"2026-08-07T10:44:40.295477Z","title":"Three Cars Approaching within 100m! Enhancing Distant Geometry by Tri-Axis Voxel Scanning for Camera-based Semantic Scene Completion","venue":"cs.CV","work_id":"fa53d12e-5b77-49f7-a0ca-461bc1a2d7e5","year":2024},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-07T10:35:02.758982Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:32.787018Z"},"links":{"cited_paper":"/paper/2411.16129","citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:0c997f1d8ca286bab820b60872749bc3db418c1b901d3c9616fc4e8e09210d6a","observation_id":"e87d0bf1-58bb-4969-85cd-3ecaf94929f1","resolution":{"observed_at":"2026-08-07T10:44:40.298728Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:32.870789Z","title":"Semantickitti: A dataset for semantic scene understanding of lidar sequences","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-07T10:35:02.758982Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:32.870789Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:c64ce93de4445e702d7d1cb2c253af725fdc1b006817c551481fda1bc4baa447","observation_id":"4def9f36-0e5f-4ffa-9322-127bfd59e1aa","resolution":{"observed_at":"2026-08-07T10:44:32.870789Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:32.955158Z","title":"Semantickitti: A dataset for semantic scene understanding of lidar sequences","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-07T10:35:02.758982Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:32.955158Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:dc917644dc17e79e6a3467d136a637be7d36b8d88f1733d3b316625cde874528","observation_id":"faad4b38-5e86-41c6-b1b5-db103f137cbd","resolution":{"observed_at":"2026-08-07T10:44:32.955158Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:33.060150Z","title":"Adabins: Depth estimation using adaptive bins","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-07T10:35:02.758982Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:33.060150Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:a965585dedbd7ceafd8e25e5284d46eb3bc3bed30c1f2d88367447f9d41b2df8","observation_id":"a9dafacf-b749-4b0c-947d-01bbcd77b259","resolution":{"observed_at":"2026-08-07T10:44:33.060150Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:33.228624Z","title":"Monoscene: Monocular 3d semantic scene completion","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-07T10:35:02.758982Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:33.228624Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:76cc196cdcfb63f88b5926d575eadfe47b72c15d1941ec0935998530a51d4717","observation_id":"852b602a-9865-41a8-9363-0ac1058dc0e7","resolution":{"observed_at":"2026-08-07T10:44:33.228624Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:33.365579Z","title":"Pasco: Urban 3d panoptic scene completion with uncertainty awareness","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-07T10:35:02.758982Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:33.365579Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:f293ecdaa96c93adbcd7db811fe993e9e9980453dcbcf8133367c223399ff5b4","observation_id":"45198415-89a7-4c05-a4ab-cb273612058a","resolution":{"observed_at":"2026-08-07T10:44:33.365579Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:33.451770Z","title":"End-to-end object detection with transformers","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-07T10:35:02.758982Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:33.451770Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:a00094ab664c941007464951521c8c9e39c6586fe1247faa97aca733700cf943","observation_id":"14c6a6d3-b5f1-4e73-b90c-5ad9b7f06d75","resolution":{"observed_at":"2026-08-07T10:44:33.451770Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.05040","last_updated":"2025-07-07T15:05:33Z","snapshot_observed_at":"2026-08-03T19:33:24.560238Z","submitted_at":"2025-02-07T16:07:51Z","title":"GaussRender: Learning 3D Occupancy with Gaussian Rendering","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.05040","snapshot_observed_at":"2026-08-07T10:44:33.539610Z","title":"Gaussrender: Learning 3d occupancy with gaussian rendering.arXiv preprint arXiv:2502.05040, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-07T10:35:02.758982Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:33.539610Z"},"links":{"cited_paper":"/paper/2502.05040","citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:dfbfc2bdf4888d963a4fc6ef0930613a730254e4121b49537a0e0c6bab0ef40c","observation_id":"be394b1c-2e96-4315-84a1-f9be8de87b95","resolution":{"observed_at":"2026-08-07T10:44:33.539610Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:33.652764Z","title":"Domain adaptive faster r-cnn for object detection in the wild","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-07T10:35:02.758982Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:33.652764Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:c13045cac51377b6aff40c0304427beae1f16e6c17bf224f28e30dcd3b5d26e4","observation_id":"96458391-773d-454d-a533-3e2d4f8bf491","resolution":{"observed_at":"2026-08-07T10:44:33.652764Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:33.764904Z","title":"Disen- tangle your dense object detector","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-07T10:35:02.758982Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:33.764904Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:a6000cce6bcfbd7c412f1ac0a8edc647cc74d065ed2e85aba0b951725e99eb15","observation_id":"7d8f69fe-8394-4b18-888f-caa3d5cfec08","resolution":{"observed_at":"2026-08-07T10:44:33.764904Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:40.763918Z","title":"3d u-net: learning dense volumetric segmentation from sparse annotation","venue":null,"work_id":"071d30f1-df06-470b-9a98-d3cfd56a89b1","year":2016},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-07T10:35:02.758982Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:33.862806Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:30f618ce340ebba951230956bf1a7215d5fcfc57ca41e871f0a9cb0e2a5bc9d8","observation_id":"1ec2afea-4b64-4ba7-8030-86844f755cf8","resolution":{"observed_at":"2026-08-07T10:44:40.766781Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:33.951600Z","title":"Deformable convolutional networks","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-07T10:35:02.758982Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:33.951600Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:927f060166144a53a245842796cfe09261043f5739e0702744eda71b3720dbb7","observation_id":"e640fb16-fff3-4ebb-a661-3d81d05a0ea9","resolution":{"observed_at":"2026-08-07T10:44:33.951600Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:34.040500Z","title":"Worldscore: A unified evaluation benchmark for world generation.arXiv preprint arXiv:2504.00983, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-07T10:35:02.758982Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:34.040500Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:b94584a0b94dd6b850c2b6fe4053925cd2f0cf66d7bc2066d90c020a87efe32b","observation_id":"0f5d43b0-20ae-4b48-891a-418ce3f7619a","resolution":{"observed_at":"2026-08-07T10:44:34.040500Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:40.750577Z","title":"MIT press, 1993","venue":null,"work_id":"bfef3477-03fa-441b-99d6-b6f408b88f0d","year":1993},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-07T10:35:02.758982Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:34.132069Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:026d6f5b832348492d085ef118ffff1c9890cc8617623e1b28ef07a616a4c6b2","observation_id":"9121a374-af41-4d2c-a15e-b7048b053227","resolution":{"observed_at":"2026-08-07T10:44:40.753269Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:40.741131Z","title":"Two stream 3d semantic scene completion","venue":null,"work_id":"c520e371-650b-47af-83e8-41eb584a8ad3","year":2019},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-07T10:35:02.758982Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:34.219006Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:a4861748fd1f4f29ecd8570241220a0a28714a741387a91f5444560fefa3f330","observation_id":"c1a075e8-1536-48b1-88ef-146e07941711","resolution":{"observed_at":"2026-08-07T10:44:40.744798Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:34.298345Z","title":"Are we ready for autonomous driving? the kitti vision benchmark suite","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-07T10:35:02.758982Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:34.298345Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:865dc620e6a93a1e8f80d15dd435dc7bc7038af2fdf2aaa16f68aa1ec25ebc7b","observation_id":"7e9ebb3d-fc93-4916-a73e-941292dcafd3","resolution":{"observed_at":"2026-08-07T10:44:34.298345Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:34.393084Z","title":"Fast r-cnn","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-07T10:35:02.758982Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:34.393084Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:7209c2ea8924c415a1fd996ee472bb4537994769525e64c07bfad6ff98a07243","observation_id":"1ad22272-4770-42ae-af07-369a120a4efe","resolution":{"observed_at":"2026-08-07T10:44:34.393084Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:40.721774Z","title":"Sgformer: Satellite-ground fusion for 3d semantic scene completion","venue":null,"work_id":"a77d2a4d-1abb-42c3-a4f7-c08d0af3fb72","year":2025},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-07T10:35:02.758982Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:34.492587Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:7dffcfdc473007f2153e21e11b669d05578f590776ae1a423f14a68f23253df6","observation_id":"bcb51231-69e7-40f6-865d-776f4ffe4c61","resolution":{"observed_at":"2026-08-07T10:44:40.725218Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:40.713319Z","title":"Masked autoencoders are scalable vision learners","venue":null,"work_id":"ac0a8752-0e3d-4eff-8e59-1be0d9e313fc","year":2022},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-07T10:35:02.758982Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:34.569667Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:7ecfdc331eec4567168792ff32a34f88913ba0455902a2354cf62432cdd88bc6","observation_id":"2c1fa58b-fb81-47a3-a56a-acadcb8a6237","resolution":{"observed_at":"2026-08-07T10:44:40.716474Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:40.704050Z","title":"Deep residual learning for image recognition","venue":null,"work_id":"388f6f64-adc3-4320-8fad-e75bedf726ce","year":2016},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-07T10:35:02.758982Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:34.654448Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:19580246857c2b649a656a9ffdf8645e80502e8872539c4843e975e45f4ebbcf","observation_id":"37c60be4-db14-47e5-9ba0-9c6f1bff364d","resolution":{"observed_at":"2026-08-07T10:44:40.707505Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:40.694791Z","title":"Tri-perspective view for vision-based 3d semantic occupancy prediction","venue":null,"work_id":"5177a413-ce81-4ec7-8172-353769786844","year":2023},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-07T10:35:02.758982Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:34.766004Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:b5f258b35f86757d6062e2bb230fd18959a4ab41d9eb394a8712ef32a146e08a","observation_id":"a822c3ee-55eb-4a46-ba5b-3c622c782e61","resolution":{"observed_at":"2026-08-07T10:44:40.698722Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:40.686030Z","title":"Symphonize 3d semantic scene completion with contextual instance queries.Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition, 2024","venue":null,"work_id":"0de687af-cf49-443e-a03b-7bc1b464e71a","year":2024},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-07T10:35:02.758982Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:34.842585Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:eacdb7514074f399d68172c3e17c3a36fe5c3a56be0a4ed9328aaff371723252","observation_id":"6df1b956-179c-4f47-bdee-4f0c73a70d3a","resolution":{"observed_at":"2026-08-07T10:44:40.689089Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:34.953253Z","title":"Cornernet: Detecting objects as paired keypoints","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-07T10:35:02.758982Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:34.953253Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:e1b758854e4c71bf6e3d63f8c1b331a45424598216d00a8afeedab0b7eefa6d9","observation_id":"9655e51a-82ab-4a6d-969b-49bf2209418c","resolution":{"observed_at":"2026-08-07T10:44:34.953253Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:40.672141Z","title":"Hierarchical temporal context learning for camera-based semantic scene completion","venue":null,"work_id":"b42cbe94-c25a-42bf-9664-c24675da247f","year":2024},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-07T10:35:02.758982Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:35.041907Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:f9abd2c9ac5dc2989787f81d8dcee573dc29b73b75681ac5476d2ee4b6a2d595","observation_id":"d74ac408-00a6-4468-a8d9-acf7abd5b406","resolution":{"observed_at":"2026-08-07T10:44:40.675959Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.13959","last_updated":"2024-05-06T15:14:22Z","snapshot_observed_at":"2026-07-06T15:07:37.299096Z","submitted_at":"2023-03-24T12:33:44Z","title":"Bridging Stereo Geometry and BEV Representation with Reliable Mutual Interaction for Semantic Scene Completion","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.13959","snapshot_observed_at":"2026-08-07T10:44:35.121047Z","title":"Stereoscene: Bev-assisted stereo matching empowers 3d semantic scene completion.arXiv preprint arXiv:2303.13959, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-07T10:35:02.758982Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:35.121047Z"},"links":{"cited_paper":"/paper/2303.13959","citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:3db44bbda382507e0a1fa2fe42957308c54a1cf5e0ff19e8f0d010e15d394d73","observation_id":"611b32f4-2d5c-48fa-a93f-055cef8bd1cb","resolution":{"observed_at":"2026-08-07T10:44:35.121047Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:40.663869Z","title":"Instantsplamp: Fast and generalizable stenography framework for generative gaussian splatting","venue":null,"work_id":"3884c5e4-1fe9-45ff-b043-a22d18d4fc33","year":2025},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-07T10:35:02.758982Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:35.196278Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:3edc7e0cc4efb9114309277273b7a35c91b55a1f6dfa5627accae5004472fa82","observation_id":"8c1e29f8-ffa6-4930-ac55-936674326af9","resolution":{"observed_at":"2026-08-07T10:44:40.666928Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:35.283251Z","title":"U-kan makes strong backbone for medical image segmentation and generation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-07T10:35:02.758982Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:35.283251Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:c3a64c22346326ad60401e3e9813a59b658bf60b09d3c0b8b44438baf77fe0a0","observation_id":"46fb80b0-f3ca-4830-80a2-aec72e843995","resolution":{"observed_at":"2026-08-07T10:44:35.283251Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.09859","last_updated":"2025-03-11T02:14:51Z","snapshot_observed_at":"2026-08-03T21:06:32.345078Z","submitted_at":"2024-08-19T10:07:00Z","title":"OccMamba: Semantic Occupancy Prediction with State Space Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.09859","snapshot_observed_at":"2026-08-07T10:44:35.362608Z","title":"Occmamba: Semantic occupancy prediction with state space models.arXiv preprint arXiv:2408.09859, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-07T10:35:02.758982Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:35.362608Z"},"links":{"cited_paper":"/paper/2408.09859","citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:75978ff088dbd3d6ada5c5ba13cde0c05430c5d7aa417027348f98920a5b7d36","observation_id":"51dec6ca-4f57-46bf-817d-776f85cc3f74","resolution":{"observed_at":"2026-08-07T10:44:35.362608Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:40.651199Z","title":"Htd: Heterogeneous task decoupling for two-stage object detection.IEEE Transactions on Image Processing, 30:9456–9469, 2021","venue":null,"work_id":"c2f7d86b-4c2c-4e7f-828f-94e30240288b","year":2021},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-07T10:35:02.758982Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:35.473821Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:c6cd7d8b2e1e3e67c20eb12ad38676b7038321d6751dbe13270aae4dbe17b5b9","observation_id":"112ba65a-ca27-432b-90e8-f3edcf565a1c","resolution":{"observed_at":"2026-08-07T10:44:40.654254Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:40.643618Z","title":"Scan: Cross domain object detection with semantic conditioned adaptation","venue":null,"work_id":"37e536f3-766f-421f-9c6b-6a5abd52ea3f","year":2022},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-07T10:35:02.758982Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:35.559057Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:78d1ad3123e979577787186b0a63b31c025a6a7dfd2bd1cff377e890c417c676","observation_id":"5d3f6767-04fa-4d36-8457-8a0e746968df","resolution":{"observed_at":"2026-08-07T10:44:40.646510Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:40.636004Z","title":"Sigma: Semantic-complete graph matching for domain adaptive object detection","venue":null,"work_id":"d1656368-25d6-43dd-b56b-5a77ed9f6f2f","year":2022},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-07T10:35:02.758982Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:35.658794Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:18204ffe63ef38474afa94861906a6c7bd98f5eddb205e9b88e6452d0631f201","observation_id":"3aade382-6f84-4065-9781-1d189f443762","resolution":{"observed_at":"2026-08-07T10:44:40.638835Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:40.627101Z","title":"Unifying voxel- based representation with transformer for 3d object detection.Advances in Neural Information Processing Systems, 35:18442–18455, 2022","venue":null,"work_id":"99ff272c-7dd3-4df7-89f9-462dbf0ba313","year":2022},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-07T10:35:02.758982Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:35.732888Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:67c6f10df27d654131e5acdf6151ea3c2c3de06b408e29148703f9579c2a099b","observation_id":"6706dda3-2fc0-444e-b1b4-1422c5b2b7d6","resolution":{"observed_at":"2026-08-07T10:44:40.630723Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:40.618770Z","title":"Sscbench: A large-scale 3d semantic scene completion benchmark for autonomous driving, 2024","venue":null,"work_id":"c1216e39-0d65-4b7c-99da-73c922cca832","year":2024},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-07T10:35:02.758982Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:35.844717Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:2130d2685fd6fa45edb16ad9405438e7adf7fe4cadf544b7eb856d248e6e1f74","observation_id":"08434535-a2dd-4909-a154-ce4477481271","resolution":{"observed_at":"2026-08-07T10:44:40.621756Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:40.610481Z","title":"Choy, Chaowei Xiao, José M","venue":null,"work_id":"094632d6-2b28-43df-a3da-e7e82a013b12","year":2023},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-07T10:35:02.758982Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:35.937734Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:551eee818b32f8d3f499a95ad1719d9d94db31d54024a69527cbce1d43bb762c","observation_id":"84e89480-03ae-4e65-81f9-18e664c89438","resolution":{"observed_at":"2026-08-07T10:44:40.613197Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.07260","last_updated":"2025-01-13T12:18:58Z","snapshot_observed_at":"2026-08-05T22:49:31.021615Z","submitted_at":"2025-01-13T12:18:58Z","title":"Skip Mamba Diffusion for Monocular 3D Semantic Scene Completion","version":1},"cited_work":{"arxiv_id":"2501.07260","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.07260","snapshot_observed_at":"2026-08-07T10:44:40.197056Z","title":"Skip Mamba Diffusion for Monocular 3D Semantic Scene Completion","venue":"cs.CV","work_id":"b78cc599-c80c-4992-9fdf-7bd2e3787814","year":2025},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-07T10:35:02.758982Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:36.049098Z"},"links":{"cited_paper":"/paper/2501.07260","citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:12a853b270e07eb36012b3923a0cb8afe00fa843e427dc67a6522c7a571c2e27","observation_id":"b090fac3-d936-4e84-9df2-06f50138bc7d","resolution":{"observed_at":"2026-08-07T10:44:40.200213Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:40.602366Z","title":"Kitti-360: A novel dataset and benchmarks for urban scene understanding in 2d and 3d.IEEE Transactions on Pattern Analysis and Machine Intelligence, pages 3292–3310, 2022","venue":null,"work_id":"3cc923bb-70f1-4cc1-8479-a7afc08268fc","year":2022},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-07T10:35:02.758982Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:36.124112Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:dde6e22eaf33cdef8d1cbdf1ebca033b141e6e5b9d7152ab08b0e129e79754a1","observation_id":"5f79c07f-652e-46bf-8c5c-85dbf45a4c16","resolution":{"observed_at":"2026-08-07T10:44:40.605438Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:40.592811Z","title":"Kitti-360: A novel dataset and benchmarks for urban scene understanding in 2d and 3d.IEEE Transactions on Pattern Analysis and Machine Intelligence, 45(3):3292–3310, 2022","venue":null,"work_id":"e09e0d83-2bf4-44a9-b518-2cdb4d9ed133","year":2022},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-07T10:35:02.758982Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:36.231677Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:96f2e5a68d3033d26087501ff03b4cfd7a49a57ef9c0cf1b249af346920849c9","observation_id":"4bf206eb-5c83-4db1-87e4-20660ab71fa9","resolution":{"observed_at":"2026-08-07T10:44:40.597135Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:40.583056Z","title":"Feature pyramid networks for object detection","venue":null,"work_id":"7cb15c9e-a52b-460a-8336-0f4ed894c181","year":2017},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-07T10:35:02.758982Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:36.309263Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:ddb3dd75acff524f1bed76d37538ee3445c23cd93fc2fb6ddf70dc3a23c6dfdc","observation_id":"5f802b2e-e492-42bc-bbe0-00fb61a18765","resolution":{"observed_at":"2026-08-07T10:44:40.586981Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:40.574524Z","title":"Focal loss for dense object detection","venue":null,"work_id":"ad900315-91a8-4a4e-8b6c-b78c457aacf9","year":2017},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-07T10:35:02.758982Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:36.397447Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:3ffbaa37148ed6f1abf8b2ae0b4b4deb682031a0f27597275762b27f91d0401f","observation_id":"8475264d-cfe3-4dc3-a681-3e61b603b970","resolution":{"observed_at":"2026-08-07T10:44:40.577660Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:40.566361Z","title":"Lgs: A light-weight 4d gaussian splatting for efficient surgical scene reconstruction","venue":null,"work_id":"7a2d9e00-4f98-4e8d-b561-5c0424b01514","year":2024},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-07T10:35:02.758982Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:36.513903Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:47c850da3c9a8efca67d61ecccf7ce888fa9b15749766e3df51045bc70cde030","observation_id":"673ebd08-149d-4e70-b6b4-73bc789f4c49","resolution":{"observed_at":"2026-08-07T10:44:40.569389Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.15235","last_updated":"2025-05-26T14:57:30Z","snapshot_observed_at":"2026-08-07T15:19:18.741876Z","submitted_at":"2025-05-21T08:14:10Z","title":"X-GRM: Large Gaussian Reconstruction Model for Sparse-view X-rays to Computed Tomography","version":2},"cited_work":{"arxiv_id":"2505.15235","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.15235","snapshot_observed_at":"2026-08-07T10:44:40.186714Z","title":"X-GRM: Large Gaussian Reconstruction Model for Sparse-view X-rays to Computed Tomography","venue":"eess.IV","work_id":"e512c3ac-f5bc-4bf9-b623-579ac308fbfd","year":2025},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-07T10:35:02.758982Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:36.604382Z"},"links":{"cited_paper":"/paper/2505.15235","citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:79f809b6c0a50f6cfae633dccc0ba02fa20f9c4b8d9e2b8731926adcf3f734b7","observation_id":"a45d367c-d8bc-4149-be3a-e27d0dcc8cb7","resolution":{"observed_at":"2026-08-07T10:44:40.189783Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-07T10:44:36.675644Z","title":"Decoupled weight decay regularization.arXiv preprint arXiv:1711.05101, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-07T10:35:02.758982Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:36.675644Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:3c2edb3236168406b1066ccd3a318368ceaf461ba282f5ee9882ce569824ccc9","observation_id":"dc732074-fa27-474c-a6fd-ef8412295c50","resolution":{"observed_at":"2026-08-07T10:44:36.675644Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.08069","last_updated":"2024-04-03T11:46:48Z","snapshot_observed_at":"2026-07-06T15:16:23.984788Z","submitted_at":"2023-04-17T08:30:02Z","title":"DETRs Beat YOLOs on Real-time Object Detection","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.08069","snapshot_observed_at":"2026-08-07T10:44:36.755868Z","title":"Detrs beat yolos on real-time object detection.arXiv preprint arXiv:2304.08069, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-07T10:35:02.758982Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:36.755868Z"},"links":{"cited_paper":"/paper/2304.08069","citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:6f6631d2e1d35690907f65b0eeb582c0ab0246181f8c14daded411da34bb2dc4","observation_id":"9b229385-39a7-42e5-a43a-91c778e18b94","resolution":{"observed_at":"2026-08-07T10:44:36.755868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.05752","last_updated":"2024-09-29T06:43:38Z","snapshot_observed_at":"2026-08-08T01:09:34.308935Z","submitted_at":"2023-12-10T04:17:27Z","title":"Camera-based 3D Semantic Scene Completion with Sparse Guidance Network","version":2},"cited_work":{"arxiv_id":"2312.05752","doi":null,"metadata_source":"pith","pith_arxiv_id":"2312.05752","snapshot_observed_at":"2026-08-07T10:44:40.162888Z","title":"Camera-based 3D Semantic Scene Completion with Sparse Guidance Network","venue":"cs.CV","work_id":"6d4a6404-3135-46ff-9a22-c1e12f1156b9","year":2023},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-07T10:35:02.758982Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:36.859304Z"},"links":{"cited_paper":"/paper/2312.05752","citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:4d7ad477522ddbca61e599be3f51f872f5db8a5a8110c27af4b9ca41b16979b5","observation_id":"7444cf5c-d0a2-47e3-bc0c-2a3f94831786","resolution":{"observed_at":"2026-08-07T10:44:40.166112Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.04732","last_updated":"2025-04-07T05:08:22Z","snapshot_observed_at":"2026-08-07T16:08:06.634855Z","submitted_at":"2025-04-07T05:08:22Z","title":"Inverse++: Vision-Centric 3D Semantic Occupancy Prediction Assisted with 3D Object Detection","version":1},"cited_work":{"arxiv_id":"2504.04732","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.04732","snapshot_observed_at":"2026-08-07T10:44:40.151875Z","title":"Inverse++: Vision-Centric 3D Semantic Occupancy Prediction Assisted with 3D Object Detection","venue":"cs.CV","work_id":"67ae2ee9-393f-4a90-aee9-62ea6cce00a8","year":2025},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-07T10:35:02.758982Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:36.924654Z"},"links":{"cited_paper":"/paper/2504.04732","citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:30d59c734eeb8a37b9c47802c0d9b87fd47df8bc74b21c3a71007f61390360ed","observation_id":"156f4522-059d-4f54-a091-35545709aa58","resolution":{"observed_at":"2026-08-07T10:44:40.155165Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:40.557495Z","title":"Lift, splat, shoot: Encoding images from arbitrary camera rigs by implicitly unprojecting to 3d","venue":null,"work_id":"c503ab18-c44d-4f51-b894-14c39418b372","year":2020},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-07T10:35:02.758982Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:36.973260Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:e3f08ffa6ba36b4b6d2cb35feea77ec0ea72c37b224bd10b5f2d1951f6373c35","observation_id":"6a6d2e64-2550-43eb-a907-5275fe594b38","resolution":{"observed_at":"2026-08-07T10:44:40.560629Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:40.548923Z","title":"Borderdet: Border feature for dense object detection","venue":null,"work_id":"db88dcd0-bfae-41c0-ab67-e78e67609c20","year":2020},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-07T10:35:02.758982Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:37.043094Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:9644248bd86a535807fe28886e77e80aed80d5ae722670d0cd2d68ca46a53f4d","observation_id":"dc077b2a-8d62-4287-b92f-bd05650ce6b2","resolution":{"observed_at":"2026-08-07T10:44:40.552039Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:37.084954Z","title":"Faster r-cnn: Towards real-time object detection with region proposal networks.IEEE transactions on pattern analysis and machine intelligence, 39(6):1137–1149, 2016","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-07T10:35:02.758982Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:37.084954Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:9f181b00cf0b2943115310e2fc71e2e6f4f3ce81fce04fa3e1acec1212740d0d","observation_id":"28dab664-304a-40ff-bd14-eb1e24eed0e4","resolution":{"observed_at":"2026-08-07T10:44:37.084954Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:40.536258Z","title":"Semantic scene completion using local deep implicit functions on lidar data.IEEE transactions on pattern analysis and machine intelligence, 44(10):7205–7218, 2021","venue":null,"work_id":"bc562979-e200-4ce4-9bad-b3dde36b613c","year":2021},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-07T10:35:02.758982Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:37.147785Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:d5936fe6ccac7454e797f25185675d5da99cb8c4c3ac2f0c0e097a905882b6e0","observation_id":"93dfe922-c72e-4735-ab70-461760a5f547","resolution":{"observed_at":"2026-08-07T10:44:40.539330Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:40.527578Z","title":"Lmscnet: Lightweight multiscale 3d semantic completion","venue":null,"work_id":"9b733a2a-96f4-45d2-833d-2917c275367a","year":2020},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-07T10:35:02.758982Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:37.224276Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:149d80cde53686a63cf160685ce68338b66889836f732c649d685360bae487d4","observation_id":"2cf08de4-3025-4d63-a9ab-511ca43a84a9","resolution":{"observed_at":"2026-08-07T10:44:40.530112Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:40.519537Z","title":"3d semantic scene completion: A survey.International Journal of Computer Vision, 130(8):1978–2005, 2022","venue":null,"work_id":"561b136e-8073-4ce4-a56e-0472db81376f","year":1978},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-07T10:35:02.758982Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:37.406058Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:684a5635280f3cf0757c71d23e6b4303f449d81ee69b7add9bd5548ae47fcbd8","observation_id":"bad88318-d37b-4366-bea3-8891a2a1854f","resolution":{"observed_at":"2026-08-07T10:44:40.522508Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:40.511234Z","title":"Mobilestereonet: Towards lightweight deep networks for stereo matching","venue":null,"work_id":"27dcc940-fa35-4155-898c-6bed603bd2a3","year":2022},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-07T10:35:02.758982Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:37.452780Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:fc9afc68400d4a885c6f05b8c7b16811bc676d02f2c30d0630e1b70866f9f5c2","observation_id":"fcf6f17b-78d2-4929-b417-028059891be5","resolution":{"observed_at":"2026-08-07T10:44:40.514194Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:40.502096Z","title":"Revisiting the sibling head in object detector","venue":null,"work_id":"063192cc-bc3a-4cf1-9910-9dadc3665fc3","year":2020},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-07T10:35:02.758982Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:37.523432Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:304bda5ac655ab2a6773c523974cc273b85b7c71291afaa0811ca8b71603a1ed","observation_id":"9519cd19-d517-4819-992a-5cbaaa485ff3","resolution":{"observed_at":"2026-08-07T10:44:40.505087Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:40.493954Z","title":"Chang, Manolis Savva, and Thomas A","venue":null,"work_id":"dc010e42-e0d4-4838-9d7e-cb090bda75c6","year":2017},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-07T10:35:02.758982Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:37.559519Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:edcc354d2f99a21a22136630746568abb8d068d4f68b385153eda3873843c6cc","observation_id":"8407d5b7-31bc-4915-857d-faa7a349269b","resolution":{"observed_at":"2026-08-07T10:44:40.496884Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:37.626205Z","title":"Fcos: Fully convolutional one-stage object detection","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-07T10:35:02.758982Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:37.626205Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:acff0ec077c237cc3dca5401869682ee3d5af49102ab9ba7ecfa1394ab3e05e5","observation_id":"48052458-3c10-46a2-9878-c89c2bb6e4e9","resolution":{"observed_at":"2026-08-07T10:44:37.626205Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:40.480214Z","title":"V oxel proposal network via multi-frame knowledge distillation for semantic scene completion.Advances in Neural Information Processing Systems, 37:101096–101115, 2024","venue":null,"work_id":"65321d95-5a7e-43c9-a97f-3da41b1fbec6","year":2024},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-07T10:35:02.758982Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:37.678995Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:30b1f112883b392d4a738fb8c6270d100c1dce418318eee30cd6c0e638a7c4f8","observation_id":"4eddb841-f96e-4fca-932a-a26ab6457ca9","resolution":{"observed_at":"2026-08-07T10:44:40.483409Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:40.470759Z","title":"Vlscene: Vision- language guidance distillation for camera-based 3d semantic scene completion","venue":null,"work_id":"6c4c5799-a44d-462b-8caa-f9236e904be8","year":2025},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-07T10:35:02.758982Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:37.718591Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:5775dea7affa97a3393911c4cfc4d4f6f68870e42b0d2bf7e56c5186f719841f","observation_id":"eedaf682-0cca-4c37-804a-92ab14f81a05","resolution":{"observed_at":"2026-08-07T10:44:40.474374Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:40.462977Z","title":"Nas-fcos: Fast neural architecture search for object detection","venue":null,"work_id":"29264e74-5ca7-493c-b531-f98dc1eeffbf","year":2020},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-07T10:35:02.758982Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:37.778869Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:39733365fcd32a671523e634514a577385ae5b3d20b8ab431746aef49e58b63a","observation_id":"bcad2f04-85c7-4bec-96a9-9059cc99bfef","resolution":{"observed_at":"2026-08-07T10:44:40.465703Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.12369","last_updated":"2025-03-16T06:09:36Z","snapshot_observed_at":"2026-08-07T17:01:04.113266Z","submitted_at":"2025-03-16T06:09:36Z","title":"L2COcc: Lightweight Camera-Centric Semantic Scene Completion via Distillation of LiDAR Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.12369","snapshot_observed_at":"2026-08-07T10:44:37.840700Z","title":"L2cocc: Lightweight camera-centric semantic scene completion via distillation of lidar model.arXiv preprint arXiv:2503.12369, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-07T10:35:02.758982Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:37.840700Z"},"links":{"cited_paper":"/paper/2503.12369","citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:13504ab4227b834cd00ba0a5addc692f1dee1cac76aeed560c9fd7c32450497e","observation_id":"513c7aa8-0582-458e-8990-4b546ca68fbb","resolution":{"observed_at":"2026-08-07T10:44:37.840700Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.11958","last_updated":"2024-04-18T07:25:59Z","snapshot_observed_at":"2026-07-06T18:02:02.384288Z","submitted_at":"2024-04-18T07:25:59Z","title":"Not All Voxels Are Equal: Hardness-Aware Semantic Scene Completion with Self-Distillation","version":1},"cited_work":{"arxiv_id":"2404.11958","doi":null,"metadata_source":"pith","pith_arxiv_id":"2404.11958","snapshot_observed_at":"2026-08-07T10:44:40.134168Z","title":"Not All Voxels Are Equal: Hardness-Aware Semantic Scene Completion with Self-Distillation","venue":"cs.CV","work_id":"eb589707-d1c5-427f-b830-82a0ff3eba2c","year":2024},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-07T10:35:02.758982Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:37.917989Z"},"links":{"cited_paper":"/paper/2404.11958","citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:93def005e1db30c256d95d7b8b8e4514ad0309eb08f2062fa2d05e36c55723a3","observation_id":"b81efc28-d28c-40e2-9e68-174ee00f5f1f","resolution":{"observed_at":"2026-08-07T10:44:40.138189Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:40.454676Z","title":"Fcos3d: Fully convolutional one-stage monocular 3d object detection","venue":null,"work_id":"05ddc3d5-4c57-4a66-baa2-1f1321abb860","year":2021},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-07T10:35:02.758982Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:37.973226Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:9371272678bdaa1b1472bb8e489624f89adbeee35920a2e5faa499bf0827bb9b","observation_id":"84379e89-4513-4720-bb8b-eac96b11c32c","resolution":{"observed_at":"2026-08-07T10:44:40.457633Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:40.445826Z","title":null,"venue":null,"work_id":"60ed3c54-6a94-47e0-8988-5f6d833150dc","year":2021},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-07T10:35:02.758982Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:38.034682Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:78c4bfb205411d817992f1c8417c50676eeedceb753f033c8e7067207318b860","observation_id":"cc055b7d-fb0f-4c8a-a515-79e1bd8ce63a","resolution":{"observed_at":"2026-08-07T10:44:40.449555Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:40.437603Z","title":"H2gformer: Horizontal-to-global voxel transformer for 3d semantic scene completion","venue":null,"work_id":"7fbcc51f-84e3-4674-8a00-2455309a9fcb","year":2024},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-07T10:35:02.758982Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:38.084175Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:0eb5894c8458b277770d4f923874ea31448f12a0ad0ed4862fad03a23f9afef1","observation_id":"db222514-f47d-496c-a870-b6a8e7353c46","resolution":{"observed_at":"2026-08-07T10:44:40.440532Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:38.130572Z","title":"Surroundocc: Multi-camera 3d occupancy prediction for autonomous driving","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-07T10:35:02.758982Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:38.130572Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:90c2f7183c834c7a9394db7fcdbd287be037f984c80c92ac5d2c7f7b8a3fd8ea","observation_id":"36046737-46d9-450e-aa7b-31ee156c3503","resolution":{"observed_at":"2026-08-07T10:44:38.130572Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:40.423839Z","title":"Scpnet: Semantic scene completion on point cloud","venue":null,"work_id":"c0401054-ced9-47c2-9e0b-0e1c41cd006e","year":2023},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-07T10:35:02.758982Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:38.211523Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:0dfbb99a031897aed2f65cd962fbab323000b0710f486d627e0b04bb7d6424fd","observation_id":"6ac74c63-ad23-4ec6-a23f-3a49c4912762","resolution":{"observed_at":"2026-08-07T10:44:40.426788Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:40.416191Z","title":"Instance-aware monocular 3d semantic scene completion.IEEE Transactions on Intelligent Transportation Systems, 2024","venue":null,"work_id":"a8872b6a-6071-49fb-ab09-932dd09a3eac","year":2024},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-07T10:35:02.758982Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:38.268540Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:4d9e5332417a8819b8b5a305448c7d5602d380469612ce5fccd35d1efc5da9e5","observation_id":"1a0322c9-2679-46b1-b5d7-3981b9e36031","resolution":{"observed_at":"2026-08-07T10:44:40.418991Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:40.408491Z","title":"Revisiting ap loss for dense object detection: Adaptive ranking pair selection","venue":null,"work_id":"6e61359a-7d1c-4a7a-a36e-62ee0fdeeec6","year":2022},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-07T10:35:02.758982Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:38.347973Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:4ee1346801cc4c9b8b9af4a0d247703ae4d47523105bc9dbda3dc78933ddb4bf","observation_id":"86e2847e-9776-40cc-af8c-f3fae97df327","resolution":{"observed_at":"2026-08-07T10:44:40.411449Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:40.400833Z","title":"Sparse single sweep lidar point cloud segmentation via learning contextual shape priors from scene completion","venue":null,"work_id":"3efa982d-47ba-4a35-8eed-aae0de5a0f04","year":2021},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-07T10:35:02.758982Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:38.452237Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:d98b190abf516f701f5556fa87a888fbed2b0784b49f2c9e397fbfb44535406a","observation_id":"df7edbe5-68b3-430c-a6b4-2ba9383f6af5","resolution":{"observed_at":"2026-08-07T10:44:40.403850Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.13279","last_updated":"2025-05-20T07:45:25Z","snapshot_observed_at":"2026-08-07T15:43:06.225319Z","submitted_at":"2025-05-19T16:02:37Z","title":"Event-Driven Dynamic Scene Depth Completion","version":2},"cited_work":{"arxiv_id":"2505.13279","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.13279","snapshot_observed_at":"2026-08-07T10:44:40.085859Z","title":"Event-Driven Dynamic Scene Depth Completion","venue":"cs.CV","work_id":"b03cd0cf-d2b1-47a0-81f1-d99f5ef30422","year":2025},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-07T10:35:02.758982Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:38.592542Z"},"links":{"cited_paper":"/paper/2505.13279","citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:615a5ed1421e2b3ffc8d85f71fb93fb62f6f9bd62022973e34e8295f64ff9781","observation_id":"ebc5dfae-3504-4c26-bffc-a370fce97820","resolution":{"observed_at":"2026-08-07T10:44:40.125791Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:40.391690Z","title":"Rignet++: Semantic assisted repetitive image guided network for depth completion.International Journal of Computer Vision, pages 1–23, 2025","venue":null,"work_id":"b52a0498-5614-42d6-a8ed-01a8461fe62b","year":2025},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-07T10:35:02.758982Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:38.697816Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:4b51538bd36bed6973431b6be0ed04942abdb7408e7d7675a3b2ed5ce24820e9","observation_id":"9a9aa3c2-9f15-4043-a69b-aaacc6fd3d11","resolution":{"observed_at":"2026-08-07T10:44:40.395507Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:40.383104Z","title":"Tri-perspective view decomposition for geometry-aware depth completion","venue":null,"work_id":"28f14627-6000-4442-8fb0-749552798b56","year":2024},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-07T10:35:02.758982Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:38.850447Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:b955d92a97247f8d5d55a874c5a2338bb1b22d9ea48ccd199e5c25dd309e2dfc","observation_id":"bff829ab-aaff-440d-a016-a512ce511bd0","resolution":{"observed_at":"2026-08-07T10:44:40.385927Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:40.374157Z","title":"Rignet: Repetitive image guided network for depth completion","venue":null,"work_id":"d183ded0-58d7-46e2-b21b-e041f4334e0c","year":2022},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-07T10:35:02.758982Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:38.969476Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:cc3d0393308e01391ef0021c30bb4c01988fc355dc90a33a1bbd15a18719bd84","observation_id":"0a5790a4-c555-49cb-9ae5-9786d8ba004f","resolution":{"observed_at":"2026-08-07T10:44:40.377794Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:40.365888Z","title":"Prediction-guided distillation for dense object detection","venue":null,"work_id":"78dd9d55-bd89-4727-8151-5dc770d43ccf","year":2022},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-07T10:35:02.758982Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:39.066137Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:272c557b13ff2539753b1b4409575a009c32e79c3b014441304240621032c2f0","observation_id":"88ea2d7d-2f66-4b85-851f-828248025b11","resolution":{"observed_at":"2026-08-07T10:44:40.368796Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:40.358252Z","title":"Semantic segmentation-assisted scene completion for lidar point clouds","venue":null,"work_id":"44ae62dd-d807-4337-bc4d-083d18034bb3","year":2021},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-07T10:35:02.758982Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:39.179666Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:5c9c06feffc9db9faff71031b701b255f0ca00d73935ae0bd01769e41adf5ff4","observation_id":"1507f06b-024f-4f55-b455-6fb85926061e","resolution":{"observed_at":"2026-08-07T10:44:40.360979Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03605","last_updated":"2025-01-07T08:06:35Z","snapshot_observed_at":"2026-08-02T04:39:50.588045Z","submitted_at":"2025-01-07T08:06:35Z","title":"ConcealGS: Concealing Invisible Copyright Information in 3D Gaussian Splatting","version":1},"cited_work":{"arxiv_id":"2501.03605","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.03605","snapshot_observed_at":"2026-08-07T10:44:39.944217Z","title":"ConcealGS: Concealing Invisible Copyright Information in 3D Gaussian Splatting","venue":"cs.CV","work_id":"eb6a6958-5c3c-4ca0-b68e-d2666cb2e911","year":2025},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-07T10:35:02.758982Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:39.271233Z"},"links":{"cited_paper":"/paper/2501.03605","citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:63fc94ffd0f3f15975358dc61f3d62a7ec623c72170102bcf940bfc4de412584","observation_id":"11a50356-d025-4490-97df-05a23ac5ba91","resolution":{"observed_at":"2026-08-07T10:44:40.003932Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:39.273600Z","title":"Daocc: 3d object detection assisted multi-sensor fusion for 3d occupancy prediction.arXiv preprint arXiv:2409.19972, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-07T10:35:02.758982Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:39.273600Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:23a1b1a4e93f4537ff972705296eecbf874c12bedabe0daee4e3e9b8b5ddf820","observation_id":"547970cf-203c-4f96-be8b-1483d56d5089","resolution":{"observed_at":"2026-08-07T10:44:39.273600Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.17084","last_updated":"2024-11-25T23:13:35Z","snapshot_observed_at":"2026-07-06T16:53:58.875152Z","submitted_at":"2023-11-28T01:47:51Z","title":"DepthSSC: Monocular 3D Semantic Scene Completion via Depth-Spatial Alignment and Voxel Adaptation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.17084","snapshot_observed_at":"2026-08-07T10:44:39.275821Z","title":"Depthssc: Depth-spatial alignment and dynamic voxel resolution for monocular 3d semantic scene completion.arXiv preprint arXiv:2311.17084, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-07T10:35:02.758982Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:39.275821Z"},"links":{"cited_paper":"/paper/2311.17084","citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:d80517abf17503f1b1dff88d19741e1b47bc39898b8dcbe6966f40c4ca6cf077","observation_id":"331f99cc-0f19-4fd1-a975-d7979207e480","resolution":{"observed_at":"2026-08-07T10:44:39.275821Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.16072","last_updated":"2025-07-30T10:14:35Z","snapshot_observed_at":"2026-07-06T19:56:21.333277Z","submitted_at":"2024-11-25T03:47:10Z","title":"Language Driven Occupancy Prediction","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.16072","snapshot_observed_at":"2026-08-07T10:44:39.278703Z","title":"Language driven occupancy prediction","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-07T10:35:02.758982Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:39.278703Z"},"links":{"cited_paper":"/paper/2411.16072","citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:971375e2af794ee5677df1a9c2abb0b3308610fee6beca3afe54ba6748ad32aa","observation_id":"60f488f2-6934-4dc1-bcd8-9046e7af7fce","resolution":{"observed_at":"2026-08-07T10:44:39.278703Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:40.350987Z","title":"Aggregating feature point cloud for depth completion","venue":null,"work_id":"b438a5d7-523e-4621-97a2-5831776b16d9","year":2023},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-07T10:35:02.758982Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:39.312771Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:4485ad637ff4801615fb6e92bb38a9394d4d2d569fe7d78cf5202798e61a73e7","observation_id":"34686225-cb38-458e-9939-e52d739b9788","resolution":{"observed_at":"2026-08-07T10:44:40.353683Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:40.342738Z","title":"Aggregating feature point cloud for depth completion","venue":null,"work_id":"37a24f37-e8e5-48c5-9d71-9de97dee4890","year":2023},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-07T10:35:02.758982Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:39.444406Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:0bee0860a59b6170a3093fee663b65c1ca7a48ce0492b4c5f754d53c77b92507","observation_id":"3394b1b8-867b-4ff5-b2d8-534963362e87","resolution":{"observed_at":"2026-08-07T10:44:40.345517Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:40.335055Z","title":"Context and geometry aware voxel transformer for semantic scene completion","venue":null,"work_id":"ef7f0b96-1cbc-4872-90b9-9030c76557fa","year":2024},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-07T10:35:02.758982Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:39.545103Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:12b3d201ebf6bbb0ec85a7846e0941a16773d944975f0a5225eed77d08b012dc","observation_id":"9394c26a-d4e7-406d-a8f6-cb6c4cc3465f","resolution":{"observed_at":"2026-08-07T10:44:40.338110Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:39.625757Z","title":"Varifocalnet: An iou-aware dense object detector","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-07T10:35:02.758982Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:39.625757Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:3668ae2ec7a39fcedb2dbf09ad220e2e00368ea827824dec88dbf7770d9ac61f","observation_id":"42540342-14a4-45b5-92f9-df54e2e7ef60","resolution":{"observed_at":"2026-08-07T10:44:39.625757Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:39.632877Z","title":"Bridging the gap between anchor-based and anchor-free detection via adaptive training sample selection","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-07T10:35:02.758982Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:39.632877Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:e1936427a2171598594d069b05f50f9c6e6341c96995b5f6fdb8a8c0fddf67db","observation_id":"46399ad2-003e-41d7-bbb3-51f45f850cdf","resolution":{"observed_at":"2026-08-07T10:44:39.632877Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:40.320028Z","title":null,"venue":null,"work_id":"0585814f-dcbb-4286-a98e-cfad212396c3","year":2023},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-07T10:35:02.758982Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:39.635008Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:e4f4551fce9607729c699f4d9a3a6292aff7a69c6343cd61363b19d29f01d5f0","observation_id":"b1e1bb9b-6091-49bf-8534-19fd67aa456b","resolution":{"observed_at":"2026-08-07T10:44:40.322754Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.08766","last_updated":"2024-03-13T17:59:04Z","snapshot_observed_at":"2026-07-31T01:01:40.167762Z","submitted_at":"2024-03-13T17:59:04Z","title":"MonoOcc: Digging into Monocular Semantic Occupancy Prediction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.08766","snapshot_observed_at":"2026-08-07T10:44:39.637215Z","title":"Monoocc: Digging into monocular semantic occupancy prediction.arXiv preprint arXiv:2403.08766, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-07T10:35:02.758982Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:39.637215Z"},"links":{"cited_paper":"/paper/2403.08766","citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:b1e207e4a2cd217b7bce5cec19c6633b8a6eb8270de09455b67180eef7e59dd9","observation_id":"3ae913d7-111b-4c7f-8dd7-cf820e894d64","resolution":{"observed_at":"2026-08-07T10:44:39.637215Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:40.311835Z","title":"Localization distillation for dense object detection","venue":null,"work_id":"0f005c27-55f0-4244-82b5-e7050be0cc77","year":2022},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-07T10:35:02.758982Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:39.639748Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:aa46ed65418ee0dc93f3157f9118e43d0d4ec0d289bd80ed5a2c05040c50144b","observation_id":"f1834cae-fcf5-4628-b656-78cb0230227c","resolution":{"observed_at":"2026-08-07T10:44:40.315076Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:40.304327Z","title":"Bottom-up object detection by grouping extreme and center points","venue":null,"work_id":"2d364180-b4f2-44c0-af3b-e645600f3b70","year":2019},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-07T10:35:02.758982Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:39.693468Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:4f59cf4b204ad5c890ac4c86874a56adbc162a3d75a1e05b578bd323c3fa8ba7","observation_id":"cc4a6aab-cc74-49c6-9f3e-6ceefcaf6071","resolution":{"observed_at":"2026-08-07T10:44:40.307096Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.04159","last_updated":"2021-03-18T03:14:26Z","snapshot_observed_at":"2026-07-06T10:02:45.105181Z","submitted_at":"2020-10-08T17:59:21Z","title":"Deformable DETR: Deformable Transformers for End-to-End Object Detection","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.04159","snapshot_observed_at":"2026-08-07T10:44:39.773683Z","title":"Deformable detr: Deformable transformers for end-to-end object detection.arXiv preprint arXiv:2010.04159, 2020","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-07T10:35:02.758982Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:39.773683Z"},"links":{"cited_paper":"/paper/2010.04159","citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:906a43afea5cc07eed271553a889e6a53e1a7b078f58eeebb24bdf654c1b4101","observation_id":"144236fd-f924-4a7b-9450-3b9f513a04be","resolution":{"observed_at":"2026-08-07T10:44:39.773683Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","latest_version":1,"primary_category":"cs.GR","snapshot_observed_at":"2026-08-07T10:35:02.758982Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection"},"reference_resolution":{"displayed":89,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":33,"verified_exact":8,"verified_fuzzy":48},"total_outbound_references":89},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 89 of 89 outbound references and 3 inbound Pith citation observations for arXiv:2506.04623."}