{"as_of":"2026-08-18T20:49:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d14378126142c2a23458ef6347e294ab4a41a67960114b092034a6d568720164","coverage":[{"denominator":44,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":44,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T18:19:43.779994Z","state":"measured"},{"denominator":44,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":44,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.18331/citation-record","integrity":"/paper/2507.18331/integrity","json":"/paper/2507.18331/citation-record.json","paper":"/paper/2507.18331"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:19:44.271491Z","title":"Objectron: A large scale dataset of object-centric videos in the wild with pose annotations","venue":null,"work_id":"1bf3c216-87ad-4329-b6cd-bf46c97dfad9","year":2021},"citing_paper":{"arxiv_id":"2507.18331","last_updated":"2025-07-24T11:58:01Z","snapshot_observed_at":"2026-08-18T18:52:22.629116Z","submitted_at":"2025-07-24T11:58:01Z","title":"Boosting Multi-View Indoor 3D Object Detection via Adaptive 3D Volume Construction","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T18:19:43.622308Z"},"links":{"citing_paper":"/paper/2507.18331"},"observation_digest":"sha256:badcc14381ca7bc5062f80ea170b489220aa5953b33dbb79357feb65f16d7800","observation_id":"06f9ca8e-89da-4606-9b1c-91b13df80361","resolution":{"observed_at":"2026-08-15T18:19:44.276044Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.08897","last_updated":"2022-01-12T08:19:29Z","snapshot_observed_at":"2026-07-06T12:09:19.763667Z","submitted_at":"2021-11-17T04:27:01Z","title":"ARKitScenes: A Diverse Real-World Dataset For 3D Indoor Scene Understanding Using Mobile RGB-D Data","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.08897","snapshot_observed_at":"2026-08-15T18:19:43.627531Z","title":"ARKitScenes: A diverse real-world dataset for 3d indoor scene understanding using mobile rgb-d data","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.18331","last_updated":"2025-07-24T11:58:01Z","snapshot_observed_at":"2026-08-18T18:52:22.629116Z","submitted_at":"2025-07-24T11:58:01Z","title":"Boosting Multi-View Indoor 3D Object Detection via Adaptive 3D Volume Construction","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T18:19:43.627531Z"},"links":{"cited_paper":"/paper/2111.08897","citing_paper":"/paper/2507.18331"},"observation_digest":"sha256:8e5ead55dac93695eaa76913fea3865f670e60ac274b63b3e1b85bc8eeae8c93","observation_id":"35cc0d22-a0c8-4c7f-b035-82a913237079","resolution":{"observed_at":"2026-08-15T18:19:43.627531Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:19:44.259247Z","title":"End-to- end object detection with transformers","venue":null,"work_id":"d0be2e08-3796-4c65-b81a-f4b8dbb8698a","year":2020},"citing_paper":{"arxiv_id":"2507.18331","last_updated":"2025-07-24T11:58:01Z","snapshot_observed_at":"2026-08-18T18:52:22.629116Z","submitted_at":"2025-07-24T11:58:01Z","title":"Boosting Multi-View Indoor 3D Object Detection via Adaptive 3D Volume Construction","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T18:19:43.631741Z"},"links":{"citing_paper":"/paper/2507.18331"},"observation_digest":"sha256:97ad0d947f6a04aa898a9f4febb41224be63407e4f7ec8c73c9c3c1db562e4cf","observation_id":"2aff32a9-5339-4d58-99ca-939785001a5c","resolution":{"observed_at":"2026-08-15T18:19:44.263960Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:19:44.247565Z","title":"MVSplat: Efficient 3d gaussian splatting from sparse multi-view images","venue":null,"work_id":"85f2540b-563a-4234-ba1b-7007a28e8369","year":2024},"citing_paper":{"arxiv_id":"2507.18331","last_updated":"2025-07-24T11:58:01Z","snapshot_observed_at":"2026-08-18T18:52:22.629116Z","submitted_at":"2025-07-24T11:58:01Z","title":"Boosting Multi-View Indoor 3D Object Detection via Adaptive 3D Volume Construction","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T18:19:43.635523Z"},"links":{"citing_paper":"/paper/2507.18331"},"observation_digest":"sha256:65cd462646f27a19427f23f41bd63f96ed717add237f3b712efd9f69f508aa81","observation_id":"e9e762e2-8ac2-4b59-abf1-72de3323b8e1","resolution":{"observed_at":"2026-08-15T18:19:44.251914Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:19:44.236322Z","title":"A space-sweep approach to true multi- image matching","venue":null,"work_id":"a7c4b0bb-b39c-4dad-8f25-ad091e3d2986","year":null},"citing_paper":{"arxiv_id":"2507.18331","last_updated":"2025-07-24T11:58:01Z","snapshot_observed_at":"2026-08-18T18:52:22.629116Z","submitted_at":"2025-07-24T11:58:01Z","title":"Boosting Multi-View Indoor 3D Object Detection via Adaptive 3D Volume Construction","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T18:19:43.639437Z"},"links":{"citing_paper":"/paper/2507.18331"},"observation_digest":"sha256:78109d4bf0ffd95120061b49bd65a2930e9b9037961a3c1e8f5a67c8a2826102","observation_id":"e35a0e99-3511-4706-9634-93525dbbcb6a","resolution":{"observed_at":"2026-08-15T18:19:44.240420Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:19:44.225833Z","title":"ScanNet: Richly-annotated 3d reconstructions of indoor scenes","venue":null,"work_id":"9a8121f8-5f87-42be-b0b2-72b45d11cbfc","year":2017},"citing_paper":{"arxiv_id":"2507.18331","last_updated":"2025-07-24T11:58:01Z","snapshot_observed_at":"2026-08-18T18:52:22.629116Z","submitted_at":"2025-07-24T11:58:01Z","title":"Boosting Multi-View Indoor 3D Object Detection via Adaptive 3D Volume Construction","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T18:19:43.642914Z"},"links":{"citing_paper":"/paper/2507.18331"},"observation_digest":"sha256:e256489058a312657620f42f8a73b122da2a5ae63debccce67af9e5acdf7ff72","observation_id":"e23deab3-db4a-4495-9fa1-9a7715b72e06","resolution":{"observed_at":"2026-08-15T18:19:44.229361Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:19:43.646393Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.18331","last_updated":"2025-07-24T11:58:01Z","snapshot_observed_at":"2026-08-18T18:52:22.629116Z","submitted_at":"2025-07-24T11:58:01Z","title":"Boosting Multi-View Indoor 3D Object Detection via Adaptive 3D Volume Construction","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T18:19:43.646393Z"},"links":{"citing_paper":"/paper/2507.18331"},"observation_digest":"sha256:2dca838b631d1ec57f456edcafbe14f57d3a0477dc1ff5219bbf4ae820155c31","observation_id":"f7e56130-a8f6-4118-bb63-767e3ee5d7e3","resolution":{"observed_at":"2026-08-15T18:19:43.646393Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:19:43.650187Z","title":"Deep residual learning for image recognition","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.18331","last_updated":"2025-07-24T11:58:01Z","snapshot_observed_at":"2026-08-18T18:52:22.629116Z","submitted_at":"2025-07-24T11:58:01Z","title":"Boosting Multi-View Indoor 3D Object Detection via Adaptive 3D Volume Construction","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T18:19:43.650187Z"},"links":{"citing_paper":"/paper/2507.18331"},"observation_digest":"sha256:4c7a8b98cb09e000a5a2dc85d15f5c1c68074f3c0f7f617f1b40118d1952a7b8","observation_id":"28314dbb-710f-4138-953e-65d53d0ba1ae","resolution":{"observed_at":"2026-08-15T18:19:43.650187Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:19:44.202561Z","title":"NeRF-Det++: Incorporat- ing semantic cues and perspective-aware depth supervision for indoor multi-view 3d detection","venue":null,"work_id":"fbd14782-6b11-4185-8da9-4e979c7d89cd","year":2025},"citing_paper":{"arxiv_id":"2507.18331","last_updated":"2025-07-24T11:58:01Z","snapshot_observed_at":"2026-08-18T18:52:22.629116Z","submitted_at":"2025-07-24T11:58:01Z","title":"Boosting Multi-View Indoor 3D Object Detection via Adaptive 3D Volume Construction","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T18:19:43.653535Z"},"links":{"citing_paper":"/paper/2507.18331"},"observation_digest":"sha256:840845705d5310135be02faf6008fdc371c2a709b1f46cc6a9dfcecf44707379","observation_id":"80d14f6c-b082-4dfc-b082-710e91c53502","resolution":{"observed_at":"2026-08-15T18:19:44.206120Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11790","last_updated":"2022-06-16T09:15:52Z","snapshot_observed_at":"2026-08-17T05:15:58.663240Z","submitted_at":"2021-12-22T10:48:06Z","title":"BEVDet: High-performance Multi-camera 3D Object Detection in Bird-Eye-View","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.11790","snapshot_observed_at":"2026-08-15T18:19:43.657076Z","title":"BEVDet: High-performance multi-camera 3d object de- tection in bird-eye-view","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.18331","last_updated":"2025-07-24T11:58:01Z","snapshot_observed_at":"2026-08-18T18:52:22.629116Z","submitted_at":"2025-07-24T11:58:01Z","title":"Boosting Multi-View Indoor 3D Object Detection via Adaptive 3D Volume Construction","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T18:19:43.657076Z"},"links":{"cited_paper":"/paper/2112.11790","citing_paper":"/paper/2507.18331"},"observation_digest":"sha256:92e102abe675d7daac93f35110c8417a246a06eb6c552ea811b0cab2e1a223e1","observation_id":"d6087566-1791-4af1-8c24-4885ba77b7a1","resolution":{"observed_at":"2026-08-15T18:19:43.657076Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.04234","last_updated":"2024-09-06T12:40:19Z","snapshot_observed_at":"2026-08-16T13:20:46.879891Z","submitted_at":"2024-09-06T12:40:19Z","title":"UniDet3D: Multi-dataset Indoor 3D Object Detection","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.04234","snapshot_observed_at":"2026-08-15T18:19:43.661984Z","title":"UniDet3D: Multi-dataset indoor 3d object detection","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.18331","last_updated":"2025-07-24T11:58:01Z","snapshot_observed_at":"2026-08-18T18:52:22.629116Z","submitted_at":"2025-07-24T11:58:01Z","title":"Boosting Multi-View Indoor 3D Object Detection via Adaptive 3D Volume Construction","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T18:19:43.661984Z"},"links":{"cited_paper":"/paper/2409.04234","citing_paper":"/paper/2507.18331"},"observation_digest":"sha256:f0041b86998bde78670d1298189e907bab39962f5aaad5cb42b1f8ba3b923d1b","observation_id":"aa9126a0-7f33-4cd2-96fb-abf6338dbb08","resolution":{"observed_at":"2026-08-15T18:19:43.661984Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:19:44.190903Z","title":"DFA3D: 3d deformable attention for 2d-to-3d feature lifting","venue":null,"work_id":"d128bf2d-4dd7-4cad-85ea-77997caf0762","year":2023},"citing_paper":{"arxiv_id":"2507.18331","last_updated":"2025-07-24T11:58:01Z","snapshot_observed_at":"2026-08-18T18:52:22.629116Z","submitted_at":"2025-07-24T11:58:01Z","title":"Boosting Multi-View Indoor 3D Object Detection via Adaptive 3D Volume Construction","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T18:19:43.665669Z"},"links":{"citing_paper":"/paper/2507.18331"},"observation_digest":"sha256:013761c63c351463464bf2b4273389f1b0d42c080238933482f1410d3013b1d8","observation_id":"abc0bbd7-7425-4e61-9a34-bc982aa7a266","resolution":{"observed_at":"2026-08-15T18:19:44.195516Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-15T12:36:15.010641Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.04623","snapshot_observed_at":"2026-08-15T18:19:43.669437Z","title":"V oxDet: Re- thinking 3d semantic occupancy prediction as dense object detection","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.18331","last_updated":"2025-07-24T11:58:01Z","snapshot_observed_at":"2026-08-18T18:52:22.629116Z","submitted_at":"2025-07-24T11:58:01Z","title":"Boosting Multi-View Indoor 3D Object Detection via Adaptive 3D Volume Construction","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T18:19:43.669437Z"},"links":{"cited_paper":"/paper/2506.04623","citing_paper":"/paper/2507.18331"},"observation_digest":"sha256:ff255996ad7a912d5f5d0c702431ef49b6bfff0e98cdfa5a25615dad37a7918e","observation_id":"9a41abaf-2be6-423c-b6dd-53d242239b6b","resolution":{"observed_at":"2026-08-15T18:19:43.669437Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:19:44.179341Z","title":"BEVDepth: Acquisition of reliable depth for multi-view 3d object detec- tion","venue":null,"work_id":"3c86f27c-b6c6-4356-9228-7d00e47e9533","year":2023},"citing_paper":{"arxiv_id":"2507.18331","last_updated":"2025-07-24T11:58:01Z","snapshot_observed_at":"2026-08-18T18:52:22.629116Z","submitted_at":"2025-07-24T11:58:01Z","title":"Boosting Multi-View Indoor 3D Object Detection via Adaptive 3D Volume Construction","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T18:19:43.673938Z"},"links":{"citing_paper":"/paper/2507.18331"},"observation_digest":"sha256:4b8446f6aa121b34de8d7120b891dab7549cb57fb355321e7d1474a455e196c5","observation_id":"5956a0b1-c958-4136-8571-c6361e00a16b","resolution":{"observed_at":"2026-08-15T18:19:44.183560Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:19:44.168750Z","title":"V oxFormer: Sparse voxel transformer for camera- based 3d semantic scene completion","venue":null,"work_id":"813aa340-7bc2-4263-857a-7d3611b61d2f","year":2023},"citing_paper":{"arxiv_id":"2507.18331","last_updated":"2025-07-24T11:58:01Z","snapshot_observed_at":"2026-08-18T18:52:22.629116Z","submitted_at":"2025-07-24T11:58:01Z","title":"Boosting Multi-View Indoor 3D Object Detection via Adaptive 3D Volume Construction","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T18:19:43.677167Z"},"links":{"citing_paper":"/paper/2507.18331"},"observation_digest":"sha256:b6dad3cb109abe11831b3036915cf42c2cdf7400476049109b014cbcda016209","observation_id":"d21a3c97-1116-4653-a8f9-42a57a67dcc3","resolution":{"observed_at":"2026-08-15T18:19:44.172344Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:19:44.157253Z","title":"BEVFormer: Learning bird’s-eye-view representation from lidar-camera via spatiotemporal transformers","venue":null,"work_id":"41efe0ba-8909-4c9c-81e7-11510ea2672e","year":2024},"citing_paper":{"arxiv_id":"2507.18331","last_updated":"2025-07-24T11:58:01Z","snapshot_observed_at":"2026-08-18T18:52:22.629116Z","submitted_at":"2025-07-24T11:58:01Z","title":"Boosting Multi-View Indoor 3D Object Detection via Adaptive 3D Volume Construction","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T18:19:43.680324Z"},"links":{"citing_paper":"/paper/2507.18331"},"observation_digest":"sha256:845387f0757f478af6ead7a26edf1a3e8753c388114f831ca00482775ead7f4f","observation_id":"4db7cc86-732d-4dfc-ac46-fed5729689df","resolution":{"observed_at":"2026-08-15T18:19:44.162018Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:19:44.145933Z","title":"GO-N3RDet: Geometry opti- mized nerf-enhanced 3d object detector","venue":null,"work_id":"9a4e6e79-3940-4026-9df4-8d60e61f1af4","year":2025},"citing_paper":{"arxiv_id":"2507.18331","last_updated":"2025-07-24T11:58:01Z","snapshot_observed_at":"2026-08-18T18:52:22.629116Z","submitted_at":"2025-07-24T11:58:01Z","title":"Boosting Multi-View Indoor 3D Object Detection via Adaptive 3D Volume Construction","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T18:19:43.683615Z"},"links":{"citing_paper":"/paper/2507.18331"},"observation_digest":"sha256:6a235a778087f2be96273240f82e1b4d6274e1ed3a9a6d0a59e2f6396cf89e0e","observation_id":"0e8c5d07-1ff0-4b0b-89b9-21ccd4a707db","resolution":{"observed_at":"2026-08-15T18:19:44.150427Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.07477","last_updated":"2024-01-15T05:10:27Z","snapshot_observed_at":"2026-08-16T14:27:33.762845Z","submitted_at":"2024-01-15T05:10:27Z","title":"CascadeV-Det: Cascade Point Voting for 3D Object Detection","version":1},"cited_work":{"arxiv_id":"2401.07477","doi":null,"metadata_source":"pith","pith_arxiv_id":"2401.07477","snapshot_observed_at":"2026-08-15T18:19:43.836645Z","title":"CascadeV-Det: Cascade Point Voting for 3D Object Detection","venue":"cs.CV","work_id":"f040b5cc-8524-4f82-bc7a-46e7912c994a","year":2024},"citing_paper":{"arxiv_id":"2507.18331","last_updated":"2025-07-24T11:58:01Z","snapshot_observed_at":"2026-08-18T18:52:22.629116Z","submitted_at":"2025-07-24T11:58:01Z","title":"Boosting Multi-View Indoor 3D Object Detection via Adaptive 3D Volume Construction","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T18:19:43.686821Z"},"links":{"cited_paper":"/paper/2401.07477","citing_paper":"/paper/2507.18331"},"observation_digest":"sha256:ad97652fb1a16bafab5c7975d58a634aa5b9c29121386e81cf54b3f95e273113","observation_id":"e6dca1ba-2e33-4f2f-a130-22bd2bd8bd14","resolution":{"observed_at":"2026-08-15T18:19:43.842521Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:19:44.134238Z","title":"Feature pyramid networks for object detection","venue":null,"work_id":"6dc29429-79d6-467d-9210-b19994b83083","year":2017},"citing_paper":{"arxiv_id":"2507.18331","last_updated":"2025-07-24T11:58:01Z","snapshot_observed_at":"2026-08-18T18:52:22.629116Z","submitted_at":"2025-07-24T11:58:01Z","title":"Boosting Multi-View Indoor 3D Object Detection via Adaptive 3D Volume Construction","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T18:19:43.690261Z"},"links":{"citing_paper":"/paper/2507.18331"},"observation_digest":"sha256:28a7587ba8a67d864c8f10734f749c8d553d7286bb7ee2cb864d24251b574d43","observation_id":"5db0572c-1543-46bb-ac3c-4fe09fd76408","resolution":{"observed_at":"2026-08-15T18:19:44.138596Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:19:44.123718Z","title":"SparseBEV: High-performance sparse 3d object de- tection from multi-camera videos","venue":null,"work_id":"97edd438-4009-4d26-972b-c6268c6d3c51","year":2023},"citing_paper":{"arxiv_id":"2507.18331","last_updated":"2025-07-24T11:58:01Z","snapshot_observed_at":"2026-08-18T18:52:22.629116Z","submitted_at":"2025-07-24T11:58:01Z","title":"Boosting Multi-View Indoor 3D Object Detection via Adaptive 3D Volume Construction","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T18:19:43.693223Z"},"links":{"citing_paper":"/paper/2507.18331"},"observation_digest":"sha256:dcd7dedc2463a34fb39d557becb7b6dd47c90c02597ba2fc19ae5f897ac6dc40","observation_id":"2e750016-6751-4ff3-8f6a-aa5b3f1d724a","resolution":{"observed_at":"2026-08-15T18:19:44.127557Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:19:44.113887Z","title":"Fully sparse 3d occupancy prediction","venue":null,"work_id":"7d46d2ec-5487-49de-a65f-5e81991d0c50","year":2024},"citing_paper":{"arxiv_id":"2507.18331","last_updated":"2025-07-24T11:58:01Z","snapshot_observed_at":"2026-08-18T18:52:22.629116Z","submitted_at":"2025-07-24T11:58:01Z","title":"Boosting Multi-View Indoor 3D Object Detection via Adaptive 3D Volume Construction","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T18:19:43.696665Z"},"links":{"citing_paper":"/paper/2507.18331"},"observation_digest":"sha256:03f62521f6cf6b3667328c8f45fb4f8ee5c2146add91fb007accd488b9275a24","observation_id":"4aa453ce-c816-47a3-aed3-9194716cc3ff","resolution":{"observed_at":"2026-08-15T18:19:44.117309Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:19:44.103090Z","title":"PETR: Position embedding transformation for multi-view 3d object detection","venue":null,"work_id":"d22f571f-5d9d-4748-8c72-68200d06c18c","year":2022},"citing_paper":{"arxiv_id":"2507.18331","last_updated":"2025-07-24T11:58:01Z","snapshot_observed_at":"2026-08-18T18:52:22.629116Z","submitted_at":"2025-07-24T11:58:01Z","title":"Boosting Multi-View Indoor 3D Object Detection via Adaptive 3D Volume Construction","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T18:19:43.699989Z"},"links":{"citing_paper":"/paper/2507.18331"},"observation_digest":"sha256:63297ae584674968222feed9b99ad341da0c17601c9ffccd1c70d5d49976fbbe","observation_id":"66174b45-ede6-49bc-aa7d-12d34f682187","resolution":{"observed_at":"2026-08-15T18:19:44.107122Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1608.03983","last_updated":"2017-05-03T16:28:09Z","snapshot_observed_at":"2026-07-06T05:06:55.589962Z","submitted_at":"2016-08-13T13:46:05Z","title":"SGDR: Stochastic Gradient Descent with Warm Restarts","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1608.03983","snapshot_observed_at":"2026-08-15T18:19:43.703218Z","title":"SGDR: Stochas- tic gradient descent with warm restarts","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.18331","last_updated":"2025-07-24T11:58:01Z","snapshot_observed_at":"2026-08-18T18:52:22.629116Z","submitted_at":"2025-07-24T11:58:01Z","title":"Boosting Multi-View Indoor 3D Object Detection via Adaptive 3D Volume Construction","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T18:19:43.703218Z"},"links":{"cited_paper":"/paper/1608.03983","citing_paper":"/paper/2507.18331"},"observation_digest":"sha256:bffcae9d405c8dfc47d556ee8654032fa015450852dcfef5857990fb853dd0dc","observation_id":"6f469e3d-2756-41f7-8cdd-c0cafa5aa9ff","resolution":{"observed_at":"2026-08-15T18:19:43.703218Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-08-14T20:13:52.872565Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-15T18:19:43.706805Z","title":"Decoupled weight decay regularization","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.18331","last_updated":"2025-07-24T11:58:01Z","snapshot_observed_at":"2026-08-18T18:52:22.629116Z","submitted_at":"2025-07-24T11:58:01Z","title":"Boosting Multi-View Indoor 3D Object Detection via Adaptive 3D Volume Construction","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T18:19:43.706805Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2507.18331"},"observation_digest":"sha256:3e25a2652a823ae742a498726bbcdb09df21a8509f1743704d6bb77415402729","observation_id":"e1560505-822f-48ac-ad29-0c3820536142","resolution":{"observed_at":"2026-08-15T18:19:43.706805Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:19:44.093099Z","title":"Oc- treeOcc: Efficient and multi-granularity occupancy predic- tion using octree queries","venue":null,"work_id":"8db015c0-8a2d-4574-a9b1-60c19abbc807","year":2024},"citing_paper":{"arxiv_id":"2507.18331","last_updated":"2025-07-24T11:58:01Z","snapshot_observed_at":"2026-08-18T18:52:22.629116Z","submitted_at":"2025-07-24T11:58:01Z","title":"Boosting Multi-View Indoor 3D Object Detection via Adaptive 3D Volume Construction","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T18:19:43.710096Z"},"links":{"citing_paper":"/paper/2507.18331"},"observation_digest":"sha256:7195758255b2b73c336545736b883aaa97274588466ce5c92ee716353905c9d6","observation_id":"9ea7fa02-9f5a-4bdb-9656-e61103b445bc","resolution":{"observed_at":"2026-08-15T18:19:44.096518Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:19:44.082168Z","title":"Deep hough voting for 3d object detection in point clouds","venue":null,"work_id":"105446f5-6924-43f1-8ceb-9cff6a05f6b7","year":2019},"citing_paper":{"arxiv_id":"2507.18331","last_updated":"2025-07-24T11:58:01Z","snapshot_observed_at":"2026-08-18T18:52:22.629116Z","submitted_at":"2025-07-24T11:58:01Z","title":"Boosting Multi-View Indoor 3D Object Detection via Adaptive 3D Volume Construction","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T18:19:43.714161Z"},"links":{"citing_paper":"/paper/2507.18331"},"observation_digest":"sha256:7eb4de3ff6c024bf215af27e943a0c10e5d359c25a2fe2276f5f79d1f76a8c3a","observation_id":"6a95996b-5dc1-485d-b619-7c02df888c3b","resolution":{"observed_at":"2026-08-15T18:19:44.086639Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:19:43.718174Z","title":"Language- grounded indoor 3d semantic segmentation in the wild","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.18331","last_updated":"2025-07-24T11:58:01Z","snapshot_observed_at":"2026-08-18T18:52:22.629116Z","submitted_at":"2025-07-24T11:58:01Z","title":"Boosting Multi-View Indoor 3D Object Detection via Adaptive 3D Volume Construction","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T18:19:43.718174Z"},"links":{"citing_paper":"/paper/2507.18331"},"observation_digest":"sha256:f230b76fe415e9c4778be0b856e39f27cecbd08dc1fdd8503b99846168204e75","observation_id":"d3c5df1d-a52c-4866-a2a5-efb4e4bf05ae","resolution":{"observed_at":"2026-08-15T18:19:43.718174Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:19:44.066702Z","title":"FCAF3D: Fully convolutional anchor-free 3d object detec- tion","venue":null,"work_id":"1152e5c0-4988-4b5a-9c93-7de51d9955a9","year":2022},"citing_paper":{"arxiv_id":"2507.18331","last_updated":"2025-07-24T11:58:01Z","snapshot_observed_at":"2026-08-18T18:52:22.629116Z","submitted_at":"2025-07-24T11:58:01Z","title":"Boosting Multi-View Indoor 3D Object Detection via Adaptive 3D Volume Construction","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T18:19:43.721460Z"},"links":{"citing_paper":"/paper/2507.18331"},"observation_digest":"sha256:d0cc91d58d0b1f8ec72520546ebc899b57c2b5be88aa4904b5ff98709e16ce2d","observation_id":"161f481c-1d0c-4f0d-a02e-9e3bbc2d6eb7","resolution":{"observed_at":"2026-08-15T18:19:44.070164Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:19:44.056502Z","title":"ImV oxelNet: Image to voxels projection for monocular and multi-view general-purpose 3d object detection","venue":null,"work_id":"ad1ed4a0-63af-4dca-907d-1f7821109f98","year":2022},"citing_paper":{"arxiv_id":"2507.18331","last_updated":"2025-07-24T11:58:01Z","snapshot_observed_at":"2026-08-18T18:52:22.629116Z","submitted_at":"2025-07-24T11:58:01Z","title":"Boosting Multi-View Indoor 3D Object Detection via Adaptive 3D Volume Construction","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T18:19:43.724963Z"},"links":{"citing_paper":"/paper/2507.18331"},"observation_digest":"sha256:45d494c33b139087035ab7424c71c40fb48a06fbe6bc93b3b5fb3e6761499bbf","observation_id":"656d4941-5da4-4543-9bbc-697a407240c6","resolution":{"observed_at":"2026-08-15T18:19:44.060175Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:19:44.044741Z","title":"CN-RMA: Combined network with ray marching aggrega- tion for 3d indoor object detection from multi-view images","venue":null,"work_id":"a973d987-c818-4f43-89b8-600b2b4013b0","year":2024},"citing_paper":{"arxiv_id":"2507.18331","last_updated":"2025-07-24T11:58:01Z","snapshot_observed_at":"2026-08-18T18:52:22.629116Z","submitted_at":"2025-07-24T11:58:01Z","title":"Boosting Multi-View Indoor 3D Object Detection via Adaptive 3D Volume Construction","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T18:19:43.728281Z"},"links":{"citing_paper":"/paper/2507.18331"},"observation_digest":"sha256:ac88cd80cfe6102fe3aa88a57a177963e41b9346defeb0dc1af128629a1b7882","observation_id":"eb9192f1-80dc-4929-a5b9-364992fcde9a","resolution":{"observed_at":"2026-08-15T18:19:44.049849Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:19:44.034137Z","title":"Im- GeoNet: Image-induced geometry-aware voxel representa- tion for multi-view 3d object detection","venue":null,"work_id":"dd6ceeb7-61ca-4d64-8a20-41073485b4a3","year":2023},"citing_paper":{"arxiv_id":"2507.18331","last_updated":"2025-07-24T11:58:01Z","snapshot_observed_at":"2026-08-18T18:52:22.629116Z","submitted_at":"2025-07-24T11:58:01Z","title":"Boosting Multi-View Indoor 3D Object Detection via Adaptive 3D Volume Construction","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T18:19:43.732622Z"},"links":{"citing_paper":"/paper/2507.18331"},"observation_digest":"sha256:a9a76c37bc6bd7b2f6c25e2ce1cd6b4d9ea5ea6be8ed890f6e0bd2198bf3ecb7","observation_id":"dfff186b-5d02-4615-bbc7-bbfbdc68a26b","resolution":{"observed_at":"2026-08-15T18:19:44.038016Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:19:44.021879Z","title":"CA- Group3D: Class-aware grouping for 3d object detection on point clouds","venue":null,"work_id":"3fa78863-4ff7-4841-982d-6b1c01cfacd8","year":2022},"citing_paper":{"arxiv_id":"2507.18331","last_updated":"2025-07-24T11:58:01Z","snapshot_observed_at":"2026-08-18T18:52:22.629116Z","submitted_at":"2025-07-24T11:58:01Z","title":"Boosting Multi-View Indoor 3D Object Detection via Adaptive 3D Volume Construction","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-15T18:19:43.735851Z"},"links":{"citing_paper":"/paper/2507.18331"},"observation_digest":"sha256:d3e821ec398a964bef4aa9f306d35e9200a6ffb4851aefa69e0bd6b12b17e43f","observation_id":"52c1815b-234e-456a-aeff-da7457c1d12c","resolution":{"observed_at":"2026-08-15T18:19:44.026338Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:19:44.010863Z","title":"OPUS: Occupancy prediction using a sparse set","venue":null,"work_id":"90e2c555-5d63-4ac0-af39-39d9955cf4c8","year":2024},"citing_paper":{"arxiv_id":"2507.18331","last_updated":"2025-07-24T11:58:01Z","snapshot_observed_at":"2026-08-18T18:52:22.629116Z","submitted_at":"2025-07-24T11:58:01Z","title":"Boosting Multi-View Indoor 3D Object Detection via Adaptive 3D Volume Construction","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-15T18:19:43.739140Z"},"links":{"citing_paper":"/paper/2507.18331"},"observation_digest":"sha256:d4ce3c9999f0ec3c88d282f3bd752e9587581be702934fb31f743f8209b13b67","observation_id":"da89db84-621b-48f6-8e89-477d60c7943c","resolution":{"observed_at":"2026-08-15T18:19:44.014299Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:19:43.999161Z","title":"EmbodiedScan: A holistic multi- modal 3d perception suite towards embodied AI","venue":null,"work_id":"6b9b5b1c-7b97-4522-adcd-918f536840f6","year":2024},"citing_paper":{"arxiv_id":"2507.18331","last_updated":"2025-07-24T11:58:01Z","snapshot_observed_at":"2026-08-18T18:52:22.629116Z","submitted_at":"2025-07-24T11:58:01Z","title":"Boosting Multi-View Indoor 3D Object Detection via Adaptive 3D Volume Construction","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-15T18:19:43.742367Z"},"links":{"citing_paper":"/paper/2507.18331"},"observation_digest":"sha256:1b34276cd666edf34ebabf0a6864f45ce8564bc23534273280c453253086e784","observation_id":"a0f73c7a-51e6-4acd-bd19-184aed544d0c","resolution":{"observed_at":"2026-08-15T18:19:44.002828Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:19:43.988209Z","title":"DETR3D: 3d object detection from multi-view images via 3d-to-2d queries","venue":null,"work_id":"a0cb6cef-4121-4c29-8bbe-69682aab2608","year":null},"citing_paper":{"arxiv_id":"2507.18331","last_updated":"2025-07-24T11:58:01Z","snapshot_observed_at":"2026-08-18T18:52:22.629116Z","submitted_at":"2025-07-24T11:58:01Z","title":"Boosting Multi-View Indoor 3D Object Detection via Adaptive 3D Volume Construction","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-15T18:19:43.746582Z"},"links":{"citing_paper":"/paper/2507.18331"},"observation_digest":"sha256:8e132c182a572e3e1c3fe7185a2a1890273adf930586984b071610f83c1973a4","observation_id":"77eb54a6-1578-4448-a9e9-ad789959d202","resolution":{"observed_at":"2026-08-15T18:19:43.992553Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:19:43.977443Z","title":"Attention is all you need","venue":null,"work_id":"b963d4b6-d347-42b5-a694-8187cc08a0b6","year":2017},"citing_paper":{"arxiv_id":"2507.18331","last_updated":"2025-07-24T11:58:01Z","snapshot_observed_at":"2026-08-18T18:52:22.629116Z","submitted_at":"2025-07-24T11:58:01Z","title":"Boosting Multi-View Indoor 3D Object Detection via Adaptive 3D Volume Construction","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-15T18:19:43.750444Z"},"links":{"citing_paper":"/paper/2507.18331"},"observation_digest":"sha256:0067a68d135eea601e9309174d15f0c1d5f63ef1b8d51a18e4d7b4b3278e7695","observation_id":"e34383c4-80c0-4bf1-b66a-504161d38455","resolution":{"observed_at":"2026-08-15T18:19:43.981300Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:19:43.966431Z","title":"Pixel-aligned recurrent queries for multi-view 3d object detection","venue":null,"work_id":"5ce63ab9-5491-4a90-ade7-010f84d3577f","year":null},"citing_paper":{"arxiv_id":"2507.18331","last_updated":"2025-07-24T11:58:01Z","snapshot_observed_at":"2026-08-18T18:52:22.629116Z","submitted_at":"2025-07-24T11:58:01Z","title":"Boosting Multi-View Indoor 3D Object Detection via Adaptive 3D Volume Construction","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-15T18:19:43.754280Z"},"links":{"citing_paper":"/paper/2507.18331"},"observation_digest":"sha256:0ecd193623d2f8f2c8b734fbc7a815087792f3c6b1fba92a0ba2c17b90aa54f7","observation_id":"a1569dcf-dc0a-43ed-8f26-4fe66b556e32","resolution":{"observed_at":"2026-08-15T18:19:43.970296Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:19:43.955163Z","title":"NeRF-Det: Learning geometry-aware volumetric representation for multi-view 3d object detection","venue":null,"work_id":"393c1cd3-dd4f-44ce-95c7-dab8728e0cc0","year":null},"citing_paper":{"arxiv_id":"2507.18331","last_updated":"2025-07-24T11:58:01Z","snapshot_observed_at":"2026-08-18T18:52:22.629116Z","submitted_at":"2025-07-24T11:58:01Z","title":"Boosting Multi-View Indoor 3D Object Detection via Adaptive 3D Volume Construction","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-15T18:19:43.757725Z"},"links":{"citing_paper":"/paper/2507.18331"},"observation_digest":"sha256:5f05e84ecd922138c9c6b7810ef46510b3297152ba78b017f2877801c2c71359","observation_id":"16183f49-ee0c-4c03-9673-6b115103dfd8","resolution":{"observed_at":"2026-08-15T18:19:43.959268Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:19:43.937082Z","title":"Unifying flow, stereo and depth estimation","venue":null,"work_id":"94c2571c-1a2f-4575-aadd-0d8523957530","year":2023},"citing_paper":{"arxiv_id":"2507.18331","last_updated":"2025-07-24T11:58:01Z","snapshot_observed_at":"2026-08-18T18:52:22.629116Z","submitted_at":"2025-07-24T11:58:01Z","title":"Boosting Multi-View Indoor 3D Object Detection via Adaptive 3D Volume Construction","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-15T18:19:43.764637Z"},"links":{"citing_paper":"/paper/2507.18331"},"observation_digest":"sha256:cbc5a005d67114355160f118fd2ae07eb5008202b85db5518ed0512738f85c57","observation_id":"aab3ae61-3671-4cd8-9996-90a1a380dd41","resolution":{"observed_at":"2026-08-15T18:19:43.941402Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:19:43.925737Z","title":"MVSDet: Multi- view indoor 3d object detection via efficient plane sweeps","venue":null,"work_id":"20cb6f71-8bfc-4bf7-8025-e3e84be94422","year":2024},"citing_paper":{"arxiv_id":"2507.18331","last_updated":"2025-07-24T11:58:01Z","snapshot_observed_at":"2026-08-18T18:52:22.629116Z","submitted_at":"2025-07-24T11:58:01Z","title":"Boosting Multi-View Indoor 3D Object Detection via Adaptive 3D Volume Construction","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-15T18:19:43.768056Z"},"links":{"citing_paper":"/paper/2507.18331"},"observation_digest":"sha256:84db2fd765b386be963df4ae1d7be5a16b7f99eb4a540d51a9dd39a728a231aa","observation_id":"402b0588-40b0-433c-b66a-b8999abb7279","resolution":{"observed_at":"2026-08-15T18:19:43.929570Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:19:43.915415Z","title":"MVSNet: Depth inference for unstructured multi- view stereo","venue":null,"work_id":"34ecb040-21f8-48e8-9224-90e6f8eb4d80","year":2018},"citing_paper":{"arxiv_id":"2507.18331","last_updated":"2025-07-24T11:58:01Z","snapshot_observed_at":"2026-08-18T18:52:22.629116Z","submitted_at":"2025-07-24T11:58:01Z","title":"Boosting Multi-View Indoor 3D Object Detection via Adaptive 3D Volume Construction","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-15T18:19:43.772661Z"},"links":{"citing_paper":"/paper/2507.18331"},"observation_digest":"sha256:dfeface313c508af79492f588bae7ce5a0cbd1c70bf0a8c0cee0cddc53d7e8e5","observation_id":"1f2fb457-35e3-4890-b48c-97d2ede8f69d","resolution":{"observed_at":"2026-08-15T18:19:43.918972Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:19:43.902733Z","title":"Context and geometry aware voxel transformer for semantic scene completion","venue":null,"work_id":"e8682fd2-e5f6-48d8-931c-1a0d64f6b182","year":2024},"citing_paper":{"arxiv_id":"2507.18331","last_updated":"2025-07-24T11:58:01Z","snapshot_observed_at":"2026-08-18T18:52:22.629116Z","submitted_at":"2025-07-24T11:58:01Z","title":"Boosting Multi-View Indoor 3D Object Detection via Adaptive 3D Volume Construction","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-15T18:19:43.776468Z"},"links":{"citing_paper":"/paper/2507.18331"},"observation_digest":"sha256:57fa21250bc347ec9255ea5d076e51f168d68269a3bbd4ba9a461463b7bccdfb","observation_id":"077bbc2f-64b5-447d-9263-654229fd2320","resolution":{"observed_at":"2026-08-15T18:19:43.907844Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:19:43.890222Z","title":"H3DNet: 3d object detection using hybrid geometric prim- itives","venue":null,"work_id":"7a6c57fb-a056-4bc3-880e-73cbeb722861","year":2020},"citing_paper":{"arxiv_id":"2507.18331","last_updated":"2025-07-24T11:58:01Z","snapshot_observed_at":"2026-08-18T18:52:22.629116Z","submitted_at":"2025-07-24T11:58:01Z","title":"Boosting Multi-View Indoor 3D Object Detection via Adaptive 3D Volume Construction","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-15T18:19:43.779994Z"},"links":{"citing_paper":"/paper/2507.18331"},"observation_digest":"sha256:fceca6390538e0c37b28ef454a036861248c9a8758dadfa0e15b20b5c1d5e6dc","observation_id":"a70232c2-60cf-4043-974e-9dbc2130329d","resolution":{"observed_at":"2026-08-15T18:19:43.895048Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:19:43.761346Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.18331","last_updated":"2025-07-24T11:58:01Z","snapshot_observed_at":"2026-08-18T18:52:22.629116Z","submitted_at":"2025-07-24T11:58:01Z","title":"Boosting Multi-View Indoor 3D Object Detection via Adaptive 3D Volume Construction","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-15T18:19:43.761346Z"},"links":{"citing_paper":"/paper/2507.18331"},"observation_digest":"sha256:4d2c74377c957029678cc7d142b838b4e9a317456370035d330d8f3a8837532a","observation_id":"501fbb30-549c-4080-9105-6aacf674fd2c","resolution":{"observed_at":"2026-08-15T18:19:43.761346Z","resolver_source":null,"status":"parse_uncertain"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.18331","last_updated":"2025-07-24T11:58:01Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-18T18:52:22.629116Z","submitted_at":"2025-07-24T11:58:01Z","title":"Boosting Multi-View Indoor 3D Object Detection via Adaptive 3D Volume Construction"},"reference_resolution":{"displayed":44,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":1,"unresolved":9,"verified_exact":1,"verified_fuzzy":33},"total_outbound_references":44},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 44 of 44 outbound references and 0 inbound Pith citation observations for arXiv:2507.18331."}