{"as_of":"2026-08-08T09:35:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c011d62cf05e20e6a8512a80af5fbbd81369d49be956a03a133755b18c62b246","coverage":[{"denominator":57,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":57,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T23:57:23.112112Z","state":"measured"},{"denominator":57,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":57,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.15610/citation-record","integrity":"/paper/2506.15610/integrity","json":"/paper/2506.15610/citation-record.json","paper":"/paper/2506.15610"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:57:29.090455Z","title":"Omni3d: A large benchmark and model for 3d object detection in the wild","venue":null,"work_id":"55b5923e-b565-432f-9bff-39707a51dd0d","year":2023},"citing_paper":{"arxiv_id":"2506.15610","last_updated":"2025-08-24T13:41:46Z","snapshot_observed_at":"2026-08-07T21:29:34.511582Z","submitted_at":"2025-06-18T16:40:05Z","title":"BoxFusion: Reconstruction-Free Open-Vocabulary 3D Object Detection via Real-Time Multi-View Box Fusion","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T23:57:19.710060Z"},"links":{"citing_paper":"/paper/2506.15610"},"observation_digest":"sha256:aa7e3d418fe2eef717f2982c1561f9544b0b9abb874d73124b0bf76985a31a95","observation_id":"1810e1c3-0f9a-48e4-825b-965a552770ad","resolution":{"observed_at":"2026-08-06T23:57:29.098750Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:57:28.839583Z","title":"Coda: Col- laborative novel box discovery and cross-modal alignment for open-vocabulary 3d object detection","venue":null,"work_id":"0565dcef-1623-4084-ad55-9e03275081bc","year":2023},"citing_paper":{"arxiv_id":"2506.15610","last_updated":"2025-08-24T13:41:46Z","snapshot_observed_at":"2026-08-07T21:29:34.511582Z","submitted_at":"2025-06-18T16:40:05Z","title":"BoxFusion: Reconstruction-Free Open-Vocabulary 3D Object Detection via Real-Time Multi-View Box Fusion","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T23:57:19.773113Z"},"links":{"citing_paper":"/paper/2506.15610"},"observation_digest":"sha256:ca93782f9d0d38dff26084057e7ed11c241968b8c02d9ff6e9ca364b50304e36","observation_id":"2c0833e2-f403-4540-b463-5e4af2c0c3db","resolution":{"observed_at":"2026-08-06T23:57:28.953346Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.10439","last_updated":"2025-08-28T04:36:42Z","snapshot_observed_at":"2026-08-07T23:58:35.215663Z","submitted_at":"2024-12-11T09:50:35Z","title":"CogNav: Cognitive Process Modeling for Object Goal Navigation with LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.10439","snapshot_observed_at":"2026-08-06T23:57:19.841794Z","title":"Cognav: Cognitive pro- cess modeling for object goal navigation with llms","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.15610","last_updated":"2025-08-24T13:41:46Z","snapshot_observed_at":"2026-08-07T21:29:34.511582Z","submitted_at":"2025-06-18T16:40:05Z","title":"BoxFusion: Reconstruction-Free Open-Vocabulary 3D Object Detection via Real-Time Multi-View Box Fusion","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T23:57:19.841794Z"},"links":{"cited_paper":"/paper/2412.10439","citing_paper":"/paper/2506.15610"},"observation_digest":"sha256:9536bd368fe942a04deabcd6933931a77c020c106df3bef942ff2ae96172df47","observation_id":"0b8c31d0-66db-44f9-9ef4-7319f9e8b31b","resolution":{"observed_at":"2026-08-06T23:57:19.841794Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:57:28.689092Z","title":"Collabo- rative novel object discovery and box-guided cross-modal alignment for open-vocabulary 3d object detection","venue":null,"work_id":"5e7ea214-3e84-4b1e-ac13-b4c57e5cfb4a","year":null},"citing_paper":{"arxiv_id":"2506.15610","last_updated":"2025-08-24T13:41:46Z","snapshot_observed_at":"2026-08-07T21:29:34.511582Z","submitted_at":"2025-06-18T16:40:05Z","title":"BoxFusion: Reconstruction-Free Open-Vocabulary 3D Object Detection via Real-Time Multi-View Box Fusion","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T23:57:19.882914Z"},"links":{"citing_paper":"/paper/2506.15610"},"observation_digest":"sha256:760fc427de1560b48de0a481276e99d9356e13deb7320fc3af7447aeb76ad62c","observation_id":"388626aa-3df2-4a49-9063-f2f5c4043019","resolution":{"observed_at":"2026-08-06T23:57:28.757700Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:57:28.506007Z","title":"A hierarchical graph network for 3d object detection on point clouds","venue":null,"work_id":"d4fda422-c373-43e0-9c3d-384275c85d74","year":2020},"citing_paper":{"arxiv_id":"2506.15610","last_updated":"2025-08-24T13:41:46Z","snapshot_observed_at":"2026-08-07T21:29:34.511582Z","submitted_at":"2025-06-18T16:40:05Z","title":"BoxFusion: Reconstruction-Free Open-Vocabulary 3D Object Detection via Real-Time Multi-View Box Fusion","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T23:57:19.973335Z"},"links":{"citing_paper":"/paper/2506.15610"},"observation_digest":"sha256:07f598b5b2ac76e0779673565d9e91d640b565e51477cd362a7746921412dea9","observation_id":"74be73ef-6495-406f-9033-f653c0842a43","resolution":{"observed_at":"2026-08-06T23:57:28.627155Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:57:20.052396Z","title":"Scannet: Richly-annotated 3d reconstructions of indoor scenes","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.15610","last_updated":"2025-08-24T13:41:46Z","snapshot_observed_at":"2026-08-07T21:29:34.511582Z","submitted_at":"2025-06-18T16:40:05Z","title":"BoxFusion: Reconstruction-Free Open-Vocabulary 3D Object Detection via Real-Time Multi-View Box Fusion","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T23:57:20.052396Z"},"links":{"citing_paper":"/paper/2506.15610"},"observation_digest":"sha256:f8b577df47ebdef4dd19a055e07ddbe366933b90e53b83d8bf2a7d1c171b4a74","observation_id":"075ef2eb-c0fd-4efd-ad99-59efe427d5b2","resolution":{"observed_at":"2026-08-06T23:57:20.052396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:57:28.226228Z","title":"Graph-to-3d: End-to-end generation and ma- nipulation of 3d scenes using scene graphs","venue":null,"work_id":"4f712992-e6f3-43e2-971b-b177709037e3","year":2021},"citing_paper":{"arxiv_id":"2506.15610","last_updated":"2025-08-24T13:41:46Z","snapshot_observed_at":"2026-08-07T21:29:34.511582Z","submitted_at":"2025-06-18T16:40:05Z","title":"BoxFusion: Reconstruction-Free Open-Vocabulary 3D Object Detection via Real-Time Multi-View Box Fusion","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T23:57:20.088537Z"},"links":{"citing_paper":"/paper/2506.15610"},"observation_digest":"sha256:e46ed473c56b55d91d02db7a922187931b8c6e058f9374075fe02bd553a2e98b","observation_id":"38ade343-5ea4-4662-bfd7-b99dbd518673","resolution":{"observed_at":"2026-08-06T23:57:28.354338Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:57:28.015032Z","title":"Disarm: Displacement aware relation mod- ule for 3d detection","venue":null,"work_id":"ddb6b6a7-07c8-465d-bdaf-e0cc600e1c1d","year":2022},"citing_paper":{"arxiv_id":"2506.15610","last_updated":"2025-08-24T13:41:46Z","snapshot_observed_at":"2026-08-07T21:29:34.511582Z","submitted_at":"2025-06-18T16:40:05Z","title":"BoxFusion: Reconstruction-Free Open-Vocabulary 3D Object Detection via Real-Time Multi-View Box Fusion","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T23:57:20.164335Z"},"links":{"citing_paper":"/paper/2506.15610"},"observation_digest":"sha256:fde5d8f79052fabccefb8729e46bdfeaae8a2ac8a7a456475e795c615585c39e","observation_id":"d1050601-59d1-432a-8b23-85b38cba320d","resolution":{"observed_at":"2026-08-06T23:57:28.112593Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:57:20.230116Z","title":"3d-mpa: Multi-proposal ag- gregation for 3d semantic instance segmentation","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.15610","last_updated":"2025-08-24T13:41:46Z","snapshot_observed_at":"2026-08-07T21:29:34.511582Z","submitted_at":"2025-06-18T16:40:05Z","title":"BoxFusion: Reconstruction-Free Open-Vocabulary 3D Object Detection via Real-Time Multi-View Box Fusion","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T23:57:20.230116Z"},"links":{"citing_paper":"/paper/2506.15610"},"observation_digest":"sha256:148a57e5c82d1e66e056bc1e106d84dd7135b2ad33fe14db68c5da110a8b4493","observation_id":"d8b0e6e4-1366-422a-ad17-2a5387f33182","resolution":{"observed_at":"2026-08-06T23:57:20.230116Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:57:20.266963Z","title":"Generic objects as pose probes for few- shot view synthesis","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.15610","last_updated":"2025-08-24T13:41:46Z","snapshot_observed_at":"2026-08-07T21:29:34.511582Z","submitted_at":"2025-06-18T16:40:05Z","title":"BoxFusion: Reconstruction-Free Open-Vocabulary 3D Object Detection via Real-Time Multi-View Box Fusion","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T23:57:20.266963Z"},"links":{"citing_paper":"/paper/2506.15610"},"observation_digest":"sha256:05de6ecd90c38050ef36e4b13679d14b42e3e5528e3a9e54e71f8be87206093d","observation_id":"31c53f9e-0276-4e75-b58f-926c262a9e92","resolution":{"observed_at":"2026-08-06T23:57:20.266963Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:57:27.805948Z","title":"Training an open-vocabulary monocular 3d detection model without 3d data","venue":null,"work_id":"829225e2-ca8e-4d51-af29-f81e54e8bf20","year":null},"citing_paper":{"arxiv_id":"2506.15610","last_updated":"2025-08-24T13:41:46Z","snapshot_observed_at":"2026-08-07T21:29:34.511582Z","submitted_at":"2025-06-18T16:40:05Z","title":"BoxFusion: Reconstruction-Free Open-Vocabulary 3D Object Detection via Real-Time Multi-View Box Fusion","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T23:57:20.342896Z"},"links":{"citing_paper":"/paper/2506.15610"},"observation_digest":"sha256:886ac5920e27d859e68c5a26c804175c837699dbb33408fc91c7e3859616c800","observation_id":"0d60c4cf-3e4f-4aa1-be89-2bee002f3ca6","resolution":{"observed_at":"2026-08-06T23:57:27.903048Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:57:27.546451Z","title":"Particle filter with swarm move for optimiza- tion","venue":null,"work_id":"ea3e08ad-c7ed-42c3-99e6-f189bb90c53d","year":2008},"citing_paper":{"arxiv_id":"2506.15610","last_updated":"2025-08-24T13:41:46Z","snapshot_observed_at":"2026-08-07T21:29:34.511582Z","submitted_at":"2025-06-18T16:40:05Z","title":"BoxFusion: Reconstruction-Free Open-Vocabulary 3D Object Detection via Real-Time Multi-View Box Fusion","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T23:57:20.428794Z"},"links":{"citing_paper":"/paper/2506.15610"},"observation_digest":"sha256:db8818e2f079ff24d9da28241aec0753793e532b6123e1270b1a908acd58b15d","observation_id":"f90b80f4-833b-4283-954a-ebe59cff9416","resolution":{"observed_at":"2026-08-06T23:57:27.648559Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:57:27.349722Z","title":"Open-vocabulary 3d semantic segmentation with foundation models","venue":null,"work_id":"ccf1aaf2-7be9-4ec5-9ff8-0da7023a9fff","year":2024},"citing_paper":{"arxiv_id":"2506.15610","last_updated":"2025-08-24T13:41:46Z","snapshot_observed_at":"2026-08-07T21:29:34.511582Z","submitted_at":"2025-06-18T16:40:05Z","title":"BoxFusion: Reconstruction-Free Open-Vocabulary 3D Object Detection via Real-Time Multi-View Box Fusion","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T23:57:20.468149Z"},"links":{"citing_paper":"/paper/2506.15610"},"observation_digest":"sha256:0e91f43c1821faa0266444fd92390dc1fa0f96b26f3e8da70cb3cbfb8573d757","observation_id":"deac8d6b-e5d5-4cd7-bbc0-6472fae19635","resolution":{"observed_at":"2026-08-06T23:57:27.458507Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:57:20.519699Z","title":"Segment any- thing","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.15610","last_updated":"2025-08-24T13:41:46Z","snapshot_observed_at":"2026-08-07T21:29:34.511582Z","submitted_at":"2025-06-18T16:40:05Z","title":"BoxFusion: Reconstruction-Free Open-Vocabulary 3D Object Detection via Real-Time Multi-View Box Fusion","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T23:57:20.519699Z"},"links":{"citing_paper":"/paper/2506.15610"},"observation_digest":"sha256:95163de1b996add74cc4720bfb824ce86ff0a325cff1d361f223c50f22018d64","observation_id":"c84d6efc-034c-45c1-9efa-fc92731b8523","resolution":{"observed_at":"2026-08-06T23:57:20.519699Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:57:27.092245Z","title":"Pycuda and pyopencl: A scripting-based approach to gpu run-time code generation","venue":null,"work_id":"ff6ff2bc-3da7-417d-995a-5f5ec3b593cb","year":2012},"citing_paper":{"arxiv_id":"2506.15610","last_updated":"2025-08-24T13:41:46Z","snapshot_observed_at":"2026-08-07T21:29:34.511582Z","submitted_at":"2025-06-18T16:40:05Z","title":"BoxFusion: Reconstruction-Free Open-Vocabulary 3D Object Detection via Real-Time Multi-View Box Fusion","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T23:57:20.613522Z"},"links":{"citing_paper":"/paper/2506.15610"},"observation_digest":"sha256:5697b6c64e9e206d4ed5f24f0119a813b973aa1818077dd683533c3f9a86a734","observation_id":"b7fbde06-5851-4147-b246-6cbd89a7e6b2","resolution":{"observed_at":"2026-08-06T23:57:27.208995Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:57:26.978596Z","title":"Open3dsg: Open- vocabulary 3d scene graphs from point clouds with queryable objects and open-set relationships","venue":null,"work_id":"862fc012-5cbc-484b-934a-e4d4719521eb","year":2024},"citing_paper":{"arxiv_id":"2506.15610","last_updated":"2025-08-24T13:41:46Z","snapshot_observed_at":"2026-08-07T21:29:34.511582Z","submitted_at":"2025-06-18T16:40:05Z","title":"BoxFusion: Reconstruction-Free Open-Vocabulary 3D Object Detection via Real-Time Multi-View Box Fusion","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T23:57:20.681004Z"},"links":{"citing_paper":"/paper/2506.15610"},"observation_digest":"sha256:bb8b9677d67db71959644a6375f85ca0c23062c95f2c4b35dac972d7006ae3d1","observation_id":"d59def1e-fea6-4475-af13-29d4b993c969","resolution":{"observed_at":"2026-08-06T23:57:27.039717Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:57:26.768443Z","title":"Arm3d: Attention-based re- lation module for indoor 3d object detection","venue":null,"work_id":"6b067171-e396-4328-8f5c-ce1b2bb95647","year":2022},"citing_paper":{"arxiv_id":"2506.15610","last_updated":"2025-08-24T13:41:46Z","snapshot_observed_at":"2026-08-07T21:29:34.511582Z","submitted_at":"2025-06-18T16:40:05Z","title":"BoxFusion: Reconstruction-Free Open-Vocabulary 3D Object Detection via Real-Time Multi-View Box Fusion","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T23:57:20.729580Z"},"links":{"citing_paper":"/paper/2506.15610"},"observation_digest":"sha256:4404aaf023e7fa340887e328090a481fed8bdbd242304303745114e8f056752d","observation_id":"3227a5b0-11eb-43fa-9c32-8ba76137b8f6","resolution":{"observed_at":"2026-08-06T23:57:26.883501Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2507.17594","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:57:23.536902Z","title":"Remixfusion: Residual-based mixed representation for large-scale online rgb-d reconstruction","venue":null,"work_id":"c4307c64-1573-4f6c-af71-ba81714beb0c","year":2025},"citing_paper":{"arxiv_id":"2506.15610","last_updated":"2025-08-24T13:41:46Z","snapshot_observed_at":"2026-08-07T21:29:34.511582Z","submitted_at":"2025-06-18T16:40:05Z","title":"BoxFusion: Reconstruction-Free Open-Vocabulary 3D Object Detection via Real-Time Multi-View Box Fusion","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T23:57:20.762678Z"},"links":{"citing_paper":"/paper/2506.15610"},"observation_digest":"sha256:fcd611b25c4555f5f41524ccfc3cfc46f0f3870c4213d6cf46f50d17564b7084","observation_id":"dee36243-c969-4f07-99cd-a68810ab5ec5","resolution":{"observed_at":"2026-08-06T23:57:23.622737Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.04458","last_updated":"2024-12-05T18:59:09Z","snapshot_observed_at":"2026-07-06T20:02:21.509050Z","submitted_at":"2024-12-05T18:59:09Z","title":"Cubify Anything: Scaling Indoor 3D Object Detection","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.04458","snapshot_observed_at":"2026-08-06T23:57:20.836056Z","title":"Cubify anything: Scaling in- door 3d object detection","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.15610","last_updated":"2025-08-24T13:41:46Z","snapshot_observed_at":"2026-08-07T21:29:34.511582Z","submitted_at":"2025-06-18T16:40:05Z","title":"BoxFusion: Reconstruction-Free Open-Vocabulary 3D Object Detection via Real-Time Multi-View Box Fusion","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T23:57:20.836056Z"},"links":{"cited_paper":"/paper/2412.04458","citing_paper":"/paper/2506.15610"},"observation_digest":"sha256:553ca8a7008a2a7f69b23ec06afe1a85f6278764ccdb25c665ada9f7b8937321","observation_id":"c3d0f184-e88b-462e-b7ed-749b937e064d","resolution":{"observed_at":"2026-08-06T23:57:20.836056Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:57:26.663594Z","title":"Patch- work++: Fast and robust ground segmentation solving par- tial under-segmentation using 3D point cloud","venue":null,"work_id":"2f4042da-57e1-4f61-b0f8-c9fd889dab3c","year":2022},"citing_paper":{"arxiv_id":"2506.15610","last_updated":"2025-08-24T13:41:46Z","snapshot_observed_at":"2026-08-07T21:29:34.511582Z","submitted_at":"2025-06-18T16:40:05Z","title":"BoxFusion: Reconstruction-Free Open-Vocabulary 3D Object Detection via Real-Time Multi-View Box Fusion","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T23:57:20.923788Z"},"links":{"citing_paper":"/paper/2506.15610"},"observation_digest":"sha256:f0081dc5009a3f2fb96bc97c4048bcd43dcaccf866a03c5b7ee07b27a0aca7ba","observation_id":"ec19e30d-dcdb-4eec-bffa-9f5e596b0550","resolution":{"observed_at":"2026-08-06T23:57:26.706827Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:57:26.533688Z","title":"Ground- ing image matching in 3d with mast3r","venue":null,"work_id":"64bc8e73-707c-478f-9d88-1bdccc9378e9","year":2024},"citing_paper":{"arxiv_id":"2506.15610","last_updated":"2025-08-24T13:41:46Z","snapshot_observed_at":"2026-08-07T21:29:34.511582Z","submitted_at":"2025-06-18T16:40:05Z","title":"BoxFusion: Reconstruction-Free Open-Vocabulary 3D Object Detection via Real-Time Multi-View Box Fusion","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T23:57:20.959777Z"},"links":{"citing_paper":"/paper/2506.15610"},"observation_digest":"sha256:663499eaacff64c4edc5a9210f82acb1734c5b6fe90445165f897e5057c880d8","observation_id":"910dc8e6-aeb9-4fc5-a6a5-3799fbe6260d","resolution":{"observed_at":"2026-08-06T23:57:26.588898Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:57:26.357199Z","title":"Grass: Generative recursive autoencoders for shape structures","venue":null,"work_id":"54cad0a6-6bcf-4e0e-a5f6-c3727ab3dc3d","year":2017},"citing_paper":{"arxiv_id":"2506.15610","last_updated":"2025-08-24T13:41:46Z","snapshot_observed_at":"2026-08-07T21:29:34.511582Z","submitted_at":"2025-06-18T16:40:05Z","title":"BoxFusion: Reconstruction-Free Open-Vocabulary 3D Object Detection via Real-Time Multi-View Box Fusion","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T23:57:21.029161Z"},"links":{"citing_paper":"/paper/2506.15610"},"observation_digest":"sha256:98aaac51e753220e4f3d3d7de79f01612e5226bc2e1405d17d286e45297ecf1b","observation_id":"59b8dedd-56c5-4851-8b47-19d2c55907c0","resolution":{"observed_at":"2026-08-06T23:57:26.435530Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:57:21.106713Z","title":"Prompting depth anything for 4k resolution accurate metric depth estimation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.15610","last_updated":"2025-08-24T13:41:46Z","snapshot_observed_at":"2026-08-07T21:29:34.511582Z","submitted_at":"2025-06-18T16:40:05Z","title":"BoxFusion: Reconstruction-Free Open-Vocabulary 3D Object Detection via Real-Time Multi-View Box Fusion","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T23:57:21.106713Z"},"links":{"citing_paper":"/paper/2506.15610"},"observation_digest":"sha256:ba57b4493dd0daa7e52448dc5a798812f6fd50bacdc18f7304a5333e7ea42129","observation_id":"54325d4d-4b34-4b92-a097-d8f71b7b38e0","resolution":{"observed_at":"2026-08-06T23:57:21.106713Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:57:21.156947Z","title":"Microsoft coco: Common objects in context","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2506.15610","last_updated":"2025-08-24T13:41:46Z","snapshot_observed_at":"2026-08-07T21:29:34.511582Z","submitted_at":"2025-06-18T16:40:05Z","title":"BoxFusion: Reconstruction-Free Open-Vocabulary 3D Object Detection via Real-Time Multi-View Box Fusion","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T23:57:21.156947Z"},"links":{"citing_paper":"/paper/2506.15610"},"observation_digest":"sha256:1082fb0b210995172c75c60f61d37e5ec255113d2c98c51f9a4e8750fe3e419b","observation_id":"9575c0d0-f9d0-40b1-b110-fd3ae562ec36","resolution":{"observed_at":"2026-08-06T23:57:21.156947Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:57:26.238588Z","title":"Grounding dino: Marrying dino with grounded pre-training for open-set object detection","venue":null,"work_id":"69a2aec7-c794-4e65-8444-aa33754ce59f","year":2024},"citing_paper":{"arxiv_id":"2506.15610","last_updated":"2025-08-24T13:41:46Z","snapshot_observed_at":"2026-08-07T21:29:34.511582Z","submitted_at":"2025-06-18T16:40:05Z","title":"BoxFusion: Reconstruction-Free Open-Vocabulary 3D Object Detection via Real-Time Multi-View Box Fusion","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T23:57:21.186493Z"},"links":{"citing_paper":"/paper/2506.15610"},"observation_digest":"sha256:5fbc36b63fce53718bcad3e04f4513d9e97c04b8e12a3b8f6a5d31e97c889ad7","observation_id":"780674c6-9d6d-4cff-8789-faf511f73e8a","resolution":{"observed_at":"2026-08-06T23:57:26.283502Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:57:26.061240Z","title":"Group-free 3d object detection via transformers","venue":null,"work_id":"b16f6aff-0fcd-4a4c-8fbd-ff5cc90281d7","year":2021},"citing_paper":{"arxiv_id":"2506.15610","last_updated":"2025-08-24T13:41:46Z","snapshot_observed_at":"2026-08-07T21:29:34.511582Z","submitted_at":"2025-06-18T16:40:05Z","title":"BoxFusion: Reconstruction-Free Open-Vocabulary 3D Object Detection via Real-Time Multi-View Box Fusion","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T23:57:21.272610Z"},"links":{"citing_paper":"/paper/2506.15610"},"observation_digest":"sha256:1aa30bc469de20e6c3c293f99765f94cd7baa1c5530ad6427c5e0968f35e0cf8","observation_id":"dd589e9a-127b-47bc-907e-1b2799c5740b","resolution":{"observed_at":"2026-08-06T23:57:26.161915Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:57:25.957829Z","title":"Open-vocabulary point-cloud object detection without 3d an- notation","venue":null,"work_id":"837a3325-7a61-43e8-9845-423b17689d54","year":null},"citing_paper":{"arxiv_id":"2506.15610","last_updated":"2025-08-24T13:41:46Z","snapshot_observed_at":"2026-08-07T21:29:34.511582Z","submitted_at":"2025-06-18T16:40:05Z","title":"BoxFusion: Reconstruction-Free Open-Vocabulary 3D Object Detection via Real-Time Multi-View Box Fusion","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T23:57:21.345759Z"},"links":{"citing_paper":"/paper/2506.15610"},"observation_digest":"sha256:a4914071af23c94a381d938d46a38188bbffcce41ce448971e865582d721db66","observation_id":"91b030f3-9a99-4eec-a10d-918adbd6017f","resolution":{"observed_at":"2026-08-06T23:57:26.006363Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:57:25.797541Z","title":"Oa-cnns: Omni- adaptive sparse cnns for 3d semantic segmentation","venue":null,"work_id":"4f76bf35-41c2-40d8-88f5-a398674078da","year":2024},"citing_paper":{"arxiv_id":"2506.15610","last_updated":"2025-08-24T13:41:46Z","snapshot_observed_at":"2026-08-07T21:29:34.511582Z","submitted_at":"2025-06-18T16:40:05Z","title":"BoxFusion: Reconstruction-Free Open-Vocabulary 3D Object Detection via Real-Time Multi-View Box Fusion","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T23:57:21.395450Z"},"links":{"citing_paper":"/paper/2506.15610"},"observation_digest":"sha256:88e7f4dede84b3467854aeabf6e04abc244b767e7ba2ca71f48f9ee465306133","observation_id":"2a316920-c355-4120-94c4-cefac417f91f","resolution":{"observed_at":"2026-08-06T23:57:25.853536Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:57:21.482945Z","title":"Pointnet: Deep learning on point sets for 3d classification and segmentation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.15610","last_updated":"2025-08-24T13:41:46Z","snapshot_observed_at":"2026-08-07T21:29:34.511582Z","submitted_at":"2025-06-18T16:40:05Z","title":"BoxFusion: Reconstruction-Free Open-Vocabulary 3D Object Detection via Real-Time Multi-View Box Fusion","version":3},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T23:57:21.482945Z"},"links":{"citing_paper":"/paper/2506.15610"},"observation_digest":"sha256:03a098a533470ace657f91f69885eee533afdab2ff3d9e8e68081d9afae9ace3","observation_id":"a546f684-a63e-49ea-95b2-b8102b33067a","resolution":{"observed_at":"2026-08-06T23:57:21.482945Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:57:25.701866Z","title":"Deep hough voting for 3d object detection in point clouds","venue":null,"work_id":"4136e5d3-8f43-4f9c-a90c-facc15d151ef","year":2019},"citing_paper":{"arxiv_id":"2506.15610","last_updated":"2025-08-24T13:41:46Z","snapshot_observed_at":"2026-08-07T21:29:34.511582Z","submitted_at":"2025-06-18T16:40:05Z","title":"BoxFusion: Reconstruction-Free Open-Vocabulary 3D Object Detection via Real-Time Multi-View Box Fusion","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T23:57:21.554743Z"},"links":{"citing_paper":"/paper/2506.15610"},"observation_digest":"sha256:32a82b3f84e374fcca4e464b628221c527ff6e81fd253bcaa8d4a341334a587a","observation_id":"4839aa72-f402-41b5-ae08-ff2ffea84526","resolution":{"observed_at":"2026-08-06T23:57:25.752058Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:57:25.557242Z","title":"Imvotenet: Boosting 3d object detection in point clouds with image votes","venue":null,"work_id":"6189fe02-b977-4533-987c-27c45cb96ef1","year":2020},"citing_paper":{"arxiv_id":"2506.15610","last_updated":"2025-08-24T13:41:46Z","snapshot_observed_at":"2026-08-07T21:29:34.511582Z","submitted_at":"2025-06-18T16:40:05Z","title":"BoxFusion: Reconstruction-Free Open-Vocabulary 3D Object Detection via Real-Time Multi-View Box Fusion","version":3},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T23:57:21.596405Z"},"links":{"citing_paper":"/paper/2506.15610"},"observation_digest":"sha256:c9523ac919f06c3837ef0e1ad8bb5f91b025e66da1352a9e6b482e63097a469e","observation_id":"b82ca3dc-b805-459e-a51a-130f286f6df0","resolution":{"observed_at":"2026-08-06T23:57:25.631090Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:57:25.430052Z","title":"High quality entity segmentation","venue":null,"work_id":"2d716af7-3ce8-4398-b5bd-3de1e8c9a9d5","year":2023},"citing_paper":{"arxiv_id":"2506.15610","last_updated":"2025-08-24T13:41:46Z","snapshot_observed_at":"2026-08-07T21:29:34.511582Z","submitted_at":"2025-06-18T16:40:05Z","title":"BoxFusion: Reconstruction-Free Open-Vocabulary 3D Object Detection via Real-Time Multi-View Box Fusion","version":3},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T23:57:21.698243Z"},"links":{"citing_paper":"/paper/2506.15610"},"observation_digest":"sha256:90963619c3f2fe1c0ea56c39132d2e39c25d1d018d59e785dd058cb4a32d3aa1","observation_id":"ef7a074c-2554-4528-ad20-99f58a209b56","resolution":{"observed_at":"2026-08-06T23:57:25.480306Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:57:21.761942Z","title":"Learning transferable visual models from natural language supervi- sion","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.15610","last_updated":"2025-08-24T13:41:46Z","snapshot_observed_at":"2026-08-07T21:29:34.511582Z","submitted_at":"2025-06-18T16:40:05Z","title":"BoxFusion: Reconstruction-Free Open-Vocabulary 3D Object Detection via Real-Time Multi-View Box Fusion","version":3},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T23:57:21.761942Z"},"links":{"citing_paper":"/paper/2506.15610"},"observation_digest":"sha256:a511219aa1fb96960ea5cbb2893a50f5c05e4accfe48a1e499346e0b451d78d3","observation_id":"6b2d430e-9b97-48aa-96ac-120d0f782967","resolution":{"observed_at":"2026-08-06T23:57:21.761942Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:57:25.312118Z","title":"Fcaf3d: Fully convolutional anchor-free 3d object detection","venue":null,"work_id":"2f0873c5-ac19-43e8-9feb-35ae65344791","year":null},"citing_paper":{"arxiv_id":"2506.15610","last_updated":"2025-08-24T13:41:46Z","snapshot_observed_at":"2026-08-07T21:29:34.511582Z","submitted_at":"2025-06-18T16:40:05Z","title":"BoxFusion: Reconstruction-Free Open-Vocabulary 3D Object Detection via Real-Time Multi-View Box Fusion","version":3},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T23:57:21.814853Z"},"links":{"citing_paper":"/paper/2506.15610"},"observation_digest":"sha256:bf604ec57f6a57377271400dcc2423752b9543894c5647d9c847284e80b54405","observation_id":"df1d47f0-249e-4836-be9c-390e09e8170c","resolution":{"observed_at":"2026-08-06T23:57:25.372401Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:57:25.130473Z","title":"Tr3d: Towards real-time indoor 3d object detection","venue":null,"work_id":"cae2b67f-2123-41b3-b385-b665f0fcf7c3","year":2023},"citing_paper":{"arxiv_id":"2506.15610","last_updated":"2025-08-24T13:41:46Z","snapshot_observed_at":"2026-08-07T21:29:34.511582Z","submitted_at":"2025-06-18T16:40:05Z","title":"BoxFusion: Reconstruction-Free Open-Vocabulary 3D Object Detection via Real-Time Multi-View Box Fusion","version":3},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T23:57:21.930156Z"},"links":{"citing_paper":"/paper/2506.15610"},"observation_digest":"sha256:4507e349f13b4f390f61a76b7bf9a45e05c2679c10630a2822ba13dca831a0a6","observation_id":"1c1b4d4e-87f8-4e03-8a56-88ab71b2c584","resolution":{"observed_at":"2026-08-06T23:57:25.175588Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.05663","last_updated":"2023-05-22T22:34:29Z","snapshot_observed_at":"2026-08-06T13:49:39.474018Z","submitted_at":"2022-10-11T17:57:10Z","title":"CLIP-Fields: Weakly Supervised Semantic Fields for Robotic Memory","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.05663","snapshot_observed_at":"2026-08-06T23:57:21.984804Z","title":"Clip-fields: Weakly supervised semantic fields for robotic memory","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.15610","last_updated":"2025-08-24T13:41:46Z","snapshot_observed_at":"2026-08-07T21:29:34.511582Z","submitted_at":"2025-06-18T16:40:05Z","title":"BoxFusion: Reconstruction-Free Open-Vocabulary 3D Object Detection via Real-Time Multi-View Box Fusion","version":3},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T23:57:21.984804Z"},"links":{"cited_paper":"/paper/2210.05663","citing_paper":"/paper/2506.15610"},"observation_digest":"sha256:4e4bdb43f44dc862af0b9c1739f88fb2703f74deb0fe9e116c7b29b248eafc19","observation_id":"f2a6349b-9088-4ba2-8369-76754884eeb7","resolution":{"observed_at":"2026-08-06T23:57:21.984804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:57:25.033308Z","title":"Mips-fusion: Multi-implicit-submaps for scalable and robust online neural rgb-d reconstruction.ACM Transactions on Graphics (TOG), 42(6):1–16, 2023","venue":null,"work_id":"e3324086-a2aa-4819-911b-ae3d12bec6f7","year":2023},"citing_paper":{"arxiv_id":"2506.15610","last_updated":"2025-08-24T13:41:46Z","snapshot_observed_at":"2026-08-07T21:29:34.511582Z","submitted_at":"2025-06-18T16:40:05Z","title":"BoxFusion: Reconstruction-Free Open-Vocabulary 3D Object Detection via Real-Time Multi-View Box Fusion","version":3},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T23:57:22.095652Z"},"links":{"citing_paper":"/paper/2506.15610"},"observation_digest":"sha256:25e93cc04de1481031cedcfd5f246d42cb7eb5a1ad230814d6f33961e878289d","observation_id":"71bfd0e5-8d45-4aee-b09c-70204a46798a","resolution":{"observed_at":"2026-08-06T23:57:25.058640Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01309","last_updated":"2025-03-30T07:15:48Z","snapshot_observed_at":"2026-08-07T17:34:24.172975Z","submitted_at":"2025-03-03T08:48:06Z","title":"OnlineAnySeg: Online Zero-Shot 3D Segmentation by Visual Foundation Model Guided 2D Mask Merging","version":3},"cited_work":{"arxiv_id":"2503.01309","doi":null,"metadata_source":"pith","pith_arxiv_id":"2503.01309","snapshot_observed_at":"2026-08-06T23:57:23.305916Z","title":"OnlineAnySeg: Online Zero-Shot 3D Segmentation by Visual Foundation Model Guided 2D Mask Merging","venue":"cs.CV","work_id":"ce1299e5-cee1-4756-be1e-4496450fe9df","year":2025},"citing_paper":{"arxiv_id":"2506.15610","last_updated":"2025-08-24T13:41:46Z","snapshot_observed_at":"2026-08-07T21:29:34.511582Z","submitted_at":"2025-06-18T16:40:05Z","title":"BoxFusion: Reconstruction-Free Open-Vocabulary 3D Object Detection via Real-Time Multi-View Box Fusion","version":3},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T23:57:22.137587Z"},"links":{"cited_paper":"/paper/2503.01309","citing_paper":"/paper/2506.15610"},"observation_digest":"sha256:c4b94be2d304d469897d4be0ccabcc5b8ecf9c2e03daa35da96aa4aed406675c","observation_id":"afcaf3b6-a840-4370-ad8d-9f1204a89f5b","resolution":{"observed_at":"2026-08-06T23:57:23.380699Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:57:24.829928Z","title":"Spatiallm: Large language model for spatial understanding","venue":null,"work_id":"a40144ee-210a-44ab-bfb9-fc38ccebf9e9","year":2025},"citing_paper":{"arxiv_id":"2506.15610","last_updated":"2025-08-24T13:41:46Z","snapshot_observed_at":"2026-08-07T21:29:34.511582Z","submitted_at":"2025-06-18T16:40:05Z","title":"BoxFusion: Reconstruction-Free Open-Vocabulary 3D Object Detection via Real-Time Multi-View Box Fusion","version":3},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T23:57:22.277083Z"},"links":{"citing_paper":"/paper/2506.15610"},"observation_digest":"sha256:268a5ec6fa4af37f4c01c5e293ff16eb5e874d77a46c674ced517251804ca3c2","observation_id":"b51d861a-0292-4570-92da-364bf9ed4fc3","resolution":{"observed_at":"2026-08-06T23:57:24.873173Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:57:24.715026Z","title":"Appa- 3d: an autonomous 3d path planning algorithm for uavs in unknown complex environments","venue":null,"work_id":"d70c129d-2656-4e78-b8c2-1ebb29b928ca","year":2024},"citing_paper":{"arxiv_id":"2506.15610","last_updated":"2025-08-24T13:41:46Z","snapshot_observed_at":"2026-08-07T21:29:34.511582Z","submitted_at":"2025-06-18T16:40:05Z","title":"BoxFusion: Reconstruction-Free Open-Vocabulary 3D Object Detection via Real-Time Multi-View Box Fusion","version":3},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T23:57:22.318089Z"},"links":{"citing_paper":"/paper/2506.15610"},"observation_digest":"sha256:9d57761466329c0e402b5adf3348837fb3e16238f163f2ee7e0182fa394284d4","observation_id":"80edae4e-0db0-48cd-ac43-a86dd91cdb9f","resolution":{"observed_at":"2026-08-06T23:57:24.755358Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:57:24.589482Z","title":"Dust3r: Geometric 3d vi- sion made easy","venue":null,"work_id":"7d95ef73-4ac4-4828-a13b-813c260880bc","year":2024},"citing_paper":{"arxiv_id":"2506.15610","last_updated":"2025-08-24T13:41:46Z","snapshot_observed_at":"2026-08-07T21:29:34.511582Z","submitted_at":"2025-06-18T16:40:05Z","title":"BoxFusion: Reconstruction-Free Open-Vocabulary 3D Object Detection via Real-Time Multi-View Box Fusion","version":3},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T23:57:22.370207Z"},"links":{"citing_paper":"/paper/2506.15610"},"observation_digest":"sha256:ad380ded00064b1b5e0ef48379aa18bf509917bed8aa4346d475a49538b58b2c","observation_id":"2c411c6a-c3fb-4ff7-ad39-c8b88103abb5","resolution":{"observed_at":"2026-08-06T23:57:24.649214Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:57:24.518523Z","title":"Ov-uni3detr: Towards unified open- vocabulary 3d object detection via cycle-modality propaga- tion","venue":null,"work_id":"9f58f2e6-bfb5-4e83-b05a-ddf78ba552e8","year":2024},"citing_paper":{"arxiv_id":"2506.15610","last_updated":"2025-08-24T13:41:46Z","snapshot_observed_at":"2026-08-07T21:29:34.511582Z","submitted_at":"2025-06-18T16:40:05Z","title":"BoxFusion: Reconstruction-Free Open-Vocabulary 3D Object Detection via Real-Time Multi-View Box Fusion","version":3},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T23:57:22.452928Z"},"links":{"citing_paper":"/paper/2506.15610"},"observation_digest":"sha256:1a53c5a3c46e3edffd451a31e5b32633520602ccb063051889c24573aecd8712","observation_id":"f1c669fc-2e85-4f4a-9ec6-ca30275c7c6c","resolution":{"observed_at":"2026-08-06T23:57:24.553960Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:57:24.397086Z","title":"Mlcvnet: Multi-level con- text votenet for 3d object detection","venue":null,"work_id":"b4aa08f5-ca34-4112-ae52-8adca5120add","year":2020},"citing_paper":{"arxiv_id":"2506.15610","last_updated":"2025-08-24T13:41:46Z","snapshot_observed_at":"2026-08-07T21:29:34.511582Z","submitted_at":"2025-06-18T16:40:05Z","title":"BoxFusion: Reconstruction-Free Open-Vocabulary 3D Object Detection via Real-Time Multi-View Box Fusion","version":3},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T23:57:22.497715Z"},"links":{"citing_paper":"/paper/2506.15610"},"observation_digest":"sha256:7903d9e591af7406598237cae50b7e1fe564b6eb3f248528422614c10e2447fa","observation_id":"5a1a0568-8def-4c35-b0eb-3b748886b4fb","resolution":{"observed_at":"2026-08-06T23:57:24.451083Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.11811","last_updated":"2025-02-12T05:16:17Z","snapshot_observed_at":"2026-07-06T19:04:09.389583Z","submitted_at":"2024-08-21T17:57:06Z","title":"EmbodiedSAM: Online Segment Any 3D Thing in Real Time","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.11811","snapshot_observed_at":"2026-08-06T23:57:22.527722Z","title":"Embodiedsam: Online segment any 3d thing in real time","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.15610","last_updated":"2025-08-24T13:41:46Z","snapshot_observed_at":"2026-08-07T21:29:34.511582Z","submitted_at":"2025-06-18T16:40:05Z","title":"BoxFusion: Reconstruction-Free Open-Vocabulary 3D Object Detection via Real-Time Multi-View Box Fusion","version":3},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T23:57:22.527722Z"},"links":{"cited_paper":"/paper/2408.11811","citing_paper":"/paper/2506.15610"},"observation_digest":"sha256:460d02d985c5d9c927352d8bcf715287454c845098f784956ebbedbabbd25896","observation_id":"1ac36b7a-40cb-4bff-b7a9-79acb6ce0495","resolution":{"observed_at":"2026-08-06T23:57:22.527722Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:57:24.303380Z","title":"Memory-based adapters for online 3d scene perception","venue":null,"work_id":"813a6412-8400-47e4-82ca-489859731725","year":2024},"citing_paper":{"arxiv_id":"2506.15610","last_updated":"2025-08-24T13:41:46Z","snapshot_observed_at":"2026-08-07T21:29:34.511582Z","submitted_at":"2025-06-18T16:40:05Z","title":"BoxFusion: Reconstruction-Free Open-Vocabulary 3D Object Detection via Real-Time Multi-View Box Fusion","version":3},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T23:57:22.557788Z"},"links":{"citing_paper":"/paper/2506.15610"},"observation_digest":"sha256:3dff702f836c7f0cca5bc1b834b38a4156d30a53213a04bc39eddf4f876fccca","observation_id":"ff68512c-d9b6-40c6-b356-a34588984168","resolution":{"observed_at":"2026-08-06T23:57:24.343165Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:57:24.189618Z","title":"M 2 diffuser: Diffusion-based trajectory optimization for mobile manipulation in 3d scenes","venue":null,"work_id":"ff71ff0d-e8a4-4804-92af-6701ba2a368f","year":null},"citing_paper":{"arxiv_id":"2506.15610","last_updated":"2025-08-24T13:41:46Z","snapshot_observed_at":"2026-08-07T21:29:34.511582Z","submitted_at":"2025-06-18T16:40:05Z","title":"BoxFusion: Reconstruction-Free Open-Vocabulary 3D Object Detection via Real-Time Multi-View Box Fusion","version":3},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T23:57:22.628208Z"},"links":{"citing_paper":"/paper/2506.15610"},"observation_digest":"sha256:9fe866e6ff0886f4e3027018f77e8ae7425cd7292c9e062c9b7215f975619370","observation_id":"6cf57c01-6a2e-455c-8279-9dd6305f69c8","resolution":{"observed_at":"2026-08-06T23:57:24.240521Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:57:24.071697Z","title":"Depth anything: Unleashing the power of large-scale unlabeled data","venue":null,"work_id":"497d2a55-9676-4193-a927-22b4cb1b6826","year":2024},"citing_paper":{"arxiv_id":"2506.15610","last_updated":"2025-08-24T13:41:46Z","snapshot_observed_at":"2026-08-07T21:29:34.511582Z","submitted_at":"2025-06-18T16:40:05Z","title":"BoxFusion: Reconstruction-Free Open-Vocabulary 3D Object Detection via Real-Time Multi-View Box Fusion","version":3},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T23:57:22.685438Z"},"links":{"citing_paper":"/paper/2506.15610"},"observation_digest":"sha256:705ca3fece802e60bfa597549bef4c28e80b459875459670f5e7cfadf462a983","observation_id":"74bc0535-9c10-4fa6-9e84-dc79c263eb7d","resolution":{"observed_at":"2026-08-06T23:57:24.146333Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.03908","last_updated":"2023-06-06T17:59:51Z","snapshot_observed_at":"2026-08-07T21:29:04.973616Z","submitted_at":"2023-06-06T17:59:51Z","title":"SAM3D: Segment Anything in 3D Scenes","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.03908","snapshot_observed_at":"2026-08-06T23:57:22.728460Z","title":"Sam3d: Segment anything in 3d scenes.arXiv preprint arXiv:2306.03908, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.15610","last_updated":"2025-08-24T13:41:46Z","snapshot_observed_at":"2026-08-07T21:29:34.511582Z","submitted_at":"2025-06-18T16:40:05Z","title":"BoxFusion: Reconstruction-Free Open-Vocabulary 3D Object Detection via Real-Time Multi-View Box Fusion","version":3},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T23:57:22.728460Z"},"links":{"cited_paper":"/paper/2306.03908","citing_paper":"/paper/2506.15610"},"observation_digest":"sha256:411d3440c951a71b71a20f699bd0b5a23a8e8e28a8fb9a129e5465a70b78e177","observation_id":"015464ae-5d32-4ab9-9b2c-29a2ac39231c","resolution":{"observed_at":"2026-08-06T23:57:22.728460Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:57:23.992832Z","title":"Sg-nav: Online 3d scene graph prompting for llm-based zero-shot object navigation","venue":null,"work_id":"67d10704-895a-42a4-b312-55237c034d66","year":2024},"citing_paper":{"arxiv_id":"2506.15610","last_updated":"2025-08-24T13:41:46Z","snapshot_observed_at":"2026-08-07T21:29:34.511582Z","submitted_at":"2025-06-18T16:40:05Z","title":"BoxFusion: Reconstruction-Free Open-Vocabulary 3D Object Detection via Real-Time Multi-View Box Fusion","version":3},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T23:57:22.763335Z"},"links":{"citing_paper":"/paper/2506.15610"},"observation_digest":"sha256:33740d9a8ebf8e43ace13c5df842e4504971a346927c42aba1a6add5d10ec4a1","observation_id":"552dd05e-4ae1-4825-bcb0-e26422f24d7e","resolution":{"observed_at":"2026-08-06T23:57:24.026578Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:57:22.826709Z","title":"Detect anything 3d in the wild","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.15610","last_updated":"2025-08-24T13:41:46Z","snapshot_observed_at":"2026-08-07T21:29:34.511582Z","submitted_at":"2025-06-18T16:40:05Z","title":"BoxFusion: Reconstruction-Free Open-Vocabulary 3D Object Detection via Real-Time Multi-View Box Fusion","version":3},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T23:57:22.826709Z"},"links":{"citing_paper":"/paper/2506.15610"},"observation_digest":"sha256:e2a82a874773bb7e690be412f74db175e55d141c4bf4a3a614a6ac8b0fb49ddc","observation_id":"924d9691-d87c-4949-824a-7fdcc3e8ba7a","resolution":{"observed_at":"2026-08-06T23:57:22.826709Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:57:23.888974Z","title":"Rosefusion: random optimization for online dense recon- struction under fast camera motion","venue":null,"work_id":"f8798fac-d165-42e3-b1e2-4d428e0c54a0","year":2021},"citing_paper":{"arxiv_id":"2506.15610","last_updated":"2025-08-24T13:41:46Z","snapshot_observed_at":"2026-08-07T21:29:34.511582Z","submitted_at":"2025-06-18T16:40:05Z","title":"BoxFusion: Reconstruction-Free Open-Vocabulary 3D Object Detection via Real-Time Multi-View Box Fusion","version":3},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T23:57:22.878121Z"},"links":{"citing_paper":"/paper/2506.15610"},"observation_digest":"sha256:c8641342f4d17b34dcf7b5fe7294b67456a97cbd9f3fd85313765e988a21fb56","observation_id":"4e9fc568-6ea5-47c4-b2a4-90ae0ef3af85","resolution":{"observed_at":"2026-08-06T23:57:23.943526Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:57:23.813685Z","title":"Asro- dio: Active subspace random optimization based depth iner- tial odometry","venue":null,"work_id":"5e65e6f6-a796-444d-9d4e-5a4080a36f36","year":2022},"citing_paper":{"arxiv_id":"2506.15610","last_updated":"2025-08-24T13:41:46Z","snapshot_observed_at":"2026-08-07T21:29:34.511582Z","submitted_at":"2025-06-18T16:40:05Z","title":"BoxFusion: Reconstruction-Free Open-Vocabulary 3D Object Detection via Real-Time Multi-View Box Fusion","version":3},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T23:57:22.925803Z"},"links":{"citing_paper":"/paper/2506.15610"},"observation_digest":"sha256:962465e50b51e9261fc32099ddb9eb6183c59b2ebb4c8e24d02cdea17937fc09","observation_id":"55298ec4-c903-45d7-a8f6-00eb2c24a56b","resolution":{"observed_at":"2026-08-06T23:57:23.835827Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:57:23.010201Z","title":"Gamma: Graspability-aware mobile manipulation policy learning based on online grasping pose fusion","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.15610","last_updated":"2025-08-24T13:41:46Z","snapshot_observed_at":"2026-08-07T21:29:34.511582Z","submitted_at":"2025-06-18T16:40:05Z","title":"BoxFusion: Reconstruction-Free Open-Vocabulary 3D Object Detection via Real-Time Multi-View Box Fusion","version":3},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T23:57:23.010201Z"},"links":{"citing_paper":"/paper/2506.15610"},"observation_digest":"sha256:02fbb1f55775e1b94601b4de018ba43a7c2b98089ea2d54e0f18057b2d5de708","observation_id":"9ecbafac-1468-433c-84d3-d9f093d7f8cc","resolution":{"observed_at":"2026-08-06T23:57:23.010201Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:57:23.071247Z","title":"Navgpt: Explicit reasoning in vision-and-language navigation with large lan- guage models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.15610","last_updated":"2025-08-24T13:41:46Z","snapshot_observed_at":"2026-08-07T21:29:34.511582Z","submitted_at":"2025-06-18T16:40:05Z","title":"BoxFusion: Reconstruction-Free Open-Vocabulary 3D Object Detection via Real-Time Multi-View Box Fusion","version":3},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T23:57:23.071247Z"},"links":{"citing_paper":"/paper/2506.15610"},"observation_digest":"sha256:55c831634569ea333b52af870873b4f1d05823827dd6937bd2f9d12a57d3e806","observation_id":"a182b4fd-c592-49a9-9db0-a63b974bf72d","resolution":{"observed_at":"2026-08-06T23:57:23.071247Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:57:23.665276Z","title":"V oxelnet: End-to-end learning for point cloud based 3d object detection","venue":null,"work_id":"3cd4c095-b712-428d-aa7c-e07aa1688387","year":2018},"citing_paper":{"arxiv_id":"2506.15610","last_updated":"2025-08-24T13:41:46Z","snapshot_observed_at":"2026-08-07T21:29:34.511582Z","submitted_at":"2025-06-18T16:40:05Z","title":"BoxFusion: Reconstruction-Free Open-Vocabulary 3D Object Detection via Real-Time Multi-View Box Fusion","version":3},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T23:57:23.112112Z"},"links":{"citing_paper":"/paper/2506.15610"},"observation_digest":"sha256:2633760a92313e280bfa0813dd164041100fd38be38dd61050dbf66046570384","observation_id":"a8379172-f2ab-4ea4-856e-f298b4209031","resolution":{"observed_at":"2026-08-06T23:57:23.706522Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:57:25.210067Z","title":"1, 2, 6, 7, 8","venue":null,"work_id":"4c69923a-1245-40c9-82ec-4448f7733c1c","year":2022},"citing_paper":{"arxiv_id":"2506.15610","last_updated":"2025-08-24T13:41:46Z","snapshot_observed_at":"2026-08-07T21:29:34.511582Z","submitted_at":"2025-06-18T16:40:05Z","title":"BoxFusion: Reconstruction-Free Open-Vocabulary 3D Object Detection via Real-Time Multi-View Box Fusion","version":3},"reference_index":493,"source":"pdf_text","source_observed_at":"2026-08-06T23:57:21.877808Z"},"links":{"citing_paper":"/paper/2506.15610"},"observation_digest":"sha256:431e8c481882cc4497be24af6c65bf4da71a43384bf475efb50b48b7fef4a749","observation_id":"01a24053-0f17-464d-ac33-dffac7eb64fb","resolution":{"observed_at":"2026-08-06T23:57:25.260929Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:57:24.907203Z","title":null,"venue":null,"work_id":"8c47b58c-153a-493d-b4c2-81582d1f3651","year":null},"citing_paper":{"arxiv_id":"2506.15610","last_updated":"2025-08-24T13:41:46Z","snapshot_observed_at":"2026-08-07T21:29:34.511582Z","submitted_at":"2025-06-18T16:40:05Z","title":"BoxFusion: Reconstruction-Free Open-Vocabulary 3D Object Detection via Real-Time Multi-View Box Fusion","version":3},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-06T23:57:22.189342Z"},"links":{"citing_paper":"/paper/2506.15610"},"observation_digest":"sha256:47b4bc8970bc8c3c18e34a2d6e75e12065fe4d6126352c0330a6c0a3a3e04987","observation_id":"e659c0d4-049c-4405-9e6f-930cac7aa061","resolution":{"observed_at":"2026-08-06T23:57:24.976651Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.15610","last_updated":"2025-08-24T13:41:46Z","latest_version":3,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T21:29:34.511582Z","submitted_at":"2025-06-18T16:40:05Z","title":"BoxFusion: Reconstruction-Free Open-Vocabulary 3D Object Detection via Real-Time Multi-View Box Fusion"},"reference_resolution":{"displayed":57,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":1,"unresolved":16,"verified_exact":2,"verified_fuzzy":38},"total_outbound_references":57},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 57 of 57 outbound references and 0 inbound Pith citation observations for arXiv:2506.15610."}