{"as_of":"2026-08-20T04:49:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a6c49534899b4bf76155674df481c983b7faf3d31e8b02a2497c5d47ef587420","coverage":[{"denominator":26,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":26,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T19:53:12.973793Z","state":"measured"},{"denominator":26,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":26,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.13363/citation-record","integrity":"/paper/2507.13363/integrity","json":"/paper/2507.13363/citation-record.json","paper":"/paper/2507.13363"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:53:16.087441Z","title":"Lang, Sourabh V ora, Venice Erin Liong, Qiang Xu, Anush Krishnan, Yu Pan, Gi- ancarlo Baldan, and Oscar Beijbom","venue":null,"work_id":"43653008-9b08-4a76-b2f8-7dc342467eff","year":2020},"citing_paper":{"arxiv_id":"2507.13363","last_updated":"2025-07-06T15:00:13Z","snapshot_observed_at":"2026-08-06T19:45:42.295815Z","submitted_at":"2025-07-06T15:00:13Z","title":"Just Add Geometry: Gradient-Free Open-Vocabulary 3D Detection Without Human-in-the-Loop","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T19:53:10.707737Z"},"links":{"citing_paper":"/paper/2507.13363"},"observation_digest":"sha256:a71e9b115f1b3c28fbf94f5013c111b03c26121e224a21b37e3c3760d5fd2791","observation_id":"756b31d3-4b71-470c-848b-5e1f3c97582a","resolution":{"observed_at":"2026-08-06T19:53:16.240488Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:53:15.804455Z","title":"nuscenes: A multimodal dataset for autonomous driv- ing","venue":null,"work_id":"382b8e88-0537-46ad-8eeb-59cdc609f965","year":2020},"citing_paper":{"arxiv_id":"2507.13363","last_updated":"2025-07-06T15:00:13Z","snapshot_observed_at":"2026-08-06T19:45:42.295815Z","submitted_at":"2025-07-06T15:00:13Z","title":"Just Add Geometry: Gradient-Free Open-Vocabulary 3D Detection Without Human-in-the-Loop","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T19:53:10.790288Z"},"links":{"citing_paper":"/paper/2507.13363"},"observation_digest":"sha256:5db9d56841ca937bb3e6a30b318361552076672f59f09c156efe611c81dce50f","observation_id":"651cd614-9a53-44d7-b257-583c8034331e","resolution":{"observed_at":"2026-08-06T19:53:15.924631Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:53:15.713093Z","title":"Glip: Grounded language-image pre-training","venue":null,"work_id":"037db4be-1dcc-426d-b293-73b555242051","year":2022},"citing_paper":{"arxiv_id":"2507.13363","last_updated":"2025-07-06T15:00:13Z","snapshot_observed_at":"2026-08-06T19:45:42.295815Z","submitted_at":"2025-07-06T15:00:13Z","title":"Just Add Geometry: Gradient-Free Open-Vocabulary 3D Detection Without Human-in-the-Loop","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T19:53:10.869876Z"},"links":{"citing_paper":"/paper/2507.13363"},"observation_digest":"sha256:c49276a2def741db45261dbfbd0df5a19ce29decfc71075d57a8f725cd6c5ac5","observation_id":"341c9cb0-c041-4c79-ac67-60d7606ca020","resolution":{"observed_at":"2026-08-06T19:53:15.766867Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:53:15.616899Z","title":"Are we ready for autonomous driving? the kitti vision benchmark suite","venue":null,"work_id":"7cb56970-8132-4438-8744-1c17da73f45a","year":2012},"citing_paper":{"arxiv_id":"2507.13363","last_updated":"2025-07-06T15:00:13Z","snapshot_observed_at":"2026-08-06T19:45:42.295815Z","submitted_at":"2025-07-06T15:00:13Z","title":"Just Add Geometry: Gradient-Free Open-Vocabulary 3D Detection Without Human-in-the-Loop","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T19:53:10.943668Z"},"links":{"citing_paper":"/paper/2507.13363"},"observation_digest":"sha256:3677f7d53d65cdeaab13438230d50b26d72b42faa918573a7b7f7e5552f0033b","observation_id":"2ba90232-de17-4fcc-a3d3-99f9c63682b4","resolution":{"observed_at":"2026-08-06T19:53:15.655536Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:53:15.524298Z","title":"Lvis: A dataset for large vocabulary instance segmentation","venue":null,"work_id":"479f91c8-5c95-4eaf-97e6-000299e89050","year":2019},"citing_paper":{"arxiv_id":"2507.13363","last_updated":"2025-07-06T15:00:13Z","snapshot_observed_at":"2026-08-06T19:45:42.295815Z","submitted_at":"2025-07-06T15:00:13Z","title":"Just Add Geometry: Gradient-Free Open-Vocabulary 3D Detection Without Human-in-the-Loop","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T19:53:11.019752Z"},"links":{"citing_paper":"/paper/2507.13363"},"observation_digest":"sha256:9b73181e17c2f10c6c44fc8ed5889e7144a113c0bf752488615e43cf4b1d6b04","observation_id":"c7b83058-ef0e-47e8-9aae-fe7ef719323b","resolution":{"observed_at":"2026-08-06T19:53:15.562487Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.02643","last_updated":"2023-04-05T17:59:46Z","snapshot_observed_at":"2026-08-08T05:14:59.435033Z","submitted_at":"2023-04-05T17:59:46Z","title":"Segment Anything","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.02643","snapshot_observed_at":"2026-08-06T19:53:11.097615Z","title":"Berg, Wan-Yen Lo, Piotr Doll ´ar, and Ross Girshick","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.13363","last_updated":"2025-07-06T15:00:13Z","snapshot_observed_at":"2026-08-06T19:45:42.295815Z","submitted_at":"2025-07-06T15:00:13Z","title":"Just Add Geometry: Gradient-Free Open-Vocabulary 3D Detection Without Human-in-the-Loop","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T19:53:11.097615Z"},"links":{"cited_paper":"/paper/2304.02643","citing_paper":"/paper/2507.13363"},"observation_digest":"sha256:b509e19b469d99f4155a0422d6f5b35c5301a0da63248cca8fce5b003233fdaf","observation_id":"30a69994-e77e-44ed-ac00-dbb812543359","resolution":{"observed_at":"2026-08-06T19:53:11.097615Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:53:15.414465Z","title":"Pointpillars: Fast encoders for object detection from point clouds","venue":null,"work_id":"e9d5806f-31e6-4136-bc83-38d7a93c874d","year":2019},"citing_paper":{"arxiv_id":"2507.13363","last_updated":"2025-07-06T15:00:13Z","snapshot_observed_at":"2026-08-06T19:45:42.295815Z","submitted_at":"2025-07-06T15:00:13Z","title":"Just Add Geometry: Gradient-Free Open-Vocabulary 3D Detection Without Human-in-the-Loop","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T19:53:11.227219Z"},"links":{"citing_paper":"/paper/2507.13363"},"observation_digest":"sha256:fd0f666e1a68a991a6ead80d534fa0c51d16db7b7929eeb87c314ce9ffd80ced","observation_id":"de5854e5-001b-47d3-913c-9da661c8b3cc","resolution":{"observed_at":"2026-08-06T19:53:15.455622Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:53:15.322202Z","title":"Clip-fo3d: Free open-vocabulary 3d object detection","venue":null,"work_id":"ef3f5b5b-c471-4150-867a-e6d02c44b357","year":2023},"citing_paper":{"arxiv_id":"2507.13363","last_updated":"2025-07-06T15:00:13Z","snapshot_observed_at":"2026-08-06T19:45:42.295815Z","submitted_at":"2025-07-06T15:00:13Z","title":"Just Add Geometry: Gradient-Free Open-Vocabulary 3D Detection Without Human-in-the-Loop","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T19:53:11.304389Z"},"links":{"citing_paper":"/paper/2507.13363"},"observation_digest":"sha256:9775b52856358e226efd86cd7fb3e4c0feb6e8fc9e1878ce41836a6fa7af98ad","observation_id":"8d5b0919-12b9-4e92-9c07-e49c1634f233","resolution":{"observed_at":"2026-08-06T19:53:15.351669Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:53:11.411236Z","title":"Lawrence Zitnick","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2507.13363","last_updated":"2025-07-06T15:00:13Z","snapshot_observed_at":"2026-08-06T19:45:42.295815Z","submitted_at":"2025-07-06T15:00:13Z","title":"Just Add Geometry: Gradient-Free Open-Vocabulary 3D Detection Without Human-in-the-Loop","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T19:53:11.411236Z"},"links":{"citing_paper":"/paper/2507.13363"},"observation_digest":"sha256:28cce15fff9a375a90253dd22735298b4c89d06811c26a8b38bde51c06a375c5","observation_id":"477a519a-5234-4981-8330-4f43719a18d1","resolution":{"observed_at":"2026-08-06T19:53:11.411236Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.05499","last_updated":"2024-07-19T06:00:41Z","snapshot_observed_at":"2026-08-19T16:02:58.628969Z","submitted_at":"2023-03-09T18:52:16Z","title":"Grounding DINO: Marrying DINO with Grounded Pre-Training for Open-Set Object Detection","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.05499","snapshot_observed_at":"2026-08-06T19:53:11.655343Z","title":"Grounding dino: Marrying dino with grounded pre-training for open-set object detection","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.13363","last_updated":"2025-07-06T15:00:13Z","snapshot_observed_at":"2026-08-06T19:45:42.295815Z","submitted_at":"2025-07-06T15:00:13Z","title":"Just Add Geometry: Gradient-Free Open-Vocabulary 3D Detection Without Human-in-the-Loop","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T19:53:11.655343Z"},"links":{"cited_paper":"/paper/2303.05499","citing_paper":"/paper/2507.13363"},"observation_digest":"sha256:ca461936a19e63d93a22714bf93e7ead4ff4c4984baee1a02341c699aeb724f8","observation_id":"b6c26b46-2073-413f-8ddc-4a8cae9da2cc","resolution":{"observed_at":"2026-08-06T19:53:11.655343Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:53:15.112531Z","title":"Clip2scene: Scene-level 3d open-world understanding via vision-language founda- tion models","venue":null,"work_id":"9f267745-d122-483d-aee9-caa5578fb5a1","year":2023},"citing_paper":{"arxiv_id":"2507.13363","last_updated":"2025-07-06T15:00:13Z","snapshot_observed_at":"2026-08-06T19:45:42.295815Z","submitted_at":"2025-07-06T15:00:13Z","title":"Just Add Geometry: Gradient-Free Open-Vocabulary 3D Detection Without Human-in-the-Loop","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T19:53:11.737320Z"},"links":{"citing_paper":"/paper/2507.13363"},"observation_digest":"sha256:a5d3b796a03fb97544366fdfca6308f38040dd08677302163c0a50d022bc268e","observation_id":"fe58fcc7-f628-4440-bfae-ae9e85f96351","resolution":{"observed_at":"2026-08-06T19:53:15.152642Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:53:14.988256Z","title":"Open-vocabulary point-cloud object detection without 3d an- notation","venue":null,"work_id":"85bbf8e0-5d5b-4c3f-9b1e-e663080fbec6","year":2023},"citing_paper":{"arxiv_id":"2507.13363","last_updated":"2025-07-06T15:00:13Z","snapshot_observed_at":"2026-08-06T19:45:42.295815Z","submitted_at":"2025-07-06T15:00:13Z","title":"Just Add Geometry: Gradient-Free Open-Vocabulary 3D Detection Without Human-in-the-Loop","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T19:53:11.830279Z"},"links":{"citing_paper":"/paper/2507.13363"},"observation_digest":"sha256:54c302f534797b705e59ccc5dcfded20481fa99026e82e2d8594c77e983a5ba1","observation_id":"539f97de-c60c-477e-9b88-11918bd0f6cd","resolution":{"observed_at":"2026-08-06T19:53:15.041547Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:53:14.890395Z","title":"Open-vocabulary point-cloud object detection without 3d annotation","venue":null,"work_id":"0f5c6bcf-b332-49ea-bbbb-958ea6e42e5c","year":2023},"citing_paper":{"arxiv_id":"2507.13363","last_updated":"2025-07-06T15:00:13Z","snapshot_observed_at":"2026-08-06T19:45:42.295815Z","submitted_at":"2025-07-06T15:00:13Z","title":"Just Add Geometry: Gradient-Free Open-Vocabulary 3D Detection Without Human-in-the-Loop","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T19:53:11.924582Z"},"links":{"citing_paper":"/paper/2507.13363"},"observation_digest":"sha256:28b081716e51bf2eec8f43f885d203118fff8c6ed6500dfd7768a5ccb4a3ddc9","observation_id":"08a8471c-a351-47d6-8b84-14d3d47fb821","resolution":{"observed_at":"2026-08-06T19:53:14.929498Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:53:14.780305Z","title":"Unidepth: Universal monocular metric depth estimation","venue":null,"work_id":"047832c7-f1c1-43fd-a1a8-8b84b93cda44","year":2024},"citing_paper":{"arxiv_id":"2507.13363","last_updated":"2025-07-06T15:00:13Z","snapshot_observed_at":"2026-08-06T19:45:42.295815Z","submitted_at":"2025-07-06T15:00:13Z","title":"Just Add Geometry: Gradient-Free Open-Vocabulary 3D Detection Without Human-in-the-Loop","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T19:53:12.005130Z"},"links":{"citing_paper":"/paper/2507.13363"},"observation_digest":"sha256:c76801602b68465da1f3858c709c0284eae9a5bd3146fe2d3a43c35b5cb913aa","observation_id":"af9fe8da-467c-466b-bd6e-e3a14c99f102","resolution":{"observed_at":"2026-08-06T19:53:14.835280Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:53:14.663056Z","title":"Frustum pointnets for 3d object detection from rgb- d data","venue":null,"work_id":"9cbc3979-ed97-42e0-9337-8b536b3d27a0","year":2018},"citing_paper":{"arxiv_id":"2507.13363","last_updated":"2025-07-06T15:00:13Z","snapshot_observed_at":"2026-08-06T19:45:42.295815Z","submitted_at":"2025-07-06T15:00:13Z","title":"Just Add Geometry: Gradient-Free Open-Vocabulary 3D Detection Without Human-in-the-Loop","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T19:53:12.090961Z"},"links":{"citing_paper":"/paper/2507.13363"},"observation_digest":"sha256:e171a0016a3797a71c9424ec4d076f1e2be9adf3b3db35ff2b07cbd444aa4600","observation_id":"14c6e116-7669-48b2-b122-fb2ab3df6388","resolution":{"observed_at":"2026-08-06T19:53:14.708710Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:53:12.171860Z","title":"You only look once: Unified, real-time object de- tection","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.13363","last_updated":"2025-07-06T15:00:13Z","snapshot_observed_at":"2026-08-06T19:45:42.295815Z","submitted_at":"2025-07-06T15:00:13Z","title":"Just Add Geometry: Gradient-Free Open-Vocabulary 3D Detection Without Human-in-the-Loop","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T19:53:12.171860Z"},"links":{"citing_paper":"/paper/2507.13363"},"observation_digest":"sha256:20f62b85cb76dfeb98dfd087b97f8d1cdc3027d6e663f5b965e982ec73ea4f50","observation_id":"f3baef2b-99b5-4c70-8f27-c9b2cd5f15d7","resolution":{"observed_at":"2026-08-06T19:53:12.171860Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:53:14.547023Z","title":"Faster r-cnn: Towards real-time object detection with region proposal networks","venue":null,"work_id":"9a31c33b-db8b-4ab2-95d1-cdc13eb944e9","year":2016},"citing_paper":{"arxiv_id":"2507.13363","last_updated":"2025-07-06T15:00:13Z","snapshot_observed_at":"2026-08-06T19:45:42.295815Z","submitted_at":"2025-07-06T15:00:13Z","title":"Just Add Geometry: Gradient-Free Open-Vocabulary 3D Detection Without Human-in-the-Loop","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T19:53:12.269015Z"},"links":{"citing_paper":"/paper/2507.13363"},"observation_digest":"sha256:8c2b99dc2a7a52868b82efc15fc5be653df9a8952686d75244df10c795ef8047","observation_id":"24ab1c56-722d-429e-8729-c159eb926b7e","resolution":{"observed_at":"2026-08-06T19:53:14.605512Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:53:14.274174Z","title":"Scalability in perception for autonomous driving: Waymo open dataset","venue":null,"work_id":"270abd0f-740d-425a-85ac-cc7bdc3bdb48","year":null},"citing_paper":{"arxiv_id":"2507.13363","last_updated":"2025-07-06T15:00:13Z","snapshot_observed_at":"2026-08-06T19:45:42.295815Z","submitted_at":"2025-07-06T15:00:13Z","title":"Just Add Geometry: Gradient-Free Open-Vocabulary 3D Detection Without Human-in-the-Loop","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T19:53:12.350142Z"},"links":{"citing_paper":"/paper/2507.13363"},"observation_digest":"sha256:8bcdeb5c474c9108006bc503c30c112e3ac911e0056b818826925119f9e71e31","observation_id":"addb06c4-4bc4-4e50-b1c0-bead2b9f0df8","resolution":{"observed_at":"2026-08-06T19:53:14.422435Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:53:14.095689Z","title":"Fsd: Few-shot object detection in 3d scenes","venue":null,"work_id":"b8b59c23-61ec-4e3c-9059-e748baeb6dce","year":2023},"citing_paper":{"arxiv_id":"2507.13363","last_updated":"2025-07-06T15:00:13Z","snapshot_observed_at":"2026-08-06T19:45:42.295815Z","submitted_at":"2025-07-06T15:00:13Z","title":"Just Add Geometry: Gradient-Free Open-Vocabulary 3D Detection Without Human-in-the-Loop","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T19:53:12.441833Z"},"links":{"citing_paper":"/paper/2507.13363"},"observation_digest":"sha256:d98e4fb15d3b62e98217eb34e577cb478d6d43afd6c6a7be61f2f833b28ce8c8","observation_id":"a7ee932b-59e2-4b8e-9a25-66ab4caaa0d3","resolution":{"observed_at":"2026-08-06T19:53:14.169948Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2008.10592","last_updated":"2020-08-24T17:54:51Z","snapshot_observed_at":"2026-08-05T14:08:54.020913Z","submitted_at":"2020-08-24T17:54:51Z","title":"3D for Free: Crossmodal Transfer Learning using HD Maps","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2008.10592","snapshot_observed_at":"2026-08-06T19:53:12.548365Z","title":"3d for free: Crossmodal transfer learning using hd maps","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2507.13363","last_updated":"2025-07-06T15:00:13Z","snapshot_observed_at":"2026-08-06T19:45:42.295815Z","submitted_at":"2025-07-06T15:00:13Z","title":"Just Add Geometry: Gradient-Free Open-Vocabulary 3D Detection Without Human-in-the-Loop","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T19:53:12.548365Z"},"links":{"cited_paper":"/paper/2008.10592","citing_paper":"/paper/2507.13363"},"observation_digest":"sha256:0f81add7c04f9620f62e5c435ab651e09fa03a02b81baca55f9ce690a513a01d","observation_id":"e4e9ebd6-b558-4430-94c1-6636f4c4d062","resolution":{"observed_at":"2026-08-06T19:53:12.548365Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:53:13.910265Z","title":"Posecnn: A convolutional neural network for 6d object pose estimation in cluttered scenes","venue":null,"work_id":"4bbcd064-7711-49ba-a9ca-cb63ac3caefa","year":2018},"citing_paper":{"arxiv_id":"2507.13363","last_updated":"2025-07-06T15:00:13Z","snapshot_observed_at":"2026-08-06T19:45:42.295815Z","submitted_at":"2025-07-06T15:00:13Z","title":"Just Add Geometry: Gradient-Free Open-Vocabulary 3D Detection Without Human-in-the-Loop","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T19:53:12.613800Z"},"links":{"citing_paper":"/paper/2507.13363"},"observation_digest":"sha256:012dcf10613a5b48da70a9de181eeb237c027af5facda4ace74a7170b991d1b7","observation_id":"8f86db43-4429-4499-bd31-f4ab68a64794","resolution":{"observed_at":"2026-08-06T19:53:14.002820Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:53:13.730297Z","title":"Ulip: Learning unified representation of language, image and point cloud for 3d understanding","venue":null,"work_id":"528a52f7-599d-49c0-b4e0-db6ca5fedb7f","year":2022},"citing_paper":{"arxiv_id":"2507.13363","last_updated":"2025-07-06T15:00:13Z","snapshot_observed_at":"2026-08-06T19:45:42.295815Z","submitted_at":"2025-07-06T15:00:13Z","title":"Just Add Geometry: Gradient-Free Open-Vocabulary 3D Detection Without Human-in-the-Loop","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T19:53:12.727849Z"},"links":{"citing_paper":"/paper/2507.13363"},"observation_digest":"sha256:8bdbbd27c505ac2ea8dcc7509b098675bd3858ecde18606250017044e2364b7e","observation_id":"5466189b-1c80-493c-95d8-1aedf36084a0","resolution":{"observed_at":"2026-08-06T19:53:13.826577Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:53:13.527338Z","title":"Open-vocabulary object de- tection using captions","venue":null,"work_id":"7150da9e-981f-481c-8b5c-4abe539d318c","year":2021},"citing_paper":{"arxiv_id":"2507.13363","last_updated":"2025-07-06T15:00:13Z","snapshot_observed_at":"2026-08-06T19:45:42.295815Z","submitted_at":"2025-07-06T15:00:13Z","title":"Just Add Geometry: Gradient-Free Open-Vocabulary 3D Detection Without Human-in-the-Loop","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T19:53:12.797385Z"},"links":{"citing_paper":"/paper/2507.13363"},"observation_digest":"sha256:06956815be4fe2943ea196e1942f64ccf082fdba5bbfba3e3e8f0c8db95450d8","observation_id":"68912b25-2825-4e79-8201-c26f5eb6fceb","resolution":{"observed_at":"2026-08-06T19:53:13.627903Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:53:13.337110Z","title":"Pointclip: Point cloud understanding by clip","venue":null,"work_id":"4a3e3761-8d1d-40fe-ba19-2ede9a96181c","year":2022},"citing_paper":{"arxiv_id":"2507.13363","last_updated":"2025-07-06T15:00:13Z","snapshot_observed_at":"2026-08-06T19:45:42.295815Z","submitted_at":"2025-07-06T15:00:13Z","title":"Just Add Geometry: Gradient-Free Open-Vocabulary 3D Detection Without Human-in-the-Loop","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T19:53:12.899553Z"},"links":{"citing_paper":"/paper/2507.13363"},"observation_digest":"sha256:743337209dc3c46a4e4a3c6f07ed62b3677892afdbd63adc93d5edcb79a9bcf0","observation_id":"1c65b2cf-3b03-4a79-a162-374e891afec3","resolution":{"observed_at":"2026-08-06T19:53:13.430144Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:53:13.162414Z","title":"Regionclip: Region- based language-image pretraining","venue":null,"work_id":"84ccc2f2-aaa8-44ed-8dac-05ffbec4d971","year":2022},"citing_paper":{"arxiv_id":"2507.13363","last_updated":"2025-07-06T15:00:13Z","snapshot_observed_at":"2026-08-06T19:45:42.295815Z","submitted_at":"2025-07-06T15:00:13Z","title":"Just Add Geometry: Gradient-Free Open-Vocabulary 3D Detection Without Human-in-the-Loop","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T19:53:12.973793Z"},"links":{"citing_paper":"/paper/2507.13363"},"observation_digest":"sha256:d93b9506f72b019af3acd05bdbed1ec6b2706f1b5f093842af13b4dfc7d3cb19","observation_id":"24ae7b24-1551-450c-9d73-6fd0a2e46731","resolution":{"observed_at":"2026-08-06T19:53:13.251207Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:53:15.215227Z","title":null,"venue":null,"work_id":"8b527fca-a1e1-4933-95ac-70e114f178d7","year":null},"citing_paper":{"arxiv_id":"2507.13363","last_updated":"2025-07-06T15:00:13Z","snapshot_observed_at":"2026-08-06T19:45:42.295815Z","submitted_at":"2025-07-06T15:00:13Z","title":"Just Add Geometry: Gradient-Free Open-Vocabulary 3D Detection Without Human-in-the-Loop","version":1},"reference_index":2014,"source":"pdf_text","source_observed_at":"2026-08-06T19:53:11.514722Z"},"links":{"citing_paper":"/paper/2507.13363"},"observation_digest":"sha256:586f687531538531ad4b14ecd6f61e58fa468ded1893f20ecef197f91afeeaf9","observation_id":"a1f7c993-07b9-46ab-b21d-bd7f69b8a49f","resolution":{"observed_at":"2026-08-06T19:53:15.258223Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.13363","last_updated":"2025-07-06T15:00:13Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-06T19:45:42.295815Z","submitted_at":"2025-07-06T15:00:13Z","title":"Just Add Geometry: Gradient-Free Open-Vocabulary 3D Detection Without Human-in-the-Loop"},"reference_resolution":{"displayed":26,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":6,"verified_exact":0,"verified_fuzzy":20},"total_outbound_references":26},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 26 of 26 outbound references and 0 inbound Pith citation observations for arXiv:2507.13363."}