{"as_of":"2026-08-08T08:51:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5b6c82439179a0dd2a63e65ddc83df5b29da822b4e609e2edee1773ed710457a","coverage":[{"denominator":16,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":16,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T10:38:52.289632Z","state":"measured"},{"denominator":19,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":19,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T22:00:13.802598Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-22T10:31:25.365391Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.04837","last_updated":"2025-06-05T09:57:43Z","snapshot_observed_at":"2026-08-07T10:30:13.381962Z","submitted_at":"2025-06-05T09:57:43Z","title":"OpenMaskDINO3D : Reasoning 3D Segmentation via Large Language Model","version":1},"cited_work":{"arxiv_id":"2506.04837","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.04837","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Openmaskdino3d: Reasoning 3d segmentation via large language model","venue":null,"work_id":"e8f9b7d2-8aa1-434a-937b-3328825bc9e6","year":2025},"citing_paper":{"arxiv_id":"2602.18600","last_updated":"2026-07-29T09:42:45Z","snapshot_observed_at":"2026-08-02T22:00:02.664173Z","submitted_at":"2026-02-20T20:22:18Z","title":"MapTab: A Diagnostic Benchmark for Long-Horizon Multi-Criteria Multimodal Reasoning on Heterogeneous Topological Graphs","version":2},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-05-15T20:12:46.385646Z"},"links":{"cited_paper":"/paper/2506.04837","citing_paper":"/paper/2602.18600"},"observation_digest":"sha256:1dc46296004a4ac6592660c3ec74455f91e5acfd0cb3009c7f49390b3d3c14c5","observation_id":"e8f1562a-0e30-4ebd-8319-587ecf1edfff","resolution":{"observed_at":"2026-05-15T20:16:34.740516Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.04837","last_updated":"2025-06-05T09:57:43Z","snapshot_observed_at":"2026-08-07T10:30:13.381962Z","submitted_at":"2025-06-05T09:57:43Z","title":"OpenMaskDINO3D : Reasoning 3D Segmentation via Large Language Model","version":1},"cited_work":{"arxiv_id":"2506.04837","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.04837","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Openmaskdino3d: Reasoning 3d segmentation via large language model","venue":null,"work_id":"e8f9b7d2-8aa1-434a-937b-3328825bc9e6","year":2025},"citing_paper":{"arxiv_id":"2602.18600","last_updated":"2026-07-29T09:42:45Z","snapshot_observed_at":"2026-08-02T22:00:02.664173Z","submitted_at":"2026-02-20T20:22:18Z","title":"MapTab: A Diagnostic Benchmark for Long-Horizon Multi-Criteria Multimodal Reasoning on Heterogeneous Topological Graphs","version":3},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-05-22T10:30:06.829915Z"},"links":{"cited_paper":"/paper/2506.04837","citing_paper":"/paper/2602.18600"},"observation_digest":"sha256:32a4938e591a900343986627411643ed703ff60aea32c3431ef906bcb3ad04da","observation_id":"a95306e0-ac56-4181-be9d-bea87b5a387f","resolution":{"observed_at":"2026-05-22T10:31:25.368092Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.04837","last_updated":"2025-06-05T09:57:43Z","snapshot_observed_at":"2026-08-07T10:30:13.381962Z","submitted_at":"2025-06-05T09:57:43Z","title":"OpenMaskDINO3D : Reasoning 3D Segmentation via Large Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.04837","snapshot_observed_at":"2026-08-02T22:00:13.802598Z","title":"Openmaskdino3d: Reasoning 3d segmentation via large language model","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.18600","last_updated":"2026-07-29T09:42:45Z","snapshot_observed_at":"2026-08-02T22:00:02.664173Z","submitted_at":"2026-02-20T20:22:18Z","title":"MapTab: A Diagnostic Benchmark for Long-Horizon Multi-Criteria Multimodal Reasoning on Heterogeneous Topological Graphs","version":5},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-08-02T22:00:13.802598Z"},"links":{"cited_paper":"/paper/2506.04837","citing_paper":"/paper/2602.18600"},"observation_digest":"sha256:eccafb0a40b97c2be26ed77bab7f5948ad48e7388099469c93769797f984b448","observation_id":"6e32a0b0-e437-430c-b73f-cb9f38343f12","resolution":{"observed_at":"2026-08-02T22:00:13.802598Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2506.04837/citation-record","integrity":"/paper/2506.04837/integrity","json":"/paper/2506.04837/citation-record.json","paper":"/paper/2506.04837"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:38:54.505316Z","title":"Henriques, Andrew Zisser- man, and Andrea Vedaldi","venue":null,"work_id":"af62d3ab-3f52-4026-82b8-afe70a0c6ca2","year":2024},"citing_paper":{"arxiv_id":"2506.04837","last_updated":"2025-06-05T09:57:43Z","snapshot_observed_at":"2026-08-07T10:30:13.381962Z","submitted_at":"2025-06-05T09:57:43Z","title":"OpenMaskDINO3D : Reasoning 3D Segmentation via Large Language Model","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T10:38:50.250747Z"},"links":{"citing_paper":"/paper/2506.04837"},"observation_digest":"sha256:5919f8f52f8ea2eb701f132f234922dcf3b2a27810e625e46a7b7018e9c9d1d2","observation_id":"938b140a-ae7c-4a69-8125-7e1cae4193f3","resolution":{"observed_at":"2026-08-07T10:38:54.616520Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:38:54.369792Z","title":"Coda: Col- laborative novel box discovery and cross-modal alignment for open-vocabulary 3d object detection","venue":null,"work_id":"5971711b-ec90-452c-b27f-49fec8b5f510","year":2023},"citing_paper":{"arxiv_id":"2506.04837","last_updated":"2025-06-05T09:57:43Z","snapshot_observed_at":"2026-08-07T10:30:13.381962Z","submitted_at":"2025-06-05T09:57:43Z","title":"OpenMaskDINO3D : Reasoning 3D Segmentation via Large Language Model","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T10:38:50.327719Z"},"links":{"citing_paper":"/paper/2506.04837"},"observation_digest":"sha256:5ac5631761f64ecf6de274067e2565b2826f82b1e4ec8c3e8e6a3154207690b7","observation_id":"8dc444f3-b219-45cf-9fb4-dcf35f7b2d9e","resolution":{"observed_at":"2026-08-07T10:38:54.436610Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:38:54.213862Z","title":"Image Token Acc@0.25 Acc@0.50 mIoU ✗ 51.4 35.5 36.7 ✓ 55.1 40.2 40.3 (b) 2D Features for Segmentation","venue":null,"work_id":"20ea7609-2f22-4022-b7c3-39ddb162c0c7","year":2023},"citing_paper":{"arxiv_id":"2506.04837","last_updated":"2025-06-05T09:57:43Z","snapshot_observed_at":"2026-08-07T10:30:13.381962Z","submitted_at":"2025-06-05T09:57:43Z","title":"OpenMaskDINO3D : Reasoning 3D Segmentation via Large Language Model","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T10:38:50.442838Z"},"links":{"citing_paper":"/paper/2506.04837"},"observation_digest":"sha256:935db2256999efaf8339c2fc10c676b1bdef4b0e58996c624ce8c8acc74d132e","observation_id":"e5d3c5f8-78b3-4bb6-83ae-68ecd6c7a3d6","resolution":{"observed_at":"2026-08-07T10:38:54.296577Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:38:54.072744Z","title":"Openins3d: Snap and lookup for 3d open-vocabulary instance segmentation","venue":null,"work_id":"9b8bf1fc-f752-45ab-a5bd-6a85bc96913f","year":null},"citing_paper":{"arxiv_id":"2506.04837","last_updated":"2025-06-05T09:57:43Z","snapshot_observed_at":"2026-08-07T10:30:13.381962Z","submitted_at":"2025-06-05T09:57:43Z","title":"OpenMaskDINO3D : Reasoning 3D Segmentation via Large Language Model","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T10:38:50.614827Z"},"links":{"citing_paper":"/paper/2506.04837"},"observation_digest":"sha256:98947036daaf54eb556771babba75391c19a183208fe56c2e56f869470595ea3","observation_id":"a982400b-1dc2-4216-8e16-98deb750aeff","resolution":{"observed_at":"2026-08-07T10:38:54.143351Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:38:53.935471Z","title":"Lerf: Language embedded radiance fields","venue":null,"work_id":"e438195e-c345-4569-a392-0694fcd1c45c","year":2023},"citing_paper":{"arxiv_id":"2506.04837","last_updated":"2025-06-05T09:57:43Z","snapshot_observed_at":"2026-08-07T10:30:13.381962Z","submitted_at":"2025-06-05T09:57:43Z","title":"OpenMaskDINO3D : Reasoning 3D Segmentation via Large Language Model","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T10:38:50.724330Z"},"links":{"citing_paper":"/paper/2506.04837"},"observation_digest":"sha256:6d0ab49f3ced806ac0493ad5af96aa5c3a260cf5f0395d65769971c9d32f37d4","observation_id":"5f6d4232-9cb1-4c9b-9aaf-790f9c9b5bf0","resolution":{"observed_at":"2026-08-07T10:38:53.997837Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:38:53.786229Z","title":"Decomposing nerf for editing via feature field dis- tillation","venue":null,"work_id":"2330d6d2-2f11-4dda-a0a6-859cdc6c8b85","year":2022},"citing_paper":{"arxiv_id":"2506.04837","last_updated":"2025-06-05T09:57:43Z","snapshot_observed_at":"2026-08-07T10:30:13.381962Z","submitted_at":"2025-06-05T09:57:43Z","title":"OpenMaskDINO3D : Reasoning 3D Segmentation via Large Language Model","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T10:38:50.822720Z"},"links":{"citing_paper":"/paper/2506.04837"},"observation_digest":"sha256:519109e8e697227b8683e75ed732a48f5518d0be285aef3db523b2bd1160a45c","observation_id":"ed87ee76-174d-415f-995f-af7a93b8c9ed","resolution":{"observed_at":"2026-08-07T10:38:53.851299Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:38:53.583301Z","title":"Weakly supervised 3d open- vocabulary segmentation","venue":null,"work_id":"f873cd46-f452-44ed-89a0-af6ad91b292a","year":2024},"citing_paper":{"arxiv_id":"2506.04837","last_updated":"2025-06-05T09:57:43Z","snapshot_observed_at":"2026-08-07T10:30:13.381962Z","submitted_at":"2025-06-05T09:57:43Z","title":"OpenMaskDINO3D : Reasoning 3D Segmentation via Large Language Model","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T10:38:50.935217Z"},"links":{"citing_paper":"/paper/2506.04837"},"observation_digest":"sha256:24be19b5599a3054b3e807d1f0763205ba1c76c41459eceb3aa2b65539f6e841","observation_id":"72cbf191-f244-4f98-81e8-5a3eb246a52c","resolution":{"observed_at":"2026-08-07T10:38:53.714392Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:38:53.350826Z","title":"Ovir-3d: Open-vocabulary 3d in- stance retrieval without training on 3d data","venue":null,"work_id":"eb55fbb0-4ca5-41ea-87fb-1e3e9659ed01","year":2023},"citing_paper":{"arxiv_id":"2506.04837","last_updated":"2025-06-05T09:57:43Z","snapshot_observed_at":"2026-08-07T10:30:13.381962Z","submitted_at":"2025-06-05T09:57:43Z","title":"OpenMaskDINO3D : Reasoning 3D Segmentation via Large Language Model","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T10:38:51.039850Z"},"links":{"citing_paper":"/paper/2506.04837"},"observation_digest":"sha256:1a81a283d478137f9933566c9a0c8ee1848bdf60ddad0cfe118ecc38a344c617","observation_id":"2fb5fc72-94f4-4212-986c-122e471e3611","resolution":{"observed_at":"2026-08-07T10:38:53.490044Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:38:53.180710Z","title":"Openscene: 3d scene understanding with open vocabularies","venue":null,"work_id":"4e7861dd-3d8f-4736-ba31-e54bec28467f","year":2023},"citing_paper":{"arxiv_id":"2506.04837","last_updated":"2025-06-05T09:57:43Z","snapshot_observed_at":"2026-08-07T10:30:13.381962Z","submitted_at":"2025-06-05T09:57:43Z","title":"OpenMaskDINO3D : Reasoning 3D Segmentation via Large Language Model","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T10:38:51.137020Z"},"links":{"citing_paper":"/paper/2506.04837"},"observation_digest":"sha256:08a3a886250391d85d3f3cbca4953e6aa3ffb5d196bc4f05b616d7e90a45cc39","observation_id":"c30d6fbc-d8c7-4272-bbad-818e7f978504","resolution":{"observed_at":"2026-08-07T10:38:53.230575Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.16084","last_updated":"2024-03-31T04:45:58Z","snapshot_observed_at":"2026-07-06T17:08:08.775293Z","submitted_at":"2023-12-26T15:14:37Z","title":"LangSplat: 3D Language Gaussian Splatting","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.16084","snapshot_observed_at":"2026-08-07T10:38:51.322064Z","title":"Langsplat: 3d language gaussian splatting","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.04837","last_updated":"2025-06-05T09:57:43Z","snapshot_observed_at":"2026-08-07T10:30:13.381962Z","submitted_at":"2025-06-05T09:57:43Z","title":"OpenMaskDINO3D : Reasoning 3D Segmentation via Large Language Model","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T10:38:51.322064Z"},"links":{"cited_paper":"/paper/2312.16084","citing_paper":"/paper/2506.04837"},"observation_digest":"sha256:d3550e08fcfc635c2f6f635e67191741f5364c1163a9221e585c57530dbdae99","observation_id":"2b807271-8275-475a-b801-63742fdc18a8","resolution":{"observed_at":"2026-08-07T10:38:51.322064Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:38:51.420204Z","title":"Learning transferable visual models from natural language supervi- sion","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.04837","last_updated":"2025-06-05T09:57:43Z","snapshot_observed_at":"2026-08-07T10:30:13.381962Z","submitted_at":"2025-06-05T09:57:43Z","title":"OpenMaskDINO3D : Reasoning 3D Segmentation via Large Language Model","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T10:38:51.420204Z"},"links":{"citing_paper":"/paper/2506.04837"},"observation_digest":"sha256:a01440ba04b6d015ea1a6d64257b68831bc25afb591984f8e570bdf274ba3817","observation_id":"b4b4e6a2-546a-46a9-bff2-2d96dd175d5a","resolution":{"observed_at":"2026-08-07T10:38:51.420204Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:38:52.943498Z","title":"Sumner, Marc Pollefeys, Federico Tombari, and Francis Engelmann","venue":null,"work_id":"8894dfbc-cdcc-477e-a5da-710698680c44","year":2023},"citing_paper":{"arxiv_id":"2506.04837","last_updated":"2025-06-05T09:57:43Z","snapshot_observed_at":"2026-08-07T10:30:13.381962Z","submitted_at":"2025-06-05T09:57:43Z","title":"OpenMaskDINO3D : Reasoning 3D Segmentation via Large Language Model","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T10:38:51.542471Z"},"links":{"citing_paper":"/paper/2506.04837"},"observation_digest":"sha256:3c3054c7ac73cbfbcc79a5aeac66a47534dc033a56607ee01583f08d8519064e","observation_id":"31366615-60c0-44ce-9604-9bfc4052eef5","resolution":{"observed_at":"2026-08-07T10:38:53.066921Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.12427","last_updated":"2023-05-25T08:38:52Z","snapshot_observed_at":"2026-07-06T15:30:14.400809Z","submitted_at":"2023-05-21T10:55:27Z","title":"VL-Fields: Towards Language-Grounded Neural Implicit Spatial Representations","version":2},"cited_work":{"arxiv_id":"2305.12427","doi":null,"metadata_source":"pith","pith_arxiv_id":"2305.12427","snapshot_observed_at":"2026-08-07T10:38:52.519035Z","title":"VL-Fields: Towards Language-Grounded Neural Implicit Spatial Representations","venue":"cs.CV","work_id":"bc61e7cb-94a8-4df4-9848-49fa9ed9ff1a","year":2023},"citing_paper":{"arxiv_id":"2506.04837","last_updated":"2025-06-05T09:57:43Z","snapshot_observed_at":"2026-08-07T10:30:13.381962Z","submitted_at":"2025-06-05T09:57:43Z","title":"OpenMaskDINO3D : Reasoning 3D Segmentation via Large Language Model","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T10:38:51.702038Z"},"links":{"cited_paper":"/paper/2305.12427","citing_paper":"/paper/2506.04837"},"observation_digest":"sha256:129605b94d8391e472b7cbb22ba9711bf35af05f4e11acb248b38533c4a8e019","observation_id":"166a6fdf-be22-4ab2-9254-7f4ec7a554a4","resolution":{"observed_at":"2026-08-07T10:38:52.698058Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.03923","last_updated":"2023-10-05T21:57:36Z","snapshot_observed_at":"2026-08-05T23:33:55.326516Z","submitted_at":"2023-10-05T21:57:36Z","title":"Open-Fusion: Real-time Open-Vocabulary 3D Mapping and Queryable Scene Representation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.03923","snapshot_observed_at":"2026-08-07T10:38:51.869988Z","title":"Open-fusion: Real-time open-vocabulary 3d map- ping and queryable scene representation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.04837","last_updated":"2025-06-05T09:57:43Z","snapshot_observed_at":"2026-08-07T10:30:13.381962Z","submitted_at":"2025-06-05T09:57:43Z","title":"OpenMaskDINO3D : Reasoning 3D Segmentation via Large Language Model","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T10:38:51.869988Z"},"links":{"cited_paper":"/paper/2310.03923","citing_paper":"/paper/2506.04837"},"observation_digest":"sha256:f046b9c3750869922a4dd499ba63b1059c4547680650dbb8d78050b29980281e","observation_id":"ba7513b3-55e8-412c-8168-c208336dd54f","resolution":{"observed_at":"2026-08-07T10:38:51.869988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.00962","last_updated":"2024-05-05T04:44:55Z","snapshot_observed_at":"2026-07-06T15:11:24.863362Z","submitted_at":"2023-04-03T13:30:04Z","title":"RegionPLC: Regional Point-Language Contrastive Learning for Open-World 3D Scene Understanding","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.00962","snapshot_observed_at":"2026-08-07T10:38:52.071377Z","title":"Regionplc: Regional point-language contrastive learning for open-world 3d scene understanding","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.04837","last_updated":"2025-06-05T09:57:43Z","snapshot_observed_at":"2026-08-07T10:30:13.381962Z","submitted_at":"2025-06-05T09:57:43Z","title":"OpenMaskDINO3D : Reasoning 3D Segmentation via Large Language Model","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T10:38:52.071377Z"},"links":{"cited_paper":"/paper/2304.00962","citing_paper":"/paper/2506.04837"},"observation_digest":"sha256:e2be6e0b96657b0bbad14c68f0e02630d251366a5df693e3d312f60647a86dfe","observation_id":"e51fb179-e8d9-4678-b368-8d8c863744ab","resolution":{"observed_at":"2026-08-07T10:38:52.071377Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:38:52.817425Z","title":"Clip-fo3d: Learning free open-world 3d scene representations from 2d dense clip","venue":null,"work_id":"389171d8-5c96-4b36-945c-7ba10905a944","year":2023},"citing_paper":{"arxiv_id":"2506.04837","last_updated":"2025-06-05T09:57:43Z","snapshot_observed_at":"2026-08-07T10:30:13.381962Z","submitted_at":"2025-06-05T09:57:43Z","title":"OpenMaskDINO3D : Reasoning 3D Segmentation via Large Language Model","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T10:38:52.289632Z"},"links":{"citing_paper":"/paper/2506.04837"},"observation_digest":"sha256:e6a4167921e0d2329a83457bc28bde68280d15febb4b35e891449399f32d0d90","observation_id":"0568b568-42fb-49ea-af52-aa847b8874db","resolution":{"observed_at":"2026-08-07T10:38:52.867422Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.04837","last_updated":"2025-06-05T09:57:43Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T10:30:13.381962Z","submitted_at":"2025-06-05T09:57:43Z","title":"OpenMaskDINO3D : Reasoning 3D Segmentation via Large Language Model"},"reference_resolution":{"displayed":16,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":4,"verified_exact":1,"verified_fuzzy":11},"total_outbound_references":16},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 16 of 16 outbound references and 3 inbound Pith citation observations for arXiv:2506.04837."}