{"as_of":"2026-08-22T17:51:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b4e18b52729207da3dac444012355f6b4541267e606c10adb5e6229280399e2d","coverage":[{"denominator":71,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":71,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T11:07:09.337105Z","state":"measured"},{"denominator":74,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":74,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-22T06:32:14.747728+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-10T17:44:01.158027Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-11T11:26:01.940748Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.23134","last_updated":"2025-07-30T22:26:56Z","snapshot_observed_at":"2026-08-17T22:02:50.920534Z","submitted_at":"2025-07-30T22:26:56Z","title":"Details Matter for Indoor Open-vocabulary 3D Instance Segmentation","version":1},"cited_work":{"arxiv_id":"2507.23134","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.23134","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2507.23134 (2025) 9, 12, 13","venue":null,"work_id":"90e42fa9-770a-442d-a6e6-4df3d73fc3da","year":2025},"citing_paper":{"arxiv_id":"2604.08916","last_updated":"2026-04-10T03:26:52Z","snapshot_observed_at":"2026-08-15T11:30:21.475308Z","submitted_at":"2026-04-10T03:26:52Z","title":"MV3DIS: Multi-View Mask Matching via 3D Guides for Zero-Shot 3D Instance Segmentation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-10T17:44:01.158027Z"},"links":{"cited_paper":"/paper/2507.23134","citing_paper":"/paper/2604.08916"},"observation_digest":"sha256:6aed28861057ea4114a01d7b7c8930684b82aca4b53eb32a676b0bd0d96562a8","observation_id":"c6b73b08-1ed5-4f2d-a4f3-35899d2aa3b8","resolution":{"observed_at":"2026-05-11T06:15:57.920813Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.23134","last_updated":"2025-07-30T22:26:56Z","snapshot_observed_at":"2026-08-17T22:02:50.920534Z","submitted_at":"2025-07-30T22:26:56Z","title":"Details Matter for Indoor Open-vocabulary 3D Instance Segmentation","version":1},"cited_work":{"arxiv_id":"2507.23134","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.23134","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2507.23134 (2025) 9, 12, 13","venue":null,"work_id":"90e42fa9-770a-442d-a6e6-4df3d73fc3da","year":2025},"citing_paper":{"arxiv_id":"2604.12551","last_updated":"2026-04-14T10:25:32Z","snapshot_observed_at":"2026-08-20T18:45:59.685733Z","submitted_at":"2026-04-14T10:25:32Z","title":"Cross-Attentive Multiview Fusion of Vision-Language Embeddings","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-10T14:56:08.616492Z"},"links":{"cited_paper":"/paper/2507.23134","citing_paper":"/paper/2604.12551"},"observation_digest":"sha256:85bfc62501b4c3427a041a54b94e6cce50f16a03a6564daaca0eeb9e7b0d116f","observation_id":"48400404-e3eb-4a7c-a1cf-f114d1ca1d55","resolution":{"observed_at":"2026-05-11T11:26:01.944445Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.23134","last_updated":"2025-07-30T22:26:56Z","snapshot_observed_at":"2026-08-17T22:02:50.920534Z","submitted_at":"2025-07-30T22:26:56Z","title":"Details Matter for Indoor Open-vocabulary 3D Instance Segmentation","version":1},"cited_work":{"arxiv_id":"2507.23134","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.23134","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2507.23134 (2025) 9, 12, 13","venue":null,"work_id":"90e42fa9-770a-442d-a6e6-4df3d73fc3da","year":2025},"citing_paper":{"arxiv_id":"2604.20395","last_updated":"2026-05-28T23:37:52Z","snapshot_observed_at":"2026-08-11T00:22:30.036381Z","submitted_at":"2026-04-22T09:57:57Z","title":"SpaCeFormer: Fast Proposal-Free Open-Vocabulary 3D Instance Segmentation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-10T00:06:56.909467Z"},"links":{"cited_paper":"/paper/2507.23134","citing_paper":"/paper/2604.20395"},"observation_digest":"sha256:57026edfdce5f122b9c3872943b40d0d195a37a956a2783b1a758c3133711006","observation_id":"9e86a1d8-034e-43ff-a058-ee3a07736e53","resolution":{"observed_at":"2026-05-10T00:24:47.419381Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2507.23134/citation-record","integrity":"/paper/2507.23134/integrity","json":"/paper/2507.23134/citation-record.json","paper":"/paper/2507.23134"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:07:10.519182Z","title":"3d seman- tic parsing of large-scale indoor spaces","venue":null,"work_id":"ed0ae58b-aada-425e-8e38-7752ea121be1","year":2016},"citing_paper":{"arxiv_id":"2507.23134","last_updated":"2025-07-30T22:26:56Z","snapshot_observed_at":"2026-08-17T22:02:50.920534Z","submitted_at":"2025-07-30T22:26:56Z","title":"Details Matter for Indoor Open-vocabulary 3D Instance Segmentation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T11:07:05.407873Z"},"links":{"citing_paper":"/paper/2507.23134"},"observation_digest":"sha256:145c0e525ce04e8ba7d90cb21647dec2379e0e71945add8e40493e6a3e565f7f","observation_id":"f0f72009-c3bd-4118-9727-61d1718727d4","resolution":{"observed_at":"2026-08-06T11:07:10.521402Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02548","last_updated":"2025-02-13T10:46:38Z","snapshot_observed_at":"2026-08-16T13:46:10.289583Z","submitted_at":"2024-06-04T17:59:31Z","title":"Open-YOLO 3D: Towards Fast and Accurate Open-Vocabulary 3D Instance Segmentation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.02548","snapshot_observed_at":"2026-08-06T11:07:05.479192Z","title":"Open-yolo 3d: Towards fast and accurate open-vocabulary 3d instance segmentation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.23134","last_updated":"2025-07-30T22:26:56Z","snapshot_observed_at":"2026-08-17T22:02:50.920534Z","submitted_at":"2025-07-30T22:26:56Z","title":"Details Matter for Indoor Open-vocabulary 3D Instance Segmentation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T11:07:05.479192Z"},"links":{"cited_paper":"/paper/2406.02548","citing_paper":"/paper/2507.23134"},"observation_digest":"sha256:d2792b01c4b7776c5e58d64477d9ab6f4d31d9a9983aaa9b1d1610a22f73b9ea","observation_id":"bfa2bc6d-5eea-428b-92f1-bc1437adba60","resolution":{"observed_at":"2026-08-06T11:07:05.479192Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:07:05.521036Z","title":"Zero-shot semantic segmentation.Advances in Neural Information Processing Systems, 32, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.23134","last_updated":"2025-07-30T22:26:56Z","snapshot_observed_at":"2026-08-17T22:02:50.920534Z","submitted_at":"2025-07-30T22:26:56Z","title":"Details Matter for Indoor Open-vocabulary 3D Instance Segmentation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T11:07:05.521036Z"},"links":{"citing_paper":"/paper/2507.23134"},"observation_digest":"sha256:bb10db5224ad95940fd6efe6c163347e43fa0840e44701c8b81d3702ee23c556","observation_id":"be4baef7-d462-4850-b883-f5648a3736ea","resolution":{"observed_at":"2026-08-06T11:07:05.521036Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:07:10.508608Z","title":"Hierarchical aggregation for 3d instance segmentation","venue":null,"work_id":"5731d07a-8f43-4aa0-8045-4abbf1a0ed0f","year":null},"citing_paper":{"arxiv_id":"2507.23134","last_updated":"2025-07-30T22:26:56Z","snapshot_observed_at":"2026-08-17T22:02:50.920534Z","submitted_at":"2025-07-30T22:26:56Z","title":"Details Matter for Indoor Open-vocabulary 3D Instance Segmentation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T11:07:05.586699Z"},"links":{"citing_paper":"/paper/2507.23134"},"observation_digest":"sha256:0391056c4c9653c8642eea494a4deb47b5c4dc46b45bb482ac7a361204aa2e5e","observation_id":"6284050b-7d70-4917-ba54-1da3e6d36a87","resolution":{"observed_at":"2026-08-06T11:07:10.511001Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:07:10.502141Z","title":"Yolo-world: Real-time open-vocabulary object detection","venue":null,"work_id":"abeecd06-ecbe-4830-bdb4-8e2750bdb616","year":2024},"citing_paper":{"arxiv_id":"2507.23134","last_updated":"2025-07-30T22:26:56Z","snapshot_observed_at":"2026-08-17T22:02:50.920534Z","submitted_at":"2025-07-30T22:26:56Z","title":"Details Matter for Indoor Open-vocabulary 3D Instance Segmentation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T11:07:05.667169Z"},"links":{"citing_paper":"/paper/2507.23134"},"observation_digest":"sha256:be9f3b63ef6e12152fd77fc3b48a4d18084117474b0d989c8e88b0e930a5bd8a","observation_id":"c86447d6-6af2-41e6-899a-e424ec38048f","resolution":{"observed_at":"2026-08-06T11:07:10.504598Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:07:10.495690Z","title":"Robustnet: Improving domain generalization in urban-scene segmentation via in- stance selective whitening","venue":null,"work_id":"57f034e0-35dd-49fc-9ffe-6f15367c05c0","year":2021},"citing_paper":{"arxiv_id":"2507.23134","last_updated":"2025-07-30T22:26:56Z","snapshot_observed_at":"2026-08-17T22:02:50.920534Z","submitted_at":"2025-07-30T22:26:56Z","title":"Details Matter for Indoor Open-vocabulary 3D Instance Segmentation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T11:07:05.708444Z"},"links":{"citing_paper":"/paper/2507.23134"},"observation_digest":"sha256:e290151faa0a49a58299a5d0cd45f3376675dfaf17e8016014c127f5d9243d86","observation_id":"64cbe05a-8abd-43c6-ac9f-a470e564b261","resolution":{"observed_at":"2026-08-06T11:07:10.498074Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:07:10.488774Z","title":"Scannet: Richly-annotated 3d reconstructions of indoor scenes","venue":null,"work_id":"6dda79d3-89bd-467e-a3ad-a27ca8d1ebf9","year":2017},"citing_paper":{"arxiv_id":"2507.23134","last_updated":"2025-07-30T22:26:56Z","snapshot_observed_at":"2026-08-17T22:02:50.920534Z","submitted_at":"2025-07-30T22:26:56Z","title":"Details Matter for Indoor Open-vocabulary 3D Instance Segmentation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T11:07:05.745675Z"},"links":{"citing_paper":"/paper/2507.23134"},"observation_digest":"sha256:23a6fb86ec62cafeb98f6678d5e217726ea6e87da80f4522f3a189dfc29c5166","observation_id":"d954d124-ae30-4d93-95c2-e7330e2da63a","resolution":{"observed_at":"2026-08-06T11:07:10.491327Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:07:10.482301Z","title":"Pla: Language-driven open- vocabulary 3d scene understanding","venue":null,"work_id":"9e7c5088-da55-44b5-a88f-af06d4fa0175","year":2023},"citing_paper":{"arxiv_id":"2507.23134","last_updated":"2025-07-30T22:26:56Z","snapshot_observed_at":"2026-08-17T22:02:50.920534Z","submitted_at":"2025-07-30T22:26:56Z","title":"Details Matter for Indoor Open-vocabulary 3D Instance Segmentation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T11:07:05.870583Z"},"links":{"citing_paper":"/paper/2507.23134"},"observation_digest":"sha256:d8d5ae0ffa1e435eb8a80e943f5e85005081fadc35190e457e789d55ffa4b5e2","observation_id":"a9e6ca6a-e9b0-4fbb-93dc-ec7d23b920c7","resolution":{"observed_at":"2026-08-06T11:07:10.484492Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:07:10.475769Z","title":"Lowis3d: Language-driven open-world instance-level 3d scene understanding","venue":null,"work_id":"45a471f1-f2d3-4ff9-8f0d-aac907f56053","year":null},"citing_paper":{"arxiv_id":"2507.23134","last_updated":"2025-07-30T22:26:56Z","snapshot_observed_at":"2026-08-17T22:02:50.920534Z","submitted_at":"2025-07-30T22:26:56Z","title":"Details Matter for Indoor Open-vocabulary 3D Instance Segmentation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T11:07:05.913928Z"},"links":{"citing_paper":"/paper/2507.23134"},"observation_digest":"sha256:3b10f5fdf5af4706b2e865e1a01a1fa10265271c15e7be3041f7f3fe15367f4b","observation_id":"6347bf58-60cc-4562-91c2-6025a0faf498","resolution":{"observed_at":"2026-08-06T11:07:10.478113Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:07:10.469439Z","title":"Learning regional purity for instance segmentation on 3d point clouds","venue":null,"work_id":"ea830e17-0108-494a-9327-79cca8427d04","year":2022},"citing_paper":{"arxiv_id":"2507.23134","last_updated":"2025-07-30T22:26:56Z","snapshot_observed_at":"2026-08-17T22:02:50.920534Z","submitted_at":"2025-07-30T22:26:56Z","title":"Details Matter for Indoor Open-vocabulary 3D Instance Segmentation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T11:07:05.979382Z"},"links":{"citing_paper":"/paper/2507.23134"},"observation_digest":"sha256:a6875e319652f51c5285f024924ff2c320b3130c9c821a6733ffdaf6a923842b","observation_id":"80297a8f-a44c-485d-86a5-77a53f239216","resolution":{"observed_at":"2026-08-06T11:07:10.471758Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:07:10.462777Z","title":"3d-mpa: Multi-proposal aggre- gation for 3d semantic instance segmentation","venue":null,"work_id":"503fedb0-5361-4592-a39a-de5d44c88610","year":2020},"citing_paper":{"arxiv_id":"2507.23134","last_updated":"2025-07-30T22:26:56Z","snapshot_observed_at":"2026-08-17T22:02:50.920534Z","submitted_at":"2025-07-30T22:26:56Z","title":"Details Matter for Indoor Open-vocabulary 3D Instance Segmentation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T11:07:05.996211Z"},"links":{"citing_paper":"/paper/2507.23134"},"observation_digest":"sha256:dc999a4d7ea24d6aeac8aa73d2c6a77beeec2d33adb9af5139b5d7a98044af45","observation_id":"4fdf5fca-1de0-41c0-8bf5-645cc3a14e42","resolution":{"observed_at":"2026-08-06T11:07:10.465136Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:07:06.029439Z","title":"A density-based algorithm for discovering clusters in large spatial databases with noise","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.23134","last_updated":"2025-07-30T22:26:56Z","snapshot_observed_at":"2026-08-17T22:02:50.920534Z","submitted_at":"2025-07-30T22:26:56Z","title":"Details Matter for Indoor Open-vocabulary 3D Instance Segmentation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T11:07:06.029439Z"},"links":{"citing_paper":"/paper/2507.23134"},"observation_digest":"sha256:ff770953a4a3dc18b4f57b2d1adbd7f4f1648424512382be293395016b937d69","observation_id":"ef4f740b-4373-4328-8f8a-763ed509a5c4","resolution":{"observed_at":"2026-08-06T11:07:06.029439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:07:10.451988Z","title":"Efficient graph-based image segmentation","venue":null,"work_id":"f6ab846a-fb66-4cdf-8017-f17806b4f8c3","year":2004},"citing_paper":{"arxiv_id":"2507.23134","last_updated":"2025-07-30T22:26:56Z","snapshot_observed_at":"2026-08-17T22:02:50.920534Z","submitted_at":"2025-07-30T22:26:56Z","title":"Details Matter for Indoor Open-vocabulary 3D Instance Segmentation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T11:07:06.035091Z"},"links":{"citing_paper":"/paper/2507.23134"},"observation_digest":"sha256:c41b1b040dc2d21d8d1d297efb3eca9400531de6f7f749d77041569b565a53e3","observation_id":"5a2daaf7-9f11-4a3c-b609-4aa642006499","resolution":{"observed_at":"2026-08-06T11:07:10.454503Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:07:10.445206Z","title":"Scal- ing open-vocabulary image segmentation with image-level labels","venue":null,"work_id":"0d1082e8-079a-4a58-aca6-11127d42566a","year":2022},"citing_paper":{"arxiv_id":"2507.23134","last_updated":"2025-07-30T22:26:56Z","snapshot_observed_at":"2026-08-17T22:02:50.920534Z","submitted_at":"2025-07-30T22:26:56Z","title":"Details Matter for Indoor Open-vocabulary 3D Instance Segmentation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T11:07:06.075057Z"},"links":{"citing_paper":"/paper/2507.23134"},"observation_digest":"sha256:5aff37adbe64c829854a65da41e55f92844d96e08a98be14b7c22fef2b8f24b7","observation_id":"253b33a0-0574-40c5-affe-94d7f88feeb6","resolution":{"observed_at":"2026-08-06T11:07:10.447516Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.13921","last_updated":"2022-05-12T01:27:40Z","snapshot_observed_at":"2026-08-16T03:57:01.951598Z","submitted_at":"2021-04-28T17:58:57Z","title":"Open-vocabulary Object Detection via Vision and Language Knowledge Distillation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.13921","snapshot_observed_at":"2026-08-06T11:07:06.120200Z","title":"Open- vocabulary object detection via vision and language knowl- edge distillation","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.23134","last_updated":"2025-07-30T22:26:56Z","snapshot_observed_at":"2026-08-17T22:02:50.920534Z","submitted_at":"2025-07-30T22:26:56Z","title":"Details Matter for Indoor Open-vocabulary 3D Instance Segmentation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T11:07:06.120200Z"},"links":{"cited_paper":"/paper/2104.13921","citing_paper":"/paper/2507.23134"},"observation_digest":"sha256:59d30d47f490407dac419851e87f858c1dacbac27f9e66328f0c4fa34c461440","observation_id":"6e2ad12f-a344-47a2-bacb-429b0856476d","resolution":{"observed_at":"2026-08-06T11:07:06.120200Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:07:10.438207Z","title":"Sam-guided graph cut for 3d instance segmentation","venue":null,"work_id":"5a8ff5cd-6caf-4655-9924-cc97e224d674","year":2024},"citing_paper":{"arxiv_id":"2507.23134","last_updated":"2025-07-30T22:26:56Z","snapshot_observed_at":"2026-08-17T22:02:50.920534Z","submitted_at":"2025-07-30T22:26:56Z","title":"Details Matter for Indoor Open-vocabulary 3D Instance Segmentation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T11:07:06.192043Z"},"links":{"citing_paper":"/paper/2507.23134"},"observation_digest":"sha256:ef2395334e30e82370e08b9e492b3f35a49eec9470ff43f19468bf59dcd36428","observation_id":"d79bf52e-135e-4f5f-8b14-2843c5a4fa6e","resolution":{"observed_at":"2026-08-06T11:07:10.440669Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:07:10.431651Z","title":"Occuseg: Occupancy-aware 3d instance segmentation","venue":null,"work_id":"a3f914a9-423b-47d2-b2c3-6f00e6e3297f","year":2020},"citing_paper":{"arxiv_id":"2507.23134","last_updated":"2025-07-30T22:26:56Z","snapshot_observed_at":"2026-08-17T22:02:50.920534Z","submitted_at":"2025-07-30T22:26:56Z","title":"Details Matter for Indoor Open-vocabulary 3D Instance Segmentation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T11:07:06.230156Z"},"links":{"citing_paper":"/paper/2507.23134"},"observation_digest":"sha256:377bfb20a4627c013151058b6937eaa3e7b58e180c329b9b1f24d697680c50d6","observation_id":"098b7f6b-dd99-4b47-8ffb-8009885b9c14","resolution":{"observed_at":"2026-08-06T11:07:10.433888Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:07:10.424892Z","title":"Dyco3d: Robust instance segmentation of 3d point clouds through dynamic convolution","venue":null,"work_id":"f44958c7-5932-4047-8975-b62cffa5e9c6","year":2021},"citing_paper":{"arxiv_id":"2507.23134","last_updated":"2025-07-30T22:26:56Z","snapshot_observed_at":"2026-08-17T22:02:50.920534Z","submitted_at":"2025-07-30T22:26:56Z","title":"Details Matter for Indoor Open-vocabulary 3D Instance Segmentation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T11:07:06.264912Z"},"links":{"citing_paper":"/paper/2507.23134"},"observation_digest":"sha256:ddcd3f54969925f882c300181e66df1ddfcf7e5fd63d8fb1eb888a4bf5638edb","observation_id":"770dfaef-3d0d-432f-83d3-cd964fa5ce6c","resolution":{"observed_at":"2026-08-06T11:07:10.427475Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:07:10.418524Z","title":"Clip goes 3d: Leveraging prompt tuning for language grounded 3d recognition","venue":null,"work_id":"8b9f4c58-d539-42e8-acd6-e2d41af342cb","year":2023},"citing_paper":{"arxiv_id":"2507.23134","last_updated":"2025-07-30T22:26:56Z","snapshot_observed_at":"2026-08-17T22:02:50.920534Z","submitted_at":"2025-07-30T22:26:56Z","title":"Details Matter for Indoor Open-vocabulary 3D Instance Segmentation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T11:07:06.285181Z"},"links":{"citing_paper":"/paper/2507.23134"},"observation_digest":"sha256:608a10a087cd70d1ee85daed3b68cae883e76a206875e166a91416b047036e71","observation_id":"1ba2795b-46e0-4241-84c9-f0647abb0de4","resolution":{"observed_at":"2026-08-06T11:07:10.420859Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:07:06.317498Z","title":"3d-sis: 3d se- mantic instance segmentation of rgb-d scans","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.23134","last_updated":"2025-07-30T22:26:56Z","snapshot_observed_at":"2026-08-17T22:02:50.920534Z","submitted_at":"2025-07-30T22:26:56Z","title":"Details Matter for Indoor Open-vocabulary 3D Instance Segmentation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T11:07:06.317498Z"},"links":{"citing_paper":"/paper/2507.23134"},"observation_digest":"sha256:05e18b0bfdd1ab7b1c78ae3c349d8796badc58d2d4df03c14e6bc7b44430cf8b","observation_id":"fa10a68e-bc99-46e1-a42d-79c3857a1783","resolution":{"observed_at":"2026-08-06T11:07:06.317498Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:07:10.407365Z","title":"Reclip: Refine contrastive language image pre-training with source free domain adaptation","venue":null,"work_id":"bda7327c-ad55-4de7-af52-0c6b590822cf","year":2024},"citing_paper":{"arxiv_id":"2507.23134","last_updated":"2025-07-30T22:26:56Z","snapshot_observed_at":"2026-08-17T22:02:50.920534Z","submitted_at":"2025-07-30T22:26:56Z","title":"Details Matter for Indoor Open-vocabulary 3D Instance Segmentation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T11:07:06.336898Z"},"links":{"citing_paper":"/paper/2507.23134"},"observation_digest":"sha256:2b5da54833e91237852c14a356135a0c7dade46f08f0eea7e04cfcca390b35f2","observation_id":"fd2376f0-e4ff-4052-9859-f32fbae4b08b","resolution":{"observed_at":"2026-08-06T11:07:10.409854Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:07:10.400182Z","title":"Decorre- lated batch normalization","venue":null,"work_id":"5f498da2-f0f0-4dd1-bc3b-b550539c1699","year":2018},"citing_paper":{"arxiv_id":"2507.23134","last_updated":"2025-07-30T22:26:56Z","snapshot_observed_at":"2026-08-17T22:02:50.920534Z","submitted_at":"2025-07-30T22:26:56Z","title":"Details Matter for Indoor Open-vocabulary 3D Instance Segmentation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T11:07:06.369959Z"},"links":{"citing_paper":"/paper/2507.23134"},"observation_digest":"sha256:4f299f9d814f970168f932b61eae7c8e574d5790e7c32c613c305e991415222d","observation_id":"8e51e046-c2a0-4fa7-989f-2fa12584c97b","resolution":{"observed_at":"2026-08-06T11:07:10.402977Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:07:10.393542Z","title":"Segment3d: Learning fine-grained class-agnostic 3d segmentation without manual labels","venue":null,"work_id":"0243e431-9658-44ed-b85b-26946da61a5b","year":2024},"citing_paper":{"arxiv_id":"2507.23134","last_updated":"2025-07-30T22:26:56Z","snapshot_observed_at":"2026-08-17T22:02:50.920534Z","submitted_at":"2025-07-30T22:26:56Z","title":"Details Matter for Indoor Open-vocabulary 3D Instance Segmentation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T11:07:06.394971Z"},"links":{"citing_paper":"/paper/2507.23134"},"observation_digest":"sha256:c890b01b70e2868e3741091b7714a10b7385f8cf577f0edd0f27e0e630fb7ab7","observation_id":"29abf999-ed33-4520-9fb0-bfa4042001da","resolution":{"observed_at":"2026-08-06T11:07:10.395784Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.00616","last_updated":"2024-08-12T16:58:33Z","snapshot_observed_at":"2026-08-16T15:03:56.654719Z","submitted_at":"2023-09-01T17:59:56Z","title":"OpenIns3D: Snap and Lookup for 3D Open-vocabulary Instance Segmentation","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.00616","snapshot_observed_at":"2026-08-06T11:07:06.433791Z","title":"Openins3d: Snap and lookup for 3d open-vocabulary instance segmentation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.23134","last_updated":"2025-07-30T22:26:56Z","snapshot_observed_at":"2026-08-17T22:02:50.920534Z","submitted_at":"2025-07-30T22:26:56Z","title":"Details Matter for Indoor Open-vocabulary 3D Instance Segmentation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T11:07:06.433791Z"},"links":{"cited_paper":"/paper/2309.00616","citing_paper":"/paper/2507.23134"},"observation_digest":"sha256:5e21a5d45e7733e02d4f2ccdd5f57b1cef1b0eb64501d839abd169b81d0e9c3a","observation_id":"fd70fa91-4086-4658-a34f-f3c3e98d5549","resolution":{"observed_at":"2026-08-06T11:07:06.433791Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.07241","last_updated":"2023-10-23T14:56:15Z","snapshot_observed_at":"2026-08-16T15:55:21.590710Z","submitted_at":"2023-02-14T18:40:26Z","title":"ConceptFusion: Open-set Multimodal 3D Mapping","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.07241","snapshot_observed_at":"2026-08-06T11:07:06.484168Z","title":"Con- 9 ceptfusion: Open-set multimodal 3d mapping.arXiv preprint arXiv:2302.07241, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.23134","last_updated":"2025-07-30T22:26:56Z","snapshot_observed_at":"2026-08-17T22:02:50.920534Z","submitted_at":"2025-07-30T22:26:56Z","title":"Details Matter for Indoor Open-vocabulary 3D Instance Segmentation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T11:07:06.484168Z"},"links":{"cited_paper":"/paper/2302.07241","citing_paper":"/paper/2507.23134"},"observation_digest":"sha256:0d124ce7ccb60eeec21704d3606a31efb96891631693d24a2c29e9aeff5bb7c2","observation_id":"bb122f5d-3607-4a7b-ba11-cb11d24ac6ad","resolution":{"observed_at":"2026-08-06T11:07:06.484168Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:07:10.386914Z","title":"Dynamic filter networks","venue":null,"work_id":"5824fae1-e734-4dcd-a264-6e2471f9ec98","year":2016},"citing_paper":{"arxiv_id":"2507.23134","last_updated":"2025-07-30T22:26:56Z","snapshot_observed_at":"2026-08-17T22:02:50.920534Z","submitted_at":"2025-07-30T22:26:56Z","title":"Details Matter for Indoor Open-vocabulary 3D Instance Segmentation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T11:07:06.528420Z"},"links":{"citing_paper":"/paper/2507.23134"},"observation_digest":"sha256:16e246a70baed3f01b998b2eb3d8b9a188f8f6e68d01fa441fb6d1fdc1ffc983","observation_id":"69003d17-f0e0-4da6-91a2-3f0df34ed739","resolution":{"observed_at":"2026-08-06T11:07:10.389052Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:07:10.380035Z","title":"Pointgroup: Dual-set point group- ing for 3d instance segmentation","venue":null,"work_id":"77d7fde9-2fc4-458c-b6f0-9221002944f2","year":2020},"citing_paper":{"arxiv_id":"2507.23134","last_updated":"2025-07-30T22:26:56Z","snapshot_observed_at":"2026-08-17T22:02:50.920534Z","submitted_at":"2025-07-30T22:26:56Z","title":"Details Matter for Indoor Open-vocabulary 3D Instance Segmentation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T11:07:06.565686Z"},"links":{"citing_paper":"/paper/2507.23134"},"observation_digest":"sha256:f2e091d0eed2f1df4d323cfe690dfe7c82b29ac861da7520d8adbfe168e8e041","observation_id":"28e0788e-09ce-4c25-b36a-1c3457a3587e","resolution":{"observed_at":"2026-08-06T11:07:10.382327Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:07:06.598696Z","title":"Multi- modal classifiers for open-vocabulary object detection","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.23134","last_updated":"2025-07-30T22:26:56Z","snapshot_observed_at":"2026-08-17T22:02:50.920534Z","submitted_at":"2025-07-30T22:26:56Z","title":"Details Matter for Indoor Open-vocabulary 3D Instance Segmentation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T11:07:06.598696Z"},"links":{"citing_paper":"/paper/2507.23134"},"observation_digest":"sha256:7f79c9c6af6ab8a11a3bc6643171113901d7faa5deba03b8e2754d2e6f81c1c4","observation_id":"7f22078b-6f82-4a93-bfc7-90acb8e6875d","resolution":{"observed_at":"2026-08-06T11:07:06.598696Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:07:06.629655Z","title":"Lerf: Language embedded radiance fields","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.23134","last_updated":"2025-07-30T22:26:56Z","snapshot_observed_at":"2026-08-17T22:02:50.920534Z","submitted_at":"2025-07-30T22:26:56Z","title":"Details Matter for Indoor Open-vocabulary 3D Instance Segmentation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T11:07:06.629655Z"},"links":{"citing_paper":"/paper/2507.23134"},"observation_digest":"sha256:e3de870d417412e8f62af2825491e591d39ae7d75bbd22b83859c0633267f352","observation_id":"43110e46-d98f-4472-8cce-dd24f924a92d","resolution":{"observed_at":"2026-08-06T11:07:06.629655Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:07:10.366035Z","title":"Segment any- thing","venue":null,"work_id":"c326fa68-d729-43d9-974f-fc78e4847d42","year":2023},"citing_paper":{"arxiv_id":"2507.23134","last_updated":"2025-07-30T22:26:56Z","snapshot_observed_at":"2026-08-17T22:02:50.920534Z","submitted_at":"2025-07-30T22:26:56Z","title":"Details Matter for Indoor Open-vocabulary 3D Instance Segmentation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T11:07:06.658611Z"},"links":{"citing_paper":"/paper/2507.23134"},"observation_digest":"sha256:4e3b4fd756cf1538fdceec4048e091b84b9e3eb3f0dc98d615669b72805e64e5","observation_id":"2b213264-4bc0-4177-9313-3722a23837a6","resolution":{"observed_at":"2026-08-06T11:07:10.368301Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:07:10.359612Z","title":"Oneformer3d: One transformer for unified point cloud segmentation","venue":null,"work_id":"209a7a62-d382-4f6f-a6df-12e0cc961699","year":2024},"citing_paper":{"arxiv_id":"2507.23134","last_updated":"2025-07-30T22:26:56Z","snapshot_observed_at":"2026-08-17T22:02:50.920534Z","submitted_at":"2025-07-30T22:26:56Z","title":"Details Matter for Indoor Open-vocabulary 3D Instance Segmentation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T11:07:06.699422Z"},"links":{"citing_paper":"/paper/2507.23134"},"observation_digest":"sha256:fa14fdd8a58863feb522f1cc7a184aabbac758d4eb63ad4fdb572eef26a35604","observation_id":"fbb034e4-11ce-43fd-afde-37ec10faf60e","resolution":{"observed_at":"2026-08-06T11:07:10.361952Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:07:10.353583Z","title":"3d instance segmentation via multi-task met- ric learning","venue":null,"work_id":"8b29fe5b-041d-48ba-aefd-53503fb8e000","year":2019},"citing_paper":{"arxiv_id":"2507.23134","last_updated":"2025-07-30T22:26:56Z","snapshot_observed_at":"2026-08-17T22:02:50.920534Z","submitted_at":"2025-07-30T22:26:56Z","title":"Details Matter for Indoor Open-vocabulary 3D Instance Segmentation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T11:07:06.737283Z"},"links":{"citing_paper":"/paper/2507.23134"},"observation_digest":"sha256:8df512d72b90674c0b7bfa4007634418ffb8b8e701abac5439e0a8e26c9e73cc","observation_id":"d427de06-8a9e-42af-bfc1-75aa8b330ca3","resolution":{"observed_at":"2026-08-06T11:07:10.355878Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.02157","last_updated":"2024-04-02T17:59:10Z","snapshot_observed_at":"2026-08-17T13:52:24.951747Z","submitted_at":"2024-04-02T17:59:10Z","title":"Segment Any 3D Object with Language","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.02157","snapshot_observed_at":"2026-08-06T11:07:06.793797Z","title":"Seg- ment any 3d object with language","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.23134","last_updated":"2025-07-30T22:26:56Z","snapshot_observed_at":"2026-08-17T22:02:50.920534Z","submitted_at":"2025-07-30T22:26:56Z","title":"Details Matter for Indoor Open-vocabulary 3D Instance Segmentation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T11:07:06.793797Z"},"links":{"cited_paper":"/paper/2404.02157","citing_paper":"/paper/2507.23134"},"observation_digest":"sha256:853f58844b5090faef3631d8efdc9dbdf0863f63f18251debc8704da1548ed3e","observation_id":"2f544d92-f794-463d-8fd1-8e95137ff743","resolution":{"observed_at":"2026-08-06T11:07:06.793797Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2201.03546","last_updated":"2022-04-03T03:33:43Z","snapshot_observed_at":"2026-08-01T06:14:31.660540Z","submitted_at":"2022-01-10T18:59:10Z","title":"Language-driven Semantic Segmentation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.03546","snapshot_observed_at":"2026-08-06T11:07:06.885510Z","title":"Language-driven semantic seg- mentation","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.23134","last_updated":"2025-07-30T22:26:56Z","snapshot_observed_at":"2026-08-17T22:02:50.920534Z","submitted_at":"2025-07-30T22:26:56Z","title":"Details Matter for Indoor Open-vocabulary 3D Instance Segmentation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T11:07:06.885510Z"},"links":{"cited_paper":"/paper/2201.03546","citing_paper":"/paper/2507.23134"},"observation_digest":"sha256:4bfb7b541d0303feab5d2b054d057bc902a6d6b8f5eb3dde13777009977c21a8","observation_id":"0facce9b-1992-43ef-9bd9-cb6ce61875ae","resolution":{"observed_at":"2026-08-06T11:07:06.885510Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:07:10.347488Z","title":"Open-vocabulary semantic segmentation with mask-adapted clip","venue":null,"work_id":"2ec76f62-6bdc-49b1-83b0-ec6a0d00fbd3","year":2023},"citing_paper":{"arxiv_id":"2507.23134","last_updated":"2025-07-30T22:26:56Z","snapshot_observed_at":"2026-08-17T22:02:50.920534Z","submitted_at":"2025-07-30T22:26:56Z","title":"Details Matter for Indoor Open-vocabulary 3D Instance Segmentation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T11:07:06.944640Z"},"links":{"citing_paper":"/paper/2507.23134"},"observation_digest":"sha256:abe9e1fd3e45ee4bbcd929e18d1a0269703bfcd0484179d59fdb94e5ec7938af","observation_id":"e0c86996-2815-4399-822b-c7827d41f331","resolution":{"observed_at":"2026-08-06T11:07:10.349780Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:07:10.341032Z","title":"Instance segmentation in 3d scenes using semantic superpoint tree networks","venue":null,"work_id":"330469b0-936d-47d3-816e-337ec7c58f94","year":2021},"citing_paper":{"arxiv_id":"2507.23134","last_updated":"2025-07-30T22:26:56Z","snapshot_observed_at":"2026-08-17T22:02:50.920534Z","submitted_at":"2025-07-30T22:26:56Z","title":"Details Matter for Indoor Open-vocabulary 3D Instance Segmentation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T11:07:07.003567Z"},"links":{"citing_paper":"/paper/2507.23134"},"observation_digest":"sha256:5f0ba1d02f3e7470083c83202caf796069fc8305db0ee4bd1585d1bf4f419cec","observation_id":"3f4be95d-d60c-4568-a880-1eb6256f1d8b","resolution":{"observed_at":"2026-08-06T11:07:10.343271Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.05499","last_updated":"2024-07-19T06:00:41Z","snapshot_observed_at":"2026-08-19T16:02:58.628969Z","submitted_at":"2023-03-09T18:52:16Z","title":"Grounding DINO: Marrying DINO with Grounded Pre-Training for Open-Set Object Detection","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.05499","snapshot_observed_at":"2026-08-06T11:07:07.072658Z","title":"Grounding dino: Marrying dino with grounded pre-training for open-set object detection","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.23134","last_updated":"2025-07-30T22:26:56Z","snapshot_observed_at":"2026-08-17T22:02:50.920534Z","submitted_at":"2025-07-30T22:26:56Z","title":"Details Matter for Indoor Open-vocabulary 3D Instance Segmentation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T11:07:07.072658Z"},"links":{"cited_paper":"/paper/2303.05499","citing_paper":"/paper/2507.23134"},"observation_digest":"sha256:7de9081a085d2a2b312dbc9f15091eed065fbc5d4a3d3769b2cdbc1bb0000421","observation_id":"730c4500-7ae5-4d27-b544-0e017b0a8da5","resolution":{"observed_at":"2026-08-06T11:07:07.072658Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2007.09860","last_updated":"2020-07-20T03:11:32Z","snapshot_observed_at":"2026-08-02T18:07:51.672931Z","submitted_at":"2020-07-20T03:11:32Z","title":"Learning Gaussian Instance Segmentation in Point Clouds","version":1},"cited_work":{"arxiv_id":"2007.09860","doi":null,"metadata_source":"pith","pith_arxiv_id":"2007.09860","snapshot_observed_at":"2026-08-06T11:07:09.573781Z","title":"Learning Gaussian Instance Segmentation in Point Clouds","venue":"cs.CV","work_id":"45201ec8-d540-4fb2-8a2c-6c243ccd4fbe","year":2020},"citing_paper":{"arxiv_id":"2507.23134","last_updated":"2025-07-30T22:26:56Z","snapshot_observed_at":"2026-08-17T22:02:50.920534Z","submitted_at":"2025-07-30T22:26:56Z","title":"Details Matter for Indoor Open-vocabulary 3D Instance Segmentation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T11:07:07.162186Z"},"links":{"cited_paper":"/paper/2007.09860","citing_paper":"/paper/2507.23134"},"observation_digest":"sha256:59f12d09777214548e4fb96ade6476fd77561ab4ebf785d650f135a4b619aaca","observation_id":"35a568ad-e2aa-4e16-9093-957885a593e1","resolution":{"observed_at":"2026-08-06T11:07:09.621484Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:07:10.334231Z","title":"Ovir-3d: Open-vocabulary 3d in- stance retrieval without training on 3d data","venue":null,"work_id":"c517dac5-ce24-42ed-a5ad-2ace0478eddd","year":2023},"citing_paper":{"arxiv_id":"2507.23134","last_updated":"2025-07-30T22:26:56Z","snapshot_observed_at":"2026-08-17T22:02:50.920534Z","submitted_at":"2025-07-30T22:26:56Z","title":"Details Matter for Indoor Open-vocabulary 3D Instance Segmentation","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T11:07:07.242731Z"},"links":{"citing_paper":"/paper/2507.23134"},"observation_digest":"sha256:c919f1f3a61fca0a38956838e489cf96f3009657ae13a8dae22e4c71f9f7357d","observation_id":"a5b9417d-75b2-4a1a-bdc4-7b9bd44a728f","resolution":{"observed_at":"2026-08-06T11:07:10.336593Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:07:10.327257Z","title":"Isbnet: a 3d point cloud instance segmentation network with instance- aware sampling and box-aware dynamic convolution","venue":null,"work_id":"fcad82f5-4ecb-4d58-97a1-9cee720097ee","year":2023},"citing_paper":{"arxiv_id":"2507.23134","last_updated":"2025-07-30T22:26:56Z","snapshot_observed_at":"2026-08-17T22:02:50.920534Z","submitted_at":"2025-07-30T22:26:56Z","title":"Details Matter for Indoor Open-vocabulary 3D Instance Segmentation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T11:07:07.296695Z"},"links":{"citing_paper":"/paper/2507.23134"},"observation_digest":"sha256:fb066c33ccea634a145f7e387e1a462e9c0295526558790070af299a1b34ac54","observation_id":"3721f919-3ade-4a49-b14c-ec8a3ee2afac","resolution":{"observed_at":"2026-08-06T11:07:10.329739Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:07:10.320937Z","title":"Open3dis: Open-vocabulary 3d instance segmentation with 2d mask guidance","venue":null,"work_id":"dbb9f622-453c-45b8-971d-d6edff82172c","year":2024},"citing_paper":{"arxiv_id":"2507.23134","last_updated":"2025-07-30T22:26:56Z","snapshot_observed_at":"2026-08-17T22:02:50.920534Z","submitted_at":"2025-07-30T22:26:56Z","title":"Details Matter for Indoor Open-vocabulary 3D Instance Segmentation","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T11:07:07.396043Z"},"links":{"citing_paper":"/paper/2507.23134"},"observation_digest":"sha256:c8fcba4fba6ba0fbc1a66c748387a338818f65e610bd3ea42078615936977b5b","observation_id":"523302a6-e68a-4d4f-9388-cef6404ebfce","resolution":{"observed_at":"2026-08-06T11:07:10.323188Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:07:10.314336Z","title":"Openscene: 3d scene understanding with open vocabularies","venue":null,"work_id":"007f5a9a-1dd8-49b5-8910-2d19a6d310cc","year":2023},"citing_paper":{"arxiv_id":"2507.23134","last_updated":"2025-07-30T22:26:56Z","snapshot_observed_at":"2026-08-17T22:02:50.920534Z","submitted_at":"2025-07-30T22:26:56Z","title":"Details Matter for Indoor Open-vocabulary 3D Instance Segmentation","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T11:07:07.457336Z"},"links":{"citing_paper":"/paper/2507.23134"},"observation_digest":"sha256:9a0bfd6c3fc28f46e68d842b273ab8f6d7a5031a37cd5a192183c81fbdd1ddc2","observation_id":"3c55dc42-6e07-4708-b8d1-a1c477f18387","resolution":{"observed_at":"2026-08-06T11:07:10.316906Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:07:10.307709Z","title":"Lp-ovod: Open- vocabulary object detection by linear probing","venue":null,"work_id":"a06a492e-1eb1-4551-904a-9fb75f82e9c0","year":2024},"citing_paper":{"arxiv_id":"2507.23134","last_updated":"2025-07-30T22:26:56Z","snapshot_observed_at":"2026-08-17T22:02:50.920534Z","submitted_at":"2025-07-30T22:26:56Z","title":"Details Matter for Indoor Open-vocabulary 3D Instance Segmentation","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T11:07:07.528571Z"},"links":{"citing_paper":"/paper/2507.23134"},"observation_digest":"sha256:f00797a9511fb69232012e628607c2fd8da78ea32cf1258c1c58af1b84f8b470","observation_id":"d049fb39-7866-414d-9222-eb84fd076821","resolution":{"observed_at":"2026-08-06T11:07:10.310101Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:07:10.301020Z","title":"Learning transferable visual models from natural language supervi- sion","venue":null,"work_id":"884b7d64-f9a3-44d7-a17e-abfcaadc7ab1","year":2021},"citing_paper":{"arxiv_id":"2507.23134","last_updated":"2025-07-30T22:26:56Z","snapshot_observed_at":"2026-08-17T22:02:50.920534Z","submitted_at":"2025-07-30T22:26:56Z","title":"Details Matter for Indoor Open-vocabulary 3D Instance Segmentation","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T11:07:07.586034Z"},"links":{"citing_paper":"/paper/2507.23134"},"observation_digest":"sha256:dc216247ac9b899d8c5315262435dff54fd3852ba0e0aadba818b335fd7122a2","observation_id":"14100c5e-1026-4cd9-a56b-5944d236e9d2","resolution":{"observed_at":"2026-08-06T11:07:10.303376Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.14159","last_updated":"2024-01-25T13:12:09Z","snapshot_observed_at":"2026-07-06T17:20:25.138890Z","submitted_at":"2024-01-25T13:12:09Z","title":"Grounded SAM: Assembling Open-World Models for Diverse Visual Tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.14159","snapshot_observed_at":"2026-08-06T11:07:07.645385Z","title":"Grounded sam: Assembling open-world models for diverse visual tasks","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.23134","last_updated":"2025-07-30T22:26:56Z","snapshot_observed_at":"2026-08-17T22:02:50.920534Z","submitted_at":"2025-07-30T22:26:56Z","title":"Details Matter for Indoor Open-vocabulary 3D Instance Segmentation","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T11:07:07.645385Z"},"links":{"cited_paper":"/paper/2401.14159","citing_paper":"/paper/2507.23134"},"observation_digest":"sha256:0c5cbec2eb3429c5905396424a296a001bd950f433fd6f76b289a094a533b8a6","observation_id":"adbe5cf2-d713-4154-9359-80544b548885","resolution":{"observed_at":"2026-08-06T11:07:07.645385Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:07:10.294619Z","title":"Unsuper- vised domain adaptation using feature-whitening and con- sensus loss","venue":null,"work_id":"98d526d3-1e8b-4890-8fe6-b32af4504ae1","year":null},"citing_paper":{"arxiv_id":"2507.23134","last_updated":"2025-07-30T22:26:56Z","snapshot_observed_at":"2026-08-17T22:02:50.920534Z","submitted_at":"2025-07-30T22:26:56Z","title":"Details Matter for Indoor Open-vocabulary 3D Instance Segmentation","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T11:07:07.696997Z"},"links":{"citing_paper":"/paper/2507.23134"},"observation_digest":"sha256:afde79c8c68c5027d4af8a06c042617e9e58fcdb58b148d20cd415021dd56ac0","observation_id":"f5be1d3d-0156-4d0f-a130-c9f6253e5b41","resolution":{"observed_at":"2026-08-06T11:07:10.296988Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:07:10.288248Z","title":"Mask3d: Mask trans- former for 3d semantic instance segmentation","venue":null,"work_id":"98ff67f1-78be-47fb-953f-bc82208eb6ef","year":2023},"citing_paper":{"arxiv_id":"2507.23134","last_updated":"2025-07-30T22:26:56Z","snapshot_observed_at":"2026-08-17T22:02:50.920534Z","submitted_at":"2025-07-30T22:26:56Z","title":"Details Matter for Indoor Open-vocabulary 3D Instance Segmentation","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T11:07:07.762951Z"},"links":{"citing_paper":"/paper/2507.23134"},"observation_digest":"sha256:6f894cf1794dc1dacc5b61ba022fe568b446253e2db956253539311c722e8b5b","observation_id":"34898380-c820-4cee-86ff-3c2b5590dc94","resolution":{"observed_at":"2026-08-06T11:07:10.290499Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1806.00420","last_updated":"2019-02-25T23:19:40Z","snapshot_observed_at":"2026-08-14T19:08:28.947198Z","submitted_at":"2018-06-01T16:17:30Z","title":"Whitening and Coloring batch transform for GANs","version":2},"cited_work":{"arxiv_id":"1806.00420","doi":null,"metadata_source":"pith","pith_arxiv_id":"1806.00420","snapshot_observed_at":"2026-08-06T11:07:09.452774Z","title":"Whitening and Coloring batch transform for GANs","venue":"stat.ML","work_id":"a7bd76aa-8f12-4365-875f-77a9fa9fb1f8","year":2018},"citing_paper":{"arxiv_id":"2507.23134","last_updated":"2025-07-30T22:26:56Z","snapshot_observed_at":"2026-08-17T22:02:50.920534Z","submitted_at":"2025-07-30T22:26:56Z","title":"Details Matter for Indoor Open-vocabulary 3D Instance Segmentation","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T11:07:07.790113Z"},"links":{"cited_paper":"/paper/1806.00420","citing_paper":"/paper/2507.23134"},"observation_digest":"sha256:0fc7de5e572243bee9c4a991c0768f0d0271956cee305478ab8115e0d0335294","observation_id":"320d72e3-e7c0-4f0d-aa6c-c66988c285d0","resolution":{"observed_at":"2026-08-06T11:07:09.495317Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1906.05797","last_updated":"2019-06-13T16:29:58Z","snapshot_observed_at":"2026-08-16T20:27:41.336890Z","submitted_at":"2019-06-13T16:29:58Z","title":"The Replica Dataset: A Digital Replica of Indoor Spaces","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1906.05797","snapshot_observed_at":"2026-08-06T11:07:07.853176Z","title":"The replica dataset: A digital replica of indoor spaces","venue":null,"work_id":null,"year":1906},"citing_paper":{"arxiv_id":"2507.23134","last_updated":"2025-07-30T22:26:56Z","snapshot_observed_at":"2026-08-17T22:02:50.920534Z","submitted_at":"2025-07-30T22:26:56Z","title":"Details Matter for Indoor Open-vocabulary 3D Instance Segmentation","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T11:07:07.853176Z"},"links":{"cited_paper":"/paper/1906.05797","citing_paper":"/paper/2507.23134"},"observation_digest":"sha256:f0d7f83e8b938342657c152f028c3bb0eb5ba86326d5b00e369321ee883d5efb","observation_id":"27847e1b-7fd8-474e-accc-55260767bb41","resolution":{"observed_at":"2026-08-06T11:07:07.853176Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:07:10.281329Z","title":"Alpha- clip: A clip model focusing on wherever you want","venue":null,"work_id":"ad752c84-584b-4139-9369-452ead2c05c9","year":2024},"citing_paper":{"arxiv_id":"2507.23134","last_updated":"2025-07-30T22:26:56Z","snapshot_observed_at":"2026-08-17T22:02:50.920534Z","submitted_at":"2025-07-30T22:26:56Z","title":"Details Matter for Indoor Open-vocabulary 3D Instance Segmentation","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T11:07:07.904323Z"},"links":{"citing_paper":"/paper/2507.23134"},"observation_digest":"sha256:e08d2128a25a2272a0eb168ed574712715e5f72de90ffbb393ebeb913d38f156","observation_id":"67a636e8-55bf-443a-a88b-940a0fc2d61b","resolution":{"observed_at":"2026-08-06T11:07:10.283622Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.13631","last_updated":"2023-10-29T14:04:25Z","snapshot_observed_at":"2026-08-16T15:21:36.291027Z","submitted_at":"2023-06-23T17:36:44Z","title":"OpenMask3D: Open-Vocabulary 3D Instance Segmentation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.13631","snapshot_observed_at":"2026-08-06T11:07:07.992835Z","title":"Open- mask3d: Open-vocabulary 3d instance segmentation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.23134","last_updated":"2025-07-30T22:26:56Z","snapshot_observed_at":"2026-08-17T22:02:50.920534Z","submitted_at":"2025-07-30T22:26:56Z","title":"Details Matter for Indoor Open-vocabulary 3D Instance Segmentation","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T11:07:07.992835Z"},"links":{"cited_paper":"/paper/2306.13631","citing_paper":"/paper/2507.23134"},"observation_digest":"sha256:849a310f1c3f76dd36c86e991cbf64dfcab893fc5d0d930cf55575cc6309b4ce","observation_id":"fdde2e5c-ae80-4400-b9a5-6f12dfcd3b97","resolution":{"observed_at":"2026-08-06T11:07:07.992835Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:07:10.274410Z","title":"Conditional con- volutions for instance segmentation","venue":null,"work_id":"aabf0507-e401-4e9d-ba7a-1cdc2264ecf6","year":2020},"citing_paper":{"arxiv_id":"2507.23134","last_updated":"2025-07-30T22:26:56Z","snapshot_observed_at":"2026-08-17T22:02:50.920534Z","submitted_at":"2025-07-30T22:26:56Z","title":"Details Matter for Indoor Open-vocabulary 3D Instance Segmentation","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T11:07:08.140415Z"},"links":{"citing_paper":"/paper/2507.23134"},"observation_digest":"sha256:0726083ad464d8346e7fe957bf521faf6e7349a679c985f8ef85dbd5a29f5bfa","observation_id":"cb78d0a0-0ea1-4092-bf27-7010013ded16","resolution":{"observed_at":"2026-08-06T11:07:10.277170Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:07:08.189483Z","title":"Attention is all you need","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.23134","last_updated":"2025-07-30T22:26:56Z","snapshot_observed_at":"2026-08-17T22:02:50.920534Z","submitted_at":"2025-07-30T22:26:56Z","title":"Details Matter for Indoor Open-vocabulary 3D Instance Segmentation","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T11:07:08.189483Z"},"links":{"citing_paper":"/paper/2507.23134"},"observation_digest":"sha256:7df3ffcf35b4db0ae1bd4f5cfe68f13f3ae287d430d940ed0c0a02aa3f1ea0b3","observation_id":"5ddf3551-7805-462f-a711-54e5d87e2ebc","resolution":{"observed_at":"2026-08-06T11:07:08.189483Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:07:10.264084Z","title":"Softgroup for 3d instance segmentation on point clouds","venue":null,"work_id":"65d90ee1-b65e-4e1e-a44c-a387450cd43e","year":2022},"citing_paper":{"arxiv_id":"2507.23134","last_updated":"2025-07-30T22:26:56Z","snapshot_observed_at":"2026-08-17T22:02:50.920534Z","submitted_at":"2025-07-30T22:26:56Z","title":"Details Matter for Indoor Open-vocabulary 3D Instance Segmentation","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T11:07:08.224895Z"},"links":{"citing_paper":"/paper/2507.23134"},"observation_digest":"sha256:957f62eb7fa1aefd09e1328777490b4fa18b827d36f6025bf0aa7b9bf469ce99","observation_id":"94be33b2-64c2-46af-a697-68a1dc96dcb3","resolution":{"observed_at":"2026-08-06T11:07:10.266563Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:07:08.229534Z","title":"Object-aware dis- tillation pyramid for open-vocabulary object detection","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.23134","last_updated":"2025-07-30T22:26:56Z","snapshot_observed_at":"2026-08-17T22:02:50.920534Z","submitted_at":"2025-07-30T22:26:56Z","title":"Details Matter for Indoor Open-vocabulary 3D Instance Segmentation","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T11:07:08.229534Z"},"links":{"citing_paper":"/paper/2507.23134"},"observation_digest":"sha256:3a02a47746d9fdc7c79831c31c17b28dd14b23d73be77457bd4fd3442cbd62d1","observation_id":"eb38a89a-eada-4a80-8c5a-ba1dfeb3b3e8","resolution":{"observed_at":"2026-08-06T11:07:08.229534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:07:10.252922Z","title":"Sgpn: Similarity group proposal network for 3d point cloud instance segmentation","venue":null,"work_id":"d1369905-6c21-43cb-a19b-98b04bc04582","year":2018},"citing_paper":{"arxiv_id":"2507.23134","last_updated":"2025-07-30T22:26:56Z","snapshot_observed_at":"2026-08-17T22:02:50.920534Z","submitted_at":"2025-07-30T22:26:56Z","title":"Details Matter for Indoor Open-vocabulary 3D Instance Segmentation","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-06T11:07:08.274324Z"},"links":{"citing_paper":"/paper/2507.23134"},"observation_digest":"sha256:0f5f98c8ecd38ce2c01f45113b35879bf1b32d2de0d10b3edc4f94e895ad84fe","observation_id":"4810adf6-288f-4711-a2a8-9ef0d89ed3cb","resolution":{"observed_at":"2026-08-06T11:07:10.255582Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:07:10.246165Z","title":"Groupvit: Semantic segmentation emerges from text supervision","venue":null,"work_id":"ab0fbba4-4aa8-478a-af9c-43f6ae6b5370","year":2022},"citing_paper":{"arxiv_id":"2507.23134","last_updated":"2025-07-30T22:26:56Z","snapshot_observed_at":"2026-08-17T22:02:50.920534Z","submitted_at":"2025-07-30T22:26:56Z","title":"Details Matter for Indoor Open-vocabulary 3D Instance Segmentation","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-06T11:07:08.359790Z"},"links":{"citing_paper":"/paper/2507.23134"},"observation_digest":"sha256:9d3d26717b6d7484e5e40082c474842402a4369d7181f0c150d764cfa5676263","observation_id":"3f8610d9-4449-40be-9a9a-6581f84abb99","resolution":{"observed_at":"2026-08-06T11:07:10.248371Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:07:10.239037Z","title":"Open-vocabulary panop- tic segmentation with text-to-image diffusion models","venue":null,"work_id":"7976504f-c0e8-43e2-9c4c-35dbb3a8da4f","year":2023},"citing_paper":{"arxiv_id":"2507.23134","last_updated":"2025-07-30T22:26:56Z","snapshot_observed_at":"2026-08-17T22:02:50.920534Z","submitted_at":"2025-07-30T22:26:56Z","title":"Details Matter for Indoor Open-vocabulary 3D Instance Segmentation","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-06T11:07:08.427813Z"},"links":{"citing_paper":"/paper/2507.23134"},"observation_digest":"sha256:7e0f4ccad22cb60ea3d1b075283ab2f5eefddd43135d1706836e08f5e2c0575f","observation_id":"df1a85b7-d098-4447-8bef-c2bc4606971d","resolution":{"observed_at":"2026-08-06T11:07:10.241419Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:07:10.232396Z","title":"Maskclus- tering: View consensus based mask graph clustering for open-vocabulary 3d instance segmentation","venue":null,"work_id":"37b3efbc-2ac2-4b4e-8ca1-c27e70e58f50","year":2024},"citing_paper":{"arxiv_id":"2507.23134","last_updated":"2025-07-30T22:26:56Z","snapshot_observed_at":"2026-08-17T22:02:50.920534Z","submitted_at":"2025-07-30T22:26:56Z","title":"Details Matter for Indoor Open-vocabulary 3D Instance Segmentation","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-06T11:07:08.496386Z"},"links":{"citing_paper":"/paper/2507.23134"},"observation_digest":"sha256:8f77471f2fdf5c68efecee9b50ad48208e11d299fc998bc5e9afb398eebfd536","observation_id":"5deb6fa7-7414-4731-88f5-aacd5feeb240","resolution":{"observed_at":"2026-08-06T11:07:10.234787Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:07:10.225635Z","title":"Learning ob- ject bounding boxes for 3d instance segmentation on point clouds","venue":null,"work_id":"92ac0ef4-c4e6-4b8b-8718-593ab110cdd7","year":2019},"citing_paper":{"arxiv_id":"2507.23134","last_updated":"2025-07-30T22:26:56Z","snapshot_observed_at":"2026-08-17T22:02:50.920534Z","submitted_at":"2025-07-30T22:26:56Z","title":"Details Matter for Indoor Open-vocabulary 3D Instance Segmentation","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-06T11:07:08.592227Z"},"links":{"citing_paper":"/paper/2507.23134"},"observation_digest":"sha256:d2e7972679cb5143e264f00f6496a9b651047353569428fe504b2d29a5d5054f","observation_id":"c5f5bb63-1ecd-4edd-90bd-a15e71dbf927","resolution":{"observed_at":"2026-08-06T11:07:10.228148Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:07:10.218580Z","title":"Regionplc: Regional point-language contrastive learning for open-world 3d scene understanding","venue":null,"work_id":"e4e1251d-eae4-45c3-a66f-520a7efeff8b","year":2024},"citing_paper":{"arxiv_id":"2507.23134","last_updated":"2025-07-30T22:26:56Z","snapshot_observed_at":"2026-08-17T22:02:50.920534Z","submitted_at":"2025-07-30T22:26:56Z","title":"Details Matter for Indoor Open-vocabulary 3D Instance Segmentation","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-06T11:07:08.704154Z"},"links":{"citing_paper":"/paper/2507.23134"},"observation_digest":"sha256:8dfdf0d9b53e34a24da2eabdeb031a15161f817d6570e9d1f2502b06a66ad431","observation_id":"3e7d3687-b012-464d-ae5b-b1210f634bf9","resolution":{"observed_at":"2026-08-06T11:07:10.220972Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.03908","last_updated":"2023-06-06T17:59:51Z","snapshot_observed_at":"2026-08-21T09:05:29.355557Z","submitted_at":"2023-06-06T17:59:51Z","title":"SAM3D: Segment Anything in 3D Scenes","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.03908","snapshot_observed_at":"2026-08-06T11:07:08.751645Z","title":"Sam3d: Segment anything in 3d scenes.arXiv preprint arXiv:2306.03908, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.23134","last_updated":"2025-07-30T22:26:56Z","snapshot_observed_at":"2026-08-17T22:02:50.920534Z","submitted_at":"2025-07-30T22:26:56Z","title":"Details Matter for Indoor Open-vocabulary 3D Instance Segmentation","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-06T11:07:08.751645Z"},"links":{"cited_paper":"/paper/2306.03908","citing_paper":"/paper/2507.23134"},"observation_digest":"sha256:71b6fccc0054c22d35296380b18dfe80b04664c8e55161c0fe4015a3b3dc28cf","observation_id":"6fe2e905-cd2b-4a00-9e4a-a9d57d73fded","resolution":{"observed_at":"2026-08-06T11:07:08.751645Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:07:10.211771Z","title":"Detclipv2: Scalable open- vocabulary object detection pre-training via word-region alignment","venue":null,"work_id":"301e4d8f-382c-4a6c-9f25-0ecfc7ba92f4","year":2023},"citing_paper":{"arxiv_id":"2507.23134","last_updated":"2025-07-30T22:26:56Z","snapshot_observed_at":"2026-08-17T22:02:50.920534Z","submitted_at":"2025-07-30T22:26:56Z","title":"Details Matter for Indoor Open-vocabulary 3D Instance Segmentation","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-06T11:07:08.811077Z"},"links":{"citing_paper":"/paper/2507.23134"},"observation_digest":"sha256:39fdc78c003270702910f9d128bcbabf5de55b4c0f49e99dd2d03e7b70014da1","observation_id":"e1148f27-0ec3-4560-b579-cc326a11c5c6","resolution":{"observed_at":"2026-08-06T11:07:10.214173Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:07:10.205244Z","title":"Scannet++: A high-fidelity dataset of 3d indoor scenes","venue":null,"work_id":"03317991-f843-4c39-a859-ac6c08cefbc4","year":2023},"citing_paper":{"arxiv_id":"2507.23134","last_updated":"2025-07-30T22:26:56Z","snapshot_observed_at":"2026-08-17T22:02:50.920534Z","submitted_at":"2025-07-30T22:26:56Z","title":"Details Matter for Indoor Open-vocabulary 3D Instance Segmentation","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-06T11:07:08.919217Z"},"links":{"citing_paper":"/paper/2507.23134"},"observation_digest":"sha256:9e75c85541693b770422af29c229205ad818d19ac5ee2d08a934a96fb51647fa","observation_id":"ca03573a-00f8-493a-8084-80a97b9fe356","resolution":{"observed_at":"2026-08-06T11:07:10.207708Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:07:10.198105Z","title":"Gspn: Generative shape proposal network for 3d instance segmentation in point cloud","venue":null,"work_id":"03730156-7158-4783-9253-b066f138ca85","year":2019},"citing_paper":{"arxiv_id":"2507.23134","last_updated":"2025-07-30T22:26:56Z","snapshot_observed_at":"2026-08-17T22:02:50.920534Z","submitted_at":"2025-07-30T22:26:56Z","title":"Details Matter for Indoor Open-vocabulary 3D Instance Segmentation","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-06T11:07:08.973006Z"},"links":{"citing_paper":"/paper/2507.23134"},"observation_digest":"sha256:aca06d59e5f97cdbe9f767486fa0e85da18b393f27bb3b2b03cbec1cc806de34","observation_id":"be78f894-1d54-44a8-a305-f9c52ea6e1a6","resolution":{"observed_at":"2026-08-06T11:07:10.200944Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:07:10.191635Z","title":"Sai3d: Segment any in- stance in 3d scenes","venue":null,"work_id":"5c8f4016-86a0-4530-84f0-e49b3cfe4865","year":2024},"citing_paper":{"arxiv_id":"2507.23134","last_updated":"2025-07-30T22:26:56Z","snapshot_observed_at":"2026-08-17T22:02:50.920534Z","submitted_at":"2025-07-30T22:26:56Z","title":"Details Matter for Indoor Open-vocabulary 3D Instance Segmentation","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-06T11:07:09.077209Z"},"links":{"citing_paper":"/paper/2507.23134"},"observation_digest":"sha256:6cb7e23511f7e5f3547b8f874126ec5aadd41eae3e010586e0f1040dab18800c","observation_id":"f6fc8a56-a3cd-4792-9be0-5836c97000a6","resolution":{"observed_at":"2026-08-06T11:07:10.193909Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:07:09.147448Z","title":"Open-vocabulary detr with conditional matching","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.23134","last_updated":"2025-07-30T22:26:56Z","snapshot_observed_at":"2026-08-17T22:02:50.920534Z","submitted_at":"2025-07-30T22:26:56Z","title":"Details Matter for Indoor Open-vocabulary 3D Instance Segmentation","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-06T11:07:09.147448Z"},"links":{"citing_paper":"/paper/2507.23134"},"observation_digest":"sha256:deab50e603a604959d79320c81506b9cecdeb035c88f16ebe25c9d9ac6c57fce","observation_id":"9df13edf-1708-4f92-8491-7e2e4928b2af","resolution":{"observed_at":"2026-08-06T11:07:09.147448Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:07:10.130064Z","title":"Regionclip: Region- based language-image pretraining","venue":null,"work_id":"34da5908-7cd6-4814-bd05-4c300c39b0f6","year":2022},"citing_paper":{"arxiv_id":"2507.23134","last_updated":"2025-07-30T22:26:56Z","snapshot_observed_at":"2026-08-17T22:02:50.920534Z","submitted_at":"2025-07-30T22:26:56Z","title":"Details Matter for Indoor Open-vocabulary 3D Instance Segmentation","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-06T11:07:09.209014Z"},"links":{"citing_paper":"/paper/2507.23134"},"observation_digest":"sha256:3786933ae2f8dabc4b68341fa605f1f8f6b3d68792b4f161551c6fa4c532eb5e","observation_id":"9f05ae89-5f88-4337-b336-e908e3a862e1","resolution":{"observed_at":"2026-08-06T11:07:10.170497Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:07:09.951586Z","title":"Detecting twenty-thousand classes using image-level supervision","venue":null,"work_id":"75b2f6c3-d66d-4d40-bb16-2c6ad045d31c","year":2022},"citing_paper":{"arxiv_id":"2507.23134","last_updated":"2025-07-30T22:26:56Z","snapshot_observed_at":"2026-08-17T22:02:50.920534Z","submitted_at":"2025-07-30T22:26:56Z","title":"Details Matter for Indoor Open-vocabulary 3D Instance Segmentation","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-06T11:07:09.267483Z"},"links":{"citing_paper":"/paper/2507.23134"},"observation_digest":"sha256:37c70254f12d8027518576655fb7fac23489afaa22540cc49ac8a7c94819d143","observation_id":"141911a6-d1b7-46a0-9fe5-a7d291fe0488","resolution":{"observed_at":"2026-08-06T11:07:10.010995Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:07:09.857878Z","title":"a blurry photo of {CLASS NAME} in a room,","venue":null,"work_id":"c3ece0b8-37f1-4bb0-85b6-086a0d7bf55b","year":2024},"citing_paper":{"arxiv_id":"2507.23134","last_updated":"2025-07-30T22:26:56Z","snapshot_observed_at":"2026-08-17T22:02:50.920534Z","submitted_at":"2025-07-30T22:26:56Z","title":"Details Matter for Indoor Open-vocabulary 3D Instance Segmentation","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-06T11:07:09.306740Z"},"links":{"citing_paper":"/paper/2507.23134"},"observation_digest":"sha256:ebd8729aa69ebbbfaf74697d39a1e100a8bf86a7577b6efaa64312c0c613b942","observation_id":"ada82d0f-7d71-41e4-8367-6be536d6308e","resolution":{"observed_at":"2026-08-06T11:07:09.902265Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:07:09.711920Z","title":"stuff” Classes. We present re- sults that include","venue":null,"work_id":"6210950a-e413-4ade-a3c8-8c5f7045b068","year":null},"citing_paper":{"arxiv_id":"2507.23134","last_updated":"2025-07-30T22:26:56Z","snapshot_observed_at":"2026-08-17T22:02:50.920534Z","submitted_at":"2025-07-30T22:26:56Z","title":"Details Matter for Indoor Open-vocabulary 3D Instance Segmentation","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-06T11:07:09.337105Z"},"links":{"citing_paper":"/paper/2507.23134"},"observation_digest":"sha256:adf451c6f7b8eace4a790de196ac98f58d877b5a5450cfeb1c95ec4cae39e2cd","observation_id":"c52e96fc-e688-446d-a620-da2eb596cc3b","resolution":{"observed_at":"2026-08-06T11:07:09.797018Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.23134","last_updated":"2025-07-30T22:26:56Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-17T22:02:50.920534Z","submitted_at":"2025-07-30T22:26:56Z","title":"Details Matter for Indoor Open-vocabulary 3D Instance Segmentation"},"reference_resolution":{"displayed":71,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":19,"verified_exact":2,"verified_fuzzy":49},"total_outbound_references":71},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"thesis":"As of 22 August 2026, this Paper Citation Record lists 71 of 71 outbound references and 3 inbound Pith citation observations for arXiv:2507.23134."}