{"as_of":"2026-08-05T21:41:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e5aaf4d4a514f1b3cd8c25c68f70d1198efd3e4940e5b5f50f5301caa24a14c6","coverage":[{"denominator":26,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":26,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T13:28:42.407268Z","state":"measured"},{"denominator":26,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":26,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-05T06:32:48.257954+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.19115/citation-record","integrity":"/paper/2607.19115/integrity","json":"/paper/2607.19115/citation-record.json","paper":"/paper/2607.19115"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:28:39.286633Z","title":"Scanrefer: 3d object localization in rgb-d scans using natural language","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.19115","last_updated":"2026-07-21T13:59:09Z","snapshot_observed_at":"2026-08-03T05:18:30.884121Z","submitted_at":"2026-07-21T13:59:09Z","title":"CR-Refiner: An Object-Centric Optimal Transport Reranker for Edit-Conditioned 3D Scene Retrieval","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-01T13:28:39.286633Z"},"links":{"citing_paper":"/paper/2607.19115"},"observation_digest":"sha256:33e82d47737ea031e0f233dc4273ccac0062cb4eb49d429a5e893aa189c2d3a3","observation_id":"0870830a-f7cd-40de-b6bc-01e49a68ac89","resolution":{"observed_at":"2026-08-01T13:28:39.286633Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:28:39.398186Z","title":"Multi3drefer: Grounding text description to multiple 3d objects","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.19115","last_updated":"2026-07-21T13:59:09Z","snapshot_observed_at":"2026-08-03T05:18:30.884121Z","submitted_at":"2026-07-21T13:59:09Z","title":"CR-Refiner: An Object-Centric Optimal Transport Reranker for Edit-Conditioned 3D Scene Retrieval","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-01T13:28:39.398186Z"},"links":{"citing_paper":"/paper/2607.19115"},"observation_digest":"sha256:53c9bd4f8e9eec81fd6195ad6b219d10c76e8b573aa98273363b95a4965d897d","observation_id":"7617525e-6502-4e84-9f78-c5d8a203ec24","resolution":{"observed_at":"2026-08-01T13:28:39.398186Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:28:39.528280Z","title":"Image retrieval on real-life images with pre-trained vision-and-language models","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.19115","last_updated":"2026-07-21T13:59:09Z","snapshot_observed_at":"2026-08-03T05:18:30.884121Z","submitted_at":"2026-07-21T13:59:09Z","title":"CR-Refiner: An Object-Centric Optimal Transport Reranker for Edit-Conditioned 3D Scene Retrieval","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-01T13:28:39.528280Z"},"links":{"citing_paper":"/paper/2607.19115"},"observation_digest":"sha256:ef3b67303a84e072320b5f542dbc4c45b9c393e83ec94da3a88e5eacc431b0f2","observation_id":"59913f7c-1d99-49d3-a783-8603cd588000","resolution":{"observed_at":"2026-08-01T13:28:39.528280Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:28:39.675882Z","title":"Zero-shot composed image retrieval with textual inversion","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.19115","last_updated":"2026-07-21T13:59:09Z","snapshot_observed_at":"2026-08-03T05:18:30.884121Z","submitted_at":"2026-07-21T13:59:09Z","title":"CR-Refiner: An Object-Centric Optimal Transport Reranker for Edit-Conditioned 3D Scene Retrieval","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-01T13:28:39.675882Z"},"links":{"citing_paper":"/paper/2607.19115"},"observation_digest":"sha256:cc145c355be2d98791aaabc81431ac2a8cf629b8d6b74f25631ffc15863a1ebc","observation_id":"1cca4f9c-5298-47e7-8dcc-cee93cf69c06","resolution":{"observed_at":"2026-08-01T13:28:39.675882Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1812.07119","last_updated":"2018-12-18T00:57:03Z","snapshot_observed_at":"2026-07-06T07:21:48.321626Z","submitted_at":"2018-12-18T00:57:03Z","title":"Composing Text and Image for Image Retrieval - An Empirical Odyssey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1812.07119","snapshot_observed_at":"2026-08-01T13:28:39.782804Z","title":"Composing text and image for image retrieval - an empirical odyssey, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.19115","last_updated":"2026-07-21T13:59:09Z","snapshot_observed_at":"2026-08-03T05:18:30.884121Z","submitted_at":"2026-07-21T13:59:09Z","title":"CR-Refiner: An Object-Centric Optimal Transport Reranker for Edit-Conditioned 3D Scene Retrieval","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-01T13:28:39.782804Z"},"links":{"cited_paper":"/paper/1812.07119","citing_paper":"/paper/2607.19115"},"observation_digest":"sha256:bf9539272021d26d81a919140fc6b21bbc62dafab4066916fbcea728d7015efa","observation_id":"7254a2ab-5857-4fd0-8ac4-9ca21928b1f2","resolution":{"observed_at":"2026-08-01T13:28:39.782804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:28:39.918250Z","title":"Effective conditioned and composed image retrieval combining clip-based features","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.19115","last_updated":"2026-07-21T13:59:09Z","snapshot_observed_at":"2026-08-03T05:18:30.884121Z","submitted_at":"2026-07-21T13:59:09Z","title":"CR-Refiner: An Object-Centric Optimal Transport Reranker for Edit-Conditioned 3D Scene Retrieval","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-01T13:28:39.918250Z"},"links":{"citing_paper":"/paper/2607.19115"},"observation_digest":"sha256:efd2f71a1e8d5f3793a0825f3fa2fb0846a55e1c55711d01ec7ada9bd56fbe64","observation_id":"16a9d165-5614-450a-be5c-53b5dde88ea7","resolution":{"observed_at":"2026-08-01T13:28:39.918250Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.09291","last_updated":"2024-02-26T18:59:49Z","snapshot_observed_at":"2026-07-06T16:32:41.602193Z","submitted_at":"2023-10-13T17:59:38Z","title":"Vision-by-Language for Training-Free Compositional Image Retrieval","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.09291","snapshot_observed_at":"2026-08-01T13:28:40.030166Z","title":"Vision-by- language for training-free compositional image retrieval.arXiv preprint arXiv:2310.09291, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.19115","last_updated":"2026-07-21T13:59:09Z","snapshot_observed_at":"2026-08-03T05:18:30.884121Z","submitted_at":"2026-07-21T13:59:09Z","title":"CR-Refiner: An Object-Centric Optimal Transport Reranker for Edit-Conditioned 3D Scene Retrieval","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-01T13:28:40.030166Z"},"links":{"cited_paper":"/paper/2310.09291","citing_paper":"/paper/2607.19115"},"observation_digest":"sha256:a7355069628103d897d9aa1700455f40ff8e2df19733d277f36a96967d352e06","observation_id":"bbc903ec-637b-47e2-b7f3-8f0cebfa60bc","resolution":{"observed_at":"2026-08-01T13:28:40.030166Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:28:40.180474Z","title":"Pic2word: Mapping pictures to words for zero-shot composed image retrieval","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.19115","last_updated":"2026-07-21T13:59:09Z","snapshot_observed_at":"2026-08-03T05:18:30.884121Z","submitted_at":"2026-07-21T13:59:09Z","title":"CR-Refiner: An Object-Centric Optimal Transport Reranker for Edit-Conditioned 3D Scene Retrieval","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-01T13:28:40.180474Z"},"links":{"citing_paper":"/paper/2607.19115"},"observation_digest":"sha256:6ad46708b6d406f986e0eea61e83b90c37266411791feafc661c027d0675a112","observation_id":"ce7a457b-6b7c-4c74-bc47-1c9694e50564","resolution":{"observed_at":"2026-08-01T13:28:40.180474Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:28:40.307489Z","title":"Compodiff: Versatile composed image retrieval with latent diffusion, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.19115","last_updated":"2026-07-21T13:59:09Z","snapshot_observed_at":"2026-08-03T05:18:30.884121Z","submitted_at":"2026-07-21T13:59:09Z","title":"CR-Refiner: An Object-Centric Optimal Transport Reranker for Edit-Conditioned 3D Scene Retrieval","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-01T13:28:40.307489Z"},"links":{"citing_paper":"/paper/2607.19115"},"observation_digest":"sha256:2fcd073cd6f963c82037dfc63b733837accb673604acaf1976801fbc32ad6c97","observation_id":"8b9756ba-0473-4e46-8cc1-8f3e7f13d6c2","resolution":{"observed_at":"2026-08-01T13:28:40.307489Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.01998","last_updated":"2024-03-31T22:58:09Z","snapshot_observed_at":"2026-07-06T16:56:38.112343Z","submitted_at":"2023-12-04T16:22:06Z","title":"Language-only Efficient Training of Zero-shot Composed Image Retrieval","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.01998","snapshot_observed_at":"2026-08-01T13:28:40.438064Z","title":"Language-only efficient training of zero-shot composed image retrieval, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.19115","last_updated":"2026-07-21T13:59:09Z","snapshot_observed_at":"2026-08-03T05:18:30.884121Z","submitted_at":"2026-07-21T13:59:09Z","title":"CR-Refiner: An Object-Centric Optimal Transport Reranker for Edit-Conditioned 3D Scene Retrieval","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-01T13:28:40.438064Z"},"links":{"cited_paper":"/paper/2312.01998","citing_paper":"/paper/2607.19115"},"observation_digest":"sha256:d0295c236f1fded0048b611471cadff87a05fd53eff3a7366b9d32e5b3e45eed","observation_id":"91c3b21e-d9f5-4d32-b4b4-9d8fee6dfdcd","resolution":{"observed_at":"2026-08-01T13:28:40.438064Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.02413","last_updated":"2021-12-04T19:42:40Z","snapshot_observed_at":"2026-08-03T03:45:19.226751Z","submitted_at":"2021-12-04T19:42:40Z","title":"PointCLIP: Point Cloud Understanding by CLIP","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.02413","snapshot_observed_at":"2026-08-01T13:28:40.550894Z","title":"Pointclip: Point cloud understanding by clip, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.19115","last_updated":"2026-07-21T13:59:09Z","snapshot_observed_at":"2026-08-03T05:18:30.884121Z","submitted_at":"2026-07-21T13:59:09Z","title":"CR-Refiner: An Object-Centric Optimal Transport Reranker for Edit-Conditioned 3D Scene Retrieval","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-01T13:28:40.550894Z"},"links":{"cited_paper":"/paper/2112.02413","citing_paper":"/paper/2607.19115"},"observation_digest":"sha256:771c2d45b5f6225698cec1bc9e91ab5a624c84f39718753b6861eebcea42d3f0","observation_id":"47c939c2-f339-4be8-bb12-35839b2f50b7","resolution":{"observed_at":"2026-08-01T13:28:40.550894Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:28:40.684540Z","title":"Openshape: Scaling up 3d shape representation towards open-world understanding.Advances in neural information processing systems, 36:44860–44879, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.19115","last_updated":"2026-07-21T13:59:09Z","snapshot_observed_at":"2026-08-03T05:18:30.884121Z","submitted_at":"2026-07-21T13:59:09Z","title":"CR-Refiner: An Object-Centric Optimal Transport Reranker for Edit-Conditioned 3D Scene Retrieval","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-01T13:28:40.684540Z"},"links":{"citing_paper":"/paper/2607.19115"},"observation_digest":"sha256:6c23860d474b62a7b7700248d6c2d253ab1242104d08da041b47c21187c43333","observation_id":"44399a56-962c-4aab-baf2-d1eea2a84a52","resolution":{"observed_at":"2026-08-01T13:28:40.684540Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06773","last_updated":"2023-10-10T16:49:21Z","snapshot_observed_at":"2026-08-05T16:12:03.689396Z","submitted_at":"2023-10-10T16:49:21Z","title":"Uni3D: Exploring Unified 3D Representation at Scale","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06773","snapshot_observed_at":"2026-08-01T13:28:40.804760Z","title":"Uni3d: Exploring unified 3d representation at scale.arXiv preprint arXiv:2310.06773, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.19115","last_updated":"2026-07-21T13:59:09Z","snapshot_observed_at":"2026-08-03T05:18:30.884121Z","submitted_at":"2026-07-21T13:59:09Z","title":"CR-Refiner: An Object-Centric Optimal Transport Reranker for Edit-Conditioned 3D Scene Retrieval","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-01T13:28:40.804760Z"},"links":{"cited_paper":"/paper/2310.06773","citing_paper":"/paper/2607.19115"},"observation_digest":"sha256:ea14b8095601cd6bd17c08144569240b1a139fc6c01fee93ec1bf341f36360db","observation_id":"827edf0b-279a-4246-acc1-54979f537bd6","resolution":{"observed_at":"2026-08-01T13:28:40.804760Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:28:40.969347Z","title":"Ulip-2: Towards scalable multimodal pre-training for 3d understanding","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.19115","last_updated":"2026-07-21T13:59:09Z","snapshot_observed_at":"2026-08-03T05:18:30.884121Z","submitted_at":"2026-07-21T13:59:09Z","title":"CR-Refiner: An Object-Centric Optimal Transport Reranker for Edit-Conditioned 3D Scene Retrieval","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-01T13:28:40.969347Z"},"links":{"citing_paper":"/paper/2607.19115"},"observation_digest":"sha256:78bc43bab3b44a593af19a6d15bfc2ea8c1c7f86e490778517a2986a9214e5ef","observation_id":"2f27b992-a45f-4ce0-b2e8-28f684b727e4","resolution":{"observed_at":"2026-08-01T13:28:40.969347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.04352","last_updated":"2023-08-08T15:59:17Z","snapshot_observed_at":"2026-07-06T16:03:58.984997Z","submitted_at":"2023-08-08T15:59:17Z","title":"3D-VisTA: Pre-trained Transformer for 3D Vision and Text Alignment","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.04352","snapshot_observed_at":"2026-08-01T13:28:41.116997Z","title":"3d-vista: Pre-trained transformer for 3d vision and text alignment, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.19115","last_updated":"2026-07-21T13:59:09Z","snapshot_observed_at":"2026-08-03T05:18:30.884121Z","submitted_at":"2026-07-21T13:59:09Z","title":"CR-Refiner: An Object-Centric Optimal Transport Reranker for Edit-Conditioned 3D Scene Retrieval","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-01T13:28:41.116997Z"},"links":{"cited_paper":"/paper/2308.04352","citing_paper":"/paper/2607.19115"},"observation_digest":"sha256:bab5da228f781459ee3e4b63f1b0aec0b78b81b9f4743f4c424e33b4de326ba7","observation_id":"d7e7e5be-d45e-46a3-8b8c-08614967c8ad","resolution":{"observed_at":"2026-08-01T13:28:41.116997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.12981","last_updated":"2023-07-24T17:59:02Z","snapshot_observed_at":"2026-08-03T03:13:48.042761Z","submitted_at":"2023-07-24T17:59:02Z","title":"3D-LLM: Injecting the 3D World into Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.12981","snapshot_observed_at":"2026-08-01T13:28:41.240174Z","title":"3d-llm: Injecting the 3d world into large language models, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.19115","last_updated":"2026-07-21T13:59:09Z","snapshot_observed_at":"2026-08-03T05:18:30.884121Z","submitted_at":"2026-07-21T13:59:09Z","title":"CR-Refiner: An Object-Centric Optimal Transport Reranker for Edit-Conditioned 3D Scene Retrieval","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-01T13:28:41.240174Z"},"links":{"cited_paper":"/paper/2307.12981","citing_paper":"/paper/2607.19115"},"observation_digest":"sha256:5d0d69db05bf33c918f5bb0a7469b1c94cf55fbabd726caa1691961cbfd91cc1","observation_id":"a8a3588e-322f-449d-81cb-443cfa3d2159","resolution":{"observed_at":"2026-08-01T13:28:41.240174Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.16911","last_updated":"2024-09-06T22:45:43Z","snapshot_observed_at":"2026-07-06T16:12:55.132006Z","submitted_at":"2023-08-31T17:59:46Z","title":"PointLLM: Empowering Large Language Models to Understand Point Clouds","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.16911","snapshot_observed_at":"2026-08-01T13:28:41.335244Z","title":"Pointllm: Empowering large language models to understand point clouds, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.19115","last_updated":"2026-07-21T13:59:09Z","snapshot_observed_at":"2026-08-03T05:18:30.884121Z","submitted_at":"2026-07-21T13:59:09Z","title":"CR-Refiner: An Object-Centric Optimal Transport Reranker for Edit-Conditioned 3D Scene Retrieval","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-01T13:28:41.335244Z"},"links":{"cited_paper":"/paper/2308.16911","citing_paper":"/paper/2607.19115"},"observation_digest":"sha256:679f173185041d72cf97a7f9ae0c3ff6957289359c45888ee2a13bd04b1f7d01","observation_id":"8d5cbfb9-d64d-4d45-8f92-dad97c174035","resolution":{"observed_at":"2026-08-01T13:28:41.335244Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.00469","last_updated":"2024-07-12T09:00:03Z","snapshot_observed_at":"2026-07-06T17:53:31.221833Z","submitted_at":"2024-03-30T20:25:16Z","title":"SceneGraphLoc: Cross-Modal Coarse Visual Localization on 3D Scene Graphs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.00469","snapshot_observed_at":"2026-08-01T13:28:41.481839Z","title":"Scenegraphloc: Cross-modal coarse visual localization on 3d scene graphs, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.19115","last_updated":"2026-07-21T13:59:09Z","snapshot_observed_at":"2026-08-03T05:18:30.884121Z","submitted_at":"2026-07-21T13:59:09Z","title":"CR-Refiner: An Object-Centric Optimal Transport Reranker for Edit-Conditioned 3D Scene Retrieval","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-01T13:28:41.481839Z"},"links":{"cited_paper":"/paper/2404.00469","citing_paper":"/paper/2607.19115"},"observation_digest":"sha256:e2a3f2e7e42e3d4deb2fc20bd1c9943cb87b72b5c2aa9be088760e90275c7c84","observation_id":"7efccbba-2d19-40f6-9947-1cc66cdec931","resolution":{"observed_at":"2026-08-01T13:28:41.481839Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:28:41.598350Z","title":"Referit3d: Neural listeners for fine-grained 3d object identification in real-world scenes","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.19115","last_updated":"2026-07-21T13:59:09Z","snapshot_observed_at":"2026-08-03T05:18:30.884121Z","submitted_at":"2026-07-21T13:59:09Z","title":"CR-Refiner: An Object-Centric Optimal Transport Reranker for Edit-Conditioned 3D Scene Retrieval","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-01T13:28:41.598350Z"},"links":{"citing_paper":"/paper/2607.19115"},"observation_digest":"sha256:b038a611df1503b993cdcf9ca88b7dcd155a5fdf1f639e9aaa18685ae35f3641","observation_id":"addb6ed4-e83c-4ecc-a596-0d4ffe757260","resolution":{"observed_at":"2026-08-01T13:28:41.598350Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:28:41.696371Z","title":"Scanqa: 3d question answering for spatial scene understanding, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.19115","last_updated":"2026-07-21T13:59:09Z","snapshot_observed_at":"2026-08-03T05:18:30.884121Z","submitted_at":"2026-07-21T13:59:09Z","title":"CR-Refiner: An Object-Centric Optimal Transport Reranker for Edit-Conditioned 3D Scene Retrieval","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-01T13:28:41.696371Z"},"links":{"citing_paper":"/paper/2607.19115"},"observation_digest":"sha256:aaaa3db9a47ca7e3344ab4cf4d0f2f6ee869a69aec261350e8c8fb90982e2b69","observation_id":"28bc1e2e-7037-4e1c-bb04-e7e2851c6c7f","resolution":{"observed_at":"2026-08-01T13:28:41.696371Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:28:41.808263Z","title":"Sceneverse: Scaling 3d vision-language learning for grounded scene understanding","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.19115","last_updated":"2026-07-21T13:59:09Z","snapshot_observed_at":"2026-08-03T05:18:30.884121Z","submitted_at":"2026-07-21T13:59:09Z","title":"CR-Refiner: An Object-Centric Optimal Transport Reranker for Edit-Conditioned 3D Scene Retrieval","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-01T13:28:41.808263Z"},"links":{"citing_paper":"/paper/2607.19115"},"observation_digest":"sha256:8dc21cb68ea504c47dbeb180fef0f4b51c37dee30f29bc5a2e97cfd6db72b3c2","observation_id":"f1099b5a-e6ea-4ba9-a303-c352bf1441e3","resolution":{"observed_at":"2026-08-01T13:28:41.808263Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:28:41.899560Z","title":"Shapetalk: A language dataset and framework for 3d shape edits and deformations","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.19115","last_updated":"2026-07-21T13:59:09Z","snapshot_observed_at":"2026-08-03T05:18:30.884121Z","submitted_at":"2026-07-21T13:59:09Z","title":"CR-Refiner: An Object-Centric Optimal Transport Reranker for Edit-Conditioned 3D Scene Retrieval","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-01T13:28:41.899560Z"},"links":{"citing_paper":"/paper/2607.19115"},"observation_digest":"sha256:992eaa1a9ac4b8af9428a6443cb1371a0019ec0bab03332d46ed2d9d85794914","observation_id":"8441237e-ef62-4668-a223-6e209038fd8b","resolution":{"observed_at":"2026-08-01T13:28:41.899560Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.14207","last_updated":"2024-03-12T15:40:08Z","snapshot_observed_at":"2026-07-06T15:07:45.408464Z","submitted_at":"2023-03-24T18:00:15Z","title":"DiffuScene: Denoising Diffusion Models for Generative Indoor Scene Synthesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.14207","snapshot_observed_at":"2026-08-01T13:28:42.012546Z","title":"Diffuscene: Denoising diffusion models for generative indoor scene synthesis, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.19115","last_updated":"2026-07-21T13:59:09Z","snapshot_observed_at":"2026-08-03T05:18:30.884121Z","submitted_at":"2026-07-21T13:59:09Z","title":"CR-Refiner: An Object-Centric Optimal Transport Reranker for Edit-Conditioned 3D Scene Retrieval","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-01T13:28:42.012546Z"},"links":{"cited_paper":"/paper/2303.14207","citing_paper":"/paper/2607.19115"},"observation_digest":"sha256:dbd3da9dbe051d1e0a43cd8973b7deafb34376399199a00e73593edbcfd8dd3f","observation_id":"1b18aabd-8815-45e8-9619-2e5a6d2b21ed","resolution":{"observed_at":"2026-08-01T13:28:42.012546Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04717","last_updated":"2024-02-07T10:09:00Z","snapshot_observed_at":"2026-08-04T09:43:53.639294Z","submitted_at":"2024-02-07T10:09:00Z","title":"InstructScene: Instruction-Driven 3D Indoor Scene Synthesis with Semantic Graph Prior","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04717","snapshot_observed_at":"2026-08-01T13:28:42.153220Z","title":"Instructscene: Instruction-driven 3d indoor scene synthesis with semantic graph prior, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.19115","last_updated":"2026-07-21T13:59:09Z","snapshot_observed_at":"2026-08-03T05:18:30.884121Z","submitted_at":"2026-07-21T13:59:09Z","title":"CR-Refiner: An Object-Centric Optimal Transport Reranker for Edit-Conditioned 3D Scene Retrieval","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-01T13:28:42.153220Z"},"links":{"cited_paper":"/paper/2402.04717","citing_paper":"/paper/2607.19115"},"observation_digest":"sha256:bfe95140d89cde47f1195af8831223980656df017ef13d64b5347bc9ab71a2ff","observation_id":"9b561c93-6303-40a3-b87d-a6f9383e3b56","resolution":{"observed_at":"2026-08-01T13:28:42.153220Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.12836","last_updated":"2025-04-01T23:38:07Z","snapshot_observed_at":"2026-08-05T00:28:51.279803Z","submitted_at":"2024-10-03T17:42:24Z","title":"EditRoom: LLM-parameterized Graph Diffusion for Composable 3D Room Layout Editing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.12836","snapshot_observed_at":"2026-08-01T13:28:42.290808Z","title":"Editroom: Llm-parameterized graph diffusion for composable 3d room layout editing, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19115","last_updated":"2026-07-21T13:59:09Z","snapshot_observed_at":"2026-08-03T05:18:30.884121Z","submitted_at":"2026-07-21T13:59:09Z","title":"CR-Refiner: An Object-Centric Optimal Transport Reranker for Edit-Conditioned 3D Scene Retrieval","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-01T13:28:42.290808Z"},"links":{"cited_paper":"/paper/2410.12836","citing_paper":"/paper/2607.19115"},"observation_digest":"sha256:b6b459774a9cf9819b44ea89bf03f4531e9925de00e7215aa00e324ec7a8a7e1","observation_id":"742f1192-4473-402d-922f-36058ee7ea7f","resolution":{"observed_at":"2026-08-01T13:28:42.290808Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:28:42.407268Z","title":"in roughly the same layout","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.19115","last_updated":"2026-07-21T13:59:09Z","snapshot_observed_at":"2026-08-03T05:18:30.884121Z","submitted_at":"2026-07-21T13:59:09Z","title":"CR-Refiner: An Object-Centric Optimal Transport Reranker for Edit-Conditioned 3D Scene Retrieval","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-01T13:28:42.407268Z"},"links":{"citing_paper":"/paper/2607.19115"},"observation_digest":"sha256:d04f7c4e2b740b80f6e09960b833a5b02753e6b7f3d5fa6bb56025b0d92745db","observation_id":"61ead812-5d1c-44d6-8afe-c0cf88181cde","resolution":{"observed_at":"2026-08-01T13:28:42.407268Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.19115","last_updated":"2026-07-21T13:59:09Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-03T05:18:30.884121Z","submitted_at":"2026-07-21T13:59:09Z","title":"CR-Refiner: An Object-Centric Optimal Transport Reranker for Edit-Conditioned 3D Scene Retrieval"},"reference_resolution":{"displayed":26,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":25,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":26},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"thesis":"As of 5 August 2026, this Paper Citation Record lists 26 of 26 outbound references and 0 inbound Pith citation observations for arXiv:2607.19115."}