{"as_of":"2026-08-04T07:10:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9391c10e3c8f9a6acf3cf8c5f8b44cc7ae59c45368e34a6eb083a80e5e292d9f","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":26,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":26,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-04T06:34:03.388597+00:00","state":"measured"},{"denominator":26,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":26,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T12:50:01.034749Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T03:09:29.321784Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2309.00615","last_updated":"2023-09-01T17:59:47Z","snapshot_observed_at":"2026-07-06T16:13:23.343694Z","submitted_at":"2023-09-01T17:59:47Z","title":"Point-Bind & Point-LLM: Aligning Point Cloud with Multi-modality for 3D Understanding, Generation, and Instruction Following","version":1},"cited_work":{"arxiv_id":"2309.00615","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2309.00615","snapshot_observed_at":"2026-07-04T03:09:29.321784Z","title":"Point-bind & point-llm: Aligning point cloud with multi-modality for 3d understanding, generation, and instruction following","venue":null,"work_id":"99ba2617-dd10-4f2d-bb63-cc88e743aa78","year":2023},"citing_paper":{"arxiv_id":"2303.16199","last_updated":"2024-09-18T23:54:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-03-28T17:59:12Z","title":"LLaMA-Adapter: Efficient Fine-tuning of Language Models with Zero-init Attention","version":3},"reference_index":109,"source":"arxiv_source","source_observed_at":"2026-05-14T23:07:42.245641Z"},"links":{"cited_paper":"/paper/2309.00615","citing_paper":"/paper/2303.16199"},"observation_digest":"sha256:6b88ff53478b0908118145eb5544f5c25925641c325aafac005b82dac45e3d43","observation_id":"c7239216-2861-4a65-ace9-fbe23b8d32f4","resolution":{"observed_at":"2026-05-14T23:07:42.622601Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.00615","last_updated":"2023-09-01T17:59:47Z","snapshot_observed_at":"2026-07-06T16:13:23.343694Z","submitted_at":"2023-09-01T17:59:47Z","title":"Point-Bind & Point-LLM: Aligning Point Cloud with Multi-modality for 3D Understanding, Generation, and Instruction Following","version":1},"cited_work":{"arxiv_id":"2309.00615","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2309.00615","snapshot_observed_at":"2026-07-04T03:09:29.321784Z","title":"Point-bind & point-llm: Aligning point cloud with multi-modality for 3d understanding, generation, and instruction following","venue":null,"work_id":"99ba2617-dd10-4f2d-bb63-cc88e743aa78","year":2023},"citing_paper":{"arxiv_id":"2311.07575","last_updated":"2023-11-13T18:59:47Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-11-13T18:59:47Z","title":"SPHINX: The Joint Mixing of Weights, Tasks, and Visual Embeddings for Multi-modal Large Language Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-17T03:03:26.723464Z"},"links":{"cited_paper":"/paper/2309.00615","citing_paper":"/paper/2311.07575"},"observation_digest":"sha256:ccd66eb2b784e22d9810e4f5eb3ca27e6ff0af10c8629a56945c819fdffe59e6","observation_id":"2b2ea280-db75-4de4-bd15-237819b722e0","resolution":{"observed_at":"2026-05-17T03:03:26.883172Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.00615","last_updated":"2023-09-01T17:59:47Z","snapshot_observed_at":"2026-07-06T16:13:23.343694Z","submitted_at":"2023-09-01T17:59:47Z","title":"Point-Bind & Point-LLM: Aligning Point Cloud with Multi-modality for 3D Understanding, Generation, and Instruction Following","version":1},"cited_work":{"arxiv_id":"2309.00615","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2309.00615","snapshot_observed_at":"2026-07-04T03:09:29.321784Z","title":"Point-bind & point-llm: Aligning point cloud with multi-modality for 3d understanding, generation, and instruction following","venue":null,"work_id":"99ba2617-dd10-4f2d-bb63-cc88e743aa78","year":2023},"citing_paper":{"arxiv_id":"2403.14624","last_updated":"2024-08-18T08:10:16Z","snapshot_observed_at":"2026-08-04T04:40:00.850270Z","submitted_at":"2024-03-21T17:59:50Z","title":"MathVerse: Does Your Multi-modal LLM Truly See the Diagrams in Visual Math Problems?","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-17T01:29:30.032408Z"},"links":{"cited_paper":"/paper/2309.00615","citing_paper":"/paper/2403.14624"},"observation_digest":"sha256:f022877e28ce584a7c79e561778ad9324997fab1e650bddae532211a8a3421bc","observation_id":"63e58c97-9553-4247-933f-e64629c117d9","resolution":{"observed_at":"2026-05-17T01:29:30.121405Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.00615","last_updated":"2023-09-01T17:59:47Z","snapshot_observed_at":"2026-07-06T16:13:23.343694Z","submitted_at":"2023-09-01T17:59:47Z","title":"Point-Bind & Point-LLM: Aligning Point Cloud with Multi-modality for 3D Understanding, Generation, and Instruction Following","version":1},"cited_work":{"arxiv_id":"2309.00615","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2309.00615","snapshot_observed_at":"2026-07-04T03:09:29.321784Z","title":"Point-bind & point-llm: Aligning point cloud with multi-modality for 3d understanding, generation, and instruction following","venue":null,"work_id":"99ba2617-dd10-4f2d-bb63-cc88e743aa78","year":2023},"citing_paper":{"arxiv_id":"2407.07895","last_updated":"2024-07-28T19:58:08Z","snapshot_observed_at":"2026-07-06T18:44:24.873040Z","submitted_at":"2024-07-10T17:59:43Z","title":"LLaVA-NeXT-Interleave: Tackling Multi-image, Video, and 3D in Large Multimodal Models","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-11T06:01:53.730356Z"},"links":{"cited_paper":"/paper/2309.00615","citing_paper":"/paper/2407.07895"},"observation_digest":"sha256:8660aa14a5f57f423b03ee9afc650801ebc404e610283c62efb5eb8d889027c5","observation_id":"080577c8-4f50-4d7f-a6ab-4f3b2ac2b91e","resolution":{"observed_at":"2026-05-11T06:01:54.075378Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.00615","last_updated":"2023-09-01T17:59:47Z","snapshot_observed_at":"2026-07-06T16:13:23.343694Z","submitted_at":"2023-09-01T17:59:47Z","title":"Point-Bind & Point-LLM: Aligning Point Cloud with Multi-modality for 3D Understanding, Generation, and Instruction Following","version":1},"cited_work":{"arxiv_id":"2309.00615","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2309.00615","snapshot_observed_at":"2026-07-04T03:09:29.321784Z","title":"Point-bind & point-llm: Aligning point cloud with multi-modality for 3d understanding, generation, and instruction following","venue":null,"work_id":"99ba2617-dd10-4f2d-bb63-cc88e743aa78","year":2023},"citing_paper":{"arxiv_id":"2408.03326","last_updated":"2024-10-26T16:35:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-06T17:59:44Z","title":"LLaVA-OneVision: Easy Visual Task Transfer","version":3},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-10T14:23:49.412830Z"},"links":{"cited_paper":"/paper/2309.00615","citing_paper":"/paper/2408.03326"},"observation_digest":"sha256:700cc593168abb757dc75685337fdc63c9e239b2dd307930aec93a5787bc9d01","observation_id":"ee4d18be-d8a8-4d3a-8433-57f5ae56d34d","resolution":{"observed_at":"2026-05-10T14:23:49.552473Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.00615","last_updated":"2023-09-01T17:59:47Z","snapshot_observed_at":"2026-07-06T16:13:23.343694Z","submitted_at":"2023-09-01T17:59:47Z","title":"Point-Bind & Point-LLM: Aligning Point Cloud with Multi-modality for 3D Understanding, Generation, and Instruction Following","version":1},"cited_work":{"arxiv_id":"2309.00615","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2309.00615","snapshot_observed_at":"2026-07-04T03:09:29.321784Z","title":"Point-bind & point-llm: Aligning point cloud with multi-modality for 3d understanding, generation, and instruction following","venue":null,"work_id":"99ba2617-dd10-4f2d-bb63-cc88e743aa78","year":2023},"citing_paper":{"arxiv_id":"2410.14702","last_updated":"2026-05-10T19:30:43Z","snapshot_observed_at":"2026-07-06T19:36:10.759412Z","submitted_at":"2024-10-06T20:35:41Z","title":"Polymath: A Challenging Multi-modal Mathematical Reasoning Benchmark","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-23T20:03:38.336841Z"},"links":{"cited_paper":"/paper/2309.00615","citing_paper":"/paper/2410.14702"},"observation_digest":"sha256:1cf876af732ad1e99128f34c25ccd83a537fd5a4ff8fbc555c500be42591f90b","observation_id":"6b4cb0ed-a327-4aff-827a-e27a4f09a8dc","resolution":{"observed_at":"2026-05-23T20:05:47.810561Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.00615","last_updated":"2023-09-01T17:59:47Z","snapshot_observed_at":"2026-07-06T16:13:23.343694Z","submitted_at":"2023-09-01T17:59:47Z","title":"Point-Bind & Point-LLM: Aligning Point Cloud with Multi-modality for 3D Understanding, Generation, and Instruction Following","version":1},"cited_work":{"arxiv_id":"2309.00615","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2309.00615","snapshot_observed_at":"2026-07-04T03:09:29.321784Z","title":"Point-bind & point-llm: Aligning point cloud with multi-modality for 3d understanding, generation, and instruction following","venue":null,"work_id":"99ba2617-dd10-4f2d-bb63-cc88e743aa78","year":2023},"citing_paper":{"arxiv_id":"2505.17674","last_updated":"2026-05-17T03:39:20Z","snapshot_observed_at":"2026-08-02T11:55:09.826478Z","submitted_at":"2025-05-23T09:41:10Z","title":"SVL: Spike-based Vision-language Pretraining for Efficient 3D Open-world Understanding","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-05-22T02:12:29.058875Z"},"links":{"cited_paper":"/paper/2309.00615","citing_paper":"/paper/2505.17674"},"observation_digest":"sha256:5fe9e41aa30b94f4e162973177ccc01e3d8fc8e6b83873488066f63b9fb2e778","observation_id":"fb9951c6-01da-41c6-b870-43e634eac887","resolution":{"observed_at":"2026-05-22T02:14:31.402477Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.00615","last_updated":"2023-09-01T17:59:47Z","snapshot_observed_at":"2026-07-06T16:13:23.343694Z","submitted_at":"2023-09-01T17:59:47Z","title":"Point-Bind & Point-LLM: Aligning Point Cloud with Multi-modality for 3D Understanding, Generation, and Instruction Following","version":1},"cited_work":{"arxiv_id":"2309.00615","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2309.00615","snapshot_observed_at":"2026-07-04T03:09:29.321784Z","title":"Point-bind & point-llm: Aligning point cloud with multi-modality for 3d understanding, generation, and instruction following","venue":null,"work_id":"99ba2617-dd10-4f2d-bb63-cc88e743aa78","year":2023},"citing_paper":{"arxiv_id":"2511.12034","last_updated":"2026-05-12T07:28:48Z","snapshot_observed_at":"2026-08-02T17:34:14.031307Z","submitted_at":"2025-11-15T05:01:43Z","title":"Calibrated Multimodal Representation Learning with Missing Modalities","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-17T22:08:07.217659Z"},"links":{"cited_paper":"/paper/2309.00615","citing_paper":"/paper/2511.12034"},"observation_digest":"sha256:1748a4c78576f3f95675a7c2d3b6e78444591cdbb0f31cf9658a34554ed89d87","observation_id":"84f5614f-93ca-4b8c-8136-58b77355c6a4","resolution":{"observed_at":"2026-05-17T22:10:22.660828Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.00615","last_updated":"2023-09-01T17:59:47Z","snapshot_observed_at":"2026-07-06T16:13:23.343694Z","submitted_at":"2023-09-01T17:59:47Z","title":"Point-Bind & Point-LLM: Aligning Point Cloud with Multi-modality for 3D Understanding, Generation, and Instruction Following","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.00615","snapshot_observed_at":"2026-08-03T12:50:01.034749Z","title":"Point-bind & point- llm: Aligning point cloud with multi-modality for 3d under- standing, generation, and instruction following.arXiv preprint arXiv:2309.00615,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2601.01456","last_updated":"2026-05-29T09:27:43Z","snapshot_observed_at":"2026-08-03T12:49:59.506715Z","submitted_at":"2026-01-04T09:53:49Z","title":"Rethinking Multimodal Few-Shot 3D Point Cloud Segmentation: From Fused Refinement to Decoupled Arbitration","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-03T12:50:01.034749Z"},"links":{"cited_paper":"/paper/2309.00615","citing_paper":"/paper/2601.01456"},"observation_digest":"sha256:16c42a4fc13303b451f8191b301f90921df68603db095ca77448bf1eaaf267fa","observation_id":"e61121aa-809c-44e4-a755-e5b43e9b7d83","resolution":{"observed_at":"2026-08-03T12:50:01.034749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.00615","last_updated":"2023-09-01T17:59:47Z","snapshot_observed_at":"2026-07-06T16:13:23.343694Z","submitted_at":"2023-09-01T17:59:47Z","title":"Point-Bind & Point-LLM: Aligning Point Cloud with Multi-modality for 3D Understanding, Generation, and Instruction Following","version":1},"cited_work":{"arxiv_id":"2309.00615","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2309.00615","snapshot_observed_at":"2026-07-04T03:09:29.321784Z","title":"Point-bind & point-llm: Aligning point cloud with multi-modality for 3d understanding, generation, and instruction following","venue":null,"work_id":"99ba2617-dd10-4f2d-bb63-cc88e743aa78","year":2023},"citing_paper":{"arxiv_id":"2603.10963","last_updated":"2026-03-11T16:50:46Z","snapshot_observed_at":"2026-07-06T22:48:44.253503Z","submitted_at":"2026-03-11T16:50:46Z","title":"Pointy - A Lightweight Transformer for Point Cloud Foundation Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-15T13:28:23.934522Z"},"links":{"cited_paper":"/paper/2309.00615","citing_paper":"/paper/2603.10963"},"observation_digest":"sha256:48211d0a17062ab68fcdd6d6bb3f563d4318506e1ee939b5b07045d7cbeb2132","observation_id":"26024ed0-c9be-4d31-be8a-7c3e922ab0e1","resolution":{"observed_at":"2026-05-15T13:30:01.609235Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.00615","last_updated":"2023-09-01T17:59:47Z","snapshot_observed_at":"2026-07-06T16:13:23.343694Z","submitted_at":"2023-09-01T17:59:47Z","title":"Point-Bind & Point-LLM: Aligning Point Cloud with Multi-modality for 3D Understanding, Generation, and Instruction Following","version":1},"cited_work":{"arxiv_id":"2309.00615","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2309.00615","snapshot_observed_at":"2026-07-04T03:09:29.321784Z","title":"Point-bind & point-llm: Aligning point cloud with multi-modality for 3d understanding, generation, and instruction following","venue":null,"work_id":"99ba2617-dd10-4f2d-bb63-cc88e743aa78","year":2023},"citing_paper":{"arxiv_id":"2603.17980","last_updated":"2026-05-07T05:29:31Z","snapshot_observed_at":"2026-07-06T22:49:37.944352Z","submitted_at":"2026-03-18T17:42:49Z","title":"Feeling the Space: Egomotion-Aware Video Representation for Efficient and Accurate 3D Scene Understanding","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-15T09:30:03.668178Z"},"links":{"cited_paper":"/paper/2309.00615","citing_paper":"/paper/2603.17980"},"observation_digest":"sha256:732ca08a597f8b6ab46d016aa7f80c618860a0d69d1eafcd5d54ac71ccdb1d64","observation_id":"860ced58-9fcd-4dd9-a5c6-08df71a734a3","resolution":{"observed_at":"2026-05-15T09:30:22.462415Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.00615","last_updated":"2023-09-01T17:59:47Z","snapshot_observed_at":"2026-07-06T16:13:23.343694Z","submitted_at":"2023-09-01T17:59:47Z","title":"Point-Bind & Point-LLM: Aligning Point Cloud with Multi-modality for 3D Understanding, Generation, and Instruction Following","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.00615","snapshot_observed_at":"2026-08-02T17:54:04.904102Z","title":"arXiv preprint arXiv:2309.00615 (2023) 2, 4","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.19235","last_updated":"2026-07-17T06:42:00Z","snapshot_observed_at":"2026-08-02T17:54:03.255042Z","submitted_at":"2026-03-19T17:59:58Z","title":"Generation Models Know Space: Unleashing Implicit 3D Priors for Scene Understanding","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-02T17:54:04.904102Z"},"links":{"cited_paper":"/paper/2309.00615","citing_paper":"/paper/2603.19235"},"observation_digest":"sha256:80fbd52f81e1c4a47f324f62a541b6eb2836ce75dbc04cfbf39663feaf87ebed","observation_id":"fc0d30ca-9ace-47ee-aae3-8a25e85ce2a6","resolution":{"observed_at":"2026-08-02T17:54:04.904102Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.00615","last_updated":"2023-09-01T17:59:47Z","snapshot_observed_at":"2026-07-06T16:13:23.343694Z","submitted_at":"2023-09-01T17:59:47Z","title":"Point-Bind & Point-LLM: Aligning Point Cloud with Multi-modality for 3D Understanding, Generation, and Instruction Following","version":1},"cited_work":{"arxiv_id":"2309.00615","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2309.00615","snapshot_observed_at":"2026-07-04T03:09:29.321784Z","title":"Point-bind & point-llm: Aligning point cloud with multi-modality for 3d understanding, generation, and instruction following","venue":null,"work_id":"99ba2617-dd10-4f2d-bb63-cc88e743aa78","year":2023},"citing_paper":{"arxiv_id":"2603.27507","last_updated":"2026-04-26T20:14:44Z","snapshot_observed_at":"2026-07-06T22:50:55.897076Z","submitted_at":"2026-03-29T04:16:04Z","title":"Chat-Scene++: Exploiting Context-Rich Object Identification for 3D LLM","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-14T21:31:00.764078Z"},"links":{"cited_paper":"/paper/2309.00615","citing_paper":"/paper/2603.27507"},"observation_digest":"sha256:a81027fa8b6bc4b92c3175f4f9282f6d3cf6d992e125cba8759e970f24800b38","observation_id":"2a95df81-557a-4628-91a3-784c68deacc3","resolution":{"observed_at":"2026-05-14T21:32:59.409437Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.00615","last_updated":"2023-09-01T17:59:47Z","snapshot_observed_at":"2026-07-06T16:13:23.343694Z","submitted_at":"2023-09-01T17:59:47Z","title":"Point-Bind & Point-LLM: Aligning Point Cloud with Multi-modality for 3D Understanding, Generation, and Instruction Following","version":1},"cited_work":{"arxiv_id":"2309.00615","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2309.00615","snapshot_observed_at":"2026-07-04T03:09:29.321784Z","title":"Point-bind & point-llm: Aligning point cloud with multi-modality for 3d understanding, generation, and instruction following","venue":null,"work_id":"99ba2617-dd10-4f2d-bb63-cc88e743aa78","year":2023},"citing_paper":{"arxiv_id":"2604.02546","last_updated":"2026-07-02T01:57:06Z","snapshot_observed_at":"2026-08-02T20:00:32.514238Z","submitted_at":"2026-04-02T21:54:43Z","title":"RGB-Pointmap Pretraining for Unified 3D Scene Understanding","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-13T21:19:49.421653Z"},"links":{"cited_paper":"/paper/2309.00615","citing_paper":"/paper/2604.02546"},"observation_digest":"sha256:9a22debac57f1ad80c47845ffef95a072c5ec242c6e67652f8bf6630943d34da","observation_id":"5ec2897e-d7c3-4518-a28f-f3a1f3b05512","resolution":{"observed_at":"2026-05-13T21:23:17.900121Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.00615","last_updated":"2023-09-01T17:59:47Z","snapshot_observed_at":"2026-07-06T16:13:23.343694Z","submitted_at":"2023-09-01T17:59:47Z","title":"Point-Bind & Point-LLM: Aligning Point Cloud with Multi-modality for 3D Understanding, Generation, and Instruction Following","version":1},"cited_work":{"arxiv_id":"2309.00615","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2309.00615","snapshot_observed_at":"2026-07-04T03:09:29.321784Z","title":"Point-bind & point-llm: Aligning point cloud with multi-modality for 3d understanding, generation, and instruction following","venue":null,"work_id":"99ba2617-dd10-4f2d-bb63-cc88e743aa78","year":2023},"citing_paper":{"arxiv_id":"2604.02689","last_updated":"2026-04-03T03:32:55Z","snapshot_observed_at":"2026-07-06T22:52:02.162758Z","submitted_at":"2026-04-03T03:32:55Z","title":"Efficient3D: A Unified Framework for Adaptive and Debiased Token Reduction in 3D MLLMs","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-13T19:45:33.950587Z"},"links":{"cited_paper":"/paper/2309.00615","citing_paper":"/paper/2604.02689"},"observation_digest":"sha256:f8e4cb446bd9b6891db3b393d082122d3de11d2f00990f724091271f46095fa0","observation_id":"8ad60e09-435a-4793-aa0d-2884ed868abf","resolution":{"observed_at":"2026-05-13T19:48:11.404582Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.00615","last_updated":"2023-09-01T17:59:47Z","snapshot_observed_at":"2026-07-06T16:13:23.343694Z","submitted_at":"2023-09-01T17:59:47Z","title":"Point-Bind & Point-LLM: Aligning Point Cloud with Multi-modality for 3D Understanding, Generation, and Instruction Following","version":1},"cited_work":{"arxiv_id":"2309.00615","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2309.00615","snapshot_observed_at":"2026-07-04T03:09:29.321784Z","title":"Point-bind & point-llm: Aligning point cloud with multi-modality for 3d understanding, generation, and instruction following","venue":null,"work_id":"99ba2617-dd10-4f2d-bb63-cc88e743aa78","year":2023},"citing_paper":{"arxiv_id":"2604.07763","last_updated":"2026-04-09T03:35:21Z","snapshot_observed_at":"2026-07-06T22:57:00.904627Z","submitted_at":"2026-04-09T03:35:21Z","title":"Beyond Surface Artifacts: Capturing Shared Latent Forgery Knowledge Across Modalities","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-10T18:06:06.896112Z"},"links":{"cited_paper":"/paper/2309.00615","citing_paper":"/paper/2604.07763"},"observation_digest":"sha256:9c3c8a47b770cd3f0185b46db0a4c19441c4cbf0e4ca5ee7019171b3d41ecdc5","observation_id":"bb3797ac-0573-40bb-893f-d23c12f67e7d","resolution":{"observed_at":"2026-05-11T05:30:59.344899Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.00615","last_updated":"2023-09-01T17:59:47Z","snapshot_observed_at":"2026-07-06T16:13:23.343694Z","submitted_at":"2023-09-01T17:59:47Z","title":"Point-Bind & Point-LLM: Aligning Point Cloud with Multi-modality for 3D Understanding, Generation, and Instruction Following","version":1},"cited_work":{"arxiv_id":"2309.00615","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2309.00615","snapshot_observed_at":"2026-07-04T03:09:29.321784Z","title":"Point-bind & point-llm: Aligning point cloud with multi-modality for 3d understanding, generation, and instruction following","venue":null,"work_id":"99ba2617-dd10-4f2d-bb63-cc88e743aa78","year":2023},"citing_paper":{"arxiv_id":"2604.21160","last_updated":"2026-04-23T00:01:40Z","snapshot_observed_at":"2026-08-03T02:31:06.414610Z","submitted_at":"2026-04-23T00:01:40Z","title":"Reinforcing 3D Understanding in Point-VLMs via Geometric Reward Credit Assignment","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-09T23:00:14.031709Z"},"links":{"cited_paper":"/paper/2309.00615","citing_paper":"/paper/2604.21160"},"observation_digest":"sha256:f697be89c01bddd73b46242c528dfc0c5a00e1f9fb213dca51c0523f22ffb9f3","observation_id":"22b41bc1-497c-41a9-90d5-cfed256071a6","resolution":{"observed_at":"2026-05-09T23:04:18.054828Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.00615","last_updated":"2023-09-01T17:59:47Z","snapshot_observed_at":"2026-07-06T16:13:23.343694Z","submitted_at":"2023-09-01T17:59:47Z","title":"Point-Bind & Point-LLM: Aligning Point Cloud with Multi-modality for 3D Understanding, Generation, and Instruction Following","version":1},"cited_work":{"arxiv_id":"2309.00615","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2309.00615","snapshot_observed_at":"2026-07-04T03:09:29.321784Z","title":"Point-bind & point-llm: Aligning point cloud with multi-modality for 3d understanding, generation, and instruction following","venue":null,"work_id":"99ba2617-dd10-4f2d-bb63-cc88e743aa78","year":2023},"citing_paper":{"arxiv_id":"2605.18039","last_updated":"2026-05-18T08:31:04Z","snapshot_observed_at":"2026-07-06T23:28:59.503300Z","submitted_at":"2026-05-18T08:31:04Z","title":"SGSoft: Learning Fused Semantic-Geometric Features for 3D Shape Correspondence via Template-Guided Soft Signals","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-20T11:48:55.446684Z"},"links":{"cited_paper":"/paper/2309.00615","citing_paper":"/paper/2605.18039"},"observation_digest":"sha256:aa604654f5c5295fee16e5774259953bf201ffea87025a04dedc4c31fbae7724","observation_id":"41006236-384f-48d0-967e-987897c84767","resolution":{"observed_at":"2026-05-20T11:53:15.141947Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.00615","last_updated":"2023-09-01T17:59:47Z","snapshot_observed_at":"2026-07-06T16:13:23.343694Z","submitted_at":"2023-09-01T17:59:47Z","title":"Point-Bind & Point-LLM: Aligning Point Cloud with Multi-modality for 3D Understanding, Generation, and Instruction Following","version":1},"cited_work":{"arxiv_id":"2309.00615","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2309.00615","snapshot_observed_at":"2026-07-04T03:09:29.321784Z","title":"Point-bind & point-llm: Aligning point cloud with multi-modality for 3d understanding, generation, and instruction following","venue":null,"work_id":"99ba2617-dd10-4f2d-bb63-cc88e743aa78","year":2023},"citing_paper":{"arxiv_id":"2606.17888","last_updated":"2026-06-16T13:09:32Z","snapshot_observed_at":"2026-08-02T19:33:03.727936Z","submitted_at":"2026-06-16T13:09:32Z","title":"MathVis-Fine: Aligning Visual Supervision with Necessity via Progressive Dependency-Guided Training for Multimodal Mathematical Reasoning","version":1},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-06-27T01:23:40.564561Z"},"links":{"cited_paper":"/paper/2309.00615","citing_paper":"/paper/2606.17888"},"observation_digest":"sha256:5b5e89f2e1ee51cf5e07bf1edefe2e57ce520761713d14cc2f350ab401092c42","observation_id":"bb6a6b9a-3818-4e0a-a863-38a7bfce053d","resolution":{"observed_at":"2026-07-03T20:18:57.763666Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.00615","last_updated":"2023-09-01T17:59:47Z","snapshot_observed_at":"2026-07-06T16:13:23.343694Z","submitted_at":"2023-09-01T17:59:47Z","title":"Point-Bind & Point-LLM: Aligning Point Cloud with Multi-modality for 3D Understanding, Generation, and Instruction Following","version":1},"cited_work":{"arxiv_id":"2309.00615","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2309.00615","snapshot_observed_at":"2026-07-04T03:09:29.321784Z","title":"Point-bind & point-llm: Aligning point cloud with multi-modality for 3d understanding, generation, and instruction following","venue":null,"work_id":"99ba2617-dd10-4f2d-bb63-cc88e743aa78","year":2023},"citing_paper":{"arxiv_id":"2606.19776","last_updated":"2026-06-18T04:24:28Z","snapshot_observed_at":"2026-08-03T12:16:21.711624Z","submitted_at":"2026-06-18T04:24:28Z","title":"Occ-VLM: Occupancy Grounded Vision Language Model for Indoor Scene Understanding","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-26T18:40:20.588652Z"},"links":{"cited_paper":"/paper/2309.00615","citing_paper":"/paper/2606.19776"},"observation_digest":"sha256:8d5f27c0537b253c6b7a2ad9618bfde508e22f17dbbb36fc0aa61dcb53b427e1","observation_id":"e7e808af-abb6-456d-a443-0ebefd3e80f8","resolution":{"observed_at":"2026-07-04T02:59:25.799065Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.00615","last_updated":"2023-09-01T17:59:47Z","snapshot_observed_at":"2026-07-06T16:13:23.343694Z","submitted_at":"2023-09-01T17:59:47Z","title":"Point-Bind & Point-LLM: Aligning Point Cloud with Multi-modality for 3D Understanding, Generation, and Instruction Following","version":1},"cited_work":{"arxiv_id":"2309.00615","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2309.00615","snapshot_observed_at":"2026-07-04T03:09:29.321784Z","title":"Point-bind & point-llm: Aligning point cloud with multi-modality for 3d understanding, generation, and instruction following","venue":null,"work_id":"99ba2617-dd10-4f2d-bb63-cc88e743aa78","year":2023},"citing_paper":{"arxiv_id":"2606.19828","last_updated":"2026-06-18T06:12:59Z","snapshot_observed_at":"2026-08-03T23:40:45.913835Z","submitted_at":"2026-06-18T06:12:59Z","title":"3D-PLOT-LLM: Part-Level Object Tokens for 3D Large Language Models","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-06-26T18:25:55.011125Z"},"links":{"cited_paper":"/paper/2309.00615","citing_paper":"/paper/2606.19828"},"observation_digest":"sha256:74c972c915896336e2cb0466b4193c8bfcb5cb7bd8535d70fe74b8feaee480c8","observation_id":"083afcaf-f843-4667-976e-a20b19ff9d03","resolution":{"observed_at":"2026-07-04T03:09:29.323841Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.00615","last_updated":"2023-09-01T17:59:47Z","snapshot_observed_at":"2026-07-06T16:13:23.343694Z","submitted_at":"2023-09-01T17:59:47Z","title":"Point-Bind & Point-LLM: Aligning Point Cloud with Multi-modality for 3D Understanding, Generation, and Instruction Following","version":1},"cited_work":{"arxiv_id":"2309.00615","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2309.00615","snapshot_observed_at":"2026-07-04T03:09:29.321784Z","title":"Point-bind & point-llm: Aligning point cloud with multi-modality for 3d understanding, generation, and instruction following","venue":null,"work_id":"99ba2617-dd10-4f2d-bb63-cc88e743aa78","year":2023},"citing_paper":{"arxiv_id":"2606.31533","last_updated":"2026-07-23T15:06:35Z","snapshot_observed_at":"2026-08-02T09:23:09.584288Z","submitted_at":"2026-06-30T11:46:25Z","title":"MV-GEL: Language-Driven Multi-View Geometric Entity Localization on Meshes","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-01T05:56:47.849311Z"},"links":{"cited_paper":"/paper/2309.00615","citing_paper":"/paper/2606.31533"},"observation_digest":"sha256:bf9190784199fabeebb724f3d2ce456a8c7d25ed279cfc5f83ed323d775fd515","observation_id":"cc7bc106-3e0b-4cde-94ca-d2f97f99e77a","resolution":{"observed_at":"2026-07-01T10:05:40.451224Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.00615","last_updated":"2023-09-01T17:59:47Z","snapshot_observed_at":"2026-07-06T16:13:23.343694Z","submitted_at":"2023-09-01T17:59:47Z","title":"Point-Bind & Point-LLM: Aligning Point Cloud with Multi-modality for 3D Understanding, Generation, and Instruction Following","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.00615","snapshot_observed_at":"2026-08-02T09:23:10.452175Z","title":"arXiv preprint arXiv:2309.00615 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.31533","last_updated":"2026-07-23T15:06:35Z","snapshot_observed_at":"2026-08-02T09:23:09.584288Z","submitted_at":"2026-06-30T11:46:25Z","title":"MV-GEL: Language-Driven Multi-View Geometric Entity Localization on Meshes","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-02T09:23:10.452175Z"},"links":{"cited_paper":"/paper/2309.00615","citing_paper":"/paper/2606.31533"},"observation_digest":"sha256:47f783a3638e0c5febedde1187663673be02fd6abb254536632c011c4b6d4f07","observation_id":"85be3b90-7c38-49e4-8bab-740661559d48","resolution":{"observed_at":"2026-08-02T09:23:10.452175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.00615","last_updated":"2023-09-01T17:59:47Z","snapshot_observed_at":"2026-07-06T16:13:23.343694Z","submitted_at":"2023-09-01T17:59:47Z","title":"Point-Bind & Point-LLM: Aligning Point Cloud with Multi-modality for 3D Understanding, Generation, and Instruction Following","version":1},"cited_work":{"arxiv_id":"2309.00615","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2309.00615","snapshot_observed_at":"2026-07-04T03:09:29.321784Z","title":"Point-bind & point-llm: Aligning point cloud with multi-modality for 3d understanding, generation, and instruction following","venue":null,"work_id":"99ba2617-dd10-4f2d-bb63-cc88e743aa78","year":2023},"citing_paper":{"arxiv_id":"2607.01784","last_updated":"2026-07-02T06:56:29Z","snapshot_observed_at":"2026-08-03T11:23:56.400674Z","submitted_at":"2026-07-02T06:56:29Z","title":"SpaceEra++: A Unified Framework Towards 3D Spatial Reasoning in Video","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-07-03T16:16:41.412451Z"},"links":{"cited_paper":"/paper/2309.00615","citing_paper":"/paper/2607.01784"},"observation_digest":"sha256:d559d135683d477a85bf72b30962b3666235e7fd6b702d83e89e73af8cdaee25","observation_id":"d1acf887-f64c-4ed8-a250-ec3305992d20","resolution":{"observed_at":"2026-07-03T16:18:37.260308Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.00615","last_updated":"2023-09-01T17:59:47Z","snapshot_observed_at":"2026-07-06T16:13:23.343694Z","submitted_at":"2023-09-01T17:59:47Z","title":"Point-Bind & Point-LLM: Aligning Point Cloud with Multi-modality for 3D Understanding, Generation, and Instruction Following","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.00615","snapshot_observed_at":"2026-08-02T06:23:28.101393Z","title":"Point-Bind & Point-","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.12752","last_updated":"2026-07-15T04:28:35Z","snapshot_observed_at":"2026-08-02T11:35:25.338844Z","submitted_at":"2026-07-14T13:19:06Z","title":"Hallo4D: Multi-Modal Hallucination Mitigation for Consistent Spatio-Temporal Generation","version":2},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-02T06:23:28.101393Z"},"links":{"cited_paper":"/paper/2309.00615","citing_paper":"/paper/2607.12752"},"observation_digest":"sha256:f87e3e0ae3db2a37630d7a971496205f0e6c86c83a6588ddad4e89573223d26d","observation_id":"131fa64a-d148-48f8-88e0-f269398cb505","resolution":{"observed_at":"2026-08-02T06:23:28.101393Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.00615","last_updated":"2023-09-01T17:59:47Z","snapshot_observed_at":"2026-07-06T16:13:23.343694Z","submitted_at":"2023-09-01T17:59:47Z","title":"Point-Bind & Point-LLM: Aligning Point Cloud with Multi-modality for 3D Understanding, Generation, and Instruction Following","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.00615","snapshot_observed_at":"2026-08-02T00:23:01.446109Z","title":"Point-bind & point-llm: Aligning point cloud with multi- modality for 3d understanding, generation, and instruction following.arXiv preprint arXiv:2309.00615,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.15054","last_updated":"2026-07-16T14:31:16Z","snapshot_observed_at":"2026-08-02T09:38:56.901727Z","submitted_at":"2026-07-16T14:31:16Z","title":"Beyond Single Expert: Harmonizing Diverse Visual Priors in MLLMs for Spatial Understanding","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-02T00:23:01.446109Z"},"links":{"cited_paper":"/paper/2309.00615","citing_paper":"/paper/2607.15054"},"observation_digest":"sha256:85d18542a98fcafbfc6360a843778af05b6751ad6743a08658d4b299a264e1ca","observation_id":"4ba8b9c3-c4ab-43e9-9f7c-f875897ca14e","resolution":{"observed_at":"2026-08-02T00:23:01.446109Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2309.00615/citation-record","integrity":"/paper/2309.00615/integrity","json":"/paper/2309.00615/citation-record.json","paper":"/paper/2309.00615"},"outbound":[],"paper":{"arxiv_id":"2309.00615","last_updated":"2023-09-01T17:59:47Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-07-06T16:13:23.343694Z","submitted_at":"2023-09-01T17:59:47Z","title":"Point-Bind & Point-LLM: Aligning Point Cloud with Multi-modality for 3D Understanding, Generation, and Instruction Following"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"thesis":"As of 4 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 26 inbound Pith citation observations for arXiv:2309.00615."}