{"as_of":"2026-08-22T07:00:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:efe9d2fff700ab4fc90ebf3dbf54207f9a8a656b877da3782ac50374c1eb3a0f","coverage":[{"denominator":22,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":22,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T06:24:29.865289Z","state":"measured"},{"denominator":22,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":22,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-22T06:32:14.747728+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.12815/citation-record","integrity":"/paper/2607.12815/integrity","json":"/paper/2607.12815/citation-record.json","paper":"/paper/2607.12815"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.08008","last_updated":"2025-06-09T17:59:54Z","snapshot_observed_at":"2026-08-15T07:02:37.929930Z","submitted_at":"2025-06-09T17:59:54Z","title":"Hidden in plain sight: VLMs overlook their visual representations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.08008","snapshot_observed_at":"2026-08-02T06:24:27.325903Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.12815","last_updated":"2026-07-18T02:07:01Z","snapshot_observed_at":"2026-08-20T05:25:49.708168Z","submitted_at":"2026-07-14T14:27:58Z","title":"Visual Access Boundaries in Vision-Language Model Reasoning","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-02T06:24:27.325903Z"},"links":{"cited_paper":"/paper/2506.08008","citing_paper":"/paper/2607.12815"},"observation_digest":"sha256:342c79472275cd3a0d934f77f012cfe4af7aa5ca15afe7cfbedb870e0da3d04a","observation_id":"4ab637ef-2e2c-4309-8082-436d893e5348","resolution":{"observed_at":"2026-08-02T06:24:27.325903Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-02T06:24:27.684742Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.12815","last_updated":"2026-07-18T02:07:01Z","snapshot_observed_at":"2026-08-20T05:25:49.708168Z","submitted_at":"2026-07-14T14:27:58Z","title":"Visual Access Boundaries in Vision-Language Model Reasoning","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-02T06:24:27.684742Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2607.12815"},"observation_digest":"sha256:64aef2c4fd1c313f0858e4ded462992ff8d5267a245873efd69daff531526ac3","observation_id":"86b99209-9e10-414b-ada0-8b73ec0fbf6f","resolution":{"observed_at":"2026-08-02T06:24:27.684742Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.13702","last_updated":"2023-07-17T01:08:39Z","snapshot_observed_at":"2026-08-13T18:02:27.155379Z","submitted_at":"2023-07-17T01:08:39Z","title":"Measuring Faithfulness in Chain-of-Thought Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.13702","snapshot_observed_at":"2026-08-02T06:24:28.082474Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.12815","last_updated":"2026-07-18T02:07:01Z","snapshot_observed_at":"2026-08-20T05:25:49.708168Z","submitted_at":"2026-07-14T14:27:58Z","title":"Visual Access Boundaries in Vision-Language Model Reasoning","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-02T06:24:28.082474Z"},"links":{"cited_paper":"/paper/2307.13702","citing_paper":"/paper/2607.12815"},"observation_digest":"sha256:4fd7ac5c6a1c1c3efa48ae5ec624e7747117dfb2d4c2b88c671df8a158abd6af","observation_id":"2f069232-2fc6-490e-bc39-ed4e1bfda74f","resolution":{"observed_at":"2026-08-02T06:24:28.082474Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.11514","last_updated":"2025-05-25T04:36:14Z","snapshot_observed_at":"2026-08-16T12:57:51.005791Z","submitted_at":"2025-02-17T07:29:01Z","title":"Investigating Inference-time Scaling for Chain of Multi-modal Thought: A Preliminary Study","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.11514","snapshot_observed_at":"2026-08-02T06:24:28.174746Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.12815","last_updated":"2026-07-18T02:07:01Z","snapshot_observed_at":"2026-08-20T05:25:49.708168Z","submitted_at":"2026-07-14T14:27:58Z","title":"Visual Access Boundaries in Vision-Language Model Reasoning","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-02T06:24:28.174746Z"},"links":{"cited_paper":"/paper/2502.11514","citing_paper":"/paper/2607.12815"},"observation_digest":"sha256:83d5aca5c4181fb570130497a3bedd1d96ba6b3754b8469e9942d844ff32de18","observation_id":"5e7db585-cffd-40c5-bfc0-4fc0913ee509","resolution":{"observed_at":"2026-08-02T06:24:28.174746Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.10981","last_updated":"2025-08-02T08:06:23Z","snapshot_observed_at":"2026-08-19T23:33:04.607595Z","submitted_at":"2025-05-16T08:28:57Z","title":"Rethinking the Role of Prompting Strategies in LLM Test-Time Scaling: A Perspective of Probability Theory","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.10981","snapshot_observed_at":"2026-08-02T06:24:28.324742Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.12815","last_updated":"2026-07-18T02:07:01Z","snapshot_observed_at":"2026-08-20T05:25:49.708168Z","submitted_at":"2026-07-14T14:27:58Z","title":"Visual Access Boundaries in Vision-Language Model Reasoning","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-02T06:24:28.324742Z"},"links":{"cited_paper":"/paper/2505.10981","citing_paper":"/paper/2607.12815"},"observation_digest":"sha256:de49a976032fa9a5c7048f18fd9d0c12c11a44e5f80763bdd06609d4db5614d4","observation_id":"2d690a40-c96d-402f-a155-3180290068c3","resolution":{"observed_at":"2026-08-02T06:24:28.324742Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.04388","last_updated":"2023-12-09T21:25:02Z","snapshot_observed_at":"2026-08-12T21:03:44.597326Z","submitted_at":"2023-05-07T22:44:25Z","title":"Language Models Don't Always Say What They Think: Unfaithful Explanations in Chain-of-Thought Prompting","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.04388","snapshot_observed_at":"2026-08-02T06:24:28.514743Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.12815","last_updated":"2026-07-18T02:07:01Z","snapshot_observed_at":"2026-08-20T05:25:49.708168Z","submitted_at":"2026-07-14T14:27:58Z","title":"Visual Access Boundaries in Vision-Language Model Reasoning","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-02T06:24:28.514743Z"},"links":{"cited_paper":"/paper/2305.04388","citing_paper":"/paper/2607.12815"},"observation_digest":"sha256:9b277e89c953d70a84befd2b9983737246818e468bd6cb9fcce0cf5bc5e6290b","observation_id":"3d0856dd-7956-4a5a-b24f-4a218373a933","resolution":{"observed_at":"2026-08-02T06:24:28.514743Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:24:28.634750Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.12815","last_updated":"2026-07-18T02:07:01Z","snapshot_observed_at":"2026-08-20T05:25:49.708168Z","submitted_at":"2026-07-14T14:27:58Z","title":"Visual Access Boundaries in Vision-Language Model Reasoning","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-02T06:24:28.634750Z"},"links":{"citing_paper":"/paper/2607.12815"},"observation_digest":"sha256:129b94b0c83df528a4c7116cab200aa98d123bb4010e5601dc59df6665d6a05d","observation_id":"2ee309ca-7383-4054-bc26-01581fd9f8c8","resolution":{"observed_at":"2026-08-02T06:24:28.634750Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.12799","last_updated":"2025-03-24T11:30:58Z","snapshot_observed_at":"2026-08-16T12:49:29.988082Z","submitted_at":"2025-03-17T04:07:47Z","title":"Grounded Chain-of-Thought for Multimodal Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.12799","snapshot_observed_at":"2026-08-02T06:24:28.750079Z","title":null,"venue":null,"work_id":null,"year":2087},"citing_paper":{"arxiv_id":"2607.12815","last_updated":"2026-07-18T02:07:01Z","snapshot_observed_at":"2026-08-20T05:25:49.708168Z","submitted_at":"2026-07-14T14:27:58Z","title":"Visual Access Boundaries in Vision-Language Model Reasoning","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-02T06:24:28.750079Z"},"links":{"cited_paper":"/paper/2503.12799","citing_paper":"/paper/2607.12815"},"observation_digest":"sha256:a18b4e23c1ac33233604175b0b1263ec0d57b40807a23a3f03cdbb664e35675e","observation_id":"d07fa59e-6f8d-4f08-aef1-664a84ff5b83","resolution":{"observed_at":"2026-08-02T06:24:28.750079Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.03469","last_updated":"2025-08-05T14:05:15Z","snapshot_observed_at":"2026-08-08T08:52:56.516264Z","submitted_at":"2025-08-05T14:05:15Z","title":"IKOD: Mitigating Visual Attention Degradation in Large Vision-Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.03469","snapshot_observed_at":"2026-08-02T06:24:28.914749Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.12815","last_updated":"2026-07-18T02:07:01Z","snapshot_observed_at":"2026-08-20T05:25:49.708168Z","submitted_at":"2026-07-14T14:27:58Z","title":"Visual Access Boundaries in Vision-Language Model Reasoning","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-02T06:24:28.914749Z"},"links":{"cited_paper":"/paper/2508.03469","citing_paper":"/paper/2607.12815"},"observation_digest":"sha256:70c25010fd3154717937403b50bb065755541bfe3e67a1503c9ea4ed1b1070b7","observation_id":"1cccbf46-ee10-4923-897e-93f11be2c53e","resolution":{"observed_at":"2026-08-02T06:24:28.914749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.17425","last_updated":"2025-02-24T18:56:12Z","snapshot_observed_at":"2026-08-18T06:13:09.288674Z","submitted_at":"2025-02-24T18:56:12Z","title":"Introducing Visual Perception Token into Multimodal Large Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.17425","snapshot_observed_at":"2026-08-02T06:24:29.245780Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.12815","last_updated":"2026-07-18T02:07:01Z","snapshot_observed_at":"2026-08-20T05:25:49.708168Z","submitted_at":"2026-07-14T14:27:58Z","title":"Visual Access Boundaries in Vision-Language Model Reasoning","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-02T06:24:29.245780Z"},"links":{"cited_paper":"/paper/2502.17425","citing_paper":"/paper/2607.12815"},"observation_digest":"sha256:d43e0a9d02c3098f10216d23c77e407ea43d5edc553dfd0438e804acd1219bdf","observation_id":"c3b6a2db-9f62-4656-9d02-1af7581f551f","resolution":{"observed_at":"2026-08-02T06:24:29.245780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:24:29.393679Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.12815","last_updated":"2026-07-18T02:07:01Z","snapshot_observed_at":"2026-08-20T05:25:49.708168Z","submitted_at":"2026-07-14T14:27:58Z","title":"Visual Access Boundaries in Vision-Language Model Reasoning","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-02T06:24:29.393679Z"},"links":{"citing_paper":"/paper/2607.12815"},"observation_digest":"sha256:89b746cbf8dffd904ca2f950379183ad9280527ec9e3b3a2973693a86f249561","observation_id":"e7c1a778-abdf-4e96-b4c4-da4ec616abda","resolution":{"observed_at":"2026-08-02T06:24:29.393679Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.10479","last_updated":"2025-04-19T03:47:21Z","snapshot_observed_at":"2026-08-17T09:56:52.502317Z","submitted_at":"2025-04-14T17:59:25Z","title":"InternVL3: Exploring Advanced Training and Test-Time Recipes for Open-Source Multimodal Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.10479","snapshot_observed_at":"2026-08-02T06:24:29.537189Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.12815","last_updated":"2026-07-18T02:07:01Z","snapshot_observed_at":"2026-08-20T05:25:49.708168Z","submitted_at":"2026-07-14T14:27:58Z","title":"Visual Access Boundaries in Vision-Language Model Reasoning","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-02T06:24:29.537189Z"},"links":{"cited_paper":"/paper/2504.10479","citing_paper":"/paper/2607.12815"},"observation_digest":"sha256:2173b0c4eebdbdcc013ecc1258cf27adf27393301e3f960971fc9150cc3e099a","observation_id":"8748d5d4-adf1-4b04-80ef-6a9e769d54bd","resolution":{"observed_at":"2026-08-02T06:24:29.537189Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03577","last_updated":"2025-05-08T05:49:30Z","snapshot_observed_at":"2026-08-20T05:00:11.970202Z","submitted_at":"2024-10-04T16:30:54Z","title":"Look Twice Before You Answer: Memory-Space Visual Retracing for Hallucination Mitigation in Multimodal Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.03577","snapshot_observed_at":"2026-08-02T06:24:29.678069Z","title":"13 Appendix Contents A Experimental Details 15 A.1 Dataset Generation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.12815","last_updated":"2026-07-18T02:07:01Z","snapshot_observed_at":"2026-08-20T05:25:49.708168Z","submitted_at":"2026-07-14T14:27:58Z","title":"Visual Access Boundaries in Vision-Language Model Reasoning","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-02T06:24:29.678069Z"},"links":{"cited_paper":"/paper/2410.03577","citing_paper":"/paper/2607.12815"},"observation_digest":"sha256:03f059aa5e1647b027df083916c16c88bcc3c377e5c1a35e16a3b849f58c5ff1","observation_id":"460f5360-033a-4eba-911c-8e7c45aee9cd","resolution":{"observed_at":"2026-08-02T06:24:29.678069Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:24:29.865289Z","title":"We denote the corresponding CoT-side boundaries by ℓ∗ CoT and ℓ∗ DA, respectively, and report shifts relative to the Direct boundaryℓ∗ D following Eq","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.12815","last_updated":"2026-07-18T02:07:01Z","snapshot_observed_at":"2026-08-20T05:25:49.708168Z","submitted_at":"2026-07-14T14:27:58Z","title":"Visual Access Boundaries in Vision-Language Model Reasoning","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-02T06:24:29.865289Z"},"links":{"citing_paper":"/paper/2607.12815"},"observation_digest":"sha256:4a7d64e8772d0675642959798fbc30296de4a163175dce659711d93688354764","observation_id":"6c7f837c-c7e0-4bfb-ad80-8590771416c0","resolution":{"observed_at":"2026-08-02T06:24:29.865289Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1610.01644","last_updated":"2018-11-22T23:40:00Z","snapshot_observed_at":"2026-08-09T22:50:03.459615Z","submitted_at":"2016-10-05T20:59:01Z","title":"Understanding intermediate layers using linear classifier probes","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1610.01644","snapshot_observed_at":"2026-08-02T06:24:26.784742Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.12815","last_updated":"2026-07-18T02:07:01Z","snapshot_observed_at":"2026-08-20T05:25:49.708168Z","submitted_at":"2026-07-14T14:27:58Z","title":"Visual Access Boundaries in Vision-Language Model Reasoning","version":2},"reference_index":2016,"source":"pdf_text","source_observed_at":"2026-08-02T06:24:26.784742Z"},"links":{"cited_paper":"/paper/1610.01644","citing_paper":"/paper/2607.12815"},"observation_digest":"sha256:bc6c9515610b6d11cd47ecdfe494d29984f8fb67ec4f779e7f8d4186b02ac324","observation_id":"cd31ca40-85cc-4072-a324-a434d63366c2","resolution":{"observed_at":"2026-08-02T06:24:26.784742Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1612.06890","last_updated":"2016-12-20T21:40:40Z","snapshot_observed_at":"2026-08-14T21:24:26.006854Z","submitted_at":"2016-12-20T21:40:40Z","title":"CLEVR: A Diagnostic Dataset for Compositional Language and Elementary Visual Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1612.06890","snapshot_observed_at":"2026-08-02T06:24:27.792154Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.12815","last_updated":"2026-07-18T02:07:01Z","snapshot_observed_at":"2026-08-20T05:25:49.708168Z","submitted_at":"2026-07-14T14:27:58Z","title":"Visual Access Boundaries in Vision-Language Model Reasoning","version":2},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-02T06:24:27.792154Z"},"links":{"cited_paper":"/paper/1612.06890","citing_paper":"/paper/2607.12815"},"observation_digest":"sha256:af30e0549bb9bacc0a85014c3c8864beca2ef061f4a8385f847af3a0c2d7be53","observation_id":"11a64650-03dd-4d43-bce7-7c9b4a507792","resolution":{"observed_at":"2026-08-02T06:24:27.792154Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:24:27.434878Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.12815","last_updated":"2026-07-18T02:07:01Z","snapshot_observed_at":"2026-08-20T05:25:49.708168Z","submitted_at":"2026-07-14T14:27:58Z","title":"Visual Access Boundaries in Vision-Language Model Reasoning","version":2},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-02T06:24:27.434878Z"},"links":{"citing_paper":"/paper/2607.12815"},"observation_digest":"sha256:3d36f059db6668b0903e6a0f9c710112fdcc84ac95a1eb4616334f45f12d1faf","observation_id":"e9573295-1f5c-4545-a22b-ab3d0cd93718","resolution":{"observed_at":"2026-08-02T06:24:27.434878Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2202.05262","last_updated":"2023-01-13T15:16:16Z","snapshot_observed_at":"2026-08-15T12:28:05.800155Z","submitted_at":"2022-02-10T18:59:54Z","title":"Locating and Editing Factual Associations in GPT","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2202.05262","snapshot_observed_at":"2026-08-02T06:24:28.404744Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.12815","last_updated":"2026-07-18T02:07:01Z","snapshot_observed_at":"2026-08-20T05:25:49.708168Z","submitted_at":"2026-07-14T14:27:58Z","title":"Visual Access Boundaries in Vision-Language Model Reasoning","version":2},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-02T06:24:28.404744Z"},"links":{"cited_paper":"/paper/2202.05262","citing_paper":"/paper/2607.12815"},"observation_digest":"sha256:7f087974c2e28916694a0f3fe14ef3517a83a1cf7f612c0135f654a478907f39","observation_id":"c4a84307-c14f-4b21-a92a-f3c73faa86c2","resolution":{"observed_at":"2026-08-02T06:24:28.404744Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08112","last_updated":"2025-11-11T01:13:28Z","snapshot_observed_at":"2026-08-14T11:50:41.917778Z","submitted_at":"2023-03-14T17:47:09Z","title":"Eliciting Latent Predictions from Transformers with the Tuned Lens","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08112","snapshot_observed_at":"2026-08-02T06:24:27.188310Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.12815","last_updated":"2026-07-18T02:07:01Z","snapshot_observed_at":"2026-08-20T05:25:49.708168Z","submitted_at":"2026-07-14T14:27:58Z","title":"Visual Access Boundaries in Vision-Language Model Reasoning","version":2},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-02T06:24:27.188310Z"},"links":{"cited_paper":"/paper/2303.08112","citing_paper":"/paper/2607.12815"},"observation_digest":"sha256:b70cacab274080459a4bfc0296a01ab8b7d901503d979c2675f3a8cbc9caa65d","observation_id":"54940c80-306f-4087-8e4c-3938e73a57e5","resolution":{"observed_at":"2026-08-02T06:24:27.188310Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-08-21T16:02:41.546193Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-02T06:24:26.894776Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.12815","last_updated":"2026-07-18T02:07:01Z","snapshot_observed_at":"2026-08-20T05:25:49.708168Z","submitted_at":"2026-07-14T14:27:58Z","title":"Visual Access Boundaries in Vision-Language Model Reasoning","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-02T06:24:26.894776Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2607.12815"},"observation_digest":"sha256:2336183b96d16d2fe80fd7b80dec276021da6dbad10ec4f8a2b78c9f0afe1c25","observation_id":"d8984636-5460-480a-ae89-64911d16dc79","resolution":{"observed_at":"2026-08-02T06:24:26.894776Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-08-21T16:02:41.546193Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-02T06:24:27.024869Z","title":"URL https://arxiv.org/abs/ 2502.13923","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.12815","last_updated":"2026-07-18T02:07:01Z","snapshot_observed_at":"2026-08-20T05:25:49.708168Z","submitted_at":"2026-07-14T14:27:58Z","title":"Visual Access Boundaries in Vision-Language Model Reasoning","version":2},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-02T06:24:27.024869Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2607.12815"},"observation_digest":"sha256:d4d4f372965836b93c6eaaf9e59b2f58eae22e56b49ba8cbd8dec819f272d471","observation_id":"95b3dbb1-3004-40aa-98b3-a93a6e567c4a","resolution":{"observed_at":"2026-08-02T06:24:27.024869Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.16060","last_updated":"2026-04-17T13:35:45Z","snapshot_observed_at":"2026-07-06T23:03:30.601598Z","submitted_at":"2026-04-17T13:35:45Z","title":"Chain-of-Thought Degrades Visual Spatial Reasoning Capabilities of Multimodal LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.16060","snapshot_observed_at":"2026-08-02T06:24:27.922484Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.12815","last_updated":"2026-07-18T02:07:01Z","snapshot_observed_at":"2026-08-20T05:25:49.708168Z","submitted_at":"2026-07-14T14:27:58Z","title":"Visual Access Boundaries in Vision-Language Model Reasoning","version":2},"reference_index":2026,"source":"pdf_text","source_observed_at":"2026-08-02T06:24:27.922484Z"},"links":{"cited_paper":"/paper/2604.16060","citing_paper":"/paper/2607.12815"},"observation_digest":"sha256:46fbd655ff641b9dce602a4b0a09958160d501e1cc01092443eb45a72bf03358","observation_id":"4adfd617-66cd-4bb3-870a-37657d71a07b","resolution":{"observed_at":"2026-08-02T06:24:27.922484Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.12815","last_updated":"2026-07-18T02:07:01Z","latest_version":2,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-20T05:25:49.708168Z","submitted_at":"2026-07-14T14:27:58Z","title":"Visual Access Boundaries in Vision-Language Model Reasoning"},"reference_resolution":{"displayed":22,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":22,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":22},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"thesis":"As of 22 August 2026, this Paper Citation Record lists 22 of 22 outbound references and 0 inbound Pith citation observations for arXiv:2607.12815."}