{"as_of":"2026-08-09T18:11:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b26a3bf64e33368bbbce2aeb5297c2a930a90e444eac3a18f2586351e59eae68","coverage":[{"denominator":36,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":36,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T21:26:12.756909Z","state":"measured"},{"denominator":36,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":36,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.16094/citation-record","integrity":"/paper/2607.16094/integrity","json":"/paper/2607.16094/citation-record.json","paper":"/paper/2607.16094"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:26:09.364457Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.16094","last_updated":"2026-07-17T16:25:03Z","snapshot_observed_at":"2026-08-08T03:29:38.707478Z","submitted_at":"2026-07-17T16:25:03Z","title":"How Do VLMs Fail? Vision-Operation Misalignment in Compositional VQA","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-01T21:26:09.364457Z"},"links":{"citing_paper":"/paper/2607.16094"},"observation_digest":"sha256:beea2aa960b515087cf314b4b3194ebe117841226fe01189902baa2625a79d53","observation_id":"575369cb-bed9-4fbf-a03b-cdd5321c69a1","resolution":{"observed_at":"2026-08-01T21:26:09.364457Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1610.01644","last_updated":"2018-11-22T23:40:00Z","snapshot_observed_at":"2026-07-06T05:13:30.860932Z","submitted_at":"2016-10-05T20:59:01Z","title":"Understanding intermediate layers using linear classifier probes","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1610.01644","snapshot_observed_at":"2026-08-01T21:26:09.438049Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.16094","last_updated":"2026-07-17T16:25:03Z","snapshot_observed_at":"2026-08-08T03:29:38.707478Z","submitted_at":"2026-07-17T16:25:03Z","title":"How Do VLMs Fail? Vision-Operation Misalignment in Compositional VQA","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-01T21:26:09.438049Z"},"links":{"cited_paper":"/paper/1610.01644","citing_paper":"/paper/2607.16094"},"observation_digest":"sha256:b682ca40bdba913754eee8fed80a1d852d72453b109953256031f9d533023c72","observation_id":"ff265363-d447-4857-8eb0-97805eae4453","resolution":{"observed_at":"2026-08-01T21:26:09.438049Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.21631","last_updated":"2025-11-27T12:16:54Z","snapshot_observed_at":"2026-07-06T22:37:03.716474Z","submitted_at":"2025-11-26T17:59:08Z","title":"Qwen3-VL Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.21631","snapshot_observed_at":"2026-08-01T21:26:09.546558Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16094","last_updated":"2026-07-17T16:25:03Z","snapshot_observed_at":"2026-08-08T03:29:38.707478Z","submitted_at":"2026-07-17T16:25:03Z","title":"How Do VLMs Fail? Vision-Operation Misalignment in Compositional VQA","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-01T21:26:09.546558Z"},"links":{"cited_paper":"/paper/2511.21631","citing_paper":"/paper/2607.16094"},"observation_digest":"sha256:7d914be2aee321b32c007e67b2b65ddb83456ed3a6127abe1574f4fad1ca7908","observation_id":"fb207d1e-ad1e-4943-a5a2-b531f0cf0cdc","resolution":{"observed_at":"2026-08-01T21:26:09.546558Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:26:09.605697Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.16094","last_updated":"2026-07-17T16:25:03Z","snapshot_observed_at":"2026-08-08T03:29:38.707478Z","submitted_at":"2026-07-17T16:25:03Z","title":"How Do VLMs Fail? Vision-Operation Misalignment in Compositional VQA","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-01T21:26:09.605697Z"},"links":{"citing_paper":"/paper/2607.16094"},"observation_digest":"sha256:ee0173114904d6a8e0e85f33c525ba60fe58ae221edf9596f492c4aa6ea7c8d8","observation_id":"436ea42a-4485-44a8-a232-56d9a9d15a70","resolution":{"observed_at":"2026-08-01T21:26:09.605697Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:26:09.646120Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.16094","last_updated":"2026-07-17T16:25:03Z","snapshot_observed_at":"2026-08-08T03:29:38.707478Z","submitted_at":"2026-07-17T16:25:03Z","title":"How Do VLMs Fail? Vision-Operation Misalignment in Compositional VQA","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-01T21:26:09.646120Z"},"links":{"citing_paper":"/paper/2607.16094"},"observation_digest":"sha256:3e2b05e73ffae6d2b19950987336040e7327350ca201c45b66c3f6435db28343","observation_id":"98315fae-9cbe-4d7e-a602-523d30839dd1","resolution":{"observed_at":"2026-08-01T21:26:09.646120Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:26:09.848796Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.16094","last_updated":"2026-07-17T16:25:03Z","snapshot_observed_at":"2026-08-08T03:29:38.707478Z","submitted_at":"2026-07-17T16:25:03Z","title":"How Do VLMs Fail? Vision-Operation Misalignment in Compositional VQA","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-01T21:26:09.848796Z"},"links":{"citing_paper":"/paper/2607.16094"},"observation_digest":"sha256:d3cf59ece3e5ef5c85116336eb9a13e0ce54839d63cb085ca3f794f522f0850d","observation_id":"d6acefd4-ee2d-4779-91c8-df161655e5c6","resolution":{"observed_at":"2026-08-01T21:26:09.848796Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:26:09.892429Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.16094","last_updated":"2026-07-17T16:25:03Z","snapshot_observed_at":"2026-08-08T03:29:38.707478Z","submitted_at":"2026-07-17T16:25:03Z","title":"How Do VLMs Fail? Vision-Operation Misalignment in Compositional VQA","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-01T21:26:09.892429Z"},"links":{"citing_paper":"/paper/2607.16094"},"observation_digest":"sha256:bfb8d64aaf6d025e9fd24bb2a15d67cfcd5c670386bbe2f2d39fe5f2d3719d97","observation_id":"d4c0d2dd-ea76-497b-947d-41d68f24e63c","resolution":{"observed_at":"2026-08-01T21:26:09.892429Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:26:09.899220Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.16094","last_updated":"2026-07-17T16:25:03Z","snapshot_observed_at":"2026-08-08T03:29:38.707478Z","submitted_at":"2026-07-17T16:25:03Z","title":"How Do VLMs Fail? Vision-Operation Misalignment in Compositional VQA","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-01T21:26:09.899220Z"},"links":{"citing_paper":"/paper/2607.16094"},"observation_digest":"sha256:eaaf5c021d690ebaf305ee11afa86c174130303a0a2dca100ebc2edf9679e81e","observation_id":"e77509d7-24ad-40b9-9d04-a6c124af6045","resolution":{"observed_at":"2026-08-01T21:26:09.899220Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:26:10.017303Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.16094","last_updated":"2026-07-17T16:25:03Z","snapshot_observed_at":"2026-08-08T03:29:38.707478Z","submitted_at":"2026-07-17T16:25:03Z","title":"How Do VLMs Fail? Vision-Operation Misalignment in Compositional VQA","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-01T21:26:10.017303Z"},"links":{"citing_paper":"/paper/2607.16094"},"observation_digest":"sha256:ddd08706edd5b584cfdec17b1c146fc0198d686cefc596f55f7aa5d445f2f685","observation_id":"d931f2f4-8967-49a9-941a-a985e7334062","resolution":{"observed_at":"2026-08-01T21:26:10.017303Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:26:10.140001Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.16094","last_updated":"2026-07-17T16:25:03Z","snapshot_observed_at":"2026-08-08T03:29:38.707478Z","submitted_at":"2026-07-17T16:25:03Z","title":"How Do VLMs Fail? Vision-Operation Misalignment in Compositional VQA","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-01T21:26:10.140001Z"},"links":{"citing_paper":"/paper/2607.16094"},"observation_digest":"sha256:e36fc2e83b6e2865ff1de36f0a0f0947bc8cf24de7d2c2b75c20166c076e21f1","observation_id":"0644139d-22b3-41a1-81dc-eae42434da56","resolution":{"observed_at":"2026-08-01T21:26:10.140001Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16320","last_updated":"2025-02-07T20:56:08Z","snapshot_observed_at":"2026-07-06T18:35:49.991098Z","submitted_at":"2024-06-24T05:13:19Z","title":"What Do VLMs NOTICE? A Mechanistic Interpretability Pipeline for Gaussian-Noise-free Text-Image Corruption and Evaluation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.16320","snapshot_observed_at":"2026-08-01T21:26:10.251986Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.16094","last_updated":"2026-07-17T16:25:03Z","snapshot_observed_at":"2026-08-08T03:29:38.707478Z","submitted_at":"2026-07-17T16:25:03Z","title":"How Do VLMs Fail? Vision-Operation Misalignment in Compositional VQA","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-01T21:26:10.251986Z"},"links":{"cited_paper":"/paper/2406.16320","citing_paper":"/paper/2607.16094"},"observation_digest":"sha256:4190b2425163c65452350a3d180f22d138e1a96c68227fb77600c7bae08244e6","observation_id":"c5427786-c7fb-4579-b6ea-7cd131e35a99","resolution":{"observed_at":"2026-08-01T21:26:10.251986Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:26:10.367842Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.16094","last_updated":"2026-07-17T16:25:03Z","snapshot_observed_at":"2026-08-08T03:29:38.707478Z","submitted_at":"2026-07-17T16:25:03Z","title":"How Do VLMs Fail? Vision-Operation Misalignment in Compositional VQA","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-01T21:26:10.367842Z"},"links":{"citing_paper":"/paper/2607.16094"},"observation_digest":"sha256:325cca722076532b392e4eb21f29a705225f143c0ce7024b64925ed35884a881","observation_id":"608e7f35-7917-4e9b-9f62-7e15ee1447f6","resolution":{"observed_at":"2026-08-01T21:26:10.367842Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:26:10.482519Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16094","last_updated":"2026-07-17T16:25:03Z","snapshot_observed_at":"2026-08-08T03:29:38.707478Z","submitted_at":"2026-07-17T16:25:03Z","title":"How Do VLMs Fail? Vision-Operation Misalignment in Compositional VQA","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-01T21:26:10.482519Z"},"links":{"citing_paper":"/paper/2607.16094"},"observation_digest":"sha256:2fc9249a6d2ac9de95c16c55ffce2bbb7d3a75d1654d765fb8641e36945fb778","observation_id":"c15930bd-2992-473a-bd73-0359601edc2a","resolution":{"observed_at":"2026-08-01T21:26:10.482519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:26:10.592030Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16094","last_updated":"2026-07-17T16:25:03Z","snapshot_observed_at":"2026-08-08T03:29:38.707478Z","submitted_at":"2026-07-17T16:25:03Z","title":"How Do VLMs Fail? Vision-Operation Misalignment in Compositional VQA","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-01T21:26:10.592030Z"},"links":{"citing_paper":"/paper/2607.16094"},"observation_digest":"sha256:e3f84feb7acf5ec5dd27d153040176e4a69280dcfcb9ff28323d3728767335a1","observation_id":"750a0814-2520-40fa-983b-da1c4b0a79c5","resolution":{"observed_at":"2026-08-01T21:26:10.592030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:26:10.806485Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16094","last_updated":"2026-07-17T16:25:03Z","snapshot_observed_at":"2026-08-08T03:29:38.707478Z","submitted_at":"2026-07-17T16:25:03Z","title":"How Do VLMs Fail? Vision-Operation Misalignment in Compositional VQA","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-01T21:26:10.806485Z"},"links":{"citing_paper":"/paper/2607.16094"},"observation_digest":"sha256:82c795506e712d19a5bff6dc98934f7662c6b24f3dc5da27e403b46737b42229","observation_id":"386e9a8a-94ed-4e08-9051-4535d632bcab","resolution":{"observed_at":"2026-08-01T21:26:10.806485Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:26:10.930409Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.16094","last_updated":"2026-07-17T16:25:03Z","snapshot_observed_at":"2026-08-08T03:29:38.707478Z","submitted_at":"2026-07-17T16:25:03Z","title":"How Do VLMs Fail? Vision-Operation Misalignment in Compositional VQA","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-01T21:26:10.930409Z"},"links":{"citing_paper":"/paper/2607.16094"},"observation_digest":"sha256:6494faa027e9b359dda98bc4b28406eb76bd504ca1c1511992229ce387854958","observation_id":"f43732f8-501f-4e3b-acfd-10e9fd72505d","resolution":{"observed_at":"2026-08-01T21:26:10.930409Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.17516","last_updated":"2025-02-22T20:55:26Z","snapshot_observed_at":"2026-08-08T10:56:10.786814Z","submitted_at":"2025-02-22T20:55:26Z","title":"A Survey on Mechanistic Interpretability for Multi-Modal Foundation Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.17516","snapshot_observed_at":"2026-08-01T21:26:11.083317Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16094","last_updated":"2026-07-17T16:25:03Z","snapshot_observed_at":"2026-08-08T03:29:38.707478Z","submitted_at":"2026-07-17T16:25:03Z","title":"How Do VLMs Fail? Vision-Operation Misalignment in Compositional VQA","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-01T21:26:11.083317Z"},"links":{"cited_paper":"/paper/2502.17516","citing_paper":"/paper/2607.16094"},"observation_digest":"sha256:0d9dea64179cc810fa8c8ce9d0da015ff7f437cac47470f3685369dc8fe7bc1b","observation_id":"5f34887d-bfc9-4ea3-84a8-1a5900ce8322","resolution":{"observed_at":"2026-08-01T21:26:11.083317Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:26:11.197000Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.16094","last_updated":"2026-07-17T16:25:03Z","snapshot_observed_at":"2026-08-08T03:29:38.707478Z","submitted_at":"2026-07-17T16:25:03Z","title":"How Do VLMs Fail? Vision-Operation Misalignment in Compositional VQA","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-01T21:26:11.197000Z"},"links":{"citing_paper":"/paper/2607.16094"},"observation_digest":"sha256:b68ba9359795ef2e9d2aa6393967af73febe92073498abcd3d398a20c0e5203d","observation_id":"4306f21e-bda3-4a08-b948-80ebf296da8e","resolution":{"observed_at":"2026-08-01T21:26:11.197000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:26:11.352114Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.16094","last_updated":"2026-07-17T16:25:03Z","snapshot_observed_at":"2026-08-08T03:29:38.707478Z","submitted_at":"2026-07-17T16:25:03Z","title":"How Do VLMs Fail? Vision-Operation Misalignment in Compositional VQA","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-01T21:26:11.352114Z"},"links":{"citing_paper":"/paper/2607.16094"},"observation_digest":"sha256:b6ea89fa772d7f1dc06167579a721f2887716ef276153fc2e826c907d71e0671","observation_id":"09c3882a-63b1-442f-9f28-527a6fc91b3a","resolution":{"observed_at":"2026-08-01T21:26:11.352114Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:26:11.510363Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16094","last_updated":"2026-07-17T16:25:03Z","snapshot_observed_at":"2026-08-08T03:29:38.707478Z","submitted_at":"2026-07-17T16:25:03Z","title":"How Do VLMs Fail? Vision-Operation Misalignment in Compositional VQA","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-01T21:26:11.510363Z"},"links":{"citing_paper":"/paper/2607.16094"},"observation_digest":"sha256:e37f4d27e51172d710413096329194de6eddb2839cb9402426443cfe445c6888","observation_id":"e83b81ed-fbee-4c64-b4a8-6d1d46ba8fec","resolution":{"observed_at":"2026-08-01T21:26:11.510363Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00569","last_updated":"2025-04-12T02:05:56Z","snapshot_observed_at":"2026-08-09T01:23:29.416963Z","submitted_at":"2024-12-31T17:54:29Z","title":"Probing Visual Language Priors in VLMs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.00569","snapshot_observed_at":"2026-08-01T21:26:11.622982Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.16094","last_updated":"2026-07-17T16:25:03Z","snapshot_observed_at":"2026-08-08T03:29:38.707478Z","submitted_at":"2026-07-17T16:25:03Z","title":"How Do VLMs Fail? Vision-Operation Misalignment in Compositional VQA","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-01T21:26:11.622982Z"},"links":{"cited_paper":"/paper/2501.00569","citing_paper":"/paper/2607.16094"},"observation_digest":"sha256:18e2f4d3badfd94e25a80811524f2969d4bb28f206e82a90b3305702f424b4c6","observation_id":"bb588c93-0540-4aff-9b92-5221881b9536","resolution":{"observed_at":"2026-08-01T21:26:11.622982Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:26:11.662799Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.16094","last_updated":"2026-07-17T16:25:03Z","snapshot_observed_at":"2026-08-08T03:29:38.707478Z","submitted_at":"2026-07-17T16:25:03Z","title":"How Do VLMs Fail? Vision-Operation Misalignment in Compositional VQA","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-01T21:26:11.662799Z"},"links":{"citing_paper":"/paper/2607.16094"},"observation_digest":"sha256:f517eef0d75c80a294de86be1a0ca863370211b30f2b8bf20d46f57aae3c3d1b","observation_id":"068c816c-5ab3-4058-bc17-aaf1e0b3991c","resolution":{"observed_at":"2026-08-01T21:26:11.662799Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:26:11.726974Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.16094","last_updated":"2026-07-17T16:25:03Z","snapshot_observed_at":"2026-08-08T03:29:38.707478Z","submitted_at":"2026-07-17T16:25:03Z","title":"How Do VLMs Fail? Vision-Operation Misalignment in Compositional VQA","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-01T21:26:11.726974Z"},"links":{"citing_paper":"/paper/2607.16094"},"observation_digest":"sha256:6028dac26902ddcae36dbe2890be2e38ff15699eb4bd22767c3edffb5ffb8f84","observation_id":"7a2e62dd-353b-428c-9ad8-6b3e4d87104b","resolution":{"observed_at":"2026-08-01T21:26:11.726974Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:26:11.872903Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16094","last_updated":"2026-07-17T16:25:03Z","snapshot_observed_at":"2026-08-08T03:29:38.707478Z","submitted_at":"2026-07-17T16:25:03Z","title":"How Do VLMs Fail? Vision-Operation Misalignment in Compositional VQA","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-01T21:26:11.872903Z"},"links":{"citing_paper":"/paper/2607.16094"},"observation_digest":"sha256:4f380bb0b2bf36bd4c8c391f5dd42ffca9f47c10c67fd75e7a92b88db1d0232b","observation_id":"d46c534e-992e-402e-adf3-2ed8e25f8377","resolution":{"observed_at":"2026-08-01T21:26:11.872903Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:26:12.107536Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.16094","last_updated":"2026-07-17T16:25:03Z","snapshot_observed_at":"2026-08-08T03:29:38.707478Z","submitted_at":"2026-07-17T16:25:03Z","title":"How Do VLMs Fail? Vision-Operation Misalignment in Compositional VQA","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-01T21:26:12.107536Z"},"links":{"citing_paper":"/paper/2607.16094"},"observation_digest":"sha256:fc7cd07f5239a6b40b053236121608318cb514bddf88e57b6bbba8dc3bfe5914","observation_id":"dd624ca3-7252-4627-9a83-909e2b043e05","resolution":{"observed_at":"2026-08-01T21:26:12.107536Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:26:12.178590Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.16094","last_updated":"2026-07-17T16:25:03Z","snapshot_observed_at":"2026-08-08T03:29:38.707478Z","submitted_at":"2026-07-17T16:25:03Z","title":"How Do VLMs Fail? Vision-Operation Misalignment in Compositional VQA","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-01T21:26:12.178590Z"},"links":{"citing_paper":"/paper/2607.16094"},"observation_digest":"sha256:430fe87edf39e04c34088dc16632840a260150171bda6c6abb0d53d265c14a74","observation_id":"8ec03805-f1b5-4082-8903-079c3136cdb9","resolution":{"observed_at":"2026-08-01T21:26:12.178590Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:26:12.268995Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.16094","last_updated":"2026-07-17T16:25:03Z","snapshot_observed_at":"2026-08-08T03:29:38.707478Z","submitted_at":"2026-07-17T16:25:03Z","title":"How Do VLMs Fail? Vision-Operation Misalignment in Compositional VQA","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-01T21:26:12.268995Z"},"links":{"citing_paper":"/paper/2607.16094"},"observation_digest":"sha256:ede8c515df4016dc32bc42f30eec6cc4a9a4c4f651e3aaf39608c3f09d9f636f","observation_id":"be6bb6f2-7e05-4696-af70-2a7e4f3e9a77","resolution":{"observed_at":"2026-08-01T21:26:12.268995Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:26:12.343480Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.16094","last_updated":"2026-07-17T16:25:03Z","snapshot_observed_at":"2026-08-08T03:29:38.707478Z","submitted_at":"2026-07-17T16:25:03Z","title":"How Do VLMs Fail? Vision-Operation Misalignment in Compositional VQA","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-01T21:26:12.343480Z"},"links":{"citing_paper":"/paper/2607.16094"},"observation_digest":"sha256:a1247c925b8cd43ce5c44b5876ff0700a5e64f65c139e587660b7b15d6c2432c","observation_id":"3fe6c3b0-4d70-44b5-9151-230e5ed0fbe0","resolution":{"observed_at":"2026-08-01T21:26:12.343480Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:26:12.443842Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.16094","last_updated":"2026-07-17T16:25:03Z","snapshot_observed_at":"2026-08-08T03:29:38.707478Z","submitted_at":"2026-07-17T16:25:03Z","title":"How Do VLMs Fail? Vision-Operation Misalignment in Compositional VQA","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-01T21:26:12.443842Z"},"links":{"citing_paper":"/paper/2607.16094"},"observation_digest":"sha256:7c000cbe25e567046c5c57c8d06be3de2cf7eb951c5325120632a6b70dec298e","observation_id":"957726a8-a8fa-4bdc-8ccf-ecf22f66612c","resolution":{"observed_at":"2026-08-01T21:26:12.443842Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10950","last_updated":"2025-01-11T15:51:41Z","snapshot_observed_at":"2026-07-06T19:51:28.494860Z","submitted_at":"2024-11-17T03:32:50Z","title":"Understanding Multimodal LLMs: the Mechanistic Interpretability of Llava in Visual Question Answering","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.10950","snapshot_observed_at":"2026-08-01T21:26:12.501420Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.16094","last_updated":"2026-07-17T16:25:03Z","snapshot_observed_at":"2026-08-08T03:29:38.707478Z","submitted_at":"2026-07-17T16:25:03Z","title":"How Do VLMs Fail? Vision-Operation Misalignment in Compositional VQA","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-01T21:26:12.501420Z"},"links":{"cited_paper":"/paper/2411.10950","citing_paper":"/paper/2607.16094"},"observation_digest":"sha256:bbf3b676c20ce3ceb4e1cfdb496adaf4e90cf813a9bf0050df131b35c48ce179","observation_id":"19c52fda-037a-4ec6-ad48-f4c50c0d210f","resolution":{"observed_at":"2026-08-01T21:26:12.501420Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:26:12.596676Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16094","last_updated":"2026-07-17T16:25:03Z","snapshot_observed_at":"2026-08-08T03:29:38.707478Z","submitted_at":"2026-07-17T16:25:03Z","title":"How Do VLMs Fail? Vision-Operation Misalignment in Compositional VQA","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-01T21:26:12.596676Z"},"links":{"citing_paper":"/paper/2607.16094"},"observation_digest":"sha256:0c87538d1c43c6c9e3ba277d3f09c89ede7e75c4717cac46d99b566c781bee90","observation_id":"a1f14d05-cbfc-43b4-951e-426a635064f6","resolution":{"observed_at":"2026-08-01T21:26:12.596676Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:26:12.689280Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.16094","last_updated":"2026-07-17T16:25:03Z","snapshot_observed_at":"2026-08-08T03:29:38.707478Z","submitted_at":"2026-07-17T16:25:03Z","title":"How Do VLMs Fail? Vision-Operation Misalignment in Compositional VQA","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-01T21:26:12.689280Z"},"links":{"citing_paper":"/paper/2607.16094"},"observation_digest":"sha256:46cc0b1e896d3a3516588b2cc439a04cd4c4d769db7caeab1ec097c309b15ee5","observation_id":"aa9b03dd-23dd-47c3-ad1e-97cabd7188bc","resolution":{"observed_at":"2026-08-01T21:26:12.689280Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:26:12.733736Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.16094","last_updated":"2026-07-17T16:25:03Z","snapshot_observed_at":"2026-08-08T03:29:38.707478Z","submitted_at":"2026-07-17T16:25:03Z","title":"How Do VLMs Fail? Vision-Operation Misalignment in Compositional VQA","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-01T21:26:12.733736Z"},"links":{"citing_paper":"/paper/2607.16094"},"observation_digest":"sha256:3f3b642299517bc5bcc4d2bb406f0d15a8f0655e48add104d8d270f52b4c4574","observation_id":"37bae0dd-b13c-4f86-8f81-aeca4ca86197","resolution":{"observed_at":"2026-08-01T21:26:12.733736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:26:12.756909Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16094","last_updated":"2026-07-17T16:25:03Z","snapshot_observed_at":"2026-08-08T03:29:38.707478Z","submitted_at":"2026-07-17T16:25:03Z","title":"How Do VLMs Fail? Vision-Operation Misalignment in Compositional VQA","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-01T21:26:12.756909Z"},"links":{"citing_paper":"/paper/2607.16094"},"observation_digest":"sha256:e76ed2cc552a02c7101978ee862f2b836531486fe6ab44ddb465add50cfa83ad","observation_id":"658c5cfa-036a-4f9a-bd20-4adb98acc026","resolution":{"observed_at":"2026-08-01T21:26:12.756909Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07149","last_updated":"2025-04-26T06:47:21Z","snapshot_observed_at":"2026-08-03T16:26:26.684826Z","submitted_at":"2024-10-09T17:55:02Z","title":"Towards Interpreting Visual Information Processing in Vision-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.07149","snapshot_observed_at":"2026-08-01T21:26:11.993187Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.16094","last_updated":"2026-07-17T16:25:03Z","snapshot_observed_at":"2026-08-08T03:29:38.707478Z","submitted_at":"2026-07-17T16:25:03Z","title":"How Do VLMs Fail? Vision-Operation Misalignment in Compositional VQA","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-01T21:26:11.993187Z"},"links":{"cited_paper":"/paper/2410.07149","citing_paper":"/paper/2607.16094"},"observation_digest":"sha256:e24f49b77ecdad1fc5d5c686435a3bac6b41ae2bbbe96e0def706b42d85874e7","observation_id":"287e32b1-9179-496c-a116-d6747c979a3e","resolution":{"observed_at":"2026-08-01T21:26:11.993187Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:26:10.699908Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16094","last_updated":"2026-07-17T16:25:03Z","snapshot_observed_at":"2026-08-08T03:29:38.707478Z","submitted_at":"2026-07-17T16:25:03Z","title":"How Do VLMs Fail? Vision-Operation Misalignment in Compositional VQA","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-01T21:26:10.699908Z"},"links":{"citing_paper":"/paper/2607.16094"},"observation_digest":"sha256:da4d8c5bd57436ec7cbe39776a92d266cfc279e17ac7f10b4745fae1340fd6f5","observation_id":"02286548-cc48-457c-aaed-b4e36ec42a43","resolution":{"observed_at":"2026-08-01T21:26:10.699908Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.16094","last_updated":"2026-07-17T16:25:03Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-08T03:29:38.707478Z","submitted_at":"2026-07-17T16:25:03Z","title":"How Do VLMs Fail? Vision-Operation Misalignment in Compositional VQA"},"reference_resolution":{"displayed":36,"state_counts":{"malformed_identifier":2,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":34,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":36},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 36 of 36 outbound references and 0 inbound Pith citation observations for arXiv:2607.16094."}