{"as_of":"2026-08-08T12:26:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:929111d408f14f8282102c708417d36f08bd668880e16c6aaaa100fd93d86571","coverage":[{"denominator":54,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":54,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T01:41:52.790018Z","state":"measured"},{"denominator":54,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":54,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.00035/citation-record","integrity":"/paper/2608.00035/integrity","json":"/paper/2608.00035/citation-record.json","paper":"/paper/2608.00035"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:41:48.020126Z","title":"Advances in Neural Information Processing Systems , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00035","last_updated":"2026-07-21T06:06:20Z","snapshot_observed_at":"2026-08-06T23:11:32.830225Z","submitted_at":"2026-07-21T06:06:20Z","title":"Linguistic Context Recodes Visual Representations in Vision-Language Models","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-04T01:41:48.020126Z"},"links":{"citing_paper":"/paper/2608.00035"},"observation_digest":"sha256:c87afda8ae9f79c3d11018341db18574b155697b1da83e5b298503f1f95e665a","observation_id":"dfee5729-b931-416a-ba3c-141d1ccdfff7","resolution":{"observed_at":"2026-08-04T01:41:48.020126Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:41:48.082491Z","title":"2024 , eprint=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.00035","last_updated":"2026-07-21T06:06:20Z","snapshot_observed_at":"2026-08-06T23:11:32.830225Z","submitted_at":"2026-07-21T06:06:20Z","title":"Linguistic Context Recodes Visual Representations in Vision-Language Models","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-04T01:41:48.082491Z"},"links":{"citing_paper":"/paper/2608.00035"},"observation_digest":"sha256:b0d8b23da580e03aba43113fdeefc91236e27b8365f470753ca6133c43e927fc","observation_id":"053bb094-7277-4aec-99ed-ee596018b2dc","resolution":{"observed_at":"2026-08-04T01:41:48.082491Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:41:48.159216Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.00035","last_updated":"2026-07-21T06:06:20Z","snapshot_observed_at":"2026-08-06T23:11:32.830225Z","submitted_at":"2026-07-21T06:06:20Z","title":"Linguistic Context Recodes Visual Representations in Vision-Language Models","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-04T01:41:48.159216Z"},"links":{"citing_paper":"/paper/2608.00035"},"observation_digest":"sha256:e83865a4757deabea5281674d76e709e9314abd0b9c551c7d9c37ff769dd22fc","observation_id":"3d4998af-a871-4d78-8947-de5c6d7ac9e0","resolution":{"observed_at":"2026-08-04T01:41:48.159216Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:41:48.222563Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.00035","last_updated":"2026-07-21T06:06:20Z","snapshot_observed_at":"2026-08-06T23:11:32.830225Z","submitted_at":"2026-07-21T06:06:20Z","title":"Linguistic Context Recodes Visual Representations in Vision-Language Models","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-04T01:41:48.222563Z"},"links":{"citing_paper":"/paper/2608.00035"},"observation_digest":"sha256:5435ba15e533e78bb2e53e8c9a1b7bd58e361fd956e3a0b1d00ab28912cab293","observation_id":"672794b9-9de8-4c37-8c1b-47448aa35de4","resolution":{"observed_at":"2026-08-04T01:41:48.222563Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03659","last_updated":"2024-10-11T15:07:31Z","snapshot_observed_at":"2026-08-05T12:32:26.990966Z","submitted_at":"2024-10-04T17:59:28Z","title":"Unraveling Cross-Modality Knowledge Conflicts in Large Vision-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.03659","snapshot_observed_at":"2026-08-04T01:41:48.311245Z","title":"arXiv preprint arXiv:2410.03659 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00035","last_updated":"2026-07-21T06:06:20Z","snapshot_observed_at":"2026-08-06T23:11:32.830225Z","submitted_at":"2026-07-21T06:06:20Z","title":"Linguistic Context Recodes Visual Representations in Vision-Language Models","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-04T01:41:48.311245Z"},"links":{"cited_paper":"/paper/2410.03659","citing_paper":"/paper/2608.00035"},"observation_digest":"sha256:f19336adc1cd67a90a304a32bc4efb4c06ec7f528b68c66e5a238211cc525b2f","observation_id":"04db053e-d3c9-4ac9-86c3-f893bf014338","resolution":{"observed_at":"2026-08-04T01:41:48.311245Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:41:48.370513Z","title":"The Thirteenth International Conference on Learning Representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00035","last_updated":"2026-07-21T06:06:20Z","snapshot_observed_at":"2026-08-06T23:11:32.830225Z","submitted_at":"2026-07-21T06:06:20Z","title":"Linguistic Context Recodes Visual Representations in Vision-Language Models","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-04T01:41:48.370513Z"},"links":{"citing_paper":"/paper/2608.00035"},"observation_digest":"sha256:d157c053e37d641a67f433446f5126efdd0ab8c033f8a89f9807c0fb0efd89b5","observation_id":"2e5efe44-4f5e-4caf-9672-4a59c545ca4d","resolution":{"observed_at":"2026-08-04T01:41:48.370513Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:41:48.440068Z","title":"Frontiers in Systems Neuroscience , volume=","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2608.00035","last_updated":"2026-07-21T06:06:20Z","snapshot_observed_at":"2026-08-06T23:11:32.830225Z","submitted_at":"2026-07-21T06:06:20Z","title":"Linguistic Context Recodes Visual Representations in Vision-Language Models","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-04T01:41:48.440068Z"},"links":{"citing_paper":"/paper/2608.00035"},"observation_digest":"sha256:cd3fdab7ce2f61aeb742bb0f6d13f5f3be092f8fd15e03a53a1862bf732c891b","observation_id":"3034f0fe-d064-4575-99cb-f53626abcf76","resolution":{"observed_at":"2026-08-04T01:41:48.440068Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:41:48.527872Z","title":"The Fourteenth International Conference on Learning Representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00035","last_updated":"2026-07-21T06:06:20Z","snapshot_observed_at":"2026-08-06T23:11:32.830225Z","submitted_at":"2026-07-21T06:06:20Z","title":"Linguistic Context Recodes Visual Representations in Vision-Language Models","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-04T01:41:48.527872Z"},"links":{"citing_paper":"/paper/2608.00035"},"observation_digest":"sha256:a8d87304241bd5497988f5a81c9712993d65bcdb985fc753a1099084a21c9284","observation_id":"0962432a-affc-456c-904b-1ffb5e99cc36","resolution":{"observed_at":"2026-08-04T01:41:48.527872Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.17699","last_updated":"2026-04-20T12:27:33Z","snapshot_observed_at":"2026-07-06T22:36:40.133596Z","submitted_at":"2025-11-21T18:48:22Z","title":"Understanding Counting Mechanisms in Large Language and Vision-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.17699","snapshot_observed_at":"2026-08-04T01:41:48.610436Z","title":"arXiv preprint arXiv:2511.17699 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00035","last_updated":"2026-07-21T06:06:20Z","snapshot_observed_at":"2026-08-06T23:11:32.830225Z","submitted_at":"2026-07-21T06:06:20Z","title":"Linguistic Context Recodes Visual Representations in Vision-Language Models","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-04T01:41:48.610436Z"},"links":{"cited_paper":"/paper/2511.17699","citing_paper":"/paper/2608.00035"},"observation_digest":"sha256:b5684b624e1081c349793f1439f0b97b1b301626b4b3edb05afbc8c8533093bf","observation_id":"3e0339f7-89b3-4509-bb01-1f0aedb40cc8","resolution":{"observed_at":"2026-08-04T01:41:48.610436Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.10479","last_updated":"2025-04-19T03:47:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-14T17:59:25Z","title":"InternVL3: Exploring Advanced Training and Test-Time Recipes for Open-Source Multimodal Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.10479","snapshot_observed_at":"2026-08-04T01:41:48.669793Z","title":"arXiv preprint arXiv:2504.10479 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00035","last_updated":"2026-07-21T06:06:20Z","snapshot_observed_at":"2026-08-06T23:11:32.830225Z","submitted_at":"2026-07-21T06:06:20Z","title":"Linguistic Context Recodes Visual Representations in Vision-Language Models","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-04T01:41:48.669793Z"},"links":{"cited_paper":"/paper/2504.10479","citing_paper":"/paper/2608.00035"},"observation_digest":"sha256:979e01af262b4b968fa75bf5565aa2e08cf1222040bc830ee145df5bb2ae10cf","observation_id":"03b3ab42-6e6a-4a91-aa45-d905695394ce","resolution":{"observed_at":"2026-08-04T01:41:48.669793Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:41:48.753947Z","title":"2020 , howpublished=","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.00035","last_updated":"2026-07-21T06:06:20Z","snapshot_observed_at":"2026-08-06T23:11:32.830225Z","submitted_at":"2026-07-21T06:06:20Z","title":"Linguistic Context Recodes Visual Representations in Vision-Language Models","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-04T01:41:48.753947Z"},"links":{"citing_paper":"/paper/2608.00035"},"observation_digest":"sha256:afb31b5ff8ba672ca9c6cea704f66aea3a12a4608f6e9943175d216d3c662426","observation_id":"33a9e7ff-842f-4dc5-9010-338080c3f4c2","resolution":{"observed_at":"2026-08-04T01:41:48.753947Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:41:48.812194Z","title":"2026 , eprint=","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.00035","last_updated":"2026-07-21T06:06:20Z","snapshot_observed_at":"2026-08-06T23:11:32.830225Z","submitted_at":"2026-07-21T06:06:20Z","title":"Linguistic Context Recodes Visual Representations in Vision-Language Models","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-04T01:41:48.812194Z"},"links":{"citing_paper":"/paper/2608.00035"},"observation_digest":"sha256:f38632452426f28fdf43e04658f22a27d2462d4abcc99f36aff8336118df368f","observation_id":"e793fc7d-4205-4d96-b715-e3a69a6c225c","resolution":{"observed_at":"2026-08-04T01:41:48.812194Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:41:48.868097Z","title":"The Dual Mechanisms of Spatial Reasoning in Vision","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.00035","last_updated":"2026-07-21T06:06:20Z","snapshot_observed_at":"2026-08-06T23:11:32.830225Z","submitted_at":"2026-07-21T06:06:20Z","title":"Linguistic Context Recodes Visual Representations in Vision-Language Models","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-04T01:41:48.868097Z"},"links":{"citing_paper":"/paper/2608.00035"},"observation_digest":"sha256:f2099c5c32c13a6608c609f4370ab06469ff23580f3e18729d0524853a6ffec4","observation_id":"d49f2042-4838-44ae-9ecc-47a75a972b75","resolution":{"observed_at":"2026-08-04T01:41:48.868097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:41:48.916290Z","title":"Interpreting","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.00035","last_updated":"2026-07-21T06:06:20Z","snapshot_observed_at":"2026-08-06T23:11:32.830225Z","submitted_at":"2026-07-21T06:06:20Z","title":"Linguistic Context Recodes Visual Representations in Vision-Language Models","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-04T01:41:48.916290Z"},"links":{"citing_paper":"/paper/2608.00035"},"observation_digest":"sha256:9c45e87727dfa9060cf68f091809e8e61a31144e761939e5852ce384b266c037","observation_id":"28e84ce1-972d-447a-8773-7f8e82f1fb97","resolution":{"observed_at":"2026-08-04T01:41:48.916290Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:41:48.976443Z","title":"The Fourteenth International Conference on Learning Representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00035","last_updated":"2026-07-21T06:06:20Z","snapshot_observed_at":"2026-08-06T23:11:32.830225Z","submitted_at":"2026-07-21T06:06:20Z","title":"Linguistic Context Recodes Visual Representations in Vision-Language Models","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-04T01:41:48.976443Z"},"links":{"citing_paper":"/paper/2608.00035"},"observation_digest":"sha256:5967212da15b05d0279424fd3a44cf066c05322aacd71042c80bee6c304ab6b3","observation_id":"9b3d87c3-d3e8-4ccb-a375-38bb65ff0f2e","resolution":{"observed_at":"2026-08-04T01:41:48.976443Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:41:49.030952Z","title":"Towards Vision-Language Mechanistic Interpretability: A Causal Tracing Tool for","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.00035","last_updated":"2026-07-21T06:06:20Z","snapshot_observed_at":"2026-08-06T23:11:32.830225Z","submitted_at":"2026-07-21T06:06:20Z","title":"Linguistic Context Recodes Visual Representations in Vision-Language Models","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-04T01:41:49.030952Z"},"links":{"citing_paper":"/paper/2608.00035"},"observation_digest":"sha256:88d9398f647cfb219a408f08818bc8cfbc60fa86c312efe70a72b4cb5ce4b1be","observation_id":"3f9951c3-51ee-4c2f-8c36-bd01ad115b69","resolution":{"observed_at":"2026-08-04T01:41:49.030952Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:41:49.077474Z","title":"The Thirteenth International Conference on Learning Representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00035","last_updated":"2026-07-21T06:06:20Z","snapshot_observed_at":"2026-08-06T23:11:32.830225Z","submitted_at":"2026-07-21T06:06:20Z","title":"Linguistic Context Recodes Visual Representations in Vision-Language Models","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-04T01:41:49.077474Z"},"links":{"citing_paper":"/paper/2608.00035"},"observation_digest":"sha256:2588191bec37fe944a1675b4a082788ca1fc63239089cbc09dfaed38f18f2ec7","observation_id":"1f0f955c-3e5a-4ce0-b269-f9fcdcec09d4","resolution":{"observed_at":"2026-08-04T01:41:49.077474Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:41:49.132582Z","title":"The Eleventh International Conference on Learning Representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00035","last_updated":"2026-07-21T06:06:20Z","snapshot_observed_at":"2026-08-06T23:11:32.830225Z","submitted_at":"2026-07-21T06:06:20Z","title":"Linguistic Context Recodes Visual Representations in Vision-Language Models","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-04T01:41:49.132582Z"},"links":{"citing_paper":"/paper/2608.00035"},"observation_digest":"sha256:516b267eac90d08c763269ff6b64333cd7c9251fb44ba28aa29782ae1c197de9","observation_id":"1db1ce9a-1f10-4724-ad9b-e88d3347de29","resolution":{"observed_at":"2026-08-04T01:41:49.132582Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:41:49.194239Z","title":"The Thirteenth International Conference on Learning Representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00035","last_updated":"2026-07-21T06:06:20Z","snapshot_observed_at":"2026-08-06T23:11:32.830225Z","submitted_at":"2026-07-21T06:06:20Z","title":"Linguistic Context Recodes Visual Representations in Vision-Language Models","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-04T01:41:49.194239Z"},"links":{"citing_paper":"/paper/2608.00035"},"observation_digest":"sha256:16312cc1cd6917bf93d19074e218b801b4e6b5fbdfcafb68f3a5e6bac36311f9","observation_id":"dbad24b9-4696-46ed-85fa-ce428078cd60","resolution":{"observed_at":"2026-08-04T01:41:49.194239Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:41:49.248008Z","title":"Microsoft","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2608.00035","last_updated":"2026-07-21T06:06:20Z","snapshot_observed_at":"2026-08-06T23:11:32.830225Z","submitted_at":"2026-07-21T06:06:20Z","title":"Linguistic Context Recodes Visual Representations in Vision-Language Models","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-04T01:41:49.248008Z"},"links":{"citing_paper":"/paper/2608.00035"},"observation_digest":"sha256:231c3c0eb058e50822441482cae86231843a7aeae9293c4d7136c2d02a0d9a57","observation_id":"3f340552-bd36-4b8a-99cc-eba97fbccd38","resolution":{"observed_at":"2026-08-04T01:41:49.248008Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:41:49.309490Z","title":"Annual Review of Neuroscience , volume=","venue":null,"work_id":null,"year":1995},"citing_paper":{"arxiv_id":"2608.00035","last_updated":"2026-07-21T06:06:20Z","snapshot_observed_at":"2026-08-06T23:11:32.830225Z","submitted_at":"2026-07-21T06:06:20Z","title":"Linguistic Context Recodes Visual Representations in Vision-Language Models","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-04T01:41:49.309490Z"},"links":{"citing_paper":"/paper/2608.00035"},"observation_digest":"sha256:8f5ade7c01da28c5186e9438e6b26b4e892c5ac48285b62890d7945a03efd48b","observation_id":"c9fb585a-8092-4f9a-b0ff-1b6d7a61a78c","resolution":{"observed_at":"2026-08-04T01:41:49.309490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:41:49.429087Z","title":"Journal of Experimental Psychology: General , volume=","venue":null,"work_id":null,"year":1984},"citing_paper":{"arxiv_id":"2608.00035","last_updated":"2026-07-21T06:06:20Z","snapshot_observed_at":"2026-08-06T23:11:32.830225Z","submitted_at":"2026-07-21T06:06:20Z","title":"Linguistic Context Recodes Visual Representations in Vision-Language Models","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-04T01:41:49.429087Z"},"links":{"citing_paper":"/paper/2608.00035"},"observation_digest":"sha256:3c6a92da67913c01b4b648feaf0e8ac3b97154fb256cbc3588ca861f32409555","observation_id":"4e188b82-8355-42e3-92f1-725984681e0d","resolution":{"observed_at":"2026-08-04T01:41:49.429087Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:41:49.530032Z","title":"Nature Reviews Neuroscience , volume=","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2608.00035","last_updated":"2026-07-21T06:06:20Z","snapshot_observed_at":"2026-08-06T23:11:32.830225Z","submitted_at":"2026-07-21T06:06:20Z","title":"Linguistic Context Recodes Visual Representations in Vision-Language Models","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-04T01:41:49.530032Z"},"links":{"citing_paper":"/paper/2608.00035"},"observation_digest":"sha256:5b25d76f0c4ff2f17615799af3fee5373bded84674b303b69328edc56630ef2c","observation_id":"afa70351-04f9-40d7-b9fa-c7689effb5ca","resolution":{"observed_at":"2026-08-04T01:41:49.530032Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:41:49.589093Z","title":"The Twelfth International Conference on Learning Representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00035","last_updated":"2026-07-21T06:06:20Z","snapshot_observed_at":"2026-08-06T23:11:32.830225Z","submitted_at":"2026-07-21T06:06:20Z","title":"Linguistic Context Recodes Visual Representations in Vision-Language Models","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-04T01:41:49.589093Z"},"links":{"citing_paper":"/paper/2608.00035"},"observation_digest":"sha256:f9cd6b03037e54ae49ff1be37449d2ee8bf78a613968ede029afb312d5dc8e2f","observation_id":"7bdd577f-d83e-4b5e-89eb-7a4e678f24b5","resolution":{"observed_at":"2026-08-04T01:41:49.589093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:41:49.670941Z","title":"and Nye, Maxwell and Andreas, Jacob","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.00035","last_updated":"2026-07-21T06:06:20Z","snapshot_observed_at":"2026-08-06T23:11:32.830225Z","submitted_at":"2026-07-21T06:06:20Z","title":"Linguistic Context Recodes Visual Representations in Vision-Language Models","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-04T01:41:49.670941Z"},"links":{"citing_paper":"/paper/2608.00035"},"observation_digest":"sha256:4dafec1cb2588e89c095cabc01c39fcc25e4986a9811ef2b91e6c0a5c6d63f34","observation_id":"75ae13f7-5aab-4e80-af3e-ce9e55e50069","resolution":{"observed_at":"2026-08-04T01:41:49.670941Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:41:49.756268Z","title":"Steering Llama 2 via Contrastive Activation Addition","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.00035","last_updated":"2026-07-21T06:06:20Z","snapshot_observed_at":"2026-08-06T23:11:32.830225Z","submitted_at":"2026-07-21T06:06:20Z","title":"Linguistic Context Recodes Visual Representations in Vision-Language Models","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-04T01:41:49.756268Z"},"links":{"citing_paper":"/paper/2608.00035"},"observation_digest":"sha256:b3d2620c5592eb86a6d65f2410ae987846dcbeae56a6185782cbb0ed231aa73c","observation_id":"b2ad89c8-8b87-438c-8be9-aa75b354c6fa","resolution":{"observed_at":"2026-08-04T01:41:49.756268Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.10248","last_updated":"2024-10-10T13:20:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-20T12:21:05Z","title":"Steering Language Models With Activation Engineering","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.10248","snapshot_observed_at":"2026-08-04T01:41:49.836398Z","title":"arXiv preprint arXiv:2308.10248 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00035","last_updated":"2026-07-21T06:06:20Z","snapshot_observed_at":"2026-08-06T23:11:32.830225Z","submitted_at":"2026-07-21T06:06:20Z","title":"Linguistic Context Recodes Visual Representations in Vision-Language Models","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-04T01:41:49.836398Z"},"links":{"cited_paper":"/paper/2308.10248","citing_paper":"/paper/2608.00035"},"observation_digest":"sha256:149cbd852916d4caf9559220aee06b1a30c91029b36bce9fd6b5f7e5ce3ce4ba","observation_id":"67ec1450-bdfc-43d4-a6c9-dba7c501adc8","resolution":{"observed_at":"2026-08-04T01:41:49.836398Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:41:49.918778Z","title":"Thirty-seventh Conference on Neural Information Processing Systems , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00035","last_updated":"2026-07-21T06:06:20Z","snapshot_observed_at":"2026-08-06T23:11:32.830225Z","submitted_at":"2026-07-21T06:06:20Z","title":"Linguistic Context Recodes Visual Representations in Vision-Language Models","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-04T01:41:49.918778Z"},"links":{"citing_paper":"/paper/2608.00035"},"observation_digest":"sha256:e123d47abb707a8b3e62db4714e6f94353ce7e118565f6a3dfb925939844d307","observation_id":"884e03d6-1da6-4aec-9a8c-acf3d88df76a","resolution":{"observed_at":"2026-08-04T01:41:49.918778Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:41:49.982179Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.00035","last_updated":"2026-07-21T06:06:20Z","snapshot_observed_at":"2026-08-06T23:11:32.830225Z","submitted_at":"2026-07-21T06:06:20Z","title":"Linguistic Context Recodes Visual Representations in Vision-Language Models","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-04T01:41:49.982179Z"},"links":{"citing_paper":"/paper/2608.00035"},"observation_digest":"sha256:2e4582d50dbbd6a6a63db995bed1c71ace979340f6d2e42fea6d9623eb6fa600","observation_id":"1576de44-9c75-4bec-81cf-2853d404b97c","resolution":{"observed_at":"2026-08-04T01:41:49.982179Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:41:50.046825Z","title":"The Thirty-eighth Annual Conference on Neural Information Processing Systems , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00035","last_updated":"2026-07-21T06:06:20Z","snapshot_observed_at":"2026-08-06T23:11:32.830225Z","submitted_at":"2026-07-21T06:06:20Z","title":"Linguistic Context Recodes Visual Representations in Vision-Language Models","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-04T01:41:50.046825Z"},"links":{"citing_paper":"/paper/2608.00035"},"observation_digest":"sha256:d91228d07b081987c16acdb866cb42bd5ac3866d74a7514651f7cd351d2834ce","observation_id":"c73c79c8-c911-4818-8b88-6a55b5d4954b","resolution":{"observed_at":"2026-08-04T01:41:50.046825Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:41:50.091749Z","title":"Same Task, Different Circuits: Disentangling Modality-Specific Mechanisms in","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.00035","last_updated":"2026-07-21T06:06:20Z","snapshot_observed_at":"2026-08-06T23:11:32.830225Z","submitted_at":"2026-07-21T06:06:20Z","title":"Linguistic Context Recodes Visual Representations in Vision-Language Models","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-04T01:41:50.091749Z"},"links":{"citing_paper":"/paper/2608.00035"},"observation_digest":"sha256:1107ef6fe4d3d452cd75857d63c27e1d9c3ad1be625e5fa724f81ba2e131d836","observation_id":"ce2f0005-30f7-43c5-a1b5-e947a7969e50","resolution":{"observed_at":"2026-08-04T01:41:50.091749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:41:50.147575Z","title":"The Thirty-eighth Annual Conference on Neural Information Processing Systems , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00035","last_updated":"2026-07-21T06:06:20Z","snapshot_observed_at":"2026-08-06T23:11:32.830225Z","submitted_at":"2026-07-21T06:06:20Z","title":"Linguistic Context Recodes Visual Representations in Vision-Language Models","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-04T01:41:50.147575Z"},"links":{"citing_paper":"/paper/2608.00035"},"observation_digest":"sha256:85c9332a39eb364fda04f1d7a1305bdcc2c0132c2ce9dcb3eb87fdb9dc5df546","observation_id":"6ee14402-ff0f-450c-8f3b-e93cde77dc1f","resolution":{"observed_at":"2026-08-04T01:41:50.147575Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:41:50.219989Z","title":"2022 , pages =","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.00035","last_updated":"2026-07-21T06:06:20Z","snapshot_observed_at":"2026-08-06T23:11:32.830225Z","submitted_at":"2026-07-21T06:06:20Z","title":"Linguistic Context Recodes Visual Representations in Vision-Language Models","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-04T01:41:50.219989Z"},"links":{"citing_paper":"/paper/2608.00035"},"observation_digest":"sha256:7a2702c04851b9fb037468ab1499e6d2c91026d0dac676092e305450ba1351e2","observation_id":"f28e719e-605d-4db5-a81e-f644b77c6c00","resolution":{"observed_at":"2026-08-04T01:41:50.219989Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:41:50.352731Z","title":"The Eleventh International Conference on Learning Representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00035","last_updated":"2026-07-21T06:06:20Z","snapshot_observed_at":"2026-08-06T23:11:32.830225Z","submitted_at":"2026-07-21T06:06:20Z","title":"Linguistic Context Recodes Visual Representations in Vision-Language Models","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-04T01:41:50.352731Z"},"links":{"citing_paper":"/paper/2608.00035"},"observation_digest":"sha256:df5758a6d5ec5fe60cb0da4838b6fde791cadcd6f93948b03fa3db37d897b165","observation_id":"72c6feac-0a1e-4668-a0b9-7b9f46c9ff4b","resolution":{"observed_at":"2026-08-04T01:41:50.352731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:41:50.379826Z","title":"The 2023 Conference on Empirical Methods in Natural Language Processing , year=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.00035","last_updated":"2026-07-21T06:06:20Z","snapshot_observed_at":"2026-08-06T23:11:32.830225Z","submitted_at":"2026-07-21T06:06:20Z","title":"Linguistic Context Recodes Visual Representations in Vision-Language Models","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-04T01:41:50.379826Z"},"links":{"citing_paper":"/paper/2608.00035"},"observation_digest":"sha256:81863ccbcf763c014bc6912490262b1bc8a94538671e0098f9f3e83d5f73ae30","observation_id":"a3d77227-a503-4f19-90fb-4ab694900c6b","resolution":{"observed_at":"2026-08-04T01:41:50.379826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:41:50.484560Z","title":"What Do VLM s NOTICE ? A Mechanistic Interpretability Pipeline for G aussian-Noise-free Text-Image Corruption and Evaluation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.00035","last_updated":"2026-07-21T06:06:20Z","snapshot_observed_at":"2026-08-06T23:11:32.830225Z","submitted_at":"2026-07-21T06:06:20Z","title":"Linguistic Context Recodes Visual Representations in Vision-Language Models","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-04T01:41:50.484560Z"},"links":{"citing_paper":"/paper/2608.00035"},"observation_digest":"sha256:774e8e5cc54a743aa47b331a510b482f918e6d697dc491f1a4e3c65331805bd2","observation_id":"1d7ffd93-f5a8-43fc-96bd-5d6f0780afcb","resolution":{"observed_at":"2026-08-04T01:41:50.484560Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:41:50.566782Z","title":"Second Conference on Language Modeling , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00035","last_updated":"2026-07-21T06:06:20Z","snapshot_observed_at":"2026-08-06T23:11:32.830225Z","submitted_at":"2026-07-21T06:06:20Z","title":"Linguistic Context Recodes Visual Representations in Vision-Language Models","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-04T01:41:50.566782Z"},"links":{"citing_paper":"/paper/2608.00035"},"observation_digest":"sha256:fbad75bed01e800550df833f369aec9b707ea468ea62eee8bd245dd24dad118c","observation_id":"3f58b34e-02db-4025-aef0-3f8bf99a7b9e","resolution":{"observed_at":"2026-08-04T01:41:50.566782Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:41:50.718657Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00035","last_updated":"2026-07-21T06:06:20Z","snapshot_observed_at":"2026-08-06T23:11:32.830225Z","submitted_at":"2026-07-21T06:06:20Z","title":"Linguistic Context Recodes Visual Representations in Vision-Language Models","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-04T01:41:50.718657Z"},"links":{"citing_paper":"/paper/2608.00035"},"observation_digest":"sha256:855ffdeed719e3959073019903df50b483549c54cc4b9c98d5e27a6550132e94","observation_id":"55ad2e8d-eb56-4577-bc43-447c1c95969d","resolution":{"observed_at":"2026-08-04T01:41:50.718657Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.19786","last_updated":"2025-03-25T15:52:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-25T15:52:34Z","title":"Gemma 3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.19786","snapshot_observed_at":"2026-08-04T01:41:50.827627Z","title":"arXiv preprint arXiv:2503.19786 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00035","last_updated":"2026-07-21T06:06:20Z","snapshot_observed_at":"2026-08-06T23:11:32.830225Z","submitted_at":"2026-07-21T06:06:20Z","title":"Linguistic Context Recodes Visual Representations in Vision-Language Models","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-04T01:41:50.827627Z"},"links":{"cited_paper":"/paper/2503.19786","citing_paper":"/paper/2608.00035"},"observation_digest":"sha256:a42703706631812a4f0f43ad65238fcda91e8790b0cee4a692c1ff7b4ef50e44","observation_id":"1a3bb554-a7de-463a-b148-2edb7dc6ceb9","resolution":{"observed_at":"2026-08-04T01:41:50.827627Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:41:50.936588Z","title":"Advances in Neural Information Processing Systems , editor=","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.00035","last_updated":"2026-07-21T06:06:20Z","snapshot_observed_at":"2026-08-06T23:11:32.830225Z","submitted_at":"2026-07-21T06:06:20Z","title":"Linguistic Context Recodes Visual Representations in Vision-Language Models","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-04T01:41:50.936588Z"},"links":{"citing_paper":"/paper/2608.00035"},"observation_digest":"sha256:880977a0168839cf748510f02519cd17d95484db59f95b9bf756b7a0d0631f58","observation_id":"58fcd580-49d3-4457-84fc-b9f5a0c31728","resolution":{"observed_at":"2026-08-04T01:41:50.936588Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:41:51.048549Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.00035","last_updated":"2026-07-21T06:06:20Z","snapshot_observed_at":"2026-08-06T23:11:32.830225Z","submitted_at":"2026-07-21T06:06:20Z","title":"Linguistic Context Recodes Visual Representations in Vision-Language Models","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-04T01:41:51.048549Z"},"links":{"citing_paper":"/paper/2608.00035"},"observation_digest":"sha256:d976b0522b650b8063dff1793ccb8f461b607020c125bd8495869b299b00b1ac","observation_id":"8d506ff9-d069-4d7e-9567-dec42e6dbba7","resolution":{"observed_at":"2026-08-04T01:41:51.048549Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:41:51.150732Z","title":"Lawrence Zitnick and Devi Parikh , title =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00035","last_updated":"2026-07-21T06:06:20Z","snapshot_observed_at":"2026-08-06T23:11:32.830225Z","submitted_at":"2026-07-21T06:06:20Z","title":"Linguistic Context Recodes Visual Representations in Vision-Language Models","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-04T01:41:51.150732Z"},"links":{"citing_paper":"/paper/2608.00035"},"observation_digest":"sha256:72b7d96e9a96076cd9e85146cd1ccf58828f9021496cd57086267192ad045948","observation_id":"1c0990fa-4269-4e1a-9fa8-4f115a681dbb","resolution":{"observed_at":"2026-08-04T01:41:51.150732Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:41:51.260870Z","title":"Does Object Binding Naturally Emerge in Large Pretrained Vision Transformers? , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00035","last_updated":"2026-07-21T06:06:20Z","snapshot_observed_at":"2026-08-06T23:11:32.830225Z","submitted_at":"2026-07-21T06:06:20Z","title":"Linguistic Context Recodes Visual Representations in Vision-Language Models","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-04T01:41:51.260870Z"},"links":{"citing_paper":"/paper/2608.00035"},"observation_digest":"sha256:6608e1a48574d7dcb695c599b5d297b96bd578efe32ed29c4446dfe958107605","observation_id":"370b014c-8e10-455c-9d0e-449b2c7213e4","resolution":{"observed_at":"2026-08-04T01:41:51.260870Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:41:51.406230Z","title":"science , volume=","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2608.00035","last_updated":"2026-07-21T06:06:20Z","snapshot_observed_at":"2026-08-06T23:11:32.830225Z","submitted_at":"2026-07-21T06:06:20Z","title":"Linguistic Context Recodes Visual Representations in Vision-Language Models","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-04T01:41:51.406230Z"},"links":{"citing_paper":"/paper/2608.00035"},"observation_digest":"sha256:3e139d13a57e50d7b0f1b49111296f002ba36f3ff76dab4934759861b5cff86f","observation_id":"96fae9a9-f98d-48b0-9d5d-b3ead8962f45","resolution":{"observed_at":"2026-08-04T01:41:51.406230Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:41:51.595901Z","title":"Science , volume=","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2608.00035","last_updated":"2026-07-21T06:06:20Z","snapshot_observed_at":"2026-08-06T23:11:32.830225Z","submitted_at":"2026-07-21T06:06:20Z","title":"Linguistic Context Recodes Visual Representations in Vision-Language Models","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-04T01:41:51.595901Z"},"links":{"citing_paper":"/paper/2608.00035"},"observation_digest":"sha256:48ef9f2c1d3014cd2127d17f672ebb062a2c1290000a489ae82e9a2d12a1151f","observation_id":"730f2cf2-1439-407b-a306-50e040eeea65","resolution":{"observed_at":"2026-08-04T01:41:51.595901Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:41:51.768727Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00035","last_updated":"2026-07-21T06:06:20Z","snapshot_observed_at":"2026-08-06T23:11:32.830225Z","submitted_at":"2026-07-21T06:06:20Z","title":"Linguistic Context Recodes Visual Representations in Vision-Language Models","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-04T01:41:51.768727Z"},"links":{"citing_paper":"/paper/2608.00035"},"observation_digest":"sha256:7fbfd5872a6f7aed3efc958160a41655cdddf843b674ff9a80b67d05920cca09","observation_id":"5108beeb-64da-4aa2-a3f2-4ee4061dc1b8","resolution":{"observed_at":"2026-08-04T01:41:51.768727Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:41:51.854255Z","title":"International conference on machine learning , pages=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.00035","last_updated":"2026-07-21T06:06:20Z","snapshot_observed_at":"2026-08-06T23:11:32.830225Z","submitted_at":"2026-07-21T06:06:20Z","title":"Linguistic Context Recodes Visual Representations in Vision-Language Models","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-04T01:41:51.854255Z"},"links":{"citing_paper":"/paper/2608.00035"},"observation_digest":"sha256:496562afead2ff551226d2b0cd00f76f3d9dfc0d2947a405e19a0dbc9492c4c5","observation_id":"eb47e042-92f5-4642-afd4-1ef2f4285c36","resolution":{"observed_at":"2026-08-04T01:41:51.854255Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:41:52.010823Z","title":"arXiv preprint arXiv:2602.06218 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00035","last_updated":"2026-07-21T06:06:20Z","snapshot_observed_at":"2026-08-06T23:11:32.830225Z","submitted_at":"2026-07-21T06:06:20Z","title":"Linguistic Context Recodes Visual Representations in Vision-Language Models","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-04T01:41:52.010823Z"},"links":{"citing_paper":"/paper/2608.00035"},"observation_digest":"sha256:3eb5c2cf56f1f6c1875d64467af503fd15f7ef152850550bcb0ca35e01cd7e2c","observation_id":"deb2206c-ad72-4006-ab96-e6e062df2c5a","resolution":{"observed_at":"2026-08-04T01:41:52.010823Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:41:52.179682Z","title":"Proceedings of the 2025 Conference on Empirical Methods in Natural Language Processing , pages=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.00035","last_updated":"2026-07-21T06:06:20Z","snapshot_observed_at":"2026-08-06T23:11:32.830225Z","submitted_at":"2026-07-21T06:06:20Z","title":"Linguistic Context Recodes Visual Representations in Vision-Language Models","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-04T01:41:52.179682Z"},"links":{"citing_paper":"/paper/2608.00035"},"observation_digest":"sha256:60f6d34741ba3dfe0ebd47ce712d04f1458c874d68c241dbd0e9a390c48296af","observation_id":"a8d3b7d8-41b8-419e-81a5-c619cd4d5c1b","resolution":{"observed_at":"2026-08-04T01:41:52.179682Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.09942","last_updated":"2026-04-10T22:47:11Z","snapshot_observed_at":"2026-07-06T22:58:43.155246Z","submitted_at":"2026-04-10T22:47:11Z","title":"I Walk the Line: Examining the Role of Gestalt Continuity in Object Binding for Vision Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.09942","snapshot_observed_at":"2026-08-04T01:41:52.356032Z","title":"arXiv preprint arXiv:2604.09942 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00035","last_updated":"2026-07-21T06:06:20Z","snapshot_observed_at":"2026-08-06T23:11:32.830225Z","submitted_at":"2026-07-21T06:06:20Z","title":"Linguistic Context Recodes Visual Representations in Vision-Language Models","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-04T01:41:52.356032Z"},"links":{"cited_paper":"/paper/2604.09942","citing_paper":"/paper/2608.00035"},"observation_digest":"sha256:34c1c93b727f28b07a6f08dd1bea4214ff4c5aa7aff80b22a97cbad77e0aedc0","observation_id":"bc7def13-9a7c-4a25-ac10-56dd001b2c3f","resolution":{"observed_at":"2026-08-04T01:41:52.356032Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:41:52.527563Z","title":"Journal of Neuroscience , volume=","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2608.00035","last_updated":"2026-07-21T06:06:20Z","snapshot_observed_at":"2026-08-06T23:11:32.830225Z","submitted_at":"2026-07-21T06:06:20Z","title":"Linguistic Context Recodes Visual Representations in Vision-Language Models","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-04T01:41:52.527563Z"},"links":{"citing_paper":"/paper/2608.00035"},"observation_digest":"sha256:005ac12092adbc7287a0fa347d7c3e8ca81aae4da3ce1c9146a028659f9f7dd7","observation_id":"f87fa9dd-fb68-465b-8c48-e05cd63f5845","resolution":{"observed_at":"2026-08-04T01:41:52.527563Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:41:52.651727Z","title":"Trends in cognitive sciences , volume=","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2608.00035","last_updated":"2026-07-21T06:06:20Z","snapshot_observed_at":"2026-08-06T23:11:32.830225Z","submitted_at":"2026-07-21T06:06:20Z","title":"Linguistic Context Recodes Visual Representations in Vision-Language Models","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-04T01:41:52.651727Z"},"links":{"citing_paper":"/paper/2608.00035"},"observation_digest":"sha256:90df7f5dfefae2615eff6e4a58c508e8909c97cb26770e2bff65e808c21dea26","observation_id":"1cb2dcbb-aabe-4a6a-b6e7-b152fec17b17","resolution":{"observed_at":"2026-08-04T01:41:52.651727Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:41:52.724225Z","title":"Annual review of neuroscience , volume=","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2608.00035","last_updated":"2026-07-21T06:06:20Z","snapshot_observed_at":"2026-08-06T23:11:32.830225Z","submitted_at":"2026-07-21T06:06:20Z","title":"Linguistic Context Recodes Visual Representations in Vision-Language Models","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-04T01:41:52.724225Z"},"links":{"citing_paper":"/paper/2608.00035"},"observation_digest":"sha256:244f7a7b5140547afae807cc4c05fe1bff81902e307592fa7e5a94eba4e05d49","observation_id":"5509545f-504e-47fd-8941-c9b313c2eeaa","resolution":{"observed_at":"2026-08-04T01:41:52.724225Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.01790","last_updated":"2025-07-02T15:15:14Z","snapshot_observed_at":"2026-08-06T20:40:19.349439Z","submitted_at":"2025-07-02T15:15:14Z","title":"How Do Vision-Language Models Process Conflicting Information Across Modalities?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.01790","snapshot_observed_at":"2026-08-04T01:41:52.790018Z","title":"arXiv preprint arXiv:2507.01790 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00035","last_updated":"2026-07-21T06:06:20Z","snapshot_observed_at":"2026-08-06T23:11:32.830225Z","submitted_at":"2026-07-21T06:06:20Z","title":"Linguistic Context Recodes Visual Representations in Vision-Language Models","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-04T01:41:52.790018Z"},"links":{"cited_paper":"/paper/2507.01790","citing_paper":"/paper/2608.00035"},"observation_digest":"sha256:de5e8e903307f8f566784d031bdc988f245c9bfdea030b5bb25a8226de562e4e","observation_id":"a0acd5ca-061f-4b96-8016-9cd40cbb5726","resolution":{"observed_at":"2026-08-04T01:41:52.790018Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.00035","last_updated":"2026-07-21T06:06:20Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-06T23:11:32.830225Z","submitted_at":"2026-07-21T06:06:20Z","title":"Linguistic Context Recodes Visual Representations in Vision-Language Models"},"reference_resolution":{"displayed":54,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":54,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":54},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 54 of 54 outbound references and 0 inbound Pith citation observations for arXiv:2608.00035."}