{"as_of":"2026-08-06T15:48:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f541a5b789961123991073cd890a36d4d17e9db049f53a859288666457aa2661","coverage":[{"denominator":37,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":37,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-27T07:40:22.259963Z","state":"measured"},{"denominator":37,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":37,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2606.12898/citation-record","integrity":"/paper/2606.12898/integrity","json":"/paper/2606.12898/citation-record.json","paper":"/paper/2606.12898"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T07:40:22.259963Z","title":"Mitigating object hallucinations in large vision-language models with assembly of global and local attention","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.12898","last_updated":"2026-06-11T04:57:51Z","snapshot_observed_at":"2026-08-01T06:39:53.906262Z","submitted_at":"2026-06-11T04:57:51Z","title":"Magnifying What Matters: Attention-Guided Adaptive Rendering for Visual Text Comprehension","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-27T07:40:22.259963Z"},"links":{"citing_paper":"/paper/2606.12898"},"observation_digest":"sha256:79018c6d2d612ad29fa65f97ec15f6054cc91dbb96093c2bb05bf33177ad150b","observation_id":"872e3f7b-8d16-4285-9fff-f71457732657","resolution":{"observed_at":"2026-06-27T07:40:22.259963Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":"2502.13923","doi":"10.48550/arxiv.2502.13923","metadata_source":"pith","pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen2.5-VL Technical Report","venue":"cs.CV","work_id":"69dffacb-bfe8-442d-be86-48624c60426f","year":2025},"citing_paper":{"arxiv_id":"2606.12898","last_updated":"2026-06-11T04:57:51Z","snapshot_observed_at":"2026-08-01T06:39:53.906262Z","submitted_at":"2026-06-11T04:57:51Z","title":"Magnifying What Matters: Attention-Guided Adaptive Rendering for Visual Text Comprehension","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-27T07:40:22.259963Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2606.12898"},"observation_digest":"sha256:77d6c687d150e92a0567e3ceff0c3dd888775caa3bf3a6e652080bd2f8ae4a3f","observation_id":"c94cec10-49ce-480e-a81e-f7c6b32ac18a","resolution":{"observed_at":"2026-07-03T13:38:19.562072Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-12T05:19:13.082554+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T05:19:13.082554+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T07:40:22.259963Z","title":"Longbench: A bilingual, multitask benchmark for long context understanding","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.12898","last_updated":"2026-06-11T04:57:51Z","snapshot_observed_at":"2026-08-01T06:39:53.906262Z","submitted_at":"2026-06-11T04:57:51Z","title":"Magnifying What Matters: Attention-Guided Adaptive Rendering for Visual Text Comprehension","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-27T07:40:22.259963Z"},"links":{"citing_paper":"/paper/2606.12898"},"observation_digest":"sha256:9ff5a0bb538cc1b69f87f887b80c5963f8f6c06251f17bcd59009f8551781166","observation_id":"ceb4f4b3-f8c3-4352-a649-07dad97ed828","resolution":{"observed_at":"2026-06-27T07:40:22.259963Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T07:40:22.259963Z","title":"Lvlm-intrepret: An interpretability tool for large vision-language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.12898","last_updated":"2026-06-11T04:57:51Z","snapshot_observed_at":"2026-08-01T06:39:53.906262Z","submitted_at":"2026-06-11T04:57:51Z","title":"Magnifying What Matters: Attention-Guided Adaptive Rendering for Visual Text Comprehension","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-27T07:40:22.259963Z"},"links":{"citing_paper":"/paper/2606.12898"},"observation_digest":"sha256:2d6ac88ba242a63b93b8890e137e9a076b62e3592c79e215105fe33f73d60af9","observation_id":"e07c8e4b-642b-4e54-b660-5bbd0e553290","resolution":{"observed_at":"2026-06-27T07:40:22.259963Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.17800","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T11:37:03.262420Z","title":"Glyph: Scaling context windows via visual-text compres- sion","venue":null,"work_id":"fd554aed-9fbc-48cb-bbcd-f2beff67c3d3","year":2025},"citing_paper":{"arxiv_id":"2606.12898","last_updated":"2026-06-11T04:57:51Z","snapshot_observed_at":"2026-08-01T06:39:53.906262Z","submitted_at":"2026-06-11T04:57:51Z","title":"Magnifying What Matters: Attention-Guided Adaptive Rendering for Visual Text Comprehension","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-27T07:40:22.259963Z"},"links":{"citing_paper":"/paper/2606.12898"},"observation_digest":"sha256:c13bdb16f61e057e9904326907782a1dac8ef81867332aa80124402c62d9ff68","observation_id":"78bd315c-1f07-4f4f-8500-3268e69e10b3","resolution":{"observed_at":"2026-07-03T13:38:19.570608Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T07:40:22.259963Z","title":"A dataset of information-seeking questions and answers anchored in research papers","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.12898","last_updated":"2026-06-11T04:57:51Z","snapshot_observed_at":"2026-08-01T06:39:53.906262Z","submitted_at":"2026-06-11T04:57:51Z","title":"Magnifying What Matters: Attention-Guided Adaptive Rendering for Visual Text Comprehension","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-27T07:40:22.259963Z"},"links":{"citing_paper":"/paper/2606.12898"},"observation_digest":"sha256:cfd288fdc95fb69598fffed401bfcd70118ac8a3b0b3970623e0240b468e19c1","observation_id":"fce81375-7118-4f3d-b099-a153309968c4","resolution":{"observed_at":"2026-06-27T07:40:22.259963Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2601.04786","doi":"10.48550/arxiv.2601.04786","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Agentocr: Reimagining agent history via optical self-compression","venue":"arXiv (Cornell University)","work_id":"2c3479ab-178a-4ea6-b25e-812d64d36681","year":2026},"citing_paper":{"arxiv_id":"2606.12898","last_updated":"2026-06-11T04:57:51Z","snapshot_observed_at":"2026-08-01T06:39:53.906262Z","submitted_at":"2026-06-11T04:57:51Z","title":"Magnifying What Matters: Attention-Guided Adaptive Rendering for Visual Text Comprehension","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-27T07:40:22.259963Z"},"links":{"citing_paper":"/paper/2606.12898"},"observation_digest":"sha256:bc97d192fb1127d67bd9d855bd50c68102f4385b677744643cb3e2cd1b8bb617","observation_id":"dde99e1e-ae8c-4405-9e89-45b99133db39","resolution":{"observed_at":"2026-07-03T13:38:19.562177Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T07:40:22.259963Z","title":"Constructing a multi-hop qa dataset for comprehensive evaluation of reasoning steps","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.12898","last_updated":"2026-06-11T04:57:51Z","snapshot_observed_at":"2026-08-01T06:39:53.906262Z","submitted_at":"2026-06-11T04:57:51Z","title":"Magnifying What Matters: Attention-Guided Adaptive Rendering for Visual Text Comprehension","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-27T07:40:22.259963Z"},"links":{"citing_paper":"/paper/2606.12898"},"observation_digest":"sha256:8fb150f6bf9bc43976769e6e0c6b417ab852a01a5f69719ce72ad1a5053c3c8b","observation_id":"347f56a8-367c-4a2b-9d9d-8c276f89938f","resolution":{"observed_at":"2026-06-27T07:40:22.259963Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.01006","last_updated":"2026-01-01T13:07:25Z","snapshot_observed_at":"2026-08-03T18:50:30.558321Z","submitted_at":"2025-07-01T17:55:04Z","title":"GLM-4.5V and GLM-4.1V-Thinking: Towards Versatile Multimodal Reasoning with Scalable Reinforcement Learning","version":6},"cited_work":{"arxiv_id":"2507.01006","doi":"10.48550/arxiv.2507.01006","metadata_source":"pith","pith_arxiv_id":"2507.01006","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"GLM-4.5V and GLM-4.1V-Thinking: Towards Versatile Multimodal Reasoning with Scalable Reinforcement Learning","venue":"cs.CV","work_id":"366607ba-e4ea-4726-98c3-63356e32351c","year":2025},"citing_paper":{"arxiv_id":"2606.12898","last_updated":"2026-06-11T04:57:51Z","snapshot_observed_at":"2026-08-01T06:39:53.906262Z","submitted_at":"2026-06-11T04:57:51Z","title":"Magnifying What Matters: Attention-Guided Adaptive Rendering for Visual Text Comprehension","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-27T07:40:22.259963Z"},"links":{"cited_paper":"/paper/2507.01006","citing_paper":"/paper/2606.12898"},"observation_digest":"sha256:d41c16a8b8ac52df1d85ef0836afe67bb09ef8861afc0745db8050143b8d290b","observation_id":"00b7c32a-11b5-4c80-9121-53d8bcd91f39","resolution":{"observed_at":"2026-07-03T13:38:19.556817Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T07:40:22.259963Z","title":"Effects of topic headings on text processing: Evidence from adult readers’ eye fixation patterns.Learning and instruction, 14(2):131–152, 2004","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2606.12898","last_updated":"2026-06-11T04:57:51Z","snapshot_observed_at":"2026-08-01T06:39:53.906262Z","submitted_at":"2026-06-11T04:57:51Z","title":"Magnifying What Matters: Attention-Guided Adaptive Rendering for Visual Text Comprehension","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-27T07:40:22.259963Z"},"links":{"citing_paper":"/paper/2606.12898"},"observation_digest":"sha256:8de39c645c9c92642512adfc058515390edca5a64d248eef1dce56eb4eb793fe","observation_id":"3dff2219-31af-4cd6-85a3-fad8fce0e3ce","resolution":{"observed_at":"2026-06-27T07:40:22.259963Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T07:40:22.259963Z","title":"Cumulated gain-based evaluation of ir techniques.ACM Trans","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2606.12898","last_updated":"2026-06-11T04:57:51Z","snapshot_observed_at":"2026-08-01T06:39:53.906262Z","submitted_at":"2026-06-11T04:57:51Z","title":"Magnifying What Matters: Attention-Guided Adaptive Rendering for Visual Text Comprehension","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-27T07:40:22.259963Z"},"links":{"citing_paper":"/paper/2606.12898"},"observation_digest":"sha256:b4afbf9048363852ea09080bdb83b825c4e146d3f33843324f03793650d3981e","observation_id":"e7f87c81-483b-4b31-b4c7-a3d2e55c001a","resolution":{"observed_at":"2026-06-27T07:40:22.259963Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T07:40:22.259963Z","title":"Triviaqa: A large scale distantly supervised challenge dataset for reading comprehension","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2606.12898","last_updated":"2026-06-11T04:57:51Z","snapshot_observed_at":"2026-08-01T06:39:53.906262Z","submitted_at":"2026-06-11T04:57:51Z","title":"Magnifying What Matters: Attention-Guided Adaptive Rendering for Visual Text Comprehension","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-27T07:40:22.259963Z"},"links":{"citing_paper":"/paper/2606.12898"},"observation_digest":"sha256:073baaf6fe0586025b9d8682d65fa86de7fd9989644be3cbc09c47b76ad8fc06","observation_id":"cfdd5f99-b5f8-4fab-bed3-c2a615432754","resolution":{"observed_at":"2026-06-27T07:40:22.259963Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T07:40:22.259963Z","title":"Dai, Jakob Uszkoreit, Quoc Le, and Slav Petrov","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2606.12898","last_updated":"2026-06-11T04:57:51Z","snapshot_observed_at":"2026-08-01T06:39:53.906262Z","submitted_at":"2026-06-11T04:57:51Z","title":"Magnifying What Matters: Attention-Guided Adaptive Rendering for Visual Text Comprehension","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-27T07:40:22.259963Z"},"links":{"citing_paper":"/paper/2606.12898"},"observation_digest":"sha256:cb4491511cf78c38906caa2a96c8e2cea385c364e4a7fc31973e6dbc2b248f42","observation_id":"37cf1ee0-fb32-42a7-96d6-ec621c7c582f","resolution":{"observed_at":"2026-06-27T07:40:22.259963Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2602.04802","last_updated":"2026-07-22T16:08:20Z","snapshot_observed_at":"2026-08-03T04:31:17.019218Z","submitted_at":"2026-02-04T17:48:55Z","title":"VISTA-Bench: Do Vision-Language Models Really Understand Visualized Text as Well as Pure Text?","version":3},"cited_work":{"arxiv_id":"2602.04802","doi":null,"metadata_source":"pith","pith_arxiv_id":"2602.04802","snapshot_observed_at":"2026-07-03T13:38:19.577145Z","title":"InInternational conference on ma- chine learning, pages 19730–19742","venue":"cs.CV","work_id":"2e3c1d40-a58d-443e-bd50-aac6d8295b60","year":2026},"citing_paper":{"arxiv_id":"2606.12898","last_updated":"2026-06-11T04:57:51Z","snapshot_observed_at":"2026-08-01T06:39:53.906262Z","submitted_at":"2026-06-11T04:57:51Z","title":"Magnifying What Matters: Attention-Guided Adaptive Rendering for Visual Text Comprehension","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-27T07:40:22.259963Z"},"links":{"cited_paper":"/paper/2602.04802","citing_paper":"/paper/2606.12898"},"observation_digest":"sha256:6d2376dbeec03854675a11b02e41d43575d52925e63899a190ab5208f44ae18e","observation_id":"ce114b32-d256-40a0-b090-b629c6af9726","resolution":{"observed_at":"2026-07-03T13:38:19.578741Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T07:40:22.259963Z","title":"Unveiling the ignorance of mllms: Seeing clearly, answering incorrectly","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.12898","last_updated":"2026-06-11T04:57:51Z","snapshot_observed_at":"2026-08-01T06:39:53.906262Z","submitted_at":"2026-06-11T04:57:51Z","title":"Magnifying What Matters: Attention-Guided Adaptive Rendering for Visual Text Comprehension","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-27T07:40:22.259963Z"},"links":{"citing_paper":"/paper/2606.12898"},"observation_digest":"sha256:c5351090c70206776b7ca43cbe32c4eb2db811cc41e3e4e6996e315c54a593a8","observation_id":"37df122e-679b-4681-a177-a208700304e9","resolution":{"observed_at":"2026-06-27T07:40:22.259963Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.08767","last_updated":"2025-05-26T01:07:58Z","snapshot_observed_at":"2026-08-01T06:42:08.774255Z","submitted_at":"2025-02-12T20:13:56Z","title":"SelfElicit: Your Language Model Secretly Knows Where is the Relevant Evidence","version":2},"cited_work":{"arxiv_id":"2502.08767","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.08767","snapshot_observed_at":"2026-07-03T13:38:19.563221Z","title":"Zhining Liu, Rana Ali Amjad, Ravinarayana Adkathimar, Tianxin Wei, and Hanghang Tong","venue":null,"work_id":"1236bd61-f4ec-4a9f-82c6-00a1595fff3d","year":2025},"citing_paper":{"arxiv_id":"2606.12898","last_updated":"2026-06-11T04:57:51Z","snapshot_observed_at":"2026-08-01T06:39:53.906262Z","submitted_at":"2026-06-11T04:57:51Z","title":"Magnifying What Matters: Attention-Guided Adaptive Rendering for Visual Text Comprehension","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-27T07:40:22.259963Z"},"links":{"cited_paper":"/paper/2502.08767","citing_paper":"/paper/2606.12898"},"observation_digest":"sha256:327f55a11f7d509d1658050a620e66d6c94f3e0ad8a672e50f50461d2adf5670","observation_id":"f3bf9c70-720e-4e44-a328-af27934c0623","resolution":{"observed_at":"2026-07-03T13:38:19.564760Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.17771","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T05:54:33.524291Z","title":"Seeing but not believing: Probing the disconnect between visual attention and answer correctness in vlms","venue":null,"work_id":"86ab4537-55ce-4a99-b6c9-64abd30a26d0","year":2025},"citing_paper":{"arxiv_id":"2606.12898","last_updated":"2026-06-11T04:57:51Z","snapshot_observed_at":"2026-08-01T06:39:53.906262Z","submitted_at":"2026-06-11T04:57:51Z","title":"Magnifying What Matters: Attention-Guided Adaptive Rendering for Visual Text Comprehension","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-27T07:40:22.259963Z"},"links":{"citing_paper":"/paper/2606.12898"},"observation_digest":"sha256:40a466cf98bed47278710b927e2cc15fc551106ffa999fea2b0e6ccdafdefc2d","observation_id":"37d9e875-573f-4059-8d3a-5d4e83668ae0","resolution":{"observed_at":"2026-07-03T13:38:19.567381Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T07:40:22.259963Z","title":"Evaluating very long-term conversational memory of llm agents","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.12898","last_updated":"2026-06-11T04:57:51Z","snapshot_observed_at":"2026-08-01T06:39:53.906262Z","submitted_at":"2026-06-11T04:57:51Z","title":"Magnifying What Matters: Attention-Guided Adaptive Rendering for Visual Text Comprehension","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-27T07:40:22.259963Z"},"links":{"citing_paper":"/paper/2606.12898"},"observation_digest":"sha256:7560dffe38946477f80d5794b5584246efb735dba9ef7d44f8f2b2399090b897","observation_id":"597768fd-ee8f-458a-a568-afa1aa8581da","resolution":{"observed_at":"2026-06-27T07:40:22.259963Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.11895","last_updated":"2022-09-24T00:43:19Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-09-24T00:43:19Z","title":"In-context Learning and Induction Heads","version":1},"cited_work":{"arxiv_id":"2209.11895","doi":"10.1145/3411763.3451760","metadata_source":"pith","pith_arxiv_id":"2209.11895","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"In-context Learning and Induction Heads","venue":"cs.LG","work_id":"db2b0911-2758-4a2a-99dc-15b14b91bd5e","year":2022},"citing_paper":{"arxiv_id":"2606.12898","last_updated":"2026-06-11T04:57:51Z","snapshot_observed_at":"2026-08-01T06:39:53.906262Z","submitted_at":"2026-06-11T04:57:51Z","title":"Magnifying What Matters: Attention-Guided Adaptive Rendering for Visual Text Comprehension","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-27T07:40:22.259963Z"},"links":{"cited_paper":"/paper/2209.11895","citing_paper":"/paper/2606.12898"},"observation_digest":"sha256:cca53c1a4e7455e0975ee01def494aed114b65bf696837c4635296b5ce471c42","observation_id":"cb3aa9b3-4f6c-4c01-b557-18a656e2569a","resolution":{"observed_at":"2026-07-03T13:38:19.550704Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-05-23T02:23:10.795052+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T02:23:10.795052+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2601.14697","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T13:38:19.579959Z","title":"When text-as-vision meets semantic ids in generative recommendation: An empirical study","venue":null,"work_id":"329934d2-d347-48e0-b6b7-47bfe0a2df81","year":2026},"citing_paper":{"arxiv_id":"2606.12898","last_updated":"2026-06-11T04:57:51Z","snapshot_observed_at":"2026-08-01T06:39:53.906262Z","submitted_at":"2026-06-11T04:57:51Z","title":"Magnifying What Matters: Attention-Guided Adaptive Rendering for Visual Text Comprehension","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-27T07:40:22.259963Z"},"links":{"citing_paper":"/paper/2606.12898"},"observation_digest":"sha256:5cb3e95be5a7a28372924c06c0c3c16c5143c4f42b2d0eb76abdfd1ad6686460","observation_id":"5e861b1b-d57d-4e9e-99ad-8549bbb9d703","resolution":{"observed_at":"2026-07-03T13:38:19.581377Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T07:40:22.259963Z","title":"Eye movements in reading and information processing: 20 years of research","venue":null,"work_id":null,"year":1998},"citing_paper":{"arxiv_id":"2606.12898","last_updated":"2026-06-11T04:57:51Z","snapshot_observed_at":"2026-08-01T06:39:53.906262Z","submitted_at":"2026-06-11T04:57:51Z","title":"Magnifying What Matters: Attention-Guided Adaptive Rendering for Visual Text Comprehension","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-27T07:40:22.259963Z"},"links":{"citing_paper":"/paper/2606.12898"},"observation_digest":"sha256:deed8c8c1eb7e24151dd34090ac668d58cdb99ba4af778a076b02bae495c16d4","observation_id":"354b6097-e54d-4d6b-a74b-880ffbe442d6","resolution":{"observed_at":"2026-06-27T07:40:22.259963Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T07:40:22.259963Z","title":"Grad-cam: Visual explanations from deep networks via gradient-based localization","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2606.12898","last_updated":"2026-06-11T04:57:51Z","snapshot_observed_at":"2026-08-01T06:39:53.906262Z","submitted_at":"2026-06-11T04:57:51Z","title":"Magnifying What Matters: Attention-Guided Adaptive Rendering for Visual Text Comprehension","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-27T07:40:22.259963Z"},"links":{"citing_paper":"/paper/2606.12898"},"observation_digest":"sha256:e424526be1e0881f4e5b917a5717263e9787d025aa90a69d1b1662e3167584fb","observation_id":"98917a90-ca09-428e-8586-7d29316c5150","resolution":{"observed_at":"2026-06-27T07:40:22.259963Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.21468","last_updated":"2026-05-18T07:50:29Z","snapshot_observed_at":"2026-08-04T01:48:38.560710Z","submitted_at":"2026-01-29T09:47:17Z","title":"MemOCR: Layout-Aware Visual Memory for Efficient Long-Horizon Reasoning","version":5},"cited_work":{"arxiv_id":"2601.21468","doi":"10.48550/arxiv.2601.21468","metadata_source":"pith","pith_arxiv_id":"2601.21468","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2601.21468 , year=","venue":"cs.AI","work_id":"2519086e-7b90-4c3b-9672-1de1029ef560","year":2026},"citing_paper":{"arxiv_id":"2606.12898","last_updated":"2026-06-11T04:57:51Z","snapshot_observed_at":"2026-08-01T06:39:53.906262Z","submitted_at":"2026-06-11T04:57:51Z","title":"Magnifying What Matters: Attention-Guided Adaptive Rendering for Visual Text Comprehension","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-27T07:40:22.259963Z"},"links":{"cited_paper":"/paper/2601.21468","citing_paper":"/paper/2606.12898"},"observation_digest":"sha256:04fc4b2c482f492b09b65154e994d188602e8116d060e40f452d7a8e9f4c4370","observation_id":"3c4e548f-6993-4a5d-b792-165249451cd3","resolution":{"observed_at":"2026-07-03T13:38:19.575891Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":"2505.09388","doi":"10.1016/j.aiopen.2022.12","metadata_source":"pith","pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Qwen3 Technical Report","venue":"cs.CL","work_id":"25a4e30c-1232-48e7-9925-02fa12ba7c9e","year":2025},"citing_paper":{"arxiv_id":"2606.12898","last_updated":"2026-06-11T04:57:51Z","snapshot_observed_at":"2026-08-01T06:39:53.906262Z","submitted_at":"2026-06-11T04:57:51Z","title":"Magnifying What Matters: Attention-Guided Adaptive Rendering for Visual Text Comprehension","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-27T07:40:22.259963Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2606.12898"},"observation_digest":"sha256:cc3f48af4855bda513639c0aef305d9786274ff96d29920823426adcceeec0d6","observation_id":"84f6fff0-f032-4d9f-92f3-5a28b340f55b","resolution":{"observed_at":"2026-07-03T13:38:19.559344Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T07:40:22.259963Z","title":"Newsqa: A machine comprehension dataset","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2606.12898","last_updated":"2026-06-11T04:57:51Z","snapshot_observed_at":"2026-08-01T06:39:53.906262Z","submitted_at":"2026-06-11T04:57:51Z","title":"Magnifying What Matters: Attention-Guided Adaptive Rendering for Visual Text Comprehension","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-27T07:40:22.259963Z"},"links":{"citing_paper":"/paper/2606.12898"},"observation_digest":"sha256:b1ced85070d18d7c0d0bb04bc1e3d378445d67e2b4bc0a139bb5a788067cac85","observation_id":"d681fd5d-2ee5-4ad1-8c06-80165d745fe3","resolution":{"observed_at":"2026-06-27T07:40:22.259963Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T07:40:22.259963Z","title":"Musique: Multihop questions via single-hop question composition.Transactions of the Association for Computational Linguistics, 10:539–554, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.12898","last_updated":"2026-06-11T04:57:51Z","snapshot_observed_at":"2026-08-01T06:39:53.906262Z","submitted_at":"2026-06-11T04:57:51Z","title":"Magnifying What Matters: Attention-Guided Adaptive Rendering for Visual Text Comprehension","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-27T07:40:22.259963Z"},"links":{"citing_paper":"/paper/2606.12898"},"observation_digest":"sha256:6a56492a574e24f5e8439668810113242fa71a9bf205d7f2a584d44afaf0dd31","observation_id":"9fdc5816-b573-4a74-86a0-af4a741435a0","resolution":{"observed_at":"2026-06-27T07:40:22.259963Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.18265","last_updated":"2025-08-27T14:39:45Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-08-25T17:58:17Z","title":"InternVL3.5: Advancing Open-Source Multimodal Models in Versatility, Reasoning, and Efficiency","version":2},"cited_work":{"arxiv_id":"2508.18265","doi":"10.48550/arxiv.2508.18265","metadata_source":"pith","pith_arxiv_id":"2508.18265","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"InternVL3.5: Advancing Open-Source Multimodal Models in Versatility, Reasoning, and Efficiency","venue":"cs.CV","work_id":"b8f5e260-fff5-444e-bcf5-2c42cfefd83d","year":2025},"citing_paper":{"arxiv_id":"2606.12898","last_updated":"2026-06-11T04:57:51Z","snapshot_observed_at":"2026-08-01T06:39:53.906262Z","submitted_at":"2026-06-11T04:57:51Z","title":"Magnifying What Matters: Attention-Guided Adaptive Rendering for Visual Text Comprehension","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-27T07:40:22.259963Z"},"links":{"cited_paper":"/paper/2508.18265","citing_paper":"/paper/2606.12898"},"observation_digest":"sha256:9e4a32242241eb0c9cfd8f7dc30194eff8d5ca2b3e58aab353ad48df2d790644","observation_id":"93b91472-d1e3-4592-a7e8-f06c3f264503","resolution":{"observed_at":"2026-07-03T13:38:19.550478Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2601.22069","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T13:38:19.551806Z","title":"Vtc-r1: Vision-text compres- sion for efficient long-context reasoning.arXiv preprint arXiv:2601.22069","venue":null,"work_id":"c3e20253-f23a-4fc2-8d6d-5c281f15c05d","year":2026},"citing_paper":{"arxiv_id":"2606.12898","last_updated":"2026-06-11T04:57:51Z","snapshot_observed_at":"2026-08-01T06:39:53.906262Z","submitted_at":"2026-06-11T04:57:51Z","title":"Magnifying What Matters: Attention-Guided Adaptive Rendering for Visual Text Comprehension","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-27T07:40:22.259963Z"},"links":{"citing_paper":"/paper/2606.12898"},"observation_digest":"sha256:1e860fe19383cb0e49a1cf8c7047fde5a9a67e50df25681cf7c6c0e4df9bc0ed","observation_id":"6aada440-7f64-4012-9a81-ee9354b444eb","resolution":{"observed_at":"2026-07-03T13:38:19.553767Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2510.18234","last_updated":"2025-10-21T02:41:44Z","snapshot_observed_at":"2026-07-06T22:33:39.148066Z","submitted_at":"2025-10-21T02:41:44Z","title":"DeepSeek-OCR: Contexts Optical Compression","version":1},"cited_work":{"arxiv_id":"2510.18234","doi":"10.48550/arxiv.2510.18234","metadata_source":"pith","pith_arxiv_id":"2510.18234","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DeepSeek-OCR: Contexts Optical Compression","venue":"cs.CV","work_id":"e85551be-f243-4764-886f-76a8813ccbb8","year":2025},"citing_paper":{"arxiv_id":"2606.12898","last_updated":"2026-06-11T04:57:51Z","snapshot_observed_at":"2026-08-01T06:39:53.906262Z","submitted_at":"2026-06-11T04:57:51Z","title":"Magnifying What Matters: Attention-Guided Adaptive Rendering for Visual Text Comprehension","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-06-27T07:40:22.259963Z"},"links":{"cited_paper":"/paper/2510.18234","citing_paper":"/paper/2606.12898"},"observation_digest":"sha256:3440a7b91c8d076156de937f2221229d1584ba341bae58683264dad41699989e","observation_id":"896b7fb7-92b4-409f-9a6a-0b7c2814ef78","resolution":{"observed_at":"2026-07-03T13:38:19.567426Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2601.20552","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T17:07:25.727485Z","title":"Deepseek-ocr 2: Visual causal flow","venue":null,"work_id":"9886dce9-776e-4ad6-b96c-fbf9037ca41c","year":2026},"citing_paper":{"arxiv_id":"2606.12898","last_updated":"2026-06-11T04:57:51Z","snapshot_observed_at":"2026-08-01T06:39:53.906262Z","submitted_at":"2026-06-11T04:57:51Z","title":"Magnifying What Matters: Attention-Guided Adaptive Rendering for Visual Text Comprehension","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-27T07:40:22.259963Z"},"links":{"citing_paper":"/paper/2606.12898"},"observation_digest":"sha256:1f82247b3baed81d990e97d7958be4984f9e6295c5bfff82c9d28a47dae83699","observation_id":"1c3c03fa-433b-4a43-b0ef-94cc163d0a32","resolution":{"observed_at":"2026-07-03T13:38:19.570386Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T07:40:22.259963Z","title":"Hotpotqa: A dataset for diverse, explainable multi-hop question answering","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2606.12898","last_updated":"2026-06-11T04:57:51Z","snapshot_observed_at":"2026-08-01T06:39:53.906262Z","submitted_at":"2026-06-11T04:57:51Z","title":"Magnifying What Matters: Attention-Guided Adaptive Rendering for Visual Text Comprehension","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-06-27T07:40:22.259963Z"},"links":{"citing_paper":"/paper/2606.12898"},"observation_digest":"sha256:ccffc8774a836a9e6ada59e70b707b81aeb3c6383f90bcb50b2ff8717caa909e","observation_id":"043bd2ec-28fb-4aee-aa93-e1fe2c849ce2","resolution":{"observed_at":"2026-06-27T07:40:22.259963Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14100","last_updated":"2025-02-22T23:03:21Z","snapshot_observed_at":"2026-08-02T07:42:28.336592Z","submitted_at":"2025-02-19T20:59:35Z","title":"Towards Context-Robust LLMs: A Gated Representation Fine-tuning Approach","version":2},"cited_work":{"arxiv_id":"2502.14100","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.14100","snapshot_observed_at":"2026-07-03T13:38:19.574307Z","title":"Towards context-robust llms: A gated representation fine-tuning approach.arXiv preprint arXiv:2502.14100, 2025","venue":null,"work_id":"e4eb2b27-def6-4e02-abd4-18f274ea1d90","year":2025},"citing_paper":{"arxiv_id":"2606.12898","last_updated":"2026-06-11T04:57:51Z","snapshot_observed_at":"2026-08-01T06:39:53.906262Z","submitted_at":"2026-06-11T04:57:51Z","title":"Magnifying What Matters: Attention-Guided Adaptive Rendering for Visual Text Comprehension","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-06-27T07:40:22.259963Z"},"links":{"cited_paper":"/paper/2502.14100","citing_paper":"/paper/2606.12898"},"observation_digest":"sha256:3e576df12b6bd652da09ee239c37a87f4859c2b9b8139d0f9eaece6ed1f2d445","observation_id":"05e15a62-a43b-4c75-81e3-44f3872db4aa","resolution":{"observed_at":"2026-07-03T13:38:19.575793Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T07:40:22.259963Z","title":"Towards knowledge checking in retrieval-augmented generation: A representation perspective","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.12898","last_updated":"2026-06-11T04:57:51Z","snapshot_observed_at":"2026-08-01T06:39:53.906262Z","submitted_at":"2026-06-11T04:57:51Z","title":"Magnifying What Matters: Attention-Guided Adaptive Rendering for Visual Text Comprehension","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-06-27T07:40:22.259963Z"},"links":{"citing_paper":"/paper/2606.12898"},"observation_digest":"sha256:4c636da1c5d927cf14230e56ff28433461d6286b2229f4d014f2e3b2e5c7e327","observation_id":"4df58921-b3e7-4eeb-bd7a-2596e3b6c7b1","resolution":{"observed_at":"2026-06-27T07:40:22.259963Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.07778","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T13:38:19.541518Z","title":"Attn-gs: Attention-guided context compression for efficient personalized llms.arXiv preprint arXiv:2602.07778, 2026","venue":null,"work_id":"41fb8960-02a9-4aca-ac15-533738d7894f","year":2026},"citing_paper":{"arxiv_id":"2606.12898","last_updated":"2026-06-11T04:57:51Z","snapshot_observed_at":"2026-08-01T06:39:53.906262Z","submitted_at":"2026-06-11T04:57:51Z","title":"Magnifying What Matters: Attention-Guided Adaptive Rendering for Visual Text Comprehension","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-06-27T07:40:22.259963Z"},"links":{"citing_paper":"/paper/2606.12898"},"observation_digest":"sha256:ac7ab754d269e10db675f292777ef456a99b5702d4386282737328d5f4f24ed8","observation_id":"9a6e910b-a3c9-4dff-b927-491a06d70c1c","resolution":{"observed_at":"2026-07-03T13:38:19.543057Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2512.15649","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T13:38:19.571773Z","title":"Vtcbench: Can vision-language models understand long context with vision-text compression? arXiv preprint arXiv:2512.15649","venue":null,"work_id":"c736976f-0ec9-4028-a54c-e0ceebbfcdb5","year":2025},"citing_paper":{"arxiv_id":"2606.12898","last_updated":"2026-06-11T04:57:51Z","snapshot_observed_at":"2026-08-01T06:39:53.906262Z","submitted_at":"2026-06-11T04:57:51Z","title":"Magnifying What Matters: Attention-Guided Adaptive Rendering for Visual Text Comprehension","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-06-27T07:40:22.259963Z"},"links":{"citing_paper":"/paper/2606.12898"},"observation_digest":"sha256:6d2569ce5b33d1dd27b7b1ce7ab6e19e8b1e2e9f52c8da2d2fdab1e5bd6e4be3","observation_id":"7ba48b8e-e883-4b25-aac7-fb78d822a653","resolution":{"observed_at":"2026-07-03T13:38:19.573256Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.00746","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T13:38:19.544242Z","title":"VEA and Baselines Implementation Details","venue":null,"work_id":"ae21bfc0-b0f1-4a8f-b25f-75d021766f39","year":2026},"citing_paper":{"arxiv_id":"2606.12898","last_updated":"2026-06-11T04:57:51Z","snapshot_observed_at":"2026-08-01T06:39:53.906262Z","submitted_at":"2026-06-11T04:57:51Z","title":"Magnifying What Matters: Attention-Guided Adaptive Rendering for Visual Text Comprehension","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-06-27T07:40:22.259963Z"},"links":{"citing_paper":"/paper/2606.12898"},"observation_digest":"sha256:8390cd5d722988910dbcaa28d383001900849efcadbe6e653cc29067ed75c298","observation_id":"706788ab-f6cb-482d-84a5-a18147b4c42b","resolution":{"observed_at":"2026-07-03T13:38:19.545645Z","resolver_source":"arxiv_id","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T07:40:22.259963Z","title":"Justification: Not applicable","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.12898","last_updated":"2026-06-11T04:57:51Z","snapshot_observed_at":"2026-08-01T06:39:53.906262Z","submitted_at":"2026-06-11T04:57:51Z","title":"Magnifying What Matters: Attention-Guided Adaptive Rendering for Visual Text Comprehension","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-06-27T07:40:22.259963Z"},"links":{"citing_paper":"/paper/2606.12898"},"observation_digest":"sha256:105539598032980670cad3f7d9f674d8c1cdbbb3a9a4738370cb72829b4a61c7","observation_id":"7a002897-a269-4ee1-a91f-190fb8498acb","resolution":{"observed_at":"2026-06-27T07:40:22.259963Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2606.12898","last_updated":"2026-06-11T04:57:51Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-01T06:39:53.906262Z","submitted_at":"2026-06-11T04:57:51Z","title":"Magnifying What Matters: Attention-Guided Adaptive Rendering for Visual Text Comprehension"},"reference_resolution":{"displayed":37,"state_counts":{"malformed_identifier":1,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":18,"verified_exact":16,"verified_fuzzy":0},"total_outbound_references":37},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 37 of 37 outbound references and 0 inbound Pith citation observations for arXiv:2606.12898."}