{"as_of":"2026-08-09T06:25:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4ab48978a17d6633544b612cd2e9ae2049d9154ade4d13be2d6dea9704a29bdb","coverage":[{"denominator":39,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":39,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:22:18.452564Z","state":"measured"},{"denominator":40,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":40,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-18T09:41:38.974413Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-18T09:42:30.777398Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.19091","last_updated":"2025-05-25T11:02:01Z","snapshot_observed_at":"2026-08-07T14:18:19.325846Z","submitted_at":"2025-05-25T11:02:01Z","title":"ReadBench: Measuring the Dense Text Visual Reading Ability of Vision-Language Models","version":1},"cited_work":{"arxiv_id":"2505.19091","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.19091","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Gordon V","venue":null,"work_id":"18998f37-5a6b-40ac-a603-f6726eaa7eef","year":null},"citing_paper":{"arxiv_id":"2510.05038","last_updated":"2026-04-06T22:22:13Z","snapshot_observed_at":"2026-07-06T22:31:49.574184Z","submitted_at":"2025-10-06T17:12:53Z","title":"Guided Query Refinement: Multimodal Hybrid Retrieval with Test-Time Optimization","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-18T09:41:38.974413Z"},"links":{"cited_paper":"/paper/2505.19091","citing_paper":"/paper/2510.05038"},"observation_digest":"sha256:1e1b88743d3128be7da06a2e1d2943ea87fbb8563eba9901199adc656618c4fc","observation_id":"8a4a794e-5fb4-4ee2-ba92-ac7189ff08bd","resolution":{"observed_at":"2026-05-18T09:42:30.780392Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.19091/citation-record","integrity":"/paper/2505.19091/integrity","json":"/paper/2505.19091/citation-record.json","paper":"/paper/2505.19091"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2410.07073","last_updated":"2024-10-10T17:59:16Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-09T17:16:22Z","title":"Pixtral 12B","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.07073","snapshot_observed_at":"2026-08-07T14:22:14.978982Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19091","last_updated":"2025-05-25T11:02:01Z","snapshot_observed_at":"2026-08-07T14:18:19.325846Z","submitted_at":"2025-05-25T11:02:01Z","title":"ReadBench: Measuring the Dense Text Visual Reading Ability of Vision-Language Models","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T14:22:14.978982Z"},"links":{"cited_paper":"/paper/2410.07073","citing_paper":"/paper/2505.19091"},"observation_digest":"sha256:a6fdae89de3edf37d7da11fbe845d4fc3d86588c58621868f0837f82a36c0eed","observation_id":"a11a82cc-fc52-41aa-bee1-1ddbef0659d6","resolution":{"observed_at":"2026-08-07T14:22:14.978982Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"status/1859614","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:19.115497Z","title":null,"venue":null,"work_id":"6cbb7d15-c74f-4fe3-b033-cfab08d65a13","year":2024},"citing_paper":{"arxiv_id":"2505.19091","last_updated":"2025-05-25T11:02:01Z","snapshot_observed_at":"2026-08-07T14:18:19.325846Z","submitted_at":"2025-05-25T11:02:01Z","title":"ReadBench: Measuring the Dense Text Visual Reading Ability of Vision-Language Models","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T14:22:15.036867Z"},"links":{"citing_paper":"/paper/2505.19091"},"observation_digest":"sha256:82824ae7ee2a7a84a30dae86cbbbf2922f14dd500c4b467fdbfa823c8d07d81a","observation_id":"6f23dbf1-6378-4369-be97-1253b0f78f18","resolution":{"observed_at":"2026-08-07T14:22:19.180358Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2410.06068","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:18.860541Z","title":null,"venue":null,"work_id":"c03735f4-6a5e-4a0e-88c4-82e37ed4ba68","year":2024},"citing_paper":{"arxiv_id":"2505.19091","last_updated":"2025-05-25T11:02:01Z","snapshot_observed_at":"2026-08-07T14:18:19.325846Z","submitted_at":"2025-05-25T11:02:01Z","title":"ReadBench: Measuring the Dense Text Visual Reading Ability of Vision-Language Models","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T14:22:15.118151Z"},"links":{"citing_paper":"/paper/2505.19091"},"observation_digest":"sha256:acf1371e2a7cf55c3752707f74d521cf108a6ec98bd500bbd3c59814a4c09040","observation_id":"637ebc85-6bdf-499d-94d8-661461535e84","resolution":{"observed_at":"2026-08-07T14:22:18.944954Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-07T14:22:15.170923Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19091","last_updated":"2025-05-25T11:02:01Z","snapshot_observed_at":"2026-08-07T14:18:19.325846Z","submitted_at":"2025-05-25T11:02:01Z","title":"ReadBench: Measuring the Dense Text Visual Reading Ability of Vision-Language Models","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T14:22:15.170923Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2505.19091"},"observation_digest":"sha256:bb8fce4fc97dc982e2af12b5b333660ba6e19a1fa2a7170df02f8bedd730cfa3","observation_id":"f8938571-ffaf-475c-97ff-e990837094fe","resolution":{"observed_at":"2026-08-07T14:22:15.170923Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:21.441434Z","title":null,"venue":null,"work_id":"9b87fc4d-31e9-4c59-bde0-024311ffd39d","year":2024},"citing_paper":{"arxiv_id":"2505.19091","last_updated":"2025-05-25T11:02:01Z","snapshot_observed_at":"2026-08-07T14:18:19.325846Z","submitted_at":"2025-05-25T11:02:01Z","title":"ReadBench: Measuring the Dense Text Visual Reading Ability of Vision-Language Models","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T14:22:15.249010Z"},"links":{"citing_paper":"/paper/2505.19091"},"observation_digest":"sha256:98bce5a4306f540f14bbf997b9fa634cd10de4d7497a36f1c0258552ccca4517","observation_id":"96cb9021-43dc-4054-80b3-939c38954456","resolution":{"observed_at":"2026-08-07T14:22:21.475332Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:21.307222Z","title":null,"venue":null,"work_id":"7c2e9a6a-abf2-4338-9da5-30eef094a696","year":2024},"citing_paper":{"arxiv_id":"2505.19091","last_updated":"2025-05-25T11:02:01Z","snapshot_observed_at":"2026-08-07T14:18:19.325846Z","submitted_at":"2025-05-25T11:02:01Z","title":"ReadBench: Measuring the Dense Text Visual Reading Ability of Vision-Language Models","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T14:22:15.319584Z"},"links":{"citing_paper":"/paper/2505.19091"},"observation_digest":"sha256:51bf08c3724b605db79c31a3bf587c20e2f7b427fbd5017eec2f194416da2c2e","observation_id":"78970237-af36-409c-bd97-0552e2ca09ed","resolution":{"observed_at":"2026-08-07T14:22:21.383883Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.07726","last_updated":"2024-10-10T17:28:23Z","snapshot_observed_at":"2026-08-08T07:16:45.596308Z","submitted_at":"2024-07-10T14:57:46Z","title":"PaliGemma: A versatile 3B VLM for transfer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.07726","snapshot_observed_at":"2026-08-07T14:22:15.397235Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19091","last_updated":"2025-05-25T11:02:01Z","snapshot_observed_at":"2026-08-07T14:18:19.325846Z","submitted_at":"2025-05-25T11:02:01Z","title":"ReadBench: Measuring the Dense Text Visual Reading Ability of Vision-Language Models","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T14:22:15.397235Z"},"links":{"cited_paper":"/paper/2407.07726","citing_paper":"/paper/2505.19091"},"observation_digest":"sha256:778de247a14dcbab60ed5ba06fe152b410786fee82d7246067c3c3d29ccd6451","observation_id":"9c30917c-798b-4af5-9887-7dc76a220965","resolution":{"observed_at":"2026-08-07T14:22:15.397235Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:21.140135Z","title":null,"venue":null,"work_id":"35edef96-5a20-41c4-b106-328b1c83d7e7","year":2023},"citing_paper":{"arxiv_id":"2505.19091","last_updated":"2025-05-25T11:02:01Z","snapshot_observed_at":"2026-08-07T14:18:19.325846Z","submitted_at":"2025-05-25T11:02:01Z","title":"ReadBench: Measuring the Dense Text Visual Reading Ability of Vision-Language Models","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T14:22:15.462364Z"},"links":{"citing_paper":"/paper/2505.19091"},"observation_digest":"sha256:68597b26df2b57d9157aee731bd0265d88a6d40143159c5717fe1c1870600b2e","observation_id":"3350f784-21c7-48ac-a003-57e45b192854","resolution":{"observed_at":"2026-08-07T14:22:21.187406Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:20.996793Z","title":null,"venue":null,"work_id":"f5d955a4-d583-45b9-9636-b5113e76a06b","year":2021},"citing_paper":{"arxiv_id":"2505.19091","last_updated":"2025-05-25T11:02:01Z","snapshot_observed_at":"2026-08-07T14:18:19.325846Z","submitted_at":"2025-05-25T11:02:01Z","title":"ReadBench: Measuring the Dense Text Visual Reading Ability of Vision-Language Models","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T14:22:15.666369Z"},"links":{"citing_paper":"/paper/2505.19091"},"observation_digest":"sha256:d937975207a28a3610c81dc812ad7d6316f6fdfcb0a608f1295896ead7587b45","observation_id":"ea4f78eb-b100-4568-a9bf-c1804f9cfddd","resolution":{"observed_at":"2026-08-07T14:22:21.058646Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:20.840600Z","title":null,"venue":null,"work_id":"becd5316-a86a-4376-b2f9-4c4129d13f27","year":2017},"citing_paper":{"arxiv_id":"2505.19091","last_updated":"2025-05-25T11:02:01Z","snapshot_observed_at":"2026-08-07T14:18:19.325846Z","submitted_at":"2025-05-25T11:02:01Z","title":"ReadBench: Measuring the Dense Text Visual Reading Ability of Vision-Language Models","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T14:22:15.960863Z"},"links":{"citing_paper":"/paper/2505.19091"},"observation_digest":"sha256:931d65dffc51b36c69a8b4b0533029afb3e5f83ce7b0ac300bb90ab4aa611c04","observation_id":"a6d08d23-0b1e-465b-8d74-2ca2c96c8c1a","resolution":{"observed_at":"2026-08-07T14:22:20.895656Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:20.698363Z","title":null,"venue":null,"work_id":"1ac4be27-9b2d-4157-9177-6babe2a7eb0a","year":2024},"citing_paper":{"arxiv_id":"2505.19091","last_updated":"2025-05-25T11:02:01Z","snapshot_observed_at":"2026-08-07T14:18:19.325846Z","submitted_at":"2025-05-25T11:02:01Z","title":"ReadBench: Measuring the Dense Text Visual Reading Ability of Vision-Language Models","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T14:22:15.993292Z"},"links":{"citing_paper":"/paper/2505.19091"},"observation_digest":"sha256:6c571ee55b02bde80263d4abee0e98f77afad8a507c7a9becc162f9e5c651cd1","observation_id":"63e625ac-674c-4ec6-85ad-337613c8fb95","resolution":{"observed_at":"2026-08-07T14:22:20.791427Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:16.056473Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19091","last_updated":"2025-05-25T11:02:01Z","snapshot_observed_at":"2026-08-07T14:18:19.325846Z","submitted_at":"2025-05-25T11:02:01Z","title":"ReadBench: Measuring the Dense Text Visual Reading Ability of Vision-Language Models","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T14:22:16.056473Z"},"links":{"citing_paper":"/paper/2505.19091"},"observation_digest":"sha256:83d6bf5a654baa941452b9f189ca348cf49b6dcb17ea188bddd5f7bcec0d7aea","observation_id":"149f477f-8175-4c79-96a5-b2161a7e20ac","resolution":{"observed_at":"2026-08-07T14:22:16.056473Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04127","last_updated":"2025-01-10T14:31:21Z","snapshot_observed_at":"2026-08-02T00:54:17.243656Z","submitted_at":"2024-06-06T14:49:06Z","title":"Are We Done with MMLU?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04127","snapshot_observed_at":"2026-08-07T14:22:16.148952Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19091","last_updated":"2025-05-25T11:02:01Z","snapshot_observed_at":"2026-08-07T14:18:19.325846Z","submitted_at":"2025-05-25T11:02:01Z","title":"ReadBench: Measuring the Dense Text Visual Reading Ability of Vision-Language Models","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T14:22:16.148952Z"},"links":{"cited_paper":"/paper/2406.04127","citing_paper":"/paper/2505.19091"},"observation_digest":"sha256:a65f11554a2f290566bd5ca15d3519a18b3b04724cc9211c259a66d9314e3801","observation_id":"710d461c-00ca-4d95-bdd9-67c7c3375277","resolution":{"observed_at":"2026-08-07T14:22:16.148952Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05530","last_updated":"2024-12-16T17:39:39Z","snapshot_observed_at":"2026-07-06T17:41:42.995949Z","submitted_at":"2024-03-08T18:54:20Z","title":"Gemini 1.5: Unlocking multimodal understanding across millions of tokens of context","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05530","snapshot_observed_at":"2026-08-07T14:22:16.193830Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19091","last_updated":"2025-05-25T11:02:01Z","snapshot_observed_at":"2026-08-07T14:18:19.325846Z","submitted_at":"2025-05-25T11:02:01Z","title":"ReadBench: Measuring the Dense Text Visual Reading Ability of Vision-Language Models","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T14:22:16.193830Z"},"links":{"cited_paper":"/paper/2403.05530","citing_paper":"/paper/2505.19091"},"observation_digest":"sha256:c87843b0694482497f01709c77e74bbf8f49dcf789e56cff6b32def8fd0a2b12","observation_id":"772d1901-f92c-4aed-9140-0213a2e69bb8","resolution":{"observed_at":"2026-08-07T14:22:16.193830Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:20.535259Z","title":null,"venue":null,"work_id":"16a23ea0-80fc-4ec4-aceb-8b06b34f2edd","year":2021},"citing_paper":{"arxiv_id":"2505.19091","last_updated":"2025-05-25T11:02:01Z","snapshot_observed_at":"2026-08-07T14:18:19.325846Z","submitted_at":"2025-05-25T11:02:01Z","title":"ReadBench: Measuring the Dense Text Visual Reading Ability of Vision-Language Models","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T14:22:16.276144Z"},"links":{"citing_paper":"/paper/2505.19091"},"observation_digest":"sha256:3711f60ef4ca92ae4ea266cb8ba5e6c59910e805fe4721dc507965ee86a3bf18","observation_id":"44dafb12-e62a-40f6-ad08-97497d455f20","resolution":{"observed_at":"2026-08-07T14:22:20.599123Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:16.350173Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.19091","last_updated":"2025-05-25T11:02:01Z","snapshot_observed_at":"2026-08-07T14:18:19.325846Z","submitted_at":"2025-05-25T11:02:01Z","title":"ReadBench: Measuring the Dense Text Visual Reading Ability of Vision-Language Models","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T14:22:16.350173Z"},"links":{"citing_paper":"/paper/2505.19091"},"observation_digest":"sha256:ea6fc6b676730a71c6bb80eb8b7807f1cb75d3485e4c34d96d0874a62d960a49","observation_id":"4a8cfe55-d7d5-4881-bb3b-25a6a94ce22d","resolution":{"observed_at":"2026-08-07T14:22:16.350173Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:20.447749Z","title":null,"venue":null,"work_id":"d6a71bbb-1006-4ff8-ba27-585ad3ca7aad","year":2024},"citing_paper":{"arxiv_id":"2505.19091","last_updated":"2025-05-25T11:02:01Z","snapshot_observed_at":"2026-08-07T14:18:19.325846Z","submitted_at":"2025-05-25T11:02:01Z","title":"ReadBench: Measuring the Dense Text Visual Reading Ability of Vision-Language Models","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T14:22:16.404584Z"},"links":{"citing_paper":"/paper/2505.19091"},"observation_digest":"sha256:c02c1caf8e26026924e36b8b0ace85812720341967a6c39d53e864c27f03fb7c","observation_id":"2e099a18-1910-408a-9ec6-a8940ee999e4","resolution":{"observed_at":"2026-08-07T14:22:20.475478Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-07T14:22:16.473235Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19091","last_updated":"2025-05-25T11:02:01Z","snapshot_observed_at":"2026-08-07T14:18:19.325846Z","submitted_at":"2025-05-25T11:02:01Z","title":"ReadBench: Measuring the Dense Text Visual Reading Ability of Vision-Language Models","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T14:22:16.473235Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2505.19091"},"observation_digest":"sha256:af285222e38d9241c6a68db6bd0bb3b43365e31c431f37035acd6ea5ccf79c97","observation_id":"08188aaf-101f-41de-a959-8b70270610e9","resolution":{"observed_at":"2026-08-07T14:22:16.473235Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:16.577583Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.19091","last_updated":"2025-05-25T11:02:01Z","snapshot_observed_at":"2026-08-07T14:18:19.325846Z","submitted_at":"2025-05-25T11:02:01Z","title":"ReadBench: Measuring the Dense Text Visual Reading Ability of Vision-Language Models","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T14:22:16.577583Z"},"links":{"citing_paper":"/paper/2505.19091"},"observation_digest":"sha256:0093d8c1c301da8b5830529a025b4a2e089a67d1966780118fb3c905e9b95f5f","observation_id":"aee66e8f-19a0-484c-a873-8a4e20840689","resolution":{"observed_at":"2026-08-07T14:22:16.577583Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:20.228847Z","title":null,"venue":null,"work_id":"868c790d-c684-4cf9-a383-42bdc0d0d188","year":2017},"citing_paper":{"arxiv_id":"2505.19091","last_updated":"2025-05-25T11:02:01Z","snapshot_observed_at":"2026-08-07T14:18:19.325846Z","submitted_at":"2025-05-25T11:02:01Z","title":"ReadBench: Measuring the Dense Text Visual Reading Ability of Vision-Language Models","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T14:22:16.628128Z"},"links":{"citing_paper":"/paper/2505.19091"},"observation_digest":"sha256:01d423868050ed154ccbbc075cf3ffbd4c7cefe99191fd761cc0beb66ae6459d","observation_id":"f66744fb-3031-44a8-a458-713ee1618c49","resolution":{"observed_at":"2026-08-07T14:22:20.306771Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:20.080472Z","title":null,"venue":null,"work_id":"7bfe7107-e97c-4561-b0c9-5eea893d831a","year":2023},"citing_paper":{"arxiv_id":"2505.19091","last_updated":"2025-05-25T11:02:01Z","snapshot_observed_at":"2026-08-07T14:18:19.325846Z","submitted_at":"2025-05-25T11:02:01Z","title":"ReadBench: Measuring the Dense Text Visual Reading Ability of Vision-Language Models","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T14:22:16.725180Z"},"links":{"citing_paper":"/paper/2505.19091"},"observation_digest":"sha256:3e069f43b9246d22ecf105650d0728873a8526e66df9df435a7d4c852523bdef","observation_id":"c06c9dd5-69c9-4453-a9d0-021e91397f4b","resolution":{"observed_at":"2026-08-07T14:22:20.120149Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:16.856094Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.19091","last_updated":"2025-05-25T11:02:01Z","snapshot_observed_at":"2026-08-07T14:18:19.325846Z","submitted_at":"2025-05-25T11:02:01Z","title":"ReadBench: Measuring the Dense Text Visual Reading Ability of Vision-Language Models","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T14:22:16.856094Z"},"links":{"citing_paper":"/paper/2505.19091"},"observation_digest":"sha256:a4b86e7723070a120ed863ef624a0255e28f9414d385cafabc48894edb7074dd","observation_id":"d37843a3-c27a-4b9e-9a4c-cc9423c46333","resolution":{"observed_at":"2026-08-07T14:22:16.856094Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:16.957747Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19091","last_updated":"2025-05-25T11:02:01Z","snapshot_observed_at":"2026-08-07T14:18:19.325846Z","submitted_at":"2025-05-25T11:02:01Z","title":"ReadBench: Measuring the Dense Text Visual Reading Ability of Vision-Language Models","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T14:22:16.957747Z"},"links":{"citing_paper":"/paper/2505.19091"},"observation_digest":"sha256:147229802a59e3eb53f25a594e2751ad3044e792f175cb707fc7eb1e1a39f2e8","observation_id":"247cbc9c-625a-467e-8bb7-dbb36f52ef2e","resolution":{"observed_at":"2026-08-07T14:22:16.957747Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:17.077528Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19091","last_updated":"2025-05-25T11:02:01Z","snapshot_observed_at":"2026-08-07T14:18:19.325846Z","submitted_at":"2025-05-25T11:02:01Z","title":"ReadBench: Measuring the Dense Text Visual Reading Ability of Vision-Language Models","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T14:22:17.077528Z"},"links":{"citing_paper":"/paper/2505.19091"},"observation_digest":"sha256:b1dbe067f11b138bd5f2bdab9eb46d116a24c597234dd1902c0a80e9ae900929","observation_id":"fc88de60-333d-41ae-bb01-0ed320cfe8ea","resolution":{"observed_at":"2026-08-07T14:22:17.077528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:17.189077Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19091","last_updated":"2025-05-25T11:02:01Z","snapshot_observed_at":"2026-08-07T14:18:19.325846Z","submitted_at":"2025-05-25T11:02:01Z","title":"ReadBench: Measuring the Dense Text Visual Reading Ability of Vision-Language Models","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T14:22:17.189077Z"},"links":{"citing_paper":"/paper/2505.19091"},"observation_digest":"sha256:863cdd24fe5b0d00a1e9a1aa3e4d1654a0bc0594f762f4cd7ec226c80c9f5bce","observation_id":"1738294d-1e7f-4582-af4e-c99026dec0ac","resolution":{"observed_at":"2026-08-07T14:22:17.189077Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:19.794041Z","title":null,"venue":null,"work_id":"76cb4ea5-b11f-4731-81bb-b65ae43f70e4","year":2024},"citing_paper":{"arxiv_id":"2505.19091","last_updated":"2025-05-25T11:02:01Z","snapshot_observed_at":"2026-08-07T14:18:19.325846Z","submitted_at":"2025-05-25T11:02:01Z","title":"ReadBench: Measuring the Dense Text Visual Reading Ability of Vision-Language Models","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T14:22:17.237006Z"},"links":{"citing_paper":"/paper/2505.19091"},"observation_digest":"sha256:476a1de6f4dc6d2bf547bb95ec400bc48f1e3093878aa5ced74bb3ad689a4572","observation_id":"28b0f7d4-bad6-49b6-9526-18085c2b035b","resolution":{"observed_at":"2026-08-07T14:22:19.893775Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:17.311371Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.19091","last_updated":"2025-05-25T11:02:01Z","snapshot_observed_at":"2026-08-07T14:18:19.325846Z","submitted_at":"2025-05-25T11:02:01Z","title":"ReadBench: Measuring the Dense Text Visual Reading Ability of Vision-Language Models","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T14:22:17.311371Z"},"links":{"citing_paper":"/paper/2505.19091"},"observation_digest":"sha256:1b6302ed6713ce4ec5db4b55ae5a67ada647e122c6ab19a98afb95068d90a5e9","observation_id":"51e508f0-b950-4597-b83f-9f600359e79e","resolution":{"observed_at":"2026-08-07T14:22:17.311371Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:19.593212Z","title":null,"venue":null,"work_id":"813ba41d-5aa9-4b12-9720-e33e1e4703c0","year":2009},"citing_paper":{"arxiv_id":"2505.19091","last_updated":"2025-05-25T11:02:01Z","snapshot_observed_at":"2026-08-07T14:18:19.325846Z","submitted_at":"2025-05-25T11:02:01Z","title":"ReadBench: Measuring the Dense Text Visual Reading Ability of Vision-Language Models","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T14:22:17.387127Z"},"links":{"citing_paper":"/paper/2505.19091"},"observation_digest":"sha256:2bb07e92b95cd55e9edb0f2080aa539b6d0727574ef801f45e0529e997f0a652","observation_id":"6e7451b9-c9a1-4ec2-8d69-877535d0419f","resolution":{"observed_at":"2026-08-07T14:22:19.646371Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.05167","last_updated":"2025-07-09T14:35:23Z","snapshot_observed_at":"2026-08-08T19:59:08.845558Z","submitted_at":"2025-02-07T18:49:46Z","title":"NoLiMa: Long-Context Evaluation Beyond Literal Matching","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.05167","snapshot_observed_at":"2026-08-07T14:22:17.501214Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19091","last_updated":"2025-05-25T11:02:01Z","snapshot_observed_at":"2026-08-07T14:18:19.325846Z","submitted_at":"2025-05-25T11:02:01Z","title":"ReadBench: Measuring the Dense Text Visual Reading Ability of Vision-Language Models","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T14:22:17.501214Z"},"links":{"cited_paper":"/paper/2502.05167","citing_paper":"/paper/2505.19091"},"observation_digest":"sha256:34b6ad7de772e5a9e01c7e010a66c1303f974b48b4788453f0093560cf2144de","observation_id":"ba026d5b-c096-4fd6-9b1d-4d898b9f3da7","resolution":{"observed_at":"2026-08-07T14:22:17.501214Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:17.570803Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.19091","last_updated":"2025-05-25T11:02:01Z","snapshot_observed_at":"2026-08-07T14:18:19.325846Z","submitted_at":"2025-05-25T11:02:01Z","title":"ReadBench: Measuring the Dense Text Visual Reading Ability of Vision-Language Models","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T14:22:17.570803Z"},"links":{"citing_paper":"/paper/2505.19091"},"observation_digest":"sha256:39a05052bc969b5425bc0a4e638847ab3cd99c879785b6ddbfe403dfdd7576f8","observation_id":"9eb87987-ff3f-4ef5-8c9c-be4e6001fc98","resolution":{"observed_at":"2026-08-07T14:22:17.570803Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:19.439964Z","title":null,"venue":null,"work_id":"9d3b1bef-2c64-4ddc-9ee9-44840a422863","year":2024},"citing_paper":{"arxiv_id":"2505.19091","last_updated":"2025-05-25T11:02:01Z","snapshot_observed_at":"2026-08-07T14:18:19.325846Z","submitted_at":"2025-05-25T11:02:01Z","title":"ReadBench: Measuring the Dense Text Visual Reading Ability of Vision-Language Models","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T14:22:17.626513Z"},"links":{"citing_paper":"/paper/2505.19091"},"observation_digest":"sha256:cbc422611f59370e944d47997b68da495c9782a62688f16b5915130b1fc738ac","observation_id":"397a5e3c-d1f6-4ca8-846b-ffe7fd5da5b1","resolution":{"observed_at":"2026-08-07T14:22:19.486514Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:17.701013Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.19091","last_updated":"2025-05-25T11:02:01Z","snapshot_observed_at":"2026-08-07T14:18:19.325846Z","submitted_at":"2025-05-25T11:02:01Z","title":"ReadBench: Measuring the Dense Text Visual Reading Ability of Vision-Language Models","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T14:22:17.701013Z"},"links":{"citing_paper":"/paper/2505.19091"},"observation_digest":"sha256:a2e1a341009d61784eb5be17257bb2bb4a0881d7a7ad0f403d261be348db74f2","observation_id":"b316431b-9168-4469-a970-424496c9fff7","resolution":{"observed_at":"2026-08-07T14:22:17.701013Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.01574","last_updated":"2024-11-06T02:54:00Z","snapshot_observed_at":"2026-08-06T00:29:17.674418Z","submitted_at":"2024-06-03T17:53:00Z","title":"MMLU-Pro: A More Robust and Challenging Multi-Task Language Understanding Benchmark","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.01574","snapshot_observed_at":"2026-08-07T14:22:17.775672Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19091","last_updated":"2025-05-25T11:02:01Z","snapshot_observed_at":"2026-08-07T14:18:19.325846Z","submitted_at":"2025-05-25T11:02:01Z","title":"ReadBench: Measuring the Dense Text Visual Reading Ability of Vision-Language Models","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T14:22:17.775672Z"},"links":{"cited_paper":"/paper/2406.01574","citing_paper":"/paper/2505.19091"},"observation_digest":"sha256:59d2766f89234f69d3fad2a3677a1149b46efc62f6c0aa55e64f82ed0cf2f94c","observation_id":"49d8a318-a516-4e15-a43d-cf47b6b16376","resolution":{"observed_at":"2026-08-07T14:22:17.775672Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:19.265039Z","title":null,"venue":null,"work_id":"cb7d0f2d-58f5-47f6-b515-adb9b110c19a","year":2018},"citing_paper":{"arxiv_id":"2505.19091","last_updated":"2025-05-25T11:02:01Z","snapshot_observed_at":"2026-08-07T14:18:19.325846Z","submitted_at":"2025-05-25T11:02:01Z","title":"ReadBench: Measuring the Dense Text Visual Reading Ability of Vision-Language Models","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T14:22:17.907315Z"},"links":{"citing_paper":"/paper/2505.19091"},"observation_digest":"sha256:1b907ce4241a03ef52496cc5a432ed6ddaf6acd69485d9e8ca99129b6c8890bf","observation_id":"5d00ea9e-c2f6-4a56-94e5-eb55ca87581c","resolution":{"observed_at":"2026-08-07T14:22:19.315026Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10594","last_updated":"2025-03-02T01:19:51Z","snapshot_observed_at":"2026-08-02T13:24:00.339129Z","submitted_at":"2024-10-14T15:04:18Z","title":"VisRAG: Vision-based Retrieval-augmented Generation on Multi-modality Documents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.10594","snapshot_observed_at":"2026-08-07T14:22:18.003754Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19091","last_updated":"2025-05-25T11:02:01Z","snapshot_observed_at":"2026-08-07T14:18:19.325846Z","submitted_at":"2025-05-25T11:02:01Z","title":"ReadBench: Measuring the Dense Text Visual Reading Ability of Vision-Language Models","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T14:22:18.003754Z"},"links":{"cited_paper":"/paper/2410.10594","citing_paper":"/paper/2505.19091"},"observation_digest":"sha256:1b4a95a00eb3552463d7fa6e164f9e8e56fe99c3b6f6581f8f6f5ef5ec03733a","observation_id":"95b6676e-d350-4c12-b78b-d8dfb9175291","resolution":{"observed_at":"2026-08-07T14:22:18.003754Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:18.095788Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19091","last_updated":"2025-05-25T11:02:01Z","snapshot_observed_at":"2026-08-07T14:18:19.325846Z","submitted_at":"2025-05-25T11:02:01Z","title":"ReadBench: Measuring the Dense Text Visual Reading Ability of Vision-Language Models","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T14:22:18.095788Z"},"links":{"citing_paper":"/paper/2505.19091"},"observation_digest":"sha256:dd890cfa6a1d665d824a58787d1787cab9c986ae63b6f27b2aa616942769af2e","observation_id":"33dbe99d-b3aa-4409-b2b2-f564bb313194","resolution":{"observed_at":"2026-08-07T14:22:18.095788Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.02592","last_updated":"2025-08-30T07:10:08Z","snapshot_observed_at":"2026-08-07T19:18:09.165929Z","submitted_at":"2024-12-03T17:23:47Z","title":"OCR Hinders RAG: Evaluating the Cascading Impact of OCR on Retrieval-Augmented Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.02592","snapshot_observed_at":"2026-08-07T14:22:18.214346Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19091","last_updated":"2025-05-25T11:02:01Z","snapshot_observed_at":"2026-08-07T14:18:19.325846Z","submitted_at":"2025-05-25T11:02:01Z","title":"ReadBench: Measuring the Dense Text Visual Reading Ability of Vision-Language Models","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T14:22:18.214346Z"},"links":{"cited_paper":"/paper/2412.02592","citing_paper":"/paper/2505.19091"},"observation_digest":"sha256:81bbd660a43b69bdb0d98a67b42f45db8e76acdca54f0c5cffb80744798cb6a0","observation_id":"60ae3611-5178-4791-8278-a1eab7bdc736","resolution":{"observed_at":"2026-08-07T14:22:18.214346Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:18.350538Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.19091","last_updated":"2025-05-25T11:02:01Z","snapshot_observed_at":"2026-08-07T14:18:19.325846Z","submitted_at":"2025-05-25T11:02:01Z","title":"ReadBench: Measuring the Dense Text Visual Reading Ability of Vision-Language Models","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T14:22:18.350538Z"},"links":{"citing_paper":"/paper/2505.19091"},"observation_digest":"sha256:c0edf58c4b5b0c6cf527a95f78d17386932b7bf0a76cad7d005d5acee88ffcb6","observation_id":"10cf679d-552d-4c77-9b26-b60af85b97f7","resolution":{"observed_at":"2026-08-07T14:22:18.350538Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:22:18.452564Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.19091","last_updated":"2025-05-25T11:02:01Z","snapshot_observed_at":"2026-08-07T14:18:19.325846Z","submitted_at":"2025-05-25T11:02:01Z","title":"ReadBench: Measuring the Dense Text Visual Reading Ability of Vision-Language Models","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T14:22:18.452564Z"},"links":{"citing_paper":"/paper/2505.19091"},"observation_digest":"sha256:51adbf3d416af6338b6d1d702cc24fbc972acc9c1b3ee60f1c6c27e8166ad746","observation_id":"8eea4255-6fb5-4a02-9eba-c1e68a6518a4","resolution":{"observed_at":"2026-08-07T14:22:18.452564Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.19091","last_updated":"2025-05-25T11:02:01Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T14:18:19.325846Z","submitted_at":"2025-05-25T11:02:01Z","title":"ReadBench: Measuring the Dense Text Visual Reading Ability of Vision-Language Models"},"reference_resolution":{"displayed":39,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":37,"verified_exact":2,"verified_fuzzy":0},"total_outbound_references":39},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 39 of 39 outbound references and 1 inbound Pith citation observation for arXiv:2505.19091."}