{"as_of":"2026-08-09T05:04:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7e91807d31fc95426d6f2f1e5f5a023bfa81e43bc751c0737e68ee6e0e6794fb","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":23,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":23,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":23,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":23,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T13:24:52.343132Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-02T16:17:09.161062Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2407.01523","last_updated":"2024-11-12T04:37:44Z","snapshot_observed_at":"2026-08-06T08:51:10.907429Z","submitted_at":"2024-07-01T17:59:26Z","title":"MMLongBench-Doc: Benchmarking Long-context Document Understanding with Visualizations","version":3},"cited_work":{"arxiv_id":"2407.01523","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.01523","snapshot_observed_at":"2026-07-02T16:17:09.161062Z","title":"Mmlongbench-doc: Benchmarking long-context document understanding with visualizations","venue":null,"work_id":"2246b9f1-e504-4ca8-9082-3ab923759798","year":2024},"citing_paper":{"arxiv_id":"2407.03320","last_updated":"2024-07-03T17:59:21Z","snapshot_observed_at":"2026-08-04T22:09:42.241578Z","submitted_at":"2024-07-03T17:59:21Z","title":"InternLM-XComposer-2.5: A Versatile Large Vision Language Model Supporting Long-Contextual Input and Output","version":1},"reference_index":104,"source":"pdf_text","source_observed_at":"2026-05-17T10:46:28.447347Z"},"links":{"cited_paper":"/paper/2407.01523","citing_paper":"/paper/2407.03320"},"observation_digest":"sha256:2d5b94cebe5db6942a7691561c49594522c1673e183da4f673a3a8906a4b7ebd","observation_id":"a4ec3907-b82d-449f-a91d-604544b7d78a","resolution":{"observed_at":"2026-05-17T10:46:28.895841Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.01523","last_updated":"2024-11-12T04:37:44Z","snapshot_observed_at":"2026-08-06T08:51:10.907429Z","submitted_at":"2024-07-01T17:59:26Z","title":"MMLongBench-Doc: Benchmarking Long-context Document Understanding with Visualizations","version":3},"cited_work":{"arxiv_id":"2407.01523","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.01523","snapshot_observed_at":"2026-07-02T16:17:09.161062Z","title":"Mmlongbench-doc: Benchmarking long-context document understanding with visualizations","venue":null,"work_id":"2246b9f1-e504-4ca8-9082-3ab923759798","year":2024},"citing_paper":{"arxiv_id":"2501.00321","last_updated":"2025-06-05T02:59:05Z","snapshot_observed_at":"2026-08-07T17:13:10.057242Z","submitted_at":"2024-12-31T07:32:35Z","title":"OCRBench v2: An Improved Benchmark for Evaluating Large Multimodal Models on Visual Text Localization and Reasoning","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-17T20:33:26.613927Z"},"links":{"cited_paper":"/paper/2407.01523","citing_paper":"/paper/2501.00321"},"observation_digest":"sha256:94e12f3d5a93c7508b7c0cd2c60e65d57ba88e718ca8727f2da9166d6f1d1e71","observation_id":"f474b427-eae1-430a-ba6e-6291ebc0328f","resolution":{"observed_at":"2026-05-17T20:33:26.769132Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.01523","last_updated":"2024-11-12T04:37:44Z","snapshot_observed_at":"2026-08-06T08:51:10.907429Z","submitted_at":"2024-07-01T17:59:26Z","title":"MMLongBench-Doc: Benchmarking Long-context Document Understanding with Visualizations","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.01523","snapshot_observed_at":"2026-08-07T13:24:52.343132Z","title":"Mmlongbench-doc: Benchmarking long-context document understanding with visualizations","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22019","last_updated":"2025-06-03T05:28:55Z","snapshot_observed_at":"2026-08-07T13:14:56.558609Z","submitted_at":"2025-05-28T06:30:51Z","title":"VRAG-RL: Empower Vision-Perception-Based RAG for Visually Rich Information Understanding via Iterative Reasoning with Reinforcement Learning","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T13:24:52.343132Z"},"links":{"cited_paper":"/paper/2407.01523","citing_paper":"/paper/2505.22019"},"observation_digest":"sha256:f9231d124cb5d2763ec709b865da54d67e0a5b55e1a42a7d8483515b36f6ca95","observation_id":"c0ed3f2c-aa1f-435a-90bb-bee0c89944d7","resolution":{"observed_at":"2026-08-07T13:24:52.343132Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.01523","last_updated":"2024-11-12T04:37:44Z","snapshot_observed_at":"2026-08-06T08:51:10.907429Z","submitted_at":"2024-07-01T17:59:26Z","title":"MMLongBench-Doc: Benchmarking Long-context Document Understanding with Visualizations","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.01523","snapshot_observed_at":"2026-08-06T23:58:26.366936Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.15594","last_updated":"2025-06-18T16:09:18Z","snapshot_observed_at":"2026-08-08T00:40:27.969150Z","submitted_at":"2025-06-18T16:09:18Z","title":"WikiMixQA: A Multimodal Benchmark for Question Answering over Tables and Charts","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-06T23:58:26.366936Z"},"links":{"cited_paper":"/paper/2407.01523","citing_paper":"/paper/2506.15594"},"observation_digest":"sha256:62c0d7b7b294a6959eed76550177a3caa971fa8a1941f7209e6c52a60f46540a","observation_id":"aee3b0cc-1206-4230-a44e-afc8d3ed86ee","resolution":{"observed_at":"2026-08-06T23:58:26.366936Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.01523","last_updated":"2024-11-12T04:37:44Z","snapshot_observed_at":"2026-08-06T08:51:10.907429Z","submitted_at":"2024-07-01T17:59:26Z","title":"MMLongBench-Doc: Benchmarking Long-context Document Understanding with Visualizations","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.01523","snapshot_observed_at":"2026-08-06T23:00:11.143406Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.20187","last_updated":"2025-07-02T05:12:29Z","snapshot_observed_at":"2026-08-07T20:42:38.846597Z","submitted_at":"2025-06-25T07:26:42Z","title":"Breaking the Boundaries of Long-Context LLM Inference: Adaptive KV Management on a Single Commodity GPU","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T23:00:11.143406Z"},"links":{"cited_paper":"/paper/2407.01523","citing_paper":"/paper/2506.20187"},"observation_digest":"sha256:80c7ad1aeeb3b780f31f96f34cfeb7298eb9559f9f22a21c17bb47018e2b9116","observation_id":"3b933033-63d9-44ac-aff3-402f563405c4","resolution":{"observed_at":"2026-08-06T23:00:11.143406Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.01523","last_updated":"2024-11-12T04:37:44Z","snapshot_observed_at":"2026-08-06T08:51:10.907429Z","submitted_at":"2024-07-01T17:59:26Z","title":"MMLongBench-Doc: Benchmarking Long-context Document Understanding with Visualizations","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.01523","snapshot_observed_at":"2026-08-06T22:45:54.555828Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.20844","last_updated":"2025-06-29T02:57:01Z","snapshot_observed_at":"2026-08-08T19:50:59.025402Z","submitted_at":"2025-06-25T21:29:33Z","title":"The Next Phase of Scientific Fact-Checking: Advanced Evidence Retrieval from Complex Structured Academic Papers","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-06T22:45:54.555828Z"},"links":{"cited_paper":"/paper/2407.01523","citing_paper":"/paper/2506.20844"},"observation_digest":"sha256:223822b8883ceded3a998aedc276215181af31f6c7349c77781e767fc76d4d9d","observation_id":"1260f822-738f-40b9-996b-4ff5567b5c5f","resolution":{"observed_at":"2026-08-06T22:45:54.555828Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.01523","last_updated":"2024-11-12T04:37:44Z","snapshot_observed_at":"2026-08-06T08:51:10.907429Z","submitted_at":"2024-07-01T17:59:26Z","title":"MMLongBench-Doc: Benchmarking Long-context Document Understanding with Visualizations","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.01523","snapshot_observed_at":"2026-08-06T23:47:38.698127Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.21600","last_updated":"2025-06-19T07:16:18Z","snapshot_observed_at":"2026-08-09T00:01:38.513352Z","submitted_at":"2025-06-19T07:16:18Z","title":"Structured Attention Matters to Multimodal LLMs in Document Understanding","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-06T23:47:38.698127Z"},"links":{"cited_paper":"/paper/2407.01523","citing_paper":"/paper/2506.21600"},"observation_digest":"sha256:818d1342fd651028e99026fbbe52a9bf3edff9ef500d762b1a0d2ed8ba040a08","observation_id":"79f003c5-613d-490b-919f-c1a4b29a166a","resolution":{"observed_at":"2026-08-06T23:47:38.698127Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.01523","last_updated":"2024-11-12T04:37:44Z","snapshot_observed_at":"2026-08-06T08:51:10.907429Z","submitted_at":"2024-07-01T17:59:26Z","title":"MMLongBench-Doc: Benchmarking Long-context Document Understanding with Visualizations","version":3},"cited_work":{"arxiv_id":"2407.01523","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.01523","snapshot_observed_at":"2026-07-02T16:17:09.161062Z","title":"Mmlongbench-doc: Benchmarking long-context document understanding with visualizations","venue":null,"work_id":"2246b9f1-e504-4ca8-9082-3ab923759798","year":2024},"citing_paper":{"arxiv_id":"2507.04590","last_updated":"2025-07-07T00:51:57Z","snapshot_observed_at":"2026-08-08T15:48:31.665148Z","submitted_at":"2025-07-07T00:51:57Z","title":"VLM2Vec-V2: Advancing Multimodal Embedding for Videos, Images, and Visual Documents","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-18T14:10:14.929207Z"},"links":{"cited_paper":"/paper/2407.01523","citing_paper":"/paper/2507.04590"},"observation_digest":"sha256:3b39f7630e23ae5cf3966cf42f97998ceb618848a1266395006cdb06d251a8af","observation_id":"ec58836f-28a4-4deb-82ba-8570b98fcec4","resolution":{"observed_at":"2026-05-18T14:10:15.201235Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.01523","last_updated":"2024-11-12T04:37:44Z","snapshot_observed_at":"2026-08-06T08:51:10.907429Z","submitted_at":"2024-07-01T17:59:26Z","title":"MMLongBench-Doc: Benchmarking Long-context Document Understanding with Visualizations","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.01523","snapshot_observed_at":"2026-08-06T16:12:02.996244Z","title":"Mmlongbench-doc: Benchmarking long-context document understanding with visualizations","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.15882","last_updated":"2025-08-04T20:48:37Z","snapshot_observed_at":"2026-08-08T04:41:23.907184Z","submitted_at":"2025-07-18T19:33:15Z","title":"Document Haystack: A Long Context Multimodal Image/Document Understanding Vision LLM Benchmark","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T16:12:02.996244Z"},"links":{"cited_paper":"/paper/2407.01523","citing_paper":"/paper/2507.15882"},"observation_digest":"sha256:cf58b145c4425a856eab6b4e74ee7cd17287d99db21eb5fbef4f24e9cb119841","observation_id":"d4acb8a5-5d1b-43b1-94a9-f204c153c49a","resolution":{"observed_at":"2026-08-06T16:12:02.996244Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.01523","last_updated":"2024-11-12T04:37:44Z","snapshot_observed_at":"2026-08-06T08:51:10.907429Z","submitted_at":"2024-07-01T17:59:26Z","title":"MMLongBench-Doc: Benchmarking Long-context Document Understanding with Visualizations","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.01523","snapshot_observed_at":"2026-08-06T13:45:18.451030Z","title":"Mmlongbench-doc: Benchmark- ing long-context document understanding with visual- izations,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.20145","last_updated":"2025-07-27T06:44:53Z","snapshot_observed_at":"2026-08-08T10:07:05.353800Z","submitted_at":"2025-07-27T06:44:53Z","title":"Multi-Agent Interactive Question Generation Framework for Long Document Understanding","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T13:45:18.451030Z"},"links":{"cited_paper":"/paper/2407.01523","citing_paper":"/paper/2507.20145"},"observation_digest":"sha256:665579f1bc3e463b1472f50fdee161783c30da6e07742234a49bb6dda3e99cd6","observation_id":"b6602d08-cec9-4ae5-8d63-dd8c648ee984","resolution":{"observed_at":"2026-08-06T13:45:18.451030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.01523","last_updated":"2024-11-12T04:37:44Z","snapshot_observed_at":"2026-08-06T08:51:10.907429Z","submitted_at":"2024-07-01T17:59:26Z","title":"MMLongBench-Doc: Benchmarking Long-context Document Understanding with Visualizations","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.01523","snapshot_observed_at":"2026-08-05T22:10:08.166980Z","title":"Mmlongbench-doc: Benchmarking long-context doc- ument understanding with visualizations","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.07493","last_updated":"2025-08-25T01:29:22Z","snapshot_observed_at":"2026-08-08T07:49:36.329390Z","submitted_at":"2025-08-10T21:44:43Z","title":"VisR-Bench: An Empirical Study on Visual Retrieval-Augmented Generation for Multilingual Long Document Understanding","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-05T22:10:08.166980Z"},"links":{"cited_paper":"/paper/2407.01523","citing_paper":"/paper/2508.07493"},"observation_digest":"sha256:d8c0f9557eedffbad9502a6f07ca6ca8a3b02cfeeed50f005d99ef1b9d3dfb7c","observation_id":"539bd716-b703-4f35-bd20-4a0174b3bf81","resolution":{"observed_at":"2026-08-05T22:10:08.166980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.01523","last_updated":"2024-11-12T04:37:44Z","snapshot_observed_at":"2026-08-06T08:51:10.907429Z","submitted_at":"2024-07-01T17:59:26Z","title":"MMLongBench-Doc: Benchmarking Long-context Document Understanding with Visualizations","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.01523","snapshot_observed_at":"2026-08-05T11:23:43.927169Z","title":"arXiv preprint arXiv:2407.01523","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.02864","last_updated":"2025-09-02T22:21:55Z","snapshot_observed_at":"2026-08-05T11:23:41.718435Z","submitted_at":"2025-09-02T22:21:55Z","title":"A-SEA3L-QA: A Fully Automated Self-Evolving, Adversarial Workflow for Arabic Long-Context Question-Answer Generation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T11:23:43.927169Z"},"links":{"cited_paper":"/paper/2407.01523","citing_paper":"/paper/2509.02864"},"observation_digest":"sha256:f5144229d7803a8af32410a3fdaafd584304b5271d0f90fb1b928237e66e99e1","observation_id":"c97f5a42-b1d1-455e-a20e-a55081a197d1","resolution":{"observed_at":"2026-08-05T11:23:43.927169Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.01523","last_updated":"2024-11-12T04:37:44Z","snapshot_observed_at":"2026-08-06T08:51:10.907429Z","submitted_at":"2024-07-01T17:59:26Z","title":"MMLongBench-Doc: Benchmarking Long-context Document Understanding with Visualizations","version":3},"cited_work":{"arxiv_id":"2407.01523","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.01523","snapshot_observed_at":"2026-07-02T16:17:09.161062Z","title":"Mmlongbench-doc: Benchmarking long-context document understanding with visualizations","venue":null,"work_id":"2246b9f1-e504-4ca8-9082-3ab923759798","year":2024},"citing_paper":{"arxiv_id":"2510.18830","last_updated":"2026-05-19T17:27:20Z","snapshot_observed_at":"2026-07-06T22:33:43.999976Z","submitted_at":"2025-10-21T17:25:32Z","title":"MTraining: Distributed Dynamic Sparse Attention for Efficient Ultra-Long Context Training","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-21T19:44:04.833504Z"},"links":{"cited_paper":"/paper/2407.01523","citing_paper":"/paper/2510.18830"},"observation_digest":"sha256:d1e30b0a4d33c1faf0278f67e692b0eec3a5b7822ee2b9571510e66734defc1b","observation_id":"8b59d568-3960-45b1-a816-be2561950209","resolution":{"observed_at":"2026-05-21T19:44:19.671447Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.01523","last_updated":"2024-11-12T04:37:44Z","snapshot_observed_at":"2026-08-06T08:51:10.907429Z","submitted_at":"2024-07-01T17:59:26Z","title":"MMLongBench-Doc: Benchmarking Long-context Document Understanding with Visualizations","version":3},"cited_work":{"arxiv_id":"2407.01523","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.01523","snapshot_observed_at":"2026-07-02T16:17:09.161062Z","title":"Mmlongbench-doc: Benchmarking long-context document understanding with visualizations","venue":null,"work_id":"2246b9f1-e504-4ca8-9082-3ab923759798","year":2024},"citing_paper":{"arxiv_id":"2604.02371","last_updated":"2026-06-29T16:52:45Z","snapshot_observed_at":"2026-08-07T20:37:01.650037Z","submitted_at":"2026-03-31T04:41:01Z","title":"Internalized Reasoning for Long-Context Visual Document Understanding","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-13T23:53:19.148407Z"},"links":{"cited_paper":"/paper/2407.01523","citing_paper":"/paper/2604.02371"},"observation_digest":"sha256:1ba08457f0d9c1081f31a6e77892a4e9cbf49d927312f7bc75696da78b4e10a3","observation_id":"46761a21-751d-45be-8914-1f098d401b18","resolution":{"observed_at":"2026-05-13T23:53:28.106451Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.01523","last_updated":"2024-11-12T04:37:44Z","snapshot_observed_at":"2026-08-06T08:51:10.907429Z","submitted_at":"2024-07-01T17:59:26Z","title":"MMLongBench-Doc: Benchmarking Long-context Document Understanding with Visualizations","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.01523","snapshot_observed_at":"2026-07-13T15:50:49.083652Z","title":"Mmlongbench-doc: Benchmarking long-context document understanding with visualizations, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2604.02371","last_updated":"2026-06-29T16:52:45Z","snapshot_observed_at":"2026-08-07T20:37:01.650037Z","submitted_at":"2026-03-31T04:41:01Z","title":"Internalized Reasoning for Long-Context Visual Document Understanding","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-07-13T15:50:49.083652Z"},"links":{"cited_paper":"/paper/2407.01523","citing_paper":"/paper/2604.02371"},"observation_digest":"sha256:8b2ad61fe26995ee22745f59a37ca31f01106fb3e564202645459e9e34dd6f6f","observation_id":"31ed8674-e872-47a7-bcc2-0d1907688e01","resolution":{"observed_at":"2026-07-13T15:50:49.083652Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.01523","last_updated":"2024-11-12T04:37:44Z","snapshot_observed_at":"2026-08-06T08:51:10.907429Z","submitted_at":"2024-07-01T17:59:26Z","title":"MMLongBench-Doc: Benchmarking Long-context Document Understanding with Visualizations","version":3},"cited_work":{"arxiv_id":"2407.01523","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.01523","snapshot_observed_at":"2026-07-02T16:17:09.161062Z","title":"Mmlongbench-doc: Benchmarking long-context document understanding with visualizations","venue":null,"work_id":"2246b9f1-e504-4ca8-9082-3ab923759798","year":2024},"citing_paper":{"arxiv_id":"2604.04901","last_updated":"2026-04-06T17:49:31Z","snapshot_observed_at":"2026-07-06T22:53:46.999911Z","submitted_at":"2026-04-06T17:49:31Z","title":"FileGram: Grounding Agent Personalization in File-System Behavioral Traces","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-10T19:33:57.643549Z"},"links":{"cited_paper":"/paper/2407.01523","citing_paper":"/paper/2604.04901"},"observation_digest":"sha256:72881b32f5f05ebe3f0f246bd438f4e627d9ecc02438af14aff94ff50b59f604","observation_id":"d454812c-67b1-4dda-a968-0520fdc06ff7","resolution":{"observed_at":"2026-05-10T22:45:51.251477Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.01523","last_updated":"2024-11-12T04:37:44Z","snapshot_observed_at":"2026-08-06T08:51:10.907429Z","submitted_at":"2024-07-01T17:59:26Z","title":"MMLongBench-Doc: Benchmarking Long-context Document Understanding with Visualizations","version":3},"cited_work":{"arxiv_id":"2407.01523","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.01523","snapshot_observed_at":"2026-07-02T16:17:09.161062Z","title":"Mmlongbench-doc: Benchmarking long-context document understanding with visualizations","venue":null,"work_id":"2246b9f1-e504-4ca8-9082-3ab923759798","year":2024},"citing_paper":{"arxiv_id":"2604.26837","last_updated":"2026-04-29T16:02:00Z","snapshot_observed_at":"2026-07-06T23:12:24.456023Z","submitted_at":"2026-04-29T16:02:00Z","title":"Unifying Sparse Attention with Hierarchical Memory for Scalable Long-Context LLM Serving","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-07T13:15:21.201950Z"},"links":{"cited_paper":"/paper/2407.01523","citing_paper":"/paper/2604.26837"},"observation_digest":"sha256:41ca11cab7c9966122543da1ee20505116c764458638408dc38e0f747e40538c","observation_id":"76cc8f0e-d4c9-4a96-b6e1-ab35d84a2c13","resolution":{"observed_at":"2026-05-12T09:01:25.920832Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.01523","last_updated":"2024-11-12T04:37:44Z","snapshot_observed_at":"2026-08-06T08:51:10.907429Z","submitted_at":"2024-07-01T17:59:26Z","title":"MMLongBench-Doc: Benchmarking Long-context Document Understanding with Visualizations","version":3},"cited_work":{"arxiv_id":"2407.01523","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.01523","snapshot_observed_at":"2026-07-02T16:17:09.161062Z","title":"Mmlongbench-doc: Benchmarking long-context document understanding with visualizations","venue":null,"work_id":"2246b9f1-e504-4ca8-9082-3ab923759798","year":2024},"citing_paper":{"arxiv_id":"2605.14906","last_updated":"2026-05-14T14:41:17Z","snapshot_observed_at":"2026-08-02T09:41:14.453439Z","submitted_at":"2026-05-14T14:41:17Z","title":"MemLens: Benchmarking Multimodal Long-Term Memory in Large Vision-Language Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-30T21:00:25.664841Z"},"links":{"cited_paper":"/paper/2407.01523","citing_paper":"/paper/2605.14906"},"observation_digest":"sha256:197e5d4246acef839a2ca623ecb1c470464b7e129a7a88d70339a302ef84a59c","observation_id":"164a2a23-3a53-4da0-9a95-cc889f31716a","resolution":{"observed_at":"2026-06-30T21:05:04.225422Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.01523","last_updated":"2024-11-12T04:37:44Z","snapshot_observed_at":"2026-08-06T08:51:10.907429Z","submitted_at":"2024-07-01T17:59:26Z","title":"MMLongBench-Doc: Benchmarking Long-context Document Understanding with Visualizations","version":3},"cited_work":{"arxiv_id":"2407.01523","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.01523","snapshot_observed_at":"2026-07-02T16:17:09.161062Z","title":"Mmlongbench-doc: Benchmarking long-context document understanding with visualizations","venue":null,"work_id":"2246b9f1-e504-4ca8-9082-3ab923759798","year":2024},"citing_paper":{"arxiv_id":"2605.30027","last_updated":"2026-05-28T14:50:53Z","snapshot_observed_at":"2026-08-06T11:47:39.586448Z","submitted_at":"2026-05-28T14:50:53Z","title":"DocRetriever: A Plug-and-Play Framework for Multimodal Document Retrieval with Comprehensive Benchmark","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-06-29T08:09:41.068000Z"},"links":{"cited_paper":"/paper/2407.01523","citing_paper":"/paper/2605.30027"},"observation_digest":"sha256:7786e322f6a4da1d724398790ab9a703f21cceb497b31fd02a42c291f0be2240","observation_id":"4d4608b8-b9b3-4689-bd9c-51a078a89607","resolution":{"observed_at":"2026-06-29T08:13:15.101581Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.01523","last_updated":"2024-11-12T04:37:44Z","snapshot_observed_at":"2026-08-06T08:51:10.907429Z","submitted_at":"2024-07-01T17:59:26Z","title":"MMLongBench-Doc: Benchmarking Long-context Document Understanding with Visualizations","version":3},"cited_work":{"arxiv_id":"2407.01523","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.01523","snapshot_observed_at":"2026-07-02T16:17:09.161062Z","title":"Mmlongbench-doc: Benchmarking long-context document understanding with visualizations","venue":null,"work_id":"2246b9f1-e504-4ca8-9082-3ab923759798","year":2024},"citing_paper":{"arxiv_id":"2606.07703","last_updated":"2026-06-05T09:13:52Z","snapshot_observed_at":"2026-07-06T23:47:19.773490Z","submitted_at":"2026-06-05T09:13:52Z","title":"How Much Dense Attention is Necessary? Oracle-Guided Sparse Prefill for Full/GQA Layers in Hybrid Long-Context Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-27T22:52:13.337419Z"},"links":{"cited_paper":"/paper/2407.01523","citing_paper":"/paper/2606.07703"},"observation_digest":"sha256:3f8ef1718aaa60deb3e6641435ab570d4887b848d1f7a6435e7bedf85eecb15f","observation_id":"00d1f3ac-5416-44a1-a76b-60d1f6ccd64d","resolution":{"observed_at":"2026-07-02T16:17:09.162985Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.01523","last_updated":"2024-11-12T04:37:44Z","snapshot_observed_at":"2026-08-06T08:51:10.907429Z","submitted_at":"2024-07-01T17:59:26Z","title":"MMLongBench-Doc: Benchmarking Long-context Document Understanding with Visualizations","version":3},"cited_work":{"arxiv_id":"2407.01523","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.01523","snapshot_observed_at":"2026-07-02T16:17:09.161062Z","title":"Mmlongbench-doc: Benchmarking long-context document understanding with visualizations","venue":null,"work_id":"2246b9f1-e504-4ca8-9082-3ab923759798","year":2024},"citing_paper":{"arxiv_id":"2606.29399","last_updated":"2026-06-28T13:45:59Z","snapshot_observed_at":"2026-07-07T00:03:21.717191Z","submitted_at":"2026-06-28T13:45:59Z","title":"LLM-Guided Planning for Multi-hop Reasoning over Multimodal Nuclear Regulatory Documents","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-30T07:15:01.669896Z"},"links":{"cited_paper":"/paper/2407.01523","citing_paper":"/paper/2606.29399"},"observation_digest":"sha256:d79e3c75ef3600a8eb18492c611319cc1a71ccde3896590d60f1777b574c2145","observation_id":"fe90420f-cffe-47ca-87c1-41f41a1f507f","resolution":{"observed_at":"2026-06-30T07:24:22.472263Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.01523","last_updated":"2024-11-12T04:37:44Z","snapshot_observed_at":"2026-08-06T08:51:10.907429Z","submitted_at":"2024-07-01T17:59:26Z","title":"MMLongBench-Doc: Benchmarking Long-context Document Understanding with Visualizations","version":3},"cited_work":{"arxiv_id":"2407.01523","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.01523","snapshot_observed_at":"2026-07-02T16:17:09.161062Z","title":"Mmlongbench-doc: Benchmarking long-context document understanding with visualizations","venue":null,"work_id":"2246b9f1-e504-4ca8-9082-3ab923759798","year":2024},"citing_paper":{"arxiv_id":"2606.29648","last_updated":"2026-06-28T23:36:34Z","snapshot_observed_at":"2026-08-02T13:17:28.703367Z","submitted_at":"2026-06-28T23:36:34Z","title":"Hybrid Retriever Evolution for Multimodal Document Reasoning Agents","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-06-30T06:58:56.930942Z"},"links":{"cited_paper":"/paper/2407.01523","citing_paper":"/paper/2606.29648"},"observation_digest":"sha256:d9bc9d58291b8fe1e2849d759b88e40c55ec13b9cac6dd1325ec026c9e7cb843","observation_id":"9f59fb12-2cf2-4986-8f1f-b974419dd301","resolution":{"observed_at":"2026-06-30T07:04:21.631252Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.01523","last_updated":"2024-11-12T04:37:44Z","snapshot_observed_at":"2026-08-06T08:51:10.907429Z","submitted_at":"2024-07-01T17:59:26Z","title":"MMLongBench-Doc: Benchmarking Long-context Document Understanding with Visualizations","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.01523","snapshot_observed_at":"2026-08-01T02:55:23.398613Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25294","last_updated":"2026-07-28T05:06:43Z","snapshot_observed_at":"2026-08-06T17:57:12.013512Z","submitted_at":"2026-07-28T05:06:43Z","title":"CLBench-V: Evaluating Multimodal Context Learning from Grounding to Knowledge Acquisition","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-01T02:55:23.398613Z"},"links":{"cited_paper":"/paper/2407.01523","citing_paper":"/paper/2607.25294"},"observation_digest":"sha256:93b86d80ba0fff55faeef402d886d2c88f75802d893b8d03ccbc846b8f584041","observation_id":"be5c54ce-6652-4743-a806-d350eec7c2b1","resolution":{"observed_at":"2026-08-01T02:55:23.398613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2407.01523/citation-record","integrity":"/paper/2407.01523/integrity","json":"/paper/2407.01523/citation-record.json","paper":"/paper/2407.01523"},"outbound":[],"paper":{"arxiv_id":"2407.01523","last_updated":"2024-11-12T04:37:44Z","latest_version":3,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-06T08:51:10.907429Z","submitted_at":"2024-07-01T17:59:26Z","title":"MMLongBench-Doc: Benchmarking Long-context Document Understanding with Visualizations"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 23 inbound Pith citation observations for arXiv:2407.01523."}