{"as_of":"2026-08-07T11:42:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4e84ecf4f980e60760206c33dcb703fcbb1dcfe7a550014306bbcaa8e0f1734f","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":6,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":6,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":6,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":6,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T20:28:56.764648Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-06-29T08:13:15.042714Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2404.12720","last_updated":"2024-04-19T09:00:05Z","snapshot_observed_at":"2026-07-06T18:02:36.759308Z","submitted_at":"2024-04-19T09:00:05Z","title":"PDF-MVQA: A Dataset for Multimodal Information Retrieval in PDF-based Visual Question Answering","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.12720","snapshot_observed_at":"2026-08-04T20:28:56.764648Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09731","last_updated":"2025-09-10T13:02:29Z","snapshot_observed_at":"2026-08-04T20:28:42.834716Z","submitted_at":"2025-09-10T13:02:29Z","title":"Benchmarking Vision-Language Models on Chinese Ancient Documents: From OCR to Knowledge Reasoning","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-04T20:28:56.764648Z"},"links":{"cited_paper":"/paper/2404.12720","citing_paper":"/paper/2509.09731"},"observation_digest":"sha256:d964f51928486e583acbeb7234c02186fe78355b70bfa906d61019177e25ba06","observation_id":"0f233e32-b037-4401-a55e-61e8655d5b7d","resolution":{"observed_at":"2026-08-04T20:28:56.764648Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.12720","last_updated":"2024-04-19T09:00:05Z","snapshot_observed_at":"2026-07-06T18:02:36.759308Z","submitted_at":"2024-04-19T09:00:05Z","title":"PDF-MVQA: A Dataset for Multimodal Information Retrieval in PDF-based Visual Question Answering","version":1},"cited_work":{"arxiv_id":"2404.12720","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2404.12720","snapshot_observed_at":"2026-06-29T08:13:15.042714Z","title":"MVQA: A dataset for multimodal infor- mation retrieval in pdf-based visual question answering","venue":null,"work_id":"69a43883-61de-4f0a-8483-7584a5a83c75","year":2024},"citing_paper":{"arxiv_id":"2604.12812","last_updated":"2026-05-11T03:47:15Z","snapshot_observed_at":"2026-07-06T23:00:56.449281Z","submitted_at":"2026-04-14T14:39:26Z","title":"DocSeeker: Structured Visual Reasoning with Evidence Grounding for Long Document Understanding","version":4},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-10T16:16:58.889065Z"},"links":{"cited_paper":"/paper/2404.12720","citing_paper":"/paper/2604.12812"},"observation_digest":"sha256:3c8dca6a3defb39c8f137672feb674b1d2774bd8a6454355f69b7ed6e5a5126f","observation_id":"8ea5a4ee-9f61-46ee-ad81-fdafa8b38b60","resolution":{"observed_at":"2026-05-11T09:05:58.491401Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.12720","last_updated":"2024-04-19T09:00:05Z","snapshot_observed_at":"2026-07-06T18:02:36.759308Z","submitted_at":"2024-04-19T09:00:05Z","title":"PDF-MVQA: A Dataset for Multimodal Information Retrieval in PDF-based Visual Question Answering","version":1},"cited_work":{"arxiv_id":"2404.12720","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2404.12720","snapshot_observed_at":"2026-06-29T08:13:15.042714Z","title":"MVQA: A dataset for multimodal infor- mation retrieval in pdf-based visual question answering","venue":null,"work_id":"69a43883-61de-4f0a-8483-7584a5a83c75","year":2024},"citing_paper":{"arxiv_id":"2604.12812","last_updated":"2026-05-11T03:47:15Z","snapshot_observed_at":"2026-07-06T23:00:56.449281Z","submitted_at":"2026-04-14T14:39:26Z","title":"DocSeeker: Structured Visual Reasoning with Evidence Grounding for Long Document Understanding","version":5},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-12T04:17:55.318813Z"},"links":{"cited_paper":"/paper/2404.12720","citing_paper":"/paper/2604.12812"},"observation_digest":"sha256:bcca98b814aa7df382e11c3a91d67a70f526e817f28fae8a4694bc8ac5b0f574","observation_id":"283ec2f1-5f71-4a8a-9021-a12dce7a11ae","resolution":{"observed_at":"2026-05-12T06:26:24.407871Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.12720","last_updated":"2024-04-19T09:00:05Z","snapshot_observed_at":"2026-07-06T18:02:36.759308Z","submitted_at":"2024-04-19T09:00:05Z","title":"PDF-MVQA: A Dataset for Multimodal Information Retrieval in PDF-based Visual Question Answering","version":1},"cited_work":{"arxiv_id":"2404.12720","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2404.12720","snapshot_observed_at":"2026-06-29T08:13:15.042714Z","title":"MVQA: A dataset for multimodal infor- mation retrieval in pdf-based visual question answering","venue":null,"work_id":"69a43883-61de-4f0a-8483-7584a5a83c75","year":2024},"citing_paper":{"arxiv_id":"2604.23276","last_updated":"2026-04-25T12:40:13Z","snapshot_observed_at":"2026-07-06T23:09:34.300163Z","submitted_at":"2026-04-25T12:40:13Z","title":"Lightweight and Production-Ready PDF Visual Element Parsing","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-08T08:31:44.430067Z"},"links":{"cited_paper":"/paper/2404.12720","citing_paper":"/paper/2604.23276"},"observation_digest":"sha256:77c210df0d1750b709558733bf3641eff88bd722cdb4d502bdf1a432c88429f3","observation_id":"078c664f-980d-4fb2-9d3d-39ca10e0cd31","resolution":{"observed_at":"2026-05-11T20:36:09.148986Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.12720","last_updated":"2024-04-19T09:00:05Z","snapshot_observed_at":"2026-07-06T18:02:36.759308Z","submitted_at":"2024-04-19T09:00:05Z","title":"PDF-MVQA: A Dataset for Multimodal Information Retrieval in PDF-based Visual Question Answering","version":1},"cited_work":{"arxiv_id":"2404.12720","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2404.12720","snapshot_observed_at":"2026-06-29T08:13:15.042714Z","title":"MVQA: A dataset for multimodal infor- mation retrieval in pdf-based visual question answering","venue":null,"work_id":"69a43883-61de-4f0a-8483-7584a5a83c75","year":2024},"citing_paper":{"arxiv_id":"2605.30027","last_updated":"2026-05-28T14:50:53Z","snapshot_observed_at":"2026-08-06T11:47:39.586448Z","submitted_at":"2026-05-28T14:50:53Z","title":"DocRetriever: A Plug-and-Play Framework for Multimodal Document Retrieval with Comprehensive Benchmark","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-29T08:09:41.068000Z"},"links":{"cited_paper":"/paper/2404.12720","citing_paper":"/paper/2605.30027"},"observation_digest":"sha256:52974e4e3744024372b4ce322bb60807c8fc03b848fee0bcc7daf66a03d061f1","observation_id":"3339602c-1ccd-484f-8fed-3b001e845583","resolution":{"observed_at":"2026-06-29T08:13:15.044494Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.12720","last_updated":"2024-04-19T09:00:05Z","snapshot_observed_at":"2026-07-06T18:02:36.759308Z","submitted_at":"2024-04-19T09:00:05Z","title":"PDF-MVQA: A Dataset for Multimodal Information Retrieval in PDF-based Visual Question Answering","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.12720","snapshot_observed_at":"2026-08-02T14:55:34.545662Z","title":"arXiv preprint arXiv:2404.12720 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16203","last_updated":"2026-05-05T10:59:34Z","snapshot_observed_at":"2026-08-04T21:09:24.743822Z","submitted_at":"2026-05-05T10:59:34Z","title":"DocOCR-Eval: A Correction-Based Framework for OCR Tool Selection Without Ground Truth","version":1},"reference_index":121,"source":"arxiv_source","source_observed_at":"2026-08-02T14:55:34.545662Z"},"links":{"cited_paper":"/paper/2404.12720","citing_paper":"/paper/2607.16203"},"observation_digest":"sha256:e6d9b4eb4efb3749c9e1883b79d1f0880ffa87ee9f74603f34958de6912f49e5","observation_id":"7a4c4363-aebd-46d1-9fa1-a2571c95fa34","resolution":{"observed_at":"2026-08-02T14:55:34.545662Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2404.12720/citation-record","integrity":"/paper/2404.12720/integrity","json":"/paper/2404.12720/citation-record.json","paper":"/paper/2404.12720"},"outbound":[],"paper":{"arxiv_id":"2404.12720","last_updated":"2024-04-19T09:00:05Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-07-06T18:02:36.759308Z","submitted_at":"2024-04-19T09:00:05Z","title":"PDF-MVQA: A Dataset for Multimodal Information Retrieval in PDF-based Visual Question Answering"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 6 inbound Pith citation observations for arXiv:2404.12720."}