{"as_of":"2026-08-11T04:18:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f34b5a9869fff53fb29806acc30882813c1a1fba42e7b00317c122855f38e66e","coverage":[{"denominator":68,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":68,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-30T17:37:33.750306Z","state":"measured"},{"denominator":68,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":68,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2605.22100/citation-record","integrity":"/paper/2605.22100/integrity","json":"/paper/2605.22100/citation-record.json","paper":"/paper/2605.22100"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2604.08538","last_updated":"2026-04-13T17:37:21Z","snapshot_observed_at":"2026-08-02T07:55:28.320539Z","submitted_at":"2026-04-09T17:59:36Z","title":"ParseBench: A Document Parsing Benchmark for AI Agents","version":3},"cited_work":{"arxiv_id":"2604.08538","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.08538","snapshot_observed_at":"2026-07-02T17:17:14.896489Z","title":"ParseBench: A Document Parsing Benchmark for AI Agents","venue":"cs.CV","work_id":"f0fe24b8-c5e6-46ce-af80-196a522defe5","year":2026},"citing_paper":{"arxiv_id":"2605.22100","last_updated":"2026-05-28T08:19:59Z","snapshot_observed_at":"2026-08-08T14:11:36.911334Z","submitted_at":"2026-05-21T07:36:41Z","title":"MPDocBench-Parse: Benchmarking Practical Multi-page Document Parsing","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-30T17:37:33.750306Z"},"links":{"cited_paper":"/paper/2604.08538","citing_paper":"/paper/2605.22100"},"observation_digest":"sha256:6a9b730623297752e0f6606c0e16e5b2c50b7c13091342a68cc4ce7dfa6ed705","observation_id":"d351e960-afb9-4fa5-8d25-bc8bb8dee3a9","resolution":{"observed_at":"2026-07-01T15:05:48.239093Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T08:24:48.450719Z","title":"Publaynet: largest dataset ever for document layout analysis","venue":null,"work_id":"486f58d7-97a3-405a-b1c9-6af789312daf","year":2019},"citing_paper":{"arxiv_id":"2605.22100","last_updated":"2026-05-28T08:19:59Z","snapshot_observed_at":"2026-08-08T14:11:36.911334Z","submitted_at":"2026-05-21T07:36:41Z","title":"MPDocBench-Parse: Benchmarking Practical Multi-page Document Parsing","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-30T17:37:33.750306Z"},"links":{"citing_paper":"/paper/2605.22100"},"observation_digest":"sha256:33161f8df64c1ea1358957ffa58dbca1711c5c2610d2f0c3ce0454927981570f","observation_id":"cf0a3ffd-12ff-4a65-93a2-7fe43ecd5f28","resolution":{"observed_at":"2026-07-08T08:24:48.452633Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T08:24:48.437050Z","title":"Tablebank: Table benchmark for image-based table detection and recognition","venue":null,"work_id":"1466f3ad-2f61-4464-92b8-8b3a3ec0df0b","year":1918},"citing_paper":{"arxiv_id":"2605.22100","last_updated":"2026-05-28T08:19:59Z","snapshot_observed_at":"2026-08-08T14:11:36.911334Z","submitted_at":"2026-05-21T07:36:41Z","title":"MPDocBench-Parse: Benchmarking Practical Multi-page Document Parsing","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-30T17:37:33.750306Z"},"links":{"citing_paper":"/paper/2605.22100"},"observation_digest":"sha256:9570c93ccf455de6cc25b3dc0c7c8858ae5a771a8cc4c4b855524f9315e25dcc","observation_id":"9d068762-2d79-4819-b5f1-f0fd01b2883c","resolution":{"observed_at":"2026-07-08T08:24:48.439072Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T08:24:48.448139Z","title":"Image-to-markup generation with coarse-to-fine attention","venue":null,"work_id":"accf6212-5d8f-4f78-bb9f-3c8cfec86448","year":2017},"citing_paper":{"arxiv_id":"2605.22100","last_updated":"2026-05-28T08:19:59Z","snapshot_observed_at":"2026-08-08T14:11:36.911334Z","submitted_at":"2026-05-21T07:36:41Z","title":"MPDocBench-Parse: Benchmarking Practical Multi-page Document Parsing","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-30T17:37:33.750306Z"},"links":{"citing_paper":"/paper/2605.22100"},"observation_digest":"sha256:02b5c505c51cc42e008296d691fafbed701dfebe6870ca31b66c12f0c52e6729","observation_id":"e3468e93-e2d1-4201-9c86-d75f7abe2230","resolution":{"observed_at":"2026-07-08T08:24:48.449933Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T08:24:48.439958Z","title":"Layoutreader: Pre-training of text and layout for reading order detection","venue":null,"work_id":"e50ff544-9d16-4d7d-8fdb-a91f67b48b05","year":2021},"citing_paper":{"arxiv_id":"2605.22100","last_updated":"2026-05-28T08:19:59Z","snapshot_observed_at":"2026-08-08T14:11:36.911334Z","submitted_at":"2026-05-21T07:36:41Z","title":"MPDocBench-Parse: Benchmarking Practical Multi-page Document Parsing","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-30T17:37:33.750306Z"},"links":{"citing_paper":"/paper/2605.22100"},"observation_digest":"sha256:379b9fa9d49acdbafeb5327de787813b1bed3d276d4c81c711b62bd54661da08","observation_id":"c34d559d-8dfd-4c42-8004-bd2d7ad6acdf","resolution":{"observed_at":"2026-07-08T08:24:48.441830Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T08:24:48.442615Z","title":"Icdar 2015 competition on robust reading","venue":null,"work_id":"1a6853ff-419a-4a0f-b49f-698f67db2acc","year":2015},"citing_paper":{"arxiv_id":"2605.22100","last_updated":"2026-05-28T08:19:59Z","snapshot_observed_at":"2026-08-08T14:11:36.911334Z","submitted_at":"2026-05-21T07:36:41Z","title":"MPDocBench-Parse: Benchmarking Practical Multi-page Document Parsing","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-30T17:37:33.750306Z"},"links":{"citing_paper":"/paper/2605.22100"},"observation_digest":"sha256:d6f1c05f12854ec2b5269a5510d1882c348bdd1770b3c32212c0d857882434b2","observation_id":"38437ca1-e9ed-4640-9753-5cadc5fb7477","resolution":{"observed_at":"2026-07-08T08:24:48.444471Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T08:24:48.467094Z","title":"Hrdoc: Dataset and baseline method toward hierarchical reconstruction of document structures","venue":null,"work_id":"329334b7-e85e-4192-a9e6-79a827ed65e7","year":2023},"citing_paper":{"arxiv_id":"2605.22100","last_updated":"2026-05-28T08:19:59Z","snapshot_observed_at":"2026-08-08T14:11:36.911334Z","submitted_at":"2026-05-21T07:36:41Z","title":"MPDocBench-Parse: Benchmarking Practical Multi-page Document Parsing","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-30T17:37:33.750306Z"},"links":{"citing_paper":"/paper/2605.22100"},"observation_digest":"sha256:193991de8fdac3d625a6f1275dae1812a3a0c123c6de292c750fff17a5711a39","observation_id":"5c7c8a05-b86e-478a-a752-a883d9c9777d","resolution":{"observed_at":"2026-07-08T08:24:48.469273Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T08:24:48.478464Z","title":"Doclaynet: A large human-annotated dataset for document-layout segmentation","venue":null,"work_id":"697390b2-213d-43bd-9418-3528d8165909","year":2022},"citing_paper":{"arxiv_id":"2605.22100","last_updated":"2026-05-28T08:19:59Z","snapshot_observed_at":"2026-08-08T14:11:36.911334Z","submitted_at":"2026-05-21T07:36:41Z","title":"MPDocBench-Parse: Benchmarking Practical Multi-page Document Parsing","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-30T17:37:33.750306Z"},"links":{"citing_paper":"/paper/2605.22100"},"observation_digest":"sha256:479274c8b075a5741d8e30d19af549714482a62b865543f0ce4ca67fd88124f7","observation_id":"35d899e8-e729-4a9e-9fa6-be532a065e41","resolution":{"observed_at":"2026-07-08T08:24:48.480210Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T08:24:48.497887Z","title":"Image-based table recognition: data, model, and evaluation","venue":null,"work_id":"c8b24be9-6bea-4224-9d61-923c9e31ade0","year":2020},"citing_paper":{"arxiv_id":"2605.22100","last_updated":"2026-05-28T08:19:59Z","snapshot_observed_at":"2026-08-08T14:11:36.911334Z","submitted_at":"2026-05-21T07:36:41Z","title":"MPDocBench-Parse: Benchmarking Practical Multi-page Document Parsing","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-30T17:37:33.750306Z"},"links":{"citing_paper":"/paper/2605.22100"},"observation_digest":"sha256:34b5675680ce00b67fdcf8de709871a57ce11e226594b00d59c10a0ad816b996","observation_id":"4d569c3b-767a-40b1-8c20-318dfd2bd801","resolution":{"observed_at":"2026-07-08T08:24:48.499679Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1908.04729","last_updated":"2019-08-28T16:24:53Z","snapshot_observed_at":"2026-08-10T12:14:32.877990Z","submitted_at":"2019-08-13T16:47:08Z","title":"Complicated Table Structure Recognition","version":2},"cited_work":{"arxiv_id":"1908.04729","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1908.04729","snapshot_observed_at":"2026-07-04T06:09:37.420160Z","title":"arXiv:1908.04729 (2019)","venue":null,"work_id":"06513162-d5c8-4c90-a862-889b339725bb","year":2019},"citing_paper":{"arxiv_id":"2605.22100","last_updated":"2026-05-28T08:19:59Z","snapshot_observed_at":"2026-08-08T14:11:36.911334Z","submitted_at":"2026-05-21T07:36:41Z","title":"MPDocBench-Parse: Benchmarking Practical Multi-page Document Parsing","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-30T17:37:33.750306Z"},"links":{"cited_paper":"/paper/1908.04729","citing_paper":"/paper/2605.22100"},"observation_digest":"sha256:c12c52ac6569542fe8d289dc36b240a7e9997e01f93f876860d6aa903a7d26d0","observation_id":"1b217598-f219-41d8-a149-6b54e5dc1cc3","resolution":{"observed_at":"2026-07-01T15:05:48.229419Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14295","last_updated":"2024-05-23T08:15:49Z","snapshot_observed_at":"2026-08-08T11:06:53.281288Z","submitted_at":"2024-05-23T08:15:49Z","title":"Focus Anywhere for Fine-grained Multi-page Document Understanding","version":1},"cited_work":{"arxiv_id":"2405.14295","doi":null,"metadata_source":"pith","pith_arxiv_id":"2405.14295","snapshot_observed_at":"2026-07-08T20:35:34.401926Z","title":"Focus anywhere for fine- grained multi-page document understanding","venue":"cs.CV","work_id":"f9c7794d-c8f0-42dd-b0c1-7bba21f80c07","year":2024},"citing_paper":{"arxiv_id":"2605.22100","last_updated":"2026-05-28T08:19:59Z","snapshot_observed_at":"2026-08-08T14:11:36.911334Z","submitted_at":"2026-05-21T07:36:41Z","title":"MPDocBench-Parse: Benchmarking Practical Multi-page Document Parsing","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-30T17:37:33.750306Z"},"links":{"cited_paper":"/paper/2405.14295","citing_paper":"/paper/2605.22100"},"observation_digest":"sha256:e9ae7e55675f9c64ee88284785ec0a8c029609664d6d59615ca252a23b0edee6","observation_id":"8142f5ff-e95c-4b64-b022-3c99ad419985","resolution":{"observed_at":"2026-07-01T15:05:48.249937Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2502.18443","doi":"10.48550/arxiv.2502.18443","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"olmocr: Unlocking trillions of tokens in pdfs with vi- sion language models.arXiv preprint arXiv:2502.18443, 2025a","venue":"ArXiv.org","work_id":"bb9c92f3-5210-40cf-b3d5-7463913e3248","year":2025},"citing_paper":{"arxiv_id":"2605.22100","last_updated":"2026-05-28T08:19:59Z","snapshot_observed_at":"2026-08-08T14:11:36.911334Z","submitted_at":"2026-05-21T07:36:41Z","title":"MPDocBench-Parse: Benchmarking Practical Multi-page Document Parsing","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-30T17:37:33.750306Z"},"links":{"citing_paper":"/paper/2605.22100"},"observation_digest":"sha256:cd80e1986499e0ceead5c0997667f1a7b7ec00ee303a1a6483a0615cd3ca5ee4","observation_id":"b88159c5-0472-45c2-a349-c467a2054423","resolution":{"observed_at":"2026-07-01T15:05:48.244621Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T08:24:48.502325Z","title":"Omnidocbench: Benchmarking diverse pdf document parsing with comprehensive annotations","venue":null,"work_id":"f8de2c7e-9372-4907-b77d-2188a04844b9","year":2025},"citing_paper":{"arxiv_id":"2605.22100","last_updated":"2026-05-28T08:19:59Z","snapshot_observed_at":"2026-08-08T14:11:36.911334Z","submitted_at":"2026-05-21T07:36:41Z","title":"MPDocBench-Parse: Benchmarking Practical Multi-page Document Parsing","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-30T17:37:33.750306Z"},"links":{"citing_paper":"/paper/2605.22100"},"observation_digest":"sha256:8c187720a5c83ce09ff716f1faefe7811fe71b74c1789acee7f171cfc235b57c","observation_id":"7630c4bb-09b9-476c-9099-8159eb1fce64","resolution":{"observed_at":"2026-07-08T08:24:48.503894Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.01704","last_updated":"2024-09-03T08:41:31Z","snapshot_observed_at":"2026-08-10T02:15:09.754142Z","submitted_at":"2024-09-03T08:41:31Z","title":"General OCR Theory: Towards OCR-2.0 via a Unified End-to-end Model","version":1},"cited_work":{"arxiv_id":"2409.01704","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.01704","snapshot_observed_at":"2026-07-08T20:35:34.407064Z","title":"General OCR Theory: Towards OCR-2.0 via a Unified End-to-end Model","venue":"cs.CV","work_id":"67b1592f-02b6-4056-b3fe-cc594e484192","year":2024},"citing_paper":{"arxiv_id":"2605.22100","last_updated":"2026-05-28T08:19:59Z","snapshot_observed_at":"2026-08-08T14:11:36.911334Z","submitted_at":"2026-05-21T07:36:41Z","title":"MPDocBench-Parse: Benchmarking Practical Multi-page Document Parsing","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-30T17:37:33.750306Z"},"links":{"cited_paper":"/paper/2409.01704","citing_paper":"/paper/2605.22100"},"observation_digest":"sha256:e6d35c2dfcc6fea6bd76cb5a07533fef4968c35b1e5f37ca0f4e65bd2e6ac9fd","observation_id":"917c201c-0b89-4539-84c8-18eb88a4b3ee","resolution":{"observed_at":"2026-07-01T15:05:48.197561Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.13418","last_updated":"2023-08-25T15:03:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-25T15:03:36Z","title":"Nougat: Neural Optical Understanding for Academic Documents","version":1},"cited_work":{"arxiv_id":"2308.13418","doi":"10.48550/arxiv.2308.13418","metadata_source":"pith","pith_arxiv_id":"2308.13418","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Nougat: Neural Optical Understanding for Academic Documents","venue":"cs.LG","work_id":"26c3b627-7e97-40d7-bab3-020936b8196b","year":2023},"citing_paper":{"arxiv_id":"2605.22100","last_updated":"2026-05-28T08:19:59Z","snapshot_observed_at":"2026-08-08T14:11:36.911334Z","submitted_at":"2026-05-21T07:36:41Z","title":"MPDocBench-Parse: Benchmarking Practical Multi-page Document Parsing","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-30T17:37:33.750306Z"},"links":{"cited_paper":"/paper/2308.13418","citing_paper":"/paper/2605.22100"},"observation_digest":"sha256:5263f52f1c487418faca51c0be60993f4e0ce8572f93c3d6dd90af6e0c6ccaa6","observation_id":"228e8bf4-f3ee-4746-b1e8-11e240556f38","resolution":{"observed_at":"2026-07-01T15:05:48.227340Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T08:24:48.504687Z","title":"Readoc: A unified benchmark for realistic document structured extraction","venue":null,"work_id":"4eb3e5dd-c5dc-4aba-a421-0f7edbba37c6","year":2025},"citing_paper":{"arxiv_id":"2605.22100","last_updated":"2026-05-28T08:19:59Z","snapshot_observed_at":"2026-08-08T14:11:36.911334Z","submitted_at":"2026-05-21T07:36:41Z","title":"MPDocBench-Parse: Benchmarking Practical Multi-page Document Parsing","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-30T17:37:33.750306Z"},"links":{"citing_paper":"/paper/2605.22100"},"observation_digest":"sha256:1dd2c5063643da92946dbf49223c4e9702ef6917771c03328fc3cc1096264765","observation_id":"548fcc1b-d304-469c-af0f-68510124c03e","resolution":{"observed_at":"2026-07-08T08:24:48.506522Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T08:24:48.486428Z","title":"Cc-ocr: A comprehensive and challenging ocr benchmark for evaluating large multimodal models in literacy","venue":null,"work_id":"747409fc-11a7-4c24-a554-aefacf0cbc71","year":2025},"citing_paper":{"arxiv_id":"2605.22100","last_updated":"2026-05-28T08:19:59Z","snapshot_observed_at":"2026-08-08T14:11:36.911334Z","submitted_at":"2026-05-21T07:36:41Z","title":"MPDocBench-Parse: Benchmarking Practical Multi-page Document Parsing","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-30T17:37:33.750306Z"},"links":{"citing_paper":"/paper/2605.22100"},"observation_digest":"sha256:ecdcaa6e84ff589b187119e312614d57ace8f94f7064fbb865755c12a3d05cb7","observation_id":"fb11d753-808e-4860-8e2a-d9f393c2aa7a","resolution":{"observed_at":"2026-07-08T08:24:48.488267Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2511.18434","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-01T15:05:48.228360Z","title":"Docptbench: Benchmarking end-to-end photographed document parsing and translation","venue":null,"work_id":"ede9afd1-b00e-4d9a-bdd9-de71920a9713","year":2025},"citing_paper":{"arxiv_id":"2605.22100","last_updated":"2026-05-28T08:19:59Z","snapshot_observed_at":"2026-08-08T14:11:36.911334Z","submitted_at":"2026-05-21T07:36:41Z","title":"MPDocBench-Parse: Benchmarking Practical Multi-page Document Parsing","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-30T17:37:33.750306Z"},"links":{"citing_paper":"/paper/2605.22100"},"observation_digest":"sha256:817e83cecca04eee5444f5799c86078d60d68afdfa6596487ee6d6b1fd6e2e72","observation_id":"8271153f-b771-4c3d-94c8-b1f00a959d8e","resolution":{"observed_at":"2026-07-01T15:05:48.229709Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.28130","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-01T15:05:48.235775Z","title":"Mdpbench: A benchmark for multilingual document parsing in real-world scenarios","venue":null,"work_id":"b95c3231-f110-4103-8ab7-5c786dfcbef7","year":2026},"citing_paper":{"arxiv_id":"2605.22100","last_updated":"2026-05-28T08:19:59Z","snapshot_observed_at":"2026-08-08T14:11:36.911334Z","submitted_at":"2026-05-21T07:36:41Z","title":"MPDocBench-Parse: Benchmarking Practical Multi-page Document Parsing","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-30T17:37:33.750306Z"},"links":{"citing_paper":"/paper/2605.22100"},"observation_digest":"sha256:60e8a28e53fc4c3de0e91debc844d326c911448d3209f7ef31574b9a886a2b62","observation_id":"64b10281-1607-4ed8-90a5-f55abf492912","resolution":{"observed_at":"2026-07-01T15:05:48.237172Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.19760","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T17:07:25.798323Z","title":"Logics-parsing technical report","venue":null,"work_id":"1605fada-432f-4219-b76b-5aa6ad80d79e","year":2025},"citing_paper":{"arxiv_id":"2605.22100","last_updated":"2026-05-28T08:19:59Z","snapshot_observed_at":"2026-08-08T14:11:36.911334Z","submitted_at":"2026-05-21T07:36:41Z","title":"MPDocBench-Parse: Benchmarking Practical Multi-page Document Parsing","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-30T17:37:33.750306Z"},"links":{"citing_paper":"/paper/2605.22100"},"observation_digest":"sha256:5756ccbbf5947eab7240488f5588b4bd9bc922576af3279ea9181a1f3e4b8af1","observation_id":"050a3ec4-76a9-492e-bb3c-767a4c408270","resolution":{"observed_at":"2026-07-01T15:05:48.195603Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2512.03413","doi":"10.48550/arxiv.2512.03413","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Bookrag: A hierarchical structure-aware index-based approach for retrieval-augmented generation on complex documents","venue":"ArXiv.org","work_id":"799edb3b-faaa-4258-8719-02d276b920f0","year":2025},"citing_paper":{"arxiv_id":"2605.22100","last_updated":"2026-05-28T08:19:59Z","snapshot_observed_at":"2026-08-08T14:11:36.911334Z","submitted_at":"2026-05-21T07:36:41Z","title":"MPDocBench-Parse: Benchmarking Practical Multi-page Document Parsing","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-30T17:37:33.750306Z"},"links":{"citing_paper":"/paper/2605.22100"},"observation_digest":"sha256:1e4f9f1e004ec1225f9e390cb88be6d39deb1ee8092ce541c3bc9968fd8d18fb","observation_id":"779eb6c7-aa69-43e1-ba61-7b33464c2e5c","resolution":{"observed_at":"2026-07-01T15:05:48.195068Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.07612","doi":"10.48550/arxiv.2603.07612","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Kohakurag: A simple rag framework with hierarchical document indexing","venue":"Open MIND","work_id":"b72b30d9-32d6-412d-803b-f7b9c7f02a3f","year":2026},"citing_paper":{"arxiv_id":"2605.22100","last_updated":"2026-05-28T08:19:59Z","snapshot_observed_at":"2026-08-08T14:11:36.911334Z","submitted_at":"2026-05-21T07:36:41Z","title":"MPDocBench-Parse: Benchmarking Practical Multi-page Document Parsing","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-30T17:37:33.750306Z"},"links":{"citing_paper":"/paper/2605.22100"},"observation_digest":"sha256:5f3fd0a10c8a4995428906a02a638bc4fc778d2835c4f699f9af7e4a419e073d","observation_id":"0dfb3cf9-768d-4485-8955-88b2e1bb0466","resolution":{"observed_at":"2026-07-01T15:05:48.193050Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.05014","doi":"10.48550/arxiv.2602.05014","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Deepread: Document structure-aware reasoning to enhance agentic search","venue":"Open MIND","work_id":"cea40beb-9747-4b70-acc2-499e10b42388","year":2026},"citing_paper":{"arxiv_id":"2605.22100","last_updated":"2026-05-28T08:19:59Z","snapshot_observed_at":"2026-08-08T14:11:36.911334Z","submitted_at":"2026-05-21T07:36:41Z","title":"MPDocBench-Parse: Benchmarking Practical Multi-page Document Parsing","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-30T17:37:33.750306Z"},"links":{"citing_paper":"/paper/2605.22100"},"observation_digest":"sha256:fd25a33a4c0e9f2ba0c2de313631b2010e329938071fb0a1d93afde52eddca2b","observation_id":"791ec496-dd65-400f-821a-efa98de1117a","resolution":{"observed_at":"2026-07-01T15:05:48.185370Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T08:24:48.480948Z","title":"Multidocfusion: Hierarchical and multimodal chunking pipeline for enhanced rag on long industrial documents","venue":null,"work_id":"acc01bf6-bbc7-491a-aef3-c7e73072b1e5","year":2025},"citing_paper":{"arxiv_id":"2605.22100","last_updated":"2026-05-28T08:19:59Z","snapshot_observed_at":"2026-08-08T14:11:36.911334Z","submitted_at":"2026-05-21T07:36:41Z","title":"MPDocBench-Parse: Benchmarking Practical Multi-page Document Parsing","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-30T17:37:33.750306Z"},"links":{"citing_paper":"/paper/2605.22100"},"observation_digest":"sha256:ee27842120b1044c66ac4bc1c95f89ce34f911906143e5d052b2bd98b89a77d0","observation_id":"17b2c5b5-f138-42ae-9bf0-f359915e5748","resolution":{"observed_at":"2026-07-08T08:24:48.482846Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T08:24:48.489010Z","title":"Unimernet: A universal network for real-world mathematical expression recognition","venue":null,"work_id":"fab2b4ea-b6b8-4890-ace6-3683715adaf0","year":2024},"citing_paper":{"arxiv_id":"2605.22100","last_updated":"2026-05-28T08:19:59Z","snapshot_observed_at":"2026-08-08T14:11:36.911334Z","submitted_at":"2026-05-21T07:36:41Z","title":"MPDocBench-Parse: Benchmarking Practical Multi-page Document Parsing","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-30T17:37:33.750306Z"},"links":{"citing_paper":"/paper/2605.22100"},"observation_digest":"sha256:a28861e766720b9f696e8064e37c1aad879673a58bd7975c70d6a23b7ceb3ba4","observation_id":"ce4a0c7c-9746-4099-9aa1-1b60fbc0ecee","resolution":{"observed_at":"2026-07-08T08:24:48.490738Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T08:24:48.493655Z","title":"Dochienet: A large and diverse dataset for document hierarchy parsing","venue":null,"work_id":"6b469125-7592-4239-8c11-fc388fdd016a","year":2024},"citing_paper":{"arxiv_id":"2605.22100","last_updated":"2026-05-28T08:19:59Z","snapshot_observed_at":"2026-08-08T14:11:36.911334Z","submitted_at":"2026-05-21T07:36:41Z","title":"MPDocBench-Parse: Benchmarking Practical Multi-page Document Parsing","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-30T17:37:33.750306Z"},"links":{"citing_paper":"/paper/2605.22100"},"observation_digest":"sha256:65a64d3d59b6ad80cfd109e9f8404f51346231d66a323aa13a8ab84244dc6e47","observation_id":"9f4ba979-ea89-43eb-b0bb-84f3260d3808","resolution":{"observed_at":"2026-07-08T08:24:48.495020Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.01840","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T10:19:46.941324Z","title":"Firered-ocr technical report","venue":null,"work_id":"36c46655-2f26-436d-a19c-295616f0ae96","year":2026},"citing_paper":{"arxiv_id":"2605.22100","last_updated":"2026-05-28T08:19:59Z","snapshot_observed_at":"2026-08-08T14:11:36.911334Z","submitted_at":"2026-05-21T07:36:41Z","title":"MPDocBench-Parse: Benchmarking Practical Multi-page Document Parsing","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-30T17:37:33.750306Z"},"links":{"citing_paper":"/paper/2605.22100"},"observation_digest":"sha256:25c09f02192ba4e293850a0442e8e375b1c4699f11916382a3afe4a263927542","observation_id":"3a5ba299-cc48-44ff-bebe-324196c5e293","resolution":{"observed_at":"2026-07-01T15:05:48.210850Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2601.20552","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T17:07:25.727485Z","title":"Deepseek-ocr 2: Visual causal flow","venue":null,"work_id":"9886dce9-776e-4ad6-b96c-fbf9037ca41c","year":2026},"citing_paper":{"arxiv_id":"2605.22100","last_updated":"2026-05-28T08:19:59Z","snapshot_observed_at":"2026-08-08T14:11:36.911334Z","submitted_at":"2026-05-21T07:36:41Z","title":"MPDocBench-Parse: Benchmarking Practical Multi-page Document Parsing","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-30T17:37:33.750306Z"},"links":{"citing_paper":"/paper/2605.22100"},"observation_digest":"sha256:95d470057d76af4f93e29cd122c6757842420a5aadd5346b86eb72681f220c6a","observation_id":"baac2fc7-4ebe-4c26-90d4-51b9fd84187a","resolution":{"observed_at":"2026-07-01T15:05:48.221638Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.13398","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T10:19:46.900869Z","title":"Qianfan-ocr: A unified end-to-end model for document intelligence","venue":null,"work_id":"daabfed7-5204-4653-861d-2becb02cd711","year":2026},"citing_paper":{"arxiv_id":"2605.22100","last_updated":"2026-05-28T08:19:59Z","snapshot_observed_at":"2026-08-08T14:11:36.911334Z","submitted_at":"2026-05-21T07:36:41Z","title":"MPDocBench-Parse: Benchmarking Practical Multi-page Document Parsing","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-06-30T17:37:33.750306Z"},"links":{"citing_paper":"/paper/2605.22100"},"observation_digest":"sha256:fc0d46c82ed4d540b114daea93a83f725a2e1d20fbd25f7561ecfd01b5ee1267","observation_id":"c15da96b-3af9-4af2-a5ff-4a097dd3c2b1","resolution":{"observed_at":"2026-07-01T15:05:48.247224Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T08:24:48.445421Z","title":"Chandra ocr 2.https://github.com/datalab-to/chandra","venue":null,"work_id":"6a5e3408-dbf3-4059-9081-ed8abc49acce","year":2025},"citing_paper":{"arxiv_id":"2605.22100","last_updated":"2026-05-28T08:19:59Z","snapshot_observed_at":"2026-08-08T14:11:36.911334Z","submitted_at":"2026-05-21T07:36:41Z","title":"MPDocBench-Parse: Benchmarking Practical Multi-page Document Parsing","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-30T17:37:33.750306Z"},"links":{"citing_paper":"/paper/2605.22100"},"observation_digest":"sha256:55d698cc26e1a5f68f407644b0c58da698dae1b26cfe9c71a5efd674454e0755","observation_id":"e1d4f0bd-dd26-44a6-92d2-ced3b6b40d0c","resolution":{"observed_at":"2026-07-08T08:24:48.447291Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.22186","last_updated":"2025-09-29T16:41:28Z","snapshot_observed_at":"2026-08-06T11:22:47.957500Z","submitted_at":"2025-09-26T10:45:48Z","title":"MinerU2.5: A Decoupled Vision-Language Model for Efficient High-Resolution Document Parsing","version":2},"cited_work":{"arxiv_id":"2509.22186","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.22186","snapshot_observed_at":"2026-07-10T17:07:25.732459Z","title":"MinerU2.5: A Decoupled Vision-Language Model for Efficient High-Resolution Document Parsing","venue":"cs.CV","work_id":"6e06ed47-1ffa-419d-a9b6-145d5184c6cf","year":2025},"citing_paper":{"arxiv_id":"2605.22100","last_updated":"2026-05-28T08:19:59Z","snapshot_observed_at":"2026-08-08T14:11:36.911334Z","submitted_at":"2026-05-21T07:36:41Z","title":"MPDocBench-Parse: Benchmarking Practical Multi-page Document Parsing","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-06-30T17:37:33.750306Z"},"links":{"cited_paper":"/paper/2509.22186","citing_paper":"/paper/2605.22100"},"observation_digest":"sha256:0dd7ab8dad37a642d915527e872be829c20a25dbb69ebe3a80c1a95a6e88d5ac","observation_id":"67fa30c4-b48b-47a9-a754-8e52982c1b40","resolution":{"observed_at":"2026-07-01T15:05:48.205995Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.10910","doi":"10.48550/arxiv.2603.10910.url:http://arxiv","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T17:07:25.785152Z","title":"Glm-ocr technical report.arXiv preprint arXiv:2603.10910","venue":null,"work_id":"c18244fa-5009-4f7a-a303-76b8f016e7a0","year":2026},"citing_paper":{"arxiv_id":"2605.22100","last_updated":"2026-05-28T08:19:59Z","snapshot_observed_at":"2026-08-08T14:11:36.911334Z","submitted_at":"2026-05-21T07:36:41Z","title":"MPDocBench-Parse: Benchmarking Practical Multi-page Document Parsing","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-06-30T17:37:33.750306Z"},"links":{"citing_paper":"/paper/2605.22100"},"observation_digest":"sha256:53e54d1e54faad7c4f564fd56981d279d29fd34df967e0141f7717950fd4c9c1","observation_id":"c7d9e5e7-fc80-4058-aa2a-620df8960e77","resolution":{"observed_at":"2026-07-01T15:05:48.234322Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2506.05218","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T10:19:46.911382Z","title":"arXiv preprint arXiv:2506.05218 , year=","venue":null,"work_id":"e1783180-c7e4-4eda-92a0-bea7df4e8d95","year":2025},"citing_paper":{"arxiv_id":"2605.22100","last_updated":"2026-05-28T08:19:59Z","snapshot_observed_at":"2026-08-08T14:11:36.911334Z","submitted_at":"2026-05-21T07:36:41Z","title":"MPDocBench-Parse: Benchmarking Practical Multi-page Document Parsing","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-06-30T17:37:33.750306Z"},"links":{"citing_paper":"/paper/2605.22100"},"observation_digest":"sha256:c9b31d8d40a57f09c7b5c73aaa0800f7d2764d131d02ffe89088a7e059e8f100","observation_id":"c94901f9-b67b-4e1c-a10c-426704642174","resolution":{"observed_at":"2026-07-01T15:05:48.247464Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.18839","last_updated":"2024-09-27T15:35:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-27T15:35:15Z","title":"MinerU: An Open-Source Solution for Precise Document Content Extraction","version":1},"cited_work":{"arxiv_id":"2409.18839","doi":"10.48550/arxiv.2409.18839","metadata_source":"pith","pith_arxiv_id":"2409.18839","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"MinerU: An Open-Source Solution for Precise Document Content Extraction","venue":"cs.CV","work_id":"c1ec615b-d679-40b4-a2fe-c921d3c86546","year":2024},"citing_paper":{"arxiv_id":"2605.22100","last_updated":"2026-05-28T08:19:59Z","snapshot_observed_at":"2026-08-08T14:11:36.911334Z","submitted_at":"2026-05-21T07:36:41Z","title":"MPDocBench-Parse: Benchmarking Practical Multi-page Document Parsing","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-06-30T17:37:33.750306Z"},"links":{"cited_paper":"/paper/2409.18839","citing_paper":"/paper/2605.22100"},"observation_digest":"sha256:1a0c864305df449da60848bcc5fef473581b4abd268ea7f7316a9bbc52c21758","observation_id":"de1033c0-00c9-4dd2-a4fa-dd4be2f89c6a","resolution":{"observed_at":"2026-07-01T15:05:48.187603Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.05595","last_updated":"2025-07-08T02:14:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-08T02:14:10Z","title":"PaddleOCR 3.0 Technical Report","version":1},"cited_work":{"arxiv_id":"2507.05595","doi":"10.48550/arxiv.2507.05595.url:http://arxiv.org/","metadata_source":"pith","pith_arxiv_id":"2507.05595","snapshot_observed_at":"2026-07-11T02:17:46.362300Z","title":"PaddleOCR 3.0 Technical Report","venue":"cs.CV","work_id":"444c549c-1895-4cae-a2d3-c13d7ed5f462","year":2025},"citing_paper":{"arxiv_id":"2605.22100","last_updated":"2026-05-28T08:19:59Z","snapshot_observed_at":"2026-08-08T14:11:36.911334Z","submitted_at":"2026-05-21T07:36:41Z","title":"MPDocBench-Parse: Benchmarking Practical Multi-page Document Parsing","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-06-30T17:37:33.750306Z"},"links":{"cited_paper":"/paper/2507.05595","citing_paper":"/paper/2605.22100"},"observation_digest":"sha256:5f5b9db6eb58ae54ad03da776b5fbf6e42a6592e75f4e3c7f0ce93188e86b834","observation_id":"a3049a87-f3ef-4df1-9b4e-83a05e871133","resolution":{"observed_at":"2026-07-01T15:05:48.242228Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T08:24:48.470334Z","title":"Docling: An efficient open-source toolkit for ai-driven document conversion","venue":null,"work_id":"eaa73139-88ae-4817-9e9c-cfb193cdc7d4","year":2025},"citing_paper":{"arxiv_id":"2605.22100","last_updated":"2026-05-28T08:19:59Z","snapshot_observed_at":"2026-08-08T14:11:36.911334Z","submitted_at":"2026-05-21T07:36:41Z","title":"MPDocBench-Parse: Benchmarking Practical Multi-page Document Parsing","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-06-30T17:37:33.750306Z"},"links":{"citing_paper":"/paper/2605.22100"},"observation_digest":"sha256:11ab6dff62d6b48a37458d615fb65b43f0d0e99e53316cf9c1d27f870c39b4f4","observation_id":"d250364e-cd52-4083-9c71-ce32b931c42e","resolution":{"observed_at":"2026-07-08T08:24:48.472449Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T08:24:48.476060Z","title":"Layoutparser: A unified toolkit for deep learning based document image analysis","venue":null,"work_id":"96914f18-c216-420d-9ff9-15a39972b17e","year":2021},"citing_paper":{"arxiv_id":"2605.22100","last_updated":"2026-05-28T08:19:59Z","snapshot_observed_at":"2026-08-08T14:11:36.911334Z","submitted_at":"2026-05-21T07:36:41Z","title":"MPDocBench-Parse: Benchmarking Practical Multi-page Document Parsing","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-06-30T17:37:33.750306Z"},"links":{"citing_paper":"/paper/2605.22100"},"observation_digest":"sha256:1d43e7909da3e4738d9a4e80ef12dc5ea265a028cdef63f17c6db866cd514ab0","observation_id":"9b8112b5-9d0e-4c94-bafc-d77a4dcfe1c2","resolution":{"observed_at":"2026-07-08T08:24:48.477775Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T08:24:48.483706Z","title":"Gemini 3.1.https://deepmind.google/models/gemini/pro/","venue":null,"work_id":"a0720b5e-a920-44af-a960-e1c8f1666913","year":2026},"citing_paper":{"arxiv_id":"2605.22100","last_updated":"2026-05-28T08:19:59Z","snapshot_observed_at":"2026-08-08T14:11:36.911334Z","submitted_at":"2026-05-21T07:36:41Z","title":"MPDocBench-Parse: Benchmarking Practical Multi-page Document Parsing","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-06-30T17:37:33.750306Z"},"links":{"citing_paper":"/paper/2605.22100"},"observation_digest":"sha256:012a1446c8dc165aadfc3512161633e56e99e492d961209fce3243c82d12df81","observation_id":"4667faf5-1362-4a29-a4da-4a6fbc1f2fae","resolution":{"observed_at":"2026-07-08T08:24:48.485619Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T08:24:48.512762Z","title":"Chatgpt.https://chat.openai.com","venue":null,"work_id":"a362e38c-4510-4d73-ae58-a62ae8929829","year":2025},"citing_paper":{"arxiv_id":"2605.22100","last_updated":"2026-05-28T08:19:59Z","snapshot_observed_at":"2026-08-08T14:11:36.911334Z","submitted_at":"2026-05-21T07:36:41Z","title":"MPDocBench-Parse: Benchmarking Practical Multi-page Document Parsing","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-06-30T17:37:33.750306Z"},"links":{"citing_paper":"/paper/2605.22100"},"observation_digest":"sha256:ee2f2eb996cbb5fd6d0f839be46d6974d0dc2e15ac26cb4a01d6399ed31f9e50","observation_id":"efe6a310-6783-4209-8af8-0a531d35ac54","resolution":{"observed_at":"2026-07-08T08:24:48.514320Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T08:24:48.453586Z","title":"Claude.https://www.anthropic.com/claude","venue":null,"work_id":"5416a812-e14b-4cd1-ac6f-428503663ba3","year":2025},"citing_paper":{"arxiv_id":"2605.22100","last_updated":"2026-05-28T08:19:59Z","snapshot_observed_at":"2026-08-08T14:11:36.911334Z","submitted_at":"2026-05-21T07:36:41Z","title":"MPDocBench-Parse: Benchmarking Practical Multi-page Document Parsing","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-06-30T17:37:33.750306Z"},"links":{"citing_paper":"/paper/2605.22100"},"observation_digest":"sha256:2a6e7e643184383bc21337cd5a3e53eedd6cf2b98904eaef61bff96e83af1266","observation_id":"5140433b-b475-42d6-871e-34df5bc6a7b8","resolution":{"observed_at":"2026-07-08T08:24:48.466074Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T08:24:48.495739Z","title":"Tongyi.https://www.aliyun.com/product/tongyi","venue":null,"work_id":"d9b5980b-9055-4daa-b2ed-5ffc8ec80720","year":2025},"citing_paper":{"arxiv_id":"2605.22100","last_updated":"2026-05-28T08:19:59Z","snapshot_observed_at":"2026-08-08T14:11:36.911334Z","submitted_at":"2026-05-21T07:36:41Z","title":"MPDocBench-Parse: Benchmarking Practical Multi-page Document Parsing","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-06-30T17:37:33.750306Z"},"links":{"citing_paper":"/paper/2605.22100"},"observation_digest":"sha256:79f1a4b7618562e9fd79bae506ed8b25d36609bd606846b1f7a80a5f13176a19","observation_id":"5dbc68de-322f-4115-a982-08106feb1f0a","resolution":{"observed_at":"2026-07-08T08:24:48.497095Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.21631","last_updated":"2025-11-27T12:16:54Z","snapshot_observed_at":"2026-07-06T22:37:03.716474Z","submitted_at":"2025-11-26T17:59:08Z","title":"Qwen3-VL Technical Report","version":2},"cited_work":{"arxiv_id":"2511.21631","doi":"10.1016/j.neunet.2025.107777","metadata_source":"pith","pith_arxiv_id":"2511.21631","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen3-VL Technical Report","venue":"cs.CV","work_id":"1fe243aa-e3c0-4da6-b391-4cbcfc88d5c0","year":2025},"citing_paper":{"arxiv_id":"2605.22100","last_updated":"2026-05-28T08:19:59Z","snapshot_observed_at":"2026-08-08T14:11:36.911334Z","submitted_at":"2026-05-21T07:36:41Z","title":"MPDocBench-Parse: Benchmarking Practical Multi-page Document Parsing","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-06-30T17:37:33.750306Z"},"links":{"cited_paper":"/paper/2511.21631","citing_paper":"/paper/2605.22100"},"observation_digest":"sha256:09edcf4c669bc32892ed287a2a9983617286929ad587a50b573bd5333c4d46e4","observation_id":"bbaae063-662c-4bf8-b158-75494aa6a16c","resolution":{"observed_at":"2026-07-01T15:05:48.219082Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.05384","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T16:49:57.082643Z","title":"Dolphin-v2: Universal document parsing via scalable anchor prompting","venue":null,"work_id":"2d59c7be-b2aa-4c0b-a0b4-a6c33dd7ee05","year":2026},"citing_paper":{"arxiv_id":"2605.22100","last_updated":"2026-05-28T08:19:59Z","snapshot_observed_at":"2026-08-08T14:11:36.911334Z","submitted_at":"2026-05-21T07:36:41Z","title":"MPDocBench-Parse: Benchmarking Practical Multi-page Document Parsing","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-06-30T17:37:33.750306Z"},"links":{"citing_paper":"/paper/2605.22100"},"observation_digest":"sha256:7933b4e24e0454f927fcc03a8327b7dd25374cfeef29f3c524ed6a97f6a439c9","observation_id":"4ee1eff0-60e3-45a7-8a18-a95804c9bb04","resolution":{"observed_at":"2026-07-01T15:05:48.244402Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.14528","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T17:07:25.801009Z","title":"Paddleocr-vl: Boosting multilingual document parsing via a 0.9 b ultra-compact vision-language model","venue":null,"work_id":"24ce5f62-ba1e-4587-a368-858a472f614c","year":2025},"citing_paper":{"arxiv_id":"2605.22100","last_updated":"2026-05-28T08:19:59Z","snapshot_observed_at":"2026-08-08T14:11:36.911334Z","submitted_at":"2026-05-21T07:36:41Z","title":"MPDocBench-Parse: Benchmarking Practical Multi-page Document Parsing","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-06-30T17:37:33.750306Z"},"links":{"citing_paper":"/paper/2605.22100"},"observation_digest":"sha256:01285993131baf0cf68dfc6e6928e83e2ae84b171e6c0af3f97d806d3551dcb6","observation_id":"bc2fabd0-e3c5-446d-9912-e75ce336bfb4","resolution":{"observed_at":"2026-07-01T15:05:48.231900Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T08:24:48.473371Z","title":"M6doc: A large-scale multi-format, multi-type, multi-layout, multi-language, multi- annotation category dataset for modern document layout analysis","venue":null,"work_id":"c71d483a-3c8b-4eab-827d-c625908e7fc8","year":2023},"citing_paper":{"arxiv_id":"2605.22100","last_updated":"2026-05-28T08:19:59Z","snapshot_observed_at":"2026-08-08T14:11:36.911334Z","submitted_at":"2026-05-21T07:36:41Z","title":"MPDocBench-Parse: Benchmarking Practical Multi-page Document Parsing","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-06-30T17:37:33.750306Z"},"links":{"citing_paper":"/paper/2605.22100"},"observation_digest":"sha256:5faf5729572a080280ccb9dc1e36f6614dceeaa3e07b27f1a85237aabd3b7f6a","observation_id":"72d4763f-5838-489c-b39a-d76703b121fd","resolution":{"observed_at":"2026-07-08T08:24:48.475287Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T08:24:48.507272Z","title":"Vision grid transformer for document layout analysis","venue":null,"work_id":"a2371668-269f-448e-b7e0-9c87870350f3","year":2023},"citing_paper":{"arxiv_id":"2605.22100","last_updated":"2026-05-28T08:19:59Z","snapshot_observed_at":"2026-08-08T14:11:36.911334Z","submitted_at":"2026-05-21T07:36:41Z","title":"MPDocBench-Parse: Benchmarking Practical Multi-page Document Parsing","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-06-30T17:37:33.750306Z"},"links":{"citing_paper":"/paper/2605.22100"},"observation_digest":"sha256:5e1f6861700af9e76b7a8b1faa1a97df5751e2216b864b0755ac296f49ada2e6","observation_id":"ae96e940-b64d-435a-b276-3dee1b2323de","resolution":{"observed_at":"2026-07-08T08:24:48.508877Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T08:24:48.510109Z","title":"Global table extractor (gte): A framework for joint table identification and cell structure recognition using visual context","venue":null,"work_id":"794d6c02-4865-41cd-8992-fdd192524e7d","year":2021},"citing_paper":{"arxiv_id":"2605.22100","last_updated":"2026-05-28T08:19:59Z","snapshot_observed_at":"2026-08-08T14:11:36.911334Z","submitted_at":"2026-05-21T07:36:41Z","title":"MPDocBench-Parse: Benchmarking Practical Multi-page Document Parsing","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-06-30T17:37:33.750306Z"},"links":{"citing_paper":"/paper/2605.22100"},"observation_digest":"sha256:2162d846fa167a57262ccb9868fe6b7fed39deceb1411e7e756788ea73fd1624","observation_id":"177f1e18-1ac7-4aa1-acc0-1d61ee83ed77","resolution":{"observed_at":"2026-07-08T08:24:48.511972Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2603.09677","last_updated":"2026-04-08T07:57:35Z","snapshot_observed_at":"2026-07-06T22:48:30.706783Z","submitted_at":"2026-03-10T13:46:32Z","title":"Logics-Parsing-Omni Technical Report","version":3},"cited_work":{"arxiv_id":"2603.09677","doi":null,"metadata_source":"pith","pith_arxiv_id":"2603.09677","snapshot_observed_at":"2026-07-02T02:46:28.830346Z","title":"Logics-Parsing-Omni Technical Report","venue":"cs.AI","work_id":"d0941660-d2e3-4e17-8736-f411349a80b7","year":2026},"citing_paper":{"arxiv_id":"2605.22100","last_updated":"2026-05-28T08:19:59Z","snapshot_observed_at":"2026-08-08T14:11:36.911334Z","submitted_at":"2026-05-21T07:36:41Z","title":"MPDocBench-Parse: Benchmarking Practical Multi-page Document Parsing","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-06-30T17:37:33.750306Z"},"links":{"cited_paper":"/paper/2603.09677","citing_paper":"/paper/2605.22100"},"observation_digest":"sha256:acd3ae1b6f6d6dc7bb57f7c318aaec08c7d4dd41eddb514438a056575f2c3c5e","observation_id":"3e3dac92-b7b5-4076-b54c-61e2bea5e2b6","resolution":{"observed_at":"2026-07-01T15:05:48.252222Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T08:24:48.515079Z","title":"Mmlongbench-doc: Benchmarking long-context document understanding with visualizations.Advances in Neural Information Processing Systems, 37:95963–96010","venue":null,"work_id":"7550e862-236a-4c34-ae8b-c3bde4d3385d","year":2024},"citing_paper":{"arxiv_id":"2605.22100","last_updated":"2026-05-28T08:19:59Z","snapshot_observed_at":"2026-08-08T14:11:36.911334Z","submitted_at":"2026-05-21T07:36:41Z","title":"MPDocBench-Parse: Benchmarking Practical Multi-page Document Parsing","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-06-30T17:37:33.750306Z"},"links":{"citing_paper":"/paper/2605.22100"},"observation_digest":"sha256:3336ca92a08660c1af465d99bda7de4cf82e4893e52c1c785e319d9d8dc40c89","observation_id":"33292a8b-89f0-4220-b5f5-6025f961c28a","resolution":{"observed_at":"2026-07-08T08:24:48.516734Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T08:24:48.519945Z","title":"Longdocurl: a comprehensive multimodal long document benchmark integrating understanding, reasoning, and locating","venue":null,"work_id":"b67f228d-3601-467d-91de-563e2fd6ded2","year":2025},"citing_paper":{"arxiv_id":"2605.22100","last_updated":"2026-05-28T08:19:59Z","snapshot_observed_at":"2026-08-08T14:11:36.911334Z","submitted_at":"2026-05-21T07:36:41Z","title":"MPDocBench-Parse: Benchmarking Practical Multi-page Document Parsing","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-06-30T17:37:33.750306Z"},"links":{"citing_paper":"/paper/2605.22100"},"observation_digest":"sha256:a7719f1c35ee2eef34530319b17427b2c2f2269d9251f29ecbeb0c16ee1264fb","observation_id":"302f4340-d143-4d13-a26b-37a6cc030ca0","resolution":{"observed_at":"2026-07-08T08:24:48.521558Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.03663","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-01T15:05:48.222726Z","title":"Unidoc-bench: A unified benchmark for document-centric multimodal rag","venue":null,"work_id":"fe837556-8722-4fa8-8ced-780cd36c69bb","year":2025},"citing_paper":{"arxiv_id":"2605.22100","last_updated":"2026-05-28T08:19:59Z","snapshot_observed_at":"2026-08-08T14:11:36.911334Z","submitted_at":"2026-05-21T07:36:41Z","title":"MPDocBench-Parse: Benchmarking Practical Multi-page Document Parsing","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-06-30T17:37:33.750306Z"},"links":{"citing_paper":"/paper/2605.22100"},"observation_digest":"sha256:90f05f5251e8dbdfaa68cce1733d7116eeeca5b602bae3c0e9c49d77aeaf6645","observation_id":"36207e42-ffcf-4771-b611-0027f032ec55","resolution":{"observed_at":"2026-07-01T15:05:48.224190Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T08:24:48.517591Z","title":"Docbench: A benchmark for evaluating llm-based document reading systems","venue":null,"work_id":"9d4d88b5-1358-4c9e-bcfe-bc0eda888ab9","year":2025},"citing_paper":{"arxiv_id":"2605.22100","last_updated":"2026-05-28T08:19:59Z","snapshot_observed_at":"2026-08-08T14:11:36.911334Z","submitted_at":"2026-05-21T07:36:41Z","title":"MPDocBench-Parse: Benchmarking Practical Multi-page Document Parsing","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-06-30T17:37:33.750306Z"},"links":{"citing_paper":"/paper/2605.22100"},"observation_digest":"sha256:a39e62cbbccf0b11fe03565755b4c5f6c9ca2d2e970ab6d9603b0bc2291a9c40","observation_id":"0a1ec5bd-7d0b-444d-9886-8f5aa8625bd7","resolution":{"observed_at":"2026-07-08T08:24:48.519171Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.21957","last_updated":"2026-04-03T06:49:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-01-29T16:35:04Z","title":"PaddleOCR-VL-1.5: Towards a Multi-Task 0.9B VLM for Robust In-the-Wild Document Parsing","version":2},"cited_work":{"arxiv_id":"2601.21957","doi":null,"metadata_source":"pith","pith_arxiv_id":"2601.21957","snapshot_observed_at":"2026-07-04T15:09:54.670844Z","title":"PaddleOCR-VL-1.5: Towards a Multi-Task 0.9B VLM for Robust In-the-Wild Document Parsing","venue":"cs.CV","work_id":"aca6cad3-5eb4-48dc-92c1-44a5eb63772e","year":2026},"citing_paper":{"arxiv_id":"2605.22100","last_updated":"2026-05-28T08:19:59Z","snapshot_observed_at":"2026-08-08T14:11:36.911334Z","submitted_at":"2026-05-21T07:36:41Z","title":"MPDocBench-Parse: Benchmarking Practical Multi-page Document Parsing","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-06-30T17:37:33.750306Z"},"links":{"cited_paper":"/paper/2601.21957","citing_paper":"/paper/2605.22100"},"observation_digest":"sha256:5a9c18ef55e599651862e3ddeb9e2dc69a6d12f9997edd11a2039ed83de4b92e","observation_id":"e1e6f688-5b21-467e-9b16-bacb7b8fc14c","resolution":{"observed_at":"2026-07-01T15:05:48.216507Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T08:24:48.491496Z","title":"Binary codes capable of correcting deletions, insertions, and reversals","venue":null,"work_id":"ab213192-aa31-4cee-a550-badc87dcaaef","year":1966},"citing_paper":{"arxiv_id":"2605.22100","last_updated":"2026-05-28T08:19:59Z","snapshot_observed_at":"2026-08-08T14:11:36.911334Z","submitted_at":"2026-05-21T07:36:41Z","title":"MPDocBench-Parse: Benchmarking Practical Multi-page Document Parsing","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-06-30T17:37:33.750306Z"},"links":{"citing_paper":"/paper/2605.22100"},"observation_digest":"sha256:cec681e3bbf36039693ed42e6ad0aa2a02133ba312372fe3f23650a051e68e84","observation_id":"5a5bb5f5-65ae-4612-8835-2daa43ec6074","resolution":{"observed_at":"2026-07-08T08:24:48.492963Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T08:24:48.500394Z","title":"Gemini 3 pro","venue":null,"work_id":"03f8aab2-3528-4035-af89-d1276d386bae","year":2025},"citing_paper":{"arxiv_id":"2605.22100","last_updated":"2026-05-28T08:19:59Z","snapshot_observed_at":"2026-08-08T14:11:36.911334Z","submitted_at":"2026-05-21T07:36:41Z","title":"MPDocBench-Parse: Benchmarking Practical Multi-page Document Parsing","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-06-30T17:37:33.750306Z"},"links":{"citing_paper":"/paper/2605.22100"},"observation_digest":"sha256:880ee90d116bcd3e02a7651171e5c6d6e108aaf38a681e1268f43881b4552d44","observation_id":"b9200af5-ace6-4615-a303-01f9a10ea61e","resolution":{"observed_at":"2026-07-08T08:24:48.501599Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2508.13238","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-01T15:05:48.235373Z","title":"Dianjin-ocr-r1: Enhancing ocr capabilities via a reasoning-and-tool interleaved vision-language model","venue":null,"work_id":"3ab09f1c-a42f-483a-85ce-0a464d93d8f6","year":2025},"citing_paper":{"arxiv_id":"2605.22100","last_updated":"2026-05-28T08:19:59Z","snapshot_observed_at":"2026-08-08T14:11:36.911334Z","submitted_at":"2026-05-21T07:36:41Z","title":"MPDocBench-Parse: Benchmarking Practical Multi-page Document Parsing","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-06-30T17:37:33.750306Z"},"links":{"citing_paper":"/paper/2605.22100"},"observation_digest":"sha256:68b34c7de471a392e300294c36f1aaf68ddb8bc495f8e12bfa5e3d483fb5d227","observation_id":"b3c4f9eb-a35f-412e-9002-4c33231eccce","resolution":{"observed_at":"2026-07-01T15:05:48.236826Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.03643","last_updated":"2025-03-24T13:31:05Z","snapshot_observed_at":"2026-08-09T22:33:52.618779Z","submitted_at":"2024-09-05T16:01:21Z","title":"Image Over Text: Transforming Formula Recognition Evaluation with Character Detection Matching","version":2},"cited_work":{"arxiv_id":"2409.03643","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2409.03643","snapshot_observed_at":"2026-07-04T16:39:58.547930Z","title":"Cdm: A reliable metric for fair and accurate formula recognition evaluation.arXiv preprint arXiv:2409.03643, 5(6)","venue":null,"work_id":"565847bc-72e5-446d-ad4e-a1839b7a2915","year":2024},"citing_paper":{"arxiv_id":"2605.22100","last_updated":"2026-05-28T08:19:59Z","snapshot_observed_at":"2026-08-08T14:11:36.911334Z","submitted_at":"2026-05-21T07:36:41Z","title":"MPDocBench-Parse: Benchmarking Practical Multi-page Document Parsing","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-06-30T17:37:33.750306Z"},"links":{"cited_paper":"/paper/2409.03643","citing_paper":"/paper/2605.22100"},"observation_digest":"sha256:34797da3d5d17506dc453f5c8f65d4f8897000538d86fd3d794863574f500a2a","observation_id":"4ec345ab-f4c7-4e77-b1fc-d5b3583fc064","resolution":{"observed_at":"2026-07-01T15:05:48.232177Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T17:17:26.636943Z","title":"Image-based table recognition: data, model, and evaluation","venue":null,"work_id":"780e00d3-e411-4333-8f05-f51f19233d5c","year":2020},"citing_paper":{"arxiv_id":"2605.22100","last_updated":"2026-05-28T08:19:59Z","snapshot_observed_at":"2026-08-08T14:11:36.911334Z","submitted_at":"2026-05-21T07:36:41Z","title":"MPDocBench-Parse: Benchmarking Practical Multi-page Document Parsing","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-06-30T17:37:33.750306Z"},"links":{"citing_paper":"/paper/2605.22100"},"observation_digest":"sha256:6b4806541212b058f035cb294f4bc7eaf4ec90dd5826521f9ad0221ec5a12f74","observation_id":"0210e59c-2a59-465f-a133-638963249083","resolution":{"observed_at":"2026-07-08T08:24:48.432351Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.20430","last_updated":"2026-07-13T14:16:50Z","snapshot_observed_at":"2026-08-05T11:18:58.202841Z","submitted_at":"2026-01-28T09:37:13Z","title":"Youtu-Parsing: Perception, Structuring and Recognition via High-Parallelism Decoding","version":2},"cited_work":{"arxiv_id":"2601.20430","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2601.20430","snapshot_observed_at":"2026-07-14T03:21:27.323268Z","title":"Youtu-parsing: Perception, structuring and recognition via high-parallelism decoding","venue":null,"work_id":"a02d784c-999f-4b21-ab04-640335260827","year":2026},"citing_paper":{"arxiv_id":"2605.22100","last_updated":"2026-05-28T08:19:59Z","snapshot_observed_at":"2026-08-08T14:11:36.911334Z","submitted_at":"2026-05-21T07:36:41Z","title":"MPDocBench-Parse: Benchmarking Practical Multi-page Document Parsing","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-06-30T17:37:33.750306Z"},"links":{"cited_paper":"/paper/2601.20430","citing_paper":"/paper/2605.22100"},"observation_digest":"sha256:e8d784cb49881c559a6feef7062590cca488ad03f2072b296b4c913cb06ad8b0","observation_id":"37772d44-a626-4a8f-a5ea-4be6664445b9","resolution":{"observed_at":"2026-07-14T03:21:27.323268Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.13032","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-01T21:16:14.035094Z","title":"Multimodal ocr: Parse anything from documents","venue":null,"work_id":"83409bb9-0ee5-4da9-a750-da6424ff01f5","year":2026},"citing_paper":{"arxiv_id":"2605.22100","last_updated":"2026-05-28T08:19:59Z","snapshot_observed_at":"2026-08-08T14:11:36.911334Z","submitted_at":"2026-05-21T07:36:41Z","title":"MPDocBench-Parse: Benchmarking Practical Multi-page Document Parsing","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-06-30T17:37:33.750306Z"},"links":{"citing_paper":"/paper/2605.22100"},"observation_digest":"sha256:e5ee443d439da32a3b6dc62fa51394f1728c89a00e447b89068f189610ee367c","observation_id":"a5876d5f-2695-4d5e-a6e7-95e6acf37f08","resolution":{"observed_at":"2026-07-01T15:05:48.257599Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2512.02498","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T09:59:45.152724Z","title":"InICASSP 2023-2023 IEEE International Conference on Acoustics, Speech and Signal Processing (ICASSP), pages 1–5","venue":null,"work_id":"cb5539a0-6843-4702-bbf3-dfe7b61e5cbb","year":2025},"citing_paper":{"arxiv_id":"2605.22100","last_updated":"2026-05-28T08:19:59Z","snapshot_observed_at":"2026-08-08T14:11:36.911334Z","submitted_at":"2026-05-21T07:36:41Z","title":"MPDocBench-Parse: Benchmarking Practical Multi-page Document Parsing","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-06-30T17:37:33.750306Z"},"links":{"citing_paper":"/paper/2605.22100"},"observation_digest":"sha256:335ea178bc4dacc87db019abfe2b364b3772b463b38c44e46fc86d9e12beaf1e","observation_id":"2c9df784-4b58-4fee-ade5-045ad3f2d3d8","resolution":{"observed_at":"2026-07-01T15:05:48.168355Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2601.21639","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-02T02:46:28.850593Z","title":"Ocrverse: Towards holistic ocr in end-to-end vision-language models","venue":null,"work_id":"882cec55-a48e-435e-aaec-5dd371cee961","year":2026},"citing_paper":{"arxiv_id":"2605.22100","last_updated":"2026-05-28T08:19:59Z","snapshot_observed_at":"2026-08-08T14:11:36.911334Z","submitted_at":"2026-05-21T07:36:41Z","title":"MPDocBench-Parse: Benchmarking Practical Multi-page Document Parsing","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-06-30T17:37:33.750306Z"},"links":{"citing_paper":"/paper/2605.22100"},"observation_digest":"sha256:6b00134a404c26a93392d2985672b8f2b523bb7e49884054d3dfee639fb1cce5","observation_id":"256bb41c-1f89-46f8-9595-c35ca575032b","resolution":{"observed_at":"2026-07-01T15:05:48.224336Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.18265","last_updated":"2025-08-27T14:39:45Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-08-25T17:58:17Z","title":"InternVL3.5: Advancing Open-Source Multimodal Models in Versatility, Reasoning, and Efficiency","version":2},"cited_work":{"arxiv_id":"2508.18265","doi":"10.48550/arxiv.2508.18265","metadata_source":"pith","pith_arxiv_id":"2508.18265","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"InternVL3.5: Advancing Open-Source Multimodal Models in Versatility, Reasoning, and Efficiency","venue":"cs.CV","work_id":"b8f5e260-fff5-444e-bcf5-2c42cfefd83d","year":2025},"citing_paper":{"arxiv_id":"2605.22100","last_updated":"2026-05-28T08:19:59Z","snapshot_observed_at":"2026-08-08T14:11:36.911334Z","submitted_at":"2026-05-21T07:36:41Z","title":"MPDocBench-Parse: Benchmarking Practical Multi-page Document Parsing","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-06-30T17:37:33.750306Z"},"links":{"cited_paper":"/paper/2508.18265","citing_paper":"/paper/2605.22100"},"observation_digest":"sha256:c98892169fd1ccddf3b8db0dd5f4aa53c309c4907336a87a9cd1d4851b09d004","observation_id":"3aee8439-e395-4bd5-884e-d7dd3d05cf78","resolution":{"observed_at":"2026-07-01T15:05:48.176379Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T17:38:12.771444+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T17:38:12.771444+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-10T17:38:12.771444+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.02359","last_updated":"2025-09-02T14:22:43Z","snapshot_observed_at":"2026-08-08T06:17:37.928618Z","submitted_at":"2025-09-02T14:22:43Z","title":"Why Do MLLMs Struggle with Spatial Understanding? A Systematic Analysis from Data to Architecture","version":1},"cited_work":{"arxiv_id":"2509.02359","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.02359","snapshot_observed_at":"2026-07-04T19:50:10.271272Z","title":"Why do mllms struggle with spatial understanding? a systematic analysis from data to architecture","venue":null,"work_id":"0ff3d2c2-b3b3-41b0-8bb3-bae4d41de054","year":2025},"citing_paper":{"arxiv_id":"2605.22100","last_updated":"2026-05-28T08:19:59Z","snapshot_observed_at":"2026-08-08T14:11:36.911334Z","submitted_at":"2026-05-21T07:36:41Z","title":"MPDocBench-Parse: Benchmarking Practical Multi-page Document Parsing","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-06-30T17:37:33.750306Z"},"links":{"cited_paper":"/paper/2509.02359","citing_paper":"/paper/2605.22100"},"observation_digest":"sha256:07c99e09b006df48581711e13ec20178c3f40de3ea153941ce3131e00d65bb4d","observation_id":"9ee60d47-bac9-4064-951c-b7ec93060950","resolution":{"observed_at":"2026-07-01T15:05:48.241818Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2511.15722","doi":"10.48550/arxiv.2511.15722","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Spatial reasoning in multimodal large language models: A survey of tasks, benchmarks and methods","venue":"ArXiv.org","work_id":"6a89950e-e68f-4ee1-92ca-4c617487ec7c","year":2025},"citing_paper":{"arxiv_id":"2605.22100","last_updated":"2026-05-28T08:19:59Z","snapshot_observed_at":"2026-08-08T14:11:36.911334Z","submitted_at":"2026-05-21T07:36:41Z","title":"MPDocBench-Parse: Benchmarking Practical Multi-page Document Parsing","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-06-30T17:37:33.750306Z"},"links":{"citing_paper":"/paper/2605.22100"},"observation_digest":"sha256:de0f6673dbea8155f1024806a66fab751a29f9e7c885f14dfa4a875de3e3e38c","observation_id":"535786b0-cb0d-4b3b-896e-c1aa14afcce4","resolution":{"observed_at":"2026-07-01T15:05:48.255065Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T11:34:51.773324Z","title":null,"venue":null,"work_id":"719d8825-162a-4f79-851d-ebf7ab7d52e5","year":2020},"citing_paper":{"arxiv_id":"2605.22100","last_updated":"2026-05-28T08:19:59Z","snapshot_observed_at":"2026-08-08T14:11:36.911334Z","submitted_at":"2026-05-21T07:36:41Z","title":"MPDocBench-Parse: Benchmarking Practical Multi-page Document Parsing","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-06-30T17:37:33.750306Z"},"links":{"citing_paper":"/paper/2605.22100"},"observation_digest":"sha256:c988460dc0f6c66d6c888e7d87a3b263850a10556c56189d2ca15343033d4aff","observation_id":"c072bb97-0aee-44ac-999f-00b3342da07f","resolution":{"observed_at":"2026-07-08T08:24:48.436192Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T08:24:48.423236Z","title":"Gonzalez, Hao Zhang, and Ion Stoica","venue":null,"work_id":"4286b247-177a-4d5f-aa88-c483f25a7dac","year":2023},"citing_paper":{"arxiv_id":"2605.22100","last_updated":"2026-05-28T08:19:59Z","snapshot_observed_at":"2026-08-08T14:11:36.911334Z","submitted_at":"2026-05-21T07:36:41Z","title":"MPDocBench-Parse: Benchmarking Practical Multi-page Document Parsing","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-06-30T17:37:33.750306Z"},"links":{"citing_paper":"/paper/2605.22100"},"observation_digest":"sha256:85e396c13ccc333a6445299050af71a4a3160b054633fc2c0891dc71f0f31bf6","observation_id":"9611941a-e6ae-41d3-9464-5d665b1dd467","resolution":{"observed_at":"2026-07-08T08:24:48.425383Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.15601","last_updated":"2026-05-15T15:18:00Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-08-21T14:24:52Z","title":"LMDeploy Accelerates Mixed-Precision LLM Inference with TurboMind","version":2},"cited_work":{"arxiv_id":"2508.15601","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.15601","snapshot_observed_at":"2026-07-04T02:39:25.590062Z","title":"LMDeploy Accelerates Mixed-Precision LLM Inference with TurboMind","venue":"cs.DC","work_id":"e2ca48ee-4df8-48eb-9021-3fb79c01ff17","year":2025},"citing_paper":{"arxiv_id":"2605.22100","last_updated":"2026-05-28T08:19:59Z","snapshot_observed_at":"2026-08-08T14:11:36.911334Z","submitted_at":"2026-05-21T07:36:41Z","title":"MPDocBench-Parse: Benchmarking Practical Multi-page Document Parsing","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-06-30T17:37:33.750306Z"},"links":{"cited_paper":"/paper/2508.15601","citing_paper":"/paper/2605.22100"},"observation_digest":"sha256:305f60b235ee11aaa6c6f70bc833ae7a7d9da68a11c13991d083223968c73f82","observation_id":"5b65ec94-455d-41c0-b875-db612bef7eee","resolution":{"observed_at":"2026-07-01T15:05:48.210955Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2605.22100","last_updated":"2026-05-28T08:19:59Z","latest_version":2,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-08T14:11:36.911334Z","submitted_at":"2026-05-21T07:36:41Z","title":"MPDocBench-Parse: Benchmarking Practical Multi-page Document Parsing"},"reference_resolution":{"displayed":68,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":1,"verified_exact":36,"verified_fuzzy":31},"total_outbound_references":68},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 68 of 68 outbound references and 0 inbound Pith citation observations for arXiv:2605.22100."}