{"as_of":"2026-07-31T14:35:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4fb9443f38c52f32fd8529d36d2041c1323519f0e5cbd31e66b66085fa8dc0ca","coverage":[{"denominator":43,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":43,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-11T02:28:02.152600Z","state":"measured"},{"denominator":43,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":43,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-07-31T06:34:12.847434+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2605.07492/citation-record","integrity":"/paper/2605.07492/integrity","json":"/paper/2605.07492/citation-record.json","paper":"/paper/2605.07492"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2111.08609","last_updated":"2021-11-16T16:43:07Z","snapshot_observed_at":"2026-07-06T12:09:08.635616Z","submitted_at":"2021-11-16T16:43:07Z","title":"Document AI: Benchmarks, Models and Applications","version":1},"cited_work":{"arxiv_id":"2111.08609","doi":null,"metadata_source":"pith","pith_arxiv_id":"2111.08609","snapshot_observed_at":"2026-07-08T14:44:59.761323Z","title":"arXiv preprint arXiv:2111.08609 , year=","venue":"cs.CL","work_id":"a123b80e-a4ee-41e5-8eda-1163eb4e0b7a","year":2021},"citing_paper":{"arxiv_id":"2605.07492","last_updated":"2026-05-08T09:30:31Z","snapshot_observed_at":"2026-07-06T23:19:51.414344Z","submitted_at":"2026-05-08T09:30:31Z","title":"How Far Is Document Parsing from Solved? PureDocBench: A Source-TraceableBenchmark across Clean, Degraded, and Real-World Settings","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-11T02:28:02.152600Z"},"links":{"cited_paper":"/paper/2111.08609","citing_paper":"/paper/2605.07492"},"observation_digest":"sha256:c144da6ca0144cd9d9f72a21da6ea1c26409cd64c6b2820f887b736185f4b9cb","observation_id":"ef138282-9d3d-4826-99d7-63aba473cd6d","resolution":{"observed_at":"2026-05-11T03:30:56.204784Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.21957","last_updated":"2026-04-03T06:49:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-01-29T16:35:04Z","title":"PaddleOCR-VL-1.5: Towards a Multi-Task 0.9B VLM for Robust In-the-Wild Document Parsing","version":2},"cited_work":{"arxiv_id":"2601.21957","doi":null,"metadata_source":"pith","pith_arxiv_id":"2601.21957","snapshot_observed_at":"2026-07-04T15:09:54.670844Z","title":"PaddleOCR-VL-1.5: Towards a Multi-Task 0.9B VLM for Robust In-the-Wild Document Parsing","venue":"cs.CV","work_id":"aca6cad3-5eb4-48dc-92c1-44a5eb63772e","year":2026},"citing_paper":{"arxiv_id":"2605.07492","last_updated":"2026-05-08T09:30:31Z","snapshot_observed_at":"2026-07-06T23:19:51.414344Z","submitted_at":"2026-05-08T09:30:31Z","title":"How Far Is Document Parsing from Solved? PureDocBench: A Source-TraceableBenchmark across Clean, Degraded, and Real-World Settings","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-11T02:28:02.152600Z"},"links":{"cited_paper":"/paper/2601.21957","citing_paper":"/paper/2605.07492"},"observation_digest":"sha256:ebfb12f41d03ed84a4fdeb224e8f79fa20cae13b52c1deddcef95b79d0255c8c","observation_id":"e2db76e9-ed48-406d-9ef5-6d05b5d0c375","resolution":{"observed_at":"2026-05-11T03:30:56.226423Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.10910","doi":"10.48550/arxiv.2603.10910.url:http://arxiv","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T17:07:25.785152Z","title":"Glm-ocr technical report.arXiv preprint arXiv:2603.10910","venue":null,"work_id":"c18244fa-5009-4f7a-a303-76b8f016e7a0","year":2026},"citing_paper":{"arxiv_id":"2605.07492","last_updated":"2026-05-08T09:30:31Z","snapshot_observed_at":"2026-07-06T23:19:51.414344Z","submitted_at":"2026-05-08T09:30:31Z","title":"How Far Is Document Parsing from Solved? PureDocBench: A Source-TraceableBenchmark across Clean, Degraded, and Real-World Settings","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-11T02:28:02.152600Z"},"links":{"citing_paper":"/paper/2605.07492"},"observation_digest":"sha256:20fd0086a4f511b569a9f91a8c1130422b74e28ae727e4190f382dfb89589e34","observation_id":"a6335059-2af4-4aef-af6e-32ab659e51cf","resolution":{"observed_at":"2026-05-11T03:30:56.186347Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.22186","last_updated":"2025-09-29T16:41:28Z","snapshot_observed_at":"2026-07-29T18:54:05.552715Z","submitted_at":"2025-09-26T10:45:48Z","title":"MinerU2.5: A Decoupled Vision-Language Model for Efficient High-Resolution Document Parsing","version":2},"cited_work":{"arxiv_id":"2509.22186","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.22186","snapshot_observed_at":"2026-07-10T17:07:25.732459Z","title":"MinerU2.5: A Decoupled Vision-Language Model for Efficient High-Resolution Document Parsing","venue":"cs.CV","work_id":"6e06ed47-1ffa-419d-a9b6-145d5184c6cf","year":2025},"citing_paper":{"arxiv_id":"2605.07492","last_updated":"2026-05-08T09:30:31Z","snapshot_observed_at":"2026-07-06T23:19:51.414344Z","submitted_at":"2026-05-08T09:30:31Z","title":"How Far Is Document Parsing from Solved? PureDocBench: A Source-TraceableBenchmark across Clean, Degraded, and Real-World Settings","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-11T02:28:02.152600Z"},"links":{"cited_paper":"/paper/2509.22186","citing_paper":"/paper/2605.07492"},"observation_digest":"sha256:f606e5ba7d33a10c48e89f12a6bfb0f87010cbd3d867128ef9b419443c241f24","observation_id":"7c18a55d-5e74-4ea7-acbf-fe93182b4c01","resolution":{"observed_at":"2026-05-17T13:25:32.206292Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.04771","last_updated":"2026-04-09T09:16:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-06T15:44:18Z","title":"MinerU2.5-Pro: Pushing the Limits of Data-Centric Document Parsing at Scale","version":2},"cited_work":{"arxiv_id":"2604.04771","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.04771","snapshot_observed_at":"2026-07-03T13:48:21.128497Z","title":"MinerU2.5-Pro: Pushing the Limits of Data-Centric Document Parsing at Scale","venue":"cs.CV","work_id":"da4845f6-76a6-4428-9a5c-4554a3bf40cc","year":2026},"citing_paper":{"arxiv_id":"2605.07492","last_updated":"2026-05-08T09:30:31Z","snapshot_observed_at":"2026-07-06T23:19:51.414344Z","submitted_at":"2026-05-08T09:30:31Z","title":"How Far Is Document Parsing from Solved? PureDocBench: A Source-TraceableBenchmark across Clean, Degraded, and Real-World Settings","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-11T02:28:02.152600Z"},"links":{"cited_paper":"/paper/2604.04771","citing_paper":"/paper/2605.07492"},"observation_digest":"sha256:d0a614d353750193b3b62fa838a07000a49626572f6b7446df094dafa81b6d09","observation_id":"ca9b7c25-ef23-4b86-ae27-2a74cb67be16","resolution":{"observed_at":"2026-05-11T03:30:56.318662Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.05384","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T16:49:57.082643Z","title":"Dolphin-v2: Universal document parsing via scalable anchor prompting","venue":null,"work_id":"2d59c7be-b2aa-4c0b-a0b4-a6c33dd7ee05","year":2026},"citing_paper":{"arxiv_id":"2605.07492","last_updated":"2026-05-08T09:30:31Z","snapshot_observed_at":"2026-07-06T23:19:51.414344Z","submitted_at":"2026-05-08T09:30:31Z","title":"How Far Is Document Parsing from Solved? PureDocBench: A Source-TraceableBenchmark across Clean, Degraded, and Real-World Settings","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-11T02:28:02.152600Z"},"links":{"citing_paper":"/paper/2605.07492"},"observation_digest":"sha256:8e183176df35ccd83df58eebb6cd6e2eecda55ac2d56c98fe26a58b25c25194f","observation_id":"4efac8ca-ad56-4842-a6d7-b3b0d63fd52b","resolution":{"observed_at":"2026-05-11T03:30:56.198693Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.01840","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T10:19:46.941324Z","title":"Firered-ocr technical report","venue":null,"work_id":"36c46655-2f26-436d-a19c-295616f0ae96","year":2026},"citing_paper":{"arxiv_id":"2605.07492","last_updated":"2026-05-08T09:30:31Z","snapshot_observed_at":"2026-07-06T23:19:51.414344Z","submitted_at":"2026-05-08T09:30:31Z","title":"How Far Is Document Parsing from Solved? PureDocBench: A Source-TraceableBenchmark across Clean, Degraded, and Real-World Settings","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-11T02:28:02.152600Z"},"links":{"citing_paper":"/paper/2605.07492"},"observation_digest":"sha256:dcbb7c4bb621b0974f669975fdf9218b05383d20c89b7525aaa02da442e3ef0d","observation_id":"9f7ed9e7-6b36-4aec-b1cd-18c835765f6d","resolution":{"observed_at":"2026-05-11T03:30:56.365081Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2511.19575","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T17:07:25.779583Z","title":"Hunyuanocr technical report","venue":null,"work_id":"2380b8a5-8713-4b4a-8922-7b1baf35db89","year":2025},"citing_paper":{"arxiv_id":"2605.07492","last_updated":"2026-05-08T09:30:31Z","snapshot_observed_at":"2026-07-06T23:19:51.414344Z","submitted_at":"2026-05-08T09:30:31Z","title":"How Far Is Document Parsing from Solved? PureDocBench: A Source-TraceableBenchmark across Clean, Degraded, and Real-World Settings","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-11T02:28:02.152600Z"},"links":{"citing_paper":"/paper/2605.07492"},"observation_digest":"sha256:d2dccd13d17e66cc1d5bb95d354007cc74e38179f68ecb6d6941c78f33cb87b2","observation_id":"30b73253-bc3c-4ca2-bfc4-6401446a8652","resolution":{"observed_at":"2026-05-11T03:30:56.289559Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2510.18234","last_updated":"2025-10-21T02:41:44Z","snapshot_observed_at":"2026-07-06T22:33:39.148066Z","submitted_at":"2025-10-21T02:41:44Z","title":"DeepSeek-OCR: Contexts Optical Compression","version":1},"cited_work":{"arxiv_id":"2510.18234","doi":"10.48550/arxiv.2510.18234","metadata_source":"pith","pith_arxiv_id":"2510.18234","snapshot_observed_at":"2026-07-10T17:07:25.735032Z","title":"DeepSeek-OCR: Contexts Optical Compression","venue":"cs.CV","work_id":"e85551be-f243-4764-886f-76a8813ccbb8","year":2025},"citing_paper":{"arxiv_id":"2605.07492","last_updated":"2026-05-08T09:30:31Z","snapshot_observed_at":"2026-07-06T23:19:51.414344Z","submitted_at":"2026-05-08T09:30:31Z","title":"How Far Is Document Parsing from Solved? PureDocBench: A Source-TraceableBenchmark across Clean, Degraded, and Real-World Settings","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-11T02:28:02.152600Z"},"links":{"cited_paper":"/paper/2510.18234","citing_paper":"/paper/2605.07492"},"observation_digest":"sha256:8d34a23c43df44f85228818b3a26879b61917d9b086961aedfe42015320027fc","observation_id":"a6b44266-5eaf-4fd6-93d6-8362c8afdf3d","resolution":{"observed_at":"2026-05-12T04:35:50.904687Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2601.20552","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T17:07:25.727485Z","title":"Deepseek-ocr 2: Visual causal flow","venue":null,"work_id":"9886dce9-776e-4ad6-b96c-fbf9037ca41c","year":2026},"citing_paper":{"arxiv_id":"2605.07492","last_updated":"2026-05-08T09:30:31Z","snapshot_observed_at":"2026-07-06T23:19:51.414344Z","submitted_at":"2026-05-08T09:30:31Z","title":"How Far Is Document Parsing from Solved? PureDocBench: A Source-TraceableBenchmark across Clean, Degraded, and Real-World Settings","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-11T02:28:02.152600Z"},"links":{"citing_paper":"/paper/2605.07492"},"observation_digest":"sha256:50dff4257a285e9598ad3a0e03770dd5e04f1d01f76baf65c0437de7de8a0659","observation_id":"f81da1d8-4356-4960-96fd-c354b4272d2f","resolution":{"observed_at":"2026-05-11T03:30:56.149544Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.21631","last_updated":"2025-11-27T12:16:54Z","snapshot_observed_at":"2026-07-06T22:37:03.716474Z","submitted_at":"2025-11-26T17:59:08Z","title":"Qwen3-VL Technical Report","version":2},"cited_work":{"arxiv_id":"2511.21631","doi":"10.1016/j.neunet.2025.107777","metadata_source":"pith","pith_arxiv_id":"2511.21631","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Qwen3-VL Technical Report","venue":"cs.CV","work_id":"1fe243aa-e3c0-4da6-b391-4cbcfc88d5c0","year":2025},"citing_paper":{"arxiv_id":"2605.07492","last_updated":"2026-05-08T09:30:31Z","snapshot_observed_at":"2026-07-06T23:19:51.414344Z","submitted_at":"2026-05-08T09:30:31Z","title":"How Far Is Document Parsing from Solved? PureDocBench: A Source-TraceableBenchmark across Clean, Degraded, and Real-World Settings","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-11T02:28:02.152600Z"},"links":{"cited_paper":"/paper/2511.21631","citing_paper":"/paper/2605.07492"},"observation_digest":"sha256:369ba2a8faaf61305cce8a078b1871592241b1193f0d4ca02043cd6881ac92ae","observation_id":"5e168126-d970-4529-8df7-35e33f8607b0","resolution":{"observed_at":"2026-05-11T03:30:56.219664Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Gemini 3.1 Pro: A smarter model for your most complex tasks","venue":null,"work_id":"1f786550-5352-4d4c-8ea8-66fbe1931d29","year":2026},"citing_paper":{"arxiv_id":"2605.07492","last_updated":"2026-05-08T09:30:31Z","snapshot_observed_at":"2026-07-06T23:19:51.414344Z","submitted_at":"2026-05-08T09:30:31Z","title":"How Far Is Document Parsing from Solved? PureDocBench: A Source-TraceableBenchmark across Clean, Degraded, and Real-World Settings","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-11T02:28:02.152600Z"},"links":{"citing_paper":"/paper/2605.07492"},"observation_digest":"sha256:ae492ca2d1ad9ac546b78f72e597a574842523b99df3f484214884df0480df68","observation_id":"a25ac0d8-fbff-4aa2-aab1-e1e07399c5c4","resolution":{"observed_at":"2026-05-14T12:35:15.359883Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"OmniDocBench: Benchmarking diverse PDF document parsing with comprehensive annotations","venue":null,"work_id":"8943d573-e622-42e1-9bb4-eec7eda9ce27","year":2025},"citing_paper":{"arxiv_id":"2605.07492","last_updated":"2026-05-08T09:30:31Z","snapshot_observed_at":"2026-07-06T23:19:51.414344Z","submitted_at":"2026-05-08T09:30:31Z","title":"How Far Is Document Parsing from Solved? PureDocBench: A Source-TraceableBenchmark across Clean, Degraded, and Real-World Settings","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-11T02:28:02.152600Z"},"links":{"citing_paper":"/paper/2605.07492"},"observation_digest":"sha256:c12f5c533abc79d24911b3673a8d70126ab0448852fecf0466dd26fd545b81e3","observation_id":"a1e6547e-4df3-421e-9f5c-95b5e4d2a193","resolution":{"observed_at":"2026-05-14T12:35:15.351589Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2511.18434","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-01T15:05:48.228360Z","title":"Docptbench: Benchmarking end-to-end photographed document parsing and translation","venue":null,"work_id":"ede9afd1-b00e-4d9a-bdd9-de71920a9713","year":2025},"citing_paper":{"arxiv_id":"2605.07492","last_updated":"2026-05-08T09:30:31Z","snapshot_observed_at":"2026-07-06T23:19:51.414344Z","submitted_at":"2026-05-08T09:30:31Z","title":"How Far Is Document Parsing from Solved? PureDocBench: A Source-TraceableBenchmark across Clean, Degraded, and Real-World Settings","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-11T02:28:02.152600Z"},"links":{"citing_paper":"/paper/2605.07492"},"observation_digest":"sha256:ce053ade214e625ca5f76c38881a743b722b167ed7f0c011acd685c0fd616d2e","observation_id":"62e03f24-5ff4-414e-9b5f-9b6598109f95","resolution":{"observed_at":"2026-05-11T03:30:56.260483Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2603.04205","last_updated":"2026-06-22T03:43:39Z","snapshot_observed_at":"2026-07-06T22:47:50.848191Z","submitted_at":"2026-03-04T15:49:06Z","title":"Real5-OmniDocBench: A Full-Scale Physical Reconstruction Benchmark for Robust Document Parsing in the Wild","version":2},"cited_work":{"arxiv_id":"2603.04205","doi":null,"metadata_source":"pith","pith_arxiv_id":"2603.04205","snapshot_observed_at":"2026-07-04T09:59:45.207846Z","title":"Real5-omnidocbench: A full-scale physical reconstruction benchmark for robust document parsing in the wild","venue":"cs.CV","work_id":"ee457333-fa96-4fab-8f5e-584954133d16","year":2026},"citing_paper":{"arxiv_id":"2605.07492","last_updated":"2026-05-08T09:30:31Z","snapshot_observed_at":"2026-07-06T23:19:51.414344Z","submitted_at":"2026-05-08T09:30:31Z","title":"How Far Is Document Parsing from Solved? PureDocBench: A Source-TraceableBenchmark across Clean, Degraded, and Real-World Settings","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-11T02:28:02.152600Z"},"links":{"cited_paper":"/paper/2603.04205","citing_paper":"/paper/2605.07492"},"observation_digest":"sha256:8ceb5ba7d3892b18c01ddfb0a2e7bc7ec4d404d47d6a52b260e9f1494e85e03c","observation_id":"d64133a3-f5d7-4466-83b5-010346d52656","resolution":{"observed_at":"2026-06-23T03:13:55.135132Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.28130","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-01T15:05:48.235775Z","title":"Mdpbench: A benchmark for multilingual document parsing in real-world scenarios","venue":null,"work_id":"b95c3231-f110-4103-8ab7-5c786dfcbef7","year":2026},"citing_paper":{"arxiv_id":"2605.07492","last_updated":"2026-05-08T09:30:31Z","snapshot_observed_at":"2026-07-06T23:19:51.414344Z","submitted_at":"2026-05-08T09:30:31Z","title":"How Far Is Document Parsing from Solved? PureDocBench: A Source-TraceableBenchmark across Clean, Degraded, and Real-World Settings","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-11T02:28:02.152600Z"},"links":{"citing_paper":"/paper/2605.07492"},"observation_digest":"sha256:a19af0d6fdb339e89ca8ce3d020f7e598d488793298a0f15250780d85d0ac889","observation_id":"4c8d8ec5-d949-4ec2-b7a7-69ab781cc1df","resolution":{"observed_at":"2026-05-11T03:30:56.246602Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00321","last_updated":"2025-06-05T02:59:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-31T07:32:35Z","title":"OCRBench v2: An Improved Benchmark for Evaluating Large Multimodal Models on Visual Text Localization and Reasoning","version":2},"cited_work":{"arxiv_id":"2501.00321","doi":"10.48550/arxiv.2501.00321","metadata_source":"pith","pith_arxiv_id":"2501.00321","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"OCRBench v2: An Improved Benchmark for Evaluating Large Multimodal Models on Visual Text Localization and Reasoning","venue":"cs.CV","work_id":"58bef901-2b24-42dd-9edc-28c0b2148490","year":2024},"citing_paper":{"arxiv_id":"2605.07492","last_updated":"2026-05-08T09:30:31Z","snapshot_observed_at":"2026-07-06T23:19:51.414344Z","submitted_at":"2026-05-08T09:30:31Z","title":"How Far Is Document Parsing from Solved? PureDocBench: A Source-TraceableBenchmark across Clean, Degraded, and Real-World Settings","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-11T02:28:02.152600Z"},"links":{"cited_paper":"/paper/2501.00321","citing_paper":"/paper/2605.07492"},"observation_digest":"sha256:6b9291a79a3cfe001f6225c0cfbdcd5bf6a151527d5901a0dba69c82ca970ec8","observation_id":"1d3e5138-2a74-4901-b3bb-6cfb06f0d6d2","resolution":{"observed_at":"2026-05-17T20:33:27.157097Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.19817","doi":"10.48550/arxiv.2510.19817","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T17:07:25.791394Z","title":"olmOCR 2: Unit test rewards for document OCR","venue":null,"work_id":"7a5b54b8-26b0-4fe0-ba2f-39b063ae3aa7","year":2025},"citing_paper":{"arxiv_id":"2605.07492","last_updated":"2026-05-08T09:30:31Z","snapshot_observed_at":"2026-07-06T23:19:51.414344Z","submitted_at":"2026-05-08T09:30:31Z","title":"How Far Is Document Parsing from Solved? PureDocBench: A Source-TraceableBenchmark across Clean, Degraded, and Real-World Settings","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-11T02:28:02.152600Z"},"links":{"citing_paper":"/paper/2605.07492"},"observation_digest":"sha256:198564b825dd6d4c48a454d8d502dc6923261ed28aae10aa4cfebf636c144ceb","observation_id":"2911bc02-2b10-4420-a423-aa429d52e968","resolution":{"observed_at":"2026-05-11T03:30:56.267616Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.17163","last_updated":"2026-05-26T01:50:12Z","snapshot_observed_at":"2026-07-06T21:28:52.660414Z","submitted_at":"2025-05-22T15:25:14Z","title":"OCR-Reasoning Benchmark: Unveiling the True Capabilities of MLLMs in Complex Text-Rich Image Reasoning","version":2},"cited_work":{"arxiv_id":"2505.17163","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.17163","snapshot_observed_at":"2026-07-04T21:00:09.510505Z","title":"Ocr-reasoning benchmark: Unveiling the true capabilities of mllms in complex text-rich image reasoning","venue":"cs.LG","work_id":"049a1737-1d31-4d8f-9fe2-6232eb147ff8","year":2025},"citing_paper":{"arxiv_id":"2605.07492","last_updated":"2026-05-08T09:30:31Z","snapshot_observed_at":"2026-07-06T23:19:51.414344Z","submitted_at":"2026-05-08T09:30:31Z","title":"How Far Is Document Parsing from Solved? PureDocBench: A Source-TraceableBenchmark across Clean, Degraded, and Real-World Settings","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-11T02:28:02.152600Z"},"links":{"cited_paper":"/paper/2505.17163","citing_paper":"/paper/2605.07492"},"observation_digest":"sha256:ad2de4ec3825f23d05248241a0d08dc0197e1a09725aa9d7ac9261cc07d18bd1","observation_id":"fc0c7e8e-792c-48d2-89b5-6b30abd8a336","resolution":{"observed_at":"2026-05-27T02:04:28.324233Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Intelligent document processing market size, share & industry analysis","venue":null,"work_id":"273a930d-663e-43f3-b015-f01482cceb41","year":2026},"citing_paper":{"arxiv_id":"2605.07492","last_updated":"2026-05-08T09:30:31Z","snapshot_observed_at":"2026-07-06T23:19:51.414344Z","submitted_at":"2026-05-08T09:30:31Z","title":"How Far Is Document Parsing from Solved? PureDocBench: A Source-TraceableBenchmark across Clean, Degraded, and Real-World Settings","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-11T02:28:02.152600Z"},"links":{"citing_paper":"/paper/2605.07492"},"observation_digest":"sha256:2c8cb9ffc670d7bbf1f6b32dad614ac4d1e107a95c1eacf2250fee85d5395fa1","observation_id":"8624d1ea-f155-4946-bfdf-ce2d252bb684","resolution":{"observed_at":"2026-05-14T12:35:15.376310Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Intelligent document processing market size report","venue":null,"work_id":"2769dee5-0a7a-4131-8a33-c149e69c2e72","year":null},"citing_paper":{"arxiv_id":"2605.07492","last_updated":"2026-05-08T09:30:31Z","snapshot_observed_at":"2026-07-06T23:19:51.414344Z","submitted_at":"2026-05-08T09:30:31Z","title":"How Far Is Document Parsing from Solved? PureDocBench: A Source-TraceableBenchmark across Clean, Degraded, and Real-World Settings","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-11T02:28:02.152600Z"},"links":{"citing_paper":"/paper/2605.07492"},"observation_digest":"sha256:27fc6444d152b3ad99f41216ebe3255712c8efa5504071a98cbc2d2745a368e7","observation_id":"5fea1e6e-42d6-455d-ba9d-7501d45a240e","resolution":{"observed_at":"2026-05-14T12:35:15.364732Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Available at https://www.grandviewresearch.com/industry-analysis/ intelligent-document-processing-market-report","venue":null,"work_id":"1ea8d7d8-27c2-4f07-946d-1596a7f5f9cd","year":2025},"citing_paper":{"arxiv_id":"2605.07492","last_updated":"2026-05-08T09:30:31Z","snapshot_observed_at":"2026-07-06T23:19:51.414344Z","submitted_at":"2026-05-08T09:30:31Z","title":"How Far Is Document Parsing from Solved? PureDocBench: A Source-TraceableBenchmark across Clean, Degraded, and Real-World Settings","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-11T02:28:02.152600Z"},"links":{"citing_paper":"/paper/2605.07492"},"observation_digest":"sha256:9ff03785bb16b6fcb54983113d5fb12447ab84e962833f6aa38c08937cec39c1","observation_id":"ef55da91-da01-4a83-9ff6-b294195dea43","resolution":{"observed_at":"2026-05-14T12:35:15.355305Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2603.09677","last_updated":"2026-04-08T07:57:35Z","snapshot_observed_at":"2026-07-06T22:48:30.706783Z","submitted_at":"2026-03-10T13:46:32Z","title":"Logics-Parsing-Omni Technical Report","version":3},"cited_work":{"arxiv_id":"2603.09677","doi":null,"metadata_source":"pith","pith_arxiv_id":"2603.09677","snapshot_observed_at":"2026-07-02T02:46:28.830346Z","title":"Logics-Parsing-Omni Technical Report","venue":"cs.AI","work_id":"d0941660-d2e3-4e17-8736-f411349a80b7","year":2026},"citing_paper":{"arxiv_id":"2605.07492","last_updated":"2026-05-08T09:30:31Z","snapshot_observed_at":"2026-07-06T23:19:51.414344Z","submitted_at":"2026-05-08T09:30:31Z","title":"How Far Is Document Parsing from Solved? PureDocBench: A Source-TraceableBenchmark across Clean, Degraded, and Real-World Settings","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-11T02:28:02.152600Z"},"links":{"cited_paper":"/paper/2603.09677","citing_paper":"/paper/2605.07492"},"observation_digest":"sha256:6450e83879c7686927c6834326cdbd84e9e719ccfba5f14ec7b214a0009e1c64","observation_id":"24c47a1e-28f3-4673-bd76-1ac280afba45","resolution":{"observed_at":"2026-05-11T03:30:56.330792Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.03643","last_updated":"2025-03-24T13:31:05Z","snapshot_observed_at":"2026-07-06T19:11:05.273789Z","submitted_at":"2024-09-05T16:01:21Z","title":"Image Over Text: Transforming Formula Recognition Evaluation with Character Detection Matching","version":2},"cited_work":{"arxiv_id":"2409.03643","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2409.03643","snapshot_observed_at":"2026-07-04T16:39:58.547930Z","title":"Cdm: A reliable metric for fair and accurate formula recognition evaluation.arXiv preprint arXiv:2409.03643, 5(6)","venue":null,"work_id":"565847bc-72e5-446d-ad4e-a1839b7a2915","year":2024},"citing_paper":{"arxiv_id":"2605.07492","last_updated":"2026-05-08T09:30:31Z","snapshot_observed_at":"2026-07-06T23:19:51.414344Z","submitted_at":"2026-05-08T09:30:31Z","title":"How Far Is Document Parsing from Solved? PureDocBench: A Source-TraceableBenchmark across Clean, Degraded, and Real-World Settings","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-11T02:28:02.152600Z"},"links":{"cited_paper":"/paper/2409.03643","citing_paper":"/paper/2605.07492"},"observation_digest":"sha256:60a273a9823190696ec620ff3c469d77702a29a6993c6d6338f7b318b2d07698","observation_id":"3c9cfd12-d530-4c9f-b9fc-a75a5f4d6faf","resolution":{"observed_at":"2026-05-11T03:30:56.347542Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Image-based table recognition: Data, model, and evaluation","venue":null,"work_id":"3889c629-fa5c-47e9-9664-e7b2af6d9d98","year":2020},"citing_paper":{"arxiv_id":"2605.07492","last_updated":"2026-05-08T09:30:31Z","snapshot_observed_at":"2026-07-06T23:19:51.414344Z","submitted_at":"2026-05-08T09:30:31Z","title":"How Far Is Document Parsing from Solved? PureDocBench: A Source-TraceableBenchmark across Clean, Degraded, and Real-World Settings","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-11T02:28:02.152600Z"},"links":{"citing_paper":"/paper/2605.07492"},"observation_digest":"sha256:dd8757933b72e145b346fffbb196c328affb3778c88528f26ee45dac3985ea9f","observation_id":"c6dad526-19c6-4bd5-9472-772854bba3e1","resolution":{"observed_at":"2026-05-14T12:35:15.372335Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.13032","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-01T21:16:14.035094Z","title":"Multimodal ocr: Parse anything from documents","venue":null,"work_id":"83409bb9-0ee5-4da9-a750-da6424ff01f5","year":2026},"citing_paper":{"arxiv_id":"2605.07492","last_updated":"2026-05-08T09:30:31Z","snapshot_observed_at":"2026-07-06T23:19:51.414344Z","submitted_at":"2026-05-08T09:30:31Z","title":"How Far Is Document Parsing from Solved? PureDocBench: A Source-TraceableBenchmark across Clean, Degraded, and Real-World Settings","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-11T02:28:02.152600Z"},"links":{"citing_paper":"/paper/2605.07492"},"observation_digest":"sha256:3ac39619491be9cc6b0c66c8ab6a594a5a977137f89cff7efec62da1fb4ee264","observation_id":"feeb462d-2c4a-4c40-9395-32ac363fd760","resolution":{"observed_at":"2026-05-11T03:30:56.211632Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2506.05218","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T10:19:46.911382Z","title":"arXiv preprint arXiv:2506.05218 , year=","venue":null,"work_id":"e1783180-c7e4-4eda-92a0-bea7df4e8d95","year":2025},"citing_paper":{"arxiv_id":"2605.07492","last_updated":"2026-05-08T09:30:31Z","snapshot_observed_at":"2026-07-06T23:19:51.414344Z","submitted_at":"2026-05-08T09:30:31Z","title":"How Far Is Document Parsing from Solved? PureDocBench: A Source-TraceableBenchmark across Clean, Degraded, and Real-World Settings","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-11T02:28:02.152600Z"},"links":{"citing_paper":"/paper/2605.07492"},"observation_digest":"sha256:24ea80be9027ba279dae4cb5a05a4d59dd3a936e129b9e06681a15bb8e495c28","observation_id":"41bd8e22-a238-4374-8e7f-cd171a3283e7","resolution":{"observed_at":"2026-05-11T03:30:56.133284Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.20430","last_updated":"2026-07-13T14:16:50Z","snapshot_observed_at":"2026-07-16T23:19:31.998179Z","submitted_at":"2026-01-28T09:37:13Z","title":"Youtu-Parsing: Perception, Structuring and Recognition via High-Parallelism Decoding","version":2},"cited_work":{"arxiv_id":"2601.20430","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2601.20430","snapshot_observed_at":"2026-07-14T03:21:27.323268Z","title":"Youtu-parsing: Perception, structuring and recognition via high-parallelism decoding","venue":null,"work_id":"a02d784c-999f-4b21-ab04-640335260827","year":2026},"citing_paper":{"arxiv_id":"2605.07492","last_updated":"2026-05-08T09:30:31Z","snapshot_observed_at":"2026-07-06T23:19:51.414344Z","submitted_at":"2026-05-08T09:30:31Z","title":"How Far Is Document Parsing from Solved? PureDocBench: A Source-TraceableBenchmark across Clean, Degraded, and Real-World Settings","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-11T02:28:02.152600Z"},"links":{"cited_paper":"/paper/2601.20430","citing_paper":"/paper/2605.07492"},"observation_digest":"sha256:0898000a694f6172b01c4f7b12ccf0ce4993a31e8f328fa38d48352f5ecc0935","observation_id":"14021d59-1781-42f0-a013-106d9dd5b04b","resolution":{"observed_at":"2026-07-14T03:21:27.323268Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"OpenOCR: An open-source toolkit for general-OCR research and applications.https://github.com/Topdu/OpenOCR","venue":null,"work_id":"1789625f-8bc6-4c82-bb6a-e9bd6afe9945","year":2024},"citing_paper":{"arxiv_id":"2605.07492","last_updated":"2026-05-08T09:30:31Z","snapshot_observed_at":"2026-07-06T23:19:51.414344Z","submitted_at":"2026-05-08T09:30:31Z","title":"How Far Is Document Parsing from Solved? PureDocBench: A Source-TraceableBenchmark across Clean, Degraded, and Real-World Settings","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-11T02:28:02.152600Z"},"links":{"citing_paper":"/paper/2605.07492"},"observation_digest":"sha256:90e90954c4d78cf21bb79829d8de60e30a9c987b766b3e66b7e8fe2e26d46397","observation_id":"5e6f4550-87b4-4631-a790-4043543cef4d","resolution":{"observed_at":"2026-05-14T12:35:15.348110Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2502.18443","doi":"10.48550/arxiv.2502.18443","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T17:07:25.776831Z","title":"olmocr: Unlocking trillions of tokens in pdfs with vi- sion language models.arXiv preprint arXiv:2502.18443, 2025a","venue":null,"work_id":"bb9c92f3-5210-40cf-b3d5-7463913e3248","year":2025},"citing_paper":{"arxiv_id":"2605.07492","last_updated":"2026-05-08T09:30:31Z","snapshot_observed_at":"2026-07-06T23:19:51.414344Z","submitted_at":"2026-05-08T09:30:31Z","title":"How Far Is Document Parsing from Solved? PureDocBench: A Source-TraceableBenchmark across Clean, Degraded, and Real-World Settings","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-11T02:28:02.152600Z"},"links":{"citing_paper":"/paper/2605.07492"},"observation_digest":"sha256:457003649079cfe7b9a6cce12fe3662d2892ff1231b33e6ce0325b4426131bd5","observation_id":"318aef4e-1967-4c54-b4b3-1c21808eca04","resolution":{"observed_at":"2026-05-11T03:30:56.194257Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2601.08834","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T17:38:44.220214Z","title":"Reading or reasoning? format decoupled reinforcement learning for document OCR","venue":null,"work_id":"c1057363-ec34-4ff4-a44e-02429e493c5b","year":2025},"citing_paper":{"arxiv_id":"2605.07492","last_updated":"2026-05-08T09:30:31Z","snapshot_observed_at":"2026-07-06T23:19:51.414344Z","submitted_at":"2026-05-08T09:30:31Z","title":"How Far Is Document Parsing from Solved? PureDocBench: A Source-TraceableBenchmark across Clean, Degraded, and Real-World Settings","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-11T02:28:02.152600Z"},"links":{"citing_paper":"/paper/2605.07492"},"observation_digest":"sha256:2a70e22d1fb036641957fa7e6bf8df04686c8a0b92cfa90271f106b13f714c9f","observation_id":"6c016336-bcbb-48f8-bd59-02cac041ec40","resolution":{"observed_at":"2026-05-11T03:30:56.359415Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Logics-Parsing-v2","venue":null,"work_id":"b370b6fc-967d-4af1-86fb-cb4031ebe615","year":2026},"citing_paper":{"arxiv_id":"2605.07492","last_updated":"2026-05-08T09:30:31Z","snapshot_observed_at":"2026-07-06T23:19:51.414344Z","submitted_at":"2026-05-08T09:30:31Z","title":"How Far Is Document Parsing from Solved? PureDocBench: A Source-TraceableBenchmark across Clean, Degraded, and Real-World Settings","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-11T02:28:02.152600Z"},"links":{"citing_paper":"/paper/2605.07492"},"observation_digest":"sha256:70ff69369e91117b88872f21e7a9a158f79ca225bc62e78f584b0d4965875a05","observation_id":"00f04f2a-7e52-4a1a-8b2c-71ab4ec42ab8","resolution":{"observed_at":"2026-05-14T12:35:15.368414Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2601.21639","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-02T02:46:28.850593Z","title":"Ocrverse: Towards holistic ocr in end-to-end vision-language models","venue":null,"work_id":"882cec55-a48e-435e-aaec-5dd371cee961","year":2026},"citing_paper":{"arxiv_id":"2605.07492","last_updated":"2026-05-08T09:30:31Z","snapshot_observed_at":"2026-07-06T23:19:51.414344Z","submitted_at":"2026-05-08T09:30:31Z","title":"How Far Is Document Parsing from Solved? PureDocBench: A Source-TraceableBenchmark across Clean, Degraded, and Real-World Settings","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-11T02:28:02.152600Z"},"links":{"citing_paper":"/paper/2605.07492"},"observation_digest":"sha256:fa56e79b9dff72d39e5b665dddd1ca9d86c2f948fc7b2678e9db132110fe16bf","observation_id":"9d962b7f-3615-40ec-bc5c-863443dabd5e","resolution":{"observed_at":"2026-05-11T03:30:56.308055Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.13398","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T10:19:46.900869Z","title":"Qianfan-ocr: A unified end-to-end model for document intelligence","venue":null,"work_id":"daabfed7-5204-4653-861d-2becb02cd711","year":2026},"citing_paper":{"arxiv_id":"2605.07492","last_updated":"2026-05-08T09:30:31Z","snapshot_observed_at":"2026-07-06T23:19:51.414344Z","submitted_at":"2026-05-08T09:30:31Z","title":"How Far Is Document Parsing from Solved? PureDocBench: A Source-TraceableBenchmark across Clean, Degraded, and Real-World Settings","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-11T02:28:02.152600Z"},"links":{"citing_paper":"/paper/2605.07492"},"observation_digest":"sha256:d03f198fceba4a8b38a09982a3f4e9bd06a08c9aa80121e15da6ce43acae2bb6","observation_id":"6fd7350e-5bb2-471d-b504-2d926db6bc63","resolution":{"observed_at":"2026-05-11T03:30:56.251996Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Nanonets-OCR2: A model for transforming documents into structured markdown with in- telligent content recognition and semantic tagging","venue":null,"work_id":"bdfcda47-3d92-4a59-b76c-a1f9ce7f72ee","year":2025},"citing_paper":{"arxiv_id":"2605.07492","last_updated":"2026-05-08T09:30:31Z","snapshot_observed_at":"2026-07-06T23:19:51.414344Z","submitted_at":"2026-05-08T09:30:31Z","title":"How Far Is Document Parsing from Solved? PureDocBench: A Source-TraceableBenchmark across Clean, Degraded, and Real-World Settings","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-11T02:28:02.152600Z"},"links":{"citing_paper":"/paper/2605.07492"},"observation_digest":"sha256:5f44ae5f34ecb3461672616e48ce7fc7392ffd416659992547210ff4ea0055f7","observation_id":"ddf9e310-2b83-404e-8a26-4861dd021403","resolution":{"observed_at":"2026-05-14T12:35:15.384016Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"OCRFlux-3B","venue":null,"work_id":"431f8082-b5d6-4279-9b93-cea9d9a2ead9","year":2025},"citing_paper":{"arxiv_id":"2605.07492","last_updated":"2026-05-08T09:30:31Z","snapshot_observed_at":"2026-07-06T23:19:51.414344Z","submitted_at":"2026-05-08T09:30:31Z","title":"How Far Is Document Parsing from Solved? PureDocBench: A Source-TraceableBenchmark across Clean, Degraded, and Real-World Settings","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-11T02:28:02.152600Z"},"links":{"citing_paper":"/paper/2605.07492"},"observation_digest":"sha256:fa28db13eb7ee66b7f8a982997613d001c4f9ebba9b604e9a77d2892e316dd0a","observation_id":"e63484da-aff1-48dd-9816-a6589f70861a","resolution":{"observed_at":"2026-05-14T12:35:15.380264Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2512.02498","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T09:59:45.152724Z","title":"InICASSP 2023-2023 IEEE International Conference on Acoustics, Speech and Signal Processing (ICASSP), pages 1–5","venue":null,"work_id":"cb5539a0-6843-4702-bbf3-dfe7b61e5cbb","year":2025},"citing_paper":{"arxiv_id":"2605.07492","last_updated":"2026-05-08T09:30:31Z","snapshot_observed_at":"2026-07-06T23:19:51.414344Z","submitted_at":"2026-05-08T09:30:31Z","title":"How Far Is Document Parsing from Solved? PureDocBench: A Source-TraceableBenchmark across Clean, Degraded, and Real-World Settings","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-11T02:28:02.152600Z"},"links":{"citing_paper":"/paper/2605.07492"},"observation_digest":"sha256:00e65718c05934b6a3710a13e358101a3b9f9e6b3863b8be1c2ee1d15ac05250","observation_id":"eed8e37b-7086-44cb-a30b-fed136d5500e","resolution":{"observed_at":"2026-05-11T03:30:56.231839Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.21095","last_updated":"2026-07-11T09:04:48Z","snapshot_observed_at":"2026-07-16T23:17:45.279644Z","submitted_at":"2025-12-24T10:35:21Z","title":"UniRec-0.1B: Unified Text and Formula Recognition with 0.1B Parameters","version":2},"cited_work":{"arxiv_id":"2512.21095","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2512.21095","snapshot_observed_at":"2026-07-14T02:19:24.298662Z","title":"Unirec-0.1 b: Unified text and formula recognition with 0.1 b parameters","venue":null,"work_id":"e78d8a84-1d7c-4dc7-b8cc-2fa3a68d5d87","year":2025},"citing_paper":{"arxiv_id":"2605.07492","last_updated":"2026-05-08T09:30:31Z","snapshot_observed_at":"2026-07-06T23:19:51.414344Z","submitted_at":"2026-05-08T09:30:31Z","title":"How Far Is Document Parsing from Solved? PureDocBench: A Source-TraceableBenchmark across Clean, Degraded, and Real-World Settings","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-11T02:28:02.152600Z"},"links":{"cited_paper":"/paper/2512.21095","citing_paper":"/paper/2605.07492"},"observation_digest":"sha256:fe8ca194907427d53634e6340227944843e7436b0d9a3c0a5c365d0d55c856b7","observation_id":"9f7ff89d-acc1-4b56-9e1b-86e449ca2ce4","resolution":{"observed_at":"2026-07-14T02:19:24.298662Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"OpenDoc-0.1B: An ultra-lightweight document parsing system","venue":null,"work_id":"73683a78-414d-426e-83e4-ac1c6b898979","year":2025},"citing_paper":{"arxiv_id":"2605.07492","last_updated":"2026-05-08T09:30:31Z","snapshot_observed_at":"2026-07-06T23:19:51.414344Z","submitted_at":"2026-05-08T09:30:31Z","title":"How Far Is Document Parsing from Solved? PureDocBench: A Source-TraceableBenchmark across Clean, Degraded, and Real-World Settings","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-11T02:28:02.152600Z"},"links":{"citing_paper":"/paper/2605.07492"},"observation_digest":"sha256:3d1dbd3399296672a3aa5b8b677a38f718c91693988814aafd756cb48cf775a2","observation_id":"358bf655-c781-436c-a59c-b4f6c6de554b","resolution":{"observed_at":"2026-05-14T12:35:15.340341Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Qwen3.5: Towards native multimodal agents","venue":null,"work_id":"a34c44fb-8ba9-4d41-8e66-8e26b29f4cee","year":2026},"citing_paper":{"arxiv_id":"2605.07492","last_updated":"2026-05-08T09:30:31Z","snapshot_observed_at":"2026-07-06T23:19:51.414344Z","submitted_at":"2026-05-08T09:30:31Z","title":"How Far Is Document Parsing from Solved? PureDocBench: A Source-TraceableBenchmark across Clean, Degraded, and Real-World Settings","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-11T02:28:02.152600Z"},"links":{"citing_paper":"/paper/2605.07492"},"observation_digest":"sha256:65eecba3f826e4e59994920b42e1b8a8f597c6fdc4cf3f49c9736313e3e66d7a","observation_id":"011f0929-0c2e-4ee3-b846-12ffd194f6f0","resolution":{"observed_at":"2026-05-14T12:35:15.336618Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Kimi K2.6","venue":null,"work_id":"dbd52c9f-0319-4e18-a00c-b7b0e9eb068a","year":2026},"citing_paper":{"arxiv_id":"2605.07492","last_updated":"2026-05-08T09:30:31Z","snapshot_observed_at":"2026-07-06T23:19:51.414344Z","submitted_at":"2026-05-08T09:30:31Z","title":"How Far Is Document Parsing from Solved? PureDocBench: A Source-TraceableBenchmark across Clean, Degraded, and Real-World Settings","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-11T02:28:02.152600Z"},"links":{"citing_paper":"/paper/2605.07492"},"observation_digest":"sha256:56ef4b0424bd291acb8692b373bea89e2def4cb9057ab6262b94cebd7d1902cd","observation_id":"3589de6a-18c5-4e68-a810-0cf0e02b69d6","resolution":{"observed_at":"2026-05-14T12:35:15.343982Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2601.09668","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T06:34:41.894993Z","title":"Step3-vl-10b technical report","venue":null,"work_id":"b7059382-9467-45e4-b9f6-a83382eaeba4","year":2026},"citing_paper":{"arxiv_id":"2605.07492","last_updated":"2026-05-08T09:30:31Z","snapshot_observed_at":"2026-07-06T23:19:51.414344Z","submitted_at":"2026-05-08T09:30:31Z","title":"How Far Is Document Parsing from Solved? PureDocBench: A Source-TraceableBenchmark across Clean, Degraded, and Real-World Settings","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-11T02:28:02.152600Z"},"links":{"citing_paper":"/paper/2605.07492"},"observation_digest":"sha256:dce6b41be8ef7058544463f06561ab3efa83a354ee992e4d6e52e169544770c5","observation_id":"fb3cb0b8-2f8b-4917-8408-94555c27614b","resolution":{"observed_at":"2026-05-11T03:30:56.239823Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.18154","last_updated":"2025-09-16T19:41:48Z","snapshot_observed_at":"2026-07-06T22:30:31.933240Z","submitted_at":"2025-09-16T19:41:48Z","title":"MiniCPM-V 4.5: Cooking Efficient MLLMs via Architecture, Data, and Training Recipe","version":1},"cited_work":{"arxiv_id":"2509.18154","doi":"10.48550/arxiv.2509.18154","metadata_source":"pith","pith_arxiv_id":"2509.18154","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"MiniCPM-V 4.5: Cooking Efficient MLLMs via Architecture, Data, and Training Recipe","venue":"cs.LG","work_id":"21d4b019-63d0-49e5-b51b-350ef4783709","year":2025},"citing_paper":{"arxiv_id":"2605.07492","last_updated":"2026-05-08T09:30:31Z","snapshot_observed_at":"2026-07-06T23:19:51.414344Z","submitted_at":"2026-05-08T09:30:31Z","title":"How Far Is Document Parsing from Solved? PureDocBench: A Source-TraceableBenchmark across Clean, Degraded, and Real-World Settings","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-11T02:28:02.152600Z"},"links":{"cited_paper":"/paper/2509.18154","citing_paper":"/paper/2605.07492"},"observation_digest":"sha256:659c777cf6ffac2a5d790f6161dc81f30ef85ef4c87cd50757cb5ef236381296","observation_id":"f2975afc-c8b6-421d-8aff-321d413f206e","resolution":{"observed_at":"2026-05-15T17:07:27.685083Z","resolver_source":"arxiv_id","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-05-25T00:53:18.923957+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-25T00:53:18.923957+00:00","source":"openalex_status_cache"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2605.07492","last_updated":"2026-05-08T09:30:31Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-07-06T23:19:51.414344Z","submitted_at":"2026-05-08T09:30:31Z","title":"How Far Is Document Parsing from Solved? PureDocBench: A Source-TraceableBenchmark across Clean, Degraded, and Real-World Settings"},"reference_resolution":{"displayed":43,"state_counts":{"malformed_identifier":1,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":0,"verified_exact":28,"verified_fuzzy":13},"total_outbound_references":43},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"thesis":"As of 31 July 2026, this Paper Citation Record lists 43 of 43 outbound references and 0 inbound Pith citation observations for arXiv:2605.07492."}