{"as_of":"2026-08-21T07:39:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:12548683c3872500e78b3f0a0bc3e651e5c0f52a6cd1e952fa280df541cb1d8c","coverage":[{"denominator":53,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":53,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T04:40:07.276016Z","state":"measured"},{"denominator":54,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":54,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-21T06:32:19.484+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T21:04:30.112023Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-15T21:04:30.892547Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2607.13639","last_updated":"2026-07-15T09:32:33Z","snapshot_observed_at":"2026-08-20T14:12:11.072339Z","submitted_at":"2026-07-15T09:32:33Z","title":"OvisOCR2 Technical Report","version":1},"cited_work":{"arxiv_id":"2607.13639","doi":null,"metadata_source":"pith","pith_arxiv_id":"2607.13639","snapshot_observed_at":"2026-08-15T21:04:30.892547Z","title":"OvisOCR2 Technical Report","venue":"cs.CV","work_id":"000d68a4-b751-40bd-9c9a-c8103b32949d","year":2026},"citing_paper":{"arxiv_id":"2608.12898","last_updated":"2026-08-18T06:14:21Z","snapshot_observed_at":"2026-08-21T07:10:55.676736Z","submitted_at":"2026-08-13T07:34:21Z","title":"NaviDC-OCR: Navigating Document Parsing Across Digital and Camera-Captured Documents","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-15T21:04:30.112023Z"},"links":{"cited_paper":"/paper/2607.13639","citing_paper":"/paper/2608.12898"},"observation_digest":"sha256:f6cf79e87ca5acc50fb771405af2b19daa20686592efeb19611db88b9a28ed2c","observation_id":"d9fd1a58-12db-42cd-9077-a4924ef5a80a","resolution":{"observed_at":"2026-08-15T21:04:30.897654Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2607.13639/citation-record","integrity":"/paper/2607.13639/integrity","json":"/paper/2607.13639/citation-record.json","paper":"/paper/2607.13639"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:40:01.259977Z","title":"OmniDocBench: Benchmarking diverse PDF document parsing with comprehensive annotations","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13639","last_updated":"2026-07-15T09:32:33Z","snapshot_observed_at":"2026-08-20T14:12:11.072339Z","submitted_at":"2026-07-15T09:32:33Z","title":"OvisOCR2 Technical Report","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-02T04:40:01.259977Z"},"links":{"citing_paper":"/paper/2607.13639"},"observation_digest":"sha256:28a9e5b6665f367d61b34ae3d03b86272166f43c3b96d7ba557277a25927a732","observation_id":"a601b3fb-4a16-47c1-a3db-41e0e7da2bda","resolution":{"observed_at":"2026-08-02T04:40:01.259977Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.07492","last_updated":"2026-05-08T09:30:31Z","snapshot_observed_at":"2026-08-10T21:40:06.999198Z","submitted_at":"2026-05-08T09:30:31Z","title":"How Far Is Document Parsing from Solved? PureDocBench: A Source-TraceableBenchmark across Clean, Degraded, and Real-World Settings","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.07492","snapshot_observed_at":"2026-08-02T04:40:01.433462Z","title":"How far is document parsing from solved? PureDocBench: A source-traceable benchmark across clean, degraded, and real-world settings.arXiv preprint arXiv:2605.07492, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.13639","last_updated":"2026-07-15T09:32:33Z","snapshot_observed_at":"2026-08-20T14:12:11.072339Z","submitted_at":"2026-07-15T09:32:33Z","title":"OvisOCR2 Technical Report","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-02T04:40:01.433462Z"},"links":{"cited_paper":"/paper/2605.07492","citing_paper":"/paper/2607.13639"},"observation_digest":"sha256:6e3bad002d26e3e633799530be043ff08c094edbd290fe152b5b67e59c8fd7f2","observation_id":"342ac919-ed8a-48c5-8684-8183f6ef5aff","resolution":{"observed_at":"2026-08-02T04:40:01.433462Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.03264","last_updated":"2026-06-02T07:27:03Z","snapshot_observed_at":"2026-08-16T07:12:09.561259Z","submitted_at":"2026-06-02T07:27:03Z","title":"PaddleOCR-VL-1.6: Expanding the Frontier of Document Parsing with Under-Optimized Region Refinement and Progressive Post-Training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.03264","snapshot_observed_at":"2026-08-02T04:40:01.558740Z","title":"PaddleOCR-VL-1.6: Expanding the frontier of document parsing with under-optimized region refinement and progressive post-training.arXiv preprint arXiv:2606.03264, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.13639","last_updated":"2026-07-15T09:32:33Z","snapshot_observed_at":"2026-08-20T14:12:11.072339Z","submitted_at":"2026-07-15T09:32:33Z","title":"OvisOCR2 Technical Report","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-02T04:40:01.558740Z"},"links":{"cited_paper":"/paper/2606.03264","citing_paper":"/paper/2607.13639"},"observation_digest":"sha256:44c7525fe8cd4726cff2642806e3e754d24410f73eeeb07b5496223a8bac824c","observation_id":"561d56b7-659a-4b49-9a46-dfa2faf8daea","resolution":{"observed_at":"2026-08-02T04:40:01.558740Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:40:01.734149Z","title":"MinerU2.5: A decoupled vision-language model for efficient high-resolution document parsing","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.13639","last_updated":"2026-07-15T09:32:33Z","snapshot_observed_at":"2026-08-20T14:12:11.072339Z","submitted_at":"2026-07-15T09:32:33Z","title":"OvisOCR2 Technical Report","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-02T04:40:01.734149Z"},"links":{"citing_paper":"/paper/2607.13639"},"observation_digest":"sha256:b1f9d1e1ddba2abaf29862e6ae577e0ae74a7a2571c217cd38ec44526e993645","observation_id":"1c70908e-5519-4314-8101-32f3acdb3f36","resolution":{"observed_at":"2026-08-02T04:40:01.734149Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:40:01.896669Z","title":"GLM-OCR technical report.arXiv preprint arXiv:2603.10910, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.13639","last_updated":"2026-07-15T09:32:33Z","snapshot_observed_at":"2026-08-20T14:12:11.072339Z","submitted_at":"2026-07-15T09:32:33Z","title":"OvisOCR2 Technical Report","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-02T04:40:01.896669Z"},"links":{"citing_paper":"/paper/2607.13639"},"observation_digest":"sha256:d79d1ff61a76a88be033eb3a636160104da2bdbc277a38fb9bc28df7e48fe5ae","observation_id":"fecbc486-1339-429d-ad8e-1e0aca303b73","resolution":{"observed_at":"2026-08-02T04:40:01.896669Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.04771","last_updated":"2026-04-09T09:16:34Z","snapshot_observed_at":"2026-08-12T11:17:57.847430Z","submitted_at":"2026-04-06T15:44:18Z","title":"MinerU2.5-Pro: Pushing the Limits of Data-Centric Document Parsing at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.04771","snapshot_observed_at":"2026-08-02T04:40:02.010695Z","title":"MinerU2.5-Pro: Pushing the limits of data-centric document parsing at scale.arXiv preprint arXiv:2604.04771, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.13639","last_updated":"2026-07-15T09:32:33Z","snapshot_observed_at":"2026-08-20T14:12:11.072339Z","submitted_at":"2026-07-15T09:32:33Z","title":"OvisOCR2 Technical Report","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-02T04:40:02.010695Z"},"links":{"cited_paper":"/paper/2604.04771","citing_paper":"/paper/2607.13639"},"observation_digest":"sha256:525c5b063c873c49f27a55fbee6e57e902039bccb940f1a03d18669cca372969","observation_id":"0edfedcf-0652-405e-ab59-c633a6c43a0f","resolution":{"observed_at":"2026-08-02T04:40:02.010695Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:40:02.123125Z","title":"OmniDocBench public leaderboard","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.13639","last_updated":"2026-07-15T09:32:33Z","snapshot_observed_at":"2026-08-20T14:12:11.072339Z","submitted_at":"2026-07-15T09:32:33Z","title":"OvisOCR2 Technical Report","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-02T04:40:02.123125Z"},"links":{"citing_paper":"/paper/2607.13639"},"observation_digest":"sha256:f51d895faed4f50d3ad76b26e16116bf75eb84ed1206b6eb97e73f8e5ebc9f27","observation_id":"77a061e0-16cb-45fc-a999-06746ea3692d","resolution":{"observed_at":"2026-08-02T04:40:02.123125Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2607.04884","last_updated":"2026-08-06T10:55:17Z","snapshot_observed_at":"2026-08-19T06:07:12.300490Z","submitted_at":"2026-07-06T10:06:05Z","title":"HunyuanOCR-1.5: Making Lightweight OCR VLMs Faster and Better","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2607.04884","snapshot_observed_at":"2026-08-02T04:40:02.221409Z","title":"HunyuanOCR-1.5: Making lightweight OCR VLMs faster and better.arXiv preprint arXiv:2607.04884, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.13639","last_updated":"2026-07-15T09:32:33Z","snapshot_observed_at":"2026-08-20T14:12:11.072339Z","submitted_at":"2026-07-15T09:32:33Z","title":"OvisOCR2 Technical Report","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-02T04:40:02.221409Z"},"links":{"cited_paper":"/paper/2607.04884","citing_paper":"/paper/2607.13639"},"observation_digest":"sha256:f648b10978501d32cfa1f03551b21e500da2d99ebe1217e6b6330fc4d3c12869","observation_id":"9cb51a65-45cf-4769-9420-086fa4d67eb4","resolution":{"observed_at":"2026-08-02T04:40:02.221409Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.23050","last_updated":"2026-06-22T09:01:29Z","snapshot_observed_at":"2026-08-13T17:57:13.876850Z","submitted_at":"2026-06-22T09:01:29Z","title":"Unlimited OCR Works","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.23050","snapshot_observed_at":"2026-08-02T04:40:02.330789Z","title":"Unlimited OCR works.arXiv preprint arXiv:2606.23050, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.13639","last_updated":"2026-07-15T09:32:33Z","snapshot_observed_at":"2026-08-20T14:12:11.072339Z","submitted_at":"2026-07-15T09:32:33Z","title":"OvisOCR2 Technical Report","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-02T04:40:02.330789Z"},"links":{"cited_paper":"/paper/2606.23050","citing_paper":"/paper/2607.13639"},"observation_digest":"sha256:394e49b955703b2a50bfe037aadb853b63d454688830db1a8500b2f1383f3681","observation_id":"7593d479-f94b-48ec-8988-8284cee30d9b","resolution":{"observed_at":"2026-08-02T04:40:02.330789Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:40:02.464627Z","title":"OvisOCR: End-to-end document parsing via aligning specialized perception with general reasoning","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.13639","last_updated":"2026-07-15T09:32:33Z","snapshot_observed_at":"2026-08-20T14:12:11.072339Z","submitted_at":"2026-07-15T09:32:33Z","title":"OvisOCR2 Technical Report","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-02T04:40:02.464627Z"},"links":{"citing_paper":"/paper/2607.13639"},"observation_digest":"sha256:e7d1cda696353e6d09fb1baf194e096030a3f86fec65d163589e6acb785ef02e","observation_id":"858832ca-3502-4c2c-9b30-0a015bc9b0d6","resolution":{"observed_at":"2026-08-02T04:40:02.464627Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:40:02.618627Z","title":"Qwen3.5: Towards native multimodal agents","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.13639","last_updated":"2026-07-15T09:32:33Z","snapshot_observed_at":"2026-08-20T14:12:11.072339Z","submitted_at":"2026-07-15T09:32:33Z","title":"OvisOCR2 Technical Report","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-02T04:40:02.618627Z"},"links":{"citing_paper":"/paper/2607.13639"},"observation_digest":"sha256:aca2783d4bd3809db2025a2987d6f3f7d24f0b399384ef33a6fc3e2564a6b621","observation_id":"ba14643c-53d9-40ad-b957-c8acfc5d6304","resolution":{"observed_at":"2026-08-02T04:40:02.618627Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.21957","last_updated":"2026-04-03T06:49:11Z","snapshot_observed_at":"2026-08-13T13:13:25.351259Z","submitted_at":"2026-01-29T16:35:04Z","title":"PaddleOCR-VL-1.5: Towards a Multi-Task 0.9B VLM for Robust In-the-Wild Document Parsing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.21957","snapshot_observed_at":"2026-08-02T04:40:02.774648Z","title":"PaddleOCR-VL-1.5: Towards a multi-task 0.9B VLM for robust in-the- wild document parsing.arXiv preprint arXiv:2601.21957, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.13639","last_updated":"2026-07-15T09:32:33Z","snapshot_observed_at":"2026-08-20T14:12:11.072339Z","submitted_at":"2026-07-15T09:32:33Z","title":"OvisOCR2 Technical Report","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-02T04:40:02.774648Z"},"links":{"cited_paper":"/paper/2601.21957","citing_paper":"/paper/2607.13639"},"observation_digest":"sha256:eb05d6d3f11cf21cda8451eb5704f5807e325eb4fcbf8db4c0f61dae9a214c09","observation_id":"0ea104eb-fecf-4cb6-a45f-072b90cd4c53","resolution":{"observed_at":"2026-08-02T04:40:02.774648Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:40:02.900278Z","title":"Playwright: Fast and reliable end-to-end testing for modern web apps","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.13639","last_updated":"2026-07-15T09:32:33Z","snapshot_observed_at":"2026-08-20T14:12:11.072339Z","submitted_at":"2026-07-15T09:32:33Z","title":"OvisOCR2 Technical Report","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-02T04:40:02.900278Z"},"links":{"citing_paper":"/paper/2607.13639"},"observation_digest":"sha256:e1521728769c613f5da76c62311467dcb090eb6ce9335ebeb10681820d593f34","observation_id":"f8ff5d12-506c-48f1-a8dc-51d597de6758","resolution":{"observed_at":"2026-08-02T04:40:02.900278Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-02T04:40:03.001768Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.13639","last_updated":"2026-07-15T09:32:33Z","snapshot_observed_at":"2026-08-20T14:12:11.072339Z","submitted_at":"2026-07-15T09:32:33Z","title":"OvisOCR2 Technical Report","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-02T04:40:03.001768Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2607.13639"},"observation_digest":"sha256:8aa7c1be2ededf65f97a673f2a8a741ecc9107ad0cac970038f3599db8c03be0","observation_id":"a6e11d44-f663-432e-9c0a-d75b0d536d3d","resolution":{"observed_at":"2026-08-02T04:40:03.001768Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:40:03.067995Z","title":"Image over text: Transforming formula recognition evaluation with character detection matching","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13639","last_updated":"2026-07-15T09:32:33Z","snapshot_observed_at":"2026-08-20T14:12:11.072339Z","submitted_at":"2026-07-15T09:32:33Z","title":"OvisOCR2 Technical Report","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-02T04:40:03.067995Z"},"links":{"citing_paper":"/paper/2607.13639"},"observation_digest":"sha256:bd5dd538b8aa91f793fa13bc89c683ca78f84d1d1eb4ae5db93e8f2a5e479e95","observation_id":"ace0e5dd-05b5-4f59-9cb7-cd94be8003cb","resolution":{"observed_at":"2026-08-02T04:40:03.067995Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:40:03.115928Z","title":"Image-based table recognition: Data, model, and evaluation","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.13639","last_updated":"2026-07-15T09:32:33Z","snapshot_observed_at":"2026-08-20T14:12:11.072339Z","submitted_at":"2026-07-15T09:32:33Z","title":"OvisOCR2 Technical Report","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-02T04:40:03.115928Z"},"links":{"citing_paper":"/paper/2607.13639"},"observation_digest":"sha256:e3fe825cbab9cc759e0867016415be1905e7ea999a03bcc84f5a88b7051ceec9","observation_id":"977261d8-12af-4eee-83ab-9979444636dd","resolution":{"observed_at":"2026-08-02T04:40:03.115928Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1503.02531","last_updated":"2015-03-09T15:44:49Z","snapshot_observed_at":"2026-08-16T18:00:58.008096Z","submitted_at":"2015-03-09T15:44:49Z","title":"Distilling the Knowledge in a Neural Network","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1503.02531","snapshot_observed_at":"2026-08-02T04:40:03.183618Z","title":"Distilling the knowledge in a neural network","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2607.13639","last_updated":"2026-07-15T09:32:33Z","snapshot_observed_at":"2026-08-20T14:12:11.072339Z","submitted_at":"2026-07-15T09:32:33Z","title":"OvisOCR2 Technical Report","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-02T04:40:03.183618Z"},"links":{"cited_paper":"/paper/1503.02531","citing_paper":"/paper/2607.13639"},"observation_digest":"sha256:11c7d90ee0173590041efa4a3d64e37e08c30d7eacefbe0f5ebfd7ea23e648b1","observation_id":"0ad0383f-6286-4056-94de-c93cbd1709cf","resolution":{"observed_at":"2026-08-02T04:40:03.183618Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:40:03.245742Z","title":"On-policy distillation of language models: Learning from self-generated mistakes","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.13639","last_updated":"2026-07-15T09:32:33Z","snapshot_observed_at":"2026-08-20T14:12:11.072339Z","submitted_at":"2026-07-15T09:32:33Z","title":"OvisOCR2 Technical Report","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-02T04:40:03.245742Z"},"links":{"citing_paper":"/paper/2607.13639"},"observation_digest":"sha256:50cb2a8224026048c43d6993869233e48a650371e2a2e4c885cae1764e727d44","observation_id":"de4679eb-4997-46e7-9403-808700220e05","resolution":{"observed_at":"2026-08-02T04:40:03.245742Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.13016","last_updated":"2026-04-15T17:48:51Z","snapshot_observed_at":"2026-08-16T00:27:04.851196Z","submitted_at":"2026-04-14T17:54:28Z","title":"Rethinking On-Policy Distillation of Large Language Models: Phenomenology, Mechanism, and Recipe","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.13016","snapshot_observed_at":"2026-08-02T04:40:03.309100Z","title":"Rethinking on-policy distillation of large language models: Phenomenology, mechanism, and recipe.arXiv preprint arXiv:2604.13016, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.13639","last_updated":"2026-07-15T09:32:33Z","snapshot_observed_at":"2026-08-20T14:12:11.072339Z","submitted_at":"2026-07-15T09:32:33Z","title":"OvisOCR2 Technical Report","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-02T04:40:03.309100Z"},"links":{"cited_paper":"/paper/2604.13016","citing_paper":"/paper/2607.13639"},"observation_digest":"sha256:36855d2532e56154ba3c0ca354bae40dcd4de7636f5415f6122f2f5dfe5b176f","observation_id":"aae4d24f-98ac-4a3a-9715-83769c4ec3f0","resolution":{"observed_at":"2026-08-02T04:40:03.309100Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:40:03.357692Z","title":"Morcos, Hongseok Namkoong, Ali Farhadi, Yair Carmon, Simon Kornblith, and Ludwig Schmidt","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.13639","last_updated":"2026-07-15T09:32:33Z","snapshot_observed_at":"2026-08-20T14:12:11.072339Z","submitted_at":"2026-07-15T09:32:33Z","title":"OvisOCR2 Technical Report","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-02T04:40:03.357692Z"},"links":{"citing_paper":"/paper/2607.13639"},"observation_digest":"sha256:26bca289531d62132674994940805b0d96206d34f6ac466c409de1c1b7e5c678","observation_id":"fa331f93-7164-4e3e-b2d8-ba7077e705bb","resolution":{"observed_at":"2026-08-02T04:40:03.357692Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.18265","last_updated":"2025-08-27T14:39:45Z","snapshot_observed_at":"2026-08-17T12:32:16.575866Z","submitted_at":"2025-08-25T17:58:17Z","title":"InternVL3.5: Advancing Open-Source Multimodal Models in Versatility, Reasoning, and Efficiency","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.18265","snapshot_observed_at":"2026-08-02T04:40:03.411990Z","title":"InternVL3.5: Advancing open-source multimodal models in versatility, reasoning, and efficiency.arXiv preprint arXiv:2508.18265, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13639","last_updated":"2026-07-15T09:32:33Z","snapshot_observed_at":"2026-08-20T14:12:11.072339Z","submitted_at":"2026-07-15T09:32:33Z","title":"OvisOCR2 Technical Report","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-02T04:40:03.411990Z"},"links":{"cited_paper":"/paper/2508.18265","citing_paper":"/paper/2607.13639"},"observation_digest":"sha256:c492b4ba3dbd48e2c85b797f54cced8b96149a57a3fc1ba0dd3d60eb304717d8","observation_id":"8b0ec144-a422-4278-8c43-062b89666d18","resolution":{"observed_at":"2026-08-02T04:40:03.411990Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2602.02276","last_updated":"2026-02-02T16:17:38Z","snapshot_observed_at":"2026-08-12T00:25:39.214406Z","submitted_at":"2026-02-02T16:17:38Z","title":"Kimi K2.5: Visual Agentic Intelligence","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.02276","snapshot_observed_at":"2026-08-02T04:40:03.486812Z","title":"Kimi K2.5: Visual agentic intelligence.arXiv preprint arXiv:2602.02276, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.13639","last_updated":"2026-07-15T09:32:33Z","snapshot_observed_at":"2026-08-20T14:12:11.072339Z","submitted_at":"2026-07-15T09:32:33Z","title":"OvisOCR2 Technical Report","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-02T04:40:03.486812Z"},"links":{"cited_paper":"/paper/2602.02276","citing_paper":"/paper/2607.13639"},"observation_digest":"sha256:a9cb7ed19e305c4d6cb1d501b63b531ffc4fad8c18f883586c3edf1cfbe45d46","observation_id":"b7e2f639-bb24-4df3-b406-2c94a2b196f0","resolution":{"observed_at":"2026-08-02T04:40:03.486812Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:40:03.564849Z","title":"Update to GPT-5 system card: GPT-5.2","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13639","last_updated":"2026-07-15T09:32:33Z","snapshot_observed_at":"2026-08-20T14:12:11.072339Z","submitted_at":"2026-07-15T09:32:33Z","title":"OvisOCR2 Technical Report","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-02T04:40:03.564849Z"},"links":{"citing_paper":"/paper/2607.13639"},"observation_digest":"sha256:7c7f402b1869e6f692bbfd0722e1ad8264bb15ab6c66b7d668d060912294862d","observation_id":"080620d8-886d-4a74-ba32-347ede3f2c43","resolution":{"observed_at":"2026-08-02T04:40:03.564849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.21631","last_updated":"2025-11-27T12:16:54Z","snapshot_observed_at":"2026-08-17T13:26:10.378579Z","submitted_at":"2025-11-26T17:59:08Z","title":"Qwen3-VL Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.21631","snapshot_observed_at":"2026-08-02T04:40:03.683731Z","title":"Qwen3-VL technical report.arXiv preprint arXiv:2511.21631, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13639","last_updated":"2026-07-15T09:32:33Z","snapshot_observed_at":"2026-08-20T14:12:11.072339Z","submitted_at":"2026-07-15T09:32:33Z","title":"OvisOCR2 Technical Report","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-02T04:40:03.683731Z"},"links":{"cited_paper":"/paper/2511.21631","citing_paper":"/paper/2607.13639"},"observation_digest":"sha256:e080b729fc932f6a01bfd7da7dfac2a321a3bcf85e4e02aadc1cb349963882f5","observation_id":"93be6811-84da-4b13-83e2-3cc77de566b1","resolution":{"observed_at":"2026-08-02T04:40:03.683731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:40:03.799418Z","title":"Gemini 3 Flash model card","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13639","last_updated":"2026-07-15T09:32:33Z","snapshot_observed_at":"2026-08-20T14:12:11.072339Z","submitted_at":"2026-07-15T09:32:33Z","title":"OvisOCR2 Technical Report","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-02T04:40:03.799418Z"},"links":{"citing_paper":"/paper/2607.13639"},"observation_digest":"sha256:69a73740b7167d3fd29cc8d6c60a6f1e56679ad2aeb97c8850fd78ad02f1e864","observation_id":"12806a7b-92a2-4696-b13a-e28489aaaca0","resolution":{"observed_at":"2026-08-02T04:40:03.799418Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:40:03.936431Z","title":"Gemini 3 Pro model card","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13639","last_updated":"2026-07-15T09:32:33Z","snapshot_observed_at":"2026-08-20T14:12:11.072339Z","submitted_at":"2026-07-15T09:32:33Z","title":"OvisOCR2 Technical Report","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-02T04:40:03.936431Z"},"links":{"citing_paper":"/paper/2607.13639"},"observation_digest":"sha256:8fa59d3a82e2dc1d8e3b70d12deaf7c1673970482416e021068b0e2c1fe6406b","observation_id":"e28a9df1-47a8-4f59-b92c-f11694bae833","resolution":{"observed_at":"2026-08-02T04:40:03.936431Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.11737","last_updated":"2025-08-15T17:01:08Z","snapshot_observed_at":"2026-07-06T22:13:37.150049Z","submitted_at":"2025-08-15T17:01:08Z","title":"Ovis2.5 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.11737","snapshot_observed_at":"2026-08-02T04:40:04.052317Z","title":"Ovis2.5 Technical Report.arXiv:2508.11737, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13639","last_updated":"2026-07-15T09:32:33Z","snapshot_observed_at":"2026-08-20T14:12:11.072339Z","submitted_at":"2026-07-15T09:32:33Z","title":"OvisOCR2 Technical Report","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-02T04:40:04.052317Z"},"links":{"cited_paper":"/paper/2508.11737","citing_paper":"/paper/2607.13639"},"observation_digest":"sha256:899e6574e438579d54dea6d1e60a886b1d3236b0512a148f37f2b9ab01621451","observation_id":"e4602724-477f-43ad-9c91-a27c0c116c1d","resolution":{"observed_at":"2026-08-02T04:40:04.052317Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:40:04.223297Z","title":"Dolphin: Document image parsing via heterogeneous anchor prompting","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13639","last_updated":"2026-07-15T09:32:33Z","snapshot_observed_at":"2026-08-20T14:12:11.072339Z","submitted_at":"2026-07-15T09:32:33Z","title":"OvisOCR2 Technical Report","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-02T04:40:04.223297Z"},"links":{"citing_paper":"/paper/2607.13639"},"observation_digest":"sha256:56e1ce154619373607fb1ec709750967938614b26f0374382e7dd2bb7246b7f1","observation_id":"9347515a-44e9-40d3-8dd6-0c289bc36821","resolution":{"observed_at":"2026-08-02T04:40:04.223297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:40:04.397723Z","title":"MonkeyOCR: Document parsing with a structure-recognition-relation triplet paradigm.arXiv preprint arXiv:2506.05218, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13639","last_updated":"2026-07-15T09:32:33Z","snapshot_observed_at":"2026-08-20T14:12:11.072339Z","submitted_at":"2026-07-15T09:32:33Z","title":"OvisOCR2 Technical Report","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-02T04:40:04.397723Z"},"links":{"citing_paper":"/paper/2607.13639"},"observation_digest":"sha256:e9ffa475f142982fa049425356ae63ee646d3313ffb6301e71196be0cc8d6e62","observation_id":"f5fab770-0088-4f78-ac28-052a9ea45d80","resolution":{"observed_at":"2026-08-02T04:40:04.397723Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.20430","last_updated":"2026-07-13T14:16:50Z","snapshot_observed_at":"2026-08-20T08:11:16.201938Z","submitted_at":"2026-01-28T09:37:13Z","title":"Youtu-Parsing: Perception, Structuring and Recognition via High-Parallelism Decoding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.20430","snapshot_observed_at":"2026-08-02T04:40:04.566211Z","title":"Youtu-Parsing: Perception, structuring and recognition via high-parallelism decoding.arXiv preprint arXiv:2601.20430, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.13639","last_updated":"2026-07-15T09:32:33Z","snapshot_observed_at":"2026-08-20T14:12:11.072339Z","submitted_at":"2026-07-15T09:32:33Z","title":"OvisOCR2 Technical Report","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-02T04:40:04.566211Z"},"links":{"cited_paper":"/paper/2601.20430","citing_paper":"/paper/2607.13639"},"observation_digest":"sha256:84bf0333f0210b20e44cd6ad655a77f4e3e3ce061fbf6dccf40b3b404a2f66ca","observation_id":"647786e6-5233-4b77-b337-d1e8c995a3c0","resolution":{"observed_at":"2026-08-02T04:40:04.566211Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:40:04.742421Z","title":"PaddleOCR-VL: Boosting multilingual document parsing via a 0.9B ultra-compact vision-language model.arXiv preprint arXiv:2510.14528, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13639","last_updated":"2026-07-15T09:32:33Z","snapshot_observed_at":"2026-08-20T14:12:11.072339Z","submitted_at":"2026-07-15T09:32:33Z","title":"OvisOCR2 Technical Report","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-02T04:40:04.742421Z"},"links":{"citing_paper":"/paper/2607.13639"},"observation_digest":"sha256:3e756577be475bfa24aec35e554e2cd24d29a14a363d101dd6d988f5e088e59b","observation_id":"5f57399f-a3b8-4903-a3a1-5cf0e119f0e8","resolution":{"observed_at":"2026-08-02T04:40:04.742421Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:40:04.916438Z","title":"POINTS-Reader: Distillation-free adapta- tion of vision-language models for document conversion","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13639","last_updated":"2026-07-15T09:32:33Z","snapshot_observed_at":"2026-08-20T14:12:11.072339Z","submitted_at":"2026-07-15T09:32:33Z","title":"OvisOCR2 Technical Report","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-02T04:40:04.916438Z"},"links":{"citing_paper":"/paper/2607.13639"},"observation_digest":"sha256:c98df052b501d6b23b8a304ed6ce35cf852626212195993b60abe8215b648540","observation_id":"8aa7ac39-52df-463f-9b88-476e36bc0fc0","resolution":{"observed_at":"2026-08-02T04:40:04.916438Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:40:05.060855Z","title":"Nanonets-OCR-S: A model for transforming documents into structured Markdown with intelligent con- tent recognition and semantic tagging","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13639","last_updated":"2026-07-15T09:32:33Z","snapshot_observed_at":"2026-08-20T14:12:11.072339Z","submitted_at":"2026-07-15T09:32:33Z","title":"OvisOCR2 Technical Report","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-02T04:40:05.060855Z"},"links":{"citing_paper":"/paper/2607.13639"},"observation_digest":"sha256:a1e92be0726c575e9cae02ff0ac86949ff80ceb8cab5ee3c55c4c3215af44d4b","observation_id":"2ac95d85-434a-41b1-8e21-c4ea689c2c5e","resolution":{"observed_at":"2026-08-02T04:40:05.060855Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:40:05.227277Z","title":"olmOCR: Unlocking trillions of tokens in PDFs with vision language models.arXiv preprint arXiv:2502.18443, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13639","last_updated":"2026-07-15T09:32:33Z","snapshot_observed_at":"2026-08-20T14:12:11.072339Z","submitted_at":"2026-07-15T09:32:33Z","title":"OvisOCR2 Technical Report","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-02T04:40:05.227277Z"},"links":{"citing_paper":"/paper/2607.13639"},"observation_digest":"sha256:955de8f36fc9307cd1d388e8941138ff3fd9ca218d7021d6264a73be268a66c6","observation_id":"5acb6a12-f423-4a81-af96-64f0d31c315f","resolution":{"observed_at":"2026-08-02T04:40:05.227277Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:40:05.348245Z","title":"OCRVerse: Towards holistic OCR in end-to- end vision-language models.arXiv preprint arXiv:2601.21639, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.13639","last_updated":"2026-07-15T09:32:33Z","snapshot_observed_at":"2026-08-20T14:12:11.072339Z","submitted_at":"2026-07-15T09:32:33Z","title":"OvisOCR2 Technical Report","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-02T04:40:05.348245Z"},"links":{"citing_paper":"/paper/2607.13639"},"observation_digest":"sha256:22564fa1a22b395f24320e6b65c75e29284a48b877076dd159e674bb7404aca5","observation_id":"786c03fe-5a27-4cf0-ab43-bfd09bd5caef","resolution":{"observed_at":"2026-08-02T04:40:05.348245Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:40:05.529028Z","title":"HunyuanOCR technical report.arXiv preprint arXiv:2511.19575, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13639","last_updated":"2026-07-15T09:32:33Z","snapshot_observed_at":"2026-08-20T14:12:11.072339Z","submitted_at":"2026-07-15T09:32:33Z","title":"OvisOCR2 Technical Report","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-02T04:40:05.529028Z"},"links":{"citing_paper":"/paper/2607.13639"},"observation_digest":"sha256:847f3e8c4e449d78de4bf1d8d37d108ba5c6705f73ce05c3be00fc34e2b3942a","observation_id":"8c5459fb-1557-4d43-8702-278a9f0d210e","resolution":{"observed_at":"2026-08-02T04:40:05.529028Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:40:05.705502Z","title":"DeepSeek-OCR 2: Visual causal flow.arXiv preprint arXiv:2601.20552, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.13639","last_updated":"2026-07-15T09:32:33Z","snapshot_observed_at":"2026-08-20T14:12:11.072339Z","submitted_at":"2026-07-15T09:32:33Z","title":"OvisOCR2 Technical Report","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-02T04:40:05.705502Z"},"links":{"citing_paper":"/paper/2607.13639"},"observation_digest":"sha256:7ee29c09fe7d147a3881e113561b4a7df26fcab2f52384c47eed51e20a06dde2","observation_id":"4d548933-cc80-464b-b5c0-4e713bd8fbf8","resolution":{"observed_at":"2026-08-02T04:40:05.705502Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2512.21095","last_updated":"2026-07-11T09:04:48Z","snapshot_observed_at":"2026-08-19T23:40:02.808027Z","submitted_at":"2025-12-24T10:35:21Z","title":"UniRec-0.1B: Unified Text and Formula Recognition with 0.1B Parameters","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2512.21095","snapshot_observed_at":"2026-08-02T04:40:05.856964Z","title":"UniRec-0.1B: Unified text and formula recognition with 0.1B parameters.arXiv preprint arXiv:2512.21095, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13639","last_updated":"2026-07-15T09:32:33Z","snapshot_observed_at":"2026-08-20T14:12:11.072339Z","submitted_at":"2026-07-15T09:32:33Z","title":"OvisOCR2 Technical Report","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-02T04:40:05.856964Z"},"links":{"cited_paper":"/paper/2512.21095","citing_paper":"/paper/2607.13639"},"observation_digest":"sha256:16e2875ca1de32c232cfb111ad8149f64107372eb3d5105e4233db73e1c4c431","observation_id":"5f496906-8501-48a0-a702-47aab7217bf7","resolution":{"observed_at":"2026-08-02T04:40:05.856964Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:40:05.945266Z","title":"dots.ocr: Multilingual document layout parsing in a single vision-language model.arXiv preprint arXiv:2512.02498, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13639","last_updated":"2026-07-15T09:32:33Z","snapshot_observed_at":"2026-08-20T14:12:11.072339Z","submitted_at":"2026-07-15T09:32:33Z","title":"OvisOCR2 Technical Report","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-02T04:40:05.945266Z"},"links":{"citing_paper":"/paper/2607.13639"},"observation_digest":"sha256:86101d1d90ff1c446bbca92fac4b98fc8d9c3b9a901c7a1d77cb8f60b5f57ea4","observation_id":"18758040-9c4b-45ab-9e63-90309e27d03a","resolution":{"observed_at":"2026-08-02T04:40:05.945266Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:40:06.002608Z","title":"FireRed-OCR technical report.arXiv preprint arXiv:2603.01840, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.13639","last_updated":"2026-07-15T09:32:33Z","snapshot_observed_at":"2026-08-20T14:12:11.072339Z","submitted_at":"2026-07-15T09:32:33Z","title":"OvisOCR2 Technical Report","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-02T04:40:06.002608Z"},"links":{"citing_paper":"/paper/2607.13639"},"observation_digest":"sha256:41162f9561c17c19a05db8af1dadd377d42e6f7fdcf717379aa90f5c46905e47","observation_id":"ec373b6c-f67e-4a77-a479-7c2616ecea43","resolution":{"observed_at":"2026-08-02T04:40:06.002608Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.27978","last_updated":"2026-05-27T05:16:21Z","snapshot_observed_at":"2026-08-13T01:21:58.936928Z","submitted_at":"2026-05-27T05:16:21Z","title":"ABot-OCR Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.27978","snapshot_observed_at":"2026-08-02T04:40:06.065397Z","title":"ABot-OCR technical report.arXiv preprint arXiv:2605.27978, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.13639","last_updated":"2026-07-15T09:32:33Z","snapshot_observed_at":"2026-08-20T14:12:11.072339Z","submitted_at":"2026-07-15T09:32:33Z","title":"OvisOCR2 Technical Report","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-02T04:40:06.065397Z"},"links":{"cited_paper":"/paper/2605.27978","citing_paper":"/paper/2607.13639"},"observation_digest":"sha256:d57211d33f2450014613ad391f93f4d2f56b75d415b190b2f3d889c233b3d3dc","observation_id":"76cdc04c-1bd3-4f8e-af27-be721ce3e435","resolution":{"observed_at":"2026-08-02T04:40:06.065397Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:40:06.184917Z","title":"Logics-Parsing technical report.arXiv preprint arXiv:2509.19760, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13639","last_updated":"2026-07-15T09:32:33Z","snapshot_observed_at":"2026-08-20T14:12:11.072339Z","submitted_at":"2026-07-15T09:32:33Z","title":"OvisOCR2 Technical Report","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-02T04:40:06.184917Z"},"links":{"citing_paper":"/paper/2607.13639"},"observation_digest":"sha256:a1ab0f74e266b9d282b7901d9aa0095ce72a3cf4025f6868a3d03c43ed905c5f","observation_id":"7d3e9152-7027-4445-88ba-2bcb13dd1e5f","resolution":{"observed_at":"2026-08-02T04:40:06.184917Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:40:06.257726Z","title":"Qianfan-OCR: A unified end-to-end model for document intelligence.arXiv preprint arXiv:2603.13398, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.13639","last_updated":"2026-07-15T09:32:33Z","snapshot_observed_at":"2026-08-20T14:12:11.072339Z","submitted_at":"2026-07-15T09:32:33Z","title":"OvisOCR2 Technical Report","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-02T04:40:06.257726Z"},"links":{"citing_paper":"/paper/2607.13639"},"observation_digest":"sha256:9b8916439c02e99924f19523e983a33bd4e29628d95d3f30d07443355f1c8025","observation_id":"cb94db28-c423-4db1-a266-3a990723e9e4","resolution":{"observed_at":"2026-08-02T04:40:06.257726Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.18154","last_updated":"2025-09-16T19:41:48Z","snapshot_observed_at":"2026-08-09T11:10:24.301223Z","submitted_at":"2025-09-16T19:41:48Z","title":"MiniCPM-V 4.5: Cooking Efficient MLLMs via Architecture, Data, and Training Recipe","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.18154","snapshot_observed_at":"2026-08-02T04:40:06.407090Z","title":"MiniCPM-V 4.5: Cooking efficient MLLMs via architecture, data, and training recipe.arXiv preprint arXiv:2509.18154, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13639","last_updated":"2026-07-15T09:32:33Z","snapshot_observed_at":"2026-08-20T14:12:11.072339Z","submitted_at":"2026-07-15T09:32:33Z","title":"OvisOCR2 Technical Report","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-02T04:40:06.407090Z"},"links":{"cited_paper":"/paper/2509.18154","citing_paper":"/paper/2607.13639"},"observation_digest":"sha256:eb8b4b120bdefff1fc5fc88f26ffcfe4299cf286a0113aa6b0648cc29c6f55db","observation_id":"2759cf15-214a-42dc-9d09-6894885d6a31","resolution":{"observed_at":"2026-08-02T04:40:06.407090Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:40:06.539789Z","title":"STEP3-VL-10B technical report.arXiv preprint arXiv:2601.09668, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.13639","last_updated":"2026-07-15T09:32:33Z","snapshot_observed_at":"2026-08-20T14:12:11.072339Z","submitted_at":"2026-07-15T09:32:33Z","title":"OvisOCR2 Technical Report","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-02T04:40:06.539789Z"},"links":{"citing_paper":"/paper/2607.13639"},"observation_digest":"sha256:1a3d5f783e626ed770b57aceacba53976116cf2a6c7bd1060a80e036c873d0b6","observation_id":"d935928b-fbec-4d0c-97f1-b07a249d100f","resolution":{"observed_at":"2026-08-02T04:40:06.539789Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:40:06.648330Z","title":"Gemini 3.1 Pro model card","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.13639","last_updated":"2026-07-15T09:32:33Z","snapshot_observed_at":"2026-08-20T14:12:11.072339Z","submitted_at":"2026-07-15T09:32:33Z","title":"OvisOCR2 Technical Report","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-02T04:40:06.648330Z"},"links":{"citing_paper":"/paper/2607.13639"},"observation_digest":"sha256:8fa29fa1d5ccdab6ddd92c03084db0bfbd6e98705e761037d12f2f543b2a6a44","observation_id":"67fe7ca1-a60a-4d6a-ac35-e008dd911e99","resolution":{"observed_at":"2026-08-02T04:40:06.648330Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:40:06.738106Z","title":"SVTRv2: CTC beats encoder-decoder models in scene text recognition","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13639","last_updated":"2026-07-15T09:32:33Z","snapshot_observed_at":"2026-08-20T14:12:11.072339Z","submitted_at":"2026-07-15T09:32:33Z","title":"OvisOCR2 Technical Report","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-02T04:40:06.738106Z"},"links":{"citing_paper":"/paper/2607.13639"},"observation_digest":"sha256:86d4f092f684bb65187e5d1ca99563f79754f9111d4f1a7a0985782054caf1cd","observation_id":"4fe4d002-db3b-44ca-815a-34b5e7931e2e","resolution":{"observed_at":"2026-08-02T04:40:06.738106Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:40:06.845336Z","title":"Multimodal OCR: Parse anything from documents","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.13639","last_updated":"2026-07-15T09:32:33Z","snapshot_observed_at":"2026-08-20T14:12:11.072339Z","submitted_at":"2026-07-15T09:32:33Z","title":"OvisOCR2 Technical Report","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-02T04:40:06.845336Z"},"links":{"citing_paper":"/paper/2607.13639"},"observation_digest":"sha256:e2a97714f89e9ff1d411a066b5c99a07d0e38f387d84003b9aaaef7fbfa6b406","observation_id":"232b8b5b-3feb-4af5-a67b-b03839b48943","resolution":{"observed_at":"2026-08-02T04:40:06.845336Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:40:06.915445Z","title":"OCRFlux: A multimodal toolkit for converting documents into Markdown","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13639","last_updated":"2026-07-15T09:32:33Z","snapshot_observed_at":"2026-08-20T14:12:11.072339Z","submitted_at":"2026-07-15T09:32:33Z","title":"OvisOCR2 Technical Report","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-02T04:40:06.915445Z"},"links":{"citing_paper":"/paper/2607.13639"},"observation_digest":"sha256:a8b988b28b1bf95eed9430d4d06624712995b10d08a5f3eebc3fde175bc2ad30","observation_id":"b4f74ad1-7196-4ab8-ab47-1c68f1bb7e53","resolution":{"observed_at":"2026-08-02T04:40:06.915445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2510.18234","last_updated":"2025-10-21T02:41:44Z","snapshot_observed_at":"2026-08-17T02:37:33.939393Z","submitted_at":"2025-10-21T02:41:44Z","title":"DeepSeek-OCR: Contexts Optical Compression","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2510.18234","snapshot_observed_at":"2026-08-02T04:40:07.008683Z","title":"DeepSeek-OCR: Contexts optical compression","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13639","last_updated":"2026-07-15T09:32:33Z","snapshot_observed_at":"2026-08-20T14:12:11.072339Z","submitted_at":"2026-07-15T09:32:33Z","title":"OvisOCR2 Technical Report","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-02T04:40:07.008683Z"},"links":{"cited_paper":"/paper/2510.18234","citing_paper":"/paper/2607.13639"},"observation_digest":"sha256:f726c39f9bd359c449a13ba39c483b87b6aabf10e4e6028626805b6b4a2c65a1","observation_id":"517f7cb8-4770-4624-9eb5-35f7c24ab57f","resolution":{"observed_at":"2026-08-02T04:40:07.008683Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:40:07.106147Z","title":"Nanonets-OCR2: A model for transforming documents into structured Markdown with intelligent content recognition and semantic tagging","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13639","last_updated":"2026-07-15T09:32:33Z","snapshot_observed_at":"2026-08-20T14:12:11.072339Z","submitted_at":"2026-07-15T09:32:33Z","title":"OvisOCR2 Technical Report","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-02T04:40:07.106147Z"},"links":{"citing_paper":"/paper/2607.13639"},"observation_digest":"sha256:2457f6d87a9c1531792295dd2fdec86b5e1477fc2bfc83ae4079b5ee442b935a","observation_id":"0a2c2953-2cda-40e5-850c-a3c349e9c48f","resolution":{"observed_at":"2026-08-02T04:40:07.106147Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:40:07.183985Z","title":"olmOCR 2: Unit test rewards for document OCR.arXiv preprint arXiv:2510.19817, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13639","last_updated":"2026-07-15T09:32:33Z","snapshot_observed_at":"2026-08-20T14:12:11.072339Z","submitted_at":"2026-07-15T09:32:33Z","title":"OvisOCR2 Technical Report","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-02T04:40:07.183985Z"},"links":{"citing_paper":"/paper/2607.13639"},"observation_digest":"sha256:e1017a5b4492b32911f311ee3f4091e52c5d4a980235cceb7f9a0624be60d391","observation_id":"d1d0d39a-5d06-4e20-b9f0-d9c746f9188a","resolution":{"observed_at":"2026-08-02T04:40:07.183985Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T04:40:07.276016Z","title":"Reading or reasoning? format decoupled reinforcement learning for document OCR","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.13639","last_updated":"2026-07-15T09:32:33Z","snapshot_observed_at":"2026-08-20T14:12:11.072339Z","submitted_at":"2026-07-15T09:32:33Z","title":"OvisOCR2 Technical Report","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-02T04:40:07.276016Z"},"links":{"citing_paper":"/paper/2607.13639"},"observation_digest":"sha256:d660c022367ce7a9f65c51d71bf583fd2a4f18eb7dab79406a9b1dd2fdc110da","observation_id":"b3a049d1-e6e6-4066-8131-aba159c19f83","resolution":{"observed_at":"2026-08-02T04:40:07.276016Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.13639","last_updated":"2026-07-15T09:32:33Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-20T14:12:11.072339Z","submitted_at":"2026-07-15T09:32:33Z","title":"OvisOCR2 Technical Report"},"reference_resolution":{"displayed":53,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":53,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":53},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"thesis":"As of 21 August 2026, this Paper Citation Record lists 53 of 53 outbound references and 1 inbound Pith citation observation for arXiv:2607.13639."}