{"as_of":"2026-08-09T03:21:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d59f0fd422f1ab71644e1cf3f676129600aaccabf5520920efd249bd9092bd3d","coverage":[{"denominator":21,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":21,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T04:41:40.917301Z","state":"measured"},{"denominator":22,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":22,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-20T05:48:34.771799Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-20T05:53:05.108803Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.11156","last_updated":"2025-06-11T16:03:01Z","snapshot_observed_at":"2026-08-07T04:35:41.976505Z","submitted_at":"2025-06-11T16:03:01Z","title":"Digitization of Document and Information Extraction using OCR","version":1},"cited_work":{"arxiv_id":"2506.11156","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.11156","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"4f83e3f4-99f4-408b-9267-e3380b2d527a","year":null},"citing_paper":{"arxiv_id":"2605.19866","last_updated":"2026-05-19T13:58:24Z","snapshot_observed_at":"2026-08-03T21:16:40.817874Z","submitted_at":"2026-05-19T13:58:24Z","title":"Structured Layout Priors for Robust Out-of-Distribution Visual Document Understanding","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-20T05:48:34.771799Z"},"links":{"cited_paper":"/paper/2506.11156","citing_paper":"/paper/2605.19866"},"observation_digest":"sha256:f8b41af07185910020f687b68995e3805258059a915d03c107cc89a4dda70a98","observation_id":"264e1d50-a59c-4524-ae2e-bd687ca6b29d","resolution":{"observed_at":"2026-05-20T05:53:05.110294Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.11156/citation-record","integrity":"/paper/2506.11156/integrity","json":"/paper/2506.11156/citation-record.json","paper":"/paper/2506.11156"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:41:41.223076Z","title":"For scanned documents, techniques like binarization and skew correction are utilized to enhance text clarity and improve OCR accuracy","venue":null,"work_id":"22c99eb6-f5ce-48c1-9689-88a4717f51a7","year":null},"citing_paper":{"arxiv_id":"2506.11156","last_updated":"2025-06-11T16:03:01Z","snapshot_observed_at":"2026-08-07T04:35:41.976505Z","submitted_at":"2025-06-11T16:03:01Z","title":"Digitization of Document and Information Extraction using OCR","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T04:41:40.831643Z"},"links":{"citing_paper":"/paper/2506.11156"},"observation_digest":"sha256:75db2da4efe82af9453a744b5e745ed1b214767e459f4933aa825577a6a7f81f","observation_id":"c281e1c3-ebe1-404f-95e9-5fb7a604c69b","resolution":{"observed_at":"2026-08-07T04:41:41.227123Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:41:41.210755Z","title":"● python-docx: Utilized for retrieving text and formatting details from DOCX documents","venue":null,"work_id":"e643b925-a8ce-4196-9ee1-f3b306b47fee","year":null},"citing_paper":{"arxiv_id":"2506.11156","last_updated":"2025-06-11T16:03:01Z","snapshot_observed_at":"2026-08-07T04:35:41.976505Z","submitted_at":"2025-06-11T16:03:01Z","title":"Digitization of Document and Information Extraction using OCR","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T04:41:40.836605Z"},"links":{"citing_paper":"/paper/2506.11156"},"observation_digest":"sha256:893ac42c1564e22bf83b62dd27975309257262dab9717e602b1993cea53a51b0","observation_id":"80849641-0fac-464d-91cb-3b02280b3edd","resolution":{"observed_at":"2026-08-07T04:41:41.214883Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:41:41.198528Z","title":"● Maintained Structural Metadata: Internal components such as paragraphs, headings, and tables improve segmentation and contextual understanding","venue":null,"work_id":"7a7e6e81-fbd6-44bc-9e3a-84cb620a10d7","year":null},"citing_paper":{"arxiv_id":"2506.11156","last_updated":"2025-06-11T16:03:01Z","snapshot_observed_at":"2026-08-07T04:35:41.976505Z","submitted_at":"2025-06-11T16:03:01Z","title":"Digitization of Document and Information Extraction using OCR","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T04:41:40.840781Z"},"links":{"citing_paper":"/paper/2506.11156"},"observation_digest":"sha256:3eced2a09063ed489c32b76ad3f4b19e1423a4b7e8f2b6d794987b92ce8b85c3","observation_id":"6d984e35-cf1c-4337-b47e-ec8a45245ef2","resolution":{"observed_at":"2026-08-07T04:41:41.202671Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:41:41.185634Z","title":"Extending TrOCR for Text Localization-Free OCR of Full-Page Scanned Receipt Images,","venue":null,"work_id":"67c96508-85e5-4287-9f61-4485ab1fa1d1","year":2023},"citing_paper":{"arxiv_id":"2506.11156","last_updated":"2025-06-11T16:03:01Z","snapshot_observed_at":"2026-08-07T04:35:41.976505Z","submitted_at":"2025-06-11T16:03:01Z","title":"Digitization of Document and Information Extraction using OCR","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T04:41:40.845242Z"},"links":{"citing_paper":"/paper/2506.11156"},"observation_digest":"sha256:6137dffbda74b631f970e5b59719327384c3bdb1123621ad0f4cd2685772f7c6","observation_id":"e3da482c-5b3e-4c6c-9cc9-f4f90b8c06cb","resolution":{"observed_at":"2026-08-07T04:41:41.189673Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:41:41.173827Z","title":"A Deep Learning Based Optical Character Recognition Model for Old Turkic,","venue":null,"work_id":"977e56cb-6ed0-4fa3-a36f-3d0e2a1b1cb1","year":2025},"citing_paper":{"arxiv_id":"2506.11156","last_updated":"2025-06-11T16:03:01Z","snapshot_observed_at":"2026-08-07T04:35:41.976505Z","submitted_at":"2025-06-11T16:03:01Z","title":"Digitization of Document and Information Extraction using OCR","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T04:41:40.849375Z"},"links":{"citing_paper":"/paper/2506.11156"},"observation_digest":"sha256:2099cbc6bba858ac8b5074db53ca13b0eefdd99e0bb8fe46ba805a7ed40eee2b","observation_id":"c12a3421-735b-4dde-80c4-63a5ef73bd7a","resolution":{"observed_at":"2026-08-07T04:41:41.177480Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:41:41.161815Z","title":"Image Text Extraction and Natural Language Processing of Unstructured Data from Medical Reports,","venue":null,"work_id":"f9443236-7068-4290-b435-3f1ec251dafe","year":2024},"citing_paper":{"arxiv_id":"2506.11156","last_updated":"2025-06-11T16:03:01Z","snapshot_observed_at":"2026-08-07T04:35:41.976505Z","submitted_at":"2025-06-11T16:03:01Z","title":"Digitization of Document and Information Extraction using OCR","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T04:41:40.853477Z"},"links":{"citing_paper":"/paper/2506.11156"},"observation_digest":"sha256:8e4c4493d4583c2758cf3d2095a7716ac017521998ae27d54b3c4ab97d3e7756","observation_id":"2897f759-c764-45fb-961d-aae826c89caa","resolution":{"observed_at":"2026-08-07T04:41:41.165801Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.04245","last_updated":"2023-07-09T18:51:17Z","snapshot_observed_at":"2026-08-08T00:58:18.904019Z","submitted_at":"2023-07-09T18:51:17Z","title":"A Novel Pipeline for Improving Optical Character Recognition through Post-processing Using Natural Language Processing","version":1},"cited_work":{"arxiv_id":"2307.04245","doi":null,"metadata_source":"pith","pith_arxiv_id":"2307.04245","snapshot_observed_at":"2026-08-07T04:41:41.023437Z","title":"A Novel Pipeline for Improving Optical Character Recognition through Post-processing Using Natural Language Processing","venue":"cs.CV","work_id":"204272d7-8808-4969-acfe-92fec4a1bfed","year":2023},"citing_paper":{"arxiv_id":"2506.11156","last_updated":"2025-06-11T16:03:01Z","snapshot_observed_at":"2026-08-07T04:35:41.976505Z","submitted_at":"2025-06-11T16:03:01Z","title":"Digitization of Document and Information Extraction using OCR","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T04:41:40.857409Z"},"links":{"cited_paper":"/paper/2307.04245","citing_paper":"/paper/2506.11156"},"observation_digest":"sha256:12591b5ae6d7d413bbf5a7f17ed9f2f4dc03830925e6a7e639ff7f5410c6b66f","observation_id":"43d76243-64af-40ea-85a7-ccf88349082f","resolution":{"observed_at":"2026-08-07T04:41:41.027510Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.02142","last_updated":"2023-06-03T15:56:30Z","snapshot_observed_at":"2026-07-06T15:37:35.744490Z","submitted_at":"2023-06-03T15:56:30Z","title":"TransDocAnalyser: A Framework for Offline Semi-structured Handwritten Document Analysis in the Legal Domain","version":1},"cited_work":{"arxiv_id":"2306.02142","doi":null,"metadata_source":"pith","pith_arxiv_id":"2306.02142","snapshot_observed_at":"2026-08-07T04:41:41.005877Z","title":"TransDocAnalyser: A Framework for Offline Semi-structured Handwritten Document Analysis in the Legal Domain","venue":"cs.CV","work_id":"a40ac13c-0179-4055-a7d4-babafa15f2cf","year":2023},"citing_paper":{"arxiv_id":"2506.11156","last_updated":"2025-06-11T16:03:01Z","snapshot_observed_at":"2026-08-07T04:35:41.976505Z","submitted_at":"2025-06-11T16:03:01Z","title":"Digitization of Document and Information Extraction using OCR","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T04:41:40.861557Z"},"links":{"cited_paper":"/paper/2306.02142","citing_paper":"/paper/2506.11156"},"observation_digest":"sha256:5266a6446cdb16fca04b0318c30a1be092ec23eccdf81084da07c7cc52c11e03","observation_id":"db03292f-8eb8-4106-bbe2-4a4bb31ed784","resolution":{"observed_at":"2026-08-07T04:41:41.010124Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.05396","last_updated":"2023-07-11T15:57:15Z","snapshot_observed_at":"2026-07-06T15:52:44.676636Z","submitted_at":"2023-07-11T15:57:15Z","title":"Handwritten Text Recognition Using Convolutional Neural Network","version":1},"cited_work":{"arxiv_id":"2307.05396","doi":null,"metadata_source":"pith","pith_arxiv_id":"2307.05396","snapshot_observed_at":"2026-08-07T04:41:40.986987Z","title":"Handwritten Text Recognition Using Convolutional Neural Network","venue":"cs.CV","work_id":"80843bf1-00bd-4c5d-9383-0a9cbbdd7cf8","year":2023},"citing_paper":{"arxiv_id":"2506.11156","last_updated":"2025-06-11T16:03:01Z","snapshot_observed_at":"2026-08-07T04:35:41.976505Z","submitted_at":"2025-06-11T16:03:01Z","title":"Digitization of Document and Information Extraction using OCR","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T04:41:40.865733Z"},"links":{"cited_paper":"/paper/2307.05396","citing_paper":"/paper/2506.11156"},"observation_digest":"sha256:016ec9e652e3738a076be03b5d40b0c1ed87d8ac7eb391b4a82210559b093d9a","observation_id":"bc2103d7-000a-450e-94bd-2a3b6f9c997b","resolution":{"observed_at":"2026-08-07T04:41:40.991503Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.15664","last_updated":"2022-10-06T06:50:39Z","snapshot_observed_at":"2026-08-06T10:03:36.325862Z","submitted_at":"2021-11-30T18:55:19Z","title":"OCR-free Document Understanding Transformer","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.15664","snapshot_observed_at":"2026-08-07T04:41:40.869980Z","title":"OCR-free Document Understanding Transformer,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.11156","last_updated":"2025-06-11T16:03:01Z","snapshot_observed_at":"2026-08-07T04:35:41.976505Z","submitted_at":"2025-06-11T16:03:01Z","title":"Digitization of Document and Information Extraction using OCR","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T04:41:40.869980Z"},"links":{"cited_paper":"/paper/2111.15664","citing_paper":"/paper/2506.11156"},"observation_digest":"sha256:7a46a42175073ffd93ae13792bd17a7ce64c19b5649d96898c238d1596413f6f","observation_id":"c3823ade-e530-46d5-a213-ca6e587460e2","resolution":{"observed_at":"2026-08-07T04:41:40.869980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:41:41.149673Z","title":"TrOCR: Transformer-based Optical Character Recognition with Pretrained Models,","venue":null,"work_id":"d0385745-31b8-4f5b-befe-f76bc13440d4","year":2023},"citing_paper":{"arxiv_id":"2506.11156","last_updated":"2025-06-11T16:03:01Z","snapshot_observed_at":"2026-08-07T04:35:41.976505Z","submitted_at":"2025-06-11T16:03:01Z","title":"Digitization of Document and Information Extraction using OCR","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T04:41:40.873957Z"},"links":{"citing_paper":"/paper/2506.11156"},"observation_digest":"sha256:75023985548d024929b1e7ae54b7deb0f6a1a013bca073d1a13bb2c4808e0481","observation_id":"b73c1663-ac78-4bfd-bc54-e55fc141578d","resolution":{"observed_at":"2026-08-07T04:41:41.153579Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:41:41.124928Z","title":"KuroNet: Pre-modern Japanese Kuzushiji Character Recognition with Deep Learning,","venue":null,"work_id":"ba3dc78d-18f8-4eea-adae-42de63c67835","year":2019},"citing_paper":{"arxiv_id":"2506.11156","last_updated":"2025-06-11T16:03:01Z","snapshot_observed_at":"2026-08-07T04:35:41.976505Z","submitted_at":"2025-06-11T16:03:01Z","title":"Digitization of Document and Information Extraction using OCR","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T04:41:40.881234Z"},"links":{"citing_paper":"/paper/2506.11156"},"observation_digest":"sha256:ede599b2ec92416c5bd4f99fa95aa1bb2c498aef74e4e850a26ddeb4d3e70b05","observation_id":"eeece3e0-ce99-47c5-8a28-c70777ef9626","resolution":{"observed_at":"2026-08-07T04:41:41.128808Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:41:41.112563Z","title":"Documentation of Old Turkic Runic Inscriptions of the Altai Mountains Using Photogrammetric Technology,","venue":null,"work_id":"2c3e73a3-eab3-4f37-a846-9e07ae807ac7","year":2017},"citing_paper":{"arxiv_id":"2506.11156","last_updated":"2025-06-11T16:03:01Z","snapshot_observed_at":"2026-08-07T04:35:41.976505Z","submitted_at":"2025-06-11T16:03:01Z","title":"Digitization of Document and Information Extraction using OCR","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T04:41:40.884965Z"},"links":{"citing_paper":"/paper/2506.11156"},"observation_digest":"sha256:04bb8ec008e4a758ce40d6faea256198ac987c5d0d087006467c390c23c390bc","observation_id":"0577096a-424f-4f63-b8ed-9f874d80d9ad","resolution":{"observed_at":"2026-08-07T04:41:41.116524Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:41:41.087064Z","title":"Historical Document Image Restoration Using Multispectral Imaging System,","venue":null,"work_id":"2923d952-dfb3-4b10-89b2-2ccc56778293","year":2022},"citing_paper":{"arxiv_id":"2506.11156","last_updated":"2025-06-11T16:03:01Z","snapshot_observed_at":"2026-08-07T04:35:41.976505Z","submitted_at":"2025-06-11T16:03:01Z","title":"Digitization of Document and Information Extraction using OCR","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T04:41:40.892046Z"},"links":{"citing_paper":"/paper/2506.11156"},"observation_digest":"sha256:64e03744ec7a5197168f2314032c5a21edd5defdd63f9b4f808af98772f852ef","observation_id":"c6c7cf34-f874-4093-9e3d-83168521bc47","resolution":{"observed_at":"2026-08-07T04:41:41.090874Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:41:41.074189Z","title":"Deep Learning for Document Image Enhancement,","venue":null,"work_id":"7445235f-eb4d-4263-9411-d1e5633d4311","year":2019},"citing_paper":{"arxiv_id":"2506.11156","last_updated":"2025-06-11T16:03:01Z","snapshot_observed_at":"2026-08-07T04:35:41.976505Z","submitted_at":"2025-06-11T16:03:01Z","title":"Digitization of Document and Information Extraction using OCR","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T04:41:40.895701Z"},"links":{"citing_paper":"/paper/2506.11156"},"observation_digest":"sha256:a9547a2560e8affcf9b562b11e720f614e20ebee177c58a17bc1f2493117ae51","observation_id":"57994a05-55c8-4fc3-b34f-52ae1645b6e1","resolution":{"observed_at":"2026-08-07T04:41:41.078089Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:41:41.061142Z","title":"Recognition of Historical Scripts Using Shallow Convolutional Neural Networks,","venue":null,"work_id":"b52b560f-b85b-4876-8048-27b6d6ce5da6","year":2021},"citing_paper":{"arxiv_id":"2506.11156","last_updated":"2025-06-11T16:03:01Z","snapshot_observed_at":"2026-08-07T04:35:41.976505Z","submitted_at":"2025-06-11T16:03:01Z","title":"Digitization of Document and Information Extraction using OCR","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T04:41:40.899326Z"},"links":{"citing_paper":"/paper/2506.11156"},"observation_digest":"sha256:a7dc80aa438c9d5012ebdae55ea8670c4e7ae7f459f6571e141993521216bad4","observation_id":"6eb9c5b5-15b5-44c5-844a-954e58604e95","resolution":{"observed_at":"2026-08-07T04:41:41.065607Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.03621","last_updated":"2026-04-17T13:03:40Z","snapshot_observed_at":"2026-07-06T21:04:24.672960Z","submitted_at":"2025-04-04T17:39:53Z","title":"PILOT: A Promptable Interleaved Layout-aware OCR Transformer","version":2},"cited_work":{"arxiv_id":"2504.03621","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.03621","snapshot_observed_at":"2026-08-07T04:41:40.950998Z","title":"PILOT: A Promptable Interleaved Layout-aware OCR Transformer","venue":"cs.CV","work_id":"5916e1e4-4322-47bc-8e0e-0e5599ed0010","year":2025},"citing_paper":{"arxiv_id":"2506.11156","last_updated":"2025-06-11T16:03:01Z","snapshot_observed_at":"2026-08-07T04:35:41.976505Z","submitted_at":"2025-06-11T16:03:01Z","title":"Digitization of Document and Information Extraction using OCR","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T04:41:40.902982Z"},"links":{"cited_paper":"/paper/2504.03621","citing_paper":"/paper/2506.11156"},"observation_digest":"sha256:04bf9fdf3ed76dbe41d250e4b3e0a458259b5f059609125a94513723370d9771","observation_id":"a78178eb-af2d-44b7-8f6d-3526092c1006","resolution":{"observed_at":"2026-08-07T04:41:40.957820Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:41:41.100070Z","title":"DeepNetDevanagari: A Deep Learning Model for Devanagari Ancient Character Recognition,","venue":null,"work_id":"30ae5a8a-bdf3-4be5-a7fa-a3888a64a5e4","year":2021},"citing_paper":{"arxiv_id":"2506.11156","last_updated":"2025-06-11T16:03:01Z","snapshot_observed_at":"2026-08-07T04:35:41.976505Z","submitted_at":"2025-06-11T16:03:01Z","title":"Digitization of Document and Information Extraction using OCR","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T04:41:40.906823Z"},"links":{"citing_paper":"/paper/2506.11156"},"observation_digest":"sha256:c8993268b2816011b282059dcf76731f24b219411bb1b9073430e04a919b15e1","observation_id":"caee586c-29f5-415c-9038-00350925bd70","resolution":{"observed_at":"2026-08-07T04:41:41.104150Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:41:41.048842Z","title":"Post-OCR Parsing: Building Simple and Robust Parser via BIO Tagging,","venue":null,"work_id":"c88c58b5-8aba-42bc-944c-3895bc5069f4","year":2019},"citing_paper":{"arxiv_id":"2506.11156","last_updated":"2025-06-11T16:03:01Z","snapshot_observed_at":"2026-08-07T04:35:41.976505Z","submitted_at":"2025-06-11T16:03:01Z","title":"Digitization of Document and Information Extraction using OCR","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T04:41:40.910271Z"},"links":{"citing_paper":"/paper/2506.11156"},"observation_digest":"sha256:bf7f73ecdf0e2932eb60673d58e75d112dd40648c50fa575c81a3c8990de687b","observation_id":"cef4a466-41e4-4aa3-a52a-54d2e529a34a","resolution":{"observed_at":"2026-08-07T04:41:41.052685Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:41:41.036387Z","title":"Extract Data Points from Invoices with Multi-layer Graph Attention Network and Named Entity Recognition,","venue":null,"work_id":"a3e52f2f-99d9-4e43-9a57-33c3395594f5","year":2022},"citing_paper":{"arxiv_id":"2506.11156","last_updated":"2025-06-11T16:03:01Z","snapshot_observed_at":"2026-08-07T04:35:41.976505Z","submitted_at":"2025-06-11T16:03:01Z","title":"Digitization of Document and Information Extraction using OCR","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T04:41:40.913761Z"},"links":{"citing_paper":"/paper/2506.11156"},"observation_digest":"sha256:d9a2c3f3e69135467559099b2ae9060873ab9af0a35a20c5fde1c4d542e15636","observation_id":"b8b0c408-2afa-4c63-8406-41b55733a9cd","resolution":{"observed_at":"2026-08-07T04:41:41.040409Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:41:41.137623Z","title":"A Hybrid CNN-Transformer Model for Historical Document Image Binarization,","venue":null,"work_id":"c26a8d25-bfb9-416e-a5c9-05a0760ce2a4","year":2023},"citing_paper":{"arxiv_id":"2506.11156","last_updated":"2025-06-11T16:03:01Z","snapshot_observed_at":"2026-08-07T04:35:41.976505Z","submitted_at":"2025-06-11T16:03:01Z","title":"Digitization of Document and Information Extraction using OCR","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T04:41:40.917301Z"},"links":{"citing_paper":"/paper/2506.11156"},"observation_digest":"sha256:45be1b0ce283ac82f67a63498717dc5d42b0b6d5746de889d29119247753f23f","observation_id":"38b76331-9ef4-4889-9ca5-c9647c56c00c","resolution":{"observed_at":"2026-08-07T04:41:41.141411Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.11156","last_updated":"2025-06-11T16:03:01Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T04:35:41.976505Z","submitted_at":"2025-06-11T16:03:01Z","title":"Digitization of Document and Information Extraction using OCR"},"reference_resolution":{"displayed":21,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":1,"verified_exact":4,"verified_fuzzy":16},"total_outbound_references":21},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 21 of 21 outbound references and 1 inbound Pith citation observation for arXiv:2506.11156."}