{"as_of":"2026-08-22T20:17:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:0c19fc6e135d9af4318489f18054a3d8c9379341b8efb235d56564e3c2b286bd","coverage":[{"denominator":24,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":24,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T17:33:45.080377Z","state":"measured"},{"denominator":26,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":26,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-22T06:32:14.747728+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:22:11.188805Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-05T11:23:45.109420Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2411.17835","last_updated":"2024-11-19T12:09:12Z","snapshot_observed_at":"2026-08-17T23:48:37.921815Z","submitted_at":"2024-11-19T12:09:12Z","title":"Arabic-Nougat: Fine-Tuning Vision Transformers for Arabic OCR and Markdown Extraction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.17835","snapshot_observed_at":"2026-08-07T12:22:11.188805Z","title":"Rashad, Arabic-nougat: Fine-tuning vision transformers for arabic ocr and markdown extraction, arXiv preprint arXiv:2411.17835 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24600","last_updated":"2025-05-30T13:47:54Z","snapshot_observed_at":"2026-08-17T16:59:40.316929Z","submitted_at":"2025-05-30T13:47:54Z","title":"SARD: A Large-Scale Synthetic Arabic OCR Dataset for Book-Style Text Recognition","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T12:22:11.188805Z"},"links":{"cited_paper":"/paper/2411.17835","citing_paper":"/paper/2505.24600"},"observation_digest":"sha256:f78a103133c254e608304b9b87256ca35c3c7291b84a9691fd7980f3d11a0863","observation_id":"2d4041ed-b40c-4e20-bcf7-c06581eec7b2","resolution":{"observed_at":"2026-08-07T12:22:11.188805Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.17835","last_updated":"2024-11-19T12:09:12Z","snapshot_observed_at":"2026-08-17T23:48:37.921815Z","submitted_at":"2024-11-19T12:09:12Z","title":"Arabic-Nougat: Fine-Tuning Vision Transformers for Arabic OCR and Markdown Extraction","version":1},"cited_work":{"arxiv_id":"2411.17835","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.17835","snapshot_observed_at":"2026-08-05T11:23:45.109420Z","title":"Arabic-Nougat: Fine-Tuning Vision Transformers for Arabic OCR and Markdown Extraction","venue":"cs.CL","work_id":"703c2fa4-d877-46f4-b436-14851ee8a5cb","year":2024},"citing_paper":{"arxiv_id":"2509.02864","last_updated":"2025-09-02T22:21:55Z","snapshot_observed_at":"2026-08-15T23:18:15.411191Z","submitted_at":"2025-09-02T22:21:55Z","title":"A-SEA3L-QA: A Fully Automated Self-Evolving, Adversarial Workflow for Arabic Long-Context Question-Answer Generation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T11:23:44.439355Z"},"links":{"cited_paper":"/paper/2411.17835","citing_paper":"/paper/2509.02864"},"observation_digest":"sha256:8b3e8668a0e92bb352ab763769e278ad74a27f51278adec9c6262aa81fb0afc9","observation_id":"ae8a7989-cf4c-4d87-a82f-68e64818835e","resolution":{"observed_at":"2026-08-05T11:23:45.317541Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2411.17835/citation-record","integrity":"/paper/2411.17835/integrity","json":"/paper/2411.17835/citation-record.json","paper":"/paper/2411.17835"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2308.13418","last_updated":"2023-08-25T15:03:36Z","snapshot_observed_at":"2026-08-12T03:48:04.422679Z","submitted_at":"2023-08-25T15:03:36Z","title":"Nougat: Neural Optical Understanding for Academic Documents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.13418","snapshot_observed_at":"2026-08-12T17:33:44.936180Z","title":"Nougat: Neural Optical Understanding for Academic Documents,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.17835","last_updated":"2024-11-19T12:09:12Z","snapshot_observed_at":"2026-08-17T23:48:37.921815Z","submitted_at":"2024-11-19T12:09:12Z","title":"Arabic-Nougat: Fine-Tuning Vision Transformers for Arabic OCR and Markdown Extraction","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-12T17:33:44.936180Z"},"links":{"cited_paper":"/paper/2308.13418","citing_paper":"/paper/2411.17835"},"observation_digest":"sha256:c2b24e2e4d86b20912c7013797b6406115a8990ff7dd184b2c5505783f20ce44","observation_id":"4837e81d-6a60-413f-8fe6-24139b5f0700","resolution":{"observed_at":"2026-08-12T17:33:44.936180Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2001.08210","last_updated":"2020-01-23T18:58:48Z","snapshot_observed_at":"2026-08-13T05:32:41.241386Z","submitted_at":"2020-01-22T18:59:17Z","title":"Multilingual Denoising Pre-training for Neural Machine Translation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2001.08210","snapshot_observed_at":"2026-08-12T17:33:44.942126Z","title":"Multilingual Denois- ing Pre-training for Neural Machine Translation,","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2411.17835","last_updated":"2024-11-19T12:09:12Z","snapshot_observed_at":"2026-08-17T23:48:37.921815Z","submitted_at":"2024-11-19T12:09:12Z","title":"Arabic-Nougat: Fine-Tuning Vision Transformers for Arabic OCR and Markdown Extraction","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-12T17:33:44.942126Z"},"links":{"cited_paper":"/paper/2001.08210","citing_paper":"/paper/2411.17835"},"observation_digest":"sha256:9826087051fc4ef870a67082570dcf88d3c70470fb6922c38aafd4f3cfb11c81","observation_id":"ffcd77cc-cc39-43a9-bc5d-c278c9ab6d88","resolution":{"observed_at":"2026-08-12T17:33:44.942126Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.08691","last_updated":"2023-07-17T17:50:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-07-17T17:50:36Z","title":"FlashAttention-2: Faster Attention with Better Parallelism and Work Partitioning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.08691","snapshot_observed_at":"2026-08-12T17:33:44.947796Z","title":"FlashAttention-2: Faster Attention with Better Parallelism and Work Partitioning,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.17835","last_updated":"2024-11-19T12:09:12Z","snapshot_observed_at":"2026-08-17T23:48:37.921815Z","submitted_at":"2024-11-19T12:09:12Z","title":"Arabic-Nougat: Fine-Tuning Vision Transformers for Arabic OCR and Markdown Extraction","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-12T17:33:44.947796Z"},"links":{"cited_paper":"/paper/2307.08691","citing_paper":"/paper/2411.17835"},"observation_digest":"sha256:2e4ed40c8e6a297699970eb66f43d2250485a98882531a6074fde74fefc15aa6","observation_id":"4a69a187-f985-4460-bb32-b18ced067217","resolution":{"observed_at":"2026-08-12T17:33:44.947796Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:33:45.543504Z","title":"LayoutLMv3: Pre-training for Document AI with Unified Text and Image Masking,","venue":null,"work_id":"49fb54c2-3723-4a0e-a7e1-0ed2e060bf3e","year":2022},"citing_paper":{"arxiv_id":"2411.17835","last_updated":"2024-11-19T12:09:12Z","snapshot_observed_at":"2026-08-17T23:48:37.921815Z","submitted_at":"2024-11-19T12:09:12Z","title":"Arabic-Nougat: Fine-Tuning Vision Transformers for Arabic OCR and Markdown Extraction","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-12T17:33:44.953568Z"},"links":{"citing_paper":"/paper/2411.17835"},"observation_digest":"sha256:266a406ff9b52ae626a618f16d103e605e385672a211eb42cd1f252c787eabf8","observation_id":"2d0240c6-d716-49d5-9230-e82ba1663c57","resolution":{"observed_at":"2026-08-12T17:33:45.549158Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:33:45.526731Z","title":"Donut: Document Understand- ing Transformer without OCR,","venue":null,"work_id":"1060cc40-90f0-4c27-b2c0-d0f24f4bc2e5","year":2021},"citing_paper":{"arxiv_id":"2411.17835","last_updated":"2024-11-19T12:09:12Z","snapshot_observed_at":"2026-08-17T23:48:37.921815Z","submitted_at":"2024-11-19T12:09:12Z","title":"Arabic-Nougat: Fine-Tuning Vision Transformers for Arabic OCR and Markdown Extraction","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T17:33:44.959243Z"},"links":{"citing_paper":"/paper/2411.17835"},"observation_digest":"sha256:1a94ff133ba4698bfbfdde71c278dc0ea9a9271c659751287926c8712d9816b4","observation_id":"d1492924-1050-43bb-9927-97c4bf5b8561","resolution":{"observed_at":"2026-08-12T17:33:45.531499Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:33:45.509885Z","title":"DS-YOLOv5: Deformable Single Shot YOLO for Document Parsing,","venue":null,"work_id":"0c43a964-4207-4895-9b88-b110c12249a5","year":2023},"citing_paper":{"arxiv_id":"2411.17835","last_updated":"2024-11-19T12:09:12Z","snapshot_observed_at":"2026-08-17T23:48:37.921815Z","submitted_at":"2024-11-19T12:09:12Z","title":"Arabic-Nougat: Fine-Tuning Vision Transformers for Arabic OCR and Markdown Extraction","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T17:33:44.965533Z"},"links":{"citing_paper":"/paper/2411.17835"},"observation_digest":"sha256:f37ef9f318d58dc08ab57d31996e45de480ffe1997da6b661436f52d4873ed44","observation_id":"d50c3a25-08c4-4cba-a60f-a874ffcd8159","resolution":{"observed_at":"2026-08-12T17:33:45.515172Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:33:45.493282Z","title":"https://www","venue":null,"work_id":"3114c3d8-84e7-4128-859d-38ad8ebb2bb8","year":null},"citing_paper":{"arxiv_id":"2411.17835","last_updated":"2024-11-19T12:09:12Z","snapshot_observed_at":"2026-08-17T23:48:37.921815Z","submitted_at":"2024-11-19T12:09:12Z","title":"Arabic-Nougat: Fine-Tuning Vision Transformers for Arabic OCR and Markdown Extraction","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T17:33:44.971711Z"},"links":{"citing_paper":"/paper/2411.17835"},"observation_digest":"sha256:32201101780d5406660052086c9edb8b07b19ba0ed3a1fd28867862dfa611bd1","observation_id":"a15524d1-9ee4-4cc5-99b0-ea0718fbeaa9","resolution":{"observed_at":"2026-08-12T17:33:45.498479Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:33:45.475107Z","title":"Khatt: An Open Arabic Hand- written Text Database,","venue":null,"work_id":"2e7e7253-8de0-4720-9a21-a2e489200a87","year":2012},"citing_paper":{"arxiv_id":"2411.17835","last_updated":"2024-11-19T12:09:12Z","snapshot_observed_at":"2026-08-17T23:48:37.921815Z","submitted_at":"2024-11-19T12:09:12Z","title":"Arabic-Nougat: Fine-Tuning Vision Transformers for Arabic OCR and Markdown Extraction","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T17:33:44.978031Z"},"links":{"citing_paper":"/paper/2411.17835"},"observation_digest":"sha256:8c8197a36c2326c03896ecee52f3ea5715441652313e5f94e7682893e3266407","observation_id":"2aaf8da5-9c7d-4ca8-9955-24b753052384","resolution":{"observed_at":"2026-08-12T17:33:45.481255Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:33:45.458375Z","title":"PubLayNet: Largest Dataset Ever for Document Layout Analysis,","venue":null,"work_id":"4561235e-e50b-4837-af7d-b8214a730722","year":2019},"citing_paper":{"arxiv_id":"2411.17835","last_updated":"2024-11-19T12:09:12Z","snapshot_observed_at":"2026-08-17T23:48:37.921815Z","submitted_at":"2024-11-19T12:09:12Z","title":"Arabic-Nougat: Fine-Tuning Vision Transformers for Arabic OCR and Markdown Extraction","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T17:33:44.983514Z"},"links":{"citing_paper":"/paper/2411.17835"},"observation_digest":"sha256:f0f66c187f208b6b2757cb2e157e54fdc1763c56785d9a44b438eac0df2997f7","observation_id":"e1f9116e-b8ed-4cde-ba59-916ea9f69792","resolution":{"observed_at":"2026-08-12T17:33:45.464742Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:33:45.441581Z","title":"VisionLAN: Visual Alignment Network for Scene Text Recognition,","venue":null,"work_id":"d6c295bb-78df-4b35-818b-1dc839efc9f5","year":2021},"citing_paper":{"arxiv_id":"2411.17835","last_updated":"2024-11-19T12:09:12Z","snapshot_observed_at":"2026-08-17T23:48:37.921815Z","submitted_at":"2024-11-19T12:09:12Z","title":"Arabic-Nougat: Fine-Tuning Vision Transformers for Arabic OCR and Markdown Extraction","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T17:33:44.988835Z"},"links":{"citing_paper":"/paper/2411.17835"},"observation_digest":"sha256:7307e0ffa9566a5e8c71e5ca07eae229307efe0b0c6d21eb6dd2b5303f717a56","observation_id":"7949b6c3-66a3-48d7-adfd-25d7e54244cd","resolution":{"observed_at":"2026-08-12T17:33:45.447120Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2109.10282","last_updated":"2022-09-06T15:32:48Z","snapshot_observed_at":"2026-08-17T14:12:18.895662Z","submitted_at":"2021-09-21T16:01:56Z","title":"TrOCR: Transformer-based Optical Character Recognition with Pre-trained Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.10282","snapshot_observed_at":"2026-08-12T17:33:44.993280Z","title":"TrOCR: Transformer-based Optical Character Recognition with Pre-trained Mod- els,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.17835","last_updated":"2024-11-19T12:09:12Z","snapshot_observed_at":"2026-08-17T23:48:37.921815Z","submitted_at":"2024-11-19T12:09:12Z","title":"Arabic-Nougat: Fine-Tuning Vision Transformers for Arabic OCR and Markdown Extraction","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T17:33:44.993280Z"},"links":{"cited_paper":"/paper/2109.10282","citing_paper":"/paper/2411.17835"},"observation_digest":"sha256:e21d7774add0857c6ef68235393c1c574cfc5072630d13c3816b6a8431b92074","observation_id":"08ea73c4-027d-46c0-91cf-6eae061111b0","resolution":{"observed_at":"2026-08-12T17:33:44.993280Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:33:45.423384Z","title":"riotu-lab/Aranizer-PBE-86k · Hug- ging Face,","venue":null,"work_id":"febe825d-b614-4be9-867b-5f84274c33c0","year":null},"citing_paper":{"arxiv_id":"2411.17835","last_updated":"2024-11-19T12:09:12Z","snapshot_observed_at":"2026-08-17T23:48:37.921815Z","submitted_at":"2024-11-19T12:09:12Z","title":"Arabic-Nougat: Fine-Tuning Vision Transformers for Arabic OCR and Markdown Extraction","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T17:33:44.998200Z"},"links":{"citing_paper":"/paper/2411.17835"},"observation_digest":"sha256:5b09ce00f331c2acd5704cc1a46dc2237d242d3114fba2d468c81c2aa71be062","observation_id":"d1cd6c35-943e-40ec-9a70-70c31cec0432","resolution":{"observed_at":"2026-08-12T17:33:45.428607Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:33:45.406900Z","title":"MohamedRashad/arabic- img2md · Hugging Face,","venue":null,"work_id":"da83f6cb-b1a3-45bb-9c06-a445eb832754","year":null},"citing_paper":{"arxiv_id":"2411.17835","last_updated":"2024-11-19T12:09:12Z","snapshot_observed_at":"2026-08-17T23:48:37.921815Z","submitted_at":"2024-11-19T12:09:12Z","title":"Arabic-Nougat: Fine-Tuning Vision Transformers for Arabic OCR and Markdown Extraction","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T17:33:45.003126Z"},"links":{"citing_paper":"/paper/2411.17835"},"observation_digest":"sha256:ad30acaa3c753481087c77f6ab4c5228bab35a3dac9a1c7c3424b382232372c5","observation_id":"a89dca2e-939f-40e8-9106-0a630a558da8","resolution":{"observed_at":"2026-08-12T17:33:45.411904Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:33:45.389094Z","title":"MohamedRashad/arabic-books · Hugging Face,","venue":null,"work_id":"bd7cd504-2e7f-49ed-883f-d2c1e9f1f34d","year":null},"citing_paper":{"arxiv_id":"2411.17835","last_updated":"2024-11-19T12:09:12Z","snapshot_observed_at":"2026-08-17T23:48:37.921815Z","submitted_at":"2024-11-19T12:09:12Z","title":"Arabic-Nougat: Fine-Tuning Vision Transformers for Arabic OCR and Markdown Extraction","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T17:33:45.008716Z"},"links":{"citing_paper":"/paper/2411.17835"},"observation_digest":"sha256:7188b2f76b3c68d1da57c7c47c62eb861b3a1572d20429343a3bb6c093c78c30","observation_id":"939a491e-f688-44aa-905d-691e69b057e3","resolution":{"observed_at":"2026-08-12T17:33:45.394303Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:33:45.372495Z","title":"LayoutLM: Pre-training of Text and Layout for Document Image Understanding,","venue":null,"work_id":"0595253d-c619-43b1-8978-d6790ad74bf4","year":2020},"citing_paper":{"arxiv_id":"2411.17835","last_updated":"2024-11-19T12:09:12Z","snapshot_observed_at":"2026-08-17T23:48:37.921815Z","submitted_at":"2024-11-19T12:09:12Z","title":"Arabic-Nougat: Fine-Tuning Vision Transformers for Arabic OCR and Markdown Extraction","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T17:33:45.024606Z"},"links":{"citing_paper":"/paper/2411.17835"},"observation_digest":"sha256:792f3cff7002c1808f6fbe28611f8492bbb079d5b07d469299ae8b77fec39812","observation_id":"dd57a647-5892-484b-ac17-4d54589000e6","resolution":{"observed_at":"2026-08-12T17:33:45.377256Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1909.04948","last_updated":"2019-10-14T09:55:39Z","snapshot_observed_at":"2026-08-14T01:13:04.875715Z","submitted_at":"2019-09-11T09:51:02Z","title":"BERTgrid: Contextualized Embedding for 2D Document Representation and Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.04948","snapshot_observed_at":"2026-08-12T17:33:45.029959Z","title":"BERT- grid: Contextualized Embedding for 2D Document Representation and Understanding,","venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2411.17835","last_updated":"2024-11-19T12:09:12Z","snapshot_observed_at":"2026-08-17T23:48:37.921815Z","submitted_at":"2024-11-19T12:09:12Z","title":"Arabic-Nougat: Fine-Tuning Vision Transformers for Arabic OCR and Markdown Extraction","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-12T17:33:45.029959Z"},"links":{"cited_paper":"/paper/1909.04948","citing_paper":"/paper/2411.17835"},"observation_digest":"sha256:093fc9172305c1a6d70f6d086cd9852cb51b631aa4783e8407a9cd8f90cd6191","observation_id":"1d723a6b-530a-4d01-bb1c-f61f04c7225a","resolution":{"observed_at":"2026-08-12T17:33:45.029959Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:33:45.353388Z","title":"Mathematical Formula Detection in Document Im- ages: A New Dataset and a New Approach,","venue":null,"work_id":"7ce9cc47-08bc-424f-a9db-b90bccd5d6f8","year":2024},"citing_paper":{"arxiv_id":"2411.17835","last_updated":"2024-11-19T12:09:12Z","snapshot_observed_at":"2026-08-17T23:48:37.921815Z","submitted_at":"2024-11-19T12:09:12Z","title":"Arabic-Nougat: Fine-Tuning Vision Transformers for Arabic OCR and Markdown Extraction","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-12T17:33:45.035445Z"},"links":{"citing_paper":"/paper/2411.17835"},"observation_digest":"sha256:9d078c352e54dd0a8c92d884dafcd0e553bb7b95048d4ae741c1f265f80cfc83","observation_id":"07845baa-8c01-4b49-b3d1-87da34a8aad4","resolution":{"observed_at":"2026-08-12T17:33:45.359733Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:33:45.334111Z","title":"OmniParser: A Unified Framework for Text Spotting, Key Information Ex- traction and Table Recognition,","venue":null,"work_id":"ae65db57-8954-437e-9522-e586d75cbdbf","year":2024},"citing_paper":{"arxiv_id":"2411.17835","last_updated":"2024-11-19T12:09:12Z","snapshot_observed_at":"2026-08-17T23:48:37.921815Z","submitted_at":"2024-11-19T12:09:12Z","title":"Arabic-Nougat: Fine-Tuning Vision Transformers for Arabic OCR and Markdown Extraction","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T17:33:45.041287Z"},"links":{"citing_paper":"/paper/2411.17835"},"observation_digest":"sha256:6a975a6d477f9c7898dac9c7f2cb74f05c5c97b81bcffe035f36f046f0a31e25","observation_id":"aef4e67c-eaf9-4782-9954-8ccbdc4f15d6","resolution":{"observed_at":"2026-08-12T17:33:45.340090Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.01704","last_updated":"2024-09-03T08:41:31Z","snapshot_observed_at":"2026-08-18T18:59:18.095701Z","submitted_at":"2024-09-03T08:41:31Z","title":"General OCR Theory: Towards OCR-2.0 via a Unified End-to-end Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.01704","snapshot_observed_at":"2026-08-12T17:33:45.046203Z","title":"General OCR Theory: To- wards OCR-2.0 via a Unified End-to-End Model,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.17835","last_updated":"2024-11-19T12:09:12Z","snapshot_observed_at":"2026-08-17T23:48:37.921815Z","submitted_at":"2024-11-19T12:09:12Z","title":"Arabic-Nougat: Fine-Tuning Vision Transformers for Arabic OCR and Markdown Extraction","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-12T17:33:45.046203Z"},"links":{"cited_paper":"/paper/2409.01704","citing_paper":"/paper/2411.17835"},"observation_digest":"sha256:916e9c01a54a341f41d245f14a1ac0f15172b1539262c75aa931226b942d70dc","observation_id":"8c19a771-7244-4420-8605-7120f2b21645","resolution":{"observed_at":"2026-08-12T17:33:45.046203Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14295","last_updated":"2024-05-23T08:15:49Z","snapshot_observed_at":"2026-08-16T13:50:19.823615Z","submitted_at":"2024-05-23T08:15:49Z","title":"Focus Anywhere for Fine-grained Multi-page Document Understanding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14295","snapshot_observed_at":"2026-08-12T17:33:45.051137Z","title":"Focus Any- where for Fine-Grained Multi-Page Document Under- standing,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.17835","last_updated":"2024-11-19T12:09:12Z","snapshot_observed_at":"2026-08-17T23:48:37.921815Z","submitted_at":"2024-11-19T12:09:12Z","title":"Arabic-Nougat: Fine-Tuning Vision Transformers for Arabic OCR and Markdown Extraction","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-12T17:33:45.051137Z"},"links":{"cited_paper":"/paper/2405.14295","citing_paper":"/paper/2411.17835"},"observation_digest":"sha256:e1395b210e3464f7d116916ea1842f0e472e593d3d8067fa9ba6916cf219286e","observation_id":"8648eb88-2452-4ad1-bacc-481badefaa23","resolution":{"observed_at":"2026-08-12T17:33:45.051137Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05126","last_updated":"2023-10-08T11:33:09Z","snapshot_observed_at":"2026-08-21T09:42:09.574596Z","submitted_at":"2023-10-08T11:33:09Z","title":"UReader: Universal OCR-free Visually-situated Language Understanding with Multimodal Large Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05126","snapshot_observed_at":"2026-08-12T17:33:45.057217Z","title":"Ureader: Universal OCR- Free Visually-Situated Language Understanding with Multimodal Large Language Model,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.17835","last_updated":"2024-11-19T12:09:12Z","snapshot_observed_at":"2026-08-17T23:48:37.921815Z","submitted_at":"2024-11-19T12:09:12Z","title":"Arabic-Nougat: Fine-Tuning Vision Transformers for Arabic OCR and Markdown Extraction","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-12T17:33:45.057217Z"},"links":{"cited_paper":"/paper/2310.05126","citing_paper":"/paper/2411.17835"},"observation_digest":"sha256:a0d28b3c3d0b696c06e94ecc357a9ef81424b8f2c34c45773b86ee49a5d3a28d","observation_id":"66bab495-d4ab-4ccd-b68f-a59783f6139f","resolution":{"observed_at":"2026-08-12T17:33:45.057217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.12895","last_updated":"2024-03-19T16:48:40Z","snapshot_observed_at":"2026-08-16T14:08:19.332089Z","submitted_at":"2024-03-19T16:48:40Z","title":"mPLUG-DocOwl 1.5: Unified Structure Learning for OCR-free Document Understanding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.12895","snapshot_observed_at":"2026-08-12T17:33:45.064176Z","title":"MPLUG-DocOwl 1.5: Unified Struc- ture Learning for OCR-Free Document Understand- ing,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.17835","last_updated":"2024-11-19T12:09:12Z","snapshot_observed_at":"2026-08-17T23:48:37.921815Z","submitted_at":"2024-11-19T12:09:12Z","title":"Arabic-Nougat: Fine-Tuning Vision Transformers for Arabic OCR and Markdown Extraction","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-12T17:33:45.064176Z"},"links":{"cited_paper":"/paper/2403.12895","citing_paper":"/paper/2411.17835"},"observation_digest":"sha256:0d642bd80b86620fd391282b136dcb4508d2fdc123791a7377337e9e294f062f","observation_id":"1111587f-4e5a-4b54-a3ee-6f00151088b8","resolution":{"observed_at":"2026-08-12T17:33:45.064176Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:33:45.313227Z","title":"MPLUG-PaperOwl: Scientific Dia- gram Analysis with the Multimodal Large Language Model,","venue":null,"work_id":"c0ccdf2c-bc01-4a5a-a853-21d7a141d97d","year":2024},"citing_paper":{"arxiv_id":"2411.17835","last_updated":"2024-11-19T12:09:12Z","snapshot_observed_at":"2026-08-17T23:48:37.921815Z","submitted_at":"2024-11-19T12:09:12Z","title":"Arabic-Nougat: Fine-Tuning Vision Transformers for Arabic OCR and Markdown Extraction","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-12T17:33:45.069611Z"},"links":{"citing_paper":"/paper/2411.17835"},"observation_digest":"sha256:453656fed287f677a210661c05b2045c557758a3f7bebedf3ae6d25a09288c9f","observation_id":"441bfc6a-4ae6-47e0-bbbd-f84e4d373c22","resolution":{"observed_at":"2026-08-12T17:33:45.320579Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.03420","last_updated":"2024-09-09T05:36:27Z","snapshot_observed_at":"2026-08-16T13:21:07.303548Z","submitted_at":"2024-09-05T11:09:00Z","title":"mPLUG-DocOwl2: High-resolution Compressing for OCR-free Multi-page Document Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.03420","snapshot_observed_at":"2026-08-12T17:33:45.080377Z","title":"Vary: Scaling Up the Vision V ocabulary for Large Vision-Language Models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.17835","last_updated":"2024-11-19T12:09:12Z","snapshot_observed_at":"2026-08-17T23:48:37.921815Z","submitted_at":"2024-11-19T12:09:12Z","title":"Arabic-Nougat: Fine-Tuning Vision Transformers for Arabic OCR and Markdown Extraction","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-12T17:33:45.080377Z"},"links":{"cited_paper":"/paper/2409.03420","citing_paper":"/paper/2411.17835"},"observation_digest":"sha256:c3f9050a7f2a40bfe2726187327b32a5839ac9dbc1d3db375115f0b633e9dda8","observation_id":"64294183-90b7-46e2-ba21-f46190dd377a","resolution":{"observed_at":"2026-08-12T17:33:45.080377Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2411.17835","last_updated":"2024-11-19T12:09:12Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-17T23:48:37.921815Z","submitted_at":"2024-11-19T12:09:12Z","title":"Arabic-Nougat: Fine-Tuning Vision Transformers for Arabic OCR and Markdown Extraction"},"reference_resolution":{"displayed":24,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":10,"verified_exact":0,"verified_fuzzy":14},"total_outbound_references":24},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"thesis":"As of 22 August 2026, this Paper Citation Record lists 24 of 24 outbound references and 2 inbound Pith citation observations for arXiv:2411.17835."}