{"as_of":"2026-08-09T20:51:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e0c37e37df5887c322eec3d8a0d8a9809f39654571d0ffe8dcce23ad246bb3a1","coverage":[{"denominator":61,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":61,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T23:13:14.037650Z","state":"measured"},{"denominator":63,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":63,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-02T14:47:26.322568Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-02T14:57:03.912343Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"cited_work":{"arxiv_id":"2502.04223","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.04223","snapshot_observed_at":"2026-07-02T14:57:03.912343Z","title":"2502.04223 , archivePrefix=","venue":null,"work_id":"f552926a-d1de-45cc-963d-6515bc6e356c","year":2025},"citing_paper":{"arxiv_id":"2512.20856","last_updated":"2025-12-24T00:24:05Z","snapshot_observed_at":"2026-08-07T14:13:20.121484Z","submitted_at":"2025-12-24T00:24:05Z","title":"NVIDIA Nemotron 3: Efficient and Open Intelligence","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-05-18T01:40:42.190369Z"},"links":{"cited_paper":"/paper/2502.04223","citing_paper":"/paper/2512.20856"},"observation_digest":"sha256:0182aa071e4a1b6956cee90af7d473b4fab0c16de0043a6617eb7299897614cc","observation_id":"a3305fff-7133-48f0-a338-3f8c60f09a65","resolution":{"observed_at":"2026-05-18T01:40:42.413510Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"cited_work":{"arxiv_id":"2502.04223","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.04223","snapshot_observed_at":"2026-07-02T14:57:03.912343Z","title":"2502.04223 , archivePrefix=","venue":null,"work_id":"f552926a-d1de-45cc-963d-6515bc6e356c","year":2025},"citing_paper":{"arxiv_id":"2607.00596","last_updated":"2026-07-01T08:19:00Z","snapshot_observed_at":"2026-08-07T16:45:17.069643Z","submitted_at":"2026-07-01T08:19:00Z","title":"Semantic-Guided Reading Order Reconstruction in Historical Armenian Newspapers with LLMs","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-02T14:47:26.322568Z"},"links":{"cited_paper":"/paper/2502.04223","citing_paper":"/paper/2607.00596"},"observation_digest":"sha256:dd8258b0c60fa35d03bfe04b225edcd41a8d5a8b0cd145880eda2cc4f24da836","observation_id":"9687850a-a79a-47a2-83a6-44853f20b9b7","resolution":{"observed_at":"2026-07-02T14:57:03.913867Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2502.04223/citation-record","integrity":"/paper/2502.04223/integrity","json":"/paper/2502.04223/citation-record.json","paper":"/paper/2502.04223"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:13:14.699091Z","title":"Claude 3: A new era in ai with advanced rea- soning and intelligence","venue":null,"work_id":"1968342b-1de2-4a0a-bdbe-b28a347970b9","year":2024},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:13.802742Z"},"links":{"citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:a9b45707a86ec82fc2b1fab5fd49597003b196213dd6f666b7ac6b2e25d56894","observation_id":"3118311e-b16e-45e0-8b77-ef819f0d83c9","resolution":{"observed_at":"2026-08-08T23:13:14.703780Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:13:14.687403Z","title":"Scenescript: Reconstructing scenes with an autoregressive structured language model, 2024","venue":null,"work_id":"2e3aa9e0-11a0-4b6a-bb13-dab95e6b3b54","year":2024},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:13.807117Z"},"links":{"citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:40d50b7f85bef9f75c133850f3d5433e63afb689b9842eee30ee4c8cf255ca78","observation_id":"95c67552-19fb-459f-8c60-85ea8f45a0ae","resolution":{"observed_at":"2026-08-08T23:13:14.691474Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12966","last_updated":"2023-10-13T02:41:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-24T17:59:17Z","title":"Qwen-VL: A Versatile Vision-Language Model for Understanding, Localization, Text Reading, and Beyond","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12966","snapshot_observed_at":"2026-08-08T23:13:13.811102Z","title":"Qwen-vl: A frontier large vision-language model with versatile abilities","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:13.811102Z"},"links":{"cited_paper":"/paper/2308.12966","citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:22304c256a30de05cb49c62a75783dc939872f3f3af1ecd92d3167c3d3a8fe86","observation_id":"d5ed1554-823f-4f61-b632-dad50925386d","resolution":{"observed_at":"2026-08-08T23:13:13.811102Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:13:14.676315Z","title":"SwinDocSegmenter: An end-to-end unified domain adaptive transformer for document instance segmentation","venue":null,"work_id":"4e55bead-a6dc-4209-9693-82d83ac0b013","year":2023},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:13.815604Z"},"links":{"citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:c20e1f710457f2e5aceeaa871635e72d31525a2ce47760981b2462afffbbed1c","observation_id":"85cf7391-28f2-47c4-b4e9-b7aa0a1a1828","resolution":{"observed_at":"2026-08-08T23:13:14.680186Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:13:13.819387Z","title":"Piqa: Reasoning about physical commonsense in nat- ural language","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:13.819387Z"},"links":{"citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:7d7c396b906c7cfa819dec2fae2fbffb8c5af814deed515e39f8a3a402d34dd1","observation_id":"aa77ff2b-0947-49e6-bcd8-83906fa4f024","resolution":{"observed_at":"2026-08-08T23:13:13.819387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:13:14.657490Z","title":"Nougat: Neural optical understanding for academic documents","venue":null,"work_id":"1ad9d7ce-8b9f-41f8-86de-fabbbd679349","year":2024},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:13.824129Z"},"links":{"citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:7a2aa2d4dd63124c586487a9d8fd467a2bd79a3032d64b22b23c5aa000ad8f8e","observation_id":"70da46ed-252b-4a1c-aada-6806e1c2c2fd","resolution":{"observed_at":"2026-08-08T23:13:14.661315Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.10774","last_updated":"2024-06-14T23:32:32Z","snapshot_observed_at":"2026-07-06T17:17:56.276857Z","submitted_at":"2024-01-19T15:48:40Z","title":"Medusa: Simple LLM Inference Acceleration Framework with Multiple Decoding Heads","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.10774","snapshot_observed_at":"2026-08-08T23:13:13.828407Z","title":"Medusa: Simple llm inference acceleration framework with multiple decod- ing heads","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:13.828407Z"},"links":{"cited_paper":"/paper/2401.10774","citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:4c2fe78cf14d49e08a15e064d2f76976a51c3e73145454799d012f42b8119283","observation_id":"761b8b5d-8d94-4d94-9557-2ec9a3c5c71e","resolution":{"observed_at":"2026-08-08T23:13:13.828407Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2109.10852","last_updated":"2022-03-27T14:44:00Z","snapshot_observed_at":"2026-07-06T11:50:20.455700Z","submitted_at":"2021-09-22T17:26:36Z","title":"Pix2seq: A Language Modeling Framework for Object Detection","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.10852","snapshot_observed_at":"2026-08-08T23:13:13.832416Z","title":"Pix2seq: A language modeling framework for object detection","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:13.832416Z"},"links":{"cited_paper":"/paper/2109.10852","citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:7d99e4712f8c20be9a0b7c0f5b6d58b6b09519460ee14b34661e6e7cfade9229","observation_id":"0c20d5ca-39b0-434b-9b4d-caca9c4e1031","resolution":{"observed_at":"2026-08-08T23:13:13.832416Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.05457","last_updated":"2018-03-14T18:04:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2018-03-14T18:04:21Z","title":"Think you have Solved Question Answering? Try ARC, the AI2 Reasoning Challenge","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.05457","snapshot_observed_at":"2026-08-08T23:13:13.836540Z","title":"Think you have solved question answering? try arc, the ai2 reasoning challenge","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:13.836540Z"},"links":{"cited_paper":"/paper/1803.05457","citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:ae75c0be4206912ae7ca4f41769e6021b3745234f8cf7ae2b8e50ba5d606c56c","observation_id":"111ec44c-e779-4622-af64-ce6e52b73ebf","resolution":{"observed_at":"2026-08-08T23:13:13.836540Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:13:14.645719Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale","venue":null,"work_id":"c6cca6a3-a0bf-4cd6-9c44-ba498795198e","year":2021},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:13.840718Z"},"links":{"citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:12d9984ce82ad935922b30d2d96394cbfcd9e005a7760697ef98fa320b7d9cf9","observation_id":"7693b7ee-aefe-4f50-9a88-1586999a49d9","resolution":{"observed_at":"2026-08-08T23:13:14.649752Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:13:14.633877Z","title":null,"venue":null,"work_id":"2eaf479b-2857-48eb-9505-901a673378cc","year":2024},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:13.844771Z"},"links":{"citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:564fcec99c51b0e36b4265d948d3b2c984e7683abd84b4c5b233d73e11222dc8","observation_id":"a442ef06-bac2-4c24-8bf0-745edb2fb5c9","resolution":{"observed_at":"2026-08-08T23:13:14.637976Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:13:14.622613Z","title":"https : //commoncrawl.org/","venue":null,"work_id":"31103c9e-ee53-4360-a2a7-042b1b644ef5","year":null},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:13.848850Z"},"links":{"citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:e1e2b2f158b9ca309ebf23b45d8f8c53df95a3b4362a1b732a360ca0b81b6fc2","observation_id":"acaeb2dd-5ca8-4c17-b247-b1041a69a59a","resolution":{"observed_at":"2026-08-08T23:13:14.626275Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.19737","last_updated":"2024-04-30T17:33:57Z","snapshot_observed_at":"2026-08-03T23:22:09.849239Z","submitted_at":"2024-04-30T17:33:57Z","title":"Better & Faster Large Language Models via Multi-token Prediction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.19737","snapshot_observed_at":"2026-08-08T23:13:13.852493Z","title":"Better and faster large language models via multi-token prediction","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:13.852493Z"},"links":{"cited_paper":"/paper/2404.19737","citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:020467914d78906d18846f03b62f0e4244bae0b8df059969900ca8b76ff12dcd","observation_id":"3ab2815a-3860-4c02-b4b3-ce349166ef72","resolution":{"observed_at":"2026-08-08T23:13:13.852493Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:13:13.856260Z","title":"Mask r-cnn","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:13.856260Z"},"links":{"citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:497c7a5025091c433af596a850b4795233b74379b60389027d66b3349ff11e53","observation_id":"265bf2de-c961-4aa2-b1cb-3a052122f606","resolution":{"observed_at":"2026-08-08T23:13:13.856260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.03300","last_updated":"2021-01-12T18:57:11Z","snapshot_observed_at":"2026-08-09T10:28:06.906299Z","submitted_at":"2020-09-07T17:59:25Z","title":"Measuring Massive Multitask Language Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.03300","snapshot_observed_at":"2026-08-08T23:13:13.860281Z","title":"Mea- suring massive multitask language understanding","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:13.860281Z"},"links":{"cited_paper":"/paper/2009.03300","citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:9f87b7551657bbc61b87171564516c54184b71dc19b45fce721e5b29007f22ce","observation_id":"bc373523-4b30-4c1a-b5a9-857e201ce650","resolution":{"observed_at":"2026-08-08T23:13:13.860281Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.12895","last_updated":"2024-03-19T16:48:40Z","snapshot_observed_at":"2026-08-07T02:52:27.054968Z","submitted_at":"2024-03-19T16:48:40Z","title":"mPLUG-DocOwl 1.5: Unified Structure Learning for OCR-free Document Understanding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.12895","snapshot_observed_at":"2026-08-08T23:13:13.864169Z","title":"mplug-docowl 1.5: Unified structure learning for ocr-free document understanding","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:13.864169Z"},"links":{"cited_paper":"/paper/2403.12895","citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:2642f3f556632e9ff012ccdd0525d16af62dd90b51c43bb92a509b5cc165ec76","observation_id":"04b58b47-9d1a-454e-a80d-43ac0c108524","resolution":{"observed_at":"2026-08-08T23:13:13.864169Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:13:14.603010Z","title":"mplug-docowl 1.5: Unified structure learning for ocr-free document understanding, 2024","venue":null,"work_id":"425b05dc-0c66-46d8-9611-4744976ba8d2","year":2024},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:13.868193Z"},"links":{"citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:1005f7e7fe6794d2ddc349b28519d8bae9176527d47adb7534e63478a2318a54","observation_id":"842ca28d-c95a-40a7-84a4-2b778a0bda42","resolution":{"observed_at":"2026-08-08T23:13:14.607753Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:13:13.872148Z","title":"Layoutlmv3: Pre-training for document ai with unified text and image masking","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:13.872148Z"},"links":{"citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:6d1fa04c3af437627d8a10e9192904ad3d74602d4cde54aa90e265d3c4438aa9","observation_id":"4f0977c3-1a8d-4bcb-ae0f-aa9671886d38","resolution":{"observed_at":"2026-08-08T23:13:13.872148Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:13:14.585352Z","title":"Pymupdf4llm: A python package for extracting pdf content in markdown format, 2024","venue":null,"work_id":"47f27fdf-7572-479e-b958-71468a711235","year":2024},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:13.876076Z"},"links":{"citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:7f8cbad0c25cf6a3a2c7314c0acba16cda8cb4ec387efc1ff7748959dff476f6","observation_id":"a0a776e1-362b-417c-af0c-c644eeb2ce96","resolution":{"observed_at":"2026-08-08T23:13:14.589359Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:13:14.573932Z","title":"Ultralytics yolov5, 2020","venue":null,"work_id":"705af28e-2cc6-4002-85fb-1ea42041fdb9","year":2020},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:13.879582Z"},"links":{"citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:6a604cc29005ebd31c90532c48624a197b136c65bac96ba1af6c3e2aa6411b34","observation_id":"b7f70327-ae7b-41d8-a0b0-192cbdc43cda","resolution":{"observed_at":"2026-08-08T23:13:14.578466Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:13:14.563706Z","title":"Weld, and Luke Zettle- moyer","venue":null,"work_id":"3e411808-38f4-48b9-a672-ad726540ac49","year":2017},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:13.883069Z"},"links":{"citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:02fa481e50d3ad95235df477550ff5475e1100e5b10b149561e833cbf3f7a35d","observation_id":"946ce2dd-eccb-4db3-8914-3f7bccd5899e","resolution":{"observed_at":"2026-08-08T23:13:14.567308Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1909.05858","last_updated":"2019-09-20T20:08:56Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2019-09-11T17:57:18Z","title":"CTRL: A Conditional Transformer Language Model for Controllable Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.05858","snapshot_observed_at":"2026-08-08T23:13:13.886466Z","title":"Ctrl: A condi- tional transformer language model for controllable genera- tion","venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:13.886466Z"},"links":{"cited_paper":"/paper/1909.05858","citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:4df7f1e943080583f7a247042a7ee4394c1cc9ec673eaf29a724816eb1498181","observation_id":"0d7c3f1c-d4eb-485c-9231-469cd1e1066f","resolution":{"observed_at":"2026-08-08T23:13:13.886466Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:13:14.553382Z","title":"Ocr-free document understanding transformer","venue":null,"work_id":"905c73a0-cc7b-4698-8604-68c5792c4582","year":2022},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:13.890221Z"},"links":{"citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:5663228957033df6722c9a9c799f5f05a74c236634c9496c7eb0c022a824f2b1","observation_id":"4a0cc075-d107-4429-b1f0-6fcdaaf60823","resolution":{"observed_at":"2026-08-08T23:13:14.557026Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:13:14.542366Z","title":"The stack: 3 tb of permissively licensed source code","venue":null,"work_id":"7fb4da8e-1265-49a5-b5e1-c1dba2400f5e","year":null},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:13.893743Z"},"links":{"citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:c086ec447a82e565d23f188d15e4e82d0dbca99e4a28b8a0145cff910ce84c2e","observation_id":"cb81aa4e-0570-418a-9d2d-c9c56601c720","resolution":{"observed_at":"2026-08-08T23:13:14.546446Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1704.04683","last_updated":"2017-12-05T19:36:03Z","snapshot_observed_at":"2026-08-07T10:40:47.462532Z","submitted_at":"2017-04-15T19:31:41Z","title":"RACE: Large-scale ReAding Comprehension Dataset From Examinations","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1704.04683","snapshot_observed_at":"2026-08-08T23:13:13.897557Z","title":"Race: Large-scale reading com- prehension dataset from examinations","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:13.897557Z"},"links":{"cited_paper":"/paper/1704.04683","citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:6e6737c27ee85412339e360253b63e8651388caf66a321c962f849c4d2b6f1bc","observation_id":"b9ef5926-bbef-44ce-9d62-d9374bc252e7","resolution":{"observed_at":"2026-08-08T23:13:13.897557Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14295","last_updated":"2024-05-23T08:15:49Z","snapshot_observed_at":"2026-08-08T11:06:53.281288Z","submitted_at":"2024-05-23T08:15:49Z","title":"Focus Anywhere for Fine-grained Multi-page Document Understanding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14295","snapshot_observed_at":"2026-08-08T23:13:13.901378Z","title":"Focus anywhere for fine- grained multi-page document understanding","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:13.901378Z"},"links":{"cited_paper":"/paper/2405.14295","citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:fa3fbefb4a6d5f1c66debd7e734c5775a8094c94f322b3ad1aba8b45c2ad3d7d","observation_id":"1a4b1f9e-f32f-41a7-83f7-f897e90c8686","resolution":{"observed_at":"2026-08-08T23:13:13.901378Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:13:14.532031Z","title":"Focus anywhere for fine-grained multi-page document understanding, 2024","venue":null,"work_id":"0899f148-8a56-4124-801b-47e6dc16f383","year":2024},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:13.906162Z"},"links":{"citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:ab4570f9ae2f335c7f67150e7cf3cbe965d51753ca5682bd0aa640cad5d6922d","observation_id":"cf1114d1-38cb-41ad-a496-1dd3528849ce","resolution":{"observed_at":"2026-08-08T23:13:14.535757Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:13:14.519916Z","title":"Multilingual denoising pre-training for neu- ral machine translation","venue":null,"work_id":"1dc17c1c-6791-4698-ab8c-96811983f85a","year":2020},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:13.910131Z"},"links":{"citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:089306c34c78c0e6d1afcd2683a4b413718986d9d449e539ac8c70846a7e5941","observation_id":"3a755a83-6984-4564-98bf-8248fb16dd0e","resolution":{"observed_at":"2026-08-08T23:13:14.524845Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04473","last_updated":"2024-03-15T06:51:30Z","snapshot_observed_at":"2026-08-09T20:40:14.205704Z","submitted_at":"2024-03-07T13:16:24Z","title":"TextMonkey: An OCR-Free Large Multimodal Model for Understanding Document","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04473","snapshot_observed_at":"2026-08-08T23:13:13.913693Z","title":"Textmonkey: An ocr-free large multimodal model for understanding document","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:13.913693Z"},"links":{"cited_paper":"/paper/2403.04473","citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:5549415f2f3d8a8e8ed2ab4790105689b0af112667c624bdc6c00eb6359b2991","observation_id":"b6c8fc8b-a0b1-416b-ad9e-489219011128","resolution":{"observed_at":"2026-08-08T23:13:13.913693Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-08-09T20:34:52.923500Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-08T23:13:13.917542Z","title":"Decoupled weight decay regularization","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:13.917542Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:fca21580ad139f28398452972b3f038893a4c3780e2d8e76bcf362d19b278c10","observation_id":"def0c897-3751-4ce6-98a2-66a66499659c","resolution":{"observed_at":"2026-08-08T23:13:13.917542Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.11419","last_updated":"2024-08-21T16:54:23Z","snapshot_observed_at":"2026-08-02T15:31:34.622625Z","submitted_at":"2023-09-20T15:50:08Z","title":"KOSMOS-2.5: A Multimodal Literate Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.11419","snapshot_observed_at":"2026-08-08T23:13:13.922039Z","title":"Kosmos-2.5: A multimodal literate model","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:13.922039Z"},"links":{"cited_paper":"/paper/2309.11419","citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:8110baf3a6ae16fbf76a850d13cf90b45f95cb40e7f835dccf324e2d75cc86c0","observation_id":"f092e221-6002-4759-95c0-d245e880bfbc","resolution":{"observed_at":"2026-08-08T23:13:13.922039Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1809.02789","last_updated":"2018-09-08T11:47:16Z","snapshot_observed_at":"2026-08-08T02:19:52.596062Z","submitted_at":"2018-09-08T11:47:16Z","title":"Can a Suit of Armor Conduct Electricity? A New Dataset for Open Book Question Answering","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1809.02789","snapshot_observed_at":"2026-08-08T23:13:13.925841Z","title":"Can a suit of armor conduct electricity? a new dataset for open book question answering","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:13.925841Z"},"links":{"cited_paper":"/paper/1809.02789","citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:aec629af845fe855d221bed4effbf0184f06b4068cc93c68c9fb7ba91ec92c52","observation_id":"a7a868ab-1734-46ef-857a-ac45143744a0","resolution":{"observed_at":"2026-08-08T23:13:13.925841Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:13:14.507518Z","title":"Tableformer: Table structure understanding with transformers","venue":null,"work_id":"221fb39f-d363-415d-8ffa-6cd0daa53513","year":2022},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:13.929852Z"},"links":{"citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:4d489d53fbb84e1e9a360fbc706090a2995ef05fb01e509c911f615e1850a131","observation_id":"d62fa345-f764-4300-85f4-ef502d89864b","resolution":{"observed_at":"2026-08-08T23:13:14.511696Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:13:14.495779Z","title":null,"venue":null,"work_id":"cf195e1c-a0da-4ad7-a14a-fa7af67cb1a4","year":null},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:13.933631Z"},"links":{"citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:067a7ea112be83a2ff5726714b36c42faf0a67b84115a84b9a85e67f36bbea2c","observation_id":"eeaee289-511e-4cdb-a620-94bc6e26945f","resolution":{"observed_at":"2026-08-08T23:13:14.499770Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:13:14.484884Z","title":"String normalization","venue":null,"work_id":"5eaf06d1-acb6-4cf4-b878-ba8f6c75f748","year":null},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:13.938476Z"},"links":{"citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:c18cb93ab70f8121dc6b7e2660f321d132de80faa2b875384d0190c03d98aca3","observation_id":"fa3033c3-f7d3-4c2e-8c42-10c80025a3d3","resolution":{"observed_at":"2026-08-08T23:13:14.488520Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:13:14.473905Z","title":"GPT-4o: Large language model","venue":null,"work_id":"c7988d6f-ed2a-4ca3-b7a4-d9e6aabe8b63","year":2024},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:13.942459Z"},"links":{"citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:bce6ab49f878e48ea955e4df8715450c1707e93b01ee7549e7ab3206005a5997","observation_id":"4eaf5abb-62ca-4864-92bd-b49a1c364312","resolution":{"observed_at":"2026-08-08T23:13:14.477615Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:13:14.462918Z","title":"A universal document converter","venue":null,"work_id":"9a8b3fb6-7dfc-441c-86cd-b9202d6f52d2","year":null},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:13.945987Z"},"links":{"citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:5817c7f08aed9794b0254922cba9f32f07d52f73b204599476c015cad0e8175a","observation_id":"e6d8d86a-a01f-426e-9211-744302daf415","resolution":{"observed_at":"2026-08-08T23:13:14.466545Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:13:14.450974Z","title":"Nemotron-4 15b technical report,","venue":null,"work_id":"b9218f18-b44c-4072-8a43-4abbdd1a9140","year":null},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:13.949574Z"},"links":{"citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:7f11b5c66fc8e13c203103dc2f240be10e5ba296827e71a4c5797809c95bb3a3","observation_id":"c6d90306-d240-463e-bead-770b508a264d","resolution":{"observed_at":"2026-08-08T23:13:14.454600Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06786","last_updated":"2023-10-10T16:57:28Z","snapshot_observed_at":"2026-08-02T22:16:20.939859Z","submitted_at":"2023-10-10T16:57:28Z","title":"OpenWebMath: An Open Dataset of High-Quality Mathematical Web Text","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06786","snapshot_observed_at":"2026-08-08T23:13:13.953269Z","title":"Openwebmath: An open dataset of high-quality mathematical web text","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:13.953269Z"},"links":{"cited_paper":"/paper/2310.06786","citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:da5fc4a42ff7257210251e3b5a972fdba854369796bbea928a90bf29d3afe893","observation_id":"a90df86d-7144-4288-98f7-27e0f686e828","resolution":{"observed_at":"2026-08-08T23:13:13.953269Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:13:14.440192Z","title":"DocLayNet: A large human- annotated dataset for document-layout segmentation","venue":null,"work_id":"793768dd-8085-448d-b613-e7fcf308e3a8","year":2022},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:13.957679Z"},"links":{"citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:392b3c0837e0988ca5780072f1d05c147954955e22ada08fbc83e2c0f397f4ac","observation_id":"db06cc08-7603-4cc4-96f8-abd109768e22","resolution":{"observed_at":"2026-08-08T23:13:14.443871Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:13:14.428980Z","title":"Source code for nltk.metrics.scores","venue":null,"work_id":"31fcce00-5bd1-4a37-b890-b6cfbef69aca","year":null},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:13.961153Z"},"links":{"citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:de04a5f24a2099705d9c7b4885b89d5931b07db7d1e1ae2ec70c876a745a5ffa","observation_id":"0f29857f-c5fe-4042-9bfb-9de6ae2c521c","resolution":{"observed_at":"2026-08-08T23:13:14.432750Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:13:14.418068Z","title":"AM-RADIO: Agglomerative vision founda- tion model reduce all domains into one","venue":null,"work_id":"1b38cbf0-8175-4dc8-b572-1d3d649a6f44","year":2024},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:13.965567Z"},"links":{"citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:3600d92f5345c4b94d9e5118af4b09e8a005be39f9a4f64dfc8c3453b25b0701","observation_id":"09a7165b-020d-4c76-8c2e-31e48e7fb6cf","resolution":{"observed_at":"2026-08-08T23:13:14.421851Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:13:14.406243Z","title":"Faster r-cnn: Towards real-time object detection with region proposal networks","venue":null,"work_id":"d437cdcc-e88c-497e-9e50-d0ceb68a07d8","year":2016},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:13.970199Z"},"links":{"citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:1aef48589812c0048ab2e38bf3f16c8053f7cdb2f12ef2226991d537c12ceab2","observation_id":"c12a00df-869d-49f6-93cc-553572bc8479","resolution":{"observed_at":"2026-08-08T23:13:14.410365Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:13:13.973635Z","title":"Winogrande: An adversarial winograd schema challenge at scale","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:13.973635Z"},"links":{"citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:8ee0b5e483caba77ceef49b5bb869ef197c947bf85a62d238833491d7d308876","observation_id":"4ada570c-c4e9-42aa-b513-0fbc1afa70bb","resolution":{"observed_at":"2026-08-08T23:13:13.973635Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:13:14.389424Z","title":"Statistics of the Common Crawl Corpus 2012, 2013","venue":null,"work_id":"da66815d-3f59-445d-a317-3d927186f582","year":2012},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:13.977239Z"},"links":{"citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:4d89a72ce2e63bd0aa96436f661f009ed7cfbaae50b865a8b5462b20540fa82c","observation_id":"758c2487-8eb1-4e2e-ba41-5736b07349cc","resolution":{"observed_at":"2026-08-08T23:13:14.393002Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:13:14.378607Z","title":"An overview of the tesseract ocr engine","venue":null,"work_id":"b0573a38-70e5-44fa-b266-1e73cbb5925d","year":2007},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:13.980622Z"},"links":{"citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:5f0c35236eb6ca15f250a28e67750957be3e335070771aa82edf50e055a2f3d7","observation_id":"e33fe1c6-3f8a-45e2-9a27-8790e2be5fd4","resolution":{"observed_at":"2026-08-08T23:13:14.382584Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:13:14.368309Z","title":"Galactica: A large language model for science, 2022","venue":null,"work_id":"0c0d3418-4687-4b73-830c-fe0dbd9d4b89","year":2022},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:13.984256Z"},"links":{"citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:70a9b78a3b240568fd0bffbf013353bc68d09b8ea0daf38e8ac9c76dce4becca","observation_id":"4b6d7446-1ecb-498e-a229-b51f6c8634b1","resolution":{"observed_at":"2026-08-08T23:13:14.372132Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:13:14.357810Z","title":null,"venue":null,"work_id":"d84af48e-9efb-4862-9c20-be4465de2a10","year":2024},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:13.987891Z"},"links":{"citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:be49bc3e36ed43940022f33b86c26f9136a31cbbb9a3b0e649cecc6f857f204b","observation_id":"f3064b2c-e6fd-4c5d-937e-52b4650f38d2","resolution":{"observed_at":"2026-08-08T23:13:14.361614Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:13:14.346747Z","title":null,"venue":null,"work_id":"b7e24f3a-df74-4d56-8fd0-56f2ed680a02","year":2007},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:13.992034Z"},"links":{"citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:4e4dcc52cdd138fb41baad0f465988144c8096301913680b50145905767492fd","observation_id":"e28dcc4b-e213-460d-b572-f5bdfa76b019","resolution":{"observed_at":"2026-08-08T23:13:14.350550Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:13:14.335680Z","title":"Vary: Scaling up the vision vocabulary for large vision-language models, 2023","venue":null,"work_id":"ef7ac9a4-5046-4eac-8dd5-29a00064534d","year":2023},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:13.995547Z"},"links":{"citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:d2c88b36787df15c905d88e8b9eb519dbfba010e3ba0a4e8dcbef20c40599091","observation_id":"dcdfcc8c-3a46-4765-9e12-2256c080bb52","resolution":{"observed_at":"2026-08-08T23:13:14.339596Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:13:14.324326Z","title":"Small language model meets with reinforced vision vocabu- lary, 2024","venue":null,"work_id":"7cc00367-734b-4ce2-bdff-0dcd0c98df84","year":2024},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:13.999909Z"},"links":{"citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:9aa81c36b07c95f50613a00bf2b00028972b0f964a79b4f462dfda4314570769","observation_id":"e8bd9d44-731c-4b9f-84f5-b561b55654bd","resolution":{"observed_at":"2026-08-08T23:13:14.328436Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.01704","last_updated":"2024-09-03T08:41:31Z","snapshot_observed_at":"2026-08-08T22:58:25.892839Z","submitted_at":"2024-09-03T08:41:31Z","title":"General OCR Theory: Towards OCR-2.0 via a Unified End-to-end Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.01704","snapshot_observed_at":"2026-08-08T23:13:14.003979Z","title":"General OCR theory: Towards OCR-2.0 via a unified end-to-end model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:14.003979Z"},"links":{"cited_paper":"/paper/2409.01704","citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:93ee202ceb092c1c0c3ab321092941667778b2d48dd0ccb8a52e98db19367fdd","observation_id":"b43f16ab-e725-4eaf-bf37-13af65de50bd","resolution":{"observed_at":"2026-08-08T23:13:14.003979Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1905.07830","last_updated":"2019-05-19T23:57:23Z","snapshot_observed_at":"2026-07-31T00:09:56.948833Z","submitted_at":"2019-05-19T23:57:23Z","title":"HellaSwag: Can a Machine Really Finish Your Sentence?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1905.07830","snapshot_observed_at":"2026-08-08T23:13:14.007821Z","title":"Hellaswag: Can a machine really finish your sentence? arXiv preprint arXiv:1905.07830, 2019","venue":null,"work_id":null,"year":1905},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:14.007821Z"},"links":{"cited_paper":"/paper/1905.07830","citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:32c80634104cc2e3a71013e65446723ef876aff2d0718c9e550e2af9ab3a15c5","observation_id":"49a5a653-bf1f-4b17-ad5a-ba1a8470d580","resolution":{"observed_at":"2026-08-08T23:13:14.007821Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:13:14.312519Z","title":null,"venue":null,"work_id":"6684b114-3807-45d3-9340-60d4216b1276","year":null},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:14.012221Z"},"links":{"citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:5fd3fe1c54dd44ab51fb6d5abad7b25cba12e86d1aaf0b4caf8adf7ad2907429","observation_id":"7ece616a-5bc6-4eb9-94a3-1d42a62c8da3","resolution":{"observed_at":"2026-08-08T23:13:14.316996Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:13:14.300312Z","title":"Identical scores (as in our case) lead to incorrect PR- Curves and inconsistent results","venue":null,"work_id":"c6a20fae-9c15-4e6d-85df-fa199d362bdf","year":null},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:14.015813Z"},"links":{"citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:8182b9f10346cb4e6c06b96499ca55a3db88395d7931c1db9d90376e1dd54cc6","observation_id":"191565a5-7d2c-4f98-a299-e0e2e88f2e62","resolution":{"observed_at":"2026-08-08T23:13:14.305070Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:13:14.287758Z","title":"first separate classes, then match boxes)","venue":null,"work_id":"0c816280-c389-4c02-9db7-23a7fde60916","year":null},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:14.019511Z"},"links":{"citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:0d730dc138f911cbade8391fd2e4d0017a058655cac6f86c3621f630a3a1aeb2","observation_id":"bb576429-7620-4a3b-a0d1-c3dbfd4b8a51","resolution":{"observed_at":"2026-08-08T23:13:14.291895Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:13:14.274457Z","title":"To manage paragraphs that span across pages, we need to carry open paragraphs over to next pages","venue":null,"work_id":"ee4eae54-5c45-4a9c-9c66-201f356efc8d","year":null},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:14.023135Z"},"links":{"citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:3f939ded37de9b39debc3c5aa26c3047478d153abef8dbfdc90868270288fc3e","observation_id":"ee7fd8b9-7eb8-449b-834a-814c1583fd79","resolution":{"observed_at":"2026-08-08T23:13:14.278767Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:13:14.263697Z","title":null,"venue":null,"work_id":"f8dd0039-21ae-462b-9613-54870060f2cd","year":null},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:14.026953Z"},"links":{"citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:46867adabf75645d4ee47125fd67672e64f875468b9f9c549296d5037accc1bd","observation_id":"25f2f5e9-0364-4d21-9594-7eeac941f433","resolution":{"observed_at":"2026-08-08T23:13:14.267125Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:13:14.251802Z","title":"Floating text blocks (e.g., Text and List-item) are merged based on specific rules, such as not ending with punctuation","venue":null,"work_id":"3bcde673-2b0a-4712-afd1-0ec8a29821be","year":null},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:14.030759Z"},"links":{"citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:2c6199e969f99335d0e86eaffd96e22e9d7999f696c59c6b31530ce7042c62d6","observation_id":"c4886ca4-1a6e-4655-934f-5d7103f2ff77","resolution":{"observed_at":"2026-08-08T23:13:14.256285Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:13:14.241454Z","title":null,"venue":null,"work_id":"852de959-541c-4f41-8e24-bc9cea160830","year":null},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:14.034206Z"},"links":{"citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:921fbce9bd6ada47f2c7911c0957dfafc811db5001006401b67643799aa3aa72","observation_id":"cc1d955f-ed6e-4428-bf8c-573a6bb3b3b9","resolution":{"observed_at":"2026-08-08T23:13:14.244837Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T23:13:14.229124Z","title":null,"venue":null,"work_id":"97da52bf-0898-4c11-803d-86383430e108","year":null},"citing_paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-08T23:13:14.037650Z"},"links":{"citing_paper":"/paper/2502.04223"},"observation_digest":"sha256:04f52488862ce83cfd4a00281d294cf9fff839f23bb0cc8106ac9c2bdf530899","observation_id":"5f970aeb-a7f4-403f-9bc2-e60f19edd660","resolution":{"observed_at":"2026-08-08T23:13:14.233989Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2502.04223","last_updated":"2025-02-06T17:07:22Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-09T18:50:27.207341Z","submitted_at":"2025-02-06T17:07:22Z","title":"\\'Eclair -- Extracting Content and Layout with Integrated Reading Order for Documents"},"reference_resolution":{"displayed":61,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":29,"verified_exact":0,"verified_fuzzy":32},"total_outbound_references":61},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 61 of 61 outbound references and 2 inbound Pith citation observations for arXiv:2502.04223."}