{"as_of":"2026-08-09T15:41:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ada8aeb752ba6b4afecd0e118682f440f678ef81f67e8eaccee3a9ed5b7a8533","coverage":[{"denominator":60,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":60,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T19:21:45.433810Z","state":"measured"},{"denominator":60,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":60,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.05805/citation-record","integrity":"/paper/2507.05805/integrity","json":"/paper/2507.05805/citation-record.json","paper":"/paper/2507.05805"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:46.378756Z","title":"Combining visual and textual features for semantic segmentation of historical newspapers","venue":null,"work_id":"084e9f09-c6f8-4298-be11-637996819905","year":2021},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.158071Z"},"links":{"citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:9a8d302e3a398ae382af85f20cf7705323923c408f9876068afe47320c897298","observation_id":"948b190c-efde-4fe5-917b-8aba8975e703","resolution":{"observed_at":"2026-08-06T19:21:46.385820Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.13418","last_updated":"2023-08-25T15:03:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-25T15:03:36Z","title":"Nougat: Neural Optical Understanding for Academic Documents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.13418","snapshot_observed_at":"2026-08-06T19:21:45.163193Z","title":"Nougat: Neural optical understanding for academic documents","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.163193Z"},"links":{"cited_paper":"/paper/2308.13418","citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:57fcbf3705f5033ee0bec65f25039457747ce679a68f4bf68431694b23cfc28b","observation_id":"89ac4112-0f79-442d-896d-93cb45d76f9a","resolution":{"observed_at":"2026-08-06T19:21:45.163193Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:46.364646Z","title":"End-to- end object detection with transformers","venue":null,"work_id":"95aad45c-6eaf-41be-a975-fa3c05380a88","year":2020},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.167713Z"},"links":{"citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:af1b4892e5d267de553401491bc868dfb9336b01ac7080ebb32b3bda0ebbeb90","observation_id":"e0b7a83e-0167-404f-af00-c70967787c96","resolution":{"observed_at":"2026-08-06T19:21:46.369215Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:46.350186Z","title":"Geometric layout analysis techniques for document image understanding: a review","venue":null,"work_id":"4a60b71c-6295-44cf-b7e8-e1b84ef5cd35","year":1998},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.172447Z"},"links":{"citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:b592bf13de39a31c4a498c13c04ecf5f219bb6eab8580b1cc6976aa84b1f4378","observation_id":"90ffb8e8-8a3c-4c74-b41d-dae52c3d625f","resolution":{"observed_at":"2026-08-06T19:21:46.354795Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:46.334201Z","title":"M6doc: A large-scale multi-format, multi-type, multi- layout, multi-language, multi-annotation category dataset for modern document layout analysis","venue":null,"work_id":"ca765be6-3ac9-4a1b-a229-0b454dba4d1f","year":2023},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.176529Z"},"links":{"citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:10eee8e2ce2d79986609ad0d436c57a78a6856bbe9248086e236c757000ea2e3","observation_id":"17cbca11-2ae1-43b7-96dc-a2d7393bb4fb","resolution":{"observed_at":"2026-08-06T19:21:46.339732Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1908.04729","last_updated":"2019-08-28T16:24:53Z","snapshot_observed_at":"2026-07-06T08:14:10.191646Z","submitted_at":"2019-08-13T16:47:08Z","title":"Complicated Table Structure Recognition","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1908.04729","snapshot_observed_at":"2026-08-06T19:21:45.180847Z","title":"Complicated table structure recognition","venue":null,"work_id":null,"year":1908},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.180847Z"},"links":{"cited_paper":"/paper/1908.04729","citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:584e089486888b1cd7ee90f799cbccaee2c16617a58b4a781ad175a6334c6d92","observation_id":"8532636a-818a-4d78-824a-83f8a3fdff7b","resolution":{"observed_at":"2026-08-06T19:21:45.180847Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:46.316347Z","title":"Vision grid transformer for document layout analysis","venue":null,"work_id":"09b640d8-0d11-4ea1-b134-755647f149b0","year":2023},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.185526Z"},"links":{"citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:af9248a197541df08b36aedcd885351194233035f94fa72fafe050b5eddb2cbc","observation_id":"628a2aa3-bc84-44f6-91ca-f0f79ea295ab","resolution":{"observed_at":"2026-08-06T19:21:46.322172Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:46.299644Z","title":"Image-to-markup generation with coarse-to- fine attention","venue":null,"work_id":"902ff5de-4851-40d5-95bb-618e643030c2","year":2017},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.190217Z"},"links":{"citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:8fa38bb527b59d055220db373ae174b1d3ce8589a37e8dad839f874e0e442351","observation_id":"04fe99a1-ee56-4185-a223-76b243e10f28","resolution":{"observed_at":"2026-08-06T19:21:46.304682Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04805","last_updated":"2019-05-24T20:37:26Z","snapshot_observed_at":"2026-07-30T09:12:38.100527Z","submitted_at":"2018-10-11T00:50:01Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.04805","snapshot_observed_at":"2026-08-06T19:21:45.194076Z","title":"Bert: Pre-training of deep bidirectional transformers for language understanding","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.194076Z"},"links":{"cited_paper":"/paper/1810.04805","citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:ef4c124da479a712b31bf78b43e0d45f8c65b8482aca7d497b028fd14f00234c","observation_id":"2179ac71-6c26-4a9f-9fe6-51ec98aa41af","resolution":{"observed_at":"2026-08-06T19:21:45.194076Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.09941","last_updated":"2020-10-15T14:21:53Z","snapshot_observed_at":"2026-07-06T09:57:27.039262Z","submitted_at":"2020-09-21T14:57:18Z","title":"PP-OCR: A Practical Ultra Lightweight OCR System","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.09941","snapshot_observed_at":"2026-08-06T19:21:45.198838Z","title":"Pp-ocr: A practical ultra lightweight ocr system","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.198838Z"},"links":{"cited_paper":"/paper/2009.09941","citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:4d061977eef7cbec36711c2b571c3d8e97acc1fa0a88fe428a59c88125ceb805","observation_id":"37b94c75-fb2a-4d87-a428-78a78f1f1458","resolution":{"observed_at":"2026-08-06T19:21:45.198838Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.11592","last_updated":"2023-09-02T04:28:42Z","snapshot_observed_at":"2026-08-08T00:41:35.971349Z","submitted_at":"2023-08-19T17:32:34Z","title":"UniDoc: A Universal Large Multimodal Model for Simultaneous Text Detection, Recognition, Spotting and Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.11592","snapshot_observed_at":"2026-08-06T19:21:45.203139Z","title":"Unidoc: A uni- versal large multimodal model for simultaneous text detec- tion, recognition, spotting and understanding","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.203139Z"},"links":{"cited_paper":"/paper/2308.11592","citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:cb58da5d15739d3b1235af6c96867d9f94bb1abd46303da901a3ba2710891dac","observation_id":"d4ed33a4-f251-4927-860b-22ed8db00373","resolution":{"observed_at":"2026-08-06T19:21:45.203139Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:46.283837Z","title":"Icdar 2013 table competition","venue":null,"work_id":"43cbdecc-ec8d-402e-a98a-bda969eb33b8","year":2013},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.208059Z"},"links":{"citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:ad45efa3e86a09b9bdeede4210e34e962d7e92a9d7719a4db790c06d1bdffe69","observation_id":"4c6f9bfb-a128-4b72-90b3-cd29544d28b6","resolution":{"observed_at":"2026-08-06T19:21:46.289101Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:46.266948Z","title":"Re- cursive xy cut using bounding boxes of connected compo- nents","venue":null,"work_id":"82fd7008-4173-4ec3-9209-a74d9f3dcf11","year":null},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.212790Z"},"links":{"citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:5f029c303e6124cecbff69102f02dc2fce9cf074afba3cd8d53fb53cea5d4213","observation_id":"fd3ef7da-a236-4e79-958b-192b9ab1e574","resolution":{"observed_at":"2026-08-06T19:21:46.272584Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:46.250356Z","title":"Mask r-cnn","venue":null,"work_id":"bba5f623-01f3-4ac7-9ec0-caa12ac94e7e","year":2017},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.218386Z"},"links":{"citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:c504eb45554ddfe2532b3317f20566627afa4073f41e8939756af8bf553cedf9","observation_id":"2c64b31b-bdce-4e0f-9279-9673e6c6cdd7","resolution":{"observed_at":"2026-08-06T19:21:46.255281Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:46.234927Z","title":"Swintextspotter: Scene text spotting via bet- ter synergy between text detection and text recognition","venue":null,"work_id":"e4ab9286-b204-462f-93b0-3972967f7e84","year":2022},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.223564Z"},"links":{"citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:bc90e1611473f68ba76fa44ff8bf9c12a93399aba81e664e92771641a7f09b06","observation_id":"dd64e4d4-3f8f-4f67-bb69-952210127488","resolution":{"observed_at":"2026-08-06T19:21:46.239712Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:45.228087Z","title":"Layoutlmv3: Pre-training for document ai with unified text and image masking","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.228087Z"},"links":{"citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:e556dfb7ce9f7c1316e5ad1f07bcc076e641303dac5cd80f3f7822019c576178","observation_id":"3a77adf8-258e-4afe-bdbd-0aecd712a56b","resolution":{"observed_at":"2026-08-06T19:21:45.228087Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:46.209483Z","title":"Improving table structure recognition with visual-alignment sequential coordinate modeling","venue":null,"work_id":"9d0e2bb3-3063-41e8-ae01-ff85003858c8","year":2023},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.232778Z"},"links":{"citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:3fa499f6e60d9538aa3029f525f207f2c6606e16046b1efeb17012788fde2684","observation_id":"a11b6919-5d65-4296-927c-f7cc0836588e","resolution":{"observed_at":"2026-08-06T19:21:46.214335Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:46.195172Z","title":"Icdar2019 compe- tition on scanned receipt ocr and information extraction","venue":null,"work_id":"5bb2351b-c0ca-4601-a214-a9eb697e429c","year":2019},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.237325Z"},"links":{"citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:39c397f1137e4276c389fd83b797ba50ceb56f701439a2cff2a8fb4f067ff6f6","observation_id":"9b2445af-2dc2-49d8-bc38-318f8e9b38cb","resolution":{"observed_at":"2026-08-06T19:21:46.199871Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:46.180318Z","title":"Document transformation system from pa- pers to xml data based on pivot xml document method","venue":null,"work_id":"acaf8faf-659b-4320-9a12-dc41300f39ed","year":2003},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.242205Z"},"links":{"citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:a6f772aa3dce406cd813a866907199899e62429bd300f83169a0b79d3c0226a6","observation_id":"f01ac413-86a3-4a03-818f-08d165f1c4e5","resolution":{"observed_at":"2026-08-06T19:21:46.185045Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:46.164774Z","title":"Data clustering: a review","venue":null,"work_id":"1307d018-94d1-4b6c-b382-87b79a47b136","year":1999},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.247034Z"},"links":{"citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:3d9b0063c0cbdbd04d6f5525fb3b10c355f6bf789a3fec9c536712d136b6f658","observation_id":"00225f3e-7d96-4dad-a01a-5aba247a3993","resolution":{"observed_at":"2026-08-06T19:21:46.170181Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:46.150122Z","title":"Funsd: A dataset for form understanding in noisy 14 scanned documents","venue":null,"work_id":"d5ba920e-54d8-4618-a9b0-778bd5a96e27","year":2019},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.252219Z"},"links":{"citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:20ffb3b9a05c1f1ec81a1383032255d9d2fcf46530f259f6dc686a9b5f0f9612","observation_id":"bbbb6fa5-bd0a-4b72-a621-472098f185ee","resolution":{"observed_at":"2026-08-06T19:21:46.154985Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:46.136765Z","title":"ultralytics/yolov5: v6","venue":null,"work_id":"8acbf72d-204b-4e3d-a68a-5b55e04aec59","year":2021},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.256923Z"},"links":{"citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:50d68608c468e4c82ae89d52bb537f25a82e50e3da5c5a5283ad3f0e36a9bc65","observation_id":"f1e92513-f83b-46f7-b139-c30e1a75b96e","resolution":{"observed_at":"2026-08-06T19:21:46.141098Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:46.122791Z","title":"Ocr-free document understanding transformer","venue":null,"work_id":"014438b0-8a7c-408c-bfc5-1d07a76f6f13","year":2022},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.261333Z"},"links":{"citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:21ceb5185989fdacf0b6592afc8fe255b2b8fa8a249cca19057744170c84a59f","observation_id":"6ffa6289-39a2-404c-8ac2-a7a6510e7c33","resolution":{"observed_at":"2026-08-06T19:21:46.127407Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-06T19:21:45.266080Z","title":"Adam: A method for stochastic optimization","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.266080Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:bf12eabbf444fd0d56c1a9c0c5b5d623e255f14670d4c734a0fb2cd41795cfda","observation_id":"6c24b300-fbbe-47fa-93d9-86fcd5c7dad2","resolution":{"observed_at":"2026-08-06T19:21:45.266080Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:46.108117Z","title":"Pix2struct: Screenshot parsing as pretraining for visual lan- guage understanding","venue":null,"work_id":"025e456f-80f7-464a-bcae-992e281f71f1","year":2023},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.270962Z"},"links":{"citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:9791488a653b922e825e73f6f06441368ca1f4522ad9760648bf4cb34abc9073","observation_id":"7c3eded2-5ec9-4e76-bb21-1f285b9579b2","resolution":{"observed_at":"2026-08-06T19:21:46.112836Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.13461","last_updated":"2019-10-29T18:01:00Z","snapshot_observed_at":"2026-07-06T08:33:12.534026Z","submitted_at":"2019-10-29T18:01:00Z","title":"BART: Denoising Sequence-to-Sequence Pre-training for Natural Language Generation, Translation, and Comprehension","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.13461","snapshot_observed_at":"2026-08-06T19:21:45.275641Z","title":"Bart: Denoising sequence-to-sequence pre-training for natural language generation, translation, and comprehension","venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.275641Z"},"links":{"cited_paper":"/paper/1910.13461","citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:192dcb5eda7a66cd598a76cbb63bd41b07223fac0af6e8ece38adb7603173376","observation_id":"179b7bfc-070c-4402-81fc-9576e12fa9e1","resolution":{"observed_at":"2026-08-06T19:21:45.275641Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:46.093627Z","title":"When counting meets hmer: counting-aware network for handwritten math- ematical expression recognition","venue":null,"work_id":"a8e3e72c-168f-4bb4-8d41-b89d6da0cc89","year":2022},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.280408Z"},"links":{"citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:a185816cee659e244d21ada5051e0b3a73c755f176f3fe4119c982fba9e49478","observation_id":"3c2edb88-8883-494d-9a00-41a4317650bd","resolution":{"observed_at":"2026-08-06T19:21:46.098472Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.05391","last_updated":"2022-10-13T07:11:59Z","snapshot_observed_at":"2026-07-06T14:03:38.013152Z","submitted_at":"2022-10-11T12:07:32Z","title":"PP-StructureV2: A Stronger Document Analysis System","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.05391","snapshot_observed_at":"2026-08-06T19:21:45.285089Z","title":"Pp- structurev2: A stronger document analysis system","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.285089Z"},"links":{"cited_paper":"/paper/2210.05391","citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:9d1101dafa7f89a561cc9d121e4a3886ca7eb5db3201e2fcd8972a6fa5ca4b98","observation_id":"46109a49-ec28-4bce-b70a-13b968bdac39","resolution":{"observed_at":"2026-08-06T19:21:45.285089Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:46.079401Z","title":"Tablebank: Table benchmark for image-based table detection and recognition","venue":null,"work_id":"9c3ea03b-3b05-4e66-8990-ae412ea747d5","year":1918},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.290580Z"},"links":{"citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:0f37bb87af19503793be765fd519c8866cc3b3c1d66825300697e99ba318629a","observation_id":"41d4bbd8-17b6-48b7-b88d-d71c66551388","resolution":{"observed_at":"2026-08-06T19:21:46.083907Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.01038","last_updated":"2020-11-11T05:08:05Z","snapshot_observed_at":"2026-08-08T00:49:27.760989Z","submitted_at":"2020-06-01T16:04:30Z","title":"DocBank: A Benchmark Dataset for Document Layout Analysis","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.01038","snapshot_observed_at":"2026-08-06T19:21:45.295175Z","title":"Docbank: A bench- mark dataset for document layout analysis","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.295175Z"},"links":{"cited_paper":"/paper/2006.01038","citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:4d0ea07157a31b55c84c2fc90974b4a962e508ba2f9563c2a6dbef4185acc4c1","observation_id":"7b05f804-ab5f-45c0-b759-83846a464d23","resolution":{"observed_at":"2026-08-06T19:21:45.295175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:46.064119Z","title":"Relational represen- tation learning in visually-rich documents","venue":null,"work_id":"8faf957c-5267-4105-827b-61649acd3bd4","year":2022},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.300239Z"},"links":{"citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:6910eb3393ee9ea396b7ee016d4f33e042f7d1f3cd52ae9371ffcad32eb86464","observation_id":"f86d9d90-f643-4002-b3ff-4b2209e0d562","resolution":{"observed_at":"2026-08-06T19:21:46.069488Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:46.049601Z","title":"Tsrformer: Table structure recognition with transformers","venue":null,"work_id":"88a11c7e-c9a9-4a2d-b719-1421c3d41435","year":2022},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.304719Z"},"links":{"citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:99fa1fddb81c9b1d72628a23c609704560a44063d912ad8a11bc67f505bfe52d","observation_id":"020f6bcb-59ce-4d80-baa6-887115317d4a","resolution":{"observed_at":"2026-08-06T19:21:46.054108Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:46.035023Z","title":"Show, read and reason: Table struc- ture recognition with flexible context aggregator","venue":null,"work_id":"0775aa3f-1d5d-4bfe-b57d-c1d162defbf1","year":2021},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.309328Z"},"links":{"citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:6f9830220a48421942d3f39884fb85ebe4839e726f2a9f5cb2b5215d81f678da","observation_id":"c5896211-734c-4aad-9826-c1a3a9da0d0d","resolution":{"observed_at":"2026-08-06T19:21:46.040125Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:46.020612Z","title":"Neural collaborative graph machines for table structure recognition","venue":null,"work_id":"49aa8a42-b3b9-47de-a8f8-ba5e6d006ac9","year":2022},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.313757Z"},"links":{"citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:b44a9e0216fb867bb9caa38c15fb0bc586bdd2d098aa3984c98419a627da2e5a","observation_id":"36dbdeb3-4976-4fe0-a13b-051a56684fd2","resolution":{"observed_at":"2026-08-06T19:21:46.025441Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1907.11692","last_updated":"2019-07-26T17:48:29Z","snapshot_observed_at":"2026-07-31T22:31:37.910868Z","submitted_at":"2019-07-26T17:48:29Z","title":"RoBERTa: A Robustly Optimized BERT Pretraining Approach","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.11692","snapshot_observed_at":"2026-08-06T19:21:45.318202Z","title":"Roberta: A robustly optimized bert pretraining approach","venue":null,"work_id":null,"year":1907},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.318202Z"},"links":{"cited_paper":"/paper/1907.11692","citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:984f0326550a6aa2ef720e452c412dabae25deea973b29374e6840a00ee7929c","observation_id":"461f8255-12bb-4007-9b08-cf5868ed877e","resolution":{"observed_at":"2026-08-06T19:21:45.318202Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:46.003906Z","title":"Abcnet: Real-time scene text spot- ting with adaptive bezier-curve network","venue":null,"work_id":"8cc563a8-e44e-49bb-8366-bbe37a382992","year":2020},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.323262Z"},"links":{"citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:5198a6ebb6a02bb65c6a562f9409448e2358dd84d551f1e83ca1c5603b8208b5","observation_id":"be100a4a-f9b6-415f-8e90-27198021228b","resolution":{"observed_at":"2026-08-06T19:21:46.009480Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:45.988036Z","title":"Spts v2: single-point scene text spotting","venue":null,"work_id":"05cc0eeb-6edb-41d5-a92f-30946cecb7ec","year":2023},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.327632Z"},"links":{"citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:567426af006bb0d135202354403a868a38a5f3f2c53b15a5240e6db68f21e5ef","observation_id":"470b5c36-f610-4f63-91d5-97f4d0d43e94","resolution":{"observed_at":"2026-08-06T19:21:45.992950Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:45.973617Z","title":"Swin transformer: Hierarchical vision transformer using shifted windows","venue":null,"work_id":"6179b500-254d-4d9b-aeb3-626566ce9fe4","year":2021},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.332097Z"},"links":{"citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:d370917b20a920b6c601615ce18f5a60f0d32b52c7de1b05974c645cfb0802bb","observation_id":"8a02eb8b-fe06-4c98-b82b-f643f20ee833","resolution":{"observed_at":"2026-08-06T19:21:45.978434Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.11419","last_updated":"2024-08-21T16:54:23Z","snapshot_observed_at":"2026-08-02T15:31:34.622625Z","submitted_at":"2023-09-20T15:50:08Z","title":"KOSMOS-2.5: A Multimodal Literate Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.11419","snapshot_observed_at":"2026-08-06T19:21:45.336576Z","title":"Kosmos-2.5: A multimodal literate model","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.336576Z"},"links":{"cited_paper":"/paper/2309.11419","citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:47fb38f3ebb4ff69456e6c8c8e34b68f30dd55eec0a6edc76dde116a4d1b0084","observation_id":"195cbc1e-4303-4036-aab0-dde0d903b056","resolution":{"observed_at":"2026-08-06T19:21:45.336576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:45.957786Z","title":"Mask textspotter: An end-to-end trainable neural network for spotting text with arbitrary shapes","venue":null,"work_id":"ba1adcba-d98f-4868-8525-506efcd73b9f","year":2018},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.341450Z"},"links":{"citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:762549db92464211885d58da1e64270966c0acfe0f3914c4e89111bd9b5d8651","observation_id":"a00cc7dc-b831-4dd2-86f4-25e3fbfa3485","resolution":{"observed_at":"2026-08-06T19:21:45.963331Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:45.943093Z","title":"Optimized xy-cut for determining a page read- ing order","venue":null,"work_id":"ecac6a68-e7db-46c2-93f6-8f8730f09c11","year":2005},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.345904Z"},"links":{"citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:6d2ec1bb06868f9b4de8a9efa6b850048faa3bda755dcec054b6a4a1ff6af4e7","observation_id":"881b0c1f-414e-49b7-993b-0a83ff09b7a4","resolution":{"observed_at":"2026-08-06T19:21:45.947838Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:45.928793Z","title":"Icfhr 2014 competition on recognition of on-line handwritten mathematical expressions (crohme 2014)","venue":null,"work_id":"64ea8563-1ffa-4543-9be2-ea10fc326c35","year":2014},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.350522Z"},"links":{"citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:f6fbc7b8de73a36ca75514db2acfb81b057bd132a4124287e15f917e983c10c2","observation_id":"0e9e0e64-d6fc-4aa1-8693-52b99fe4a0c9","resolution":{"observed_at":"2026-08-06T19:21:45.933356Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:45.913328Z","title":"Tableformer: Table structure understanding with transformers","venue":null,"work_id":"595e8c2f-bccc-4181-954b-8f91b3371450","year":2022},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.355000Z"},"links":{"citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:cef48dde49c57fe9ceba533a9534e5cde933e8e4007ef8fa1acd4587f717b58d","observation_id":"94552ee5-d3f0-4630-bada-960b13da4fa2","resolution":{"observed_at":"2026-08-06T19:21:45.918412Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:45.898726Z","title":"Cord: a con- solidated receipt dataset for post-ocr parsing","venue":null,"work_id":"d51516b6-9a07-4b23-97d8-54d76b929cb8","year":2019},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.360641Z"},"links":{"citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:7324c94c52e4b89d2a5046cd4795ae5589564b9cef96d62cb99f43a7ce95cdb6","observation_id":"88a44d67-2b9b-4d34-96ec-c55fb789eef1","resolution":{"observed_at":"2026-08-06T19:21:45.903544Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:45.883619Z","title":"Doclaynet: A large human- annotated dataset for document-layout segmentation","venue":null,"work_id":"e3ae196b-ce7b-4d7f-bea1-0d4c68a807c6","year":2022},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.365697Z"},"links":{"citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:acb9a16655f6ecf5380ccfbf35b01c489b9dbc46f13df230fd55427ddc6fec7a","observation_id":"872eb70e-a7d9-45a7-a518-26ebd8f5cb0e","resolution":{"observed_at":"2026-08-06T19:21:45.889052Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:45.869130Z","title":"Faster r-cnn: Towards real-time object detection with region proposal networks","venue":null,"work_id":"d5f8285d-a7c6-464e-87bd-54789e63eef5","year":2015},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.370621Z"},"links":{"citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:6d424524e796472c2baae415c2b833394f05778ed4af938b6d1e7b91fe5b4723","observation_id":"efbda340-8755-495f-83fc-464e61ad67c8","resolution":{"observed_at":"2026-08-06T19:21:45.873852Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1802.05415","last_updated":"2018-06-15T21:36:10Z","snapshot_observed_at":"2026-08-03T23:15:24.155975Z","submitted_at":"2018-02-15T06:17:51Z","title":"Teaching Machines to Code: Neural Markup Generation with Visual Attention","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1802.05415","snapshot_observed_at":"2026-08-06T19:21:45.375003Z","title":"Teaching machines to code: neural markup generation with visual attention","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.375003Z"},"links":{"cited_paper":"/paper/1802.05415","citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:538d0baeaed9d6375c1ea541f29d742d2e87d006820a08c5ba00712d9ba56863","observation_id":"2b1d6d0d-721b-406d-8f4e-b73b92c58d1f","resolution":{"observed_at":"2026-08-06T19:21:45.375003Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:45.853789Z","title":"Optimal boxes: boosting end-to- end scene text recognition by adjusting annotated bounding boxes via reinforcement learning","venue":null,"work_id":"e37faabf-e777-4dec-98a5-aa1bc0d758f5","year":2022},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.379518Z"},"links":{"citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:f11a062928d954b879632a623426026848f2c3bdc8e6de801b8fa492a6cd5aa1","observation_id":"c170a1f5-9610-4b76-9d6d-6f5d06f81485","resolution":{"observed_at":"2026-08-06T19:21:45.858931Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:45.837725Z","title":"You can even annotate text with voice: Transcription-only-supervised text spotting","venue":null,"work_id":"5b438862-48f0-475e-9519-e452f8d60f78","year":2022},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.384147Z"},"links":{"citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:b49aca9590f1433b23fa97958dc7727ff9bcf1fbfac73fa24eae20d691db16c6","observation_id":"ab2c288d-7ca2-446a-9fbd-fda1ccc47fc2","resolution":{"observed_at":"2026-08-06T19:21:45.843160Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:45.822181Z","title":"Few could be better than all: Feature sampling and grouping for scene text detection","venue":null,"work_id":"d9e8c14f-7338-4e21-b2ad-2d03a24a9959","year":2022},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.388544Z"},"links":{"citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:0f72611a375e147400ca2d0722c0dfdf8fdf77721b965d2fb32af7122a13f1ec","observation_id":"5a319298-a728-4ca8-bf3f-f4b3333995df","resolution":{"observed_at":"2026-08-06T19:21:45.827325Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2108.11591","last_updated":"2021-08-27T04:56:07Z","snapshot_observed_at":"2026-07-06T11:41:38.428205Z","submitted_at":"2021-08-26T05:52:32Z","title":"LayoutReader: Pre-training of Text and Layout for Reading Order Detection","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.11591","snapshot_observed_at":"2026-08-06T19:21:45.392730Z","title":"Layoutreader: Pre-training of text and layout for read- ing order detection","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.392730Z"},"links":{"cited_paper":"/paper/2108.11591","citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:fb3c4825db7c316622c2279cf6afe0c275e6fef7338974a7483d69930152deb8","observation_id":"0484cee8-75a7-4201-88cf-d52fa8438ce3","resolution":{"observed_at":"2026-08-06T19:21:45.392730Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:45.806384Z","title":"Learning to extract semantic struc- ture from documents using multimodal fully convolutional neural networks","venue":null,"work_id":"03dceb17-c142-4155-adae-f0d1954d0540","year":2017},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.397512Z"},"links":{"citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:95526a0aad7e0814b4ac64eecb42dc5986e87f11ab8a34635414160d9714fabf","observation_id":"03832ba0-8b19-4b52-896a-0808bffac202","resolution":{"observed_at":"2026-08-06T19:21:45.811267Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:45.789786Z","title":"Syntax-aware network for handwritten mathematical expression recognition","venue":null,"work_id":"8c79b71c-abe4-4b52-8fe6-54214e1d9694","year":2022},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.401908Z"},"links":{"citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:d0ffb3d7d569fe00960bd57a8c64e145724c8234c99e5bf52a2bd89b00a89898","observation_id":"68b287c7-9c24-40a4-831d-5f3ddeaa17a0","resolution":{"observed_at":"2026-08-06T19:21:45.795640Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.11016","last_updated":"2023-10-17T06:08:55Z","snapshot_observed_at":"2026-07-06T16:34:19.351760Z","submitted_at":"2023-10-17T06:08:55Z","title":"Reading Order Matters: Information Extraction from Visually-rich Documents by Token Path Prediction","version":1},"cited_work":{"arxiv_id":"2310.11016","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.11016","snapshot_observed_at":"2026-08-06T19:21:45.488643Z","title":"Reading Order Matters: Information Extraction from Visually-rich Documents by Token Path Prediction","venue":"cs.CL","work_id":"3e6ccbbc-7d87-4611-915d-dd5ae24dea4c","year":2023},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.406729Z"},"links":{"cited_paper":"/paper/2310.11016","citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:c817e4b766bafd8bc0db1a99f794786f3fd082033877f7dbdf6d3ad69b88f138","observation_id":"a70f3a22-86b5-4ed4-a3b1-44bf787a18de","resolution":{"observed_at":"2026-08-06T19:21:45.495864Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:45.772359Z","title":"Vsr: a unified framework for document layout analysis combining vision, semantics and relations","venue":null,"work_id":"a731675b-6190-4d77-93e6-c2caa96df763","year":2021},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.411469Z"},"links":{"citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:d342d0c19691725c26b17b37724e8ee98b93c0099423429700dbe4d85ad67c55","observation_id":"a063515c-3be1-4e26-973a-bad7a26f70e1","resolution":{"observed_at":"2026-08-06T19:21:45.777349Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:45.756575Z","title":"Tabpedia: Towards comprehensive visual ta- ble understanding with concept synergy.Advances in Neural Information Processing Systems, 37:7185–7212, 2025","venue":null,"work_id":"75d697e0-7f03-461c-a73f-6de895f1c59e","year":2025},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.415784Z"},"links":{"citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:a47caf7356a93a00daaf45218834c1a659ef14349b0cfdedb3046bf58b2e970c","observation_id":"25695353-289a-496a-96c9-a829c2bae29b","resolution":{"observed_at":"2026-08-06T19:21:45.761550Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:45.741341Z","title":"Multi-modal in-context learning makes an ego-evolving scene text recognizer","venue":null,"work_id":"4f0ab428-ebad-4092-87ee-68b7ffef7995","year":2024},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.420331Z"},"links":{"citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:3dc4d1f22eb326db8cacd3f0cbecd001b7e58a774ecad1c6860719f0e85e7844","observation_id":"09757057-99eb-4106-b319-95ea1054d91c","resolution":{"observed_at":"2026-08-06T19:21:45.746186Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:45.727010Z","title":"Pub- laynet: largest dataset ever for document layout analysis","venue":null,"work_id":"df670c34-b98e-42f6-b397-dfecce3326b7","year":2019},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.424847Z"},"links":{"citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:ce28c1de6576dee4360c4a61bf494bb9eb9cf025207b3acaad19e2ba7341fa7a","observation_id":"739e563b-2c55-478a-ba58-4b3f95051848","resolution":{"observed_at":"2026-08-06T19:21:45.731521Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:45.711153Z","title":"Image-based table recognition: data, model, and evaluation","venue":null,"work_id":"139a0e4b-2602-4938-a975-a4ed7e2a4099","year":2020},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.429219Z"},"links":{"citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:58c4aa5f99d5849fd4e292eedcf2ce962f885d676ffb65f738047249c2c8df18","observation_id":"bc44b73e-4a4a-4120-bef9-a8252e078016","resolution":{"observed_at":"2026-08-06T19:21:45.716157Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.04159","last_updated":"2021-03-18T03:14:26Z","snapshot_observed_at":"2026-07-06T10:02:45.105181Z","submitted_at":"2020-10-08T17:59:21Z","title":"Deformable DETR: Deformable Transformers for End-to-End Object Detection","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.04159","snapshot_observed_at":"2026-08-06T19:21:45.433810Z","title":"Deformable detr: Deformable trans- formers for end-to-end object detection","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:45.433810Z"},"links":{"cited_paper":"/paper/2010.04159","citing_paper":"/paper/2507.05805"},"observation_digest":"sha256:c1ddd13c6c5d0bad38bbe974d5b0eb79e5620d30b93cfc79630f2403b343b5e3","observation_id":"e7492f35-525e-4233-92df-def6c3aa3648","resolution":{"observed_at":"2026-08-06T19:21:45.433810Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.05805","last_updated":"2025-07-08T09:24:07Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-08T00:42:07.626890Z","submitted_at":"2025-07-08T09:24:07Z","title":"DREAM: Document Reconstruction via End-to-end Autoregressive Model"},"reference_resolution":{"displayed":60,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":15,"verified_exact":1,"verified_fuzzy":44},"total_outbound_references":60},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 60 of 60 outbound references and 0 inbound Pith citation observations for arXiv:2507.05805."}