{"as_of":"2026-08-15T16:48:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:cff0b9111ad1c7846de152bc4c5c7fca394d6d95f7564e256833f8b33896ca38","coverage":[{"denominator":57,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":57,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:42:31.629324Z","state":"measured"},{"denominator":79,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":79,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":22,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":22,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T15:44:16.973324Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T16:49:57.078776Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.14059","last_updated":"2025-05-20T08:03:59Z","snapshot_observed_at":"2026-08-14T18:47:58.220615Z","submitted_at":"2025-05-20T08:03:59Z","title":"Dolphin: Document Image Parsing via Heterogeneous Anchor Prompting","version":1},"cited_work":{"arxiv_id":"2505.14059","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.14059","snapshot_observed_at":"2026-07-04T16:49:57.078776Z","title":"Dolphin: Document image parsing via heterogeneous anchor prompting","venue":null,"work_id":"7b0162e1-d951-4222-9213-1f55bfd2ea95","year":2025},"citing_paper":{"arxiv_id":"2509.22186","last_updated":"2025-09-29T16:41:28Z","snapshot_observed_at":"2026-08-15T07:34:12.195990Z","submitted_at":"2025-09-26T10:45:48Z","title":"MinerU2.5: A Decoupled Vision-Language Model for Efficient High-Resolution Document Parsing","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-17T13:25:31.884175Z"},"links":{"cited_paper":"/paper/2505.14059","citing_paper":"/paper/2509.22186"},"observation_digest":"sha256:b8c74102a9f7e1277543c109d459dd49aa65a09ad78257070b3ef0a37581c8dc","observation_id":"4f1bfba0-f5f8-4ac1-a8d4-0c2ccefa47ee","resolution":{"observed_at":"2026-05-17T13:25:31.976486Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14059","last_updated":"2025-05-20T08:03:59Z","snapshot_observed_at":"2026-08-14T18:47:58.220615Z","submitted_at":"2025-05-20T08:03:59Z","title":"Dolphin: Document Image Parsing via Heterogeneous Anchor Prompting","version":1},"cited_work":{"arxiv_id":"2505.14059","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.14059","snapshot_observed_at":"2026-07-04T16:49:57.078776Z","title":"Dolphin: Document image parsing via heterogeneous anchor prompting","venue":null,"work_id":"7b0162e1-d951-4222-9213-1f55bfd2ea95","year":2025},"citing_paper":{"arxiv_id":"2510.18234","last_updated":"2025-10-21T02:41:44Z","snapshot_observed_at":"2026-07-06T22:33:39.148066Z","submitted_at":"2025-10-21T02:41:44Z","title":"DeepSeek-OCR: Contexts Optical Compression","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-12T04:35:50.647950Z"},"links":{"cited_paper":"/paper/2505.14059","citing_paper":"/paper/2510.18234"},"observation_digest":"sha256:ca20ea46a7477d4968e51a20a7af35a3928133ca334db33122466b1ae2556510","observation_id":"9f71ee87-0964-42d8-bbc1-f9c708e2a933","resolution":{"observed_at":"2026-05-12T04:35:50.836050Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14059","last_updated":"2025-05-20T08:03:59Z","snapshot_observed_at":"2026-08-14T18:47:58.220615Z","submitted_at":"2025-05-20T08:03:59Z","title":"Dolphin: Document Image Parsing via Heterogeneous Anchor Prompting","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.14059","snapshot_observed_at":"2026-08-03T14:16:50.754455Z","title":"Dolphin: Document image parsing via heterogeneous anchor prompting.arXivpreprintarXiv:2505.14059, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.21095","last_updated":"2026-07-11T09:04:48Z","snapshot_observed_at":"2026-08-14T07:02:25.973982Z","submitted_at":"2025-12-24T10:35:21Z","title":"UniRec-0.1B: Unified Text and Formula Recognition with 0.1B Parameters","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-03T14:16:50.754455Z"},"links":{"cited_paper":"/paper/2505.14059","citing_paper":"/paper/2512.21095"},"observation_digest":"sha256:9afd98d0706ecdb58fba78e457334fd8843f2a4e2d4e7f706e67e78158794282","observation_id":"70068584-e253-4fed-8c28-d604d219d824","resolution":{"observed_at":"2026-08-03T14:16:50.754455Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14059","last_updated":"2025-05-20T08:03:59Z","snapshot_observed_at":"2026-08-14T18:47:58.220615Z","submitted_at":"2025-05-20T08:03:59Z","title":"Dolphin: Document Image Parsing via Heterogeneous Anchor Prompting","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.14059","snapshot_observed_at":"2026-08-03T10:43:50.274906Z","title":"Dolphin: Document image parsing via heterogeneous anchor prompting,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.09118","last_updated":"2026-07-16T14:44:01Z","snapshot_observed_at":"2026-08-12T20:18:45.547153Z","submitted_at":"2026-01-14T03:35:09Z","title":"LPCAN: Lightweight Pyramid Cross-Attention Network for Rail Surface Defect Detection Using RGB-D Data","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-03T10:43:50.274906Z"},"links":{"cited_paper":"/paper/2505.14059","citing_paper":"/paper/2601.09118"},"observation_digest":"sha256:924f1d0a15232c9cb8485715aceb6249d0fbd874243a4175deecb3ed45e5f9f4","observation_id":"b970c54c-739d-42e1-81f1-102616d7dbdc","resolution":{"observed_at":"2026-08-03T10:43:50.274906Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14059","last_updated":"2025-05-20T08:03:59Z","snapshot_observed_at":"2026-08-14T18:47:58.220615Z","submitted_at":"2025-05-20T08:03:59Z","title":"Dolphin: Document Image Parsing via Heterogeneous Anchor Prompting","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.14059","snapshot_observed_at":"2026-08-03T10:43:42.098438Z","title":"Dolphin: Document image parsing via heterogeneous anchor prompting,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.09238","last_updated":"2026-07-16T14:45:17Z","snapshot_observed_at":"2026-08-10T07:54:29.987163Z","submitted_at":"2026-01-14T07:21:57Z","title":"Knowledge-Embedded and Hypernetwork-Guided Few-Shot Substation Meter Defect Image Generation Method","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-03T10:43:42.098438Z"},"links":{"cited_paper":"/paper/2505.14059","citing_paper":"/paper/2601.09238"},"observation_digest":"sha256:d3165b1213a6315d6407b266a1d87180705f3573fecac7fe93b4d8b9ae6a45e0","observation_id":"53d86290-5202-4667-81ec-1b21a4427028","resolution":{"observed_at":"2026-08-03T10:43:42.098438Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14059","last_updated":"2025-05-20T08:03:59Z","snapshot_observed_at":"2026-08-14T18:47:58.220615Z","submitted_at":"2025-05-20T08:03:59Z","title":"Dolphin: Document Image Parsing via Heterogeneous Anchor Prompting","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.14059","snapshot_observed_at":"2026-08-15T15:44:16.973324Z","title":"Dolphin: Document image parsing via heterogeneous anchor prompting.arXiv preprint arXiv:2505.14059, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.20430","last_updated":"2026-07-13T14:16:50Z","snapshot_observed_at":"2026-08-15T15:37:06.142564Z","submitted_at":"2026-01-28T09:37:13Z","title":"Youtu-Parsing: Perception, Structuring and Recognition via High-Parallelism Decoding","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T15:44:16.973324Z"},"links":{"cited_paper":"/paper/2505.14059","citing_paper":"/paper/2601.20430"},"observation_digest":"sha256:86c2298c60fd7aca1b23e51258ef4aeb262ef041b089027d3fd5287c6d1063c8","observation_id":"28aecddb-10c8-4960-a858-eb33f6df49bb","resolution":{"observed_at":"2026-08-15T15:44:16.973324Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14059","last_updated":"2025-05-20T08:03:59Z","snapshot_observed_at":"2026-08-14T18:47:58.220615Z","submitted_at":"2025-05-20T08:03:59Z","title":"Dolphin: Document Image Parsing via Heterogeneous Anchor Prompting","version":1},"cited_work":{"arxiv_id":"2505.14059","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.14059","snapshot_observed_at":"2026-07-04T16:49:57.078776Z","title":"Dolphin: Document image parsing via heterogeneous anchor prompting","venue":null,"work_id":"7b0162e1-d951-4222-9213-1f55bfd2ea95","year":2025},"citing_paper":{"arxiv_id":"2601.21957","last_updated":"2026-04-03T06:49:11Z","snapshot_observed_at":"2026-08-13T13:13:25.351259Z","submitted_at":"2026-01-29T16:35:04Z","title":"PaddleOCR-VL-1.5: Towards a Multi-Task 0.9B VLM for Robust In-the-Wild Document Parsing","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-16T09:40:09.955493Z"},"links":{"cited_paper":"/paper/2505.14059","citing_paper":"/paper/2601.21957"},"observation_digest":"sha256:7dc9a26f563495060cf0118bbf3977467b54d397a98f31e8092c87bad2f6fd4f","observation_id":"97096662-2de0-42d8-ae59-31fab0ac5c82","resolution":{"observed_at":"2026-05-16T09:40:48.781120Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14059","last_updated":"2025-05-20T08:03:59Z","snapshot_observed_at":"2026-08-14T18:47:58.220615Z","submitted_at":"2025-05-20T08:03:59Z","title":"Dolphin: Document Image Parsing via Heterogeneous Anchor Prompting","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.14059","snapshot_observed_at":"2026-08-02T23:44:36.730363Z","title":"arXiv preprint arXiv:2505.14059 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.12957","last_updated":"2026-06-29T06:43:50Z","snapshot_observed_at":"2026-08-14T14:25:16.701918Z","submitted_at":"2026-02-13T14:22:10Z","title":"HSD: Training-Free Acceleration for Document Parsing Vision-Language Models with Hierarchical Speculative Decoding","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-02T23:44:36.730363Z"},"links":{"cited_paper":"/paper/2505.14059","citing_paper":"/paper/2602.12957"},"observation_digest":"sha256:ec58987153575962760bf9c9bd826208035cb726981de8029aacddbb1afcdb4e","observation_id":"5dcee4d9-86b7-438f-b99e-8fe96f745507","resolution":{"observed_at":"2026-08-02T23:44:36.730363Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14059","last_updated":"2025-05-20T08:03:59Z","snapshot_observed_at":"2026-08-14T18:47:58.220615Z","submitted_at":"2025-05-20T08:03:59Z","title":"Dolphin: Document Image Parsing via Heterogeneous Anchor Prompting","version":1},"cited_work":{"arxiv_id":"2505.14059","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.14059","snapshot_observed_at":"2026-07-04T16:49:57.078776Z","title":"Dolphin: Document image parsing via heterogeneous anchor prompting","venue":null,"work_id":"7b0162e1-d951-4222-9213-1f55bfd2ea95","year":2025},"citing_paper":{"arxiv_id":"2603.09677","last_updated":"2026-04-08T07:57:35Z","snapshot_observed_at":"2026-08-14T19:39:31.611087Z","submitted_at":"2026-03-10T13:46:32Z","title":"Logics-Parsing-Omni Technical Report","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-15T13:37:44.189839Z"},"links":{"cited_paper":"/paper/2505.14059","citing_paper":"/paper/2603.09677"},"observation_digest":"sha256:c43536c67ed0c87f577eebdffc93a2bc3a31faa2572ea0334a18913a5066ab57","observation_id":"cb94e5f9-0c81-4917-8a77-26dc0856d62d","resolution":{"observed_at":"2026-05-15T13:40:01.702754Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14059","last_updated":"2025-05-20T08:03:59Z","snapshot_observed_at":"2026-08-14T18:47:58.220615Z","submitted_at":"2025-05-20T08:03:59Z","title":"Dolphin: Document Image Parsing via Heterogeneous Anchor Prompting","version":1},"cited_work":{"arxiv_id":"2505.14059","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.14059","snapshot_observed_at":"2026-07-04T16:49:57.078776Z","title":"Dolphin: Document image parsing via heterogeneous anchor prompting","venue":null,"work_id":"7b0162e1-d951-4222-9213-1f55bfd2ea95","year":2025},"citing_paper":{"arxiv_id":"2603.23885","last_updated":"2026-04-18T12:13:54Z","snapshot_observed_at":"2026-08-11T00:45:34.952402Z","submitted_at":"2026-03-25T03:19:09Z","title":"Towards Real-World Document Parsing via Realistic Scene Synthesis and Document-Aware Training","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-15T01:15:26.757215Z"},"links":{"cited_paper":"/paper/2505.14059","citing_paper":"/paper/2603.23885"},"observation_digest":"sha256:d4de53d503f984eb4be621a1cb5052212de9359e7911b5da684eaaccf1e1bf3c","observation_id":"eaebe7f8-b67f-4df0-8eb4-f49edcb05c47","resolution":{"observed_at":"2026-05-15T01:18:26.577682Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14059","last_updated":"2025-05-20T08:03:59Z","snapshot_observed_at":"2026-08-14T18:47:58.220615Z","submitted_at":"2025-05-20T08:03:59Z","title":"Dolphin: Document Image Parsing via Heterogeneous Anchor Prompting","version":1},"cited_work":{"arxiv_id":"2505.14059","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.14059","snapshot_observed_at":"2026-07-04T16:49:57.078776Z","title":"Dolphin: Document image parsing via heterogeneous anchor prompting","venue":null,"work_id":"7b0162e1-d951-4222-9213-1f55bfd2ea95","year":2025},"citing_paper":{"arxiv_id":"2603.24326","last_updated":"2026-04-03T06:49:01Z","snapshot_observed_at":"2026-07-06T22:50:28.640006Z","submitted_at":"2026-03-25T14:08:56Z","title":"Boosting Document Parsing Efficiency and Performance with Coarse-to-Fine Visual Processing","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-15T00:25:19.782732Z"},"links":{"cited_paper":"/paper/2505.14059","citing_paper":"/paper/2603.24326"},"observation_digest":"sha256:9989a9b11737cdc6cb6d313be04d2074a42c60ed720300046c55205f80a43b94","observation_id":"54d58bdb-0780-47ff-a848-c77b52179a6d","resolution":{"observed_at":"2026-05-15T00:28:23.563998Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14059","last_updated":"2025-05-20T08:03:59Z","snapshot_observed_at":"2026-08-14T18:47:58.220615Z","submitted_at":"2025-05-20T08:03:59Z","title":"Dolphin: Document Image Parsing via Heterogeneous Anchor Prompting","version":1},"cited_work":{"arxiv_id":"2505.14059","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.14059","snapshot_observed_at":"2026-07-04T16:49:57.078776Z","title":"Dolphin: Document image parsing via heterogeneous anchor prompting","venue":null,"work_id":"7b0162e1-d951-4222-9213-1f55bfd2ea95","year":2025},"citing_paper":{"arxiv_id":"2604.12812","last_updated":"2026-05-11T03:47:15Z","snapshot_observed_at":"2026-08-11T11:53:19.248454Z","submitted_at":"2026-04-14T14:39:26Z","title":"DocSeeker: Structured Visual Reasoning with Evidence Grounding for Long Document Understanding","version":4},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-10T16:16:58.889065Z"},"links":{"cited_paper":"/paper/2505.14059","citing_paper":"/paper/2604.12812"},"observation_digest":"sha256:57553eb677a775d7c26438c288bc6e4c3378231c24c12f07f0c5d0caaf8afa6f","observation_id":"3407705e-7a04-489f-ad40-29a1e8b21345","resolution":{"observed_at":"2026-05-11T09:05:58.428290Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14059","last_updated":"2025-05-20T08:03:59Z","snapshot_observed_at":"2026-08-14T18:47:58.220615Z","submitted_at":"2025-05-20T08:03:59Z","title":"Dolphin: Document Image Parsing via Heterogeneous Anchor Prompting","version":1},"cited_work":{"arxiv_id":"2505.14059","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.14059","snapshot_observed_at":"2026-07-04T16:49:57.078776Z","title":"Dolphin: Document image parsing via heterogeneous anchor prompting","venue":null,"work_id":"7b0162e1-d951-4222-9213-1f55bfd2ea95","year":2025},"citing_paper":{"arxiv_id":"2604.12812","last_updated":"2026-05-11T03:47:15Z","snapshot_observed_at":"2026-08-11T11:53:19.248454Z","submitted_at":"2026-04-14T14:39:26Z","title":"DocSeeker: Structured Visual Reasoning with Evidence Grounding for Long Document Understanding","version":5},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-12T04:17:55.318813Z"},"links":{"cited_paper":"/paper/2505.14059","citing_paper":"/paper/2604.12812"},"observation_digest":"sha256:e6945552567db6d5a007831487da9d78512114b3630d4e6e180b89df85a04cd2","observation_id":"3b2a1317-617a-4cfd-9f68-9403ab312179","resolution":{"observed_at":"2026-05-12T06:26:24.514675Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14059","last_updated":"2025-05-20T08:03:59Z","snapshot_observed_at":"2026-08-14T18:47:58.220615Z","submitted_at":"2025-05-20T08:03:59Z","title":"Dolphin: Document Image Parsing via Heterogeneous Anchor Prompting","version":1},"cited_work":{"arxiv_id":"2505.14059","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.14059","snapshot_observed_at":"2026-07-04T16:49:57.078776Z","title":"Dolphin: Document image parsing via heterogeneous anchor prompting","venue":null,"work_id":"7b0162e1-d951-4222-9213-1f55bfd2ea95","year":2025},"citing_paper":{"arxiv_id":"2604.16099","last_updated":"2026-04-17T14:33:51Z","snapshot_observed_at":"2026-07-06T23:03:30.601598Z","submitted_at":"2026-04-17T14:33:51Z","title":"DenTab: A Dataset for Table Recognition and Visual QA on Real-World Dental Estimates","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-10T08:33:00.988234Z"},"links":{"cited_paper":"/paper/2505.14059","citing_paper":"/paper/2604.16099"},"observation_digest":"sha256:dbddbb5901fedcc14704f1a3541b2e0053fd58753adfcdd9b064cd723594ae43","observation_id":"d71313e6-0202-470a-aa56-9c2f5115b00e","resolution":{"observed_at":"2026-05-10T08:53:05.011374Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14059","last_updated":"2025-05-20T08:03:59Z","snapshot_observed_at":"2026-08-14T18:47:58.220615Z","submitted_at":"2025-05-20T08:03:59Z","title":"Dolphin: Document Image Parsing via Heterogeneous Anchor Prompting","version":1},"cited_work":{"arxiv_id":"2505.14059","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.14059","snapshot_observed_at":"2026-07-04T16:49:57.078776Z","title":"Dolphin: Document image parsing via heterogeneous anchor prompting","venue":null,"work_id":"7b0162e1-d951-4222-9213-1f55bfd2ea95","year":2025},"citing_paper":{"arxiv_id":"2605.19866","last_updated":"2026-05-19T13:58:24Z","snapshot_observed_at":"2026-08-13T04:06:51.828627Z","submitted_at":"2026-05-19T13:58:24Z","title":"Structured Layout Priors for Robust Out-of-Distribution Visual Document Understanding","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-20T05:48:34.771799Z"},"links":{"cited_paper":"/paper/2505.14059","citing_paper":"/paper/2605.19866"},"observation_digest":"sha256:7275630207076dc5b644d0a3325c2e587df1a1cdbc172bdd210b7efef39e96de","observation_id":"fd3c1f14-22b9-4f08-a3fd-30ab4b9b4378","resolution":{"observed_at":"2026-05-20T05:53:05.113243Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14059","last_updated":"2025-05-20T08:03:59Z","snapshot_observed_at":"2026-08-14T18:47:58.220615Z","submitted_at":"2025-05-20T08:03:59Z","title":"Dolphin: Document Image Parsing via Heterogeneous Anchor Prompting","version":1},"cited_work":{"arxiv_id":"2505.14059","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.14059","snapshot_observed_at":"2026-07-04T16:49:57.078776Z","title":"Dolphin: Document image parsing via heterogeneous anchor prompting","venue":null,"work_id":"7b0162e1-d951-4222-9213-1f55bfd2ea95","year":2025},"citing_paper":{"arxiv_id":"2606.15932","last_updated":"2026-06-16T15:28:03Z","snapshot_observed_at":"2026-07-06T23:52:37.922109Z","submitted_at":"2026-06-14T17:21:43Z","title":"Beyond NL2Code: A Structured Survey of Multimodal Code Intelligence","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-27T03:57:19.028507Z"},"links":{"cited_paper":"/paper/2505.14059","citing_paper":"/paper/2606.15932"},"observation_digest":"sha256:2089f8811f13513cc18ddd10f58b7a575570bf9844f088d19c10d654c6786702","observation_id":"027d5702-1c86-4b0a-a720-9be94e7dbd1f","resolution":{"observed_at":"2026-07-03T17:38:44.204777Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14059","last_updated":"2025-05-20T08:03:59Z","snapshot_observed_at":"2026-08-14T18:47:58.220615Z","submitted_at":"2025-05-20T08:03:59Z","title":"Dolphin: Document Image Parsing via Heterogeneous Anchor Prompting","version":1},"cited_work":{"arxiv_id":"2505.14059","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.14059","snapshot_observed_at":"2026-07-04T16:49:57.078776Z","title":"Dolphin: Document image parsing via heterogeneous anchor prompting","venue":null,"work_id":"7b0162e1-d951-4222-9213-1f55bfd2ea95","year":2025},"citing_paper":{"arxiv_id":"2606.23050","last_updated":"2026-06-22T09:01:29Z","snapshot_observed_at":"2026-08-13T17:57:13.876850Z","submitted_at":"2026-06-22T09:01:29Z","title":"Unlimited OCR Works","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-26T09:03:33.539615Z"},"links":{"cited_paper":"/paper/2505.14059","citing_paper":"/paper/2606.23050"},"observation_digest":"sha256:72ced7bb7b90da88ec781babaff40ea656c172fe87d2849ffb8c97fe755c1106","observation_id":"d2aa3a62-ce1b-4435-92f8-a7306d015315","resolution":{"observed_at":"2026-07-04T10:19:46.905358Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14059","last_updated":"2025-05-20T08:03:59Z","snapshot_observed_at":"2026-08-14T18:47:58.220615Z","submitted_at":"2025-05-20T08:03:59Z","title":"Dolphin: Document Image Parsing via Heterogeneous Anchor Prompting","version":1},"cited_work":{"arxiv_id":"2505.14059","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.14059","snapshot_observed_at":"2026-07-04T16:49:57.078776Z","title":"Dolphin: Document image parsing via heterogeneous anchor prompting","venue":null,"work_id":"7b0162e1-d951-4222-9213-1f55bfd2ea95","year":2025},"citing_paper":{"arxiv_id":"2606.24447","last_updated":"2026-06-23T11:34:28Z","snapshot_observed_at":"2026-08-07T17:24:33.181681Z","submitted_at":"2026-06-23T11:34:28Z","title":"P-MTP: Efficient Document Parsing via Multi-Token Prediction with Progressive Depth Scaling","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-26T00:18:07.278889Z"},"links":{"cited_paper":"/paper/2505.14059","citing_paper":"/paper/2606.24447"},"observation_digest":"sha256:d088fe6796b498b715add3ca34d25d390a4052ed23c37973b8aa345d7d73412e","observation_id":"7e35d243-997d-4cf0-90b9-3acd47a809b7","resolution":{"observed_at":"2026-07-04T16:49:57.080500Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14059","last_updated":"2025-05-20T08:03:59Z","snapshot_observed_at":"2026-08-14T18:47:58.220615Z","submitted_at":"2025-05-20T08:03:59Z","title":"Dolphin: Document Image Parsing via Heterogeneous Anchor Prompting","version":1},"cited_work":{"arxiv_id":"2505.14059","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.14059","snapshot_observed_at":"2026-07-04T16:49:57.078776Z","title":"Dolphin: Document image parsing via heterogeneous anchor prompting","venue":null,"work_id":"7b0162e1-d951-4222-9213-1f55bfd2ea95","year":2025},"citing_paper":{"arxiv_id":"2606.30189","last_updated":"2026-06-29T12:04:01Z","snapshot_observed_at":"2026-08-13T15:05:21.385206Z","submitted_at":"2026-06-29T12:04:01Z","title":"DAIN: Dynamic Agent-Based Interaction Network for Efficient and Collaborative Multimodal Reasoning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-30T06:01:20.803078Z"},"links":{"cited_paper":"/paper/2505.14059","citing_paper":"/paper/2606.30189"},"observation_digest":"sha256:9cee2e93e1d8f13080829f75e026fb87df9ac8b373857958587f7ca8f7e80232","observation_id":"ed80c8eb-a770-47c5-a929-c2c3da35fedd","resolution":{"observed_at":"2026-06-30T06:04:21.400472Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14059","last_updated":"2025-05-20T08:03:59Z","snapshot_observed_at":"2026-08-14T18:47:58.220615Z","submitted_at":"2025-05-20T08:03:59Z","title":"Dolphin: Document Image Parsing via Heterogeneous Anchor Prompting","version":1},"cited_work":{"arxiv_id":"2505.14059","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.14059","snapshot_observed_at":"2026-07-04T16:49:57.078776Z","title":"Dolphin: Document image parsing via heterogeneous anchor prompting","venue":null,"work_id":"7b0162e1-d951-4222-9213-1f55bfd2ea95","year":2025},"citing_paper":{"arxiv_id":"2607.01602","last_updated":"2026-07-02T02:04:07Z","snapshot_observed_at":"2026-08-14T08:11:39.534446Z","submitted_at":"2026-07-02T02:04:07Z","title":"ProWAFT: A ROMA-LPD Instance for Workload-Aware and Dynamic Fault Tolerance in FPGA-Based CNN Accelerators","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-03T15:23:48.748933Z"},"links":{"cited_paper":"/paper/2505.14059","citing_paper":"/paper/2607.01602"},"observation_digest":"sha256:f074e63349cd5c6605f846c616e84daa34a8dd6fa9367913fd3015a0c129fbdd","observation_id":"f7374e65-be0d-4926-848a-3dab04fa51a0","resolution":{"observed_at":"2026-07-03T15:28:33.656288Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14059","last_updated":"2025-05-20T08:03:59Z","snapshot_observed_at":"2026-08-14T18:47:58.220615Z","submitted_at":"2025-05-20T08:03:59Z","title":"Dolphin: Document Image Parsing via Heterogeneous Anchor Prompting","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.14059","snapshot_observed_at":"2026-07-12T05:51:08.895411Z","title":"Dolphin: Document im- age parsing via heterogeneous anchor prompting.arXiv preprint arXiv:2505.14059,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.02956","last_updated":"2026-07-03T04:59:12Z","snapshot_observed_at":"2026-08-14T18:47:59.009039Z","submitted_at":"2026-07-03T04:59:12Z","title":"MORE: A Multilingual Document Parsing Benchmark and Evaluation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-12T05:51:08.895411Z"},"links":{"cited_paper":"/paper/2505.14059","citing_paper":"/paper/2607.02956"},"observation_digest":"sha256:a38f7dcaa167d1887e8c50bb837496b97b4317c8b982461273e705dfea880f17","observation_id":"5f93cd33-c006-4592-a72b-8db971f1d5aa","resolution":{"observed_at":"2026-07-12T05:51:08.895411Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14059","last_updated":"2025-05-20T08:03:59Z","snapshot_observed_at":"2026-08-14T18:47:58.220615Z","submitted_at":"2025-05-20T08:03:59Z","title":"Dolphin: Document Image Parsing via Heterogeneous Anchor Prompting","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.14059","snapshot_observed_at":"2026-08-12T20:43:52.188447Z","title":"arXiv:2505.14059 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10628","last_updated":"2026-08-11T08:15:16Z","snapshot_observed_at":"2026-08-14T23:10:59.215042Z","submitted_at":"2026-08-11T08:15:16Z","title":"InSight-doc: Agentic Visual Perception for Long-Document Understanding","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-12T20:43:52.188447Z"},"links":{"cited_paper":"/paper/2505.14059","citing_paper":"/paper/2608.10628"},"observation_digest":"sha256:5f1ebf0ad56cb254b8627266e3f4d83dbadc6f3a1e3bc5b8dbf34047e04e4406","observation_id":"4de26b28-e5d8-40fc-81dd-65e4981ba74b","resolution":{"observed_at":"2026-08-12T20:43:52.188447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2505.14059/citation-record","integrity":"/paper/2505.14059/integrity","json":"/paper/2505.14059/citation-record.json","paper":"/paper/2505.14059"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:24.860524Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14059","last_updated":"2025-05-20T08:03:59Z","snapshot_observed_at":"2026-08-14T18:47:58.220615Z","submitted_at":"2025-05-20T08:03:59Z","title":"Dolphin: Document Image Parsing via Heterogeneous Anchor Prompting","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T15:42:24.860524Z"},"links":{"citing_paper":"/paper/2505.14059"},"observation_digest":"sha256:9aa2386fb738ec48bb6bfd289ad55ab755316ede425e04d2971cff5117e4dc37","observation_id":"cb0cb67c-dc93-4600-aa24-c9c5db8a0aa0","resolution":{"observed_at":"2026-08-07T15:42:24.860524Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:24.949628Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14059","last_updated":"2025-05-20T08:03:59Z","snapshot_observed_at":"2026-08-14T18:47:58.220615Z","submitted_at":"2025-05-20T08:03:59Z","title":"Dolphin: Document Image Parsing via Heterogeneous Anchor Prompting","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T15:42:24.949628Z"},"links":{"citing_paper":"/paper/2505.14059"},"observation_digest":"sha256:fbe733380a4036704a71b7b43904399198ee2f1cad88c88fb9f9549bca1016a4","observation_id":"d2f48d4a-e29e-48f6-bae8-32abda07e602","resolution":{"observed_at":"2026-08-07T15:42:24.949628Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:37.682109Z","title":null,"venue":null,"work_id":"abdf19f6-a20f-4f5d-8dcc-93e07c20115c","year":2023},"citing_paper":{"arxiv_id":"2505.14059","last_updated":"2025-05-20T08:03:59Z","snapshot_observed_at":"2026-08-14T18:47:58.220615Z","submitted_at":"2025-05-20T08:03:59Z","title":"Dolphin: Document Image Parsing via Heterogeneous Anchor Prompting","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T15:42:25.004985Z"},"links":{"citing_paper":"/paper/2505.14059"},"observation_digest":"sha256:8fa017890fea23df030fef65a262d232660a65cd8fc58c33fc0c84817c47cf28","observation_id":"f38d51e7-8bda-46d3-ace5-c36b0b46d74c","resolution":{"observed_at":"2026-08-07T15:42:37.774921Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-08-14T04:17:22.593941Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-07T15:42:25.067277Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14059","last_updated":"2025-05-20T08:03:59Z","snapshot_observed_at":"2026-08-14T18:47:58.220615Z","submitted_at":"2025-05-20T08:03:59Z","title":"Dolphin: Document Image Parsing via Heterogeneous Anchor Prompting","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T15:42:25.067277Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2505.14059"},"observation_digest":"sha256:298aa5e5113c71ed580c9f5c4696bea82ed23a708691b3c396522d16ffdb4427","observation_id":"e31a9007-30fe-49f1-b30d-47dd6225bfe1","resolution":{"observed_at":"2026-08-07T15:42:25.067277Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:37.437088Z","title":"Nougat: Neural optical understanding for academic documents","venue":null,"work_id":"c0848e8d-1cdb-4758-91cb-ab9329924130","year":null},"citing_paper":{"arxiv_id":"2505.14059","last_updated":"2025-05-20T08:03:59Z","snapshot_observed_at":"2026-08-14T18:47:58.220615Z","submitted_at":"2025-05-20T08:03:59Z","title":"Dolphin: Document Image Parsing via Heterogeneous Anchor Prompting","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T15:42:25.150376Z"},"links":{"citing_paper":"/paper/2505.14059"},"observation_digest":"sha256:e3ee5273ce4cc16ed7cb58a9589ddd14132dd3bd97cfbcad2affc28830114c44","observation_id":"d960d805-f559-459d-a234-baf46c453f1b","resolution":{"observed_at":"2026-08-07T15:42:37.540737Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.12505","last_updated":"2025-05-22T07:59:33Z","snapshot_observed_at":"2026-08-14T18:48:33.412673Z","submitted_at":"2024-12-17T03:20:00Z","title":"DocFusion: A Unified Framework for Document Parsing Tasks","version":2},"cited_work":{"arxiv_id":"2412.12505","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.12505","snapshot_observed_at":"2026-08-07T15:42:32.291738Z","title":"DocFusion: A Unified Framework for Document Parsing Tasks","venue":"cs.CL","work_id":"c8e07fbe-f7e7-431a-9885-58fef9f402c5","year":2024},"citing_paper":{"arxiv_id":"2505.14059","last_updated":"2025-05-20T08:03:59Z","snapshot_observed_at":"2026-08-14T18:47:58.220615Z","submitted_at":"2025-05-20T08:03:59Z","title":"Dolphin: Document Image Parsing via Heterogeneous Anchor Prompting","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T15:42:25.216463Z"},"links":{"cited_paper":"/paper/2412.12505","citing_paper":"/paper/2505.14059"},"observation_digest":"sha256:f2ab786a7a0162a03de7836f66d16842b08052e22e897b235ff353dd38d98446","observation_id":"d0af0262-56e8-4e72-8c9b-7a894f0d0fd4","resolution":{"observed_at":"2026-08-07T15:42:32.401854Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.15558","last_updated":"2025-01-26T15:20:39Z","snapshot_observed_at":"2026-08-14T08:01:00.400549Z","submitted_at":"2025-01-26T15:20:39Z","title":"Ocean-OCR: Towards General OCR Application via a Vision-Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.15558","snapshot_observed_at":"2026-08-07T15:42:25.292711Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14059","last_updated":"2025-05-20T08:03:59Z","snapshot_observed_at":"2026-08-14T18:47:58.220615Z","submitted_at":"2025-05-20T08:03:59Z","title":"Dolphin: Document Image Parsing via Heterogeneous Anchor Prompting","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T15:42:25.292711Z"},"links":{"cited_paper":"/paper/2501.15558","citing_paper":"/paper/2505.14059"},"observation_digest":"sha256:14253cbc36ac9c01690d874e2da2d043e5ea0ea9acb07882b71e9609ed872650","observation_id":"acf72259-e3de-4028-b256-1aca9c9a9fb7","resolution":{"observed_at":"2026-08-07T15:42:25.292711Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:37.276532Z","title":null,"venue":null,"work_id":"c74e64eb-c096-439e-be08-f0560e8280f5","year":2024},"citing_paper":{"arxiv_id":"2505.14059","last_updated":"2025-05-20T08:03:59Z","snapshot_observed_at":"2026-08-14T18:47:58.220615Z","submitted_at":"2025-05-20T08:03:59Z","title":"Dolphin: Document Image Parsing via Heterogeneous Anchor Prompting","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T15:42:25.349905Z"},"links":{"citing_paper":"/paper/2505.14059"},"observation_digest":"sha256:8a78371bd0c686237c998a0877f1ec53aeb32c64f9b157bb5b1df7a25b2a795d","observation_id":"18a3cf19-5d82-4b29-94b2-7d85777d06f7","resolution":{"observed_at":"2026-08-07T15:42:37.366369Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:37.104116Z","title":"LaTe x rainbow: Open source document layout semantic annotation framework","venue":null,"work_id":"f3df6a5f-036c-4581-8b1d-cb06aa9c9bf9","year":null},"citing_paper":{"arxiv_id":"2505.14059","last_updated":"2025-05-20T08:03:59Z","snapshot_observed_at":"2026-08-14T18:47:58.220615Z","submitted_at":"2025-05-20T08:03:59Z","title":"Dolphin: Document Image Parsing via Heterogeneous Anchor Prompting","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T15:42:25.419426Z"},"links":{"citing_paper":"/paper/2505.14059"},"observation_digest":"sha256:9ad640f37a0ccf7378e2c28928ffc0267531a9734cf53a9f0d9d155607cde7d6","observation_id":"d131fa89-2a66-452a-acf0-535d64b70310","resolution":{"observed_at":"2026-08-07T15:42:37.200336Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:36.885413Z","title":null,"venue":null,"work_id":"ac15e228-a045-4076-803f-c40860a71d76","year":2024},"citing_paper":{"arxiv_id":"2505.14059","last_updated":"2025-05-20T08:03:59Z","snapshot_observed_at":"2026-08-14T18:47:58.220615Z","submitted_at":"2025-05-20T08:03:59Z","title":"Dolphin: Document Image Parsing via Heterogeneous Anchor Prompting","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T15:42:25.491792Z"},"links":{"citing_paper":"/paper/2505.14059"},"observation_digest":"sha256:b1675feb2b07952b9cb0c84f1dba2242a563b64901bfc9ee9648a77e1d206697","observation_id":"295566e0-4648-422f-9936-148e52488807","resolution":{"observed_at":"2026-08-07T15:42:36.975889Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.11592","last_updated":"2023-09-02T04:28:42Z","snapshot_observed_at":"2026-08-13T10:31:47.306856Z","submitted_at":"2023-08-19T17:32:34Z","title":"UniDoc: A Universal Large Multimodal Model for Simultaneous Text Detection, Recognition, Spotting and Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.11592","snapshot_observed_at":"2026-08-07T15:42:25.553617Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14059","last_updated":"2025-05-20T08:03:59Z","snapshot_observed_at":"2026-08-14T18:47:58.220615Z","submitted_at":"2025-05-20T08:03:59Z","title":"Dolphin: Document Image Parsing via Heterogeneous Anchor Prompting","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T15:42:25.553617Z"},"links":{"cited_paper":"/paper/2308.11592","citing_paper":"/paper/2505.14059"},"observation_digest":"sha256:ff076fda8a75b525ec65e93b48e3e0c7bd601f91680e89efc6b6dcefed932c1d","observation_id":"0e2b5b13-105c-4794-aadd-32dc8d11ce79","resolution":{"observed_at":"2026-08-07T15:42:25.553617Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:36.657384Z","title":null,"venue":null,"work_id":"736c9580-dc40-4613-81dd-1bc7507c3fd3","year":2020},"citing_paper":{"arxiv_id":"2505.14059","last_updated":"2025-05-20T08:03:59Z","snapshot_observed_at":"2026-08-14T18:47:58.220615Z","submitted_at":"2025-05-20T08:03:59Z","title":"Dolphin: Document Image Parsing via Heterogeneous Anchor Prompting","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T15:42:25.614995Z"},"links":{"citing_paper":"/paper/2505.14059"},"observation_digest":"sha256:be45c57cd931e1726fb26cc884d2b69ebb72a065c962a1f62e06df68502d36e9","observation_id":"1536b17e-782a-4d8e-a043-a012b7fa7183","resolution":{"observed_at":"2026-08-07T15:42:36.751105Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.03420","last_updated":"2024-09-09T05:36:27Z","snapshot_observed_at":"2026-08-12T22:50:50.231608Z","submitted_at":"2024-09-05T11:09:00Z","title":"mPLUG-DocOwl2: High-resolution Compressing for OCR-free Multi-page Document Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.03420","snapshot_observed_at":"2026-08-07T15:42:25.692279Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14059","last_updated":"2025-05-20T08:03:59Z","snapshot_observed_at":"2026-08-14T18:47:58.220615Z","submitted_at":"2025-05-20T08:03:59Z","title":"Dolphin: Document Image Parsing via Heterogeneous Anchor Prompting","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T15:42:25.692279Z"},"links":{"cited_paper":"/paper/2409.03420","citing_paper":"/paper/2505.14059"},"observation_digest":"sha256:2361980522387679abf9f6eed9fabfd83d2658dc6320f1a5b0997c469f27cdc4","observation_id":"ff61d71a-9f7d-47a7-a885-c2a16f2f1f94","resolution":{"observed_at":"2026-08-07T15:42:25.692279Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:36.479731Z","title":null,"venue":null,"work_id":"44698967-1971-4c45-a571-d7180860b505","year":2022},"citing_paper":{"arxiv_id":"2505.14059","last_updated":"2025-05-20T08:03:59Z","snapshot_observed_at":"2026-08-14T18:47:58.220615Z","submitted_at":"2025-05-20T08:03:59Z","title":"Dolphin: Document Image Parsing via Heterogeneous Anchor Prompting","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T15:42:25.770130Z"},"links":{"citing_paper":"/paper/2505.14059"},"observation_digest":"sha256:89f33fc24ba56859214ec33e6708a55a809673ca12fa832da1308c3eadad3ca1","observation_id":"3a2e7f47-e435-43bd-af26-e5d8171321dc","resolution":{"observed_at":"2026-08-07T15:42:36.546908Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:36.209557Z","title":null,"venue":null,"work_id":"9aa0b369-1f97-4484-8566-3ba328f3c384","year":2023},"citing_paper":{"arxiv_id":"2505.14059","last_updated":"2025-05-20T08:03:59Z","snapshot_observed_at":"2026-08-14T18:47:58.220615Z","submitted_at":"2025-05-20T08:03:59Z","title":"Dolphin: Document Image Parsing via Heterogeneous Anchor Prompting","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T15:42:25.833770Z"},"links":{"citing_paper":"/paper/2505.14059"},"observation_digest":"sha256:df4dce3668803ce068f2c0c3bffb0fb67a2f459b5507e361be17aec9a39ed0de","observation_id":"724e4287-40f5-46a3-bef8-0ca2bf1d4901","resolution":{"observed_at":"2026-08-07T15:42:36.340573Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:35.965898Z","title":null,"venue":null,"work_id":"2a51d2a1-3596-488b-8c3c-1ad851d69335","year":2022},"citing_paper":{"arxiv_id":"2505.14059","last_updated":"2025-05-20T08:03:59Z","snapshot_observed_at":"2026-08-14T18:47:58.220615Z","submitted_at":"2025-05-20T08:03:59Z","title":"Dolphin: Document Image Parsing via Heterogeneous Anchor Prompting","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T15:42:25.898307Z"},"links":{"citing_paper":"/paper/2505.14059"},"observation_digest":"sha256:09cbe35050a5814c9800e918e2a1e558ac44fe741c09bd277ef5794ec5c01191","observation_id":"17986647-2644-4afc-9aff-c7f953a97de2","resolution":{"observed_at":"2026-08-07T15:42:36.072634Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:35.714310Z","title":null,"venue":null,"work_id":"a9c9edf4-a588-406e-b057-744bf3181653","year":2023},"citing_paper":{"arxiv_id":"2505.14059","last_updated":"2025-05-20T08:03:59Z","snapshot_observed_at":"2026-08-14T18:47:58.220615Z","submitted_at":"2025-05-20T08:03:59Z","title":"Dolphin: Document Image Parsing via Heterogeneous Anchor Prompting","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T15:42:25.969264Z"},"links":{"citing_paper":"/paper/2505.14059"},"observation_digest":"sha256:4c79033be5239fcbce4f302b55959053a041b3d7f96e3112f40cb332d0736324","observation_id":"b57a9933-61d2-4178-ad49-e66c01d7b981","resolution":{"observed_at":"2026-08-07T15:42:35.866120Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.13461","last_updated":"2019-10-29T18:01:00Z","snapshot_observed_at":"2026-07-06T08:33:12.534026Z","submitted_at":"2019-10-29T18:01:00Z","title":"BART: Denoising Sequence-to-Sequence Pre-training for Natural Language Generation, Translation, and Comprehension","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.13461","snapshot_observed_at":"2026-08-07T15:42:26.033280Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.14059","last_updated":"2025-05-20T08:03:59Z","snapshot_observed_at":"2026-08-14T18:47:58.220615Z","submitted_at":"2025-05-20T08:03:59Z","title":"Dolphin: Document Image Parsing via Heterogeneous Anchor Prompting","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T15:42:26.033280Z"},"links":{"cited_paper":"/paper/1910.13461","citing_paper":"/paper/2505.14059"},"observation_digest":"sha256:351c3618280587cb9c6638b6d08763392cf3dbc630e66cafa76b17689f0e49eb","observation_id":"dee7ed97-c1d0-4096-bc77-6890701c08f1","resolution":{"observed_at":"2026-08-07T15:42:26.033280Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:35.487738Z","title":null,"venue":null,"work_id":"6584a8ac-84f2-4d17-9654-29cd95adbb15","year":2024},"citing_paper":{"arxiv_id":"2505.14059","last_updated":"2025-05-20T08:03:59Z","snapshot_observed_at":"2026-08-14T18:47:58.220615Z","submitted_at":"2025-05-20T08:03:59Z","title":"Dolphin: Document Image Parsing via Heterogeneous Anchor Prompting","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T15:42:26.091435Z"},"links":{"citing_paper":"/paper/2505.14059"},"observation_digest":"sha256:f21480b9589044444603d977f82433f9733e8fb1dea38cf82c75764346359364","observation_id":"2728c6e2-e856-4196-98e9-c9fee3874d9b","resolution":{"observed_at":"2026-08-07T15:42:35.595820Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14295","last_updated":"2024-05-23T08:15:49Z","snapshot_observed_at":"2026-08-15T10:45:23.930039Z","submitted_at":"2024-05-23T08:15:49Z","title":"Focus Anywhere for Fine-grained Multi-page Document Understanding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14295","snapshot_observed_at":"2026-08-07T15:42:26.152677Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14059","last_updated":"2025-05-20T08:03:59Z","snapshot_observed_at":"2026-08-14T18:47:58.220615Z","submitted_at":"2025-05-20T08:03:59Z","title":"Dolphin: Document Image Parsing via Heterogeneous Anchor Prompting","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T15:42:26.152677Z"},"links":{"cited_paper":"/paper/2405.14295","citing_paper":"/paper/2505.14059"},"observation_digest":"sha256:50ebe0da2736527967dbb404ffb7cdc103721901f716a437487f0a06a9b33fe4","observation_id":"33f4b08f-fb7e-4913-bb46-bc3f66d79f58","resolution":{"observed_at":"2026-08-07T15:42:26.152677Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:35.233053Z","title":null,"venue":null,"work_id":"51fbefb2-ec4a-4ba2-92eb-1416e14634a7","year":2024},"citing_paper":{"arxiv_id":"2505.14059","last_updated":"2025-05-20T08:03:59Z","snapshot_observed_at":"2026-08-14T18:47:58.220615Z","submitted_at":"2025-05-20T08:03:59Z","title":"Dolphin: Document Image Parsing via Heterogeneous Anchor Prompting","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T15:42:26.222583Z"},"links":{"citing_paper":"/paper/2505.14059"},"observation_digest":"sha256:f444a7a6d972414eedb7fbf0b6c33cbe3c8cc0b88dc402bcc5a7cc08713097c0","observation_id":"d32249e2-c699-4df2-8993-a03bc7afebc6","resolution":{"observed_at":"2026-08-07T15:42:35.368657Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04473","last_updated":"2024-03-15T06:51:30Z","snapshot_observed_at":"2026-08-13T05:57:08.016883Z","submitted_at":"2024-03-07T13:16:24Z","title":"TextMonkey: An OCR-Free Large Multimodal Model for Understanding Document","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04473","snapshot_observed_at":"2026-08-07T15:42:26.253023Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14059","last_updated":"2025-05-20T08:03:59Z","snapshot_observed_at":"2026-08-14T18:47:58.220615Z","submitted_at":"2025-05-20T08:03:59Z","title":"Dolphin: Document Image Parsing via Heterogeneous Anchor Prompting","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T15:42:26.253023Z"},"links":{"cited_paper":"/paper/2403.04473","citing_paper":"/paper/2505.14059"},"observation_digest":"sha256:e86238753d48154769d05575d7760f306ef51852a66703b6505dd754d2b7f57f","observation_id":"63fe7e2c-b1a3-4b46-9cfb-c91351b1379f","resolution":{"observed_at":"2026-08-07T15:42:26.253023Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:35.004543Z","title":null,"venue":null,"work_id":"05d5433b-6285-4189-9ae5-03c268cc21f9","year":2021},"citing_paper":{"arxiv_id":"2505.14059","last_updated":"2025-05-20T08:03:59Z","snapshot_observed_at":"2026-08-14T18:47:58.220615Z","submitted_at":"2025-05-20T08:03:59Z","title":"Dolphin: Document Image Parsing via Heterogeneous Anchor Prompting","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T15:42:26.390301Z"},"links":{"citing_paper":"/paper/2505.14059"},"observation_digest":"sha256:e0acd3cde785962bf8a9e52b5dfbf10bb81db8c1e30a78c7797e2b94bd960083","observation_id":"0b5c6d38-8289-4f53-8721-035821af1c08","resolution":{"observed_at":"2026-08-07T15:42:35.114771Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.11419","last_updated":"2024-08-21T16:54:23Z","snapshot_observed_at":"2026-08-13T10:09:07.558559Z","submitted_at":"2023-09-20T15:50:08Z","title":"KOSMOS-2.5: A Multimodal Literate Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.11419","snapshot_observed_at":"2026-08-07T15:42:26.594364Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14059","last_updated":"2025-05-20T08:03:59Z","snapshot_observed_at":"2026-08-14T18:47:58.220615Z","submitted_at":"2025-05-20T08:03:59Z","title":"Dolphin: Document Image Parsing via Heterogeneous Anchor Prompting","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T15:42:26.594364Z"},"links":{"cited_paper":"/paper/2309.11419","citing_paper":"/paper/2505.14059"},"observation_digest":"sha256:f01319f6f666baecac2f7eba9faaab78f80c5bffe4f4bbdb9c55d00699594bc7","observation_id":"875dff2a-34fb-4356-b4d9-97215fd81879","resolution":{"observed_at":"2026-08-07T15:42:26.594364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:34.859074Z","title":null,"venue":null,"work_id":"fbaaeab1-83ae-40d0-a12f-5238fcfb4a30","year":2013},"citing_paper":{"arxiv_id":"2505.14059","last_updated":"2025-05-20T08:03:59Z","snapshot_observed_at":"2026-08-14T18:47:58.220615Z","submitted_at":"2025-05-20T08:03:59Z","title":"Dolphin: Document Image Parsing via Heterogeneous Anchor Prompting","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T15:42:26.855184Z"},"links":{"citing_paper":"/paper/2505.14059"},"observation_digest":"sha256:86ae036197667dccc35b0110417657fb08e4ac03042e5078c6fdf2a97d93933e","observation_id":"cc3e6821-0359-4c4a-9776-927ce50141f7","resolution":{"observed_at":"2026-08-07T15:42:34.927812Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11576","last_updated":"2025-03-14T16:44:14Z","snapshot_observed_at":"2026-08-15T04:53:52.728431Z","submitted_at":"2025-03-14T16:44:14Z","title":"SmolDocling: An ultra-compact vision-language model for end-to-end multi-modal document conversion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.11576","snapshot_observed_at":"2026-08-07T15:42:26.990881Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14059","last_updated":"2025-05-20T08:03:59Z","snapshot_observed_at":"2026-08-14T18:47:58.220615Z","submitted_at":"2025-05-20T08:03:59Z","title":"Dolphin: Document Image Parsing via Heterogeneous Anchor Prompting","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T15:42:26.990881Z"},"links":{"cited_paper":"/paper/2503.11576","citing_paper":"/paper/2505.14059"},"observation_digest":"sha256:dea99732d87af1db588288cb9c1971b5a1f4b23f7dcc69542385a3665ccaa82f","observation_id":"4f8d34df-db08-49f0-9a62-eb1f29194697","resolution":{"observed_at":"2026-08-07T15:42:26.990881Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.14824","last_updated":"2023-07-13T05:41:34Z","snapshot_observed_at":"2026-08-12T12:24:23.815073Z","submitted_at":"2023-06-26T16:32:47Z","title":"Kosmos-2: Grounding Multimodal Large Language Models to the World","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.14824","snapshot_observed_at":"2026-08-07T15:42:27.138099Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14059","last_updated":"2025-05-20T08:03:59Z","snapshot_observed_at":"2026-08-14T18:47:58.220615Z","submitted_at":"2025-05-20T08:03:59Z","title":"Dolphin: Document Image Parsing via Heterogeneous Anchor Prompting","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T15:42:27.138099Z"},"links":{"cited_paper":"/paper/2306.14824","citing_paper":"/paper/2505.14059"},"observation_digest":"sha256:3a25e9fd48c7f37ce4c1acec38bce086a551d4016788d3372d39f237dc2e653a","observation_id":"9de8bb53-3275-4f67-bac0-d4516231a116","resolution":{"observed_at":"2026-08-07T15:42:27.138099Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:27.315516Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14059","last_updated":"2025-05-20T08:03:59Z","snapshot_observed_at":"2026-08-14T18:47:58.220615Z","submitted_at":"2025-05-20T08:03:59Z","title":"Dolphin: Document Image Parsing via Heterogeneous Anchor Prompting","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T15:42:27.315516Z"},"links":{"citing_paper":"/paper/2505.14059"},"observation_digest":"sha256:98a27b1cdca11ac16ee8a19dc2313960489aaf101bf4aa4f9a8a29521dfb0709","observation_id":"698340eb-2623-40e8-9984-28eeb7609af6","resolution":{"observed_at":"2026-08-07T15:42:27.315516Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:34.707911Z","title":null,"venue":null,"work_id":"5a4e2e42-4b07-49f4-9ec0-575d560c8e33","year":2022},"citing_paper":{"arxiv_id":"2505.14059","last_updated":"2025-05-20T08:03:59Z","snapshot_observed_at":"2026-08-14T18:47:58.220615Z","submitted_at":"2025-05-20T08:03:59Z","title":"Dolphin: Document Image Parsing via Heterogeneous Anchor Prompting","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T15:42:27.492472Z"},"links":{"citing_paper":"/paper/2505.14059"},"observation_digest":"sha256:2fe089eed9a1b842be98f60155eaa5d8a3f260359230800fa837580a9f0d1e0f","observation_id":"033cc504-4d02-49a3-ab02-7e984497625e","resolution":{"observed_at":"2026-08-07T15:42:34.773193Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.12803","last_updated":"2025-06-11T03:20:44Z","snapshot_observed_at":"2026-08-13T00:26:07.355712Z","submitted_at":"2024-04-19T11:38:08Z","title":"TextSquare: Scaling up Text-Centric Visual Instruction Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.12803","snapshot_observed_at":"2026-08-07T15:42:27.569659Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14059","last_updated":"2025-05-20T08:03:59Z","snapshot_observed_at":"2026-08-14T18:47:58.220615Z","submitted_at":"2025-05-20T08:03:59Z","title":"Dolphin: Document Image Parsing via Heterogeneous Anchor Prompting","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T15:42:27.569659Z"},"links":{"cited_paper":"/paper/2404.12803","citing_paper":"/paper/2505.14059"},"observation_digest":"sha256:8189d84eb19cf078ec4b2a18ffc8449850dba35d426e9c5727bd7ac13401f893","observation_id":"004401a8-f0c7-457d-9d87-b383096e6cdf","resolution":{"observed_at":"2026-08-07T15:42:27.569659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.11985","last_updated":"2025-06-11T03:33:02Z","snapshot_observed_at":"2026-08-14T15:19:05.187280Z","submitted_at":"2024-05-20T12:35:01Z","title":"MTVQA: Benchmarking Multilingual Text-Centric Visual Question Answering","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.11985","snapshot_observed_at":"2026-08-07T15:42:27.648631Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14059","last_updated":"2025-05-20T08:03:59Z","snapshot_observed_at":"2026-08-14T18:47:58.220615Z","submitted_at":"2025-05-20T08:03:59Z","title":"Dolphin: Document Image Parsing via Heterogeneous Anchor Prompting","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T15:42:27.648631Z"},"links":{"cited_paper":"/paper/2405.11985","citing_paper":"/paper/2505.14059"},"observation_digest":"sha256:82799e88ab4d6e6ab8f8e2c47d06c16a1796c5bb83c6fbb07edfc9f4dfa8ef1b","observation_id":"5c42ea2b-b3de-4070-8fb4-ef412deb4b9d","resolution":{"observed_at":"2026-08-07T15:42:27.648631Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:34.483020Z","title":null,"venue":null,"work_id":"20c5f883-d4dc-4a48-abaf-60561949c77f","year":2022},"citing_paper":{"arxiv_id":"2505.14059","last_updated":"2025-05-20T08:03:59Z","snapshot_observed_at":"2026-08-14T18:47:58.220615Z","submitted_at":"2025-05-20T08:03:59Z","title":"Dolphin: Document Image Parsing via Heterogeneous Anchor Prompting","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T15:42:27.827065Z"},"links":{"citing_paper":"/paper/2505.14059"},"observation_digest":"sha256:5275649d13a7150f85b69492c0c5919c287e843789ef9a8fbad8c56212ed0d5c","observation_id":"08c621b2-09c8-40a8-950f-0ec0975e6491","resolution":{"observed_at":"2026-08-07T15:42:34.599750Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:34.289843Z","title":null,"venue":null,"work_id":"9b674905-1746-401c-8966-2ca65c9f3eaf","year":2022},"citing_paper":{"arxiv_id":"2505.14059","last_updated":"2025-05-20T08:03:59Z","snapshot_observed_at":"2026-08-14T18:47:58.220615Z","submitted_at":"2025-05-20T08:03:59Z","title":"Dolphin: Document Image Parsing via Heterogeneous Anchor Prompting","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T15:42:28.013315Z"},"links":{"citing_paper":"/paper/2505.14059"},"observation_digest":"sha256:965968f75f4aae7d95bb3e32d5542d51fd598182af15060cbe7fe05283a0a826","observation_id":"74c5ef95-eb11-4739-aefb-a188f81ff338","resolution":{"observed_at":"2026-08-07T15:42:34.377573Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:34.129988Z","title":null,"venue":null,"work_id":"65340ced-c3bb-442b-a78b-e453aaa2907e","year":2023},"citing_paper":{"arxiv_id":"2505.14059","last_updated":"2025-05-20T08:03:59Z","snapshot_observed_at":"2026-08-14T18:47:58.220615Z","submitted_at":"2025-05-20T08:03:59Z","title":"Dolphin: Document Image Parsing via Heterogeneous Anchor Prompting","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T15:42:28.138095Z"},"links":{"citing_paper":"/paper/2505.14059"},"observation_digest":"sha256:ffaa3068ce2d853132c0bf67bd4705093ce5e963808c9140368665519fb8db3b","observation_id":"a39580f8-b2bb-4541-86ab-bc5977063a71","resolution":{"observed_at":"2026-08-07T15:42:34.206971Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05530","last_updated":"2024-12-16T17:39:39Z","snapshot_observed_at":"2026-08-14T18:15:53.516440Z","submitted_at":"2024-03-08T18:54:20Z","title":"Gemini 1.5: Unlocking multimodal understanding across millions of tokens of context","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05530","snapshot_observed_at":"2026-08-07T15:42:28.279635Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14059","last_updated":"2025-05-20T08:03:59Z","snapshot_observed_at":"2026-08-14T18:47:58.220615Z","submitted_at":"2025-05-20T08:03:59Z","title":"Dolphin: Document Image Parsing via Heterogeneous Anchor Prompting","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T15:42:28.279635Z"},"links":{"cited_paper":"/paper/2403.05530","citing_paper":"/paper/2505.14059"},"observation_digest":"sha256:bb32822362ec63b25a9ed74f63e0d53c1769712aa6a79b1b1768cd6977f45a31","observation_id":"6016da23-b36f-4baf-87d5-28fe1f2ade98","resolution":{"observed_at":"2026-08-07T15:42:28.279635Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:33.944571Z","title":null,"venue":null,"work_id":"ab49eaf8-0be3-46e2-93e5-7e3b01a4859f","year":2017},"citing_paper":{"arxiv_id":"2505.14059","last_updated":"2025-05-20T08:03:59Z","snapshot_observed_at":"2026-08-14T18:47:58.220615Z","submitted_at":"2025-05-20T08:03:59Z","title":"Dolphin: Document Image Parsing via Heterogeneous Anchor Prompting","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T15:42:28.502636Z"},"links":{"citing_paper":"/paper/2505.14059"},"observation_digest":"sha256:af80c7c4ba585a61d8d34dd50fa6f58178b244680682a357c142a1b22745a9d9","observation_id":"edeac974-ea23-4102-8a48-bcd3b22c4981","resolution":{"observed_at":"2026-08-07T15:42:34.038730Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.15254","last_updated":"2024-09-05T15:42:25Z","snapshot_observed_at":"2026-08-13T00:23:37.214135Z","submitted_at":"2024-04-23T17:39:27Z","title":"UniMERNet: A Universal Network for Real-World Mathematical Expression Recognition","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.15254","snapshot_observed_at":"2026-08-07T15:42:28.688888Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14059","last_updated":"2025-05-20T08:03:59Z","snapshot_observed_at":"2026-08-14T18:47:58.220615Z","submitted_at":"2025-05-20T08:03:59Z","title":"Dolphin: Document Image Parsing via Heterogeneous Anchor Prompting","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T15:42:28.688888Z"},"links":{"cited_paper":"/paper/2404.15254","citing_paper":"/paper/2505.14059"},"observation_digest":"sha256:b5271712972be99108c36ef20c65ce1c3e481740a217a7fc615520bab8ca2fba","observation_id":"0cd7478b-a09b-4260-b917-92121794d0fe","resolution":{"observed_at":"2026-08-07T15:42:28.688888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.18839","last_updated":"2024-09-27T15:35:15Z","snapshot_observed_at":"2026-08-14T02:54:31.558222Z","submitted_at":"2024-09-27T15:35:15Z","title":"MinerU: An Open-Source Solution for Precise Document Content Extraction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.18839","snapshot_observed_at":"2026-08-07T15:42:28.863648Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14059","last_updated":"2025-05-20T08:03:59Z","snapshot_observed_at":"2026-08-14T18:47:58.220615Z","submitted_at":"2025-05-20T08:03:59Z","title":"Dolphin: Document Image Parsing via Heterogeneous Anchor Prompting","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T15:42:28.863648Z"},"links":{"cited_paper":"/paper/2409.18839","citing_paper":"/paper/2505.14059"},"observation_digest":"sha256:c256d9795349abc82303d4ffcaeb3a60245ab1c690119aff4911d4b06ab30576","observation_id":"555fc07f-6944-41c6-8ff1-2b315048764b","resolution":{"observed_at":"2026-08-07T15:42:28.863648Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:33.781140Z","title":null,"venue":null,"work_id":"2cefb844-8cbd-4d95-b103-d996e40ef6d0","year":2024},"citing_paper":{"arxiv_id":"2505.14059","last_updated":"2025-05-20T08:03:59Z","snapshot_observed_at":"2026-08-14T18:47:58.220615Z","submitted_at":"2025-05-20T08:03:59Z","title":"Dolphin: Document Image Parsing via Heterogeneous Anchor Prompting","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T15:42:28.983196Z"},"links":{"citing_paper":"/paper/2505.14059"},"observation_digest":"sha256:cccacb1a437925d9fddb06f8a211efe0d23d0234c4cd69ae8f2a3fa52f87c51f","observation_id":"960fbd91-b244-48ae-a74b-6c2f47704d2c","resolution":{"observed_at":"2026-08-07T15:42:33.853994Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-08-06T05:35:29.109022Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-07T15:42:29.181440Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14059","last_updated":"2025-05-20T08:03:59Z","snapshot_observed_at":"2026-08-14T18:47:58.220615Z","submitted_at":"2025-05-20T08:03:59Z","title":"Dolphin: Document Image Parsing via Heterogeneous Anchor Prompting","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T15:42:29.181440Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2505.14059"},"observation_digest":"sha256:9410afc50a954d360f3880036cabdf9367a3f045845f33c86bb47e678f2d5763","observation_id":"6140fdca-3b2e-4b50-b1c9-6d5cbf1f00bc","resolution":{"observed_at":"2026-08-07T15:42:29.181440Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:33.603078Z","title":null,"venue":null,"work_id":"bdcc832f-f2fb-42b1-8c9e-cafa5f7f7463","year":2024},"citing_paper":{"arxiv_id":"2505.14059","last_updated":"2025-05-20T08:03:59Z","snapshot_observed_at":"2026-08-14T18:47:58.220615Z","submitted_at":"2025-05-20T08:03:59Z","title":"Dolphin: Document Image Parsing via Heterogeneous Anchor Prompting","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T15:42:29.365530Z"},"links":{"citing_paper":"/paper/2505.14059"},"observation_digest":"sha256:538c46c9387bd187be35bd5ef90c21491b1861aa90405deb37507dcbb11b7a6d","observation_id":"c1111718-0687-44b5-af77-1153ed15e5bb","resolution":{"observed_at":"2026-08-07T15:42:33.684908Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.13194","last_updated":"2023-12-15T08:12:32Z","snapshot_observed_at":"2026-08-13T05:19:54.214758Z","submitted_at":"2023-11-22T06:46:37Z","title":"Towards Improving Document Understanding: An Exploration on Text-Grounding via MLLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.13194","snapshot_observed_at":"2026-08-07T15:42:29.491492Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14059","last_updated":"2025-05-20T08:03:59Z","snapshot_observed_at":"2026-08-14T18:47:58.220615Z","submitted_at":"2025-05-20T08:03:59Z","title":"Dolphin: Document Image Parsing via Heterogeneous Anchor Prompting","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-07T15:42:29.491492Z"},"links":{"cited_paper":"/paper/2311.13194","citing_paper":"/paper/2505.14059"},"observation_digest":"sha256:7e3da56ba6757bc234c3e687fa03b5b5cb3611d8897a01d0e350112336f9945a","observation_id":"7cf65660-c4ff-48fb-b04e-6ecc9a6f071f","resolution":{"observed_at":"2026-08-07T15:42:29.491492Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:33.397975Z","title":null,"venue":null,"work_id":"cdb08c2f-68a3-4d8d-9aa8-a31f66a7730c","year":2024},"citing_paper":{"arxiv_id":"2505.14059","last_updated":"2025-05-20T08:03:59Z","snapshot_observed_at":"2026-08-14T18:47:58.220615Z","submitted_at":"2025-05-20T08:03:59Z","title":"Dolphin: Document Image Parsing via Heterogeneous Anchor Prompting","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-07T15:42:29.595723Z"},"links":{"citing_paper":"/paper/2505.14059"},"observation_digest":"sha256:a3a9ad239642c724cecf4f33127b58b62127a18c8116e88785ebaec7cec29fb2","observation_id":"60a09504-4224-4d0d-bc21-1979f3a3941b","resolution":{"observed_at":"2026-08-07T15:42:33.485972Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.01704","last_updated":"2024-09-03T08:41:31Z","snapshot_observed_at":"2026-08-10T02:15:09.754142Z","submitted_at":"2024-09-03T08:41:31Z","title":"General OCR Theory: Towards OCR-2.0 via a Unified End-to-end Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.01704","snapshot_observed_at":"2026-08-07T15:42:29.746865Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14059","last_updated":"2025-05-20T08:03:59Z","snapshot_observed_at":"2026-08-14T18:47:58.220615Z","submitted_at":"2025-05-20T08:03:59Z","title":"Dolphin: Document Image Parsing via Heterogeneous Anchor Prompting","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-07T15:42:29.746865Z"},"links":{"cited_paper":"/paper/2409.01704","citing_paper":"/paper/2505.14059"},"observation_digest":"sha256:f95e3b4144305da895ed2680c987903240faad2db4860b8dbedfdc85f1b50359","observation_id":"05f74a1d-8b18-407b-b1f3-b588864851e2","resolution":{"observed_at":"2026-08-07T15:42:29.746865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.10302","last_updated":"2024-12-13T17:37:48Z","snapshot_observed_at":"2026-08-07T03:01:29.031129Z","submitted_at":"2024-12-13T17:37:48Z","title":"DeepSeek-VL2: Mixture-of-Experts Vision-Language Models for Advanced Multimodal Understanding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.10302","snapshot_observed_at":"2026-08-07T15:42:29.872909Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14059","last_updated":"2025-05-20T08:03:59Z","snapshot_observed_at":"2026-08-14T18:47:58.220615Z","submitted_at":"2025-05-20T08:03:59Z","title":"Dolphin: Document Image Parsing via Heterogeneous Anchor Prompting","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-07T15:42:29.872909Z"},"links":{"cited_paper":"/paper/2412.10302","citing_paper":"/paper/2505.14059"},"observation_digest":"sha256:e6ff78ab75631d239a1ec158c3f58a40d32d2c2d84d27d78f7f89a58b80e8ee4","observation_id":"32a45eb8-f2a1-44d1-b9d4-f25a801b7ad8","resolution":{"observed_at":"2026-08-07T15:42:29.872909Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2012.14740","last_updated":"2022-01-10T04:08:10Z","snapshot_observed_at":"2026-08-14T06:12:20.181641Z","submitted_at":"2020-12-29T13:01:52Z","title":"LayoutLMv2: Multi-modal Pre-training for Visually-Rich Document Understanding","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.14740","snapshot_observed_at":"2026-08-07T15:42:29.988182Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.14059","last_updated":"2025-05-20T08:03:59Z","snapshot_observed_at":"2026-08-14T18:47:58.220615Z","submitted_at":"2025-05-20T08:03:59Z","title":"Dolphin: Document Image Parsing via Heterogeneous Anchor Prompting","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-07T15:42:29.988182Z"},"links":{"cited_paper":"/paper/2012.14740","citing_paper":"/paper/2505.14059"},"observation_digest":"sha256:6e65833e814e09bb9de21cfa2e2cd0a2cc7a3db1cba84f87a4ad6ff26c966d9e","observation_id":"ccdb6357-b1f2-4e13-87ac-e85f2b070bae","resolution":{"observed_at":"2026-08-07T15:42:29.988182Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:33.229525Z","title":null,"venue":null,"work_id":"29afe26a-77be-4150-93a8-109d3d0d3c8c","year":2020},"citing_paper":{"arxiv_id":"2505.14059","last_updated":"2025-05-20T08:03:59Z","snapshot_observed_at":"2026-08-14T18:47:58.220615Z","submitted_at":"2025-05-20T08:03:59Z","title":"Dolphin: Document Image Parsing via Heterogeneous Anchor Prompting","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-07T15:42:30.146086Z"},"links":{"citing_paper":"/paper/2505.14059"},"observation_digest":"sha256:14675945fe4d228c186a3456f4c7a0668fad6a4338227d82cc6fa123ee3dd233","observation_id":"da6665ab-ef8d-4e74-8cf9-82918dee383a","resolution":{"observed_at":"2026-08-07T15:42:33.313507Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17421","last_updated":"2023-10-11T05:07:37Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-29T17:34:51Z","title":"The Dawn of LMMs: Preliminary Explorations with GPT-4V(ision)","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.17421","snapshot_observed_at":"2026-08-07T15:42:30.234748Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14059","last_updated":"2025-05-20T08:03:59Z","snapshot_observed_at":"2026-08-14T18:47:58.220615Z","submitted_at":"2025-05-20T08:03:59Z","title":"Dolphin: Document Image Parsing via Heterogeneous Anchor Prompting","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-07T15:42:30.234748Z"},"links":{"cited_paper":"/paper/2309.17421","citing_paper":"/paper/2505.14059"},"observation_digest":"sha256:6866987dae3b7132b133471795262c4a918cef360e5e8fa96ffdc1cf6f8dbffa","observation_id":"16e9b915-6276-4faf-a6fa-61895bf2afe6","resolution":{"observed_at":"2026-08-07T15:42:30.234748Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.01800","last_updated":"2024-08-03T15:02:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-03T15:02:21Z","title":"MiniCPM-V: A GPT-4V Level MLLM on Your Phone","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.01800","snapshot_observed_at":"2026-08-07T15:42:30.405082Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14059","last_updated":"2025-05-20T08:03:59Z","snapshot_observed_at":"2026-08-14T18:47:58.220615Z","submitted_at":"2025-05-20T08:03:59Z","title":"Dolphin: Document Image Parsing via Heterogeneous Anchor Prompting","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-07T15:42:30.405082Z"},"links":{"cited_paper":"/paper/2408.01800","citing_paper":"/paper/2505.14059"},"observation_digest":"sha256:3a5b81bc89ff13f728ad24697f98880eccf32174350e6dfcbe6d10d70b2c51f7","observation_id":"4c5624b1-b94f-4b5f-b519-a962239c7d6d","resolution":{"observed_at":"2026-08-07T15:42:30.405082Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.02499","last_updated":"2023-07-04T11:28:07Z","snapshot_observed_at":"2026-08-13T11:03:04.175844Z","submitted_at":"2023-07-04T11:28:07Z","title":"mPLUG-DocOwl: Modularized Multimodal Large Language Model for Document Understanding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.02499","snapshot_observed_at":"2026-08-07T15:42:30.576365Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14059","last_updated":"2025-05-20T08:03:59Z","snapshot_observed_at":"2026-08-14T18:47:58.220615Z","submitted_at":"2025-05-20T08:03:59Z","title":"Dolphin: Document Image Parsing via Heterogeneous Anchor Prompting","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-07T15:42:30.576365Z"},"links":{"cited_paper":"/paper/2307.02499","citing_paper":"/paper/2505.14059"},"observation_digest":"sha256:611cad7a4de286145b5304ea7b71919d1c1c3065c30e1a39cdad57f47a7fb356","observation_id":"2d1152ff-f775-4bbb-8ec6-57a697ca8c0f","resolution":{"observed_at":"2026-08-07T15:42:30.576365Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05126","last_updated":"2023-10-08T11:33:09Z","snapshot_observed_at":"2026-08-13T05:54:33.801989Z","submitted_at":"2023-10-08T11:33:09Z","title":"UReader: Universal OCR-free Visually-situated Language Understanding with Multimodal Large Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05126","snapshot_observed_at":"2026-08-07T15:42:30.762169Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14059","last_updated":"2025-05-20T08:03:59Z","snapshot_observed_at":"2026-08-14T18:47:58.220615Z","submitted_at":"2025-05-20T08:03:59Z","title":"Dolphin: Document Image Parsing via Heterogeneous Anchor Prompting","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-07T15:42:30.762169Z"},"links":{"cited_paper":"/paper/2310.05126","citing_paper":"/paper/2505.14059"},"observation_digest":"sha256:54c4d7cada153e28fed4d35db342818f2c9af26311757efdf625f5a881208400","observation_id":"a14b27b0-8113-4d7f-8a65-b09e36415b5a","resolution":{"observed_at":"2026-08-07T15:42:30.762169Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.09204","last_updated":"2024-04-14T09:48:37Z","snapshot_observed_at":"2026-08-15T02:47:36.974131Z","submitted_at":"2024-04-14T09:48:37Z","title":"TextHawk: Exploring Efficient Fine-Grained Perception of Multimodal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.09204","snapshot_observed_at":"2026-08-07T15:42:30.992620Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14059","last_updated":"2025-05-20T08:03:59Z","snapshot_observed_at":"2026-08-14T18:47:58.220615Z","submitted_at":"2025-05-20T08:03:59Z","title":"Dolphin: Document Image Parsing via Heterogeneous Anchor Prompting","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-07T15:42:30.992620Z"},"links":{"cited_paper":"/paper/2404.09204","citing_paper":"/paper/2505.14059"},"observation_digest":"sha256:d9facdf79110a79e91ff28c8e869f5bf6b02f68798253040f0e43722b24ce50f","observation_id":"bab3b555-d38c-47f6-afe0-f98bd8f69ca1","resolution":{"observed_at":"2026-08-07T15:42:30.992620Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.05261","last_updated":"2024-10-07T17:58:35Z","snapshot_observed_at":"2026-08-12T22:28:53.225342Z","submitted_at":"2024-10-07T17:58:35Z","title":"TextHawk2: A Large Vision-Language Model Excels in Bilingual OCR and Grounding with 16x Fewer Tokens","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.05261","snapshot_observed_at":"2026-08-07T15:42:31.079587Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14059","last_updated":"2025-05-20T08:03:59Z","snapshot_observed_at":"2026-08-14T18:47:58.220615Z","submitted_at":"2025-05-20T08:03:59Z","title":"Dolphin: Document Image Parsing via Heterogeneous Anchor Prompting","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-07T15:42:31.079587Z"},"links":{"cited_paper":"/paper/2410.05261","citing_paper":"/paper/2505.14059"},"observation_digest":"sha256:27d75a439324b8cdabef6b59d5c332ffc5f1e15c4798b2b07b494b91f21da7ca","observation_id":"d579bcc5-90ce-4206-a9d1-ca44152c45a2","resolution":{"observed_at":"2026-08-07T15:42:31.079587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:33.056261Z","title":null,"venue":null,"work_id":"1d1189a6-b5b6-45f6-a223-1c433e0a3755","year":2017},"citing_paper":{"arxiv_id":"2505.14059","last_updated":"2025-05-20T08:03:59Z","snapshot_observed_at":"2026-08-14T18:47:58.220615Z","submitted_at":"2025-05-20T08:03:59Z","title":"Dolphin: Document Image Parsing via Heterogeneous Anchor Prompting","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-07T15:42:31.187966Z"},"links":{"citing_paper":"/paper/2505.14059"},"observation_digest":"sha256:1331fcbc399e880dde8310195c19555b722a36d19c39159d32c6914ec04b3377","observation_id":"df90597f-0224-4119-9494-18078c53667e","resolution":{"observed_at":"2026-08-07T15:42:33.133994Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:32.893597Z","title":null,"venue":null,"work_id":"41047f5d-f721-4eed-94fb-d6033489b418","year":2024},"citing_paper":{"arxiv_id":"2505.14059","last_updated":"2025-05-20T08:03:59Z","snapshot_observed_at":"2026-08-14T18:47:58.220615Z","submitted_at":"2025-05-20T08:03:59Z","title":"Dolphin: Document Image Parsing via Heterogeneous Anchor Prompting","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-07T15:42:31.289944Z"},"links":{"citing_paper":"/paper/2505.14059"},"observation_digest":"sha256:69204f30b508b3a13b86fe855e60c1573a171a144d146f993420cb6790b6f8ee","observation_id":"41f600f9-a4d8-4601-bde0-620b2537eda5","resolution":{"observed_at":"2026-08-07T15:42:32.984752Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:32.743126Z","title":null,"venue":null,"work_id":"dbc9d223-5079-480b-965e-9df2ca4c24f1","year":2024},"citing_paper":{"arxiv_id":"2505.14059","last_updated":"2025-05-20T08:03:59Z","snapshot_observed_at":"2026-08-14T18:47:58.220615Z","submitted_at":"2025-05-20T08:03:59Z","title":"Dolphin: Document Image Parsing via Heterogeneous Anchor Prompting","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-07T15:42:31.478326Z"},"links":{"citing_paper":"/paper/2505.14059"},"observation_digest":"sha256:40bca9d09cff94fda70150b4ffe2e3bf546420345224991e708af22870357254","observation_id":"ddd95453-269c-4c94-97e6-8c49b189a28b","resolution":{"observed_at":"2026-08-07T15:42:32.812763Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:32.533468Z","title":null,"venue":null,"work_id":"4735387f-a4b0-44c4-a343-44630d71082f","year":2020},"citing_paper":{"arxiv_id":"2505.14059","last_updated":"2025-05-20T08:03:59Z","snapshot_observed_at":"2026-08-14T18:47:58.220615Z","submitted_at":"2025-05-20T08:03:59Z","title":"Dolphin: Document Image Parsing via Heterogeneous Anchor Prompting","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-07T15:42:31.629324Z"},"links":{"citing_paper":"/paper/2505.14059"},"observation_digest":"sha256:1b361fb33de98ae132bc7270dd1de224e2484a32a5426063942c43404036bf92","observation_id":"a33ffef7-fc08-42f8-a443-77db3428f67c","resolution":{"observed_at":"2026-08-07T15:42:32.659052Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.14059","last_updated":"2025-05-20T08:03:59Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-14T18:47:58.220615Z","submitted_at":"2025-05-20T08:03:59Z","title":"Dolphin: Document Image Parsing via Heterogeneous Anchor Prompting"},"reference_resolution":{"displayed":57,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":54,"verified_exact":1,"verified_fuzzy":2},"total_outbound_references":57},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 57 of 57 outbound references and 22 inbound Pith citation observations for arXiv:2505.14059."}