{"as_of":"2026-08-18T07:45:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:af1afa8097f0de38be03f9b15eca60f5d63df67c3134ba1f63d69f38b8588c16","coverage":[{"denominator":48,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":48,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T12:09:04.011966Z","state":"measured"},{"denominator":48,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":48,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2412.14596/citation-record","integrity":"/paper/2412.14596/integrity","json":"/paper/2412.14596/citation-record.json","paper":"/paper/2412.14596"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:09:04.956931Z","title":null,"venue":null,"work_id":"61b1954d-897f-4277-a2bb-d4422d29dfe2","year":2024},"citing_paper":{"arxiv_id":"2412.14596","last_updated":"2024-12-19T07:31:40Z","snapshot_observed_at":"2026-08-17T17:34:41.308292Z","submitted_at":"2024-12-19T07:31:40Z","title":"LDP: Generalizing to Multilingual Visual Information Extraction by Language Decoupled Pretraining","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-11T12:09:03.687451Z"},"links":{"citing_paper":"/paper/2412.14596"},"observation_digest":"sha256:20885ca4f90accd51d382427e014f9c10035f5de64feaa72e43cf65f72bd2d81","observation_id":"49a4f920-7ace-4744-a9ef-58296699de4f","resolution":{"observed_at":"2026-08-11T12:09:04.965304Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:09:04.933629Z","title":null,"venue":null,"work_id":"515492a4-da09-42fe-b647-97c9c9f5c681","year":2023},"citing_paper":{"arxiv_id":"2412.14596","last_updated":"2024-12-19T07:31:40Z","snapshot_observed_at":"2026-08-17T17:34:41.308292Z","submitted_at":"2024-12-19T07:31:40Z","title":"LDP: Generalizing to Multilingual Visual Information Extraction by Language Decoupled Pretraining","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-11T12:09:03.694175Z"},"links":{"citing_paper":"/paper/2412.14596"},"observation_digest":"sha256:495797ec34ad444b698e048019f613e0083448a791792a37e54ee484bace0e7c","observation_id":"7d5a9d5e-9b5a-4624-8321-adb9261a1156","resolution":{"observed_at":"2026-08-11T12:09:04.940059Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:09:04.915683Z","title":null,"venue":null,"work_id":"03da85ef-9341-43cb-a9cc-cf12bf799cc6","year":2020},"citing_paper":{"arxiv_id":"2412.14596","last_updated":"2024-12-19T07:31:40Z","snapshot_observed_at":"2026-08-17T17:34:41.308292Z","submitted_at":"2024-12-19T07:31:40Z","title":"LDP: Generalizing to Multilingual Visual Information Extraction by Language Decoupled Pretraining","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-11T12:09:03.700233Z"},"links":{"citing_paper":"/paper/2412.14596"},"observation_digest":"sha256:270d0aba3b65c8a321a1992b6123c29d4c7a9ae5529f82b61ddb233317d71cb3","observation_id":"3d471004-9756-48ea-b0e7-88146446271c","resolution":{"observed_at":"2026-08-11T12:09:04.921480Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.06744","last_updated":"2022-07-14T08:52:07Z","snapshot_observed_at":"2026-08-17T20:48:28.070009Z","submitted_at":"2022-07-14T08:52:07Z","title":"TRIE++: Towards End-to-End Information Extraction from Visually Rich Documents","version":1},"cited_work":{"arxiv_id":"2207.06744","doi":null,"metadata_source":"pith","pith_arxiv_id":"2207.06744","snapshot_observed_at":"2026-08-11T12:09:04.224444Z","title":"TRIE++: Towards End-to-End Information Extraction from Visually Rich Documents","venue":"cs.CV","work_id":"2b4044db-0f7b-41dd-bfed-232bfbd37556","year":2022},"citing_paper":{"arxiv_id":"2412.14596","last_updated":"2024-12-19T07:31:40Z","snapshot_observed_at":"2026-08-17T17:34:41.308292Z","submitted_at":"2024-12-19T07:31:40Z","title":"LDP: Generalizing to Multilingual Visual Information Extraction by Language Decoupled Pretraining","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-11T12:09:03.708467Z"},"links":{"cited_paper":"/paper/2207.06744","citing_paper":"/paper/2412.14596"},"observation_digest":"sha256:d64d13910713df7f9707aa116f7a0318a8b3a599e033bb5f1cc027d6ffe39d60","observation_id":"242974b1-6d2f-4a93-84b9-772bbb6442e2","resolution":{"observed_at":"2026-08-11T12:09:04.232087Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:09:04.897889Z","title":null,"venue":null,"work_id":"0f4f9434-46c3-476c-a7c6-874d1a34458e","year":2009},"citing_paper":{"arxiv_id":"2412.14596","last_updated":"2024-12-19T07:31:40Z","snapshot_observed_at":"2026-08-17T17:34:41.308292Z","submitted_at":"2024-12-19T07:31:40Z","title":"LDP: Generalizing to Multilingual Visual Information Extraction by Language Decoupled Pretraining","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-11T12:09:03.714787Z"},"links":{"citing_paper":"/paper/2412.14596"},"observation_digest":"sha256:81c1ccba76a8e96408f06f17a44c6054860590bbfef8d0298f1e818278c361a4","observation_id":"5936255c-e7a2-455a-87db-cc3350bfb649","resolution":{"observed_at":"2026-08-11T12:09:04.904156Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:09:04.877968Z","title":null,"venue":null,"work_id":"c68fe4d1-84d0-49ea-a6a1-5ce37e212295","year":2019},"citing_paper":{"arxiv_id":"2412.14596","last_updated":"2024-12-19T07:31:40Z","snapshot_observed_at":"2026-08-17T17:34:41.308292Z","submitted_at":"2024-12-19T07:31:40Z","title":"LDP: Generalizing to Multilingual Visual Information Extraction by Language Decoupled Pretraining","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-11T12:09:03.720426Z"},"links":{"citing_paper":"/paper/2412.14596"},"observation_digest":"sha256:60fc10629bf24ed7d5b4da55b931ca10112e50c463833030b5503c8a12d027df","observation_id":"fbc03b8d-ab4d-4f87-ac68-c578b9a710f2","resolution":{"observed_at":"2026-08-11T12:09:04.884024Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:09:04.858971Z","title":null,"venue":null,"work_id":"40cc393a-f106-44ef-98e5-7ad974f1268d","year":2024},"citing_paper":{"arxiv_id":"2412.14596","last_updated":"2024-12-19T07:31:40Z","snapshot_observed_at":"2026-08-17T17:34:41.308292Z","submitted_at":"2024-12-19T07:31:40Z","title":"LDP: Generalizing to Multilingual Visual Information Extraction by Language Decoupled Pretraining","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-11T12:09:03.729402Z"},"links":{"citing_paper":"/paper/2412.14596"},"observation_digest":"sha256:6be88a6e8d700f3e33075e8bbefa77ad750d7c800c05be6d34f50ff7c4777c6e","observation_id":"a835e076-5c1d-4683-b66c-cbf0b5c60ec8","resolution":{"observed_at":"2026-08-11T12:09:04.864973Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:09:04.839371Z","title":null,"venue":null,"work_id":"d450f672-59e4-474f-b22c-2428c48ea46e","year":2022},"citing_paper":{"arxiv_id":"2412.14596","last_updated":"2024-12-19T07:31:40Z","snapshot_observed_at":"2026-08-17T17:34:41.308292Z","submitted_at":"2024-12-19T07:31:40Z","title":"LDP: Generalizing to Multilingual Visual Information Extraction by Language Decoupled Pretraining","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-11T12:09:03.735097Z"},"links":{"citing_paper":"/paper/2412.14596"},"observation_digest":"sha256:4367be3ea5e3fdd30dbc038a87bc1eee2edda68675985e101ba4198727e0c312","observation_id":"7e76ed2c-0ec6-45a9-8db6-f03833813123","resolution":{"observed_at":"2026-08-11T12:09:04.845473Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:09:04.820021Z","title":"W.; Ufkes, A.; and Derpanis, K","venue":null,"work_id":"95171d87-a0c7-4127-baea-fcde545d0307","year":2015},"citing_paper":{"arxiv_id":"2412.14596","last_updated":"2024-12-19T07:31:40Z","snapshot_observed_at":"2026-08-17T17:34:41.308292Z","submitted_at":"2024-12-19T07:31:40Z","title":"LDP: Generalizing to Multilingual Visual Information Extraction by Language Decoupled Pretraining","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-11T12:09:03.742153Z"},"links":{"citing_paper":"/paper/2412.14596"},"observation_digest":"sha256:3e10499d8e43e62693a7d5a0f0326688c28c094b0ce256d79970679aa28a1947","observation_id":"97dcca34-38ea-4d65-bc6a-287db9818a04","resolution":{"observed_at":"2026-08-11T12:09:04.825197Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.12895","last_updated":"2024-03-19T16:48:40Z","snapshot_observed_at":"2026-08-16T14:08:19.332089Z","submitted_at":"2024-03-19T16:48:40Z","title":"mPLUG-DocOwl 1.5: Unified Structure Learning for OCR-free Document Understanding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.12895","snapshot_observed_at":"2026-08-11T12:09:03.748983Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.14596","last_updated":"2024-12-19T07:31:40Z","snapshot_observed_at":"2026-08-17T17:34:41.308292Z","submitted_at":"2024-12-19T07:31:40Z","title":"LDP: Generalizing to Multilingual Visual Information Extraction by Language Decoupled Pretraining","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-11T12:09:03.748983Z"},"links":{"cited_paper":"/paper/2403.12895","citing_paper":"/paper/2412.14596"},"observation_digest":"sha256:40fcdadde8b56828ac39a220dc0ba4bd3f76f418bc137fcc7f1427180760f7ea","observation_id":"a903f1d5-da73-46b9-9320-8e5332c3d7d5","resolution":{"observed_at":"2026-08-11T12:09:03.748983Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:09:04.802949Z","title":null,"venue":null,"work_id":"d76cee19-5371-498f-91f5-4f18d87313e5","year":2022},"citing_paper":{"arxiv_id":"2412.14596","last_updated":"2024-12-19T07:31:40Z","snapshot_observed_at":"2026-08-17T17:34:41.308292Z","submitted_at":"2024-12-19T07:31:40Z","title":"LDP: Generalizing to Multilingual Visual Information Extraction by Language Decoupled Pretraining","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-11T12:09:03.755034Z"},"links":{"citing_paper":"/paper/2412.14596"},"observation_digest":"sha256:69ae94cb81f51d307fffc28f262fac39d7a675fcfe9d00996994032928032bd9","observation_id":"da6e5467-a369-405e-997d-cd44333f6ca2","resolution":{"observed_at":"2026-08-11T12:09:04.808251Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:09:04.785532Z","title":"K.; and Thiran, J.-P","venue":null,"work_id":"7a2a9ac9-a188-416d-95e9-007ccc0ce37e","year":2019},"citing_paper":{"arxiv_id":"2412.14596","last_updated":"2024-12-19T07:31:40Z","snapshot_observed_at":"2026-08-17T17:34:41.308292Z","submitted_at":"2024-12-19T07:31:40Z","title":"LDP: Generalizing to Multilingual Visual Information Extraction by Language Decoupled Pretraining","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-11T12:09:03.763507Z"},"links":{"citing_paper":"/paper/2412.14596"},"observation_digest":"sha256:8519cde60f6b9cd7750994d0cadf9aa90c9b2d7864d8bd6006296930ede03a42","observation_id":"07167004-bc68-43cd-bac5-0cc7444f611b","resolution":{"observed_at":"2026-08-11T12:09:04.790693Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:09:04.768159Z","title":null,"venue":null,"work_id":"326d9eee-39a9-4b0e-b42d-d87afdb75b0b","year":2022},"citing_paper":{"arxiv_id":"2412.14596","last_updated":"2024-12-19T07:31:40Z","snapshot_observed_at":"2026-08-17T17:34:41.308292Z","submitted_at":"2024-12-19T07:31:40Z","title":"LDP: Generalizing to Multilingual Visual Information Extraction by Language Decoupled Pretraining","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-11T12:09:03.771022Z"},"links":{"citing_paper":"/paper/2412.14596"},"observation_digest":"sha256:1f8509054b63a56eacbf0da34f906f9c23970030c8f4247b0a076272848c22a4","observation_id":"831aa1dc-c220-47be-b4fd-4505e2c6220e","resolution":{"observed_at":"2026-08-11T12:09:04.773573Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:09:04.747754Z","title":"P.; and Welling, M","venue":null,"work_id":"724bc2e4-8dc3-4bf1-b0d8-986e6f3ad664","year":2014},"citing_paper":{"arxiv_id":"2412.14596","last_updated":"2024-12-19T07:31:40Z","snapshot_observed_at":"2026-08-17T17:34:41.308292Z","submitted_at":"2024-12-19T07:31:40Z","title":"LDP: Generalizing to Multilingual Visual Information Extraction by Language Decoupled Pretraining","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-11T12:09:03.776335Z"},"links":{"citing_paper":"/paper/2412.14596"},"observation_digest":"sha256:8443b9ba719efd7a9517f62fa42c763c364742ddfd1d3297d7491e70e9669adc","observation_id":"024a74f9-703d-4ae7-a815-a27bc8d78ae2","resolution":{"observed_at":"2026-08-11T12:09:04.753222Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:09:04.731025Z","title":"C.; Lo, W.-Y.; et al","venue":null,"work_id":"8f11aa2f-d435-4e77-8f5e-3d1c90bb720d","year":2023},"citing_paper":{"arxiv_id":"2412.14596","last_updated":"2024-12-19T07:31:40Z","snapshot_observed_at":"2026-08-17T17:34:41.308292Z","submitted_at":"2024-12-19T07:31:40Z","title":"LDP: Generalizing to Multilingual Visual Information Extraction by Language Decoupled Pretraining","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-11T12:09:03.781746Z"},"links":{"citing_paper":"/paper/2412.14596"},"observation_digest":"sha256:d9eb6fdd8b30b24836d8ab15ffdb5d341790f7a03edb59c0ee5a4a1084ee3db8","observation_id":"fba64bd1-dc42-4708-aa65-9442f2ae64a2","resolution":{"observed_at":"2026-08-11T12:09:04.736151Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:09:04.714650Z","title":"D.; Agam, G.; Argamon, S.; Frieder, O.; Grossman, D","venue":null,"work_id":"604292e2-14f1-4bdc-82aa-ac3e2400223a","year":2006},"citing_paper":{"arxiv_id":"2412.14596","last_updated":"2024-12-19T07:31:40Z","snapshot_observed_at":"2026-08-17T17:34:41.308292Z","submitted_at":"2024-12-19T07:31:40Z","title":"LDP: Generalizing to Multilingual Visual Information Extraction by Language Decoupled Pretraining","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-11T12:09:03.787356Z"},"links":{"citing_paper":"/paper/2412.14596"},"observation_digest":"sha256:da844581657c3776850eb22c73f10d65cdb466891fac231b6bdfeaa2cd224d2b","observation_id":"106e1a95-0481-40c4-be67-0fd44a3e608c","resolution":{"observed_at":"2026-08-11T12:09:04.719565Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:09:04.697506Z","title":null,"venue":null,"work_id":"f880746d-7919-4d4b-b255-57f752413ac8","year":2020},"citing_paper":{"arxiv_id":"2412.14596","last_updated":"2024-12-19T07:31:40Z","snapshot_observed_at":"2026-08-17T17:34:41.308292Z","submitted_at":"2024-12-19T07:31:40Z","title":"LDP: Generalizing to Multilingual Visual Information Extraction by Language Decoupled Pretraining","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-11T12:09:03.792268Z"},"links":{"citing_paper":"/paper/2412.14596"},"observation_digest":"sha256:5b67c324179d27e0f3ae39eeeda936e2f15397329755579dc8428b7723cf6104","observation_id":"1ce2bcc8-d73f-43e9-91c3-ca3269e60ff3","resolution":{"observed_at":"2026-08-11T12:09:04.702970Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:09:04.678192Z","title":null,"venue":null,"work_id":"7919f531-6d6d-4093-b556-837c7ceded79","year":2021},"citing_paper":{"arxiv_id":"2412.14596","last_updated":"2024-12-19T07:31:40Z","snapshot_observed_at":"2026-08-17T17:34:41.308292Z","submitted_at":"2024-12-19T07:31:40Z","title":"LDP: Generalizing to Multilingual Visual Information Extraction by Language Decoupled Pretraining","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-11T12:09:03.798008Z"},"links":{"citing_paper":"/paper/2412.14596"},"observation_digest":"sha256:98c3e2d31ef568e1708dbe9651c7b26c5afdc12b553f90e75c61ff86d2367f98","observation_id":"eb550a2e-2c31-49ee-8207-b04c5c375566","resolution":{"observed_at":"2026-08-11T12:09:04.684898Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:09:04.661005Z","title":null,"venue":null,"work_id":"dc8e85fc-d25e-4e7f-ac17-39c1cdae0efe","year":2024},"citing_paper":{"arxiv_id":"2412.14596","last_updated":"2024-12-19T07:31:40Z","snapshot_observed_at":"2026-08-17T17:34:41.308292Z","submitted_at":"2024-12-19T07:31:40Z","title":"LDP: Generalizing to Multilingual Visual Information Extraction by Language Decoupled Pretraining","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-11T12:09:03.804054Z"},"links":{"citing_paper":"/paper/2412.14596"},"observation_digest":"sha256:2e529331c7a7be1ce1a78743ae75e05dffdf97bfee6c6a85091fd7990861d24f","observation_id":"b578fb83-9e15-413d-ae64-708ec509bcfc","resolution":{"observed_at":"2026-08-11T12:09:04.666001Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:09:04.643635Z","title":null,"venue":null,"work_id":"454b520f-045d-4f85-9db7-78ff8398da0c","year":2023},"citing_paper":{"arxiv_id":"2412.14596","last_updated":"2024-12-19T07:31:40Z","snapshot_observed_at":"2026-08-17T17:34:41.308292Z","submitted_at":"2024-12-19T07:31:40Z","title":"LDP: Generalizing to Multilingual Visual Information Extraction by Language Decoupled Pretraining","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-11T12:09:03.811555Z"},"links":{"citing_paper":"/paper/2412.14596"},"observation_digest":"sha256:f3cf581e89dc34951659857854e61c62bb62c050fb7401b2a3416a8f1dab5445","observation_id":"be0f5e10-d739-4374-890c-292ed3d6e740","resolution":{"observed_at":"2026-08-11T12:09:04.649132Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04473","last_updated":"2024-03-15T06:51:30Z","snapshot_observed_at":"2026-08-18T07:34:13.234486Z","submitted_at":"2024-03-07T13:16:24Z","title":"TextMonkey: An OCR-Free Large Multimodal Model for Understanding Document","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04473","snapshot_observed_at":"2026-08-11T12:09:03.819222Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.14596","last_updated":"2024-12-19T07:31:40Z","snapshot_observed_at":"2026-08-17T17:34:41.308292Z","submitted_at":"2024-12-19T07:31:40Z","title":"LDP: Generalizing to Multilingual Visual Information Extraction by Language Decoupled Pretraining","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-11T12:09:03.819222Z"},"links":{"cited_paper":"/paper/2403.04473","citing_paper":"/paper/2412.14596"},"observation_digest":"sha256:f432ece70c2128a73d8ff54648171b0fee61674e053d4a3a16594841323ab8d1","observation_id":"891e0cca-3531-40c6-9ecf-a1fe16fae0d6","resolution":{"observed_at":"2026-08-11T12:09:03.819222Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:09:04.620057Z","title":null,"venue":null,"work_id":"4388b296-db74-4f41-b0f5-eb0ccec5c7b9","year":2019},"citing_paper":{"arxiv_id":"2412.14596","last_updated":"2024-12-19T07:31:40Z","snapshot_observed_at":"2026-08-17T17:34:41.308292Z","submitted_at":"2024-12-19T07:31:40Z","title":"LDP: Generalizing to Multilingual Visual Information Extraction by Language Decoupled Pretraining","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-11T12:09:03.833675Z"},"links":{"citing_paper":"/paper/2412.14596"},"observation_digest":"sha256:ac7ca8eaa209fc46de23db639c9cd92c9f40b2c8297b9407072d133fdfa58ee2","observation_id":"0240406f-feaf-4785-b716-7b303da7217c","resolution":{"observed_at":"2026-08-11T12:09:04.625611Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:09:04.601669Z","title":null,"venue":null,"work_id":"502a5cc5-7a9b-4b06-9553-9cbb07004d39","year":2021},"citing_paper":{"arxiv_id":"2412.14596","last_updated":"2024-12-19T07:31:40Z","snapshot_observed_at":"2026-08-17T17:34:41.308292Z","submitted_at":"2024-12-19T07:31:40Z","title":"LDP: Generalizing to Multilingual Visual Information Extraction by Language Decoupled Pretraining","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-11T12:09:03.840143Z"},"links":{"citing_paper":"/paper/2412.14596"},"observation_digest":"sha256:e3f0fb4ec16c16c2441dbde0bc2714cd385f5310a6fed712969001fbda519602","observation_id":"56722b96-434f-49b7-a352-73300dae56b2","resolution":{"observed_at":"2026-08-11T12:09:04.607658Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:09:04.582077Z","title":null,"venue":null,"work_id":"642cf548-cc0e-4a77-92f4-9c9dab619676","year":2020},"citing_paper":{"arxiv_id":"2412.14596","last_updated":"2024-12-19T07:31:40Z","snapshot_observed_at":"2026-08-17T17:34:41.308292Z","submitted_at":"2024-12-19T07:31:40Z","title":"LDP: Generalizing to Multilingual Visual Information Extraction by Language Decoupled Pretraining","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-11T12:09:03.848136Z"},"links":{"citing_paper":"/paper/2412.14596"},"observation_digest":"sha256:947bf1b6ed32e20eda1f4c890193a818978459813dde027a18e1bce83ddc815a","observation_id":"6ab90df9-e8db-4955-a46c-e4fb7798ef4e","resolution":{"observed_at":"2026-08-11T12:09:04.587323Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:09:04.565941Z","title":null,"venue":null,"work_id":"59c9b60d-4975-4a10-8275-edb3ce32eb5b","year":2020},"citing_paper":{"arxiv_id":"2412.14596","last_updated":"2024-12-19T07:31:40Z","snapshot_observed_at":"2026-08-17T17:34:41.308292Z","submitted_at":"2024-12-19T07:31:40Z","title":"LDP: Generalizing to Multilingual Visual Information Extraction by Language Decoupled Pretraining","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-11T12:09:03.854586Z"},"links":{"citing_paper":"/paper/2412.14596"},"observation_digest":"sha256:d2b95f24d5495554998ca0da0100d345a6e0404065560f98b2926be679646f3f","observation_id":"d7d18ee1-92d9-4874-832b-79f8b387bdfe","resolution":{"observed_at":"2026-08-11T12:09:04.570620Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:09:04.548428Z","title":null,"venue":null,"work_id":"74e3e6df-571f-41ff-9f24-58286bc4fc3f","year":2019},"citing_paper":{"arxiv_id":"2412.14596","last_updated":"2024-12-19T07:31:40Z","snapshot_observed_at":"2026-08-17T17:34:41.308292Z","submitted_at":"2024-12-19T07:31:40Z","title":"LDP: Generalizing to Multilingual Visual Information Extraction by Language Decoupled Pretraining","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-11T12:09:03.863376Z"},"links":{"citing_paper":"/paper/2412.14596"},"observation_digest":"sha256:fe2fd18b3e02b29bd98552b18f6ffba57dbcc0686819d74fb6c74ef9ecb4f494","observation_id":"a3970bec-bbd2-4fd4-8c87-512ac5c74b01","resolution":{"observed_at":"2026-08-11T12:09:04.554034Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:09:04.531787Z","title":null,"venue":null,"work_id":"303fb37e-5214-4bfb-85d6-da678b54f56d","year":2020},"citing_paper":{"arxiv_id":"2412.14596","last_updated":"2024-12-19T07:31:40Z","snapshot_observed_at":"2026-08-17T17:34:41.308292Z","submitted_at":"2024-12-19T07:31:40Z","title":"LDP: Generalizing to Multilingual Visual Information Extraction by Language Decoupled Pretraining","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-11T12:09:03.871846Z"},"links":{"citing_paper":"/paper/2412.14596"},"observation_digest":"sha256:7e017648c473ff49249f8b856e9054ba0fa8771df4d5dd3ff90e0ef9eabe7da9","observation_id":"1c82e3d4-cbf6-459e-a727-bfbf157b8ae5","resolution":{"observed_at":"2026-08-11T12:09:04.537253Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:09:04.514570Z","title":null,"venue":null,"work_id":"036e6d67-36e7-42da-9dc1-e44a9c81f938","year":2023},"citing_paper":{"arxiv_id":"2412.14596","last_updated":"2024-12-19T07:31:40Z","snapshot_observed_at":"2026-08-17T17:34:41.308292Z","submitted_at":"2024-12-19T07:31:40Z","title":"LDP: Generalizing to Multilingual Visual Information Extraction by Language Decoupled Pretraining","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-11T12:09:03.878369Z"},"links":{"citing_paper":"/paper/2412.14596"},"observation_digest":"sha256:d39b6b9b741c312cc215769accbcdc749dc59f5ac2a60a16a0e125b757fa33b9","observation_id":"3d9df131-a2a2-4db8-94e9-a82e652afba9","resolution":{"observed_at":"2026-08-11T12:09:04.520059Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03082","last_updated":"2024-02-05T15:13:20Z","snapshot_observed_at":"2026-08-16T14:21:24.067315Z","submitted_at":"2024-02-05T15:13:20Z","title":"Visual Text Meets Low-level Vision: A Comprehensive Survey on Visual Text Processing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03082","snapshot_observed_at":"2026-08-11T12:09:03.884967Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.14596","last_updated":"2024-12-19T07:31:40Z","snapshot_observed_at":"2026-08-17T17:34:41.308292Z","submitted_at":"2024-12-19T07:31:40Z","title":"LDP: Generalizing to Multilingual Visual Information Extraction by Language Decoupled Pretraining","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-11T12:09:03.884967Z"},"links":{"cited_paper":"/paper/2402.03082","citing_paper":"/paper/2412.14596"},"observation_digest":"sha256:fd3d8b490c1d6899d1415e1af83a65fd03d10888631eb306589f5e3c297891f8","observation_id":"8f3e8990-377f-497e-9153-e78e104794f9","resolution":{"observed_at":"2026-08-11T12:09:03.884967Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:09:04.497714Z","title":null,"venue":null,"work_id":"e46673bd-4453-48fd-895f-0c01a23d37e3","year":2023},"citing_paper":{"arxiv_id":"2412.14596","last_updated":"2024-12-19T07:31:40Z","snapshot_observed_at":"2026-08-17T17:34:41.308292Z","submitted_at":"2024-12-19T07:31:40Z","title":"LDP: Generalizing to Multilingual Visual Information Extraction by Language Decoupled Pretraining","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-11T12:09:03.890966Z"},"links":{"citing_paper":"/paper/2412.14596"},"observation_digest":"sha256:193191e018bd79f659d0826e1cfac6add08875311ae631d4fba44ebbf66d4945","observation_id":"05f9b188-c639-48c9-877c-c03cf90f940a","resolution":{"observed_at":"2026-08-11T12:09:04.503015Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-11T12:09:03.896884Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.14596","last_updated":"2024-12-19T07:31:40Z","snapshot_observed_at":"2026-08-17T17:34:41.308292Z","submitted_at":"2024-12-19T07:31:40Z","title":"LDP: Generalizing to Multilingual Visual Information Extraction by Language Decoupled Pretraining","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-11T12:09:03.896884Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2412.14596"},"observation_digest":"sha256:9175454399f6bee326e8d68542bc330471911b70959e6c4643b2e2d08964e05a","observation_id":"6b55b6cb-ee21-4857-abaa-3fde81e69b8d","resolution":{"observed_at":"2026-08-11T12:09:03.896884Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:09:04.479960Z","title":null,"venue":null,"work_id":"72bd297f-291a-4603-bc4e-a4b567385aca","year":2024},"citing_paper":{"arxiv_id":"2412.14596","last_updated":"2024-12-19T07:31:40Z","snapshot_observed_at":"2026-08-17T17:34:41.308292Z","submitted_at":"2024-12-19T07:31:40Z","title":"LDP: Generalizing to Multilingual Visual Information Extraction by Language Decoupled Pretraining","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-11T12:09:03.903868Z"},"links":{"citing_paper":"/paper/2412.14596"},"observation_digest":"sha256:7477abf4a1a4ecd78cda098f8287836df5b97ca0eafd9f2b54fc5379e05f39dc","observation_id":"f3ba7eea-3ed8-4331-8e09-e1b4cd71463d","resolution":{"observed_at":"2026-08-11T12:09:04.486010Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:09:04.463286Z","title":null,"venue":null,"work_id":"f42038d6-f0e9-43aa-a9f9-5668cc0b68d4","year":2022},"citing_paper":{"arxiv_id":"2412.14596","last_updated":"2024-12-19T07:31:40Z","snapshot_observed_at":"2026-08-17T17:34:41.308292Z","submitted_at":"2024-12-19T07:31:40Z","title":"LDP: Generalizing to Multilingual Visual Information Extraction by Language Decoupled Pretraining","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-11T12:09:03.911547Z"},"links":{"citing_paper":"/paper/2412.14596"},"observation_digest":"sha256:bf1aec073efe06d255cae86416917feb31dd714f7eb509e17c10ad10266e66af","observation_id":"b00ef65e-6e1f-4fa5-b912-2e20813dd18c","resolution":{"observed_at":"2026-08-11T12:09:04.468599Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:09:04.447115Z","title":null,"venue":null,"work_id":"15b0e2cc-0e73-4d0c-aaaf-27c0a3df7be7","year":2025},"citing_paper":{"arxiv_id":"2412.14596","last_updated":"2024-12-19T07:31:40Z","snapshot_observed_at":"2026-08-17T17:34:41.308292Z","submitted_at":"2024-12-19T07:31:40Z","title":"LDP: Generalizing to Multilingual Visual Information Extraction by Language Decoupled Pretraining","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-11T12:09:03.917114Z"},"links":{"citing_paper":"/paper/2412.14596"},"observation_digest":"sha256:4ffec204bf27538a9e0637cba2670cca7a843a9576cf71d813607896724a3343","observation_id":"bf1fa107-f15e-41b9-a007-af1c6902e7b2","resolution":{"observed_at":"2026-08-11T12:09:04.451987Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:09:04.428789Z","title":null,"venue":null,"work_id":"36f9c0a1-7a41-4be2-8d46-fc09c19e4219","year":2020},"citing_paper":{"arxiv_id":"2412.14596","last_updated":"2024-12-19T07:31:40Z","snapshot_observed_at":"2026-08-17T17:34:41.308292Z","submitted_at":"2024-12-19T07:31:40Z","title":"LDP: Generalizing to Multilingual Visual Information Extraction by Language Decoupled Pretraining","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-11T12:09:03.923865Z"},"links":{"citing_paper":"/paper/2412.14596"},"observation_digest":"sha256:d56e1dbddcfa2252826718d29d0d7a12d774f69aa55bd697e4a5164703c29c16","observation_id":"c28aa921-b4c8-436e-9e86-dd8d5815aa7f","resolution":{"observed_at":"2026-08-11T12:09:04.434719Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.08836","last_updated":"2021-09-09T11:37:48Z","snapshot_observed_at":"2026-08-16T18:30:46.012900Z","submitted_at":"2021-04-18T12:16:00Z","title":"LayoutXLM: Multimodal Pre-training for Multilingual Visually-rich Document Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.08836","snapshot_observed_at":"2026-08-11T12:09:03.929798Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.14596","last_updated":"2024-12-19T07:31:40Z","snapshot_observed_at":"2026-08-17T17:34:41.308292Z","submitted_at":"2024-12-19T07:31:40Z","title":"LDP: Generalizing to Multilingual Visual Information Extraction by Language Decoupled Pretraining","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-11T12:09:03.929798Z"},"links":{"cited_paper":"/paper/2104.08836","citing_paper":"/paper/2412.14596"},"observation_digest":"sha256:d1fc4f8cf7b831d889a15d2470b65905f0f68bba4184820f86fe6a3bd4a3349c","observation_id":"b60822af-2cca-4b0a-b8ad-98bd4b77f384","resolution":{"observed_at":"2026-08-11T12:09:03.929798Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:09:04.410565Z","title":null,"venue":null,"work_id":"7ea436d1-743e-43eb-a343-3cbb4a487c1e","year":2022},"citing_paper":{"arxiv_id":"2412.14596","last_updated":"2024-12-19T07:31:40Z","snapshot_observed_at":"2026-08-17T17:34:41.308292Z","submitted_at":"2024-12-19T07:31:40Z","title":"LDP: Generalizing to Multilingual Visual Information Extraction by Language Decoupled Pretraining","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-11T12:09:03.936431Z"},"links":{"citing_paper":"/paper/2412.14596"},"observation_digest":"sha256:62363e5d94d1813f389a62f00e5f6377194421ce078a763b42444187acc64cf9","observation_id":"f3a999f7-767d-4727-958f-683bb939655e","resolution":{"observed_at":"2026-08-11T12:09:04.416940Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:09:04.393191Z","title":null,"venue":null,"work_id":"b6808534-d3a9-4e6a-9ccd-932f24d64a06","year":2021},"citing_paper":{"arxiv_id":"2412.14596","last_updated":"2024-12-19T07:31:40Z","snapshot_observed_at":"2026-08-17T17:34:41.308292Z","submitted_at":"2024-12-19T07:31:40Z","title":"LDP: Generalizing to Multilingual Visual Information Extraction by Language Decoupled Pretraining","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-11T12:09:03.946258Z"},"links":{"citing_paper":"/paper/2412.14596"},"observation_digest":"sha256:fddf2ddf0f7891ca18b6612aab9e4b9a8d917d9d45adbcf291ac37a8af120d25","observation_id":"332cb12e-0b01-4db5-b78d-0f8eb1481935","resolution":{"observed_at":"2026-08-11T12:09:04.398771Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:09:04.374920Z","title":null,"venue":null,"work_id":"d1abd9f1-de06-4601-8d62-f03b7268bf06","year":2023},"citing_paper":{"arxiv_id":"2412.14596","last_updated":"2024-12-19T07:31:40Z","snapshot_observed_at":"2026-08-17T17:34:41.308292Z","submitted_at":"2024-12-19T07:31:40Z","title":"LDP: Generalizing to Multilingual Visual Information Extraction by Language Decoupled Pretraining","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-11T12:09:03.954288Z"},"links":{"citing_paper":"/paper/2412.14596"},"observation_digest":"sha256:7685b7fb45bac0cc68c83b0ddada58f0cb2f0d8a82094f6df27c0e5c42732a37","observation_id":"c89cf80f-1e0e-497a-b5b7-cb15e4a94821","resolution":{"observed_at":"2026-08-11T12:09:04.380849Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.02499","last_updated":"2023-07-04T11:28:07Z","snapshot_observed_at":"2026-08-16T15:18:52.045487Z","submitted_at":"2023-07-04T11:28:07Z","title":"mPLUG-DocOwl: Modularized Multimodal Large Language Model for Document Understanding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.02499","snapshot_observed_at":"2026-08-11T12:09:03.961608Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.14596","last_updated":"2024-12-19T07:31:40Z","snapshot_observed_at":"2026-08-17T17:34:41.308292Z","submitted_at":"2024-12-19T07:31:40Z","title":"LDP: Generalizing to Multilingual Visual Information Extraction by Language Decoupled Pretraining","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-11T12:09:03.961608Z"},"links":{"cited_paper":"/paper/2307.02499","citing_paper":"/paper/2412.14596"},"observation_digest":"sha256:cc8862bbf36bb9569d02fb4cdb5f3c7ee18f14865781853cf9589423c4c6b23c","observation_id":"e974b614-b4b3-4f7f-bdfa-88217caad9ab","resolution":{"observed_at":"2026-08-11T12:09:03.961608Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.14178","last_updated":"2024-03-29T08:13:38Z","snapshot_observed_at":"2026-08-16T17:13:28.893408Z","submitted_at":"2023-04-27T13:27:01Z","title":"mPLUG-Owl: Modularization Empowers Large Language Models with Multimodality","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.14178","snapshot_observed_at":"2026-08-11T12:09:03.967138Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.14596","last_updated":"2024-12-19T07:31:40Z","snapshot_observed_at":"2026-08-17T17:34:41.308292Z","submitted_at":"2024-12-19T07:31:40Z","title":"LDP: Generalizing to Multilingual Visual Information Extraction by Language Decoupled Pretraining","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-11T12:09:03.967138Z"},"links":{"cited_paper":"/paper/2304.14178","citing_paper":"/paper/2412.14596"},"observation_digest":"sha256:1b49baeaa9a99c296b40f2827d5f76fbe6c3cbf3ca0620849adf2a4aae929113","observation_id":"b8962175-23bd-4677-bf3c-e998705f720b","resolution":{"observed_at":"2026-08-11T12:09:03.967138Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:09:04.354078Z","title":null,"venue":null,"work_id":"ec295081-ba25-4346-9864-2f86531cd299","year":2023},"citing_paper":{"arxiv_id":"2412.14596","last_updated":"2024-12-19T07:31:40Z","snapshot_observed_at":"2026-08-17T17:34:41.308292Z","submitted_at":"2024-12-19T07:31:40Z","title":"LDP: Generalizing to Multilingual Visual Information Extraction by Language Decoupled Pretraining","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-11T12:09:03.973599Z"},"links":{"citing_paper":"/paper/2412.14596"},"observation_digest":"sha256:f94a69c19e3e0b71970fe60b9e397ffad06b5141fa686ea2db6f1cfbf2285387","observation_id":"3e42a562-6078-4f14-8c7e-0fac0c2fdd3e","resolution":{"observed_at":"2026-08-11T12:09:04.360059Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:09:04.334776Z","title":null,"venue":null,"work_id":"e93f2916-fe2e-4110-85cb-4d9b73650639","year":2024},"citing_paper":{"arxiv_id":"2412.14596","last_updated":"2024-12-19T07:31:40Z","snapshot_observed_at":"2026-08-17T17:34:41.308292Z","submitted_at":"2024-12-19T07:31:40Z","title":"LDP: Generalizing to Multilingual Visual Information Extraction by Language Decoupled Pretraining","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-11T12:09:03.980184Z"},"links":{"citing_paper":"/paper/2412.14596"},"observation_digest":"sha256:b182c0bbbe0683275f9cb98428e251bcb4ae54bf88729a2bd3ef22281e65c62a","observation_id":"823880b2-a9c5-4d49-b8cf-04fc08a573e5","resolution":{"observed_at":"2026-08-11T12:09:04.340401Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:09:04.314962Z","title":null,"venue":null,"work_id":"5ea88a5c-4290-43be-8965-37e0f44d66be","year":2023},"citing_paper":{"arxiv_id":"2412.14596","last_updated":"2024-12-19T07:31:40Z","snapshot_observed_at":"2026-08-17T17:34:41.308292Z","submitted_at":"2024-12-19T07:31:40Z","title":"LDP: Generalizing to Multilingual Visual Information Extraction by Language Decoupled Pretraining","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-11T12:09:03.987597Z"},"links":{"citing_paper":"/paper/2412.14596"},"observation_digest":"sha256:64d521af7552f503735d729dcb8e9ab07fae5a63f66f4b58136e38ac95c63cf5","observation_id":"5dba199f-ed26-4e30-a792-daf2713c5158","resolution":{"observed_at":"2026-08-11T12:09:04.321205Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:09:04.297675Z","title":null,"venue":null,"work_id":"ce0f97ea-c5bc-45cf-847f-30a3731eb6fa","year":2024},"citing_paper":{"arxiv_id":"2412.14596","last_updated":"2024-12-19T07:31:40Z","snapshot_observed_at":"2026-08-17T17:34:41.308292Z","submitted_at":"2024-12-19T07:31:40Z","title":"LDP: Generalizing to Multilingual Visual Information Extraction by Language Decoupled Pretraining","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-11T12:09:03.993206Z"},"links":{"citing_paper":"/paper/2412.14596"},"observation_digest":"sha256:54fe1f15828a207ce7decf227fbca14ac107ec3f9a54a35f98c1f11cf50c7fe1","observation_id":"224e8928-3fb9-4227-a697-40ef8aa24cf1","resolution":{"observed_at":"2026-08-11T12:09:04.303114Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:09:04.277243Z","title":null,"venue":null,"work_id":"ba56f9cc-13ce-4625-bd61-876e781e4bff","year":2020},"citing_paper":{"arxiv_id":"2412.14596","last_updated":"2024-12-19T07:31:40Z","snapshot_observed_at":"2026-08-17T17:34:41.308292Z","submitted_at":"2024-12-19T07:31:40Z","title":"LDP: Generalizing to Multilingual Visual Information Extraction by Language Decoupled Pretraining","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-11T12:09:03.999020Z"},"links":{"citing_paper":"/paper/2412.14596"},"observation_digest":"sha256:e738561049d27bf897033bac5369bdfa637eb3a5ac8d39bb1c9492d31e984b96","observation_id":"435c611e-25ba-4a4c-8bbf-8c0b5d4e0fda","resolution":{"observed_at":"2026-08-11T12:09:04.282761Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:09:04.005652Z","title":", \" * write output.state after.block = add.period write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.14596","last_updated":"2024-12-19T07:31:40Z","snapshot_observed_at":"2026-08-17T17:34:41.308292Z","submitted_at":"2024-12-19T07:31:40Z","title":"LDP: Generalizing to Multilingual Visual Information Extraction by Language Decoupled Pretraining","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-11T12:09:04.005652Z"},"links":{"citing_paper":"/paper/2412.14596"},"observation_digest":"sha256:ddc5ab44258c1771e3e54e2e28136f619a0b5e49bff15d440447903af1e7d934","observation_id":"4dc3aaa1-3742-4700-ab0f-2d1690549308","resolution":{"observed_at":"2026-08-11T12:09:04.005652Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:09:04.011966Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.14596","last_updated":"2024-12-19T07:31:40Z","snapshot_observed_at":"2026-08-17T17:34:41.308292Z","submitted_at":"2024-12-19T07:31:40Z","title":"LDP: Generalizing to Multilingual Visual Information Extraction by Language Decoupled Pretraining","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-11T12:09:04.011966Z"},"links":{"citing_paper":"/paper/2412.14596"},"observation_digest":"sha256:d9ab3c0cc33aeb0ed1320e0b4eb4a05e8bc2ef2211d853737ed952b3d24e3665","observation_id":"d9f2a996-0d5d-4062-baaf-c533d177793a","resolution":{"observed_at":"2026-08-11T12:09:04.011966Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2412.14596","last_updated":"2024-12-19T07:31:40Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-17T17:34:41.308292Z","submitted_at":"2024-12-19T07:31:40Z","title":"LDP: Generalizing to Multilingual Visual Information Extraction by Language Decoupled Pretraining"},"reference_resolution":{"displayed":48,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":42,"verified_exact":1,"verified_fuzzy":5},"total_outbound_references":48},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 48 of 48 outbound references and 0 inbound Pith citation observations for arXiv:2412.14596."}