{"as_of":"2026-08-21T01:37:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:eef532c7e9ea51f3126a30d759446373d201cffecb1391b9e115aa82fdc36f28","coverage":[{"denominator":30,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":30,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T19:31:52.679349Z","state":"measured"},{"denominator":30,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":30,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.16407/citation-record","integrity":"/paper/2506.16407/integrity","json":"/paper/2506.16407/citation-record.json","paper":"/paper/2506.16407"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:31:53.563643Z","title":null,"venue":null,"work_id":"ffe4fde7-10a2-415c-a5d8-5edfc4e443bc","year":2024},"citing_paper":{"arxiv_id":"2506.16407","last_updated":"2025-06-19T15:38:31Z","snapshot_observed_at":"2026-08-18T12:49:11.369013Z","submitted_at":"2025-06-19T15:38:31Z","title":"Robustness Evaluation of OCR-based Visual Document Understanding under Multi-Modal Adversarial Attacks","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-15T19:31:52.488518Z"},"links":{"citing_paper":"/paper/2506.16407"},"observation_digest":"sha256:932eeb9c2803243561bc6b795c1eef406c456c8df86b88bfdd2ec091b37a9709","observation_id":"de966097-68a2-4b53-9655-d347e622ed7d","resolution":{"observed_at":"2026-08-15T19:31:53.569052Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:31:53.545293Z","title":"Manmatha","venue":null,"work_id":"bbfb899d-7630-40b5-b547-d5a67706f6b3","year":2021},"citing_paper":{"arxiv_id":"2506.16407","last_updated":"2025-06-19T15:38:31Z","snapshot_observed_at":"2026-08-18T12:49:11.369013Z","submitted_at":"2025-06-19T15:38:31Z","title":"Robustness Evaluation of OCR-based Visual Document Understanding under Multi-Modal Adversarial Attacks","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-15T19:31:52.494837Z"},"links":{"citing_paper":"/paper/2506.16407"},"observation_digest":"sha256:8d3c0385fc8e8b604eef0b9c21c8660b34807748cecffaf253bf95f214ae9cbf","observation_id":"de67ecde-26ee-4529-b6fd-eb6e44603762","resolution":{"observed_at":"2026-08-15T19:31:53.551044Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-08-14T04:17:22.593941Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-15T19:31:52.500389Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.16407","last_updated":"2025-06-19T15:38:31Z","snapshot_observed_at":"2026-08-18T12:49:11.369013Z","submitted_at":"2025-06-19T15:38:31Z","title":"Robustness Evaluation of OCR-based Visual Document Understanding under Multi-Modal Adversarial Attacks","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-15T19:31:52.500389Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2506.16407"},"observation_digest":"sha256:e60f72bd315577bafb038ade86c2770099e0067fc2d4bdc38f14cb2544ac3a75","observation_id":"4b951d10-46ae-4165-b84a-887699c5ba77","resolution":{"observed_at":"2026-08-15T19:31:52.500389Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:31:53.524964Z","title":null,"venue":null,"work_id":"fbbea336-c41e-442c-bf94-55a83b3d497d","year":2023},"citing_paper":{"arxiv_id":"2506.16407","last_updated":"2025-06-19T15:38:31Z","snapshot_observed_at":"2026-08-18T12:49:11.369013Z","submitted_at":"2025-06-19T15:38:31Z","title":"Robustness Evaluation of OCR-based Visual Document Understanding under Multi-Modal Adversarial Attacks","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-15T19:31:52.506208Z"},"links":{"citing_paper":"/paper/2506.16407"},"observation_digest":"sha256:7827351a4ec53f51a19e3431724e11d4da1a41a4a2ba50962dfdc02a96b71ac2","observation_id":"1de0f561-4328-4a68-b999-773af57775be","resolution":{"observed_at":"2026-08-15T19:31:53.532239Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:31:53.503536Z","title":null,"venue":null,"work_id":"fd5c7a28-edaa-4c22-b456-298fe7e88685","year":2024},"citing_paper":{"arxiv_id":"2506.16407","last_updated":"2025-06-19T15:38:31Z","snapshot_observed_at":"2026-08-18T12:49:11.369013Z","submitted_at":"2025-06-19T15:38:31Z","title":"Robustness Evaluation of OCR-based Visual Document Understanding under Multi-Modal Adversarial Attacks","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-15T19:31:52.513738Z"},"links":{"citing_paper":"/paper/2506.16407"},"observation_digest":"sha256:3e480a0ee9f4d0227c4c66241334ffc5dea5224e456548c7df1bf7c396cc30b1","observation_id":"84834916-238d-44a6-93f9-528182514c17","resolution":{"observed_at":"2026-08-15T19:31:53.510557Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:31:52.520314Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.16407","last_updated":"2025-06-19T15:38:31Z","snapshot_observed_at":"2026-08-18T12:49:11.369013Z","submitted_at":"2025-06-19T15:38:31Z","title":"Robustness Evaluation of OCR-based Visual Document Understanding under Multi-Modal Adversarial Attacks","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-15T19:31:52.520314Z"},"links":{"citing_paper":"/paper/2506.16407"},"observation_digest":"sha256:c954ea28fd77151dc7a3e34184bf842ac872701dde3092b8ec95935517bc6b76","observation_id":"e589b7a6-f953-48fd-bbbf-3f71b5c195aa","resolution":{"observed_at":"2026-08-15T19:31:52.520314Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:31:53.470409Z","title":null,"venue":null,"work_id":"33c31e66-1cc9-4497-933f-ea0f7fff55ec","year":2024},"citing_paper":{"arxiv_id":"2506.16407","last_updated":"2025-06-19T15:38:31Z","snapshot_observed_at":"2026-08-18T12:49:11.369013Z","submitted_at":"2025-06-19T15:38:31Z","title":"Robustness Evaluation of OCR-based Visual Document Understanding under Multi-Modal Adversarial Attacks","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-15T19:31:52.527482Z"},"links":{"citing_paper":"/paper/2506.16407"},"observation_digest":"sha256:b579ed1103c47204cf9d4cfec0dc12e2c8edd2069053f0da04125f1490a45f0c","observation_id":"84463c3a-0bc9-441f-981d-fbbfb3b68737","resolution":{"observed_at":"2026-08-15T19:31:53.477914Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-15T19:31:52.539745Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.16407","last_updated":"2025-06-19T15:38:31Z","snapshot_observed_at":"2026-08-18T12:49:11.369013Z","submitted_at":"2025-06-19T15:38:31Z","title":"Robustness Evaluation of OCR-based Visual Document Understanding under Multi-Modal Adversarial Attacks","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-15T19:31:52.539745Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2506.16407"},"observation_digest":"sha256:ba7e437aee1c2f7a31502baed60676a5d02353efaa2259ff9dd48a77367e2079","observation_id":"43f4e7a6-87e3-4ef4-b08c-03431574df27","resolution":{"observed_at":"2026-08-15T19:31:52.539745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.02623","last_updated":"2023-06-05T06:50:42Z","snapshot_observed_at":"2026-08-16T15:26:39.641716Z","submitted_at":"2023-06-05T06:50:42Z","title":"Do-GOOD: Towards Distribution Shift Evaluation for Pre-Trained Visual Document Understanding Models","version":1},"cited_work":{"arxiv_id":"2306.02623","doi":null,"metadata_source":"pith","pith_arxiv_id":"2306.02623","snapshot_observed_at":"2026-08-15T19:31:53.163946Z","title":"Do-GOOD: Towards Distribution Shift Evaluation for Pre-Trained Visual Document Understanding Models","venue":"cs.CV","work_id":"e3ed0b8e-4b08-4796-af0b-12b2bbdd03ba","year":2023},"citing_paper":{"arxiv_id":"2506.16407","last_updated":"2025-06-19T15:38:31Z","snapshot_observed_at":"2026-08-18T12:49:11.369013Z","submitted_at":"2025-06-19T15:38:31Z","title":"Robustness Evaluation of OCR-based Visual Document Understanding under Multi-Modal Adversarial Attacks","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-15T19:31:52.547774Z"},"links":{"cited_paper":"/paper/2306.02623","citing_paper":"/paper/2506.16407"},"observation_digest":"sha256:5a741c770f71feecb66eb618d691ba18bce562241aef012f1f22280bfb9300c6","observation_id":"df56c0e6-fe59-4ac9-b69e-f3aaf7e586ed","resolution":{"observed_at":"2026-08-15T19:31:53.170343Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:31:53.450879Z","title":null,"venue":null,"work_id":"c60841cf-fa31-49c7-8820-2a4429ea508d","year":2022},"citing_paper":{"arxiv_id":"2506.16407","last_updated":"2025-06-19T15:38:31Z","snapshot_observed_at":"2026-08-18T12:49:11.369013Z","submitted_at":"2025-06-19T15:38:31Z","title":"Robustness Evaluation of OCR-based Visual Document Understanding under Multi-Modal Adversarial Attacks","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-15T19:31:52.554443Z"},"links":{"citing_paper":"/paper/2506.16407"},"observation_digest":"sha256:6c758b034715b7aa5c6ba579598be066c6b09410dffc473ec00d66726f556efe","observation_id":"9ad7a0ec-a903-4f09-9c67-66f97d704adc","resolution":{"observed_at":"2026-08-15T19:31:53.457261Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:31:52.560614Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.16407","last_updated":"2025-06-19T15:38:31Z","snapshot_observed_at":"2026-08-18T12:49:11.369013Z","submitted_at":"2025-06-19T15:38:31Z","title":"Robustness Evaluation of OCR-based Visual Document Understanding under Multi-Modal Adversarial Attacks","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-15T19:31:52.560614Z"},"links":{"citing_paper":"/paper/2506.16407"},"observation_digest":"sha256:08a22c63fa3aa3e65a60e15bf556e85793daa2f66e37f264ed4dbc3bdc5683d6","observation_id":"06c1c97c-710b-4f4e-8892-468b6a37c5c7","resolution":{"observed_at":"2026-08-15T19:31:52.560614Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:31:53.431037Z","title":null,"venue":null,"work_id":"1e3a8d08-1bbb-4241-a300-07b72c1dd8b3","year":2019},"citing_paper":{"arxiv_id":"2506.16407","last_updated":"2025-06-19T15:38:31Z","snapshot_observed_at":"2026-08-18T12:49:11.369013Z","submitted_at":"2025-06-19T15:38:31Z","title":"Robustness Evaluation of OCR-based Visual Document Understanding under Multi-Modal Adversarial Attacks","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-15T19:31:52.567770Z"},"links":{"citing_paper":"/paper/2506.16407"},"observation_digest":"sha256:a698e2e3dd38097d37a0a1235decfd424fed39fe1ba007f258254f3ea8b73fc5","observation_id":"e7e6ebe8-0b12-4cc4-811c-d3e519613643","resolution":{"observed_at":"2026-08-15T19:31:53.437406Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:31:52.573133Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.16407","last_updated":"2025-06-19T15:38:31Z","snapshot_observed_at":"2026-08-18T12:49:11.369013Z","submitted_at":"2025-06-19T15:38:31Z","title":"Robustness Evaluation of OCR-based Visual Document Understanding under Multi-Modal Adversarial Attacks","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-15T19:31:52.573133Z"},"links":{"citing_paper":"/paper/2506.16407"},"observation_digest":"sha256:220757fc690c0a9e4ba2ba6dece0b66139b313ac580b4709015dc5d1ac4ce22e","observation_id":"717b545e-79b8-4fdc-95e6-4b7d2ec3d5ef","resolution":{"observed_at":"2026-08-15T19:31:52.573133Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.00357","last_updated":"2024-06-20T15:06:10Z","snapshot_observed_at":"2026-08-16T14:22:38.182009Z","submitted_at":"2024-02-01T05:57:10Z","title":"Safety of Multimodal Large Language Models on Images and Texts","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.00357","snapshot_observed_at":"2026-08-15T19:31:52.585142Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.16407","last_updated":"2025-06-19T15:38:31Z","snapshot_observed_at":"2026-08-18T12:49:11.369013Z","submitted_at":"2025-06-19T15:38:31Z","title":"Robustness Evaluation of OCR-based Visual Document Understanding under Multi-Modal Adversarial Attacks","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-15T19:31:52.585142Z"},"links":{"cited_paper":"/paper/2402.00357","citing_paper":"/paper/2506.16407"},"observation_digest":"sha256:3d6182761f664ff7e49e021e8de2458dba991161e31ad028137aa9a1de8cb5d1","observation_id":"fae58dc4-feec-41ee-ac7a-2ab4edfe5819","resolution":{"observed_at":"2026-08-15T19:31:52.585142Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05525","last_updated":"2024-03-11T16:47:41Z","snapshot_observed_at":"2026-08-19T16:22:29.898436Z","submitted_at":"2024-03-08T18:46:00Z","title":"DeepSeek-VL: Towards Real-World Vision-Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05525","snapshot_observed_at":"2026-08-15T19:31:52.590874Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.16407","last_updated":"2025-06-19T15:38:31Z","snapshot_observed_at":"2026-08-18T12:49:11.369013Z","submitted_at":"2025-06-19T15:38:31Z","title":"Robustness Evaluation of OCR-based Visual Document Understanding under Multi-Modal Adversarial Attacks","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-15T19:31:52.590874Z"},"links":{"cited_paper":"/paper/2403.05525","citing_paper":"/paper/2506.16407"},"observation_digest":"sha256:7d8eb7304d7c79dbba5370b0d1cbd754ef3fe6465347d5f78fc9ed27a0891726","observation_id":"91f6c54f-efa2-46ee-9102-a501c9d8fc14","resolution":{"observed_at":"2026-08-15T19:31:52.590874Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.01976","last_updated":"2025-05-19T11:31:04Z","snapshot_observed_at":"2026-08-17T06:13:49.359569Z","submitted_at":"2024-07-02T06:29:05Z","title":"A Bounding Box is Worth One Token: Interleaving Layout and Text in a Large Language Model for Document Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.01976","snapshot_observed_at":"2026-08-15T19:31:52.596598Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.16407","last_updated":"2025-06-19T15:38:31Z","snapshot_observed_at":"2026-08-18T12:49:11.369013Z","submitted_at":"2025-06-19T15:38:31Z","title":"Robustness Evaluation of OCR-based Visual Document Understanding under Multi-Modal Adversarial Attacks","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-15T19:31:52.596598Z"},"links":{"cited_paper":"/paper/2407.01976","citing_paper":"/paper/2506.16407"},"observation_digest":"sha256:6823416e3e1f577712146f8ab4942865dd2eae45e71f5121fbdeb525ba124a8e","observation_id":"53f21b78-e7c3-44da-b9ef-9384ac0db113","resolution":{"observed_at":"2026-08-15T19:31:52.596598Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:31:53.387251Z","title":null,"venue":null,"work_id":"45ccf5a1-4d3b-48fe-892e-af6fe9512ba5","year":2023},"citing_paper":{"arxiv_id":"2506.16407","last_updated":"2025-06-19T15:38:31Z","snapshot_observed_at":"2026-08-18T12:49:11.369013Z","submitted_at":"2025-06-19T15:38:31Z","title":"Robustness Evaluation of OCR-based Visual Document Understanding under Multi-Modal Adversarial Attacks","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-15T19:31:52.602330Z"},"links":{"citing_paper":"/paper/2506.16407"},"observation_digest":"sha256:446cc34a28655010168d8162d9d68596a1fb136ef8fd57adbe28bf81f9df7976","observation_id":"d3750521-7ae0-4a92-82e8-6c5fff5f8ba7","resolution":{"observed_at":"2026-08-15T19:31:53.393791Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:31:53.364792Z","title":null,"venue":null,"work_id":"fea801ba-4538-4ca4-b0c2-8f270099545f","year":2021},"citing_paper":{"arxiv_id":"2506.16407","last_updated":"2025-06-19T15:38:31Z","snapshot_observed_at":"2026-08-18T12:49:11.369013Z","submitted_at":"2025-06-19T15:38:31Z","title":"Robustness Evaluation of OCR-based Visual Document Understanding under Multi-Modal Adversarial Attacks","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-15T19:31:52.608040Z"},"links":{"citing_paper":"/paper/2506.16407"},"observation_digest":"sha256:23c19cce50f0693031157a0abe4a9531db10ac8cf2707da3f8b1b6be6922fb0f","observation_id":"589f3804-7dc0-4ae1-b793-8febcd79a862","resolution":{"observed_at":"2026-08-15T19:31:53.371702Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:31:53.341829Z","title":null,"venue":null,"work_id":"5c9e1923-071d-4108-b9fd-7448add0ad09","year":2024},"citing_paper":{"arxiv_id":"2506.16407","last_updated":"2025-06-19T15:38:31Z","snapshot_observed_at":"2026-08-18T12:49:11.369013Z","submitted_at":"2025-06-19T15:38:31Z","title":"Robustness Evaluation of OCR-based Visual Document Understanding under Multi-Modal Adversarial Attacks","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-15T19:31:52.614556Z"},"links":{"citing_paper":"/paper/2506.16407"},"observation_digest":"sha256:a6a1cdaa9377afde1bf8d40c86e3757ad100ecdd7595aeb0cadaa60548b51512","observation_id":"844c6ec4-5f78-4d94-ad27-fcfcfdbca00b","resolution":{"observed_at":"2026-08-15T19:31:53.348697Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.17468","last_updated":"2024-11-26T14:30:36Z","snapshot_observed_at":"2026-08-18T01:52:24.733135Z","submitted_at":"2024-11-26T14:30:36Z","title":"Adversarial Bounding Boxes Generation (ABBG) Attack against Visual Object Trackers","version":1},"cited_work":{"arxiv_id":"2411.17468","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.17468","snapshot_observed_at":"2026-08-15T19:31:52.985378Z","title":"Adversarial Bounding Boxes Generation (ABBG) Attack against Visual Object Trackers","venue":"cs.CV","work_id":"1f860e1b-8f71-479c-b714-814e786dbe83","year":2024},"citing_paper":{"arxiv_id":"2506.16407","last_updated":"2025-06-19T15:38:31Z","snapshot_observed_at":"2026-08-18T12:49:11.369013Z","submitted_at":"2025-06-19T15:38:31Z","title":"Robustness Evaluation of OCR-based Visual Document Understanding under Multi-Modal Adversarial Attacks","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-15T19:31:52.620243Z"},"links":{"cited_paper":"/paper/2411.17468","citing_paper":"/paper/2506.16407"},"observation_digest":"sha256:38ee2dc26d566002291be13d94d89094331808ede45e629e9e324fecb94e71ee","observation_id":"75f38645-84e9-4540-ae37-f7d3029af192","resolution":{"observed_at":"2026-08-15T19:31:52.991358Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:31:53.314250Z","title":null,"venue":null,"work_id":"f28d1626-cb80-4a09-ae64-8da56fcff212","year":2024},"citing_paper":{"arxiv_id":"2506.16407","last_updated":"2025-06-19T15:38:31Z","snapshot_observed_at":"2026-08-18T12:49:11.369013Z","submitted_at":"2025-06-19T15:38:31Z","title":"Robustness Evaluation of OCR-based Visual Document Understanding under Multi-Modal Adversarial Attacks","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-15T19:31:52.625746Z"},"links":{"citing_paper":"/paper/2506.16407"},"observation_digest":"sha256:4ebfd70ae72da92c4de319745c1a0b9c50151c2c82f2cc51049012c582df7844","observation_id":"21d0d97a-1fc3-4291-a426-3e1bfb9ebc9d","resolution":{"observed_at":"2026-08-15T19:31:53.321661Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:31:53.290291Z","title":null,"venue":null,"work_id":"7f7cd3a2-ba71-4ca4-8297-42cd91bcaad6","year":2019},"citing_paper":{"arxiv_id":"2506.16407","last_updated":"2025-06-19T15:38:31Z","snapshot_observed_at":"2026-08-18T12:49:11.369013Z","submitted_at":"2025-06-19T15:38:31Z","title":"Robustness Evaluation of OCR-based Visual Document Understanding under Multi-Modal Adversarial Attacks","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-15T19:31:52.632716Z"},"links":{"citing_paper":"/paper/2506.16407"},"observation_digest":"sha256:62fee1e58c06235ed18add9d0d9fb227ef277381500cb508396245e6cc37a5a0","observation_id":"9ab15701-eea6-4b3d-a0ce-389c8588e7d4","resolution":{"observed_at":"2026-08-15T19:31:53.298845Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18815","last_updated":"2024-12-25T07:51:57Z","snapshot_observed_at":"2026-08-20T08:49:27.569124Z","submitted_at":"2024-12-25T07:51:57Z","title":"Distortion-Aware Adversarial Attacks on Bounding Boxes of Object Detectors","version":1},"cited_work":{"arxiv_id":"2412.18815","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.18815","snapshot_observed_at":"2026-08-15T19:31:52.957337Z","title":"Distortion-Aware Adversarial Attacks on Bounding Boxes of Object Detectors","venue":"cs.CV","work_id":"78a2ea0a-a908-4717-b5e0-bb78d1ae7d00","year":2024},"citing_paper":{"arxiv_id":"2506.16407","last_updated":"2025-06-19T15:38:31Z","snapshot_observed_at":"2026-08-18T12:49:11.369013Z","submitted_at":"2025-06-19T15:38:31Z","title":"Robustness Evaluation of OCR-based Visual Document Understanding under Multi-Modal Adversarial Attacks","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-15T19:31:52.638078Z"},"links":{"cited_paper":"/paper/2412.18815","citing_paper":"/paper/2506.16407"},"observation_digest":"sha256:484cc138ed79b68b57fcfc2a03c19598478cfc0f3b2a0be6364f9b529741fb1e","observation_id":"49cc23e4-eb72-4fe1-95bc-dfff6e68f646","resolution":{"observed_at":"2026-08-15T19:31:52.965403Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.13213","last_updated":"2023-08-16T22:38:55Z","snapshot_observed_at":"2026-08-16T15:21:48.065276Z","submitted_at":"2023-06-22T22:13:03Z","title":"Visual Adversarial Examples Jailbreak Aligned Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.13213","snapshot_observed_at":"2026-08-15T19:31:52.643515Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.16407","last_updated":"2025-06-19T15:38:31Z","snapshot_observed_at":"2026-08-18T12:49:11.369013Z","submitted_at":"2025-06-19T15:38:31Z","title":"Robustness Evaluation of OCR-based Visual Document Understanding under Multi-Modal Adversarial Attacks","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-15T19:31:52.643515Z"},"links":{"cited_paper":"/paper/2306.13213","citing_paper":"/paper/2506.16407"},"observation_digest":"sha256:79681a7d8ec3373c683f660fba8834ed2842f66516b4cbfa1d08a4a3456af949","observation_id":"db723634-9c8c-44c3-bf72-2d779d908c5f","resolution":{"observed_at":"2026-08-15T19:31:52.643515Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:31:53.269234Z","title":null,"venue":null,"work_id":"f86a4e39-c948-42e6-9ad0-e8c994916ce3","year":2023},"citing_paper":{"arxiv_id":"2506.16407","last_updated":"2025-06-19T15:38:31Z","snapshot_observed_at":"2026-08-18T12:49:11.369013Z","submitted_at":"2025-06-19T15:38:31Z","title":"Robustness Evaluation of OCR-based Visual Document Understanding under Multi-Modal Adversarial Attacks","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-15T19:31:52.648853Z"},"links":{"citing_paper":"/paper/2506.16407"},"observation_digest":"sha256:874098241ab89555e5bc4575c3601e0f1b61684fd99e41c8f18e81fa9d22533a","observation_id":"481ea3c4-02c9-4e1e-b13a-1dcc5f33d618","resolution":{"observed_at":"2026-08-15T19:31:53.274685Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:31:52.655156Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.16407","last_updated":"2025-06-19T15:38:31Z","snapshot_observed_at":"2026-08-18T12:49:11.369013Z","submitted_at":"2025-06-19T15:38:31Z","title":"Robustness Evaluation of OCR-based Visual Document Understanding under Multi-Modal Adversarial Attacks","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-15T19:31:52.655156Z"},"links":{"citing_paper":"/paper/2506.16407"},"observation_digest":"sha256:c24133feac9c1b380c337eb7705e0ca3fc7790c928a25eba1e47dd6d94f40e30","observation_id":"22eebc68-389a-4cfb-8344-b1a3786c287a","resolution":{"observed_at":"2026-08-15T19:31:52.655156Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2012.14740","last_updated":"2022-01-10T04:08:10Z","snapshot_observed_at":"2026-08-16T18:55:28.472138Z","submitted_at":"2020-12-29T13:01:52Z","title":"LayoutLMv2: Multi-modal Pre-training for Visually-Rich Document Understanding","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.14740","snapshot_observed_at":"2026-08-15T19:31:52.660503Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.16407","last_updated":"2025-06-19T15:38:31Z","snapshot_observed_at":"2026-08-18T12:49:11.369013Z","submitted_at":"2025-06-19T15:38:31Z","title":"Robustness Evaluation of OCR-based Visual Document Understanding under Multi-Modal Adversarial Attacks","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-15T19:31:52.660503Z"},"links":{"cited_paper":"/paper/2012.14740","citing_paper":"/paper/2506.16407"},"observation_digest":"sha256:3cffd144de297c88361ada75641666157ec69f0dc4ccb79e84cf52eef676f4fa","observation_id":"4ec8e662-e56a-43cf-b0a1-f41bcf33de9e","resolution":{"observed_at":"2026-08-15T19:31:52.660503Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1905.07129","last_updated":"2019-06-04T11:35:58Z","snapshot_observed_at":"2026-08-18T12:33:53.728143Z","submitted_at":"2019-05-17T06:24:16Z","title":"ERNIE: Enhanced Language Representation with Informative Entities","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1905.07129","snapshot_observed_at":"2026-08-15T19:31:52.666800Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.16407","last_updated":"2025-06-19T15:38:31Z","snapshot_observed_at":"2026-08-18T12:49:11.369013Z","submitted_at":"2025-06-19T15:38:31Z","title":"Robustness Evaluation of OCR-based Visual Document Understanding under Multi-Modal Adversarial Attacks","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-15T19:31:52.666800Z"},"links":{"cited_paper":"/paper/1905.07129","citing_paper":"/paper/2506.16407"},"observation_digest":"sha256:458ecf05919b4094acf39f031f46046b24d7414f4095e36d0a7fa1f8d0f79074","observation_id":"b286b29a-2904-4c96-97e4-b2c5321f3be8","resolution":{"observed_at":"2026-08-15T19:31:52.666800Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:31:52.673349Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.16407","last_updated":"2025-06-19T15:38:31Z","snapshot_observed_at":"2026-08-18T12:49:11.369013Z","submitted_at":"2025-06-19T15:38:31Z","title":"Robustness Evaluation of OCR-based Visual Document Understanding under Multi-Modal Adversarial Attacks","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-15T19:31:52.673349Z"},"links":{"citing_paper":"/paper/2506.16407"},"observation_digest":"sha256:13b233e0dd90f472b4ddf93d7bf036056acfa6900c98a82c6a80a8cd7e1d6c6c","observation_id":"0e0c71d9-0119-4895-86c9-e068385d4bcb","resolution":{"observed_at":"2026-08-15T19:31:52.673349Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:31:52.679349Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.16407","last_updated":"2025-06-19T15:38:31Z","snapshot_observed_at":"2026-08-18T12:49:11.369013Z","submitted_at":"2025-06-19T15:38:31Z","title":"Robustness Evaluation of OCR-based Visual Document Understanding under Multi-Modal Adversarial Attacks","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-15T19:31:52.679349Z"},"links":{"citing_paper":"/paper/2506.16407"},"observation_digest":"sha256:b13c952485f056e0436e8b024a1d16d1bd209db6e9644e658bd57fb4e40493bf","observation_id":"d4680499-0cc9-455a-83d2-eadf7aecf9c7","resolution":{"observed_at":"2026-08-15T19:31:52.679349Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.16407","last_updated":"2025-06-19T15:38:31Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-18T12:49:11.369013Z","submitted_at":"2025-06-19T15:38:31Z","title":"Robustness Evaluation of OCR-based Visual Document Understanding under Multi-Modal Adversarial Attacks"},"reference_resolution":{"displayed":30,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":26,"verified_exact":3,"verified_fuzzy":1},"total_outbound_references":30},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 21 August 2026, this Paper Citation Record lists 30 of 30 outbound references and 0 inbound Pith citation observations for arXiv:2506.16407."}