{"as_of":"2026-08-20T19:56:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3edcf6a55484c75693877de25528504e10672d92c31668e37a44a8731a1debbf","coverage":[{"denominator":14,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":14,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-20T21:21:11.388050Z","state":"measured"},{"denominator":16,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":16,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-30T17:57:52.876448Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-06-30T18:04:58.287586Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2605.16409","last_updated":"2026-05-13T14:16:39Z","snapshot_observed_at":"2026-08-14T02:50:41.794143Z","submitted_at":"2026-05-13T14:16:39Z","title":"Multilingual OCR-Aware Fine-Tuning and Prompt-Guided Chain-of-Thought Reasoning for Multimodal Large Language Models","version":1},"cited_work":{"arxiv_id":"2605.16409","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.16409","snapshot_observed_at":"2026-06-30T18:04:58.287586Z","title":"Multilingual OCR-Aware Fine-Tuning and Prompt-Guided Chain-of-Thought Reasoning for Multimodal Large Language Models","venue":"cs.CV","work_id":"87d25a50-2606-48f5-b3d4-065701f2bbbd","year":2026},"citing_paper":{"arxiv_id":"2605.16409","last_updated":"2026-05-13T14:16:39Z","snapshot_observed_at":"2026-08-14T02:50:41.794143Z","submitted_at":"2026-05-13T14:16:39Z","title":"Multilingual OCR-Aware Fine-Tuning and Prompt-Guided Chain-of-Thought Reasoning for Multimodal Large Language Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-20T21:21:11.388050Z"},"links":{"cited_paper":"/paper/2605.16409","citing_paper":"/paper/2605.16409"},"observation_digest":"sha256:598e032166e6c2e68d9170368131799c8164dad347de21df93adc2e1ac52bd34","observation_id":"1451d5ac-f4a7-44b8-9c8a-fc1bfd28e8e5","resolution":{"observed_at":"2026-05-20T21:23:44.415247Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.16409","last_updated":"2026-05-13T14:16:39Z","snapshot_observed_at":"2026-08-14T02:50:41.794143Z","submitted_at":"2026-05-13T14:16:39Z","title":"Multilingual OCR-Aware Fine-Tuning and Prompt-Guided Chain-of-Thought Reasoning for Multimodal Large Language Models","version":1},"cited_work":{"arxiv_id":"2605.16409","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.16409","snapshot_observed_at":"2026-06-30T18:04:58.287586Z","title":"Multilingual OCR-Aware Fine-Tuning and Prompt-Guided Chain-of-Thought Reasoning for Multimodal Large Language Models","venue":"cs.CV","work_id":"87d25a50-2606-48f5-b3d4-065701f2bbbd","year":2026},"citing_paper":{"arxiv_id":"2605.20416","last_updated":"2026-05-24T16:52:15Z","snapshot_observed_at":"2026-08-15T04:30:13.784506Z","submitted_at":"2026-05-19T19:11:38Z","title":"Miller-Index-Based Latent Crystallographic Fracture Plane Reasoning and generation with Vision-Language Models","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-30T17:57:52.876448Z"},"links":{"cited_paper":"/paper/2605.16409","citing_paper":"/paper/2605.20416"},"observation_digest":"sha256:5aeaaedef590d330ead68656ffbb1c67c2185c29f0bb0533c1b6bf4480090318","observation_id":"b3454df4-84f8-482b-899e-a5c69e70053a","resolution":{"observed_at":"2026-06-30T18:04:58.290806Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2605.16409/citation-record","integrity":"/paper/2605.16409/integrity","json":"/paper/2605.16409/citation-record.json","paper":"/paper/2605.16409"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2605.16409","last_updated":"2026-05-13T14:16:39Z","snapshot_observed_at":"2026-08-14T02:50:41.794143Z","submitted_at":"2026-05-13T14:16:39Z","title":"Multilingual OCR-Aware Fine-Tuning and Prompt-Guided Chain-of-Thought Reasoning for Multimodal Large Language Models","version":1},"cited_work":{"arxiv_id":"2605.16409","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.16409","snapshot_observed_at":"2026-06-30T18:04:58.287586Z","title":"Multilingual OCR-Aware Fine-Tuning and Prompt-Guided Chain-of-Thought Reasoning for Multimodal Large Language Models","venue":"cs.CV","work_id":"87d25a50-2606-48f5-b3d4-065701f2bbbd","year":2026},"citing_paper":{"arxiv_id":"2605.16409","last_updated":"2026-05-13T14:16:39Z","snapshot_observed_at":"2026-08-14T02:50:41.794143Z","submitted_at":"2026-05-13T14:16:39Z","title":"Multilingual OCR-Aware Fine-Tuning and Prompt-Guided Chain-of-Thought Reasoning for Multimodal Large Language Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-20T21:21:11.388050Z"},"links":{"cited_paper":"/paper/2605.16409","citing_paper":"/paper/2605.16409"},"observation_digest":"sha256:598e032166e6c2e68d9170368131799c8164dad347de21df93adc2e1ac52bd34","observation_id":"1451d5ac-f4a7-44b8-9c8a-fc1bfd28e8e5","resolution":{"observed_at":"2026-05-20T21:23:44.415247Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"However, these approaches are often computationally expensive and difficult to deploy efficiently at scale","venue":null,"work_id":"bc9e036c-ca1e-4e2b-a410-853c5408095d","year":2023},"citing_paper":{"arxiv_id":"2605.16409","last_updated":"2026-05-13T14:16:39Z","snapshot_observed_at":"2026-08-14T02:50:41.794143Z","submitted_at":"2026-05-13T14:16:39Z","title":"Multilingual OCR-Aware Fine-Tuning and Prompt-Guided Chain-of-Thought Reasoning for Multimodal Large Language Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-20T21:21:11.388050Z"},"links":{"citing_paper":"/paper/2605.16409"},"observation_digest":"sha256:3ce63876658769f2fe2706b1483e51f73210ec11908fa5f63ab4b95971cc86fc","observation_id":"9d6ab3c9-4dcd-4032-acd6-f1665a438ef7","resolution":{"observed_at":"2026-05-20T21:24:03.693600Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"206f16c4-8e40-4a93-ba61-d581c761fbe5","year":2021},"citing_paper":{"arxiv_id":"2605.16409","last_updated":"2026-05-13T14:16:39Z","snapshot_observed_at":"2026-08-14T02:50:41.794143Z","submitted_at":"2026-05-13T14:16:39Z","title":"Multilingual OCR-Aware Fine-Tuning and Prompt-Guided Chain-of-Thought Reasoning for Multimodal Large Language Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-20T21:21:11.388050Z"},"links":{"citing_paper":"/paper/2605.16409"},"observation_digest":"sha256:5e2a672a8b0d3fd0eb4bdffc6cea990710ad773ec18e5b4977195fe8685aba23","observation_id":"0c788fcc-c292-427c-9e49-97eebc9969ed","resolution":{"observed_at":"2026-05-20T21:24:03.687035Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"You are a helpful visual assis- tant","venue":null,"work_id":"1d99531f-8132-4d24-aa1c-2f0f2bfe8c5f","year":2017},"citing_paper":{"arxiv_id":"2605.16409","last_updated":"2026-05-13T14:16:39Z","snapshot_observed_at":"2026-08-14T02:50:41.794143Z","submitted_at":"2026-05-13T14:16:39Z","title":"Multilingual OCR-Aware Fine-Tuning and Prompt-Guided Chain-of-Thought Reasoning for Multimodal Large Language Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-20T21:21:11.388050Z"},"links":{"citing_paper":"/paper/2605.16409"},"observation_digest":"sha256:4852c4a2caf7371f8389bbdfae0484a79cffa20b9e63ab555934dbdb7e1a74d3","observation_id":"2117faa5-6ef2-4ad4-b5f8-fbc75c62b9be","resolution":{"observed_at":"2026-05-20T21:24:03.691482Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12966","last_updated":"2023-10-13T02:41:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-24T17:59:17Z","title":"Qwen-VL: A Versatile Vision-Language Model for Understanding, Localization, Text Reading, and Beyond","version":3},"cited_work":{"arxiv_id":"2308.12966","doi":"10.48550/arxiv.2308.12966","metadata_source":"pith","pith_arxiv_id":"2308.12966","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen-VL: A Versatile Vision-Language Model for Understanding, Localization, Text Reading, and Beyond","venue":"cs.CV","work_id":"cbc2bb21-b6bb-46c0-80bf-107e195ffe10","year":2023},"citing_paper":{"arxiv_id":"2605.16409","last_updated":"2026-05-13T14:16:39Z","snapshot_observed_at":"2026-08-14T02:50:41.794143Z","submitted_at":"2026-05-13T14:16:39Z","title":"Multilingual OCR-Aware Fine-Tuning and Prompt-Guided Chain-of-Thought Reasoning for Multimodal Large Language Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-20T21:21:11.388050Z"},"links":{"cited_paper":"/paper/2308.12966","citing_paper":"/paper/2605.16409"},"observation_digest":"sha256:c70df4705beeadbdaf87745358d5b13f6111adb2a9bd28c3fa927c9623a31863","observation_id":"4953381a-e95f-4bf9-8521-68ab222e0158","resolution":{"observed_at":"2026-05-20T21:23:44.410859Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.18565","last_updated":"2023-05-29T18:58:38Z","snapshot_observed_at":"2026-08-07T07:27:51.369423Z","submitted_at":"2023-05-29T18:58:38Z","title":"PaLI-X: On Scaling up a Multilingual Vision and Language Model","version":1},"cited_work":{"arxiv_id":"2305.18565","doi":"10.48550/arxiv.2305.18565","metadata_source":"pith","pith_arxiv_id":"2305.18565","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"PaLI-X: On Scaling up a Multilingual Vision and Language Model","venue":"cs.CV","work_id":"b3f6141d-1fd1-42f9-8834-ff27d4a60d5f","year":2023},"citing_paper":{"arxiv_id":"2605.16409","last_updated":"2026-05-13T14:16:39Z","snapshot_observed_at":"2026-08-14T02:50:41.794143Z","submitted_at":"2026-05-13T14:16:39Z","title":"Multilingual OCR-Aware Fine-Tuning and Prompt-Guided Chain-of-Thought Reasoning for Multimodal Large Language Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-20T21:21:11.388050Z"},"links":{"cited_paper":"/paper/2305.18565","citing_paper":"/paper/2605.16409"},"observation_digest":"sha256:6500f3a1cbcdb7ab4508fa4c7f582d1c86e5da00d7145a151905b2bc8ef0abb6","observation_id":"1364a7fa-5cc4-4c58-af17-d8e7b5e04cdf","resolution":{"observed_at":"2026-05-20T21:23:44.393609Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.04671","last_updated":"2023-03-08T15:50:02Z","snapshot_observed_at":"2026-08-15T10:03:23.497428Z","submitted_at":"2023-03-08T15:50:02Z","title":"Visual ChatGPT: Talking, Drawing and Editing with Visual Foundation Models","version":1},"cited_work":{"arxiv_id":"2303.04671","doi":"10.48550/arxiv.2303.04671","metadata_source":"pith","pith_arxiv_id":"2303.04671","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Visual ChatGPT: Talking, Drawing and Editing with Visual Foundation Models","venue":"cs.CV","work_id":"b06ebfb8-5543-4f2c-af49-c05c4e63fc45","year":2023},"citing_paper":{"arxiv_id":"2605.16409","last_updated":"2026-05-13T14:16:39Z","snapshot_observed_at":"2026-08-14T02:50:41.794143Z","submitted_at":"2026-05-13T14:16:39Z","title":"Multilingual OCR-Aware Fine-Tuning and Prompt-Guided Chain-of-Thought Reasoning for Multimodal Large Language Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-20T21:21:11.388050Z"},"links":{"cited_paper":"/paper/2303.04671","citing_paper":"/paper/2605.16409"},"observation_digest":"sha256:974ddc457f83632d2dbe4fbd88a503cbd79cb45d04b72cb44adf1ea21477cc4d","observation_id":"6bb15c0c-50a4-4060-92f4-0177f37ff98e","resolution":{"observed_at":"2026-05-20T21:23:44.409801Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12986","last_updated":"2024-04-24T13:36:09Z","snapshot_observed_at":"2026-08-18T00:24:16.919937Z","submitted_at":"2024-02-20T13:16:32Z","title":"Enabling Efficient Hybrid Systolic Computation in Shared L1-Memory Manycore Clusters","version":2},"cited_work":{"arxiv_id":"2402.12986","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.12986","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Ang Jr., and others","venue":null,"work_id":"4365e164-85b2-4b2c-aee5-6721a3d2d8b4","year":null},"citing_paper":{"arxiv_id":"2605.16409","last_updated":"2026-05-13T14:16:39Z","snapshot_observed_at":"2026-08-14T02:50:41.794143Z","submitted_at":"2026-05-13T14:16:39Z","title":"Multilingual OCR-Aware Fine-Tuning and Prompt-Guided Chain-of-Thought Reasoning for Multimodal Large Language Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-20T21:21:11.388050Z"},"links":{"cited_paper":"/paper/2402.12986","citing_paper":"/paper/2605.16409"},"observation_digest":"sha256:413020f6b4261aa076a2e20f38545c9d31599d50224f34c37ff5841f3600dd47","observation_id":"2b7f7331-7dca-4129-8d50-890ef18f027b","resolution":{"observed_at":"2026-05-20T21:23:44.403745Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-17T09:58:46.058102Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":"2303.08774","doi":"10.1002/tea.20265","metadata_source":"pith","pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"GPT-4 Technical Report","venue":"cs.CL","work_id":"b928e041-6991-4c08-8c81-0359e4097c7b","year":2023},"citing_paper":{"arxiv_id":"2605.16409","last_updated":"2026-05-13T14:16:39Z","snapshot_observed_at":"2026-08-14T02:50:41.794143Z","submitted_at":"2026-05-13T14:16:39Z","title":"Multilingual OCR-Aware Fine-Tuning and Prompt-Guided Chain-of-Thought Reasoning for Multimodal Large Language Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-20T21:21:11.388050Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2605.16409"},"observation_digest":"sha256:8c1542f34999e8784a4add7fc5cec0b24a916cad4018f2ca255dd28fb1cbdfa3","observation_id":"e45adb0b-45c3-4407-9a76-c56c6415a95f","resolution":{"observed_at":"2026-05-20T21:23:44.391061Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.14824","last_updated":"2023-07-13T05:41:34Z","snapshot_observed_at":"2026-08-12T12:24:23.815073Z","submitted_at":"2023-06-26T16:32:47Z","title":"Kosmos-2: Grounding Multimodal Large Language Models to the World","version":3},"cited_work":{"arxiv_id":"2306.14824","doi":"10.48550/arxiv.2306.14824","metadata_source":"pith","pith_arxiv_id":"2306.14824","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Kosmos-2: Grounding Multimodal Large Language Models to the World","venue":"cs.CL","work_id":"46e7f9e9-24c6-49af-b7d5-96159fa6f443","year":2023},"citing_paper":{"arxiv_id":"2605.16409","last_updated":"2026-05-13T14:16:39Z","snapshot_observed_at":"2026-08-14T02:50:41.794143Z","submitted_at":"2026-05-13T14:16:39Z","title":"Multilingual OCR-Aware Fine-Tuning and Prompt-Guided Chain-of-Thought Reasoning for Multimodal Large Language Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-20T21:21:11.388050Z"},"links":{"cited_paper":"/paper/2306.14824","citing_paper":"/paper/2605.16409"},"observation_digest":"sha256:afe88b03c69c010858ae9f9c5c78174c6115bdceec5e1e11edea0658260450f5","observation_id":"ea9400ec-207a-477f-9d7d-5652e0fba1dc","resolution":{"observed_at":"2026-05-20T21:23:44.393270Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16671","last_updated":"2025-11-23T00:34:43Z","snapshot_observed_at":"2026-08-17T12:17:37.741844Z","submitted_at":"2023-09-28T17:59:56Z","title":"Demystifying CLIP Data","version":6},"cited_work":{"arxiv_id":"2309.16671","doi":null,"metadata_source":"pith","pith_arxiv_id":"2309.16671","snapshot_observed_at":"2026-07-04T20:50:12.667951Z","title":"Demystifying CLIP Data","venue":"cs.CV","work_id":"7af932a5-c6d2-4f55-9522-7777cc3fa5ae","year":2023},"citing_paper":{"arxiv_id":"2605.16409","last_updated":"2026-05-13T14:16:39Z","snapshot_observed_at":"2026-08-14T02:50:41.794143Z","submitted_at":"2026-05-13T14:16:39Z","title":"Multilingual OCR-Aware Fine-Tuning and Prompt-Guided Chain-of-Thought Reasoning for Multimodal Large Language Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-20T21:21:11.388050Z"},"links":{"cited_paper":"/paper/2309.16671","citing_paper":"/paper/2605.16409"},"observation_digest":"sha256:d956ed76889192a3632c8d9a360d59749ae7b6d7186fb81154dbc90ad1739caa","observation_id":"f1f6117c-08e8-4bc8-8294-230b6c2d5fa7","resolution":{"observed_at":"2026-05-20T21:23:44.408607Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.11381","last_updated":"2023-03-20T18:31:47Z","snapshot_observed_at":"2026-08-16T13:20:46.785210Z","submitted_at":"2023-03-20T18:31:47Z","title":"MM-REACT: Prompting ChatGPT for Multimodal Reasoning and Action","version":1},"cited_work":{"arxiv_id":"2303.11381","doi":"10.48550/arxiv.2303.11381","metadata_source":"pith","pith_arxiv_id":"2303.11381","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"MM-REACT: Prompting ChatGPT for Multimodal Reasoning and Action","venue":"cs.CV","work_id":"6dc43db8-227d-438e-8658-0c8acecba08a","year":2023},"citing_paper":{"arxiv_id":"2605.16409","last_updated":"2026-05-13T14:16:39Z","snapshot_observed_at":"2026-08-14T02:50:41.794143Z","submitted_at":"2026-05-13T14:16:39Z","title":"Multilingual OCR-Aware Fine-Tuning and Prompt-Guided Chain-of-Thought Reasoning for Multimodal Large Language Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-20T21:21:11.388050Z"},"links":{"cited_paper":"/paper/2303.11381","citing_paper":"/paper/2605.16409"},"observation_digest":"sha256:52bd8ebebee39cd191478d30eb46d7e92895d248860d48dc695b290df61f6e1c","observation_id":"5bc30fe7-ccee-45ec-87f3-1d8ccff18b2f","resolution":{"observed_at":"2026-05-20T21:23:44.412347Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.14178","last_updated":"2024-03-29T08:13:38Z","snapshot_observed_at":"2026-08-16T17:13:28.893408Z","submitted_at":"2023-04-27T13:27:01Z","title":"mPLUG-Owl: Modularization Empowers Large Language Models with Multimodality","version":3},"cited_work":{"arxiv_id":"2304.14178","doi":"10.48550/arxiv.2304.14178","metadata_source":"pith","pith_arxiv_id":"2304.14178","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"mPLUG-Owl: Modularization Empowers Large Language Models with Multimodality","venue":"cs.CL","work_id":"74a7deb6-48be-4132-9d35-882cc5870ebd","year":2023},"citing_paper":{"arxiv_id":"2605.16409","last_updated":"2026-05-13T14:16:39Z","snapshot_observed_at":"2026-08-14T02:50:41.794143Z","submitted_at":"2026-05-13T14:16:39Z","title":"Multilingual OCR-Aware Fine-Tuning and Prompt-Guided Chain-of-Thought Reasoning for Multimodal Large Language Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-20T21:21:11.388050Z"},"links":{"cited_paper":"/paper/2304.14178","citing_paper":"/paper/2605.16409"},"observation_digest":"sha256:31c5eb0762c17c06495e21d7b7f507a548ee23272ec06e6027ec05f1ec3704b1","observation_id":"a01fdfc8-680c-41b3-bd5d-22b4f8366ac9","resolution":{"observed_at":"2026-05-20T21:23:44.400235Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Schaumburg region","venue":null,"work_id":"f0d0cfe5-b1f5-4691-aae1-6e473284bdec","year":2022},"citing_paper":{"arxiv_id":"2605.16409","last_updated":"2026-05-13T14:16:39Z","snapshot_observed_at":"2026-08-14T02:50:41.794143Z","submitted_at":"2026-05-13T14:16:39Z","title":"Multilingual OCR-Aware Fine-Tuning and Prompt-Guided Chain-of-Thought Reasoning for Multimodal Large Language Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-20T21:21:11.388050Z"},"links":{"citing_paper":"/paper/2605.16409"},"observation_digest":"sha256:c7948e154b524c50daf786b30b594661e4357063ddb3ede91f3f4aa73340f13f","observation_id":"ac651965-a918-4271-8140-49f0272728d3","resolution":{"observed_at":"2026-05-20T21:24:03.689096Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2605.16409","last_updated":"2026-05-13T14:16:39Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-14T02:50:41.794143Z","submitted_at":"2026-05-13T14:16:39Z","title":"Multilingual OCR-Aware Fine-Tuning and Prompt-Guided Chain-of-Thought Reasoning for Multimodal Large Language Models"},"reference_resolution":{"displayed":14,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":1,"verified_exact":10,"verified_fuzzy":3},"total_outbound_references":14},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 14 of 14 outbound references and 2 inbound Pith citation observations for arXiv:2605.16409."}