{"as_of":"2026-08-07T17:09:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a32428ad4ea8b3ebde2d018d556a8f6e261e291e938516ecf60f2835cac40112","coverage":[{"denominator":54,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":54,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T04:42:02.726920Z","state":"measured"},{"denominator":57,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":57,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T15:57:51.206063Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-12T03:56:21.604762Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","snapshot_observed_at":"2026-08-07T04:34:26.913382Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.09958","snapshot_observed_at":"2026-08-06T15:57:51.206063Z","title":"Riegler, and P ˚ al Halvorsen","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.14544","last_updated":"2025-07-19T09:04:13Z","snapshot_observed_at":"2026-08-06T15:50:52.853862Z","submitted_at":"2025-07-19T09:04:13Z","title":"Multimodal AI for Gastrointestinal Diagnostics: Tackling VQA in MEDVQA-GI 2025","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T15:57:51.206063Z"},"links":{"cited_paper":"/paper/2506.09958","citing_paper":"/paper/2507.14544"},"observation_digest":"sha256:b7487d50487dd0c6e5137ad3959f461ffb2a7b6d2ce8115da68b707b5138490f","observation_id":"f0beebc1-9999-4b7e-97b3-738c0a256f0c","resolution":{"observed_at":"2026-08-06T15:57:51.206063Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","snapshot_observed_at":"2026-08-07T04:34:26.913382Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy","version":1},"cited_work":{"arxiv_id":"2506.09958","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.09958","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"50f12829-08fd-426a-82d6-ba4468fecb52","year":2025},"citing_paper":{"arxiv_id":"2605.10761","last_updated":"2026-05-11T15:57:35Z","snapshot_observed_at":"2026-08-02T12:12:15.627459Z","submitted_at":"2026-05-11T15:57:35Z","title":"RadThinking: A Dataset for Longitudinal Clinical Reasoning in Radiology","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-12T03:55:55.359488Z"},"links":{"cited_paper":"/paper/2506.09958","citing_paper":"/paper/2605.10761"},"observation_digest":"sha256:dbfeab3cb2daf146abeecf00d4369dfc857b340656688f51c7c5dc3259875d0e","observation_id":"16a6d077-dde9-4722-9d55-5f74cf186cc2","resolution":{"observed_at":"2026-05-12T03:56:21.606430Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","snapshot_observed_at":"2026-08-07T04:34:26.913382Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.09958","snapshot_observed_at":"2026-08-01T16:57:30.636879Z","title":"Kvasir-VQA-x1: A multimodal dataset for medical reasoning and robust MedVQA in gastrointestinal endoscopy,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.17834","last_updated":"2026-07-20T11:25:54Z","snapshot_observed_at":"2026-08-01T16:57:29.496497Z","submitted_at":"2026-07-20T11:25:54Z","title":"Measuring and Improving Complex-Atomic Answer Consistency in Endoscopic VQA","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-01T16:57:30.636879Z"},"links":{"cited_paper":"/paper/2506.09958","citing_paper":"/paper/2607.17834"},"observation_digest":"sha256:0ff10194f11296c707cbe16ac3b580ac258220b5e1942bf92250c43a0283ec14","observation_id":"e4faedd8-0162-413c-94cc-6b6cde36c72b","resolution":{"observed_at":"2026-08-01T16:57:30.636879Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2506.09958/citation-record","integrity":"/paper/2506.09958/integrity","json":"/paper/2506.09958/citation-record.json","paper":"/paper/2506.09958"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:42:02.560852Z","title":"Foundation metrics for evaluating effectiveness of healthcare conversations powered by generative AI.npj Digital Med., 7(82):1–14, March 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","snapshot_observed_at":"2026-08-07T04:34:26.913382Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T04:42:02.560852Z"},"links":{"citing_paper":"/paper/2506.09958"},"observation_digest":"sha256:3e56f56fd684cc391f110d4441df3e33effd1911a89dcb581b822bece4dd352b","observation_id":"1c52b270-b9ff-4969-b23b-a8c9878cbd98","resolution":{"observed_at":"2026-08-07T04:42:02.560852Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.14198","last_updated":"2022-11-15T23:07:37Z","snapshot_observed_at":"2026-07-06T13:05:12.350238Z","submitted_at":"2022-04-29T16:29:01Z","title":"Flamingo: a Visual Language Model for Few-Shot Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.14198","snapshot_observed_at":"2026-08-07T04:42:02.564894Z","title":"Flamingo: a Visual Language Model for Few-Shot Learning.arXiv, April 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","snapshot_observed_at":"2026-08-07T04:34:26.913382Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T04:42:02.564894Z"},"links":{"cited_paper":"/paper/2204.14198","citing_paper":"/paper/2506.09958"},"observation_digest":"sha256:a578d6dc3793fb330c574599b242e8de8aac4cf0776e2febab3cf643c18a1c0d","observation_id":"a2c6ce8e-7a85-4ee8-bff5-7d04aa538d59","resolution":{"observed_at":"2026-08-07T04:42:02.564894Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:42:02.568482Z","title":"A deep learning framework for quality assessment and restoration in video endoscopy.arXiv, April 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","snapshot_observed_at":"2026-08-07T04:34:26.913382Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T04:42:02.568482Z"},"links":{"citing_paper":"/paper/2506.09958"},"observation_digest":"sha256:ac6b60e4217f4ea6da4175f94d3b741b333c96c77769fed7cd4ff4aeba6637ee","observation_id":"a011d625-0122-4965-8059-336b9f3babff","resolution":{"observed_at":"2026-08-07T04:42:02.568482Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-07T04:42:02.572023Z","title":"Qwen2.5-vl technical report.arXiv preprint arXiv:2502.13923, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","snapshot_observed_at":"2026-08-07T04:34:26.913382Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T04:42:02.572023Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2506.09958"},"observation_digest":"sha256:63e170d58dfab49358e182c459dca94f31dc641202a445464e616210217492b5","observation_id":"742143e1-a8a9-4ca3-8b5c-06eadc2925fb","resolution":{"observed_at":"2026-08-07T04:42:02.572023Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:42:02.575479Z","title":"Vision–Language Model for Visual Question Answering in Medical Imagery.Bioengineering, 10(3):380, March 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","snapshot_observed_at":"2026-08-07T04:34:26.913382Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T04:42:02.575479Z"},"links":{"citing_paper":"/paper/2506.09958"},"observation_digest":"sha256:692615f058699a588465a20a9e757e35742bfaf9b90f725a780fbbfeaf27f230","observation_id":"9b01ca2c-d2e7-4f42-b1c4-a6b01b57a0d9","resolution":{"observed_at":"2026-08-07T04:42:02.575479Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:42:02.578778Z","title":"Smedsrud, Steven Hicks, Debesh Jha, Sigrun L","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","snapshot_observed_at":"2026-08-07T04:34:26.913382Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T04:42:02.578778Z"},"links":{"citing_paper":"/paper/2506.09958"},"observation_digest":"sha256:ce027fa664f9e688605d56ae0c89603846d7d456c0ec64bdc558328d814347e8","observation_id":"c8071b00-5997-42eb-b362-7c04b953944f","resolution":{"observed_at":"2026-08-07T04:42:02.578778Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:42:02.581769Z","title":"Iglovikov, and Alexandr A","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","snapshot_observed_at":"2026-08-07T04:34:26.913382Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T04:42:02.581769Z"},"links":{"citing_paper":"/paper/2506.09958"},"observation_digest":"sha256:636a30928b3833cf1f5ae0e8019f13cb0c59e15b79e3cf442737a105d21eac97","observation_id":"c193399a-2514-4e52-8e1b-6bf57876587d","resolution":{"observed_at":"2026-08-07T04:42:02.581769Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2002.05709","last_updated":"2020-07-01T00:09:08Z","snapshot_observed_at":"2026-08-02T19:54:26.138356Z","submitted_at":"2020-02-13T18:50:45Z","title":"A Simple Framework for Contrastive Learning of Visual Representations","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2002.05709","snapshot_observed_at":"2026-08-07T04:42:02.584675Z","title":"A Simple Framework for Contrastive Learning of Visual Representations.arXiv, February 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","snapshot_observed_at":"2026-08-07T04:34:26.913382Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T04:42:02.584675Z"},"links":{"cited_paper":"/paper/2002.05709","citing_paper":"/paper/2506.09958"},"observation_digest":"sha256:2ae3855bd1cbd7dceaa5327b736d48c876c751567485448e49b75223148937f8","observation_id":"4b9b7d8e-612e-4d26-8bcb-8f5485610ce8","resolution":{"observed_at":"2026-08-07T04:42:02.584675Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.20327","last_updated":"2025-03-09T05:23:35Z","snapshot_observed_at":"2026-08-04T23:55:18.555432Z","submitted_at":"2024-10-27T03:56:56Z","title":"R-LLaVA: Improving Med-VQA Understanding through Visual Region of Interest","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.20327","snapshot_observed_at":"2026-08-07T04:42:02.588945Z","title":"R-LLaV A: Improving Med-VQA Understanding through Visual Region of Interest.arXiv, October 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","snapshot_observed_at":"2026-08-07T04:34:26.913382Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T04:42:02.588945Z"},"links":{"cited_paper":"/paper/2410.20327","citing_paper":"/paper/2506.09958"},"observation_digest":"sha256:4df8e60d203352a1a36b35f34cb4f2ad94572f0a5122a2c55ed546a58b7e997d","observation_id":"b1d98937-3b9b-4a47-92f4-fc1afd4bd9c3","resolution":{"observed_at":"2026-08-07T04:42:02.588945Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:42:02.591678Z","title":"Generative Models in Medical Visual Question Answering: A Survey.Appl","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","snapshot_observed_at":"2026-08-07T04:34:26.913382Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T04:42:02.591678Z"},"links":{"citing_paper":"/paper/2506.09958"},"observation_digest":"sha256:7476d540abcf93b503452956e2af97a33f2c2c1132adb6ba131d2449cc9bdf01","observation_id":"e0f0c41c-5985-4413-907c-2d2629c589ea","resolution":{"observed_at":"2026-08-07T04:42:02.591678Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:42:02.594102Z","title":"LLM-based NLG Evaluation: Current Status and Challenges.Computational Linguistics, pages 1–27, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","snapshot_observed_at":"2026-08-07T04:34:26.913382Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T04:42:02.594102Z"},"links":{"citing_paper":"/paper/2506.09958"},"observation_digest":"sha256:b83c2c3a7dd0d5e9dd1af83f4d9ead3510d973aaede95261ed118e2b852e7e61","observation_id":"a3b1350f-f88c-4339-96fa-4f4a2a8c620f","resolution":{"observed_at":"2026-08-07T04:42:02.594102Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:42:02.597646Z","title":"Hicks, Vajira Thambawita, P ˚ al Halvorsen, and Michael A","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","snapshot_observed_at":"2026-08-07T04:34:26.913382Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T04:42:02.597646Z"},"links":{"citing_paper":"/paper/2506.09958"},"observation_digest":"sha256:a2474f748384fef5207b7f2122818b352e93df05012280ba9a43371d4f01ba2d","observation_id":"1c7bb54d-d855-4835-93c3-d9ae3e933a37","resolution":{"observed_at":"2026-08-07T04:42:02.597646Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:42:04.744921Z","title":"Medgemma hugging face, May 2025","venue":null,"work_id":"5c102f84-b587-4184-a6e8-e8f34e9f594b","year":2025},"citing_paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","snapshot_observed_at":"2026-08-07T04:34:26.913382Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T04:42:02.600361Z"},"links":{"citing_paper":"/paper/2506.09958"},"observation_digest":"sha256:6a8277d2bcd26281610cda20394cc5d1dffed53bddaef137756e434b1dbd7971","observation_id":"b8cbc6fb-8c62-40bc-bf01-60df620470cb","resolution":{"observed_at":"2026-08-07T04:42:04.839627Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.13039","last_updated":"2024-04-19T17:51:52Z","snapshot_observed_at":"2026-07-06T18:02:49.215786Z","submitted_at":"2024-04-19T17:51:52Z","title":"LaPA: Latent Prompt Assist Model For Medical Visual Question Answering","version":1},"cited_work":{"arxiv_id":"2404.13039","doi":"10.48550/arxiv.2404.13039","metadata_source":"pith","pith_arxiv_id":"2404.13039","snapshot_observed_at":"2026-08-07T06:16:28.064256Z","title":"LaPA: Latent Prompt Assist Model For Medical Visual Question Answering","venue":"cs.CV","work_id":"2cfaca8a-055a-4ec9-ba78-e2faf88a45dc","year":2024},"citing_paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","snapshot_observed_at":"2026-08-07T04:34:26.913382Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T04:42:02.603313Z"},"links":{"cited_paper":"/paper/2404.13039","citing_paper":"/paper/2506.09958"},"observation_digest":"sha256:069fc90bf10f5e278cad7908dfbf7b3cb351a5f5d88e3205e2f57e4f985a891b","observation_id":"2d9bf78c-e0a5-4e92-8415-b4f5e3352157","resolution":{"observed_at":"2026-08-07T04:42:03.038603Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.18536","last_updated":"2025-03-24T10:42:48Z","snapshot_observed_at":"2026-08-07T16:41:41.873666Z","submitted_at":"2025-03-24T10:42:48Z","title":"DiN: Diffusion Model for Robust Medical VQA with Semantic Noisy Labels","version":1},"cited_work":{"arxiv_id":"2503.18536","doi":"10.48550/arxiv.2503.18536","metadata_source":"pith","pith_arxiv_id":"2503.18536","snapshot_observed_at":"2026-08-07T06:16:28.064256Z","title":"DiN: Diffusion Model for Robust Medical VQA with Semantic Noisy Labels","venue":"cs.CV","work_id":"027347f8-703c-4d86-8341-015f08ba099b","year":2025},"citing_paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","snapshot_observed_at":"2026-08-07T04:34:26.913382Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T04:42:02.606380Z"},"links":{"cited_paper":"/paper/2503.18536","citing_paper":"/paper/2506.09958"},"observation_digest":"sha256:b388c2a090794d8f17fe3c6fa9a6ad2b6cb2e4d8a5ef88da5f6f24b7780b3971","observation_id":"059da0cf-f138-4789-8bb7-8129831f33a1","resolution":{"observed_at":"2026-08-07T04:42:03.024840Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:42:02.609354Z","title":"Vision-language models for medical report generation and visual question answering: a review.Front","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","snapshot_observed_at":"2026-08-07T04:34:26.913382Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T04:42:02.609354Z"},"links":{"citing_paper":"/paper/2506.09958"},"observation_digest":"sha256:5dfb12294798ad405d3a0d7ff9f3db35203c0192fd81ae8230dd82482d2d7d55","observation_id":"73acb3fc-ee4d-4efb-9116-8e12b4afe5dd","resolution":{"observed_at":"2026-08-07T04:42:02.609354Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.09543","last_updated":"2023-03-24T09:17:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-11-18T06:48:00Z","title":"DeBERTaV3: Improving DeBERTa using ELECTRA-Style Pre-Training with Gradient-Disentangled Embedding Sharing","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.09543","snapshot_observed_at":"2026-08-07T04:42:02.612276Z","title":"DeBERTaV3: Improving DeBERTa using ELECTRA-Style Pre-Training with Gradient-Disentangled Embedding Sharing.arXiv, November 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","snapshot_observed_at":"2026-08-07T04:34:26.913382Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T04:42:02.612276Z"},"links":{"cited_paper":"/paper/2111.09543","citing_paper":"/paper/2506.09958"},"observation_digest":"sha256:9704bf7d06ae05657565127581a4b205b2dae08a70d5984e989d65134d5bb6f2","observation_id":"ce258bb0-d390-4241-ad2d-c3a69acb344b","resolution":{"observed_at":"2026-08-07T04:42:02.612276Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:42:04.555642Z","title":"Overview of imageclefmedical 2023-medical visual question answering for gastrointestinal tract","venue":null,"work_id":"90e8da99-3789-4b24-8898-7fbc96105fe2","year":2023},"citing_paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","snapshot_observed_at":"2026-08-07T04:34:26.913382Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T04:42:02.617533Z"},"links":{"citing_paper":"/paper/2506.09958"},"observation_digest":"sha256:830b4821490439962c7149800c7cb664be11305194d54dc4c2d7d47dec859511","observation_id":"ba445f8d-489f-472a-be4c-234269813756","resolution":{"observed_at":"2026-08-07T04:42:04.613594Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09685","last_updated":"2021-10-16T18:40:34Z","snapshot_observed_at":"2026-08-07T07:43:16.294957Z","submitted_at":"2021-06-17T17:37:18Z","title":"LoRA: Low-Rank Adaptation of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.09685","snapshot_observed_at":"2026-08-07T04:42:02.620794Z","title":"Hu, Yelong Shen, Phillip Wallis, Zeyuan Allen-Zhu, Yuanzhi Li, Shean Wang, Lu Wang, and Weizhu Chen","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","snapshot_observed_at":"2026-08-07T04:34:26.913382Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T04:42:02.620794Z"},"links":{"cited_paper":"/paper/2106.09685","citing_paper":"/paper/2506.09958"},"observation_digest":"sha256:6358d66726a07336ebb6edc887201a777530409d1a95bb89bf1e2732acfbb2bb","observation_id":"0dc39b54-26f4-4063-9f9c-6e19054be7dc","resolution":{"observed_at":"2026-08-07T04:42:02.620794Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:42:02.624394Z","title":"Summers, and Yingying Zhu","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","snapshot_observed_at":"2026-08-07T04:34:26.913382Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T04:42:02.624394Z"},"links":{"citing_paper":"/paper/2506.09958"},"observation_digest":"sha256:559c9e328b2fb1b68bafffa3bbecae0f3a6a1671921038ff46579de1419120d8","observation_id":"8aee339d-ca74-4715-94d7-19d6be5718b2","resolution":{"observed_at":"2026-08-07T04:42:02.624394Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:42:02.627513Z","title":"Sadman Hafiz, Jamin Rahman Jim, Md","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","snapshot_observed_at":"2026-08-07T04:34:26.913382Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T04:42:02.627513Z"},"links":{"citing_paper":"/paper/2506.09958"},"observation_digest":"sha256:482f8ef37d395c4a719e21268fa4b5a568f216f2d53dac32ced0d2b33d80a761","observation_id":"84594a3c-9911-445d-91f4-5d41e69b0f21","resolution":{"observed_at":"2026-08-07T04:42:02.627513Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/978-3-030-67835-7","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:42:02.988365Z","title":"Hicks, Vajira Thambawita, Enrique Garcia-Ceja, Michael A","venue":null,"work_id":"2ae8fa38-b5ee-4c5d-916a-75c68bf10543","year":2021},"citing_paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","snapshot_observed_at":"2026-08-07T04:34:26.913382Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T04:42:02.631069Z"},"links":{"citing_paper":"/paper/2506.09958"},"observation_digest":"sha256:10012f0bd2c4bcd1d010e98aa29120a9894ac602bf049bf70789f11515f4bf3b","observation_id":"eff2e767-9c63-482a-920e-2a60e8a62874","resolution":{"observed_at":"2026-08-07T04:42:02.991850Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:42:02.633750Z","title":"Lau, Soumya Gayen, Asma Ben Abacha, and Dina Demner-Fushman","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","snapshot_observed_at":"2026-08-07T04:34:26.913382Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T04:42:02.633750Z"},"links":{"citing_paper":"/paper/2506.09958"},"observation_digest":"sha256:d89a83278a4958b346865c8a114327251c006cf25d8eaaabb4aaa4b65ddab2fc","observation_id":"bb2fe99e-3373-4845-ab3f-2a81e219314a","resolution":{"observed_at":"2026-08-07T04:42:02.633750Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:42:02.636692Z","title":"Meteor: an automatic metric for MT evaluation with high levels of correlation with human judgments","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","snapshot_observed_at":"2026-08-07T04:34:26.913382Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T04:42:02.636692Z"},"links":{"citing_paper":"/paper/2506.09958"},"observation_digest":"sha256:573047c7b39cf8c717465976562df371cb12c7e46c7f78c90d308c23c83905f7","observation_id":"d8645d43-43fa-4eed-ad94-0683aa80f03b","resolution":{"observed_at":"2026-08-07T04:42:02.636692Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.00890","last_updated":"2023-06-01T16:50:07Z","snapshot_observed_at":"2026-07-29T15:30:39.490502Z","submitted_at":"2023-06-01T16:50:07Z","title":"LLaVA-Med: Training a Large Language-and-Vision Assistant for Biomedicine in One Day","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.00890","snapshot_observed_at":"2026-08-07T04:42:02.639446Z","title":"LLaV A-Med: Training a Large Language-and-Vision Assistant for Biomedicine in One Day.arXiv, June 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","snapshot_observed_at":"2026-08-07T04:34:26.913382Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T04:42:02.639446Z"},"links":{"cited_paper":"/paper/2306.00890","citing_paper":"/paper/2506.09958"},"observation_digest":"sha256:92d3753f942aae4c7cf186adae299e65d2b858ec2ed444c534e0244b61fa0155","observation_id":"9b4184d9-7b52-4b7d-a755-5e76e336007f","resolution":{"observed_at":"2026-08-07T04:42:02.639446Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12215","last_updated":"2024-01-22T18:59:07Z","snapshot_observed_at":"2026-07-06T17:18:56.465394Z","submitted_at":"2024-01-22T18:59:07Z","title":"Less Could Be Better: Parameter-efficient Fine-tuning Advances Medical Vision Foundation Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.12215","snapshot_observed_at":"2026-08-07T04:42:02.642311Z","title":"Less Could Be Better: Parameter-efficient Fine-tuning Advances Medical Vision Foundation Models.arXiv, January 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","snapshot_observed_at":"2026-08-07T04:34:26.913382Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T04:42:02.642311Z"},"links":{"cited_paper":"/paper/2401.12215","citing_paper":"/paper/2506.09958"},"observation_digest":"sha256:e51a80d57b75dfec1aa97445108540c6a8fc41617f5a3d3c2225d671b0436e35","observation_id":"6374a26f-cdb1-4954-b58a-21362fd715d5","resolution":{"observed_at":"2026-08-07T04:42:02.642311Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:42:02.645547Z","title":"Candidate-Heuristic In-Context Learning: A new framework for enhancing medical visual question answering with LLMs.Information Processing & Management, 61(5):103805, September 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","snapshot_observed_at":"2026-08-07T04:34:26.913382Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T04:42:02.645547Z"},"links":{"citing_paper":"/paper/2506.09958"},"observation_digest":"sha256:591a590bde090452eb23f28cdae32ff5cf3c99959badcd40d80900ee2d77be82","observation_id":"5f2a347e-1273-423f-8ea4-455a9a976e34","resolution":{"observed_at":"2026-08-07T04:42:02.645547Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:42:02.648531Z","title":"Rouge: A package for automatic evaluation of summaries","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","snapshot_observed_at":"2026-08-07T04:34:26.913382Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T04:42:02.648531Z"},"links":{"citing_paper":"/paper/2506.09958"},"observation_digest":"sha256:2e48c24a75b9ad468baed80ea0a41af9a35b73913bd4828ecc64272eae562566","observation_id":"b3ee46df-b7b5-4e5a-86c2-0948147c2b90","resolution":{"observed_at":"2026-08-07T04:42:02.648531Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2023.10261","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:42:03.480208Z","title":"Medical visual question answering: A survey.Artif","venue":null,"work_id":"c3b9274a-ab1b-495e-8e32-6d09ce6d0705","year":2023},"citing_paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","snapshot_observed_at":"2026-08-07T04:34:26.913382Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T04:42:02.651405Z"},"links":{"citing_paper":"/paper/2506.09958"},"observation_digest":"sha256:fab73adf08600bf113bc22b4539359c1061bc1e1a5d0b25191bd0a89974ad438","observation_id":"2c6ec00c-b26a-4396-806b-9c645233b806","resolution":{"observed_at":"2026-08-07T04:42:03.491149Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:42:02.654115Z","title":"Slake: A Semantically-Labeled Knowledge-Enhanced Dataset For Medical Visual Question Answering","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","snapshot_observed_at":"2026-08-07T04:34:26.913382Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T04:42:02.654115Z"},"links":{"citing_paper":"/paper/2506.09958"},"observation_digest":"sha256:9ffb74d5bd313c0908ea13fc6f8c095aa7f324074fc9a936ec8b2bdc0e45f896","observation_id":"4927d41e-e237-47b8-aa8b-a2ea1a5640b1","resolution":{"observed_at":"2026-08-07T04:42:02.654115Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.08485","last_updated":"2023-12-11T17:46:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-17T17:59:25Z","title":"Visual Instruction Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.08485","snapshot_observed_at":"2026-08-07T04:42:02.657045Z","title":"Visual Instruction Tuning.arXiv, April 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","snapshot_observed_at":"2026-08-07T04:34:26.913382Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T04:42:02.657045Z"},"links":{"cited_paper":"/paper/2304.08485","citing_paper":"/paper/2506.09958"},"observation_digest":"sha256:c726570e5beb73bef91e0f8b15693d6f92537d3e4bd97ce9f77e4f0a4d1f57b4","observation_id":"454e4dff-4980-4af8-8a5a-ac47abd2aee0","resolution":{"observed_at":"2026-08-07T04:42:02.657045Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:42:04.391220Z","title":"Peft: State-of- the-art parameter-efficient fine-tuning methods","venue":null,"work_id":"a94ef3de-7473-4d2b-a508-c0da59b91196","year":2022},"citing_paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","snapshot_observed_at":"2026-08-07T04:34:26.913382Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T04:42:02.659998Z"},"links":{"citing_paper":"/paper/2506.09958"},"observation_digest":"sha256:c74aabcc5cee77c0a586c6673571778143603b65f5449b1b304978e97a550209","observation_id":"35c11c11-694e-4dd3-92a9-a62c5d80325b","resolution":{"observed_at":"2026-08-07T04:42:04.463784Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15189","last_updated":"2023-07-27T20:36:02Z","snapshot_observed_at":"2026-07-06T15:59:30.956483Z","submitted_at":"2023-07-27T20:36:02Z","title":"Med-Flamingo: a Multimodal Medical Few-shot Learner","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.15189","snapshot_observed_at":"2026-08-07T04:42:02.665674Z","title":"Med-Flamingo: a Multimodal Medical Few-shot Learner.arXiv, July 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","snapshot_observed_at":"2026-08-07T04:34:26.913382Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T04:42:02.665674Z"},"links":{"cited_paper":"/paper/2307.15189","citing_paper":"/paper/2506.09958"},"observation_digest":"sha256:fdb10d51cdf16a569ec5434e4f387a6693aed69fff4f51f82221f86cec50282f","observation_id":"2f0cbe2a-c590-420f-9b06-cbd8b6b11149","resolution":{"observed_at":"2026-08-07T04:42:02.665674Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-07T04:42:02.668362Z","title":"GPT-4 Technical Report.arXiv, March 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","snapshot_observed_at":"2026-08-07T04:34:26.913382Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T04:42:02.668362Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2506.09958"},"observation_digest":"sha256:68034e7f41cfc19bd0ee0be72aabc0b5e0b8806f1200170839a1479afac1c15f","observation_id":"27c44666-2662-4c50-8ac3-b0c032f09de0","resolution":{"observed_at":"2026-08-07T04:42:02.668362Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:42:02.671397Z","title":"Chaudhari, et al","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","snapshot_observed_at":"2026-08-07T04:34:26.913382Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T04:42:02.671397Z"},"links":{"citing_paper":"/paper/2506.09958"},"observation_digest":"sha256:12b9f9edf68edeb312a481465c3563e7cea57be39139e43fbd1720b05766dc53","observation_id":"63bbee4d-3107-4a92-94b2-4d782acf47e3","resolution":{"observed_at":"2026-08-07T04:42:02.671397Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:42:02.673870Z","title":"BLEU: a method for automatic evaluation of ma- chine translation","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","snapshot_observed_at":"2026-08-07T04:34:26.913382Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T04:42:02.673870Z"},"links":{"citing_paper":"/paper/2506.09958"},"observation_digest":"sha256:3298d9fc643562816dfa84be5db5031e1fc3f5ce9b329a6c614a3beba44ae9a5","observation_id":"de414271-f059-4fcd-86d9-dd21f162ea55","resolution":{"observed_at":"2026-08-07T04:42:02.673870Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:42:04.228724Z","title":"chrF: character n-gram F-score for automatic MT evaluation.ACL Anthology, pages 392–395, September","venue":null,"work_id":"0201780f-b631-4a24-9d75-2aa92830272e","year":null},"citing_paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","snapshot_observed_at":"2026-08-07T04:34:26.913382Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T04:42:02.676750Z"},"links":{"citing_paper":"/paper/2506.09958"},"observation_digest":"sha256:84e5cc510662de243d0f8052fac57c401b5c0046b624106a1330507add268a36","observation_id":"c9f0e415-519b-4534-b083-ff7561b001d0","resolution":{"observed_at":"2026-08-07T04:42:04.314693Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.02054","last_updated":"2020-05-13T06:45:15Z","snapshot_observed_at":"2026-07-06T08:27:00.558613Z","submitted_at":"2019-10-04T17:29:39Z","title":"ZeRO: Memory Optimizations Toward Training Trillion Parameter Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.02054","snapshot_observed_at":"2026-08-07T04:42:02.682342Z","title":"ZeRO: Memory Optimizations Toward Training Trillion Parameter Models.arXiv, October 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","snapshot_observed_at":"2026-08-07T04:34:26.913382Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T04:42:02.682342Z"},"links":{"cited_paper":"/paper/1910.02054","citing_paper":"/paper/2506.09958"},"observation_digest":"sha256:2dbe3f53e79f073a443ddf3016f194930175cd21cd9a24263f1a6db147bcf510","observation_id":"71e43144-29fe-42b6-bee7-f243b85df2ec","resolution":{"observed_at":"2026-08-07T04:42:02.682342Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.00084","last_updated":"2024-09-04T08:22:28Z","snapshot_observed_at":"2026-08-02T15:53:32.867922Z","submitted_at":"2024-08-25T14:50:47Z","title":"Vision-Language and Large Language Model Performance in Gastroenterology: GPT, Claude, Llama, Phi, Mistral, Gemma, and Quantized Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.00084","snapshot_observed_at":"2026-08-07T04:42:02.685440Z","title":"Samaan, Reem Al Shabeeb, Farah Ladak, Jamie O","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","snapshot_observed_at":"2026-08-07T04:34:26.913382Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T04:42:02.685440Z"},"links":{"cited_paper":"/paper/2409.00084","citing_paper":"/paper/2506.09958"},"observation_digest":"sha256:dfd16c58c37c547218ee5168d19378881acf4e89d7f472eab88a0100bccffb1a","observation_id":"12a40f5f-3c5e-486e-86aa-fae06d9bfec2","resolution":{"observed_at":"2026-08-07T04:42:02.685440Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.04696","last_updated":"2020-05-21T16:53:47Z","snapshot_observed_at":"2026-08-01T14:50:12.931679Z","submitted_at":"2020-04-09T17:26:52Z","title":"BLEURT: Learning Robust Metrics for Text Generation","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.04696","snapshot_observed_at":"2026-08-07T04:42:02.689211Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","snapshot_observed_at":"2026-08-07T04:34:26.913382Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T04:42:02.689211Z"},"links":{"cited_paper":"/paper/2004.04696","citing_paper":"/paper/2506.09958"},"observation_digest":"sha256:130cc56859411936c13ffe06e02219edb8a9a7cf4e37307c5f6a5786bd4e1963","observation_id":"3d5da4d0-b840-4da3-a59f-969e4b5f2476","resolution":{"observed_at":"2026-08-07T04:42:02.689211Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:42:02.692791Z","title":"Pfohl, Heather Cole-Lewis, et al","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","snapshot_observed_at":"2026-08-07T04:34:26.913382Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T04:42:02.692791Z"},"links":{"citing_paper":"/paper/2506.09958"},"observation_digest":"sha256:5979a3de8e356d3a96a0a0ca47705fe7f0fae25f28cc8462373b123f079597d6","observation_id":"24d49581-6a9f-44fb-848d-238a30735c5b","resolution":{"observed_at":"2026-08-07T04:42:02.692791Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-08-07T04:42:02.695513Z","title":"Qwen3 technical report, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","snapshot_observed_at":"2026-08-07T04:34:26.913382Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T04:42:02.695513Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2506.09958"},"observation_digest":"sha256:6ef6e35d8440612271af804e3921b1648d30cf346d339ab16348cd410a8b8701","observation_id":"c7b19ffe-ac7f-4563-9322-33b9c37baa25","resolution":{"observed_at":"2026-08-07T04:42:02.695513Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:42:02.698427Z","title":"Sanders, Yuchen Liu, Kennarey Seang, Bach Xuan Tran, Atanas G","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","snapshot_observed_at":"2026-08-07T04:34:26.913382Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T04:42:02.698427Z"},"links":{"citing_paper":"/paper/2506.09958"},"observation_digest":"sha256:d8d901ce33a4545b045d99d3e762aef3be1edcc3356dacba0e9d5419e31f87e8","observation_id":"ea035ea9-0fd3-475e-bb1f-20b208f33a15","resolution":{"observed_at":"2026-08-07T04:42:02.698427Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:42:02.701389Z","title":"Wilkinson, Michel Dumontier, IJsbrand Jan Aalbersberg, Gabrielle Appleton, Myles Axton, Arie Baak, Niklas Blomberg, Jan-Willem Boiten, Luiz Bonino da Silva Santos, Philip E","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","snapshot_observed_at":"2026-08-07T04:34:26.913382Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T04:42:02.701389Z"},"links":{"citing_paper":"/paper/2506.09958"},"observation_digest":"sha256:e11165b2346045640d882e71d66c383deafd01496a3b431da449dfaf343b23df","observation_id":"61c26755-4ced-440d-9ee4-61af9d046faf","resolution":{"observed_at":"2026-08-07T04:42:02.701389Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:42:04.078187Z","title":null,"venue":null,"work_id":"8b0c39b6-1b54-41a8-a211-4b186ece9938","year":2020},"citing_paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","snapshot_observed_at":"2026-08-07T04:34:26.913382Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T04:42:02.704076Z"},"links":{"citing_paper":"/paper/2506.09958"},"observation_digest":"sha256:e76787f9b1de5158dcbdcb021015f98f3bb8e18c5c368dda1716a191bd233f46","observation_id":"fab20e9a-a383-49f6-9eb6-f9752df995cf","resolution":{"observed_at":"2026-08-07T04:42:04.164751Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.12148","last_updated":"2023-12-19T13:31:24Z","snapshot_observed_at":"2026-07-06T17:05:19.007669Z","submitted_at":"2023-12-19T13:31:24Z","title":"Parameter-Efficient Fine-Tuning Methods for Pretrained Language Models: A Critical Review and Assessment","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.12148","snapshot_observed_at":"2026-08-07T04:42:02.706457Z","title":"Parameter-Efficient Fine-Tuning Methods for Pretrained Language Models: A Critical Review and Assessment.arXiv, December 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","snapshot_observed_at":"2026-08-07T04:34:26.913382Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T04:42:02.706457Z"},"links":{"cited_paper":"/paper/2312.12148","citing_paper":"/paper/2506.09958"},"observation_digest":"sha256:def654dc78b5b3921f298e7bfaa8069f44937cbe28e8f7beea24ed9ccab2c8cd","observation_id":"e22cee96-9e5c-420f-825a-ebdb89da6b06","resolution":{"observed_at":"2026-08-07T04:42:02.706457Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.48550/arxiv.2505.16964","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:42:02.848857Z","title":"MedFrameQA: A Multi-Image Medical VQA Benchmark for Clinical Reasoning.arXiv, May 2025","venue":null,"work_id":"a3283ec3-d492-4bb0-9d35-05463bafc699","year":2025},"citing_paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","snapshot_observed_at":"2026-08-07T04:34:26.913382Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T04:42:02.709606Z"},"links":{"citing_paper":"/paper/2506.09958"},"observation_digest":"sha256:02c8dfd231adcb8c0211470eecac86dc06ac287a13f0a02e5cafc9cb36f80c43","observation_id":"ede2d0b1-2c9f-4fa3-b54b-9e6713528d75","resolution":{"observed_at":"2026-08-07T04:42:02.854127Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:42:02.712182Z","title":"Fine-grained Adaptive Visual Prompt for Generative Medical Visual Question Answering.AAAI, 39(9):9662–9670, April 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","snapshot_observed_at":"2026-08-07T04:34:26.913382Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T04:42:02.712182Z"},"links":{"citing_paper":"/paper/2506.09958"},"observation_digest":"sha256:d3618989f334589cc99b19aa268330a2e4e4bf1b31bc5f33f03157f9cc61dc8a","observation_id":"f5190ec1-fb2e-44d6-8a72-8eb1b5c4be42","resolution":{"observed_at":"2026-08-07T04:42:02.712182Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:42:03.962971Z","title":"Medical Visual Question Answering via Conditional Reasoning","venue":null,"work_id":"84c5e2f7-142d-4dfa-90c9-0672f37e21bf","year":null},"citing_paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","snapshot_observed_at":"2026-08-07T04:34:26.913382Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T04:42:02.715622Z"},"links":{"citing_paper":"/paper/2506.09958"},"observation_digest":"sha256:022c663b2bf1f662ec7d87355772f61d45665dc255c4e471330ee8b27b139b63","observation_id":"5f569dee-710c-4b5a-8fbc-8f61c8bd0d7e","resolution":{"observed_at":"2026-08-07T04:42:04.013804Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1904.09675","last_updated":"2020-02-24T18:59:28Z","snapshot_observed_at":"2026-07-29T15:42:51.774083Z","submitted_at":"2019-04-21T23:08:53Z","title":"BERTScore: Evaluating Text Generation with BERT","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.09675","snapshot_observed_at":"2026-08-07T04:42:02.720800Z","title":"Weinberger, and Yoav Artzi","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","snapshot_observed_at":"2026-08-07T04:34:26.913382Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T04:42:02.720800Z"},"links":{"cited_paper":"/paper/1904.09675","citing_paper":"/paper/2506.09958"},"observation_digest":"sha256:76a61dec3e18c1f8bc7b853be0f490ade0f7418e2ab56913ac8fa1a8e3f983e0","observation_id":"9685044a-1a2a-4a01-b705-e61c3f63213f","resolution":{"observed_at":"2026-08-07T04:42:02.720800Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.10415","last_updated":"2024-09-08T01:04:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-17T17:50:16Z","title":"PMC-VQA: Visual Instruction Tuning for Medical Visual Question Answering","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.10415","snapshot_observed_at":"2026-08-07T04:42:02.723789Z","title":"PMC-VQA: Visual Instruction Tuning for Medical Visual Question Answering.arXiv, May 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","snapshot_observed_at":"2026-08-07T04:34:26.913382Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T04:42:02.723789Z"},"links":{"cited_paper":"/paper/2305.10415","citing_paper":"/paper/2506.09958"},"observation_digest":"sha256:778fcdcb923e8fb9cfa53b3506c4f5babfde67cac87bfe95e6f8bb8e4c356143","observation_id":"fb0332a3-b5c3-4810-82d8-acbe4ada430d","resolution":{"observed_at":"2026-08-07T04:42:02.723789Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.05517","last_updated":"2025-05-19T06:50:53Z","snapshot_observed_at":"2026-08-05T14:11:37.629456Z","submitted_at":"2024-08-10T11:00:13Z","title":"SWIFT:A Scalable lightWeight Infrastructure for Fine-Tuning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.05517","snapshot_observed_at":"2026-08-07T04:42:02.726920Z","title":"Swift:a scalable lightweight infrastructure for fine-tuning, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","snapshot_observed_at":"2026-08-07T04:34:26.913382Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T04:42:02.726920Z"},"links":{"cited_paper":"/paper/2408.05517","citing_paper":"/paper/2506.09958"},"observation_digest":"sha256:4e55ed643c326b9150061f36197d695b4f280918c8560dbf3d9c3d7c37a66f0d","observation_id":"24983bd3-10c5-4138-8d99-7ff0ad5ad655","resolution":{"observed_at":"2026-08-07T04:42:02.726920Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:42:02.679485Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","snapshot_observed_at":"2026-08-07T04:34:26.913382Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy","version":1},"reference_index":2015,"source":"pdf_text","source_observed_at":"2026-08-07T04:42:02.679485Z"},"links":{"citing_paper":"/paper/2506.09958"},"observation_digest":"sha256:52a8da401ca630bfff2dd21992befb504c489b1c5d6c8a0147c3a1ea9b8b968b","observation_id":"9973781f-b476-41fa-82b6-60c86ed56032","resolution":{"observed_at":"2026-08-07T04:42:02.679485Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:42:02.718367Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","snapshot_observed_at":"2026-08-07T04:34:26.913382Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-07T04:42:02.718367Z"},"links":{"citing_paper":"/paper/2506.09958"},"observation_digest":"sha256:189fb661da9a9110eb087eeb563555e9290e05062c79ab9e57692ef22c23ff6d","observation_id":"7fd676bb-74cc-4ad6-8035-32ac396b560a","resolution":{"observed_at":"2026-08-07T04:42:02.718367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T04:34:26.913382Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy"},"reference_resolution":{"displayed":54,"state_counts":{"malformed_identifier":2,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":42,"verified_exact":4,"verified_fuzzy":5},"total_outbound_references":54},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 54 of 54 outbound references and 3 inbound Pith citation observations for arXiv:2506.09958."}