{"as_of":"2026-08-09T09:25:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3a24f558e39b33f7eba66c9924181107435079321f84de18fa42ccd77dca563f","coverage":[{"denominator":30,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":30,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T16:57:32.887608Z","state":"measured"},{"denominator":30,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":30,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.17834/citation-record","integrity":"/paper/2607.17834/integrity","json":"/paper/2607.17834/citation-record.json","paper":"/paper/2607.17834"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:57:30.110628Z","title":"VQA: Visual question answering,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2607.17834","last_updated":"2026-07-20T11:25:54Z","snapshot_observed_at":"2026-08-08T10:21:16.088248Z","submitted_at":"2026-07-20T11:25:54Z","title":"Measuring and Improving Complex-Atomic Answer Consistency in Endoscopic VQA","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-01T16:57:30.110628Z"},"links":{"citing_paper":"/paper/2607.17834"},"observation_digest":"sha256:ec7a1f7be31b4df7355292d2a34850643a0e12546e73c4b4cfc9b118d3194df3","observation_id":"c226c4d6-8743-48bd-9b8b-6e39f5d219fa","resolution":{"observed_at":"2026-08-01T16:57:30.110628Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:57:30.215535Z","title":"Medical visual question answering: A survey,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.17834","last_updated":"2026-07-20T11:25:54Z","snapshot_observed_at":"2026-08-08T10:21:16.088248Z","submitted_at":"2026-07-20T11:25:54Z","title":"Measuring and Improving Complex-Atomic Answer Consistency in Endoscopic VQA","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-01T16:57:30.215535Z"},"links":{"citing_paper":"/paper/2607.17834"},"observation_digest":"sha256:aa824839e5285980dcc0695aaa109f44bd89cbbb1daa88a108670a5b95fa998d","observation_id":"a0b8df16-3cb7-4e2c-8aaf-02a910a9f57b","resolution":{"observed_at":"2026-08-01T16:57:30.215535Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:57:30.392641Z","title":"EndoBench: A comprehensive evaluation of multi-modal large language models for endoscopy analysis,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.17834","last_updated":"2026-07-20T11:25:54Z","snapshot_observed_at":"2026-08-08T10:21:16.088248Z","submitted_at":"2026-07-20T11:25:54Z","title":"Measuring and Improving Complex-Atomic Answer Consistency in Endoscopic VQA","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-01T16:57:30.392641Z"},"links":{"citing_paper":"/paper/2607.17834"},"observation_digest":"sha256:57abf5a9f272bc5878d0b3e94f66d9eec414108dcbbfd2828a8c565c867f8ed0","observation_id":"7588d7a5-0c30-4e5f-9445-c71634231bb5","resolution":{"observed_at":"2026-08-01T16:57:30.392641Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:57:30.507401Z","title":"Kvasir-VQA: A text-image pair gi tract dataset,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.17834","last_updated":"2026-07-20T11:25:54Z","snapshot_observed_at":"2026-08-08T10:21:16.088248Z","submitted_at":"2026-07-20T11:25:54Z","title":"Measuring and Improving Complex-Atomic Answer Consistency in Endoscopic VQA","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-01T16:57:30.507401Z"},"links":{"citing_paper":"/paper/2607.17834"},"observation_digest":"sha256:d505b4ebcc0ac1f58bf1d1f87ecf2f0f20ad3c18b4850fafd29c9cf0bf3a481b","observation_id":"8efd54df-b6e2-4fc6-bbec-7266b15ba063","resolution":{"observed_at":"2026-08-01T16:57:30.507401Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","snapshot_observed_at":"2026-08-08T12:16:45.655003Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.09958","snapshot_observed_at":"2026-08-01T16:57:30.636879Z","title":"Kvasir-VQA-x1: A multimodal dataset for medical reasoning and robust MedVQA in gastrointestinal endoscopy,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.17834","last_updated":"2026-07-20T11:25:54Z","snapshot_observed_at":"2026-08-08T10:21:16.088248Z","submitted_at":"2026-07-20T11:25:54Z","title":"Measuring and Improving Complex-Atomic Answer Consistency in Endoscopic VQA","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-01T16:57:30.636879Z"},"links":{"cited_paper":"/paper/2506.09958","citing_paper":"/paper/2607.17834"},"observation_digest":"sha256:188351454a997518589627f350499ffd16a6b668d85483fd132972254506d96a","observation_id":"e4faedd8-0162-413c-94cc-6b6cde36c72b","resolution":{"observed_at":"2026-08-01T16:57:30.636879Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:57:30.759344Z","title":"A dataset of clinically generated visual questions and answers about radiology images,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.17834","last_updated":"2026-07-20T11:25:54Z","snapshot_observed_at":"2026-08-08T10:21:16.088248Z","submitted_at":"2026-07-20T11:25:54Z","title":"Measuring and Improving Complex-Atomic Answer Consistency in Endoscopic VQA","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-01T16:57:30.759344Z"},"links":{"citing_paper":"/paper/2607.17834"},"observation_digest":"sha256:185e537d2959cc7f18b9e2d8588c4aedc521dd64d9a0cd7cff72ae0ea7ce3d32","observation_id":"fc0eb9c2-6684-44f7-a85e-eb33fe6f65c0","resolution":{"observed_at":"2026-08-01T16:57:30.759344Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:57:30.837145Z","title":"SLAKE: A semantically-labeled knowledge-enhanced dataset for medical visual question answering,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.17834","last_updated":"2026-07-20T11:25:54Z","snapshot_observed_at":"2026-08-08T10:21:16.088248Z","submitted_at":"2026-07-20T11:25:54Z","title":"Measuring and Improving Complex-Atomic Answer Consistency in Endoscopic VQA","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-01T16:57:30.837145Z"},"links":{"citing_paper":"/paper/2607.17834"},"observation_digest":"sha256:cc7e61153d34b4c36cabb936b5e4a437b5130b7e78ba1c6ceb01e23eca3a3a80","observation_id":"13ecf9ea-2aff-4da9-bddf-4357eeb8c9f2","resolution":{"observed_at":"2026-08-01T16:57:30.837145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2003.10286","last_updated":"2020-03-07T17:55:41Z","snapshot_observed_at":"2026-07-06T09:06:42.071993Z","submitted_at":"2020-03-07T17:55:41Z","title":"PathVQA: 30000+ Questions for Medical Visual Question Answering","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2003.10286","snapshot_observed_at":"2026-08-01T16:57:30.901279Z","title":"PathVQA: 30000+ ques- tions for medical visual question answering,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.17834","last_updated":"2026-07-20T11:25:54Z","snapshot_observed_at":"2026-08-08T10:21:16.088248Z","submitted_at":"2026-07-20T11:25:54Z","title":"Measuring and Improving Complex-Atomic Answer Consistency in Endoscopic VQA","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-01T16:57:30.901279Z"},"links":{"cited_paper":"/paper/2003.10286","citing_paper":"/paper/2607.17834"},"observation_digest":"sha256:4882d0116f0b3f8c23bbfd77dae51d118c0b7c3d781a447ee547b887d4aace50","observation_id":"0d86f0d9-a5c4-4074-ac96-ece0213df90a","resolution":{"observed_at":"2026-08-01T16:57:30.901279Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:57:31.025015Z","title":"Gastric-X: A multimodal multi-phase benchmark dataset for advancing vision-language models in gastric cancer analysis,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.17834","last_updated":"2026-07-20T11:25:54Z","snapshot_observed_at":"2026-08-08T10:21:16.088248Z","submitted_at":"2026-07-20T11:25:54Z","title":"Measuring and Improving Complex-Atomic Answer Consistency in Endoscopic VQA","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-01T16:57:31.025015Z"},"links":{"citing_paper":"/paper/2607.17834"},"observation_digest":"sha256:1f16245ed396b1b367a10d5eac6e4d9cc61a431a1b72434dcd0d9cfd01726729","observation_id":"0f808a84-0563-41da-bd2a-bbc15ac094c5","resolution":{"observed_at":"2026-08-01T16:57:31.025015Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.14544","last_updated":"2025-07-19T09:04:13Z","snapshot_observed_at":"2026-08-07T22:22:35.508180Z","submitted_at":"2025-07-19T09:04:13Z","title":"Multimodal AI for Gastrointestinal Diagnostics: Tackling VQA in MEDVQA-GI 2025","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.14544","snapshot_observed_at":"2026-08-01T16:57:31.114754Z","title":"Multimodal AI for gastrointestinal diagnostics: Tackling VQA in MEDVQA-GI 2025,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.17834","last_updated":"2026-07-20T11:25:54Z","snapshot_observed_at":"2026-08-08T10:21:16.088248Z","submitted_at":"2026-07-20T11:25:54Z","title":"Measuring and Improving Complex-Atomic Answer Consistency in Endoscopic VQA","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-01T16:57:31.114754Z"},"links":{"cited_paper":"/paper/2507.14544","citing_paper":"/paper/2607.17834"},"observation_digest":"sha256:a972a68353dc4850a757c2ee73f2f3c537679c1bcac23b85c90366bf1786a433","observation_id":"db7da7da-3c37-4341-aca2-c6eee986dffc","resolution":{"observed_at":"2026-08-01T16:57:31.114754Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:57:31.182264Z","title":"SQuINTing at VQA models: Introspecting VQA models with sub-questions,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.17834","last_updated":"2026-07-20T11:25:54Z","snapshot_observed_at":"2026-08-08T10:21:16.088248Z","submitted_at":"2026-07-20T11:25:54Z","title":"Measuring and Improving Complex-Atomic Answer Consistency in Endoscopic VQA","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-01T16:57:31.182264Z"},"links":{"citing_paper":"/paper/2607.17834"},"observation_digest":"sha256:d050fc8f092a48a421c508618f77cb67c16db6f5d36425b89a21c30c15f81e33","observation_id":"74a4b3a4-e836-491a-b8b2-90fbe4f12fc0","resolution":{"observed_at":"2026-08-01T16:57:31.182264Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:57:31.260410Z","title":"GQA: A new dataset for real- world visual reasoning and compositional question answering,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.17834","last_updated":"2026-07-20T11:25:54Z","snapshot_observed_at":"2026-08-08T10:21:16.088248Z","submitted_at":"2026-07-20T11:25:54Z","title":"Measuring and Improving Complex-Atomic Answer Consistency in Endoscopic VQA","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-01T16:57:31.260410Z"},"links":{"citing_paper":"/paper/2607.17834"},"observation_digest":"sha256:22d33cc08f9cd7b827c8f574b788aea2ce0da4166ac5efd4d59e82eac6d4010a","observation_id":"4b249f0d-93bb-4a93-9202-43022fd45f11","resolution":{"observed_at":"2026-08-01T16:57:31.260410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:57:31.306727Z","title":"FActScore: Fine-grained atomic eval- uation of factual precision in long form text generation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.17834","last_updated":"2026-07-20T11:25:54Z","snapshot_observed_at":"2026-08-08T10:21:16.088248Z","submitted_at":"2026-07-20T11:25:54Z","title":"Measuring and Improving Complex-Atomic Answer Consistency in Endoscopic VQA","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-01T16:57:31.306727Z"},"links":{"citing_paper":"/paper/2607.17834"},"observation_digest":"sha256:74be90813c10b589edccc82cc2a8488cdf50b15bda47cef447f4bedd5b68fa7e","observation_id":"cf4500e2-5de4-4bec-aea0-d5fdf2414192","resolution":{"observed_at":"2026-08-01T16:57:31.306727Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:57:31.424921Z","title":"FaithScore: Fine-grained evaluations of hallucinations in large vision-language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.17834","last_updated":"2026-07-20T11:25:54Z","snapshot_observed_at":"2026-08-08T10:21:16.088248Z","submitted_at":"2026-07-20T11:25:54Z","title":"Measuring and Improving Complex-Atomic Answer Consistency in Endoscopic VQA","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-01T16:57:31.424921Z"},"links":{"citing_paper":"/paper/2607.17834"},"observation_digest":"sha256:8ebdc556743b3e90fc14ef0577dbdd509f691e4dcabf2928eb739d6f21fb38f7","observation_id":"e8ff2250-0596-4bee-860d-e771419965a4","resolution":{"observed_at":"2026-08-01T16:57:31.424921Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:57:31.526176Z","title":"Evaluating object hallucination in large vision-language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.17834","last_updated":"2026-07-20T11:25:54Z","snapshot_observed_at":"2026-08-08T10:21:16.088248Z","submitted_at":"2026-07-20T11:25:54Z","title":"Measuring and Improving Complex-Atomic Answer Consistency in Endoscopic VQA","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-01T16:57:31.526176Z"},"links":{"citing_paper":"/paper/2607.17834"},"observation_digest":"sha256:4440067fbffcbd491a19cfebb4bf5325b8780f90ce746fc11d189957395c7122","observation_id":"01dc26f3-4482-408c-b211-f889a69e0e33","resolution":{"observed_at":"2026-08-01T16:57:31.526176Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:57:31.624760Z","title":"SurgViVQA: Temporally grounded video question answering for surgical scene understanding,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.17834","last_updated":"2026-07-20T11:25:54Z","snapshot_observed_at":"2026-08-08T10:21:16.088248Z","submitted_at":"2026-07-20T11:25:54Z","title":"Measuring and Improving Complex-Atomic Answer Consistency in Endoscopic VQA","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-01T16:57:31.624760Z"},"links":{"citing_paper":"/paper/2607.17834"},"observation_digest":"sha256:7304db18cdf3a5a457d627da326111ff45bc86a70c01d242fbe0d87b64c8747b","observation_id":"f1bc5eee-e0b1-4352-a770-c174d69ebae3","resolution":{"observed_at":"2026-08-01T16:57:31.624760Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:57:31.804910Z","title":"SOrT- ing VQA Models: Contrastive gradient learning for improved consistency,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.17834","last_updated":"2026-07-20T11:25:54Z","snapshot_observed_at":"2026-08-08T10:21:16.088248Z","submitted_at":"2026-07-20T11:25:54Z","title":"Measuring and Improving Complex-Atomic Answer Consistency in Endoscopic VQA","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-01T16:57:31.804910Z"},"links":{"citing_paper":"/paper/2607.17834"},"observation_digest":"sha256:0fb6259ced24083b4f4f8d92ccfe94b53ee18750c038de25fdbde57e0887b88e","observation_id":"5dfea074-c306-41b4-b149-055e26de5cc5","resolution":{"observed_at":"2026-08-01T16:57:31.804910Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:57:31.844958Z","title":"Self-consistency improves chain of thought reasoning in language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.17834","last_updated":"2026-07-20T11:25:54Z","snapshot_observed_at":"2026-08-08T10:21:16.088248Z","submitted_at":"2026-07-20T11:25:54Z","title":"Measuring and Improving Complex-Atomic Answer Consistency in Endoscopic VQA","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-01T16:57:31.844958Z"},"links":{"citing_paper":"/paper/2607.17834"},"observation_digest":"sha256:a597a65dfa0f0ad2ae72349ca117307be54d9943adf5a86094be02498eac92b4","observation_id":"c18ab17b-d6b4-417e-8ad3-8a879bfe374f","resolution":{"observed_at":"2026-08-01T16:57:31.844958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:57:31.915069Z","title":"SelfCheckGPT: Zero-resource black-box hallucination detection for generative large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.17834","last_updated":"2026-07-20T11:25:54Z","snapshot_observed_at":"2026-08-08T10:21:16.088248Z","submitted_at":"2026-07-20T11:25:54Z","title":"Measuring and Improving Complex-Atomic Answer Consistency in Endoscopic VQA","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-01T16:57:31.915069Z"},"links":{"citing_paper":"/paper/2607.17834"},"observation_digest":"sha256:bd0bb342692a585cb1fcacffe3b18e60aa0e35ee75dac0ad9fc51f2d42e356fa","observation_id":"5399dae0-f9cf-4776-826b-772e8e4f90ca","resolution":{"observed_at":"2026-08-01T16:57:31.915069Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.07292","last_updated":"2026-05-18T16:19:07Z","snapshot_observed_at":"2026-08-05T09:36:33.134532Z","submitted_at":"2025-08-10T11:02:57Z","title":"EndoCogniAgent: Closed-Loop Agentic Reasoning with Self-Consistency Validation for Endoscopic Diagnosis","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.07292","snapshot_observed_at":"2026-08-01T16:57:32.005347Z","title":"EndoCogniAgent: Closed-loop agentic reasoning with self-consistency validation for endoscopic diagnosis,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.17834","last_updated":"2026-07-20T11:25:54Z","snapshot_observed_at":"2026-08-08T10:21:16.088248Z","submitted_at":"2026-07-20T11:25:54Z","title":"Measuring and Improving Complex-Atomic Answer Consistency in Endoscopic VQA","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-01T16:57:32.005347Z"},"links":{"cited_paper":"/paper/2508.07292","citing_paper":"/paper/2607.17834"},"observation_digest":"sha256:082aee4bebfb5be95417f44c3be77345df9c87c3fa6632132c8ba36162695910","observation_id":"c06feab4-bebe-4064-807e-32a6c9601e79","resolution":{"observed_at":"2026-08-01T16:57:32.005347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.05271","last_updated":"2025-09-26T12:52:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-06T18:57:08Z","title":"Expanding Performance Boundaries of Open-Source Multimodal Models with Model, Data, and Test-Time Scaling","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.05271","snapshot_observed_at":"2026-08-01T16:57:32.074913Z","title":"Expanding performance boundaries of open-source multimodal models with model, data, and test-time scaling,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.17834","last_updated":"2026-07-20T11:25:54Z","snapshot_observed_at":"2026-08-08T10:21:16.088248Z","submitted_at":"2026-07-20T11:25:54Z","title":"Measuring and Improving Complex-Atomic Answer Consistency in Endoscopic VQA","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-01T16:57:32.074913Z"},"links":{"cited_paper":"/paper/2412.05271","citing_paper":"/paper/2607.17834"},"observation_digest":"sha256:d13d40079274caac4a18448bd243ac9c14ec5164aadf2ccb64728d41905f2722","observation_id":"96c323b5-3c29-4b2d-9806-3668349ca33a","resolution":{"observed_at":"2026-08-01T16:57:32.074913Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-01T16:57:32.164787Z","title":"Qwen2.5-VL technical report,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.17834","last_updated":"2026-07-20T11:25:54Z","snapshot_observed_at":"2026-08-08T10:21:16.088248Z","submitted_at":"2026-07-20T11:25:54Z","title":"Measuring and Improving Complex-Atomic Answer Consistency in Endoscopic VQA","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-01T16:57:32.164787Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2607.17834"},"observation_digest":"sha256:6be158ee150806743660dd1deee0cc78c9110d8501164fd74e05c9e8989b7937","observation_id":"5fd35ddb-1b5a-4314-a2e9-965536bca052","resolution":{"observed_at":"2026-08-01T16:57:32.164787Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.21631","last_updated":"2025-11-27T12:16:54Z","snapshot_observed_at":"2026-07-06T22:37:03.716474Z","submitted_at":"2025-11-26T17:59:08Z","title":"Qwen3-VL Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.21631","snapshot_observed_at":"2026-08-01T16:57:32.240973Z","title":"Qwen3-VL Technical Report,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.17834","last_updated":"2026-07-20T11:25:54Z","snapshot_observed_at":"2026-08-08T10:21:16.088248Z","submitted_at":"2026-07-20T11:25:54Z","title":"Measuring and Improving Complex-Atomic Answer Consistency in Endoscopic VQA","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-01T16:57:32.240973Z"},"links":{"cited_paper":"/paper/2511.21631","citing_paper":"/paper/2607.17834"},"observation_digest":"sha256:949f71aa1befd1880262fd0eefa227dae9ca40fdf705dadac33f171e52c522be","observation_id":"8c0b1bff-2845-445d-822b-b12f32f4dfa9","resolution":{"observed_at":"2026-08-01T16:57:32.240973Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.05201","last_updated":"2026-04-06T19:50:20Z","snapshot_observed_at":"2026-08-07T23:53:34.814339Z","submitted_at":"2025-07-07T17:01:44Z","title":"MedGemma Technical Report","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.05201","snapshot_observed_at":"2026-08-01T16:57:32.374977Z","title":"MedGemma technical report,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.17834","last_updated":"2026-07-20T11:25:54Z","snapshot_observed_at":"2026-08-08T10:21:16.088248Z","submitted_at":"2026-07-20T11:25:54Z","title":"Measuring and Improving Complex-Atomic Answer Consistency in Endoscopic VQA","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-01T16:57:32.374977Z"},"links":{"cited_paper":"/paper/2507.05201","citing_paper":"/paper/2607.17834"},"observation_digest":"sha256:3cdd724ba219e4dc205d9bd382799e415b6769f4442ffd128449bcdafa28de3a","observation_id":"4fd063ac-3bc3-4847-8aff-5f839cc11f9b","resolution":{"observed_at":"2026-08-01T16:57:32.374977Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.07044","last_updated":"2025-06-13T04:22:02Z","snapshot_observed_at":"2026-07-06T21:38:34.998414Z","submitted_at":"2025-06-08T08:47:30Z","title":"Lingshu: A Generalist Foundation Model for Unified Multimodal Medical Understanding and Reasoning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.07044","snapshot_observed_at":"2026-08-01T16:57:32.495216Z","title":"Lingshu: A generalist foundation model for unified multimodal medical understanding and reasoning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.17834","last_updated":"2026-07-20T11:25:54Z","snapshot_observed_at":"2026-08-08T10:21:16.088248Z","submitted_at":"2026-07-20T11:25:54Z","title":"Measuring and Improving Complex-Atomic Answer Consistency in Endoscopic VQA","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-01T16:57:32.495216Z"},"links":{"cited_paper":"/paper/2506.07044","citing_paper":"/paper/2607.17834"},"observation_digest":"sha256:1f4fea51c5856b697a598247f0d123988b3d282997796fc19a25ffc9882ca719","observation_id":"49e8a40b-ba03-42f8-a806-0e46509b089a","resolution":{"observed_at":"2026-08-01T16:57:32.495216Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:57:32.601379Z","title":"LLaV A-Med: Training a large language-and-vision assistant for biomedicine in one day,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.17834","last_updated":"2026-07-20T11:25:54Z","snapshot_observed_at":"2026-08-08T10:21:16.088248Z","submitted_at":"2026-07-20T11:25:54Z","title":"Measuring and Improving Complex-Atomic Answer Consistency in Endoscopic VQA","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-01T16:57:32.601379Z"},"links":{"citing_paper":"/paper/2607.17834"},"observation_digest":"sha256:d91bb4448f6905019d7ae6b56ac4f8f6253656a39e87c0082a34d199fa1cb408","observation_id":"2418b604-cf9f-4f8c-bb49-0317d304ba3f","resolution":{"observed_at":"2026-08-01T16:57:32.601379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09685","last_updated":"2021-10-16T18:40:34Z","snapshot_observed_at":"2026-08-07T07:43:16.294957Z","submitted_at":"2021-06-17T17:37:18Z","title":"LoRA: Low-Rank Adaptation of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.09685","snapshot_observed_at":"2026-08-01T16:57:32.628923Z","title":"LoRA: Low-rank adaptation of large language models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.17834","last_updated":"2026-07-20T11:25:54Z","snapshot_observed_at":"2026-08-08T10:21:16.088248Z","submitted_at":"2026-07-20T11:25:54Z","title":"Measuring and Improving Complex-Atomic Answer Consistency in Endoscopic VQA","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-01T16:57:32.628923Z"},"links":{"cited_paper":"/paper/2106.09685","citing_paper":"/paper/2607.17834"},"observation_digest":"sha256:4ee6a783ab41608ce6f49845a6b140b9f2faa3d465c82bba7b197346527d576f","observation_id":"9f02fa70-90ac-4710-a0bf-cc547e1c9f19","resolution":{"observed_at":"2026-08-01T16:57:32.628923Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:57:32.707708Z","title":"Introducing GPT-5.5,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.17834","last_updated":"2026-07-20T11:25:54Z","snapshot_observed_at":"2026-08-08T10:21:16.088248Z","submitted_at":"2026-07-20T11:25:54Z","title":"Measuring and Improving Complex-Atomic Answer Consistency in Endoscopic VQA","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-01T16:57:32.707708Z"},"links":{"citing_paper":"/paper/2607.17834"},"observation_digest":"sha256:c10b7e3b5473deb1c30f0acd4d4c5b5c40141b5ea5acb7f4f9fc8d94ba3b0f7b","observation_id":"0138a730-b715-4916-994f-82cd3726ece4","resolution":{"observed_at":"2026-08-01T16:57:32.707708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:57:32.794873Z","title":"Grok 4.20,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.17834","last_updated":"2026-07-20T11:25:54Z","snapshot_observed_at":"2026-08-08T10:21:16.088248Z","submitted_at":"2026-07-20T11:25:54Z","title":"Measuring and Improving Complex-Atomic Answer Consistency in Endoscopic VQA","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-01T16:57:32.794873Z"},"links":{"citing_paper":"/paper/2607.17834"},"observation_digest":"sha256:d7fc1ac7d74e80aeaca49684d6a6ba04345f268808ba1680c7f3cd5dd4c99c5b","observation_id":"0205a04a-0f89-4a80-be9f-b9d06b64c46c","resolution":{"observed_at":"2026-08-01T16:57:32.794873Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:57:32.887608Z","title":"Introducing Claude Opus 4.7,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.17834","last_updated":"2026-07-20T11:25:54Z","snapshot_observed_at":"2026-08-08T10:21:16.088248Z","submitted_at":"2026-07-20T11:25:54Z","title":"Measuring and Improving Complex-Atomic Answer Consistency in Endoscopic VQA","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-01T16:57:32.887608Z"},"links":{"citing_paper":"/paper/2607.17834"},"observation_digest":"sha256:d6aca02d51cb50d469f7e708602f336a33ec1adbb4aab2f697e733de70d7fc89","observation_id":"a6729660-0267-40d7-a6a0-3b8e74616e57","resolution":{"observed_at":"2026-08-01T16:57:32.887608Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.17834","last_updated":"2026-07-20T11:25:54Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-08T10:21:16.088248Z","submitted_at":"2026-07-20T11:25:54Z","title":"Measuring and Improving Complex-Atomic Answer Consistency in Endoscopic VQA"},"reference_resolution":{"displayed":30,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":30,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":30},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 30 of 30 outbound references and 0 inbound Pith citation observations for arXiv:2607.17834."}