{"as_of":"2026-08-07T10:30:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:389536f5ee44e830ee99815147cb0f1bc4c60605f8446b8031d1a79d98e0fa37","coverage":[{"denominator":40,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":40,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T23:10:46.701581Z","state":"measured"},{"denominator":40,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":40,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.19217/citation-record","integrity":"/paper/2506.19217/integrity","json":"/paper/2506.19217/citation-record.json","paper":"/paper/2506.19217"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:10:51.480811Z","title":"Computed tomography and magnetic resonance imaging: past, present and future.European Respiratory Journal, 19(35 suppl):3s–12s, 2002","venue":null,"work_id":"133ac65d-cea8-4902-aa2f-5911d0aeab8b","year":2002},"citing_paper":{"arxiv_id":"2506.19217","last_updated":"2025-06-24T00:51:03Z","snapshot_observed_at":"2026-08-06T23:04:54.325787Z","submitted_at":"2025-06-24T00:51:03Z","title":"MedErr-CT: A Visual Question Answering Benchmark for Identifying and Correcting Errors in CT Reports","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T23:10:42.598520Z"},"links":{"citing_paper":"/paper/2506.19217"},"observation_digest":"sha256:18f294b3252e5dbb91d4abc4b3fe460b56e14c2dc6635b913022fe85d605ccd3","observation_id":"0cbf479e-e58c-4054-a24a-01bfb744648e","resolution":{"observed_at":"2026-08-06T23:10:51.485949Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:10:51.464199Z","title":"Should we be concerned about the rapid increase in ct usage?Reviews on environmental health, 25(1):63–68, 2010","venue":null,"work_id":"9ff55a8c-be28-4b8d-b252-07665f6ff9a9","year":2010},"citing_paper":{"arxiv_id":"2506.19217","last_updated":"2025-06-24T00:51:03Z","snapshot_observed_at":"2026-08-06T23:04:54.325787Z","submitted_at":"2025-06-24T00:51:03Z","title":"MedErr-CT: A Visual Question Answering Benchmark for Identifying and Correcting Errors in CT Reports","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T23:10:42.647398Z"},"links":{"citing_paper":"/paper/2506.19217"},"observation_digest":"sha256:7163eaa51ccc426fff261592713cbd5f26dad8044e16a253b3b1ffb2da9005b0","observation_id":"9e6857e0-9f0d-4a9e-b64b-987df1fcd7a5","resolution":{"observed_at":"2026-08-06T23:10:51.469459Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:10:51.448346Z","title":"Cognitive and system factors contribut- ing to diagnostic errors in radiology.American Journal of Roentgenology, 201(3):611–617, 2013","venue":null,"work_id":"6b841a35-2ec5-48e7-80c1-4e7e973423c7","year":2013},"citing_paper":{"arxiv_id":"2506.19217","last_updated":"2025-06-24T00:51:03Z","snapshot_observed_at":"2026-08-06T23:04:54.325787Z","submitted_at":"2025-06-24T00:51:03Z","title":"MedErr-CT: A Visual Question Answering Benchmark for Identifying and Correcting Errors in CT Reports","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T23:10:42.739674Z"},"links":{"citing_paper":"/paper/2506.19217"},"observation_digest":"sha256:83cc7c02f60384d193b2cdc176c0c6cdbe4daba1d36df5f950f36a95304cc408","observation_id":"1786067b-301c-4b76-864b-451275c3d7a2","resolution":{"observed_at":"2026-08-06T23:10:51.454129Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:10:51.428999Z","title":"Automated radiology report generation: A review of recent advances.IEEE Reviews in Biomedical Engineer- ing, 2024","venue":null,"work_id":"24d9e873-1e68-458c-8eb5-b11a1b156cb1","year":2024},"citing_paper":{"arxiv_id":"2506.19217","last_updated":"2025-06-24T00:51:03Z","snapshot_observed_at":"2026-08-06T23:04:54.325787Z","submitted_at":"2025-06-24T00:51:03Z","title":"MedErr-CT: A Visual Question Answering Benchmark for Identifying and Correcting Errors in CT Reports","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T23:10:42.826120Z"},"links":{"citing_paper":"/paper/2506.19217"},"observation_digest":"sha256:fae2e9c8accaa2bfe647de4a169a6487c9ab99623012434639713c74a89ca474","observation_id":"2a811af5-e706-4dc4-974a-dacc0cbcc068","resolution":{"observed_at":"2026-08-06T23:10:51.433752Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:10:51.412294Z","title":"Comparing diagnostic accuracy of radiolo- gists versus gpt-4v and gemini pro vision using image inputs from diagnosis please cases.Radiology, 312(1), July 2024","venue":null,"work_id":"758318b5-e9be-4d0d-8e86-3af1b5010315","year":2024},"citing_paper":{"arxiv_id":"2506.19217","last_updated":"2025-06-24T00:51:03Z","snapshot_observed_at":"2026-08-06T23:04:54.325787Z","submitted_at":"2025-06-24T00:51:03Z","title":"MedErr-CT: A Visual Question Answering Benchmark for Identifying and Correcting Errors in CT Reports","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T23:10:42.915903Z"},"links":{"citing_paper":"/paper/2506.19217"},"observation_digest":"sha256:b244bc98c2677eecb350777083117eb08264666cf173eed0da0afd9edb7570bb","observation_id":"6ef77ae9-f7cf-4339-bb01-206237bc6697","resolution":{"observed_at":"2026-08-06T23:10:51.417716Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:10:51.322946Z","title":"Evaluating large language models on medical evidence summarization.NPJ digital medicine, 6(1):158, 2023","venue":null,"work_id":"9818069f-f09b-402d-97dd-a71015d13ca0","year":2023},"citing_paper":{"arxiv_id":"2506.19217","last_updated":"2025-06-24T00:51:03Z","snapshot_observed_at":"2026-08-06T23:04:54.325787Z","submitted_at":"2025-06-24T00:51:03Z","title":"MedErr-CT: A Visual Question Answering Benchmark for Identifying and Correcting Errors in CT Reports","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T23:10:43.011449Z"},"links":{"citing_paper":"/paper/2506.19217"},"observation_digest":"sha256:47da467ff4d31f825bb2b7db94e02beaa6aea5dcf5236ea2c7744ba24283a2b1","observation_id":"9ce878c1-d2f8-4c0f-a405-be2a867a5b76","resolution":{"observed_at":"2026-08-06T23:10:51.368002Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:10:51.227490Z","title":"Embracing large language models for medical applications: opportuni- ties and challenges.Cureus, 15(5), 2023","venue":null,"work_id":"f33e134f-c4ca-4288-b4ea-93ec30a8410a","year":2023},"citing_paper":{"arxiv_id":"2506.19217","last_updated":"2025-06-24T00:51:03Z","snapshot_observed_at":"2026-08-06T23:04:54.325787Z","submitted_at":"2025-06-24T00:51:03Z","title":"MedErr-CT: A Visual Question Answering Benchmark for Identifying and Correcting Errors in CT Reports","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T23:10:43.097684Z"},"links":{"citing_paper":"/paper/2506.19217"},"observation_digest":"sha256:d487b29ef7edeb9562cfe0e853f49489311a2f6f91430283cc19f88cd8691f87","observation_id":"e1bfba31-07e9-48d4-aa5e-dd1b23790d72","resolution":{"observed_at":"2026-08-06T23:10:51.234294Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:10:50.970320Z","title":"A dataset of clinically generated visual questions and answers about radiology images.Scientific data, 5(1):1–10, 2018","venue":null,"work_id":"18669c62-82dd-4b68-90b6-6f6f7fb43298","year":2018},"citing_paper":{"arxiv_id":"2506.19217","last_updated":"2025-06-24T00:51:03Z","snapshot_observed_at":"2026-08-06T23:04:54.325787Z","submitted_at":"2025-06-24T00:51:03Z","title":"MedErr-CT: A Visual Question Answering Benchmark for Identifying and Correcting Errors in CT Reports","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T23:10:43.193737Z"},"links":{"citing_paper":"/paper/2506.19217"},"observation_digest":"sha256:e721d52df3c50db7808fc258045a0746f742a9f6e822252e044ddbe4d3f94f18","observation_id":"a1cfe936-bb90-4e1f-9b69-6e983c5c4bdd","resolution":{"observed_at":"2026-08-06T23:10:51.108888Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2003.10286","last_updated":"2020-03-07T17:55:41Z","snapshot_observed_at":"2026-07-06T09:06:42.071993Z","submitted_at":"2020-03-07T17:55:41Z","title":"PathVQA: 30000+ Questions for Medical Visual Question Answering","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2003.10286","snapshot_observed_at":"2026-08-06T23:10:43.293038Z","title":"Pathvqa: 30000+ questions for medical vi- sual question answering.arXiv preprint arXiv:2003.10286, 2020","venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2506.19217","last_updated":"2025-06-24T00:51:03Z","snapshot_observed_at":"2026-08-06T23:04:54.325787Z","submitted_at":"2025-06-24T00:51:03Z","title":"MedErr-CT: A Visual Question Answering Benchmark for Identifying and Correcting Errors in CT Reports","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T23:10:43.293038Z"},"links":{"cited_paper":"/paper/2003.10286","citing_paper":"/paper/2506.19217"},"observation_digest":"sha256:ad0b336d5bd6f861c036cc4e3a8714609fd78d6099c2a707dcd70378ab296e2a","observation_id":"edb9e078-c00c-4196-aa6c-2063a1b601e6","resolution":{"observed_at":"2026-08-06T23:10:43.293038Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:10:50.647065Z","title":"Slake: A semantically-labeled knowledge- enhanced dataset for medical visual question answering","venue":null,"work_id":"e4c70e82-3b53-4cb3-a19b-632c08798fc0","year":2021},"citing_paper":{"arxiv_id":"2506.19217","last_updated":"2025-06-24T00:51:03Z","snapshot_observed_at":"2026-08-06T23:04:54.325787Z","submitted_at":"2025-06-24T00:51:03Z","title":"MedErr-CT: A Visual Question Answering Benchmark for Identifying and Correcting Errors in CT Reports","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T23:10:43.381150Z"},"links":{"citing_paper":"/paper/2506.19217"},"observation_digest":"sha256:775a1e2ba4fdffee58fa7c0dbd6cd226d2643a3652a84fc78e20a8fad56829a6","observation_id":"fb21cd16-96b6-45dd-99f6-433cc62987a8","resolution":{"observed_at":"2026-08-06T23:10:50.786538Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.10415","last_updated":"2024-09-08T01:04:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-17T17:50:16Z","title":"PMC-VQA: Visual Instruction Tuning for Medical Visual Question Answering","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.10415","snapshot_observed_at":"2026-08-06T23:10:43.479305Z","title":"Pmc-vqa: Vi- sual instruction tuning for medical visual question answer- ing.arXiv preprint arXiv:2305.10415, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.19217","last_updated":"2025-06-24T00:51:03Z","snapshot_observed_at":"2026-08-06T23:04:54.325787Z","submitted_at":"2025-06-24T00:51:03Z","title":"MedErr-CT: A Visual Question Answering Benchmark for Identifying and Correcting Errors in CT Reports","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T23:10:43.479305Z"},"links":{"cited_paper":"/paper/2305.10415","citing_paper":"/paper/2506.19217"},"observation_digest":"sha256:9b5686ee7964b17b64a02d6b4a2f709e17877c8883a33071f33cdece4acdfd87","observation_id":"428a250c-52c1-46a2-b798-e1b4bd39fbcc","resolution":{"observed_at":"2026-08-06T23:10:43.479305Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:10:50.359605Z","title":"Omnimedvqa: A new large-scale comprehensive evaluation benchmark for medical lvlm","venue":null,"work_id":"f4e0b543-4b19-4095-bd81-1b632fb83be1","year":2024},"citing_paper":{"arxiv_id":"2506.19217","last_updated":"2025-06-24T00:51:03Z","snapshot_observed_at":"2026-08-06T23:04:54.325787Z","submitted_at":"2025-06-24T00:51:03Z","title":"MedErr-CT: A Visual Question Answering Benchmark for Identifying and Correcting Errors in CT Reports","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T23:10:43.555156Z"},"links":{"citing_paper":"/paper/2506.19217"},"observation_digest":"sha256:e490debe24601e1c002db25048f506bf347553fc18944e58e5a4642e0fc9fca3","observation_id":"115ddd63-1894-4bef-9a33-8707ebcfab85","resolution":{"observed_at":"2026-08-06T23:10:50.479972Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:10:50.029000Z","title":"Gmai-mmbench: A comprehensive multimodal evaluation benchmark towards general medical ai.Advances in Neural Information Processing Systems, 37:94327–94427, 2024","venue":null,"work_id":"96638283-89db-482d-ab8f-278612fedc25","year":2024},"citing_paper":{"arxiv_id":"2506.19217","last_updated":"2025-06-24T00:51:03Z","snapshot_observed_at":"2026-08-06T23:04:54.325787Z","submitted_at":"2025-06-24T00:51:03Z","title":"MedErr-CT: A Visual Question Answering Benchmark for Identifying and Correcting Errors in CT Reports","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T23:10:43.645745Z"},"links":{"citing_paper":"/paper/2506.19217"},"observation_digest":"sha256:b8f7548fb3703d6ed92e712066525f68ef202e3f93c9cffa6ee1cb326a8aff9f","observation_id":"88b74f26-1912-41a0-ab9b-ccc68fbf59d6","resolution":{"observed_at":"2026-08-06T23:10:50.210620Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.18362","last_updated":"2025-06-06T13:00:07Z","snapshot_observed_at":"2026-07-06T20:28:24.203633Z","submitted_at":"2025-01-30T14:07:56Z","title":"MedXpertQA: Benchmarking Expert-Level Medical Reasoning and Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.18362","snapshot_observed_at":"2026-08-06T23:10:43.721022Z","title":"Medxpertqa: Benchmarking expert-level medical reasoning and understanding.arXiv preprint arXiv:2501.18362, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.19217","last_updated":"2025-06-24T00:51:03Z","snapshot_observed_at":"2026-08-06T23:04:54.325787Z","submitted_at":"2025-06-24T00:51:03Z","title":"MedErr-CT: A Visual Question Answering Benchmark for Identifying and Correcting Errors in CT Reports","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T23:10:43.721022Z"},"links":{"cited_paper":"/paper/2501.18362","citing_paper":"/paper/2506.19217"},"observation_digest":"sha256:96c69fffd3e50079472dbd925521884011b5562d66c4a29c410720b67676ce76","observation_id":"05f1c7c1-6992-4164-925c-2b7b3d5f5976","resolution":{"observed_at":"2026-08-06T23:10:43.721022Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:10:49.642654Z","title":"Mme-survey: A comprehensive survey on evaluation of multimodal llms,","venue":null,"work_id":"1297efad-dc39-4dab-b8df-78b921543e4f","year":null},"citing_paper":{"arxiv_id":"2506.19217","last_updated":"2025-06-24T00:51:03Z","snapshot_observed_at":"2026-08-06T23:04:54.325787Z","submitted_at":"2025-06-24T00:51:03Z","title":"MedErr-CT: A Visual Question Answering Benchmark for Identifying and Correcting Errors in CT Reports","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T23:10:43.818300Z"},"links":{"citing_paper":"/paper/2506.19217"},"observation_digest":"sha256:31e3bbff4875f11cadc5fe29f48875d578a4bc7a0009bfc61564a793420d00ed","observation_id":"a8d1fb6e-ba17-4062-b407-3ce167e99ed7","resolution":{"observed_at":"2026-08-06T23:10:49.811271Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:10:49.235581Z","title":"Kim and Liem T","venue":null,"work_id":"40a201eb-9cca-4761-a485-7ba27c0b0dbf","year":2014},"citing_paper":{"arxiv_id":"2506.19217","last_updated":"2025-06-24T00:51:03Z","snapshot_observed_at":"2026-08-06T23:04:54.325787Z","submitted_at":"2025-06-24T00:51:03Z","title":"MedErr-CT: A Visual Question Answering Benchmark for Identifying and Correcting Errors in CT Reports","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T23:10:43.903843Z"},"links":{"citing_paper":"/paper/2506.19217"},"observation_digest":"sha256:b3f935bc44f5ffd88b5b98a7465af24bd58cb19d69b315a499677f5a0f177860","observation_id":"69e2268f-8bd6-4168-b4ab-fcec64620eab","resolution":{"observed_at":"2026-08-06T23:10:49.430981Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:10:48.923935Z","title":"Recovery at the edge of error: debunking the myth of the infallible expert.Journal of biomedical in- formatics, 44(3):413–424, 2011","venue":null,"work_id":"38362578-c76a-47f5-a41f-1f3c391427bf","year":2011},"citing_paper":{"arxiv_id":"2506.19217","last_updated":"2025-06-24T00:51:03Z","snapshot_observed_at":"2026-08-06T23:04:54.325787Z","submitted_at":"2025-06-24T00:51:03Z","title":"MedErr-CT: A Visual Question Answering Benchmark for Identifying and Correcting Errors in CT Reports","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T23:10:43.983906Z"},"links":{"citing_paper":"/paper/2506.19217"},"observation_digest":"sha256:9d4881db898570bda065b099a9f766d364cf80031aa555114afed49220e68cf2","observation_id":"c25235c2-3a65-424e-9262-fa9a93711142","resolution":{"observed_at":"2026-08-06T23:10:49.078302Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:10:48.662054Z","title":"Overview of the mediqa-corr 2024 shared task on medical error detection and correction","venue":null,"work_id":"26a75f94-82f9-4ad9-ae0c-231b49a7c972","year":2024},"citing_paper":{"arxiv_id":"2506.19217","last_updated":"2025-06-24T00:51:03Z","snapshot_observed_at":"2026-08-06T23:04:54.325787Z","submitted_at":"2025-06-24T00:51:03Z","title":"MedErr-CT: A Visual Question Answering Benchmark for Identifying and Correcting Errors in CT Reports","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T23:10:44.067488Z"},"links":{"citing_paper":"/paper/2506.19217"},"observation_digest":"sha256:11f5f0343689ec1dab6aab9a55722ae3c366cc680031d3d7f91b23e91ae0df6e","observation_id":"e6c3db7a-8e7f-4548-898c-e984a7b7deae","resolution":{"observed_at":"2026-08-06T23:10:48.799582Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:10:48.539922Z","title":"Potential of gpt-4 for detecting errors in radiology reports: implications for report- ing accuracy.Radiology, 311(1):e232714, 2024","venue":null,"work_id":"98cb489d-d22b-481c-b5fe-af8c55c2d647","year":2024},"citing_paper":{"arxiv_id":"2506.19217","last_updated":"2025-06-24T00:51:03Z","snapshot_observed_at":"2026-08-06T23:04:54.325787Z","submitted_at":"2025-06-24T00:51:03Z","title":"MedErr-CT: A Visual Question Answering Benchmark for Identifying and Correcting Errors in CT Reports","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T23:10:44.141513Z"},"links":{"citing_paper":"/paper/2506.19217"},"observation_digest":"sha256:13e79e57afe7c01c467c528bbafbb967773f4a3a71ce74fb6c1d17bb510789a4","observation_id":"06a40d3c-bd45-40a2-a5e0-0983b2bbd85b","resolution":{"observed_at":"2026-08-06T23:10:48.626354Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18619","last_updated":"2024-12-30T03:00:30Z","snapshot_observed_at":"2026-07-06T20:12:54.710203Z","submitted_at":"2024-12-16T05:02:25Z","title":"Next Token Prediction Towards Multimodal Intelligence: A Comprehensive Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.18619","snapshot_observed_at":"2026-08-06T23:10:44.228630Z","title":"Next token prediction towards multi- modal intelligence: A comprehensive survey.arXiv preprint arXiv:2412.18619, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.19217","last_updated":"2025-06-24T00:51:03Z","snapshot_observed_at":"2026-08-06T23:04:54.325787Z","submitted_at":"2025-06-24T00:51:03Z","title":"MedErr-CT: A Visual Question Answering Benchmark for Identifying and Correcting Errors in CT Reports","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T23:10:44.228630Z"},"links":{"cited_paper":"/paper/2412.18619","citing_paper":"/paper/2506.19217"},"observation_digest":"sha256:db8a093291e3d592d163ad7c109c1fa9b0c14da42fd9895a9948b8faa7f7ec31","observation_id":"18e7c4a7-cc8a-4549-9bf3-db27cfb420f7","resolution":{"observed_at":"2026-08-06T23:10:44.228630Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.19330","last_updated":"2024-09-28T12:31:07Z","snapshot_observed_at":"2026-07-06T19:23:50.186410Z","submitted_at":"2024-09-28T12:31:07Z","title":"3D-CT-GPT: Generating 3D Radiology Reports through Integration of Large Vision-Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.19330","snapshot_observed_at":"2026-08-06T23:10:44.308483Z","title":"3d-ct-gpt: Generating 3d radiology reports through integration of large vision-language models.arXiv preprint arXiv:2409.19330, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.19217","last_updated":"2025-06-24T00:51:03Z","snapshot_observed_at":"2026-08-06T23:04:54.325787Z","submitted_at":"2025-06-24T00:51:03Z","title":"MedErr-CT: A Visual Question Answering Benchmark for Identifying and Correcting Errors in CT Reports","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T23:10:44.308483Z"},"links":{"cited_paper":"/paper/2409.19330","citing_paper":"/paper/2506.19217"},"observation_digest":"sha256:e27d3ac1aea656edd656144f715be1a8a4ebfd2f0a17b6a4ccc830bd37508012","observation_id":"83010895-4fda-422d-8ff1-67939e9412c1","resolution":{"observed_at":"2026-08-06T23:10:44.308483Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:10:48.327909Z","title":"Med3dvlm: An efficient vision-language model for 3d med- ical image analysis, 2025","venue":null,"work_id":"571a87f0-a9a4-4586-a87c-d6b9be4f402f","year":2025},"citing_paper":{"arxiv_id":"2506.19217","last_updated":"2025-06-24T00:51:03Z","snapshot_observed_at":"2026-08-06T23:04:54.325787Z","submitted_at":"2025-06-24T00:51:03Z","title":"MedErr-CT: A Visual Question Answering Benchmark for Identifying and Correcting Errors in CT Reports","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T23:10:44.712221Z"},"links":{"citing_paper":"/paper/2506.19217"},"observation_digest":"sha256:85817f7091f36fd0b90738c89c6fd23ef3a0aca9ee53bc1874036485fc7abbd1","observation_id":"5353d755-11e3-4d34-a00d-9f1d3d9cb799","resolution":{"observed_at":"2026-08-06T23:10:48.447620Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:10:48.221513Z","title":"Medm-vl: What makes a good medical lvlm?,","venue":null,"work_id":"99dba38c-ea68-4a15-9a13-424f4aad7cfb","year":null},"citing_paper":{"arxiv_id":"2506.19217","last_updated":"2025-06-24T00:51:03Z","snapshot_observed_at":"2026-08-06T23:04:54.325787Z","submitted_at":"2025-06-24T00:51:03Z","title":"MedErr-CT: A Visual Question Answering Benchmark for Identifying and Correcting Errors in CT Reports","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T23:10:44.801787Z"},"links":{"citing_paper":"/paper/2506.19217"},"observation_digest":"sha256:ce57095d52f3959201bf27a72a55e0971b1673069ae8c26e763a74abdd25dddb","observation_id":"0382bbba-26ec-4f69-8ff6-65e5914ada57","resolution":{"observed_at":"2026-08-06T23:10:48.276586Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19260","last_updated":"2025-01-02T18:46:05Z","snapshot_observed_at":"2026-07-06T20:13:27.068339Z","submitted_at":"2024-12-26T15:54:10Z","title":"MEDEC: A Benchmark for Medical Error Detection and Correction in Clinical Notes","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19260","snapshot_observed_at":"2026-08-06T23:10:44.901214Z","title":"Medec: A bench- mark for medical error detection and correction in clinical notes.arXiv preprint arXiv:2412.19260, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.19217","last_updated":"2025-06-24T00:51:03Z","snapshot_observed_at":"2026-08-06T23:04:54.325787Z","submitted_at":"2025-06-24T00:51:03Z","title":"MedErr-CT: A Visual Question Answering Benchmark for Identifying and Correcting Errors in CT Reports","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T23:10:44.901214Z"},"links":{"cited_paper":"/paper/2412.19260","citing_paper":"/paper/2506.19217"},"observation_digest":"sha256:339d1b2d4f83b2605d2082da60ac8dca8d2aa81f33b849769f10b42e244fcbf3","observation_id":"17dd16c3-2a9e-4bc6-b893-7ac6135e1c63","resolution":{"observed_at":"2026-08-06T23:10:44.901214Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.10829","last_updated":"2024-09-17T01:42:39Z","snapshot_observed_at":"2026-08-03T13:47:41.206814Z","submitted_at":"2024-09-17T01:42:39Z","title":"ReXErr: Synthesizing Clinically Meaningful Errors in Diagnostic Radiology Reports","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.10829","snapshot_observed_at":"2026-08-06T23:10:45.037970Z","title":"Rao, Serena Zhang, Julian N","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.19217","last_updated":"2025-06-24T00:51:03Z","snapshot_observed_at":"2026-08-06T23:04:54.325787Z","submitted_at":"2025-06-24T00:51:03Z","title":"MedErr-CT: A Visual Question Answering Benchmark for Identifying and Correcting Errors in CT Reports","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T23:10:45.037970Z"},"links":{"cited_paper":"/paper/2409.10829","citing_paper":"/paper/2506.19217"},"observation_digest":"sha256:d03265fa641ead4dbea800befcbe446a4003a307b582263fa689391a6acf010a","observation_id":"33204f4a-b552-4226-9903-d3757868ced9","resolution":{"observed_at":"2026-08-06T23:10:45.037970Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:10:48.100311Z","title":"Mimic-cxr, a de- identified publicly available database of chest radiographs with free-text reports.Scientific data, 6(1):317, 2019","venue":null,"work_id":"1906e8bc-4269-428d-986e-9d3163e534a7","year":2019},"citing_paper":{"arxiv_id":"2506.19217","last_updated":"2025-06-24T00:51:03Z","snapshot_observed_at":"2026-08-06T23:04:54.325787Z","submitted_at":"2025-06-24T00:51:03Z","title":"MedErr-CT: A Visual Question Answering Benchmark for Identifying and Correcting Errors in CT Reports","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T23:10:45.146921Z"},"links":{"citing_paper":"/paper/2506.19217"},"observation_digest":"sha256:6ff37a4f1820c1183ca0d5974057316fde741d56ccad3c83a3cac9340ff72145","observation_id":"44d7a051-144e-4d14-950f-827898976d04","resolution":{"observed_at":"2026-08-06T23:10:48.149757Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.02730","last_updated":"2024-07-03T00:59:03Z","snapshot_observed_at":"2026-07-06T18:40:39.990816Z","submitted_at":"2024-07-03T00:59:03Z","title":"MedVH: Towards Systematic Evaluation of Hallucination for Large Vision Language Models in the Medical Context","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.02730","snapshot_observed_at":"2026-08-06T23:10:45.285853Z","title":"MedVH: Towards Systematic Evaluation of Hallucination for Large Vision Language Models in the Medical Context, July 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.19217","last_updated":"2025-06-24T00:51:03Z","snapshot_observed_at":"2026-08-06T23:04:54.325787Z","submitted_at":"2025-06-24T00:51:03Z","title":"MedErr-CT: A Visual Question Answering Benchmark for Identifying and Correcting Errors in CT Reports","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T23:10:45.285853Z"},"links":{"cited_paper":"/paper/2407.02730","citing_paper":"/paper/2506.19217"},"observation_digest":"sha256:b1675079c91165b7e96220bc12ab9d07ffbb00df181fb398b02b09a559b2e446","observation_id":"63cfcc53-e338-4855-aab8-75092ce45f50","resolution":{"observed_at":"2026-08-06T23:10:45.285853Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:10:47.978434Z","title":"A foundation model utilizing chest ct volumes and radiology reports for supervised-level zero- shot detection of abnormalities.CoRR, 2024","venue":null,"work_id":"2ee95195-5570-4dad-8956-2d4203f78efd","year":2024},"citing_paper":{"arxiv_id":"2506.19217","last_updated":"2025-06-24T00:51:03Z","snapshot_observed_at":"2026-08-06T23:04:54.325787Z","submitted_at":"2025-06-24T00:51:03Z","title":"MedErr-CT: A Visual Question Answering Benchmark for Identifying and Correcting Errors in CT Reports","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T23:10:45.400446Z"},"links":{"citing_paper":"/paper/2506.19217"},"observation_digest":"sha256:38beb589a9bb85c5c73d56dfdcdc43c8a8e8673314a8e19255c016181e0ffc2a","observation_id":"bdb16b3b-681a-4534-a31f-e49f2746f9b5","resolution":{"observed_at":"2026-08-06T23:10:48.034543Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.16754","last_updated":"2024-04-25T17:11:37Z","snapshot_observed_at":"2026-08-05T06:07:21.434244Z","submitted_at":"2024-04-25T17:11:37Z","title":"RadGenome-Chest CT: A Grounded Vision-Language Dataset for Chest CT Analysis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.16754","snapshot_observed_at":"2026-08-06T23:10:45.482676Z","title":"Radgenome-chest ct: A grounded vision-language dataset for chest ct analysis","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.19217","last_updated":"2025-06-24T00:51:03Z","snapshot_observed_at":"2026-08-06T23:04:54.325787Z","submitted_at":"2025-06-24T00:51:03Z","title":"MedErr-CT: A Visual Question Answering Benchmark for Identifying and Correcting Errors in CT Reports","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T23:10:45.482676Z"},"links":{"cited_paper":"/paper/2404.16754","citing_paper":"/paper/2506.19217"},"observation_digest":"sha256:a65cb8e2af769c02fcbb5f096b33b5dc5746a7578b4740181f8d3f0686a3e7a7","observation_id":"4f65962b-c11c-4f1c-b76e-b002564a7ca5","resolution":{"observed_at":"2026-08-06T23:10:45.482676Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:10:47.852583Z","title":"Cambrian-1: A fully open, vision-centric explo- ration of multimodal llms.Advances in Neural Information Processing Systems, 37:87310–87356, 2024","venue":null,"work_id":"190df897-1bc0-4998-a4c3-dae9b5f150e4","year":2024},"citing_paper":{"arxiv_id":"2506.19217","last_updated":"2025-06-24T00:51:03Z","snapshot_observed_at":"2026-08-06T23:04:54.325787Z","submitted_at":"2025-06-24T00:51:03Z","title":"MedErr-CT: A Visual Question Answering Benchmark for Identifying and Correcting Errors in CT Reports","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T23:10:45.564153Z"},"links":{"citing_paper":"/paper/2506.19217"},"observation_digest":"sha256:57f80d6a0e33d7f713ef96c771307adf36f87158a380cf8e847a4e6bb6ccfe14","observation_id":"6f7c1a52-eae0-465f-8324-1dfff9514139","resolution":{"observed_at":"2026-08-06T23:10:47.904119Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.03714","last_updated":"2023-10-05T17:37:25Z","snapshot_observed_at":"2026-08-04T05:21:05.846165Z","submitted_at":"2023-10-05T17:37:25Z","title":"DSPy: Compiling Declarative Language Model Calls into Self-Improving Pipelines","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.03714","snapshot_observed_at":"2026-08-06T23:10:45.655074Z","title":"Dspy: Compiling declarative language model calls into self-improving pipelines.arXiv preprint arXiv:2310.03714,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.19217","last_updated":"2025-06-24T00:51:03Z","snapshot_observed_at":"2026-08-06T23:04:54.325787Z","submitted_at":"2025-06-24T00:51:03Z","title":"MedErr-CT: A Visual Question Answering Benchmark for Identifying and Correcting Errors in CT Reports","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T23:10:45.655074Z"},"links":{"cited_paper":"/paper/2310.03714","citing_paper":"/paper/2506.19217"},"observation_digest":"sha256:d7e85895298b90a75538ec1f2e3ddbee3c939c793ef6c158c2dadcf9c5ec0256","observation_id":"99978041-19d1-4172-b7a5-b4633f686d55","resolution":{"observed_at":"2026-08-06T23:10:45.655074Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-06T23:10:45.736107Z","title":"The llama 3 herd of models.arXiv preprint arXiv:2407.21783, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.19217","last_updated":"2025-06-24T00:51:03Z","snapshot_observed_at":"2026-08-06T23:04:54.325787Z","submitted_at":"2025-06-24T00:51:03Z","title":"MedErr-CT: A Visual Question Answering Benchmark for Identifying and Correcting Errors in CT Reports","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T23:10:45.736107Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2506.19217"},"observation_digest":"sha256:e7a86ffeb3936b4f1152539bf468e43f8ce2648774e4873b429df07644505108","observation_id":"d873694a-61ff-4e2e-8518-a284e4869ca4","resolution":{"observed_at":"2026-08-06T23:10:45.736107Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.02463","last_updated":"2023-11-16T12:38:46Z","snapshot_observed_at":"2026-07-06T16:02:39.154387Z","submitted_at":"2023-08-04T17:00:38Z","title":"Towards Generalist Foundation Model for Radiology by Leveraging Web-scale 2D&3D Medical Data","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.02463","snapshot_observed_at":"2026-08-06T23:10:45.868971Z","title":"Towards Generalist Foundation Model for Radiology by Leveraging Web-scale 2D&3D Medical Data, November 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.19217","last_updated":"2025-06-24T00:51:03Z","snapshot_observed_at":"2026-08-06T23:04:54.325787Z","submitted_at":"2025-06-24T00:51:03Z","title":"MedErr-CT: A Visual Question Answering Benchmark for Identifying and Correcting Errors in CT Reports","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T23:10:45.868971Z"},"links":{"cited_paper":"/paper/2308.02463","citing_paper":"/paper/2506.19217"},"observation_digest":"sha256:62ed9803083395868b54068ff57ed211e4f9f128414664a77fbc95c6eb32c74f","observation_id":"21572ae9-4807-4a72-b881-70ca51cc44b3","resolution":{"observed_at":"2026-08-06T23:10:45.868971Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.00578","last_updated":"2024-03-31T06:55:12Z","snapshot_observed_at":"2026-07-06T17:53:35.219482Z","submitted_at":"2024-03-31T06:55:12Z","title":"M3D: Advancing 3D Medical Image Analysis with Multi-Modal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.00578","snapshot_observed_at":"2026-08-06T23:10:45.988146Z","title":"Meng, and Bo Zhao","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.19217","last_updated":"2025-06-24T00:51:03Z","snapshot_observed_at":"2026-08-06T23:04:54.325787Z","submitted_at":"2025-06-24T00:51:03Z","title":"MedErr-CT: A Visual Question Answering Benchmark for Identifying and Correcting Errors in CT Reports","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T23:10:45.988146Z"},"links":{"cited_paper":"/paper/2404.00578","citing_paper":"/paper/2506.19217"},"observation_digest":"sha256:e8deb3cdb46a3050b51391302bb6ab34d8602da90546e80282acce9aa1aa547e","observation_id":"470dc869-5bc2-4946-ac5e-dde649d80ed8","resolution":{"observed_at":"2026-08-06T23:10:45.988146Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:10:46.089541Z","title":"De- veloping Generalist Foundation Models from a Multi- modal Dataset for 3D Computed Tomography, April 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.19217","last_updated":"2025-06-24T00:51:03Z","snapshot_observed_at":"2026-08-06T23:04:54.325787Z","submitted_at":"2025-06-24T00:51:03Z","title":"MedErr-CT: A Visual Question Answering Benchmark for Identifying and Correcting Errors in CT Reports","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T23:10:46.089541Z"},"links":{"citing_paper":"/paper/2506.19217"},"observation_digest":"sha256:b1cd9ca89db7891ac8d2b72096abbd932ccc85c64127ec15a493186c601c6c89","observation_id":"6d3e0d87-338f-4a8a-abce-dad19db84edf","resolution":{"observed_at":"2026-08-06T23:10:46.089541Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:10:47.693950Z","title":"ROUGE: A Package for Automatic Evalu- ation of Summaries","venue":null,"work_id":"0df72351-03c0-4056-8362-88daf6c61cd6","year":2004},"citing_paper":{"arxiv_id":"2506.19217","last_updated":"2025-06-24T00:51:03Z","snapshot_observed_at":"2026-08-06T23:04:54.325787Z","submitted_at":"2025-06-24T00:51:03Z","title":"MedErr-CT: A Visual Question Answering Benchmark for Identifying and Correcting Errors in CT Reports","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T23:10:46.201273Z"},"links":{"citing_paper":"/paper/2506.19217"},"observation_digest":"sha256:4a897ac9ff2c38489a2f76a53d8c89931a190b173d2cb2e570b75302dfa3334d","observation_id":"89e9e2f8-049d-44d9-a7e0-021817e7a208","resolution":{"observed_at":"2026-08-06T23:10:47.764041Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:10:47.499987Z","title":"Bleu: a Method for Automatic Evaluation of Ma- chine Translation","venue":null,"work_id":"b88aa657-9cd3-49d2-aa25-af332656ead6","year":2002},"citing_paper":{"arxiv_id":"2506.19217","last_updated":"2025-06-24T00:51:03Z","snapshot_observed_at":"2026-08-06T23:04:54.325787Z","submitted_at":"2025-06-24T00:51:03Z","title":"MedErr-CT: A Visual Question Answering Benchmark for Identifying and Correcting Errors in CT Reports","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T23:10:46.283549Z"},"links":{"citing_paper":"/paper/2506.19217"},"observation_digest":"sha256:32233ce2a874786f20861bed10a74874b6759ab2570e53baa6e0e1e41a1516ba","observation_id":"49635171-5368-4672-9ab1-54707ea48709","resolution":{"observed_at":"2026-08-06T23:10:47.559786Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:10:47.291155Z","title":"METEOR: An Auto- matic Metric for MT Evaluation with Improved Correlation with Human Judgments","venue":null,"work_id":"3b61af58-2d24-418a-a11a-1f296e4a092e","year":2005},"citing_paper":{"arxiv_id":"2506.19217","last_updated":"2025-06-24T00:51:03Z","snapshot_observed_at":"2026-08-06T23:04:54.325787Z","submitted_at":"2025-06-24T00:51:03Z","title":"MedErr-CT: A Visual Question Answering Benchmark for Identifying and Correcting Errors in CT Reports","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T23:10:46.443896Z"},"links":{"citing_paper":"/paper/2506.19217"},"observation_digest":"sha256:b50331901ae0c31f46c9ac007a0cb5713fb4629637ab65f388e628d7b670b057","observation_id":"cbd352a5-33a0-412f-8bd0-aeffdc2de515","resolution":{"observed_at":"2026-08-06T23:10:47.393684Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1904.09675","last_updated":"2020-02-24T18:59:28Z","snapshot_observed_at":"2026-07-29T15:42:51.774083Z","submitted_at":"2019-04-21T23:08:53Z","title":"BERTScore: Evaluating Text Generation with BERT","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.09675","snapshot_observed_at":"2026-08-06T23:10:46.566102Z","title":"Wein- berger, and Yoav Artzi","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.19217","last_updated":"2025-06-24T00:51:03Z","snapshot_observed_at":"2026-08-06T23:04:54.325787Z","submitted_at":"2025-06-24T00:51:03Z","title":"MedErr-CT: A Visual Question Answering Benchmark for Identifying and Correcting Errors in CT Reports","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T23:10:46.566102Z"},"links":{"cited_paper":"/paper/1904.09675","citing_paper":"/paper/2506.19217"},"observation_digest":"sha256:f4e54a35a5f94e6bf3123365870ad89041758b49041169e47825469bfacfc55f","observation_id":"5fff4125-b51c-4d5c-ba59-8a7cedb4ce4e","resolution":{"observed_at":"2026-08-06T23:10:46.566102Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.03595","last_updated":"2025-01-22T06:24:43Z","snapshot_observed_at":"2026-07-06T18:10:29.627336Z","submitted_at":"2024-05-06T16:04:03Z","title":"GREEN: Generative Radiology Report Evaluation and Error Notation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.03595","snapshot_observed_at":"2026-08-06T23:10:46.701581Z","title":"Chaudhari, and Jean-Benoit Delbrouck","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.19217","last_updated":"2025-06-24T00:51:03Z","snapshot_observed_at":"2026-08-06T23:04:54.325787Z","submitted_at":"2025-06-24T00:51:03Z","title":"MedErr-CT: A Visual Question Answering Benchmark for Identifying and Correcting Errors in CT Reports","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T23:10:46.701581Z"},"links":{"cited_paper":"/paper/2405.03595","citing_paper":"/paper/2506.19217"},"observation_digest":"sha256:085070f185aaa6a837a7960dcd3959326301ca3af9d313d58ca07e37790be3bf","observation_id":"6e5a2bf0-69a9-4a05-8e98-d63b4cb7fd0a","resolution":{"observed_at":"2026-08-06T23:10:46.701581Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.19217","last_updated":"2025-06-24T00:51:03Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-06T23:04:54.325787Z","submitted_at":"2025-06-24T00:51:03Z","title":"MedErr-CT: A Visual Question Answering Benchmark for Identifying and Correcting Errors in CT Reports"},"reference_resolution":{"displayed":40,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":16,"verified_exact":0,"verified_fuzzy":24},"total_outbound_references":40},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 40 of 40 outbound references and 0 inbound Pith citation observations for arXiv:2506.19217."}