{"as_of":"2026-08-08T09:13:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:757741fec77abc65540e7daf3fbba4ca141cb6672182e42f186a520005acb0dc","coverage":[{"denominator":8,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":8,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T17:19:47.183398Z","state":"measured"},{"denominator":10,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":10,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-12T13:30:26.488826Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T21:18:59.467672Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.11200","last_updated":"2025-07-18T16:56:02Z","snapshot_observed_at":"2026-08-07T20:38:25.739713Z","submitted_at":"2025-07-15T11:12:39Z","title":"How Far Have Medical Vision-Language Models Come? A Comprehensive Benchmarking Study","version":2},"cited_work":{"arxiv_id":"2507.11200","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.11200","snapshot_observed_at":"2026-07-03T21:18:59.467672Z","title":"How Far Have Medical Vision-Language Models Come? A Comprehensive Benchmarking Study,","venue":null,"work_id":"1790f7a6-bb19-4099-b2bd-ba649bf56526","year":2025},"citing_paper":{"arxiv_id":"2606.20723","last_updated":"2026-07-05T00:08:36Z","snapshot_observed_at":"2026-08-07T20:39:30.702446Z","submitted_at":"2026-06-16T22:33:14Z","title":"Evaluation of Medical Vision Language Models HuluMed and MedGemma, and general purpose chatbots Gemma 3, ChatGPT Plus, and Claude Pro on real previously unseen wound images","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-27T00:42:29.542446Z"},"links":{"cited_paper":"/paper/2507.11200","citing_paper":"/paper/2606.20723"},"observation_digest":"sha256:60deef868f5adabab2b0829701e12a573dd0e1a66f00c99b944e367e4b0c97fa","observation_id":"a4d1559b-01ff-4c57-80ba-495f6bd1e003","resolution":{"observed_at":"2026-07-03T21:18:59.469375Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.11200","last_updated":"2025-07-18T16:56:02Z","snapshot_observed_at":"2026-08-07T20:38:25.739713Z","submitted_at":"2025-07-15T11:12:39Z","title":"How Far Have Medical Vision-Language Models Come? A Comprehensive Benchmarking Study","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.11200","snapshot_observed_at":"2026-07-12T13:30:26.488826Z","title":"How Far Have Medical Vision-Language Models Come? A Comprehensive Benchmarking Study,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.20723","last_updated":"2026-07-05T00:08:36Z","snapshot_observed_at":"2026-08-07T20:39:30.702446Z","submitted_at":"2026-06-16T22:33:14Z","title":"Evaluation of Medical Vision Language Models HuluMed and MedGemma, and general purpose chatbots Gemma 3, ChatGPT Plus, and Claude Pro on real previously unseen wound images","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-12T13:30:26.488826Z"},"links":{"cited_paper":"/paper/2507.11200","citing_paper":"/paper/2606.20723"},"observation_digest":"sha256:95b24259d4906c669d8bfb21439c5603cff152105960eca763af722dab5d19ef","observation_id":"0e712b36-152f-4be7-bb8a-d510af778c50","resolution":{"observed_at":"2026-07-12T13:30:26.488826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2507.11200/citation-record","integrity":"/paper/2507.11200/integrity","json":"/paper/2507.11200/citation-record.json","paper":"/paper/2507.11200"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:19:46.780825Z","title":", \" * write output.state after.block = add.period write","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.11200","last_updated":"2025-07-18T16:56:02Z","snapshot_observed_at":"2026-08-07T20:38:25.739713Z","submitted_at":"2025-07-15T11:12:39Z","title":"How Far Have Medical Vision-Language Models Come? A Comprehensive Benchmarking Study","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-06T17:19:46.780825Z"},"links":{"citing_paper":"/paper/2507.11200"},"observation_digest":"sha256:3c76b1bb497cfbe45e65aa03a5ab56a2262e47e2e64760d3f7a4e1888663d64d","observation_id":"740feadf-96d1-44be-8a17-9966a2751240","resolution":{"observed_at":"2026-08-06T17:19:46.780825Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:19:46.808585Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.11200","last_updated":"2025-07-18T16:56:02Z","snapshot_observed_at":"2026-08-07T20:38:25.739713Z","submitted_at":"2025-07-15T11:12:39Z","title":"How Far Have Medical Vision-Language Models Come? A Comprehensive Benchmarking Study","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-06T17:19:46.808585Z"},"links":{"citing_paper":"/paper/2507.11200"},"observation_digest":"sha256:7db581df650224a4ecbf25318f4bc8b02fb3762beadb05754bc18556381a4da5","observation_id":"1d22e2f0-6239-43fb-b5d2-e812226b0145","resolution":{"observed_at":"2026-08-06T17:19:46.808585Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-06T17:19:46.853396Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.11200","last_updated":"2025-07-18T16:56:02Z","snapshot_observed_at":"2026-08-07T20:38:25.739713Z","submitted_at":"2025-07-15T11:12:39Z","title":"How Far Have Medical Vision-Language Models Come? A Comprehensive Benchmarking Study","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-06T17:19:46.853396Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2507.11200"},"observation_digest":"sha256:f97a3363a65c82db91fe14ada30fba7dfd0f22cf11219be82b6f38fbfa53b1ac","observation_id":"2364e215-df6b-4c97-ad7a-176ea07231e5","resolution":{"observed_at":"2026-08-06T17:19:46.853396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.19280","last_updated":"2024-09-30T06:45:16Z","snapshot_observed_at":"2026-08-06T18:57:51.817317Z","submitted_at":"2024-06-27T15:50:41Z","title":"HuatuoGPT-Vision, Towards Injecting Medical Visual Knowledge into Multimodal LLMs at Scale","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.19280","snapshot_observed_at":"2026-08-06T17:19:46.890585Z","title":"arXiv preprint arXiv:2406.19280 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.11200","last_updated":"2025-07-18T16:56:02Z","snapshot_observed_at":"2026-08-07T20:38:25.739713Z","submitted_at":"2025-07-15T11:12:39Z","title":"How Far Have Medical Vision-Language Models Come? A Comprehensive Benchmarking Study","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-06T17:19:46.890585Z"},"links":{"cited_paper":"/paper/2406.19280","citing_paper":"/paper/2507.11200"},"observation_digest":"sha256:e2e7af88c3d6f49a45f613a2ddea3aee30204574fdb1fb584dc0bb6fbb90274a","observation_id":"faf3aa55-f2f1-43e7-b1d3-3c55f7592289","resolution":{"observed_at":"2026-08-06T17:19:46.890585Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.19634","last_updated":"2025-03-19T13:55:33Z","snapshot_observed_at":"2026-08-07T20:37:56.716831Z","submitted_at":"2025-02-26T23:57:34Z","title":"MedVLM-R1: Incentivizing Medical Reasoning Capability of Vision-Language Models (VLMs) via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.19634","snapshot_observed_at":"2026-08-06T17:19:46.982626Z","title":"arXiv preprint arXiv:2502.19634 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.11200","last_updated":"2025-07-18T16:56:02Z","snapshot_observed_at":"2026-08-07T20:38:25.739713Z","submitted_at":"2025-07-15T11:12:39Z","title":"How Far Have Medical Vision-Language Models Come? A Comprehensive Benchmarking Study","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-06T17:19:46.982626Z"},"links":{"cited_paper":"/paper/2502.19634","citing_paper":"/paper/2507.11200"},"observation_digest":"sha256:45f3f1b45c8ed670e4bd85d25779e94d0bde1c1079b2f529cd5912bfff393d19","observation_id":"9c0eb45d-968e-4b77-abab-ae40351bd9f6","resolution":{"observed_at":"2026-08-06T17:19:46.982626Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.03569","last_updated":"2025-06-04T04:32:54Z","snapshot_observed_at":"2026-08-07T10:57:30.804332Z","submitted_at":"2025-06-04T04:32:54Z","title":"MiMo-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.03569","snapshot_observed_at":"2026-08-06T17:19:47.032597Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.11200","last_updated":"2025-07-18T16:56:02Z","snapshot_observed_at":"2026-08-07T20:38:25.739713Z","submitted_at":"2025-07-15T11:12:39Z","title":"How Far Have Medical Vision-Language Models Come? A Comprehensive Benchmarking Study","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-06T17:19:47.032597Z"},"links":{"cited_paper":"/paper/2506.03569","citing_paper":"/paper/2507.11200"},"observation_digest":"sha256:54bcbaaf8fc1f3a847941ccbf8866614bca37adb69bf55fe06252b2d149b58be","observation_id":"46e0d4a7-b639-4306-8547-51f65d2169d2","resolution":{"observed_at":"2026-08-06T17:19:47.032597Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.11462","last_updated":"2025-06-24T03:27:30Z","snapshot_observed_at":"2026-08-07T15:44:34.694747Z","submitted_at":"2025-05-16T17:16:27Z","title":"Disentangling Reasoning and Knowledge in Medical Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.11462","snapshot_observed_at":"2026-08-06T17:19:47.083790Z","title":"arXiv preprint arXiv:2505.11462 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.11200","last_updated":"2025-07-18T16:56:02Z","snapshot_observed_at":"2026-08-07T20:38:25.739713Z","submitted_at":"2025-07-15T11:12:39Z","title":"How Far Have Medical Vision-Language Models Come? A Comprehensive Benchmarking Study","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-06T17:19:47.083790Z"},"links":{"cited_paper":"/paper/2505.11462","citing_paper":"/paper/2507.11200"},"observation_digest":"sha256:12f88244f7b60216704ab04f726aacd1b5f4020b38d17f9d6a05155759dc402a","observation_id":"a2fd42b1-9267-40cb-a7c9-dcdd005dd195","resolution":{"observed_at":"2026-08-06T17:19:47.083790Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.07044","last_updated":"2025-06-13T04:22:02Z","snapshot_observed_at":"2026-07-06T21:38:34.998414Z","submitted_at":"2025-06-08T08:47:30Z","title":"Lingshu: A Generalist Foundation Model for Unified Multimodal Medical Understanding and Reasoning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.07044","snapshot_observed_at":"2026-08-06T17:19:47.183398Z","title":"arXiv preprint arXiv:2506.07044 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.11200","last_updated":"2025-07-18T16:56:02Z","snapshot_observed_at":"2026-08-07T20:38:25.739713Z","submitted_at":"2025-07-15T11:12:39Z","title":"How Far Have Medical Vision-Language Models Come? A Comprehensive Benchmarking Study","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-06T17:19:47.183398Z"},"links":{"cited_paper":"/paper/2506.07044","citing_paper":"/paper/2507.11200"},"observation_digest":"sha256:6eda8dab73b7041ceb669cbff3fbd57147876580f8aee1138348f9133d673547","observation_id":"369e548c-b35f-4172-a194-0dc66d14b44b","resolution":{"observed_at":"2026-08-06T17:19:47.183398Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.11200","last_updated":"2025-07-18T16:56:02Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T20:38:25.739713Z","submitted_at":"2025-07-15T11:12:39Z","title":"How Far Have Medical Vision-Language Models Come? A Comprehensive Benchmarking Study"},"reference_resolution":{"displayed":8,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":8,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":8},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 8 of 8 outbound references and 2 inbound Pith citation observations for arXiv:2507.11200."}