{"as_of":"2026-08-09T05:15:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:254a3ad4c0abfdb16e4ffa63c4fc98f05a3798c6aaca2733ee5481d87cff1364","coverage":[{"denominator":60,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":60,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T04:50:45.382132Z","state":"measured"},{"denominator":61,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":61,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T04:50:45.050116Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-06T04:50:45.808704Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2508.02951","last_updated":"2025-08-04T23:19:18Z","snapshot_observed_at":"2026-08-07T09:07:38.415598Z","submitted_at":"2025-08-04T23:19:18Z","title":"MedBLINK: Probing Basic Perception in Multimodal Language Models for Medicine","version":1},"cited_work":{"arxiv_id":"2508.02951","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.02951","snapshot_observed_at":"2026-08-06T04:50:45.808704Z","title":"MedBLINK: Probing Basic Perception in Multimodal Language Models for Medicine","venue":"cs.AI","work_id":"a3e84c01-cafa-4817-b836-7dc68c8a1ed5","year":2025},"citing_paper":{"arxiv_id":"2508.02951","last_updated":"2025-08-04T23:19:18Z","snapshot_observed_at":"2026-08-07T09:07:38.415598Z","submitted_at":"2025-08-04T23:19:18Z","title":"MedBLINK: Probing Basic Perception in Multimodal Language Models for Medicine","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T04:50:45.050116Z"},"links":{"cited_paper":"/paper/2508.02951","citing_paper":"/paper/2508.02951"},"observation_digest":"sha256:5f90e96d36dd1e0959d86102c37455b8e8f16d8071824573ab3ad3e380f4e21e","observation_id":"47c153a4-45ee-4a12-91f4-2dc59ba0543a","resolution":{"observed_at":"2026-08-06T04:50:45.814234Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2508.02951/citation-record","integrity":"/paper/2508.02951/integrity","json":"/paper/2508.02951/citation-record.json","paper":"/paper/2508.02951"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2508.02951","last_updated":"2025-08-04T23:19:18Z","snapshot_observed_at":"2026-08-07T09:07:38.415598Z","submitted_at":"2025-08-04T23:19:18Z","title":"MedBLINK: Probing Basic Perception in Multimodal Language Models for Medicine","version":1},"cited_work":{"arxiv_id":"2508.02951","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.02951","snapshot_observed_at":"2026-08-06T04:50:45.808704Z","title":"MedBLINK: Probing Basic Perception in Multimodal Language Models for Medicine","venue":"cs.AI","work_id":"a3e84c01-cafa-4817-b836-7dc68c8a1ed5","year":2025},"citing_paper":{"arxiv_id":"2508.02951","last_updated":"2025-08-04T23:19:18Z","snapshot_observed_at":"2026-08-07T09:07:38.415598Z","submitted_at":"2025-08-04T23:19:18Z","title":"MedBLINK: Probing Basic Perception in Multimodal Language Models for Medicine","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T04:50:45.050116Z"},"links":{"cited_paper":"/paper/2508.02951","citing_paper":"/paper/2508.02951"},"observation_digest":"sha256:5f90e96d36dd1e0959d86102c37455b8e8f16d8071824573ab3ad3e380f4e21e","observation_id":"47c153a4-45ee-4a12-91f4-2dc59ba0543a","resolution":{"observed_at":"2026-08-06T04:50:45.814234Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:50:46.552868Z","title":"These models combine text and image understanding and are typ- ically evaluated using visual question answering (VQA) tasks","venue":null,"work_id":"5939989f-59fa-42eb-8e59-5c86742b092e","year":null},"citing_paper":{"arxiv_id":"2508.02951","last_updated":"2025-08-04T23:19:18Z","snapshot_observed_at":"2026-08-07T09:07:38.415598Z","submitted_at":"2025-08-04T23:19:18Z","title":"MedBLINK: Probing Basic Perception in Multimodal Language Models for Medicine","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T04:50:45.056467Z"},"links":{"citing_paper":"/paper/2508.02951"},"observation_digest":"sha256:b69277a1632a0e86619e2bf08fca77795ac0c0f89d8a7fd4c5136049b94947d2","observation_id":"710b94de-7a56-4593-a1ca-35d63f90de9a","resolution":{"observed_at":"2026-08-06T04:50:46.557554Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:50:46.521820Z","title":"Perception enables clinicians to ex- tract key visual features before engaging in more complex 2 Figure 2","venue":null,"work_id":"92427927-f619-4631-b96a-dc6cec0d0e0e","year":null},"citing_paper":{"arxiv_id":"2508.02951","last_updated":"2025-08-04T23:19:18Z","snapshot_observed_at":"2026-08-07T09:07:38.415598Z","submitted_at":"2025-08-04T23:19:18Z","title":"MedBLINK: Probing Basic Perception in Multimodal Language Models for Medicine","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T04:50:45.067950Z"},"links":{"citing_paper":"/paper/2508.02951"},"observation_digest":"sha256:e63b9f8b101ce3a821127c574d1678f0db85b56f2e35b7f89baf1fcc0e7c44b0","observation_id":"6af40122-e672-4103-8449-829ae1cbafde","resolution":{"observed_at":"2026-08-06T04:50:46.527645Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:50:46.447521Z","title":null,"venue":null,"work_id":"3f43bac4-d776-4df7-910b-a8d196fc2a04","year":null},"citing_paper":{"arxiv_id":"2508.02951","last_updated":"2025-08-04T23:19:18Z","snapshot_observed_at":"2026-08-07T09:07:38.415598Z","submitted_at":"2025-08-04T23:19:18Z","title":"MedBLINK: Probing Basic Perception in Multimodal Language Models for Medicine","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T04:50:45.090608Z"},"links":{"citing_paper":"/paper/2508.02951"},"observation_digest":"sha256:5f3963bb28b1d7029eed2f2446cdb70fd8f4b108102bd8037e26765dbdc2f767","observation_id":"e4d88d05-d7f5-42a3-9f80-f09ff5e32940","resolution":{"observed_at":"2026-08-06T04:50:46.452654Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:50:46.504597Z","title":null,"venue":null,"work_id":"9540ef43-5fba-4f2d-85b7-236043ceb559","year":null},"citing_paper":{"arxiv_id":"2508.02951","last_updated":"2025-08-04T23:19:18Z","snapshot_observed_at":"2026-08-07T09:07:38.415598Z","submitted_at":"2025-08-04T23:19:18Z","title":"MedBLINK: Probing Basic Perception in Multimodal Language Models for Medicine","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T04:50:45.073600Z"},"links":{"citing_paper":"/paper/2508.02951"},"observation_digest":"sha256:eefc6c48a4a58ef155efec5da6a06c10dbf9aa047816828c229016210437b64d","observation_id":"847fb887-7ac6-46d8-bfa2-1993dbbd1d71","resolution":{"observed_at":"2026-08-06T04:50:46.510041Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:50:46.487007Z","title":null,"venue":null,"work_id":"9ef2dae0-8738-4557-81fb-fdff30d3f0bb","year":null},"citing_paper":{"arxiv_id":"2508.02951","last_updated":"2025-08-04T23:19:18Z","snapshot_observed_at":"2026-08-07T09:07:38.415598Z","submitted_at":"2025-08-04T23:19:18Z","title":"MedBLINK: Probing Basic Perception in Multimodal Language Models for Medicine","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T04:50:45.079017Z"},"links":{"citing_paper":"/paper/2508.02951"},"observation_digest":"sha256:00f1294346737a09312730503a3852dfac3e4b2b2f8210a7f84c9c9ec1fb121b","observation_id":"7f86ac3c-fbac-475f-8c64-101e529991c7","resolution":{"observed_at":"2026-08-06T04:50:46.491579Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:50:46.467060Z","title":"We mimic this form of prompting, by leveraging visual cues like points/dots to spatially prompt the models when answering the specified question [43, 50]","venue":null,"work_id":"00e1abd7-7cbd-4abe-9298-5057cf71377f","year":null},"citing_paper":{"arxiv_id":"2508.02951","last_updated":"2025-08-04T23:19:18Z","snapshot_observed_at":"2026-08-07T09:07:38.415598Z","submitted_at":"2025-08-04T23:19:18Z","title":"MedBLINK: Probing Basic Perception in Multimodal Language Models for Medicine","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T04:50:45.084623Z"},"links":{"citing_paper":"/paper/2508.02951"},"observation_digest":"sha256:e5d295e6ab20533ce43ffbbbd2aa010f82f42f63003017659ee051635fd28207","observation_id":"54d22850-cdf2-4baa-ae46-bf76d3454179","resolution":{"observed_at":"2026-08-06T04:50:46.474122Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:50:46.429810Z","title":"Current models including leading generalist and domain-specialized systems perform far below human levels on perceptual tasks that clinicians solve effortlessly (best: 65% vs","venue":null,"work_id":"c6f68535-d5bf-4651-86bd-756e0d265928","year":null},"citing_paper":{"arxiv_id":"2508.02951","last_updated":"2025-08-04T23:19:18Z","snapshot_observed_at":"2026-08-07T09:07:38.415598Z","submitted_at":"2025-08-04T23:19:18Z","title":"MedBLINK: Probing Basic Perception in Multimodal Language Models for Medicine","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T04:50:45.096640Z"},"links":{"citing_paper":"/paper/2508.02951"},"observation_digest":"sha256:b2437420747aa8a5c7c3c2898edf1f302ba05faa16fb50b108e5453f510c9dd8","observation_id":"f0ade7de-781a-417f-b728-1541bb262b80","resolution":{"observed_at":"2026-08-06T04:50:46.435678Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:50:45.860662Z","title":null,"venue":null,"work_id":"42e73b97-b610-4db8-aecc-93a3a52d281d","year":null},"citing_paper":{"arxiv_id":"2508.02951","last_updated":"2025-08-04T23:19:18Z","snapshot_observed_at":"2026-08-07T09:07:38.415598Z","submitted_at":"2025-08-04T23:19:18Z","title":"MedBLINK: Probing Basic Perception in Multimodal Language Models for Medicine","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T04:50:45.371172Z"},"links":{"citing_paper":"/paper/2508.02951"},"observation_digest":"sha256:312a9ab758f97e72cfa50c3dfbb34ed9a03e22f0af9a9e87dc59b603d98727d8","observation_id":"6280ff95-d0ab-431c-bc7b-415cae1e46b7","resolution":{"observed_at":"2026-08-06T04:50:45.865994Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:50:45.843318Z","title":null,"venue":null,"work_id":"5f52f24b-c565-47b4-8f6e-5bbeb9029ef1","year":null},"citing_paper":{"arxiv_id":"2508.02951","last_updated":"2025-08-04T23:19:18Z","snapshot_observed_at":"2026-08-07T09:07:38.415598Z","submitted_at":"2025-08-04T23:19:18Z","title":"MedBLINK: Probing Basic Perception in Multimodal Language Models for Medicine","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T04:50:45.376206Z"},"links":{"citing_paper":"/paper/2508.02951"},"observation_digest":"sha256:1e472ca7413f465501a2c02b172388d66b0ab400b02c538e3e2c348b1766d4c1","observation_id":"d1fcc25d-bb44-4297-9949-9cef024da10d","resolution":{"observed_at":"2026-08-06T04:50:45.848416Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:50:45.826741Z","title":"Small Specialized models We train small specialized models for some of the tasks with sizeable train sets from the original dataset used to construct the task","venue":null,"work_id":"7e3bf3df-067e-4565-9c22-aa0df3851879","year":null},"citing_paper":{"arxiv_id":"2508.02951","last_updated":"2025-08-04T23:19:18Z","snapshot_observed_at":"2026-08-07T09:07:38.415598Z","submitted_at":"2025-08-04T23:19:18Z","title":"MedBLINK: Probing Basic Perception in Multimodal Language Models for Medicine","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T04:50:45.382132Z"},"links":{"citing_paper":"/paper/2508.02951"},"observation_digest":"sha256:fa01dc1d724a4c67e2cd1de76cde222925117c52feadbb7bf8b07bc0fe36067c","observation_id":"382d428a-6816-4345-9815-1370576706e9","resolution":{"observed_at":"2026-08-06T04:50:45.832023Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:50:46.412516Z","title":"Omnimedvqa: A new large- scale comprehensive evaluation benchmark for medical lvlm","venue":null,"work_id":"87ffcca9-c41f-442e-817c-64529ea9993f","year":2024},"citing_paper":{"arxiv_id":"2508.02951","last_updated":"2025-08-04T23:19:18Z","snapshot_observed_at":"2026-08-07T09:07:38.415598Z","submitted_at":"2025-08-04T23:19:18Z","title":"MedBLINK: Probing Basic Perception in Multimodal Language Models for Medicine","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T04:50:45.101847Z"},"links":{"citing_paper":"/paper/2508.02951"},"observation_digest":"sha256:b2d6d3c2c6857915823dca840728f6212339f3852c556cb89c346f0ed74ade06","observation_id":"29967050-21e7-49b3-b916-a48d40f29a5d","resolution":{"observed_at":"2026-08-06T04:50:46.417870Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-06T04:50:45.107165Z","title":"Gpt-4o system card","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.02951","last_updated":"2025-08-04T23:19:18Z","snapshot_observed_at":"2026-08-07T09:07:38.415598Z","submitted_at":"2025-08-04T23:19:18Z","title":"MedBLINK: Probing Basic Perception in Multimodal Language Models for Medicine","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T04:50:45.107165Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2508.02951"},"observation_digest":"sha256:3ca07014225aca2be0a53d26e20c7ff17a5cde21a7534ddfe150d533e843d852","observation_id":"3fd89b40-4785-4f9c-9255-30b339a8010b","resolution":{"observed_at":"2026-08-06T04:50:45.107165Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:50:46.388840Z","title":"The diagnostic impact of contrast-enhanced computed tomography (cect) in evaluating lymph node involvement in colorectal cancer: a comprehen- sive review","venue":null,"work_id":"839d954e-baff-48e8-8b00-c349d3636f05","year":2024},"citing_paper":{"arxiv_id":"2508.02951","last_updated":"2025-08-04T23:19:18Z","snapshot_observed_at":"2026-08-07T09:07:38.415598Z","submitted_at":"2025-08-04T23:19:18Z","title":"MedBLINK: Probing Basic Perception in Multimodal Language Models for Medicine","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T04:50:45.113559Z"},"links":{"citing_paper":"/paper/2508.02951"},"observation_digest":"sha256:1cd351d8216702957798b51a1e694c35ce92d918044a950f8ef11b28893fbe19","observation_id":"f3429a48-d7ad-4bf8-9555-7e26f08a7c10","resolution":{"observed_at":"2026-08-06T04:50:46.401814Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:50:46.359124Z","title":"Chexpert: A large chest radiograph dataset with uncertainty labels and expert comparison","venue":null,"work_id":"dd1a2fac-f359-4009-9d53-a55da79e4704","year":2019},"citing_paper":{"arxiv_id":"2508.02951","last_updated":"2025-08-04T23:19:18Z","snapshot_observed_at":"2026-08-07T09:07:38.415598Z","submitted_at":"2025-08-04T23:19:18Z","title":"MedBLINK: Probing Basic Perception in Multimodal Language Models for Medicine","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T04:50:45.119177Z"},"links":{"citing_paper":"/paper/2508.02951"},"observation_digest":"sha256:39915c44d82169439b8ee418e16aaee6c9796649d082a32e8328a6b91ee5918d","observation_id":"4fa8b32c-08b4-4b95-8ee6-b032d571f42c","resolution":{"observed_at":"2026-08-06T04:50:46.369421Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:50:46.341043Z","title":"A dataset of clinically generated visual questions and answers about radiology images","venue":null,"work_id":"d97d9c4c-7884-4d6a-9f1c-ddb59851b406","year":2018},"citing_paper":{"arxiv_id":"2508.02951","last_updated":"2025-08-04T23:19:18Z","snapshot_observed_at":"2026-08-07T09:07:38.415598Z","submitted_at":"2025-08-04T23:19:18Z","title":"MedBLINK: Probing Basic Perception in Multimodal Language Models for Medicine","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T04:50:45.124916Z"},"links":{"citing_paper":"/paper/2508.02951"},"observation_digest":"sha256:5520c2a19e4e38a821f5b8b948330c51715833fd1f8bdfbe2502f6a7f5d101c9","observation_id":"4702e604-2bdc-4114-abe0-c795ffa19983","resolution":{"observed_at":"2026-08-06T04:50:46.346514Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:50:46.322014Z","title":"Llava-onevision: Easy visual task transfer, 2024","venue":null,"work_id":"b7588736-1298-4b0a-9196-9d04f0910d35","year":2024},"citing_paper":{"arxiv_id":"2508.02951","last_updated":"2025-08-04T23:19:18Z","snapshot_observed_at":"2026-08-07T09:07:38.415598Z","submitted_at":"2025-08-04T23:19:18Z","title":"MedBLINK: Probing Basic Perception in Multimodal Language Models for Medicine","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T04:50:45.130611Z"},"links":{"citing_paper":"/paper/2508.02951"},"observation_digest":"sha256:9caa70cf83e1142040a444f9fc61f44037a996d502cf29e31b61d55444bee836","observation_id":"42ef0246-05b1-41a5-90c1-25d056987509","resolution":{"observed_at":"2026-08-06T04:50:46.328216Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03326","last_updated":"2024-10-26T16:35:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-06T17:59:44Z","title":"LLaVA-OneVision: Easy Visual Task Transfer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.03326","snapshot_observed_at":"2026-08-06T04:50:45.135890Z","title":"Llava-onevision: Easy visual task transfer","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.02951","last_updated":"2025-08-04T23:19:18Z","snapshot_observed_at":"2026-08-07T09:07:38.415598Z","submitted_at":"2025-08-04T23:19:18Z","title":"MedBLINK: Probing Basic Perception in Multimodal Language Models for Medicine","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T04:50:45.135890Z"},"links":{"cited_paper":"/paper/2408.03326","citing_paper":"/paper/2508.02951"},"observation_digest":"sha256:88cd74add5199ee60db3c66c8dc0b11f7c1d1b9b45d4684d1321e247475a1ae4","observation_id":"8008b3fc-6a3b-4fff-87cd-a44e45d15971","resolution":{"observed_at":"2026-08-06T04:50:45.135890Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:50:45.141848Z","title":"Llava-med: Training a large language- and-vision assistant for biomedicine in one day","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.02951","last_updated":"2025-08-04T23:19:18Z","snapshot_observed_at":"2026-08-07T09:07:38.415598Z","submitted_at":"2025-08-04T23:19:18Z","title":"MedBLINK: Probing Basic Perception in Multimodal Language Models for Medicine","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T04:50:45.141848Z"},"links":{"citing_paper":"/paper/2508.02951"},"observation_digest":"sha256:0f81d059d870e2713f34491c568e01d8ebaa01e00f232a0d533a1c691b567fe0","observation_id":"80da6ea6-1f71-466c-9550-417b77da3a1f","resolution":{"observed_at":"2026-08-06T04:50:45.141848Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:50:46.294902Z","title":"Slake: A semantically-labeled knowledge- enhanced dataset for medical visual question answering","venue":null,"work_id":"9825c6d3-04ad-4451-8bac-3d2e12abe957","year":2021},"citing_paper":{"arxiv_id":"2508.02951","last_updated":"2025-08-04T23:19:18Z","snapshot_observed_at":"2026-08-07T09:07:38.415598Z","submitted_at":"2025-08-04T23:19:18Z","title":"MedBLINK: Probing Basic Perception in Multimodal Language Models for Medicine","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T04:50:45.146966Z"},"links":{"citing_paper":"/paper/2508.02951"},"observation_digest":"sha256:0490723fc018fd247514dfc2648a2dddf45a7ebe7486b88ff8d1bd28c5737426","observation_id":"0f1634c8-b201-43e2-94db-5372c0df43d5","resolution":{"observed_at":"2026-08-06T04:50:46.300661Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.03744","last_updated":"2024-05-15T19:22:44Z","snapshot_observed_at":"2026-07-06T16:28:22.350574Z","submitted_at":"2023-10-05T17:59:56Z","title":"Improved Baselines with Visual Instruction Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.03744","snapshot_observed_at":"2026-08-06T04:50:45.152773Z","title":"Improved baselines with visual instruction tuning, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.02951","last_updated":"2025-08-04T23:19:18Z","snapshot_observed_at":"2026-08-07T09:07:38.415598Z","submitted_at":"2025-08-04T23:19:18Z","title":"MedBLINK: Probing Basic Perception in Multimodal Language Models for Medicine","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T04:50:45.152773Z"},"links":{"cited_paper":"/paper/2310.03744","citing_paper":"/paper/2508.02951"},"observation_digest":"sha256:3ee97f1a0d33f1ac0629528aa0fb23dd6515568e8e218278b3d9e194979a55b4","observation_id":"3039d259-df27-4083-9eb5-38244175a009","resolution":{"observed_at":"2026-08-06T04:50:45.152773Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.11217","last_updated":"2024-11-29T02:50:45Z","snapshot_observed_at":"2026-08-06T15:12:29.012379Z","submitted_at":"2024-02-17T08:04:23Z","title":"A Spectrum Evaluation Benchmark for Medical Multi-Modal Large Language Models","version":2},"cited_work":{"arxiv_id":"2402.11217","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.11217","snapshot_observed_at":"2026-08-06T04:50:45.731150Z","title":"A Spectrum Evaluation Benchmark for Medical Multi-Modal Large Language Models","venue":"cs.CL","work_id":"2ffda452-88b0-428b-835f-735d7579f115","year":2024},"citing_paper":{"arxiv_id":"2508.02951","last_updated":"2025-08-04T23:19:18Z","snapshot_observed_at":"2026-08-07T09:07:38.415598Z","submitted_at":"2025-08-04T23:19:18Z","title":"MedBLINK: Probing Basic Perception in Multimodal Language Models for Medicine","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T04:50:45.158675Z"},"links":{"cited_paper":"/paper/2402.11217","citing_paper":"/paper/2508.02951"},"observation_digest":"sha256:7781c176a8092dc17f2eb904b76bc48d2aa7a142eefdee7781e4161b15c06cca","observation_id":"503ad637-3270-4f14-acbd-35c7b1d9855a","resolution":{"observed_at":"2026-08-06T04:50:45.737508Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:50:46.276786Z","title":"The coding of roentgen images for computer analysis as applied to lung cancer","venue":null,"work_id":"4c3de253-3a1d-45dc-9643-0bef409d1915","year":1963},"citing_paper":{"arxiv_id":"2508.02951","last_updated":"2025-08-04T23:19:18Z","snapshot_observed_at":"2026-08-07T09:07:38.415598Z","submitted_at":"2025-08-04T23:19:18Z","title":"MedBLINK: Probing Basic Perception in Multimodal Language Models for Medicine","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T04:50:45.164214Z"},"links":{"citing_paper":"/paper/2508.02951"},"observation_digest":"sha256:44992f8e4b31fbc1e3bb438f1963b7bad3bb5b6fb7d423bb34ee13558386ecf2","observation_id":"be03e375-8617-4b08-8dc6-5727ce900fe7","resolution":{"observed_at":"2026-08-06T04:50:46.282228Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:50:46.258578Z","title":"Lu, Bowen Chen, Drew F","venue":null,"work_id":"0f740f7a-a06b-45a8-9bff-1ccfcc936a48","year":2024},"citing_paper":{"arxiv_id":"2508.02951","last_updated":"2025-08-04T23:19:18Z","snapshot_observed_at":"2026-08-07T09:07:38.415598Z","submitted_at":"2025-08-04T23:19:18Z","title":"MedBLINK: Probing Basic Perception in Multimodal Language Models for Medicine","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T04:50:45.170000Z"},"links":{"citing_paper":"/paper/2508.02951"},"observation_digest":"sha256:eb0123724f0793b9b1400bfad41c7eed20119e5754900802d58f54ddc57af89b","observation_id":"b9d79b9d-06b9-4d12-a317-a8d6f17014b8","resolution":{"observed_at":"2026-08-06T04:50:46.265144Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:50:46.241277Z","title":"Lung-rads: pushing the limits","venue":null,"work_id":"307b262f-b4c2-4ca2-af67-f76f41c0bfdb","year":1975},"citing_paper":{"arxiv_id":"2508.02951","last_updated":"2025-08-04T23:19:18Z","snapshot_observed_at":"2026-08-07T09:07:38.415598Z","submitted_at":"2025-08-04T23:19:18Z","title":"MedBLINK: Probing Basic Perception in Multimodal Language Models for Medicine","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T04:50:45.175275Z"},"links":{"citing_paper":"/paper/2508.02951"},"observation_digest":"sha256:dad219a050530b8263f2e28338a12f63451f14d2b7fe54da9230b925240d4329","observation_id":"3fa64eb0-1fd8-4a7c-a042-bc6278f9868b","resolution":{"observed_at":"2026-08-06T04:50:46.246274Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.00164","last_updated":"2023-11-30T19:55:51Z","snapshot_observed_at":"2026-07-06T16:55:20.926830Z","submitted_at":"2023-11-30T19:55:51Z","title":"Towards Accurate Differential Diagnosis with Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.00164","snapshot_observed_at":"2026-08-06T04:50:45.181592Z","title":"Towards accurate differential diagnosis with large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.02951","last_updated":"2025-08-04T23:19:18Z","snapshot_observed_at":"2026-08-07T09:07:38.415598Z","submitted_at":"2025-08-04T23:19:18Z","title":"MedBLINK: Probing Basic Perception in Multimodal Language Models for Medicine","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T04:50:45.181592Z"},"links":{"cited_paper":"/paper/2312.00164","citing_paper":"/paper/2508.02951"},"observation_digest":"sha256:863195d74192fa41b3d29db72678cc9e3964ec158fecfcf2a61ab2e307a8dc50","observation_id":"dca4a1ca-1a4c-4c61-89a8-22c858a68100","resolution":{"observed_at":"2026-08-06T04:50:45.181592Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:50:46.224030Z","title":"Med-flamingo: a multimodal medical few-shot learner","venue":null,"work_id":"c47eb94c-4759-40ba-ba90-2e82a8b31f1c","year":2023},"citing_paper":{"arxiv_id":"2508.02951","last_updated":"2025-08-04T23:19:18Z","snapshot_observed_at":"2026-08-07T09:07:38.415598Z","submitted_at":"2025-08-04T23:19:18Z","title":"MedBLINK: Probing Basic Perception in Multimodal Language Models for Medicine","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T04:50:45.188471Z"},"links":{"citing_paper":"/paper/2508.02951"},"observation_digest":"sha256:ebe75f921784bb21cc8ffb04c78dab615ae36e287979d0c71c0d14f7bc0cdf6e","observation_id":"4614b4aa-68e4-4136-8e44-eb087144fc66","resolution":{"observed_at":"2026-08-06T04:50:46.229278Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:50:46.207792Z","title":"Interactions of perceptual and conceptual pro- cessing: Expertise in medical image diagnosis","venue":null,"work_id":"def99191-a69c-40c6-90f3-baf87af7d95d","year":2008},"citing_paper":{"arxiv_id":"2508.02951","last_updated":"2025-08-04T23:19:18Z","snapshot_observed_at":"2026-08-07T09:07:38.415598Z","submitted_at":"2025-08-04T23:19:18Z","title":"MedBLINK: Probing Basic Perception in Multimodal Language Models for Medicine","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T04:50:45.194078Z"},"links":{"citing_paper":"/paper/2508.02951"},"observation_digest":"sha256:06a410817880e4fb75be14af2348d1a99cc522f17d30fe3c92da87f9685eab98","observation_id":"7a1be3ce-2ba3-40d0-9881-1351627d55e9","resolution":{"observed_at":"2026-08-06T04:50:46.212954Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.08704","last_updated":"2025-04-09T17:42:01Z","snapshot_observed_at":"2026-07-06T19:01:32.237848Z","submitted_at":"2024-08-16T12:32:44Z","title":"Beyond the Hype: A dispassionate look at vision-language models in medical scenario","version":2},"cited_work":{"arxiv_id":"2408.08704","doi":null,"metadata_source":"pith","pith_arxiv_id":"2408.08704","snapshot_observed_at":"2026-08-06T04:50:45.683550Z","title":"Beyond the Hype: A dispassionate look at vision-language models in medical scenario","venue":"cs.CV","work_id":"1e4103b7-cabb-44c0-84d6-4799f990e7d0","year":2024},"citing_paper":{"arxiv_id":"2508.02951","last_updated":"2025-08-04T23:19:18Z","snapshot_observed_at":"2026-08-07T09:07:38.415598Z","submitted_at":"2025-08-04T23:19:18Z","title":"MedBLINK: Probing Basic Perception in Multimodal Language Models for Medicine","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T04:50:45.199029Z"},"links":{"cited_paper":"/paper/2408.08704","citing_paper":"/paper/2508.02951"},"observation_digest":"sha256:9ec7995657723121683800b29e7d36c1ec28fae7cf8d574bd24ea9b7ee68a3b0","observation_id":"0910e13e-2cab-4d99-92ef-3dbdd9f931a7","resolution":{"observed_at":"2026-08-06T04:50:45.691969Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:50:46.190405Z","title":"Video-based ai for beat-to-beat assessment of cardiac function","venue":null,"work_id":"9e12af26-6882-464b-be80-4bf4c1330e56","year":2020},"citing_paper":{"arxiv_id":"2508.02951","last_updated":"2025-08-04T23:19:18Z","snapshot_observed_at":"2026-08-07T09:07:38.415598Z","submitted_at":"2025-08-04T23:19:18Z","title":"MedBLINK: Probing Basic Perception in Multimodal Language Models for Medicine","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T04:50:45.205271Z"},"links":{"citing_paper":"/paper/2508.02951"},"observation_digest":"sha256:18b096067e5ce0177d7fb7a9fa20f234dbae2555f3cc1ec9400a078fa8671e8b","observation_id":"3dbd8851-1a05-4103-8386-467712ece06c","resolution":{"observed_at":"2026-08-06T04:50:46.196722Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:50:46.170979Z","title":"Kvasir: A multi-class image dataset for computer aided gastrointestinal disease detection","venue":null,"work_id":"b61254ed-a84a-4d35-bcff-c070d22eb499","year":2017},"citing_paper":{"arxiv_id":"2508.02951","last_updated":"2025-08-04T23:19:18Z","snapshot_observed_at":"2026-08-07T09:07:38.415598Z","submitted_at":"2025-08-04T23:19:18Z","title":"MedBLINK: Probing Basic Perception in Multimodal Language Models for Medicine","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T04:50:45.210922Z"},"links":{"citing_paper":"/paper/2508.02951"},"observation_digest":"sha256:1a0ed9f6e4273e9c56484cee539e2e245a7728f92efae63072e2557e5844c577","observation_id":"bb599bb3-104d-4f89-b8eb-12d27c251d4f","resolution":{"observed_at":"2026-08-06T04:50:46.177764Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:50:45.215891Z","title":"Learning transferable visual models from natural language supervision, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.02951","last_updated":"2025-08-04T23:19:18Z","snapshot_observed_at":"2026-08-07T09:07:38.415598Z","submitted_at":"2025-08-04T23:19:18Z","title":"MedBLINK: Probing Basic Perception in Multimodal Language Models for Medicine","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T04:50:45.215891Z"},"links":{"citing_paper":"/paper/2508.02951"},"observation_digest":"sha256:78d93672cec2ffad39be2ce00bea62e1d5a8608825ed631f6c9d79a684a0e034","observation_id":"4c63d650-f3ba-46a8-9471-4d7e92744df8","resolution":{"observed_at":"2026-08-06T04:50:45.215891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:50:45.220710Z","title":"Mul- timedeval: A benchmark and a toolkit for evaluating medical vision-language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.02951","last_updated":"2025-08-04T23:19:18Z","snapshot_observed_at":"2026-08-07T09:07:38.415598Z","submitted_at":"2025-08-04T23:19:18Z","title":"MedBLINK: Probing Basic Perception in Multimodal Language Models for Medicine","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T04:50:45.220710Z"},"links":{"citing_paper":"/paper/2508.02951"},"observation_digest":"sha256:48162830e8769cc8e116a4196e65c2abf8a22bb46db314d86ee28532c7e618bd","observation_id":"95b409ea-16bb-41c5-9bbe-3c8adf40784d","resolution":{"observed_at":"2026-08-06T04:50:45.220710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:50:46.134466Z","title":"Hematoxylin and eosin-stained whole slide image dataset annotated for skin tissue segmentation","venue":null,"work_id":"69528176-fc21-4b25-89df-8cfaeaf29938","year":2025},"citing_paper":{"arxiv_id":"2508.02951","last_updated":"2025-08-04T23:19:18Z","snapshot_observed_at":"2026-08-07T09:07:38.415598Z","submitted_at":"2025-08-04T23:19:18Z","title":"MedBLINK: Probing Basic Perception in Multimodal Language Models for Medicine","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T04:50:45.225802Z"},"links":{"citing_paper":"/paper/2508.02951"},"observation_digest":"sha256:0158a93663b4a89aa42ad758b559698c2f2149fa1a739f00bc71dcdf2edadcdf","observation_id":"dbf45989-4f88-43f9-bbfb-004d4022d6f9","resolution":{"observed_at":"2026-08-06T04:50:46.142357Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.15477","last_updated":"2025-05-20T23:20:36Z","snapshot_observed_at":"2026-07-06T19:20:46.575837Z","submitted_at":"2024-09-23T18:59:37Z","title":"MediConfusion: Can you trust your AI radiologist? Probing the reliability of multimodal medical foundation models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.15477","snapshot_observed_at":"2026-08-06T04:50:45.231663Z","title":"Mediconfusion: Can you trust your ai radiologist? probing the reliability 10 of multimodal medical foundation models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.02951","last_updated":"2025-08-04T23:19:18Z","snapshot_observed_at":"2026-08-07T09:07:38.415598Z","submitted_at":"2025-08-04T23:19:18Z","title":"MedBLINK: Probing Basic Perception in Multimodal Language Models for Medicine","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T04:50:45.231663Z"},"links":{"cited_paper":"/paper/2409.15477","citing_paper":"/paper/2508.02951"},"observation_digest":"sha256:059be1b4e56b03b188a0b42801394810d72557595ff3c90eda20eb6cad35fe67","observation_id":"cfd50d5a-86c3-4101-adee-4ff98f625024","resolution":{"observed_at":"2026-08-06T04:50:45.231663Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:50:46.114892Z","title":"Quilt-llava: Visual instruction tuning by extracting localized narratives from open-source histopathology videos","venue":null,"work_id":"c17fd453-a170-43e7-a05b-a50f3a538612","year":2024},"citing_paper":{"arxiv_id":"2508.02951","last_updated":"2025-08-04T23:19:18Z","snapshot_observed_at":"2026-08-07T09:07:38.415598Z","submitted_at":"2025-08-04T23:19:18Z","title":"MedBLINK: Probing Basic Perception in Multimodal Language Models for Medicine","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T04:50:45.237379Z"},"links":{"citing_paper":"/paper/2508.02951"},"observation_digest":"sha256:760c6d24207e101b3c8c0d5bca8e14abaaa17c3a52135683688548e23219bb29","observation_id":"46cd4533-fb17-4e19-bb77-767cfc68408f","resolution":{"observed_at":"2026-08-06T04:50:46.121877Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:50:46.097130Z","title":"Diagnostic ultrasound imaging: inside out","venue":null,"work_id":"2ceb4a8c-ea55-4952-9156-063779e47277","year":2013},"citing_paper":{"arxiv_id":"2508.02951","last_updated":"2025-08-04T23:19:18Z","snapshot_observed_at":"2026-08-07T09:07:38.415598Z","submitted_at":"2025-08-04T23:19:18Z","title":"MedBLINK: Probing Basic Perception in Multimodal Language Models for Medicine","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T04:50:45.242452Z"},"links":{"citing_paper":"/paper/2508.02951"},"observation_digest":"sha256:d86bfe6f87151912ad2a1a1c9f9820b999a58c468f96aa8e567a5269b8c6728a","observation_id":"72043f7c-db68-416f-b52f-7337a3562546","resolution":{"observed_at":"2026-08-06T04:50:46.102569Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05530","last_updated":"2024-12-16T17:39:39Z","snapshot_observed_at":"2026-07-06T17:41:42.995949Z","submitted_at":"2024-03-08T18:54:20Z","title":"Gemini 1.5: Unlocking multimodal understanding across millions of tokens of context","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05530","snapshot_observed_at":"2026-08-06T04:50:45.249202Z","title":"Gemini 1.5: Unlocking mul- timodal understanding across millions of tokens of context","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.02951","last_updated":"2025-08-04T23:19:18Z","snapshot_observed_at":"2026-08-07T09:07:38.415598Z","submitted_at":"2025-08-04T23:19:18Z","title":"MedBLINK: Probing Basic Perception in Multimodal Language Models for Medicine","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T04:50:45.249202Z"},"links":{"cited_paper":"/paper/2403.05530","citing_paper":"/paper/2508.02951"},"observation_digest":"sha256:af505ef0ed00afaf807cde7a37c63410013d2fedb582abf7078f56ba28ee23d3","observation_id":"db8c5afb-1320-454f-9fe9-b77cbb2332d1","resolution":{"observed_at":"2026-08-06T04:50:45.249202Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:50:46.078406Z","title":"What clinicians want: contextualizing explainable machine learning for clinical end use","venue":null,"work_id":"ea41f875-7004-409f-b47e-8f1f5b2b2014","year":null},"citing_paper":{"arxiv_id":"2508.02951","last_updated":"2025-08-04T23:19:18Z","snapshot_observed_at":"2026-08-07T09:07:38.415598Z","submitted_at":"2025-08-04T23:19:18Z","title":"MedBLINK: Probing Basic Perception in Multimodal Language Models for Medicine","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T04:50:45.255259Z"},"links":{"citing_paper":"/paper/2508.02951"},"observation_digest":"sha256:6f7f05fb918a494a3f67a6bc22d63c8fa8d2f24b224f555054b5870c06e248a7","observation_id":"66423372-b8a5-4212-9344-495965152d86","resolution":{"observed_at":"2026-08-06T04:50:46.084094Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-06T04:50:45.261256Z","title":"Llama 2: Open foundation and fine-tuned chat models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.02951","last_updated":"2025-08-04T23:19:18Z","snapshot_observed_at":"2026-08-07T09:07:38.415598Z","submitted_at":"2025-08-04T23:19:18Z","title":"MedBLINK: Probing Basic Perception in Multimodal Language Models for Medicine","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T04:50:45.261256Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2508.02951"},"observation_digest":"sha256:b4a70911e4dd6b0e2a381c13f96ae652b907c7cc682a1cdae2eefc239971b9c0","observation_id":"92afd454-277d-4b91-8d57-a9cbcf723d8f","resolution":{"observed_at":"2026-08-06T04:50:45.261256Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:50:46.062111Z","title":"Corrado, Yossi Matias, Karan Singhal, Pete Florence, Alan Karthikesalingam, and Vivek Natarajan","venue":null,"work_id":"2c77c79f-fd7c-47cd-9451-62086ff5c2d3","year":2023},"citing_paper":{"arxiv_id":"2508.02951","last_updated":"2025-08-04T23:19:18Z","snapshot_observed_at":"2026-08-07T09:07:38.415598Z","submitted_at":"2025-08-04T23:19:18Z","title":"MedBLINK: Probing Basic Perception in Multimodal Language Models for Medicine","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T04:50:45.268906Z"},"links":{"citing_paper":"/paper/2508.02951"},"observation_digest":"sha256:2d97d6c2dbcb01d6ea15744752a03e1f0495d88c8b36ed8d80f338c7780477e0","observation_id":"f998d0a9-5378-44a1-8740-88c68dbde60a","resolution":{"observed_at":"2026-08-06T04:50:46.067523Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.12671","last_updated":"2025-03-05T08:23:04Z","snapshot_observed_at":"2026-08-07T18:09:45.002146Z","submitted_at":"2025-02-18T09:21:12Z","title":"Baichuan-M1: Pushing the Medical Capability of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.12671","snapshot_observed_at":"2026-08-06T04:50:45.273861Z","title":"Baichuan-m1: Pushing the medical capability of large language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.02951","last_updated":"2025-08-04T23:19:18Z","snapshot_observed_at":"2026-08-07T09:07:38.415598Z","submitted_at":"2025-08-04T23:19:18Z","title":"MedBLINK: Probing Basic Perception in Multimodal Language Models for Medicine","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-06T04:50:45.273861Z"},"links":{"cited_paper":"/paper/2502.12671","citing_paper":"/paper/2508.02951"},"observation_digest":"sha256:167b21c6717fdb9fe1d10d8742abf2aebd9eec40814062895f6a0979d7eaf275","observation_id":"00bfc95d-4598-4802-a203-d9aea1a245c1","resolution":{"observed_at":"2026-08-06T04:50:45.273861Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:50:45.279006Z","title":"Chestx- ray8: Hospital-scale chest x-ray database and benchmarks on weakly-supervised classification and localization of common thorax diseases","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.02951","last_updated":"2025-08-04T23:19:18Z","snapshot_observed_at":"2026-08-07T09:07:38.415598Z","submitted_at":"2025-08-04T23:19:18Z","title":"MedBLINK: Probing Basic Perception in Multimodal Language Models for Medicine","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-06T04:50:45.279006Z"},"links":{"citing_paper":"/paper/2508.02951"},"observation_digest":"sha256:bbb1c37b2f98ba10537372f58505fb05ebd119f71e1189b19b6104916456de94","observation_id":"0a69827b-6308-4eb3-9760-2852c2d11ef6","resolution":{"observed_at":"2026-08-06T04:50:45.279006Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:50:46.034344Z","title":"Detection of radiographic abnor- malities in mammograms by means of optical scanning and computer analysis","venue":null,"work_id":"ee638058-66c8-4dc8-967e-6506fa661c43","year":1967},"citing_paper":{"arxiv_id":"2508.02951","last_updated":"2025-08-04T23:19:18Z","snapshot_observed_at":"2026-08-07T09:07:38.415598Z","submitted_at":"2025-08-04T23:19:18Z","title":"MedBLINK: Probing Basic Perception in Multimodal Language Models for Medicine","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-06T04:50:45.283634Z"},"links":{"citing_paper":"/paper/2508.02951"},"observation_digest":"sha256:ce75cb3f5afb1dddca6c697a547aa8865ac8438befefe503eea662585df8e7bb","observation_id":"fd19d5cf-bcf1-4ea1-a4d5-e45f44bcb0ff","resolution":{"observed_at":"2026-08-06T04:50:46.040026Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.09909","last_updated":"2023-12-04T14:13:35Z","snapshot_observed_at":"2026-08-06T15:15:16.288168Z","submitted_at":"2023-10-15T18:32:27Z","title":"Can GPT-4V(ision) Serve Medical Applications? Case Studies on GPT-4V for Multimodal Medical Diagnosis","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.09909","snapshot_observed_at":"2026-08-06T04:50:45.288838Z","title":"Can gpt-4v (ision) serve medical ap- plications? case studies on gpt-4v for multimodal medical diagnosis","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.02951","last_updated":"2025-08-04T23:19:18Z","snapshot_observed_at":"2026-08-07T09:07:38.415598Z","submitted_at":"2025-08-04T23:19:18Z","title":"MedBLINK: Probing Basic Perception in Multimodal Language Models for Medicine","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-06T04:50:45.288838Z"},"links":{"cited_paper":"/paper/2310.09909","citing_paper":"/paper/2508.02951"},"observation_digest":"sha256:f7b2583647b6e101c6b328f2164057017b9d07d4caa5efeebaaae9fe23c392c2","observation_id":"12078155-60aa-4a78-b8e6-edd367152b85","resolution":{"observed_at":"2026-08-06T04:50:45.288838Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.02463","last_updated":"2023-11-16T12:38:46Z","snapshot_observed_at":"2026-08-08T04:57:05.131540Z","submitted_at":"2023-08-04T17:00:38Z","title":"Towards Generalist Foundation Model for Radiology by Leveraging Web-scale 2D&3D Medical Data","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.02463","snapshot_observed_at":"2026-08-06T04:50:45.295335Z","title":"Towards generalist foundation model for radiology by leveraging web-scale 2d&3d medical data","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.02951","last_updated":"2025-08-04T23:19:18Z","snapshot_observed_at":"2026-08-07T09:07:38.415598Z","submitted_at":"2025-08-04T23:19:18Z","title":"MedBLINK: Probing Basic Perception in Multimodal Language Models for Medicine","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-06T04:50:45.295335Z"},"links":{"cited_paper":"/paper/2308.02463","citing_paper":"/paper/2508.02951"},"observation_digest":"sha256:08caf1e3abccbd54baeeaf320d5c83a148a33b75fe0479ba238e148a9eb8c8db","observation_id":"360772cb-1472-4e1e-934d-18f1316792ab","resolution":{"observed_at":"2026-08-06T04:50:45.295335Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:50:46.538464Z","title":"MediConfusion [ 49] probes failure modes on visually dissimilar image pairs","venue":null,"work_id":"c2f5259e-5d0a-4ba6-9237-49a64232ef34","year":null},"citing_paper":{"arxiv_id":"2508.02951","last_updated":"2025-08-04T23:19:18Z","snapshot_observed_at":"2026-08-07T09:07:38.415598Z","submitted_at":"2025-08-04T23:19:18Z","title":"MedBLINK: Probing Basic Perception in Multimodal Language Models for Medicine","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-06T04:50:45.061737Z"},"links":{"citing_paper":"/paper/2508.02951"},"observation_digest":"sha256:3558969892347fd6fbae9bb571067c27eeb1e44e5f6c0c61ab39ac037935acc8","observation_id":"a26b6eee-0fca-48a4-a7db-b5e9c62f8bbf","resolution":{"observed_at":"2026-08-06T04:50:46.543033Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06007","last_updated":"2024-11-03T16:54:14Z","snapshot_observed_at":"2026-08-05T05:05:30.872910Z","submitted_at":"2024-06-10T04:07:09Z","title":"CARES: A Comprehensive Benchmark of Trustworthiness in Medical Vision Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.06007","snapshot_observed_at":"2026-08-06T04:50:45.300767Z","title":"Cares: A comprehensive benchmark of trustwor- thiness in medical vision language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.02951","last_updated":"2025-08-04T23:19:18Z","snapshot_observed_at":"2026-08-07T09:07:38.415598Z","submitted_at":"2025-08-04T23:19:18Z","title":"MedBLINK: Probing Basic Perception in Multimodal Language Models for Medicine","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-06T04:50:45.300767Z"},"links":{"cited_paper":"/paper/2406.06007","citing_paper":"/paper/2508.02951"},"observation_digest":"sha256:3bece02c4442627ff91321529209cebb7e3f3522676c2341b0458e019f6b9eb2","observation_id":"ec15513e-c7ba-42c5-a280-4db773bee185","resolution":{"observed_at":"2026-08-06T04:50:45.300767Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.02900","last_updated":"2025-07-10T08:33:52Z","snapshot_observed_at":"2026-07-06T18:57:14.251413Z","submitted_at":"2024-08-06T02:09:35Z","title":"MedTrinity-25M: A Large-scale Multimodal Dataset with Multigranular Annotations for Medicine","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.02900","snapshot_observed_at":"2026-08-06T04:50:45.306820Z","title":"Medtrinity-25m: A large-scale multimodal dataset with multigranular annotations for medicine","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.02951","last_updated":"2025-08-04T23:19:18Z","snapshot_observed_at":"2026-08-07T09:07:38.415598Z","submitted_at":"2025-08-04T23:19:18Z","title":"MedBLINK: Probing Basic Perception in Multimodal Language Models for Medicine","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-06T04:50:45.306820Z"},"links":{"cited_paper":"/paper/2408.02900","citing_paper":"/paper/2508.02951"},"observation_digest":"sha256:17a653624fdeddbfb9f7165b5e10493e66caed60350186516e41e8e8a26828cf","observation_id":"42125ddc-4570-45f7-b84c-5dba5e666f68","resolution":{"observed_at":"2026-08-06T04:50:45.306820Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:50:46.015124Z","title":"Depth anything: Unleashing the power of large-scale unlabeled data","venue":null,"work_id":"c0be3c64-aa63-4c8a-b8f9-0e3bc2f6e8ec","year":2024},"citing_paper":{"arxiv_id":"2508.02951","last_updated":"2025-08-04T23:19:18Z","snapshot_observed_at":"2026-08-07T09:07:38.415598Z","submitted_at":"2025-08-04T23:19:18Z","title":"MedBLINK: Probing Basic Perception in Multimodal Language Models for Medicine","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-06T04:50:45.312871Z"},"links":{"citing_paper":"/paper/2508.02951"},"observation_digest":"sha256:d97b6898ddbd61772f6ae8542cc0b3d438e4c604e74d0aba3d45eedf817063c5","observation_id":"ea407e41-f8ca-4185-a42f-eee8bff03f30","resolution":{"observed_at":"2026-08-06T04:50:46.022706Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.03162","last_updated":"2024-05-06T04:44:22Z","snapshot_observed_at":"2026-07-06T18:10:12.621492Z","submitted_at":"2024-05-06T04:44:22Z","title":"Advancing Multimodal Medical Capabilities of Gemini","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.03162","snapshot_observed_at":"2026-08-06T04:50:45.317935Z","title":"Advancing multimodal medical capabilities of gemini","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.02951","last_updated":"2025-08-04T23:19:18Z","snapshot_observed_at":"2026-08-07T09:07:38.415598Z","submitted_at":"2025-08-04T23:19:18Z","title":"MedBLINK: Probing Basic Perception in Multimodal Language Models for Medicine","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-06T04:50:45.317935Z"},"links":{"cited_paper":"/paper/2405.03162","citing_paper":"/paper/2508.02951"},"observation_digest":"sha256:51245510b5bc4fb3e8bc08d5e0b1cafcac7a82a2ce6a819a94a3075941a41783","observation_id":"d4185d3c-b5de-49c8-9e27-4923254fee06","resolution":{"observed_at":"2026-08-06T04:50:45.317935Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:50:45.996276Z","title":"Gmai-mmbench: A comprehensive multimodal evaluation benchmark towards general medical ai","venue":null,"work_id":"4e836cf6-68cf-4090-a36a-0aa99bb1c1bf","year":2024},"citing_paper":{"arxiv_id":"2508.02951","last_updated":"2025-08-04T23:19:18Z","snapshot_observed_at":"2026-08-07T09:07:38.415598Z","submitted_at":"2025-08-04T23:19:18Z","title":"MedBLINK: Probing Basic Perception in Multimodal Language Models for Medicine","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-06T04:50:45.323714Z"},"links":{"citing_paper":"/paper/2508.02951"},"observation_digest":"sha256:5f1c389816a1256cbb7417d079a1fc65841a0be1d085f675aa6b38fc53f896d2","observation_id":"82cbc2ec-e34a-479a-ac03-8f78de3111f6","resolution":{"observed_at":"2026-08-06T04:50:46.002495Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.10415","last_updated":"2024-09-08T01:04:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-17T17:50:16Z","title":"PMC-VQA: Visual Instruction Tuning for Medical Visual Question Answering","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.10415","snapshot_observed_at":"2026-08-06T04:50:45.328920Z","title":"Pmc-vqa: Visual in- struction tuning for medical visual question answering","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.02951","last_updated":"2025-08-04T23:19:18Z","snapshot_observed_at":"2026-08-07T09:07:38.415598Z","submitted_at":"2025-08-04T23:19:18Z","title":"MedBLINK: Probing Basic Perception in Multimodal Language Models for Medicine","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-06T04:50:45.328920Z"},"links":{"cited_paper":"/paper/2305.10415","citing_paper":"/paper/2508.02951"},"observation_digest":"sha256:984e9917abd1eb19a200651ddc2d6b0d1c5bfa7682c34913504ba6ecde9e4a5c","observation_id":"d7768017-fca9-49a6-b8dd-6a6de030ffa8","resolution":{"observed_at":"2026-08-06T04:50:45.328920Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:50:45.978715Z","title":null,"venue":null,"work_id":"be6d3f99-b2c6-4cb1-b17a-6fd508d3bbfc","year":null},"citing_paper":{"arxiv_id":"2508.02951","last_updated":"2025-08-04T23:19:18Z","snapshot_observed_at":"2026-08-07T09:07:38.415598Z","submitted_at":"2025-08-04T23:19:18Z","title":"MedBLINK: Probing Basic Perception in Multimodal Language Models for Medicine","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-06T04:50:45.334499Z"},"links":{"citing_paper":"/paper/2508.02951"},"observation_digest":"sha256:6ac374b29fc6f70021c4623fd73d700cf02f8c693375356689c90983e374979e","observation_id":"8cfcdeb0-8fa5-4ce3-9f83-fe4581342e22","resolution":{"observed_at":"2026-08-06T04:50:45.983909Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:50:45.962860Z","title":null,"venue":null,"work_id":"de347a75-473e-4c0b-a20b-e94c65d6c996","year":null},"citing_paper":{"arxiv_id":"2508.02951","last_updated":"2025-08-04T23:19:18Z","snapshot_observed_at":"2026-08-07T09:07:38.415598Z","submitted_at":"2025-08-04T23:19:18Z","title":"MedBLINK: Probing Basic Perception in Multimodal Language Models for Medicine","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-06T04:50:45.339961Z"},"links":{"citing_paper":"/paper/2508.02951"},"observation_digest":"sha256:64e7f983f8a837e983f663c9dfaab14496e10db6f7c81b929593d89a35973af8","observation_id":"22370e71-3979-4e4d-8cf4-dbd23db8f2b5","resolution":{"observed_at":"2026-08-06T04:50:45.968069Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:50:45.946284Z","title":null,"venue":null,"work_id":"88aae89b-48e9-4400-b6d0-9bd299c24076","year":null},"citing_paper":{"arxiv_id":"2508.02951","last_updated":"2025-08-04T23:19:18Z","snapshot_observed_at":"2026-08-07T09:07:38.415598Z","submitted_at":"2025-08-04T23:19:18Z","title":"MedBLINK: Probing Basic Perception in Multimodal Language Models for Medicine","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-06T04:50:45.346086Z"},"links":{"citing_paper":"/paper/2508.02951"},"observation_digest":"sha256:407cddd7c8d409091d41c4a1f187a65c1af5999b2d2c5e1471c317334d62a61c","observation_id":"34fc5d89-f78b-4671-aa47-456e4ddfc969","resolution":{"observed_at":"2026-08-06T04:50:45.951271Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:50:45.930437Z","title":null,"venue":null,"work_id":"6cfcebd6-1b09-4f19-b594-92e09756f5a8","year":null},"citing_paper":{"arxiv_id":"2508.02951","last_updated":"2025-08-04T23:19:18Z","snapshot_observed_at":"2026-08-07T09:07:38.415598Z","submitted_at":"2025-08-04T23:19:18Z","title":"MedBLINK: Probing Basic Perception in Multimodal Language Models for Medicine","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-06T04:50:45.351161Z"},"links":{"citing_paper":"/paper/2508.02951"},"observation_digest":"sha256:49245e28bca13da6a4c6739b464bd7454b0c0c92db0264be430a61ae51281799","observation_id":"04848663-0141-4fc7-b3ed-9f935c04c9e9","resolution":{"observed_at":"2026-08-06T04:50:45.935521Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:50:45.912825Z","title":"Here we use two versions as well, the 0.5B parameterized model, and 7B parameter- ized models","venue":null,"work_id":"eb39fd17-9e7f-4471-a437-2e6940f16359","year":null},"citing_paper":{"arxiv_id":"2508.02951","last_updated":"2025-08-04T23:19:18Z","snapshot_observed_at":"2026-08-07T09:07:38.415598Z","submitted_at":"2025-08-04T23:19:18Z","title":"MedBLINK: Probing Basic Perception in Multimodal Language Models for Medicine","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-06T04:50:45.356130Z"},"links":{"citing_paper":"/paper/2508.02951"},"observation_digest":"sha256:6ef7e6a984ae2772178a136c685eeaf9111e25af58c11ad4ddf1be73c16b571a","observation_id":"710a4900-c0a2-41d9-bbfd-5c4fa6eb15e1","resolution":{"observed_at":"2026-08-06T04:50:45.918541Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:50:45.895111Z","title":"Specifically, we prompt it with three questions and answers from PMC-VQA benchmark","venue":null,"work_id":"abba655a-8709-4953-819b-91c460004aa2","year":null},"citing_paper":{"arxiv_id":"2508.02951","last_updated":"2025-08-04T23:19:18Z","snapshot_observed_at":"2026-08-07T09:07:38.415598Z","submitted_at":"2025-08-04T23:19:18Z","title":"MedBLINK: Probing Basic Perception in Multimodal Language Models for Medicine","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-06T04:50:45.361108Z"},"links":{"citing_paper":"/paper/2508.02951"},"observation_digest":"sha256:87de81806d3886f52709b5a8befa7ab43bab16193b633cbde3be1ba1e582ca5e","observation_id":"b2e27d68-1e17-4fcc-bf01-fa012d90f9a5","resolution":{"observed_at":"2026-08-06T04:50:45.900362Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:50:45.877901Z","title":null,"venue":null,"work_id":"1d8f4471-b0f3-45b3-a2da-c8eed910a936","year":null},"citing_paper":{"arxiv_id":"2508.02951","last_updated":"2025-08-04T23:19:18Z","snapshot_observed_at":"2026-08-07T09:07:38.415598Z","submitted_at":"2025-08-04T23:19:18Z","title":"MedBLINK: Probing Basic Perception in Multimodal Language Models for Medicine","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-06T04:50:45.366141Z"},"links":{"citing_paper":"/paper/2508.02951"},"observation_digest":"sha256:5a60911645f173a43478b9daba896527ab2919f9bb545f15d3cf530aa8721b38","observation_id":"dbc38cef-16cb-40c4-93ca-4cd9ceffcb02","resolution":{"observed_at":"2026-08-06T04:50:45.882897Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2508.02951","last_updated":"2025-08-04T23:19:18Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-07T09:07:38.415598Z","submitted_at":"2025-08-04T23:19:18Z","title":"MedBLINK: Probing Basic Perception in Multimodal Language Models for Medicine"},"reference_resolution":{"displayed":60,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":4,"unresolved":23,"verified_exact":3,"verified_fuzzy":29},"total_outbound_references":60},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 60 of 60 outbound references and 1 inbound Pith citation observation for arXiv:2508.02951."}