{"as_of":"2026-08-17T22:23:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:070c96d6842db4ab6f367efa8cc579afa6824e5b49da4090862ef884a6e1949e","coverage":[{"denominator":37,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":37,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T20:29:36.511758Z","state":"measured"},{"denominator":37,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":37,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.12928/citation-record","integrity":"/paper/2608.12928/integrity","json":"/paper/2608.12928/citation-record.json","paper":"/paper/2608.12928"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2026.eacl-srw.44","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:29:36.669014Z","title":"Annotation-Efficient Vision-Language Model Adaptation to the P olish Language Using the LL a VA Framework","venue":null,"work_id":"b6e0d82e-b5fe-449c-a0e6-03fd1cdd230a","year":2026},"citing_paper":{"arxiv_id":"2608.12928","last_updated":"2026-08-13T08:07:22Z","snapshot_observed_at":"2026-08-17T12:52:28.235059Z","submitted_at":"2026-08-13T08:07:22Z","title":"Polish Medical Visual Question Answering: Vision-Language Models Underutilize Visual Evidence","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-15T20:29:36.306797Z"},"links":{"citing_paper":"/paper/2608.12928"},"observation_digest":"sha256:3197374d9f993fc1bb88535b920d7775b013c1a51835af4323d235145b10a982","observation_id":"5bb8eb6c-56a3-45a5-8aac-95779aa588d2","resolution":{"observed_at":"2026-08-15T20:29:36.675027Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:29:36.312340Z","title":"Data Contamination Quiz: A Tool to Detect and Estimate Contamination in Large Language Models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12928","last_updated":"2026-08-13T08:07:22Z","snapshot_observed_at":"2026-08-17T12:52:28.235059Z","submitted_at":"2026-08-13T08:07:22Z","title":"Polish Medical Visual Question Answering: Vision-Language Models Underutilize Visual Evidence","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-15T20:29:36.312340Z"},"links":{"citing_paper":"/paper/2608.12928"},"observation_digest":"sha256:dfd4b448c3bf79b6dcfa683e52ca7a41e2f59f165cb26474c8103154c2b1f864","observation_id":"6e8e333a-6354-4116-a902-872d918ef6b7","resolution":{"observed_at":"2026-08-15T20:29:36.312340Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:29:36.318911Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.12928","last_updated":"2026-08-13T08:07:22Z","snapshot_observed_at":"2026-08-17T12:52:28.235059Z","submitted_at":"2026-08-13T08:07:22Z","title":"Polish Medical Visual Question Answering: Vision-Language Models Underutilize Visual Evidence","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-15T20:29:36.318911Z"},"links":{"citing_paper":"/paper/2608.12928"},"observation_digest":"sha256:f06e7e9e6efe6b75d8dff2ea0aaeb2c2ec2619a5febf1acad0725c9a5618841f","observation_id":"b86cc106-17f9-405b-8a07-97968fe25467","resolution":{"observed_at":"2026-08-15T20:29:36.318911Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:29:37.234852Z","title":null,"venue":null,"work_id":"e629f673-1f79-4972-97ca-cc7766114af1","year":null},"citing_paper":{"arxiv_id":"2608.12928","last_updated":"2026-08-13T08:07:22Z","snapshot_observed_at":"2026-08-17T12:52:28.235059Z","submitted_at":"2026-08-13T08:07:22Z","title":"Polish Medical Visual Question Answering: Vision-Language Models Underutilize Visual Evidence","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-15T20:29:36.323956Z"},"links":{"citing_paper":"/paper/2608.12928"},"observation_digest":"sha256:05f66ad0859a7dea7f86bdf640fdd7307ea457b25bcc6dbaacc616516ec6d11c","observation_id":"a21dfa53-e633-43d0-9480-f83bd6259e16","resolution":{"observed_at":"2026-08-15T20:29:37.240769Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.02266","last_updated":"2025-01-04T12:04:46Z","snapshot_observed_at":"2026-08-17T01:11:55.393115Z","submitted_at":"2025-01-04T12:04:46Z","title":"LLMzSz{\\L}: a comprehensive LLM benchmark for Polish","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.02266","snapshot_observed_at":"2026-08-15T20:29:36.329103Z","title":"arXiv preprint arXiv:2501.02266 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.12928","last_updated":"2026-08-13T08:07:22Z","snapshot_observed_at":"2026-08-17T12:52:28.235059Z","submitted_at":"2026-08-13T08:07:22Z","title":"Polish Medical Visual Question Answering: Vision-Language Models Underutilize Visual Evidence","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-15T20:29:36.329103Z"},"links":{"cited_paper":"/paper/2501.02266","citing_paper":"/paper/2608.12928"},"observation_digest":"sha256:12130cabe43c968c9fb91486413b4e634be843266d8ab3f0e538bee77f16d643","observation_id":"6e66ba6e-e602-4945-b4a2-a9115a8d43fb","resolution":{"observed_at":"2026-08-15T20:29:36.329103Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2021.findings-emnlp.151","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:29:36.639138Z","title":"Towards Developing a Multilingual and Code-Mixed Visual Question Answering System by Knowledge Distillation","venue":null,"work_id":"232b73da-6ac2-418b-a2a6-adbe57a7c381","year":2021},"citing_paper":{"arxiv_id":"2608.12928","last_updated":"2026-08-13T08:07:22Z","snapshot_observed_at":"2026-08-17T12:52:28.235059Z","submitted_at":"2026-08-13T08:07:22Z","title":"Polish Medical Visual Question Answering: Vision-Language Models Underutilize Visual Evidence","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-15T20:29:36.334811Z"},"links":{"citing_paper":"/paper/2608.12928"},"observation_digest":"sha256:8b5ae0b6293b854f6e49b87f1318dad904e12f5fae5b59c2363195c2fa859d53","observation_id":"7c779479-debc-4302-9ca2-ea3b88e9ece3","resolution":{"observed_at":"2026-08-15T20:29:36.644951Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:29:36.340195Z","title":"2026 , howpublished =","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.12928","last_updated":"2026-08-13T08:07:22Z","snapshot_observed_at":"2026-08-17T12:52:28.235059Z","submitted_at":"2026-08-13T08:07:22Z","title":"Polish Medical Visual Question Answering: Vision-Language Models Underutilize Visual Evidence","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-15T20:29:36.340195Z"},"links":{"citing_paper":"/paper/2608.12928"},"observation_digest":"sha256:cacc1ae3d7fe90e20e1c24ace5b495d1d238e451a410375fd3479b8d36b8de2f","observation_id":"7324f780-42e1-405a-951e-7fa99fdb3438","resolution":{"observed_at":"2026-08-15T20:29:36.340195Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:29:36.345009Z","title":"Artifacts or Abduction: How Do LLM s Answer Multiple-Choice Questions Without the Question?","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.12928","last_updated":"2026-08-13T08:07:22Z","snapshot_observed_at":"2026-08-17T12:52:28.235059Z","submitted_at":"2026-08-13T08:07:22Z","title":"Polish Medical Visual Question Answering: Vision-Language Models Underutilize Visual Evidence","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-15T20:29:36.345009Z"},"links":{"citing_paper":"/paper/2608.12928"},"observation_digest":"sha256:322a10b7936ecafeda8e8ebc375ca903c9c5a70a2c1b4d68fc27c60b7e46e434","observation_id":"e6dcadf2-b077-40a9-b50d-4267e6426bd9","resolution":{"observed_at":"2026-08-15T20:29:36.345009Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:29:36.350616Z","title":"Which of These Best Describes Multiple Choice Evaluation with LLM s? A) Forced B ) Flawed C ) Fixable D ) All of the Above","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12928","last_updated":"2026-08-13T08:07:22Z","snapshot_observed_at":"2026-08-17T12:52:28.235059Z","submitted_at":"2026-08-13T08:07:22Z","title":"Polish Medical Visual Question Answering: Vision-Language Models Underutilize Visual Evidence","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-15T20:29:36.350616Z"},"links":{"citing_paper":"/paper/2608.12928"},"observation_digest":"sha256:ae326f06323750d5d7e17ba0a747090fdd8a33825ea0162346421219e2963547","observation_id":"fafc7553-1c75-48bc-89c8-43a8a8a8da71","resolution":{"observed_at":"2026-08-15T20:29:36.350616Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:29:37.208239Z","title":"2024 , eprint=","venue":null,"work_id":"73bc9e0b-8ce3-47d0-9691-07a77787067d","year":2024},"citing_paper":{"arxiv_id":"2608.12928","last_updated":"2026-08-13T08:07:22Z","snapshot_observed_at":"2026-08-17T12:52:28.235059Z","submitted_at":"2026-08-13T08:07:22Z","title":"Polish Medical Visual Question Answering: Vision-Language Models Underutilize Visual Evidence","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-15T20:29:36.356680Z"},"links":{"citing_paper":"/paper/2608.12928"},"observation_digest":"sha256:898af4551eeb0f93ed8b09edcfda75f943e2ae4dd008c0a4b9800eb425b79621","observation_id":"ebae2032-79f3-46cf-b609-c67697eed21f","resolution":{"observed_at":"2026-08-15T20:29:37.212959Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:29:37.192161Z","title":"2026 , eprint=","venue":null,"work_id":"c6e5d8ad-6f16-4ee2-b6b7-ddadfc3c0753","year":2026},"citing_paper":{"arxiv_id":"2608.12928","last_updated":"2026-08-13T08:07:22Z","snapshot_observed_at":"2026-08-17T12:52:28.235059Z","submitted_at":"2026-08-13T08:07:22Z","title":"Polish Medical Visual Question Answering: Vision-Language Models Underutilize Visual Evidence","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-15T20:29:36.362619Z"},"links":{"citing_paper":"/paper/2608.12928"},"observation_digest":"sha256:b41dad17c0055cbaa8e1389217ceac2cc1d96dcba7f89eb3d450ce43fd5ce8f3","observation_id":"fadff88d-5e42-49f0-be31-a6424e337509","resolution":{"observed_at":"2026-08-15T20:29:37.197292Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2025.findings-emnlp.480","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:29:36.597327Z","title":"P olish- E nglish medical knowledge transfer: A new benchmark and results","venue":null,"work_id":"b2941b8b-ba63-4a67-8027-7f335ed379d8","year":2025},"citing_paper":{"arxiv_id":"2608.12928","last_updated":"2026-08-13T08:07:22Z","snapshot_observed_at":"2026-08-17T12:52:28.235059Z","submitted_at":"2026-08-13T08:07:22Z","title":"Polish Medical Visual Question Answering: Vision-Language Models Underutilize Visual Evidence","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-15T20:29:36.368222Z"},"links":{"citing_paper":"/paper/2608.12928"},"observation_digest":"sha256:37fcdaf9ea2d9f8fccda20cf4b2b3ad2acd54952687212d9b180331bf4bf7f1c","observation_id":"1cf1a991-894a-4974-bde3-e270a58ba985","resolution":{"observed_at":"2026-08-15T20:29:36.603198Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:29:37.174750Z","title":"2026 , howpublished =","venue":null,"work_id":"eb3aab29-9a5a-4be3-b018-9ff06a516291","year":2026},"citing_paper":{"arxiv_id":"2608.12928","last_updated":"2026-08-13T08:07:22Z","snapshot_observed_at":"2026-08-17T12:52:28.235059Z","submitted_at":"2026-08-13T08:07:22Z","title":"Polish Medical Visual Question Answering: Vision-Language Models Underutilize Visual Evidence","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-15T20:29:36.373653Z"},"links":{"citing_paper":"/paper/2608.12928"},"observation_digest":"sha256:a5cee6680f63f1d649a37ee8e49d2efa4d6d29325c7bff6222d36154f6697da5","observation_id":"4712cd2c-f4cc-4d89-9186-52556622934a","resolution":{"observed_at":"2026-08-15T20:29:37.179988Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:29:37.156330Z","title":"reVISION: A Polish Benchmark for Evaluating Vision-Language Models on Multimodal National Exam Data , year=","venue":null,"work_id":"1a3c84fa-18cf-4aae-b43b-fb664d23616f","year":null},"citing_paper":{"arxiv_id":"2608.12928","last_updated":"2026-08-13T08:07:22Z","snapshot_observed_at":"2026-08-17T12:52:28.235059Z","submitted_at":"2026-08-13T08:07:22Z","title":"Polish Medical Visual Question Answering: Vision-Language Models Underutilize Visual Evidence","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-15T20:29:36.380142Z"},"links":{"citing_paper":"/paper/2608.12928"},"observation_digest":"sha256:00195063fd0b206e993293c4cd2cebb7263063252a4ffebcd449affec8f0f155","observation_id":"1fb96ccd-4941-475d-ba38-da945edd99a1","resolution":{"observed_at":"2026-08-15T20:29:37.162874Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:29:36.385425Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.12928","last_updated":"2026-08-13T08:07:22Z","snapshot_observed_at":"2026-08-17T12:52:28.235059Z","submitted_at":"2026-08-13T08:07:22Z","title":"Polish Medical Visual Question Answering: Vision-Language Models Underutilize Visual Evidence","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-15T20:29:36.385425Z"},"links":{"citing_paper":"/paper/2608.12928"},"observation_digest":"sha256:9ad3ad9af5185fcd00d4ada091364ff4b400719fadf912100cdf047aefdfbc5d","observation_id":"739db54a-6095-4bac-8179-aabea38c55ad","resolution":{"observed_at":"2026-08-15T20:29:36.385425Z","resolver_source":null,"status":"parse_uncertain"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:29:36.390344Z","title":"EXAMS - V : A Multi-Discipline Multilingual Multimodal Exam Benchmark for Evaluating Vision Language Models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.12928","last_updated":"2026-08-13T08:07:22Z","snapshot_observed_at":"2026-08-17T12:52:28.235059Z","submitted_at":"2026-08-13T08:07:22Z","title":"Polish Medical Visual Question Answering: Vision-Language Models Underutilize Visual Evidence","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-15T20:29:36.390344Z"},"links":{"citing_paper":"/paper/2608.12928"},"observation_digest":"sha256:e3679a4246f9497a83d583a2febfd081cad092e970f56e68a27681f686a49c98","observation_id":"5f6bc3f5-3ce0-47be-80bd-a3dcedf33b41","resolution":{"observed_at":"2026-08-15T20:29:36.390344Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:29:37.126799Z","title":"Scientific Data , volume =","venue":null,"work_id":"f7cbd676-c96f-4eeb-bfd4-532a81ccf405","year":2018},"citing_paper":{"arxiv_id":"2608.12928","last_updated":"2026-08-13T08:07:22Z","snapshot_observed_at":"2026-08-17T12:52:28.235059Z","submitted_at":"2026-08-13T08:07:22Z","title":"Polish Medical Visual Question Answering: Vision-Language Models Underutilize Visual Evidence","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-15T20:29:36.395247Z"},"links":{"citing_paper":"/paper/2608.12928"},"observation_digest":"sha256:ffb555df6d5c3832b9ee9b1367f39f931b13516446d743f038ad311de9adeba5","observation_id":"57e16b8a-ec2d-47d9-82ed-1c4ada1f788d","resolution":{"observed_at":"2026-08-15T20:29:37.132443Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:29:37.109753Z","title":"Hasan and Yuan Ling and Oladimeji Farri and Joey Liu and Matthew Lungren and Henning M\\\"uller , title =","venue":null,"work_id":"190425ab-8813-43b8-9033-4d48a25e7a32","year":2018},"citing_paper":{"arxiv_id":"2608.12928","last_updated":"2026-08-13T08:07:22Z","snapshot_observed_at":"2026-08-17T12:52:28.235059Z","submitted_at":"2026-08-13T08:07:22Z","title":"Polish Medical Visual Question Answering: Vision-Language Models Underutilize Visual Evidence","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-15T20:29:36.400945Z"},"links":{"citing_paper":"/paper/2608.12928"},"observation_digest":"sha256:3d34a40f0d6b538e53a9a4bddc2a2f52338c7514d9dc08630cc7cd4009db1cc7","observation_id":"3d4d9ad8-3132-4698-909a-ae4531d9819d","resolution":{"observed_at":"2026-08-15T20:29:37.114905Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:29:37.092799Z","title":"Working Notes of","venue":null,"work_id":"903a2c73-c16b-4016-aa8d-4894a4d79b36","year":2019},"citing_paper":{"arxiv_id":"2608.12928","last_updated":"2026-08-13T08:07:22Z","snapshot_observed_at":"2026-08-17T12:52:28.235059Z","submitted_at":"2026-08-13T08:07:22Z","title":"Polish Medical Visual Question Answering: Vision-Language Models Underutilize Visual Evidence","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-15T20:29:36.406103Z"},"links":{"citing_paper":"/paper/2608.12928"},"observation_digest":"sha256:f725ef71bc1ba5b0323e10eca1fc250693c65e094ae0e93bf34f8f4f3e90e50c","observation_id":"c2bcd8d3-acda-45e9-9542-98355b1155f1","resolution":{"observed_at":"2026-08-15T20:29:37.099163Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:29:37.075601Z","title":"Overview of the","venue":null,"work_id":"c232714a-17b4-4123-9022-50a8a2378c80","year":2020},"citing_paper":{"arxiv_id":"2608.12928","last_updated":"2026-08-13T08:07:22Z","snapshot_observed_at":"2026-08-17T12:52:28.235059Z","submitted_at":"2026-08-13T08:07:22Z","title":"Polish Medical Visual Question Answering: Vision-Language Models Underutilize Visual Evidence","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-15T20:29:36.412810Z"},"links":{"citing_paper":"/paper/2608.12928"},"observation_digest":"sha256:a994a4722a244db8f4603d4914fa55a014b0b3bd3e0b5cc30ceb128aeb271cc9","observation_id":"f9282cce-b387-4bda-a53f-9716ac164c9a","resolution":{"observed_at":"2026-08-15T20:29:37.081451Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:29:37.059351Z","title":"Overview of the","venue":null,"work_id":"b92dd9b0-7d2d-4249-b7c8-32e1bd2beb94","year":2021},"citing_paper":{"arxiv_id":"2608.12928","last_updated":"2026-08-13T08:07:22Z","snapshot_observed_at":"2026-08-17T12:52:28.235059Z","submitted_at":"2026-08-13T08:07:22Z","title":"Polish Medical Visual Question Answering: Vision-Language Models Underutilize Visual Evidence","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-15T20:29:36.417787Z"},"links":{"citing_paper":"/paper/2608.12928"},"observation_digest":"sha256:0c206fa8ebb9ecb8f847370113c128710a8419acef14770cf699eccb0e084cb5","observation_id":"3fec154f-b382-48cd-be7b-0009c73b91aa","resolution":{"observed_at":"2026-08-15T20:29:37.064348Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2021.acl-short.90","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:29:36.568091Z","title":"Towards Visual Question Answering on Pathology Images","venue":null,"work_id":"2ec556ec-aa1a-4942-9295-b164bbef741f","year":2021},"citing_paper":{"arxiv_id":"2608.12928","last_updated":"2026-08-13T08:07:22Z","snapshot_observed_at":"2026-08-17T12:52:28.235059Z","submitted_at":"2026-08-13T08:07:22Z","title":"Polish Medical Visual Question Answering: Vision-Language Models Underutilize Visual Evidence","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-15T20:29:36.424381Z"},"links":{"citing_paper":"/paper/2608.12928"},"observation_digest":"sha256:b7aa6ecab5f60162c39f5d54d4fc24c4eee19df076ca220c37abb2bbde60ddcb","observation_id":"82f46247-4765-4af9-9030-0677df9fa20d","resolution":{"observed_at":"2026-08-15T20:29:36.574969Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:29:37.042006Z","title":"2023 , url =","venue":null,"work_id":"37e9fce2-b63b-4653-a523-f0bbbff6e404","year":2023},"citing_paper":{"arxiv_id":"2608.12928","last_updated":"2026-08-13T08:07:22Z","snapshot_observed_at":"2026-08-17T12:52:28.235059Z","submitted_at":"2026-08-13T08:07:22Z","title":"Polish Medical Visual Question Answering: Vision-Language Models Underutilize Visual Evidence","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-15T20:29:36.429582Z"},"links":{"citing_paper":"/paper/2608.12928"},"observation_digest":"sha256:b4d5891744746f22ff477f16f3ea1dfdd8142b3368a117758d5ab6b96c147095","observation_id":"78aa71c5-06b6-4bf9-b104-6cb1e15c0486","resolution":{"observed_at":"2026-08-15T20:29:37.046942Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:29:36.434677Z","title":"Towards Injecting Medical Visual Knowledge into Multimodal","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.12928","last_updated":"2026-08-13T08:07:22Z","snapshot_observed_at":"2026-08-17T12:52:28.235059Z","submitted_at":"2026-08-13T08:07:22Z","title":"Polish Medical Visual Question Answering: Vision-Language Models Underutilize Visual Evidence","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-15T20:29:36.434677Z"},"links":{"citing_paper":"/paper/2608.12928"},"observation_digest":"sha256:c07c46f348503eadae212862cc8f0b1b09ac9edf265136b5c192631c2c5e23c6","observation_id":"79fc0afd-ae17-4a9b-bc6e-8910cc9fd4a4","resolution":{"observed_at":"2026-08-15T20:29:36.434677Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:29:37.024623Z","title":"Slake: A Semantically-Labeled Knowledge-Enhanced Dataset For Medical Visual Question Answering , year=","venue":null,"work_id":"81e90bd0-bce3-4c83-ba86-9240fa2d61ed","year":null},"citing_paper":{"arxiv_id":"2608.12928","last_updated":"2026-08-13T08:07:22Z","snapshot_observed_at":"2026-08-17T12:52:28.235059Z","submitted_at":"2026-08-13T08:07:22Z","title":"Polish Medical Visual Question Answering: Vision-Language Models Underutilize Visual Evidence","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-15T20:29:36.440921Z"},"links":{"citing_paper":"/paper/2608.12928"},"observation_digest":"sha256:b723ee6358ece07a78b338cb3f456fb345f5507b46fcc570e6d88b3f1fc97688","observation_id":"fca90e38-987f-4ac9-ae39-6768095dc8e8","resolution":{"observed_at":"2026-08-15T20:29:37.029961Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:29:36.446248Z","title":"Findings of the Association for Computational Linguistics: NAACL 2025 , month = apr, year =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12928","last_updated":"2026-08-13T08:07:22Z","snapshot_observed_at":"2026-08-17T12:52:28.235059Z","submitted_at":"2026-08-13T08:07:22Z","title":"Polish Medical Visual Question Answering: Vision-Language Models Underutilize Visual Evidence","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-15T20:29:36.446248Z"},"links":{"citing_paper":"/paper/2608.12928"},"observation_digest":"sha256:cb337702dd965ce8523949f32a39edbe04cf460e7fab42225d255a10102b23b9","observation_id":"1212fc71-0220-46ea-a611-2b24262e91a6","resolution":{"observed_at":"2026-08-15T20:29:36.446248Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"5348.2025","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:29:36.790955Z","title":"2025 IEEE 38th International Symposium on Computer-Based Medical Systems (CBMS) , pages =","venue":null,"work_id":"11c83a8a-65ce-4381-b7e1-028ca6a28fd6","year":2025},"citing_paper":{"arxiv_id":"2608.12928","last_updated":"2026-08-13T08:07:22Z","snapshot_observed_at":"2026-08-17T12:52:28.235059Z","submitted_at":"2026-08-13T08:07:22Z","title":"Polish Medical Visual Question Answering: Vision-Language Models Underutilize Visual Evidence","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-15T20:29:36.452542Z"},"links":{"citing_paper":"/paper/2608.12928"},"observation_digest":"sha256:ff03179b7669f5df8d1d702a0f9f0e000288dea82106c9bb86c01b58ec1c85d1","observation_id":"ff307ca8-b3d4-4ffa-9fd5-6cfb8977c520","resolution":{"observed_at":"2026-08-15T20:29:36.800339Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:29:37.005917Z","title":"Kennedy and Yetisgen, Meliha , journal =","venue":null,"work_id":"91004c58-8138-4b4d-af36-fc7dea852189","year":2025},"citing_paper":{"arxiv_id":"2608.12928","last_updated":"2026-08-13T08:07:22Z","snapshot_observed_at":"2026-08-17T12:52:28.235059Z","submitted_at":"2026-08-13T08:07:22Z","title":"Polish Medical Visual Question Answering: Vision-Language Models Underutilize Visual Evidence","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-15T20:29:36.457652Z"},"links":{"citing_paper":"/paper/2608.12928"},"observation_digest":"sha256:24a2b199beeb9239c53b86afad49d7317a64ccfd7297ca4e99993abe32a67268","observation_id":"04345bf1-17ac-4095-9fe3-5cf547e4e1fc","resolution":{"observed_at":"2026-08-15T20:29:37.011750Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:29:36.986125Z","title":"2026 , eprint =","venue":null,"work_id":"0a95f4be-2217-4a80-b5de-fdc94af39c50","year":2026},"citing_paper":{"arxiv_id":"2608.12928","last_updated":"2026-08-13T08:07:22Z","snapshot_observed_at":"2026-08-17T12:52:28.235059Z","submitted_at":"2026-08-13T08:07:22Z","title":"Polish Medical Visual Question Answering: Vision-Language Models Underutilize Visual Evidence","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-15T20:29:36.462777Z"},"links":{"citing_paper":"/paper/2608.12928"},"observation_digest":"sha256:07511124f929bab2412e3cede0ac6e22f9513a6ddfdab17d9e24ec3c31ef271e","observation_id":"21af4605-4313-4587-b467-3e730494ca3f","resolution":{"observed_at":"2026-08-15T20:29:36.992710Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:29:36.966466Z","title":"2026 , eprint =","venue":null,"work_id":"c76fb916-8996-4b32-a44d-93266ad30ab5","year":2026},"citing_paper":{"arxiv_id":"2608.12928","last_updated":"2026-08-13T08:07:22Z","snapshot_observed_at":"2026-08-17T12:52:28.235059Z","submitted_at":"2026-08-13T08:07:22Z","title":"Polish Medical Visual Question Answering: Vision-Language Models Underutilize Visual Evidence","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-15T20:29:36.472237Z"},"links":{"citing_paper":"/paper/2608.12928"},"observation_digest":"sha256:cf79e9e0f4f791e3869baa700f822035b1340a2e58ec5d2224da4e2e92457d3e","observation_id":"9bb25061-9002-47d0-9ef9-fb2c3fb194ff","resolution":{"observed_at":"2026-08-15T20:29:36.972988Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:29:36.479021Z","title":"Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition (CVPR) , pages =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.12928","last_updated":"2026-08-13T08:07:22Z","snapshot_observed_at":"2026-08-17T12:52:28.235059Z","submitted_at":"2026-08-13T08:07:22Z","title":"Polish Medical Visual Question Answering: Vision-Language Models Underutilize Visual Evidence","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-15T20:29:36.479021Z"},"links":{"citing_paper":"/paper/2608.12928"},"observation_digest":"sha256:a0a6ab3294f7480d70979b37c5e817fb3427860c34f129ac2f934ab4d0034823","observation_id":"48dac0f7-b239-451d-82ea-da3ec9c1898a","resolution":{"observed_at":"2026-08-15T20:29:36.479021Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:29:36.933106Z","title":"Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition (CVPR) , pages =","venue":null,"work_id":"34fcf6c6-63f9-4972-8221-b5e7749f6b79","year":null},"citing_paper":{"arxiv_id":"2608.12928","last_updated":"2026-08-13T08:07:22Z","snapshot_observed_at":"2026-08-17T12:52:28.235059Z","submitted_at":"2026-08-13T08:07:22Z","title":"Polish Medical Visual Question Answering: Vision-Language Models Underutilize Visual Evidence","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-15T20:29:36.485582Z"},"links":{"citing_paper":"/paper/2608.12928"},"observation_digest":"sha256:010494ca9c1e857f06614169f8f983efc75fff7f6007d58c53cca88231c10c4f","observation_id":"e058d13f-4693-4d8d-9e44-63f4039f7497","resolution":{"observed_at":"2026-08-15T20:29:36.939448Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:29:36.911789Z","title":"Advances in Neural Information Processing Systems , volume =","venue":null,"work_id":"8748a1f4-d8c5-4238-b8e8-0cc261dc8952","year":2018},"citing_paper":{"arxiv_id":"2608.12928","last_updated":"2026-08-13T08:07:22Z","snapshot_observed_at":"2026-08-17T12:52:28.235059Z","submitted_at":"2026-08-13T08:07:22Z","title":"Polish Medical Visual Question Answering: Vision-Language Models Underutilize Visual Evidence","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-15T20:29:36.490570Z"},"links":{"citing_paper":"/paper/2608.12928"},"observation_digest":"sha256:f96d2810fe33f24e80608b85dcbdb90c954185bde487cde7333ca5fcb46ebe41","observation_id":"16a1aa4b-b433-484d-90c4-53d3ee81b408","resolution":{"observed_at":"2026-08-15T20:29:36.918653Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:29:36.892765Z","title":"2019 , url =","venue":null,"work_id":"3134e252-9cd3-4f4a-880c-40fd8737e630","year":2019},"citing_paper":{"arxiv_id":"2608.12928","last_updated":"2026-08-13T08:07:22Z","snapshot_observed_at":"2026-08-17T12:52:28.235059Z","submitted_at":"2026-08-13T08:07:22Z","title":"Polish Medical Visual Question Answering: Vision-Language Models Underutilize Visual Evidence","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-15T20:29:36.496219Z"},"links":{"citing_paper":"/paper/2608.12928"},"observation_digest":"sha256:bbc93e2bd187957e100ec88867e13ea0cf10f1ac2b53a8830c19250ad948b230","observation_id":"91e51785-758e-404c-bc9f-fdff3555d96d","resolution":{"observed_at":"2026-08-15T20:29:36.899571Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:29:36.874222Z","title":"Computer Vision -- ECCV 2020 , series =","venue":null,"work_id":"af469942-99c2-465c-8396-b986e830ce60","year":2020},"citing_paper":{"arxiv_id":"2608.12928","last_updated":"2026-08-13T08:07:22Z","snapshot_observed_at":"2026-08-17T12:52:28.235059Z","submitted_at":"2026-08-13T08:07:22Z","title":"Polish Medical Visual Question Answering: Vision-Language Models Underutilize Visual Evidence","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-15T20:29:36.501195Z"},"links":{"citing_paper":"/paper/2608.12928"},"observation_digest":"sha256:ebbd5c34048a7339ddc72bc6f6a684a0403254c030abecd174129bc50f6b2b9f","observation_id":"a85235f7-e669-4f08-bae5-393a6f2f4019","resolution":{"observed_at":"2026-08-15T20:29:36.879616Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:29:36.854590Z","title":"Medical Image Computing and Computer Assisted Intervention -- MICCAI 2023 , series =","venue":null,"work_id":"bc16c3e9-8410-49ff-b8ca-28793299f286","year":2023},"citing_paper":{"arxiv_id":"2608.12928","last_updated":"2026-08-13T08:07:22Z","snapshot_observed_at":"2026-08-17T12:52:28.235059Z","submitted_at":"2026-08-13T08:07:22Z","title":"Polish Medical Visual Question Answering: Vision-Language Models Underutilize Visual Evidence","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-15T20:29:36.506729Z"},"links":{"citing_paper":"/paper/2608.12928"},"observation_digest":"sha256:e80d91e376f6177dae41fa6862fcbe5dc96c643ef79ffcc0663609f66936ac98","observation_id":"9c667f1e-cb29-4d80-90e7-fdc15d74782e","resolution":{"observed_at":"2026-08-15T20:29:36.860669Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:29:36.832817Z","title":null,"venue":null,"work_id":"71250207-ec6a-4824-9f82-5f9e448a3325","year":null},"citing_paper":{"arxiv_id":"2608.12928","last_updated":"2026-08-13T08:07:22Z","snapshot_observed_at":"2026-08-17T12:52:28.235059Z","submitted_at":"2026-08-13T08:07:22Z","title":"Polish Medical Visual Question Answering: Vision-Language Models Underutilize Visual Evidence","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-15T20:29:36.511758Z"},"links":{"citing_paper":"/paper/2608.12928"},"observation_digest":"sha256:30a384b5df5efe5b59f78cb9624a10ab72a66a7bb0c8a867c137de8ceddd2f11","observation_id":"1af0deff-77e2-46bb-bc5f-a9d784084bf1","resolution":{"observed_at":"2026-08-15T20:29:36.838867Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.12928","last_updated":"2026-08-13T08:07:22Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-17T12:52:28.235059Z","submitted_at":"2026-08-13T08:07:22Z","title":"Polish Medical Visual Question Answering: Vision-Language Models Underutilize Visual Evidence"},"reference_resolution":{"displayed":37,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":1,"unresolved":12,"verified_exact":5,"verified_fuzzy":19},"total_outbound_references":37},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 37 of 37 outbound references and 0 inbound Pith citation observations for arXiv:2608.12928."}