{"as_of":"2026-08-08T05:48:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f290ecece3882cc3668203ec8ff5529474a411cabaf2000b306eb230e054c786","coverage":[{"denominator":22,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":22,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T14:28:24.864787Z","state":"measured"},{"denominator":22,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":22,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.04885/citation-record","integrity":"/paper/2608.04885/integrity","json":"/paper/2608.04885/citation-record.json","paper":"/paper/2608.04885"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2024.33696","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:28:26.839535Z","title":"doi:10.1109/TPAMI.2024.3369699 , shorttitle =","venue":null,"work_id":"068606fa-f8ed-4b33-80ec-4200560dbd99","year":2024},"citing_paper":{"arxiv_id":"2608.04885","last_updated":"2026-08-05T14:09:55Z","snapshot_observed_at":"2026-08-08T05:12:09.633349Z","submitted_at":"2026-08-05T14:09:55Z","title":"Evaluating the Diagnostic Robustness of Vision-Language Models Under Visual and Textual Perturbations","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-06T14:28:22.577560Z"},"links":{"citing_paper":"/paper/2608.04885"},"observation_digest":"sha256:38910c8deaddc6c99f4510f6a4f0df3650bbc80df3842d30e1a6cbe474dc4c0d","observation_id":"9fb51281-984e-48c7-bb39-f50b0cac5fd8","resolution":{"observed_at":"2026-08-06T14:28:26.941665Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:28:22.642641Z","title":", urldate =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.04885","last_updated":"2026-08-05T14:09:55Z","snapshot_observed_at":"2026-08-08T05:12:09.633349Z","submitted_at":"2026-08-05T14:09:55Z","title":"Evaluating the Diagnostic Robustness of Vision-Language Models Under Visual and Textual Perturbations","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-06T14:28:22.642641Z"},"links":{"citing_paper":"/paper/2608.04885"},"observation_digest":"sha256:5311d1ce36074e21b59f6198e114bb12da3d1b76c920acf8ea17c8bacbab0e5c","observation_id":"b6e363bf-d92f-4a4a-9303-e3402f39280e","resolution":{"observed_at":"2026-08-06T14:28:22.642641Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:28:22.796444Z","title":"National Science Review , volume =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.04885","last_updated":"2026-08-05T14:09:55Z","snapshot_observed_at":"2026-08-08T05:12:09.633349Z","submitted_at":"2026-08-05T14:09:55Z","title":"Evaluating the Diagnostic Robustness of Vision-Language Models Under Visual and Textual Perturbations","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-06T14:28:22.796444Z"},"links":{"citing_paper":"/paper/2608.04885"},"observation_digest":"sha256:dce2b49963d76387a98377cabd7fb7c5454851b4d503ce609023521bd9522509","observation_id":"3171cae7-121b-4ea8-b7db-e81b96105daf","resolution":{"observed_at":"2026-08-06T14:28:22.796444Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:28:28.520277Z","title":"Artificial Intelligence Review , volume=","venue":null,"work_id":"c3547f82-36e8-4f92-8749-e9730046e6e7","year":2024},"citing_paper":{"arxiv_id":"2608.04885","last_updated":"2026-08-05T14:09:55Z","snapshot_observed_at":"2026-08-08T05:12:09.633349Z","submitted_at":"2026-08-05T14:09:55Z","title":"Evaluating the Diagnostic Robustness of Vision-Language Models Under Visual and Textual Perturbations","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-06T14:28:22.963733Z"},"links":{"citing_paper":"/paper/2608.04885"},"observation_digest":"sha256:b57f07cdf40fea5e89a4ff90a98a9ab372fe76bb360ae9b1a76b9379c26b8f60","observation_id":"135870f4-9f10-4abb-b3f3-247f6f56ba4e","resolution":{"observed_at":"2026-08-06T14:28:28.684842Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.05201","last_updated":"2026-04-06T19:50:20Z","snapshot_observed_at":"2026-08-07T23:53:34.814339Z","submitted_at":"2025-07-07T17:01:44Z","title":"MedGemma Technical Report","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.05201","snapshot_observed_at":"2026-08-06T14:28:23.071063Z","title":"Steiner and Can Kirmizibayrak and Rory Pilgrim and Daniel Golden and Lin Yang , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04885","last_updated":"2026-08-05T14:09:55Z","snapshot_observed_at":"2026-08-08T05:12:09.633349Z","submitted_at":"2026-08-05T14:09:55Z","title":"Evaluating the Diagnostic Robustness of Vision-Language Models Under Visual and Textual Perturbations","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-06T14:28:23.071063Z"},"links":{"cited_paper":"/paper/2507.05201","citing_paper":"/paper/2608.04885"},"observation_digest":"sha256:4329e5e298b841b8384a00f4279ad2c2165f0a01351d562d78ecd18d7785fceb","observation_id":"7805a149-cfe0-40f1-aec0-eaa159a01e9f","resolution":{"observed_at":"2026-08-06T14:28:23.071063Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2024.14309","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:28:26.376545Z","title":"doi:10.3389/frai.2024.1430984 , journaltitle =","venue":null,"work_id":"933c60d9-c022-40b0-8b53-d0346519bac2","year":2024},"citing_paper":{"arxiv_id":"2608.04885","last_updated":"2026-08-05T14:09:55Z","snapshot_observed_at":"2026-08-08T05:12:09.633349Z","submitted_at":"2026-08-05T14:09:55Z","title":"Evaluating the Diagnostic Robustness of Vision-Language Models Under Visual and Textual Perturbations","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-06T14:28:23.270138Z"},"links":{"citing_paper":"/paper/2608.04885"},"observation_digest":"sha256:e9e6afe2b838dc5306215aa0ecd5e2228df12cd3ecde3944b191affa44b268f1","observation_id":"6c9fc011-6eaa-4dbb-b10d-159891d0af4d","resolution":{"observed_at":"2026-08-06T14:28:26.455174Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.10694","last_updated":"2025-03-12T05:08:02Z","snapshot_observed_at":"2026-08-07T17:11:05.218386Z","submitted_at":"2025-03-12T05:08:02Z","title":"Medical Large Language Model Benchmarks Should Prioritize Construct Validity","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.10694","snapshot_observed_at":"2026-08-06T14:28:23.370826Z","title":"2503.10694 , archivePrefix=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04885","last_updated":"2026-08-05T14:09:55Z","snapshot_observed_at":"2026-08-08T05:12:09.633349Z","submitted_at":"2026-08-05T14:09:55Z","title":"Evaluating the Diagnostic Robustness of Vision-Language Models Under Visual and Textual Perturbations","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-06T14:28:23.370826Z"},"links":{"cited_paper":"/paper/2503.10694","citing_paper":"/paper/2608.04885"},"observation_digest":"sha256:6e03d817c74a1e7657233e084fb29ae64d4d40ca264fba2549d6350e4d8922eb","observation_id":"c0b13f56-e835-420d-8d81-6e2f637deb73","resolution":{"observed_at":"2026-08-06T14:28:23.370826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:28:28.220919Z","title":"Nature Machine Intelligence , volume=","venue":null,"work_id":"41348aac-9b5d-4a58-9321-14efd5c7e26f","year":2025},"citing_paper":{"arxiv_id":"2608.04885","last_updated":"2026-08-05T14:09:55Z","snapshot_observed_at":"2026-08-08T05:12:09.633349Z","submitted_at":"2026-08-05T14:09:55Z","title":"Evaluating the Diagnostic Robustness of Vision-Language Models Under Visual and Textual Perturbations","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-06T14:28:23.421945Z"},"links":{"citing_paper":"/paper/2608.04885"},"observation_digest":"sha256:28391546acbf8f8e81c37c93383777cbcd662887ef42e957c59dc87da6daa16e","observation_id":"06ecfbdf-f735-498b-bb57-63e497fc99cc","resolution":{"observed_at":"2026-08-06T14:28:28.334737Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:28:27.811982Z","title":"Proceedings of the IEEE/CVF International Conference on Computer Vision (ICCV) , url =","venue":null,"work_id":"ab33be51-dad0-41ce-8bd4-5dee1996f9ce","year":2025},"citing_paper":{"arxiv_id":"2608.04885","last_updated":"2026-08-05T14:09:55Z","snapshot_observed_at":"2026-08-08T05:12:09.633349Z","submitted_at":"2026-08-05T14:09:55Z","title":"Evaluating the Diagnostic Robustness of Vision-Language Models Under Visual and Textual Perturbations","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-06T14:28:23.478348Z"},"links":{"citing_paper":"/paper/2608.04885"},"observation_digest":"sha256:c9dd6c0b5e84c74efe95da218e150d1c2abf300089448f4030c23cfd314d9793","observation_id":"4b3374e0-e45f-4a16-8556-2992d9aa89a8","resolution":{"observed_at":"2026-08-06T14:28:28.054170Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2511.11206","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:28:26.089373Z","title":"2511.11206 , archivePrefix=","venue":null,"work_id":"74209a8b-b8d1-4e2f-bc07-a4093971b02c","year":null},"citing_paper":{"arxiv_id":"2608.04885","last_updated":"2026-08-05T14:09:55Z","snapshot_observed_at":"2026-08-08T05:12:09.633349Z","submitted_at":"2026-08-05T14:09:55Z","title":"Evaluating the Diagnostic Robustness of Vision-Language Models Under Visual and Textual Perturbations","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-06T14:28:23.574302Z"},"links":{"citing_paper":"/paper/2608.04885"},"observation_digest":"sha256:b5a32f947c0a71645bdd1aecff24da3e7d8543e951969e1006af8d17f670f308","observation_id":"db7cf230-b906-4cf0-8644-4abfb35d1a14","resolution":{"observed_at":"2026-08-06T14:28:26.161489Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:28:23.664605Z","title":"MM -R ^3 : On (In-)Consistency of Vision-Language Models ( VLM s)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.04885","last_updated":"2026-08-05T14:09:55Z","snapshot_observed_at":"2026-08-08T05:12:09.633349Z","submitted_at":"2026-08-05T14:09:55Z","title":"Evaluating the Diagnostic Robustness of Vision-Language Models Under Visual and Textual Perturbations","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-06T14:28:23.664605Z"},"links":{"citing_paper":"/paper/2608.04885"},"observation_digest":"sha256:89eff1b539e74da476010bb1bc265641c56c47182e263c1f098a8150681420c2","observation_id":"2c4a9caa-77c9-454d-8ad0-5377f039b767","resolution":{"observed_at":"2026-08-06T14:28:23.664605Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.05429","last_updated":"2025-06-05T08:09:05Z","snapshot_observed_at":"2026-08-07T10:32:06.331613Z","submitted_at":"2025-06-05T08:09:05Z","title":"Coordinated Robustness Evaluation Framework for Vision-Language Models","version":1},"cited_work":{"arxiv_id":"2506.05429","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.05429","snapshot_observed_at":"2026-08-06T14:28:25.701065Z","title":"Coordinated Robustness Evaluation Framework for Vision-Language Models","venue":"cs.CV","work_id":"a518c283-89a6-4a2f-b673-3fdcc667e465","year":2025},"citing_paper":{"arxiv_id":"2608.04885","last_updated":"2026-08-05T14:09:55Z","snapshot_observed_at":"2026-08-08T05:12:09.633349Z","submitted_at":"2026-08-05T14:09:55Z","title":"Evaluating the Diagnostic Robustness of Vision-Language Models Under Visual and Textual Perturbations","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-06T14:28:23.793963Z"},"links":{"cited_paper":"/paper/2506.05429","citing_paper":"/paper/2608.04885"},"observation_digest":"sha256:c11a8b922f26eee341042bd7874d0c039cabe21e1e3ac28714dffd406451877d","observation_id":"ffbaa1ea-698a-4b8d-9411-1e26d89989ee","resolution":{"observed_at":"2026-08-06T14:28:25.803833Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:28:27.550132Z","title":"On the Risk of Misleading Reports: Diagnosing Textual Biases in Multimodal Clinical AI","venue":null,"work_id":"72cf7773-c37e-47d7-b1d9-270742f16536","year":2026},"citing_paper":{"arxiv_id":"2608.04885","last_updated":"2026-08-05T14:09:55Z","snapshot_observed_at":"2026-08-08T05:12:09.633349Z","submitted_at":"2026-08-05T14:09:55Z","title":"Evaluating the Diagnostic Robustness of Vision-Language Models Under Visual and Textual Perturbations","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-06T14:28:23.905653Z"},"links":{"citing_paper":"/paper/2608.04885"},"observation_digest":"sha256:e23b3ea327b0bc8ec11832e2b11a40f302208f308e788344ef6004e73c1edde4","observation_id":"16670686-85eb-4732-96ca-6001f486c1d4","resolution":{"observed_at":"2026-08-06T14:28:27.634752Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:28:23.964560Z","title":"Adams and Keno K","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04885","last_updated":"2026-08-05T14:09:55Z","snapshot_observed_at":"2026-08-08T05:12:09.633349Z","submitted_at":"2026-08-05T14:09:55Z","title":"Evaluating the Diagnostic Robustness of Vision-Language Models Under Visual and Textual Perturbations","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-06T14:28:23.964560Z"},"links":{"citing_paper":"/paper/2608.04885"},"observation_digest":"sha256:2ff2db2919769f0ab3aae7d253cdbb0b9c03b031f7098358f31d040f37df423c","observation_id":"69f66e2d-c119-43a0-b19d-dcfbc4d9df5c","resolution":{"observed_at":"2026-08-06T14:28:23.964560Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:28:27.394834Z","title":"Decoupling Visual Parsing and Diagnostic Reasoning for Vision--Language Models (GPT-4o and GPT-5): Analysis Using Thoracic Imaging Quiz Cases , author=","venue":null,"work_id":"bcffadfe-1025-4bfc-b307-8bda857fd830","year":null},"citing_paper":{"arxiv_id":"2608.04885","last_updated":"2026-08-05T14:09:55Z","snapshot_observed_at":"2026-08-08T05:12:09.633349Z","submitted_at":"2026-08-05T14:09:55Z","title":"Evaluating the Diagnostic Robustness of Vision-Language Models Under Visual and Textual Perturbations","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-06T14:28:24.029468Z"},"links":{"citing_paper":"/paper/2608.04885"},"observation_digest":"sha256:1b15939d78f0aefbd087a784fa4e58699ddc49117c1ac1bce7192d6ce48bd58b","observation_id":"1ecb8c9f-3c09-4cef-9dc3-9772e3ea46fb","resolution":{"observed_at":"2026-08-06T14:28:27.476500Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.03267","last_updated":"2026-05-01T23:55:43Z","snapshot_observed_at":"2026-08-02T10:52:10.211700Z","submitted_at":"2025-12-19T07:05:38Z","title":"OpenAI GPT-5 System Card","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.03267","snapshot_observed_at":"2026-08-06T14:28:24.174326Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04885","last_updated":"2026-08-05T14:09:55Z","snapshot_observed_at":"2026-08-08T05:12:09.633349Z","submitted_at":"2026-08-05T14:09:55Z","title":"Evaluating the Diagnostic Robustness of Vision-Language Models Under Visual and Textual Perturbations","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-06T14:28:24.174326Z"},"links":{"cited_paper":"/paper/2601.03267","citing_paper":"/paper/2608.04885"},"observation_digest":"sha256:348e672a90e2ebde357184a7003f8365327b88779b660a3f51f6489fd2d76e52","observation_id":"1b1f973e-633d-4253-840c-838037a95d3d","resolution":{"observed_at":"2026-08-06T14:28:24.174326Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.06261","last_updated":"2025-12-19T14:25:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-07T17:36:04Z","title":"Gemini 2.5: Pushing the Frontier with Advanced Reasoning, Multimodality, Long Context, and Next Generation Agentic Capabilities","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.06261","snapshot_observed_at":"2026-08-06T14:28:24.288336Z","title":"2507.06261 , archivePrefix=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04885","last_updated":"2026-08-05T14:09:55Z","snapshot_observed_at":"2026-08-08T05:12:09.633349Z","submitted_at":"2026-08-05T14:09:55Z","title":"Evaluating the Diagnostic Robustness of Vision-Language Models Under Visual and Textual Perturbations","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-06T14:28:24.288336Z"},"links":{"cited_paper":"/paper/2507.06261","citing_paper":"/paper/2608.04885"},"observation_digest":"sha256:bd7f72fc1e6c5c1cd637e355a3e375f1b9ff7ff567d2c100fcf9320d931be042","observation_id":"a6ca5270-c471-462f-8f46-336727441555","resolution":{"observed_at":"2026-08-06T14:28:24.288336Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.21631","last_updated":"2025-11-27T12:16:54Z","snapshot_observed_at":"2026-07-06T22:37:03.716474Z","submitted_at":"2025-11-26T17:59:08Z","title":"Qwen3-VL Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.21631","snapshot_observed_at":"2026-08-06T14:28:24.411076Z","title":"2511.21631 , archivePrefix=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04885","last_updated":"2026-08-05T14:09:55Z","snapshot_observed_at":"2026-08-08T05:12:09.633349Z","submitted_at":"2026-08-05T14:09:55Z","title":"Evaluating the Diagnostic Robustness of Vision-Language Models Under Visual and Textual Perturbations","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-06T14:28:24.411076Z"},"links":{"cited_paper":"/paper/2511.21631","citing_paper":"/paper/2608.04885"},"observation_digest":"sha256:f94e219a7f72053ae1aa5a999c9800d0c4cfce142660910117319a6c1d6b3827","observation_id":"57405837-fe60-452c-b7dc-2d1f30f85add","resolution":{"observed_at":"2026-08-06T14:28:24.411076Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1609/aaai.v40i44.41142","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:28:25.062603Z","title":"2026 , month=","venue":null,"work_id":"d7c9c775-3c54-465b-ac65-a0b371e963ef","year":2026},"citing_paper":{"arxiv_id":"2608.04885","last_updated":"2026-08-05T14:09:55Z","snapshot_observed_at":"2026-08-08T05:12:09.633349Z","submitted_at":"2026-08-05T14:09:55Z","title":"Evaluating the Diagnostic Robustness of Vision-Language Models Under Visual and Textual Perturbations","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-06T14:28:24.598882Z"},"links":{"citing_paper":"/paper/2608.04885"},"observation_digest":"sha256:e0548a37fada3322c13034ce36c4b1aaa3b175848cb7a8b189c428cba1c6b671","observation_id":"3a80765e-208a-4785-bcb2-cb14d8693cce","resolution":{"observed_at":"2026-08-06T14:28:25.130990Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:28:24.694749Z","title":"2602.22955 , archivePrefix=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04885","last_updated":"2026-08-05T14:09:55Z","snapshot_observed_at":"2026-08-08T05:12:09.633349Z","submitted_at":"2026-08-05T14:09:55Z","title":"Evaluating the Diagnostic Robustness of Vision-Language Models Under Visual and Textual Perturbations","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-06T14:28:24.694749Z"},"links":{"citing_paper":"/paper/2608.04885"},"observation_digest":"sha256:31d04c9875cb49f5e3006d2ca275015d6739a4f6ae574eea35d84d34dcd68252","observation_id":"3bc42b65-9559-416b-97b5-e4fd22ebf2a7","resolution":{"observed_at":"2026-08-06T14:28:24.694749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:28:27.133256Z","title":"and Lupo, J.M","venue":null,"work_id":"9724ab6e-93c9-4e81-abf5-e3ef99180656","year":2007},"citing_paper":{"arxiv_id":"2608.04885","last_updated":"2026-08-05T14:09:55Z","snapshot_observed_at":"2026-08-08T05:12:09.633349Z","submitted_at":"2026-08-05T14:09:55Z","title":"Evaluating the Diagnostic Robustness of Vision-Language Models Under Visual and Textual Perturbations","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-06T14:28:24.791731Z"},"links":{"citing_paper":"/paper/2608.04885"},"observation_digest":"sha256:126b9d796c02b2c794e481e15d8a71960e200988bc5f7d763e6ca3af246ac27b","observation_id":"a793218c-24d5-4ae1-85c9-ecda150f10d0","resolution":{"observed_at":"2026-08-06T14:28:27.204170Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:28:24.864787Z","title":"doi:10.52202/079017-4455 , editor =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04885","last_updated":"2026-08-05T14:09:55Z","snapshot_observed_at":"2026-08-08T05:12:09.633349Z","submitted_at":"2026-08-05T14:09:55Z","title":"Evaluating the Diagnostic Robustness of Vision-Language Models Under Visual and Textual Perturbations","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-06T14:28:24.864787Z"},"links":{"citing_paper":"/paper/2608.04885"},"observation_digest":"sha256:937d11ce22cd68913b30b2cc44131f7dd067249765a8928c6313c2e63d1b4d7e","observation_id":"9dba628d-a02c-4b4f-a210-0d01b83f7a30","resolution":{"observed_at":"2026-08-06T14:28:24.864787Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.04885","last_updated":"2026-08-05T14:09:55Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-08T05:12:09.633349Z","submitted_at":"2026-08-05T14:09:55Z","title":"Evaluating the Diagnostic Robustness of Vision-Language Models Under Visual and Textual Perturbations"},"reference_resolution":{"displayed":22,"state_counts":{"malformed_identifier":0,"metadata_mismatch":3,"parse_uncertain":0,"unresolved":11,"verified_exact":2,"verified_fuzzy":6},"total_outbound_references":22},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 22 of 22 outbound references and 0 inbound Pith citation observations for arXiv:2608.04885."}