{"as_of":"2026-08-07T10:28:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f19756ba4c447c31d20d9723d6fcb258fe0ba64c8a24a5681cb502e5589e60a5","coverage":[{"denominator":51,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":51,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-27T09:30:47.726480Z","state":"measured"},{"denominator":51,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":51,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2606.12291/citation-record","integrity":"/paper/2606.12291/integrity","json":"/paper/2606.12291/citation-record.json","paper":"/paper/2606.12291"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:30:47.726480Z","title":"The evaluation illusion of large language models in medicine.npj Digital Medicine, 8(1):600, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.12291","last_updated":"2026-06-10T16:27:26Z","snapshot_observed_at":"2026-08-02T15:04:58.080617Z","submitted_at":"2026-06-10T16:27:26Z","title":"Measuring Epistemic Resilience of LLMs Under Misleading Medical Context","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-27T09:30:47.726480Z"},"links":{"citing_paper":"/paper/2606.12291"},"observation_digest":"sha256:f0975dd64fe34e4dc8361fceb8474bcf79616770f773406eb30760c27a808289","observation_id":"0c261a26-5299-4181-9e32-924ec78a814a","resolution":{"observed_at":"2026-06-27T09:30:47.726480Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:30:47.726480Z","title":"Introducing Claude Sonnet 4.6, February 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.12291","last_updated":"2026-06-10T16:27:26Z","snapshot_observed_at":"2026-08-02T15:04:58.080617Z","submitted_at":"2026-06-10T16:27:26Z","title":"Measuring Epistemic Resilience of LLMs Under Misleading Medical Context","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-27T09:30:47.726480Z"},"links":{"citing_paper":"/paper/2606.12291"},"observation_digest":"sha256:f3abf8102f65c5c97a0ee195116d799312519bbd57aa42d86b53cf9328789aad","observation_id":"b80a1a4e-76e0-4561-956d-3f49a38a89a9","resolution":{"observed_at":"2026-06-27T09:30:47.726480Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:30:47.726480Z","title":"Comparing physician and artificial intelligence chatbot responses to patient questions posted to a public social media forum.JAMA internal medicine, 183(6):589–596, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.12291","last_updated":"2026-06-10T16:27:26Z","snapshot_observed_at":"2026-08-02T15:04:58.080617Z","submitted_at":"2026-06-10T16:27:26Z","title":"Measuring Epistemic Resilience of LLMs Under Misleading Medical Context","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-27T09:30:47.726480Z"},"links":{"citing_paper":"/paper/2606.12291"},"observation_digest":"sha256:b2d3050920cdcad0133940a25124a9c9d353b0f62ee41e9ae7ba4fb7e424e0d1","observation_id":"f5a1742e-396c-4ff5-8470-868ed1648851","resolution":{"observed_at":"2026-06-27T09:30:47.726480Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2024.21700","doi":"10.1001/jama.2024.21700","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Fries, Michael Wornow, Akshay Swami- nathan, Lisa Soleymani Lehmann, Hyo Jung Hong, Mehr Kashyap, Akash R","venue":"JAMA","work_id":"cd445cd6-9a5e-40b1-92eb-5bb3df19fbb4","year":2025},"citing_paper":{"arxiv_id":"2606.12291","last_updated":"2026-06-10T16:27:26Z","snapshot_observed_at":"2026-08-02T15:04:58.080617Z","submitted_at":"2026-06-10T16:27:26Z","title":"Measuring Epistemic Resilience of LLMs Under Misleading Medical Context","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-27T09:30:47.726480Z"},"links":{"citing_paper":"/paper/2606.12291"},"observation_digest":"sha256:0286fe87b693d6aa26515c8af43593c4b53a5d79f68de213fc21a319881e743e","observation_id":"67e647d4-03be-4e73-b46b-8dba7ca2f750","resolution":{"observed_at":"2026-06-27T09:40:47.713725Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-05-25T16:53:45.252371+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-25T16:53:45.252371+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1038/s43856-024-00717-2","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"and Saba, Luca and Hadamitzky, Martin and Kather, Jakob Nikolas and Truhn, Daniel and Cuocolo, Renato and Adams, Lisa C","venue":"Communications Medicine","work_id":"5a19e86b-31d1-4d77-ad33-ef73f5ecdcc9","year":2025},"citing_paper":{"arxiv_id":"2606.12291","last_updated":"2026-06-10T16:27:26Z","snapshot_observed_at":"2026-08-02T15:04:58.080617Z","submitted_at":"2026-06-10T16:27:26Z","title":"Measuring Epistemic Resilience of LLMs Under Misleading Medical Context","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-27T09:30:47.726480Z"},"links":{"citing_paper":"/paper/2606.12291"},"observation_digest":"sha256:709cced861083a13a54474db06b277988afcb8f185baaeafc708cab26e953474","observation_id":"be36c7f0-cd1a-4761-99c8-606b73022289","resolution":{"observed_at":"2026-06-27T09:40:47.715756Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.12806","last_updated":"2023-12-20T07:01:49Z","snapshot_observed_at":"2026-08-05T10:00:04.639857Z","submitted_at":"2023-12-20T07:01:49Z","title":"MedBench: A Large-Scale Chinese Benchmark for Evaluating Medical Large Language Models","version":1},"cited_work":{"arxiv_id":"2312.12806","doi":"10.48550/arxiv.2312.12806","metadata_source":"arxiv_reference","pith_arxiv_id":"2312.12806","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Medbench: A large-scale chinese benchmark for evaluating medical large language models","venue":"arXiv (Cornell University)","work_id":"69c6b3f6-49db-4815-963a-20ea4eae386a","year":2023},"citing_paper":{"arxiv_id":"2606.12291","last_updated":"2026-06-10T16:27:26Z","snapshot_observed_at":"2026-08-02T15:04:58.080617Z","submitted_at":"2026-06-10T16:27:26Z","title":"Measuring Epistemic Resilience of LLMs Under Misleading Medical Context","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-27T09:30:47.726480Z"},"links":{"cited_paper":"/paper/2312.12806","citing_paper":"/paper/2606.12291"},"observation_digest":"sha256:230cf825c35b88c7822fba5e946f2b3918f57e977b05fd80bc93f00e1329709f","observation_id":"7e605dd6-e4a8-4331-bce0-cb9334308c6b","resolution":{"observed_at":"2026-06-27T09:40:47.726832Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1038/s41467-025-56989-2","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Singer, Xuguang Ai, Po-Ting Lai, Zhizheng Wang, et al","venue":"Nature Communications","work_id":"41f8c7d0-34dd-44ce-85a2-cbe6fe583ebb","year":2025},"citing_paper":{"arxiv_id":"2606.12291","last_updated":"2026-06-10T16:27:26Z","snapshot_observed_at":"2026-08-02T15:04:58.080617Z","submitted_at":"2026-06-10T16:27:26Z","title":"Measuring Epistemic Resilience of LLMs Under Misleading Medical Context","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-27T09:30:47.726480Z"},"links":{"citing_paper":"/paper/2606.12291"},"observation_digest":"sha256:a4f5cd1aaa20c330c504ab9e70ad191bb08d6f48e263921eab57f4544447c1ab","observation_id":"d577bdeb-c2e2-452a-bf3e-cec76a00e335","resolution":{"observed_at":"2026-06-27T09:40:47.729745Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2026.eacl-industry.39","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"M ed R isk E val: Medical Risk Evaluation Benchmark of Language Models, On the Importance of User Perspectives in Healthcare Settings","venue":null,"work_id":"33eca858-5a90-496b-b6df-ddc9c7a3025a","year":2026},"citing_paper":{"arxiv_id":"2606.12291","last_updated":"2026-06-10T16:27:26Z","snapshot_observed_at":"2026-08-02T15:04:58.080617Z","submitted_at":"2026-06-10T16:27:26Z","title":"Measuring Epistemic Resilience of LLMs Under Misleading Medical Context","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-27T09:30:47.726480Z"},"links":{"citing_paper":"/paper/2606.12291"},"observation_digest":"sha256:cd983ed177ee3785ad1d8fc8dbe7cbc3f3a4fc6450154f1f4df3ab95b2a0068e","observation_id":"1e241908-2353-4149-87e4-a074900d5322","resolution":{"observed_at":"2026-06-27T09:40:47.703992Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1038/s44360-026-00117-x","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Nour, Seth Spielman, Samuel F","venue":"Nature Health","work_id":"42d821d9-84b9-45a1-812c-b3b2c3b0ded2","year":2026},"citing_paper":{"arxiv_id":"2606.12291","last_updated":"2026-06-10T16:27:26Z","snapshot_observed_at":"2026-08-02T15:04:58.080617Z","submitted_at":"2026-06-10T16:27:26Z","title":"Measuring Epistemic Resilience of LLMs Under Misleading Medical Context","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-27T09:30:47.726480Z"},"links":{"citing_paper":"/paper/2606.12291"},"observation_digest":"sha256:7fb51c762e730d294aa5143b879cbce8ecdd76b873f7f822e8b07bdf4d4a11b9","observation_id":"719ec87d-f4b3-4372-be84-e1568a1de664","resolution":{"observed_at":"2026-06-27T09:40:47.717626Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-07-13T07:50:02.39144+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-13T07:50:02.39144+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.15594","doi":"10.48550/arxiv.2603.15594","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Openseeker: Democratizing frontier search agents by fully open-sourcing training data","venue":"arXiv (Cornell University)","work_id":"82630ffa-fbd5-4446-9af7-9d802ef3cbcb","year":2026},"citing_paper":{"arxiv_id":"2606.12291","last_updated":"2026-06-10T16:27:26Z","snapshot_observed_at":"2026-08-02T15:04:58.080617Z","submitted_at":"2026-06-10T16:27:26Z","title":"Measuring Epistemic Resilience of LLMs Under Misleading Medical Context","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-27T09:30:47.726480Z"},"links":{"citing_paper":"/paper/2606.12291"},"observation_digest":"sha256:8e768c532cbda84ba01f1b0eab0dd23bd1661c16b65e5292334e4ace6c6055e2","observation_id":"5351bece-dab5-4883-a7cc-6ef534825137","resolution":{"observed_at":"2026-06-27T09:40:47.720548Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:30:47.726480Z","title":"Gemini 3.1 Flash-Lite model card, March 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.12291","last_updated":"2026-06-10T16:27:26Z","snapshot_observed_at":"2026-08-02T15:04:58.080617Z","submitted_at":"2026-06-10T16:27:26Z","title":"Measuring Epistemic Resilience of LLMs Under Misleading Medical Context","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-27T09:30:47.726480Z"},"links":{"citing_paper":"/paper/2606.12291"},"observation_digest":"sha256:2bc9347b82cf515aee038e5857fec0a0a03d0cec08507db6e6cd7e8986462d99","observation_id":"540d2000-a428-44b9-ab3d-16b6a5dfff03","resolution":{"observed_at":"2026-06-27T09:30:47.726480Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:30:47.726480Z","title":"Gemini 3.1 Pro model card, February 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.12291","last_updated":"2026-06-10T16:27:26Z","snapshot_observed_at":"2026-08-02T15:04:58.080617Z","submitted_at":"2026-06-10T16:27:26Z","title":"Measuring Epistemic Resilience of LLMs Under Misleading Medical Context","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-27T09:30:47.726480Z"},"links":{"citing_paper":"/paper/2606.12291"},"observation_digest":"sha256:c66532a5c88ebccde55ffa0f7c4fb5f10c9d6fab0ab03a68fa572052359c8159","observation_id":"c5699b5a-6319-465d-be68-7fab4520da9c","resolution":{"observed_at":"2026-06-27T09:30:47.726480Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:30:47.726480Z","title":"Gemma 4 model card, April 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.12291","last_updated":"2026-06-10T16:27:26Z","snapshot_observed_at":"2026-08-02T15:04:58.080617Z","submitted_at":"2026-06-10T16:27:26Z","title":"Measuring Epistemic Resilience of LLMs Under Misleading Medical Context","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-27T09:30:47.726480Z"},"links":{"citing_paper":"/paper/2606.12291"},"observation_digest":"sha256:09f047cb5da4d8eb41f8c33dfc8168c308f76685c13e7d7de574841618e23ac3","observation_id":"27ac4c67-ad69-4624-9585-ed5d35d10b72","resolution":{"observed_at":"2026-06-27T09:30:47.726480Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"5764.362398","doi":"10.1145/3605764.3623985","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"InProceedings of the 16th ACM Workshop on Artificial Intelligence and Security (AISec @ CCS 2023)","venue":null,"work_id":"0b235739-d106-431c-aed9-3675d531c886","year":2023},"citing_paper":{"arxiv_id":"2606.12291","last_updated":"2026-06-10T16:27:26Z","snapshot_observed_at":"2026-08-02T15:04:58.080617Z","submitted_at":"2026-06-10T16:27:26Z","title":"Measuring Epistemic Resilience of LLMs Under Misleading Medical Context","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-27T09:30:47.726480Z"},"links":{"citing_paper":"/paper/2606.12291"},"observation_digest":"sha256:0dea48de14f42d2726698ace25cb88dd7a8f8fad2b38aed59a48a81862584172","observation_id":"7a4ed9e4-0b01-4fca-b6dc-362ca410d226","resolution":{"observed_at":"2026-06-27T09:40:47.665521Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-07-12T05:19:17.163767+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T05:19:17.163767+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1038/s41746-024-01282-7","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Bressem, Jakob Niko- las Kather, and Daniel Truhn","venue":"npj Digital Medicine","work_id":"1496c47b-2a02-4708-94ab-ebf60e187a65","year":2024},"citing_paper":{"arxiv_id":"2606.12291","last_updated":"2026-06-10T16:27:26Z","snapshot_observed_at":"2026-08-02T15:04:58.080617Z","submitted_at":"2026-06-10T16:27:26Z","title":"Measuring Epistemic Resilience of LLMs Under Misleading Medical Context","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-27T09:30:47.726480Z"},"links":{"citing_paper":"/paper/2606.12291"},"observation_digest":"sha256:15eef4bb297fe8345d30e80717472e06f061241dcecab611b7ddf05687db0fa4","observation_id":"32c75ced-a565-4b9f-9ea8-459d041a706b","resolution":{"observed_at":"2026-06-27T09:40:47.671155Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14654","last_updated":"2025-02-12T05:32:07Z","snapshot_observed_at":"2026-07-06T20:25:40.715105Z","submitted_at":"2025-01-24T17:21:01Z","title":"MedAgentBench: A Realistic Virtual EHR Environment to Benchmark Medical LLM Agents","version":2},"cited_work":{"arxiv_id":"2501.14654","doi":"10.48550/arxiv.2501.14654","metadata_source":"arxiv_reference","pith_arxiv_id":"2501.14654","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"and Geng, Gloria and Park, Danny and Zou, James and Ng, Andrew Y","venue":"ArXiv.org","work_id":"52ee24a4-e815-4788-8c57-f947197cc09e","year":2025},"citing_paper":{"arxiv_id":"2606.12291","last_updated":"2026-06-10T16:27:26Z","snapshot_observed_at":"2026-08-02T15:04:58.080617Z","submitted_at":"2026-06-10T16:27:26Z","title":"Measuring Epistemic Resilience of LLMs Under Misleading Medical Context","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-27T09:30:47.726480Z"},"links":{"cited_paper":"/paper/2501.14654","citing_paper":"/paper/2606.12291"},"observation_digest":"sha256:d609236e438b4c0db7d04108326c45174987e70c05864adf644c4c5397b46cf1","observation_id":"1c4768a3-0fc8-408c-9191-6c9e5ae83fe9","resolution":{"observed_at":"2026-06-27T09:40:47.682854Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.3390/app11146421","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"What disease does this patient have? A large-scale open domain question answering dataset from medical exams.Applied Sciences, 11(14):6421","venue":"Applied Sciences","work_id":"8f5486db-de55-4505-948e-e05912d36328","year":2021},"citing_paper":{"arxiv_id":"2606.12291","last_updated":"2026-06-10T16:27:26Z","snapshot_observed_at":"2026-08-02T15:04:58.080617Z","submitted_at":"2026-06-10T16:27:26Z","title":"Measuring Epistemic Resilience of LLMs Under Misleading Medical Context","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-27T09:30:47.726480Z"},"links":{"citing_paper":"/paper/2606.12291"},"observation_digest":"sha256:54850df8fc346adfb2a908f5d5aab7fddd0fd5c78f3e0731769be083c727ad2c","observation_id":"4a51a8e8-4057-411b-a30a-9ff8d7640f71","resolution":{"observed_at":"2026-06-27T09:40:47.679630Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-05-30T11:25:12.258303+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-30T11:25:12.258303+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1038/s41746-025-01519-z","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"H., et al","venue":"npj Digital Medicine","work_id":"c1117a0c-e6ba-494c-8809-77a7658707c8","year":2025},"citing_paper":{"arxiv_id":"2606.12291","last_updated":"2026-06-10T16:27:26Z","snapshot_observed_at":"2026-08-02T15:04:58.080617Z","submitted_at":"2026-06-10T16:27:26Z","title":"Measuring Epistemic Resilience of LLMs Under Misleading Medical Context","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-27T09:30:47.726480Z"},"links":{"citing_paper":"/paper/2606.12291"},"observation_digest":"sha256:6fd35d6c05a5b5a616bef405a80847b4eaa795d4c5b3b54d7596159a6d7a9287","observation_id":"58b18d2e-4f74-41c8-aaf5-84660a3342ab","resolution":{"observed_at":"2026-06-27T09:40:47.657248Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1038/s41467-026-71622-6","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Evaluating clinical competencies of large language models with a general practice benchmark.Nature Communications, 2026","venue":"Nature Communications","work_id":"d7214531-4cf2-4505-bac7-40879e96dd39","year":2026},"citing_paper":{"arxiv_id":"2606.12291","last_updated":"2026-06-10T16:27:26Z","snapshot_observed_at":"2026-08-02T15:04:58.080617Z","submitted_at":"2026-06-10T16:27:26Z","title":"Measuring Epistemic Resilience of LLMs Under Misleading Medical Context","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-27T09:30:47.726480Z"},"links":{"citing_paper":"/paper/2606.12291"},"observation_digest":"sha256:48591bbd61aad3fd842deda0bf6e74b9c058d03333a1d8d56a942b8526293d68","observation_id":"89a3a225-a350-4a6e-a4bc-33a2f0d0ab4e","resolution":{"observed_at":"2026-06-27T09:40:47.668222Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2024.emnlp-main.759","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":null,"venue":null,"work_id":"e7272151-5580-4c92-b6f1-09ee4eb505c1","year":2024},"citing_paper":{"arxiv_id":"2606.12291","last_updated":"2026-06-10T16:27:26Z","snapshot_observed_at":"2026-08-02T15:04:58.080617Z","submitted_at":"2026-06-10T16:27:26Z","title":"Measuring Epistemic Resilience of LLMs Under Misleading Medical Context","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-27T09:30:47.726480Z"},"links":{"citing_paper":"/paper/2606.12291"},"observation_digest":"sha256:59ef7cbce9cbbc33d8a20521ed6ea32848094b0825c76bb881869316c893a024","observation_id":"1a051535-a6c0-4d00-84d3-dc346cc526ad","resolution":{"observed_at":"2026-06-27T09:40:47.659138Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1038/s44222-0","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:40:47.659691Z","title":"Chen, Yining Hua, Peilin Zhou, Junling Liu, Chengfeng Mao, Chenyu You, Xian Wu, Yefeng Zheng, Lei Clifton, Zheng Li, Jiebo Luo, and David A","venue":null,"work_id":"09947856-bd52-4af6-b0d3-975f34edb76f","year":2025},"citing_paper":{"arxiv_id":"2606.12291","last_updated":"2026-06-10T16:27:26Z","snapshot_observed_at":"2026-08-02T15:04:58.080617Z","submitted_at":"2026-06-10T16:27:26Z","title":"Measuring Epistemic Resilience of LLMs Under Misleading Medical Context","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-27T09:30:47.726480Z"},"links":{"citing_paper":"/paper/2606.12291"},"observation_digest":"sha256:85c9f9c834927c0cec43fd549bf5344c1f500dea7df6741f57478dd2f09faa11","observation_id":"9e798e51-8f1c-4fb7-9a37-9cf94bc46b4f","resolution":{"observed_at":"2026-06-27T09:40:47.661074Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:30:47.726480Z","title":"Benchmarking large language models on CMExam - A comprehensive chinese medical exam dataset","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.12291","last_updated":"2026-06-10T16:27:26Z","snapshot_observed_at":"2026-08-02T15:04:58.080617Z","submitted_at":"2026-06-10T16:27:26Z","title":"Measuring Epistemic Resilience of LLMs Under Misleading Medical Context","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-27T09:30:47.726480Z"},"links":{"citing_paper":"/paper/2606.12291"},"observation_digest":"sha256:569175c4363f0310ac24c0478317edd8463cd096bde3c6c88f0d24c43ef900d3","observation_id":"3b68e594-aaad-45d0-851a-2c5d26fc447e","resolution":{"observed_at":"2026-06-27T09:30:47.726480Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1038/s41746-026-02443-6","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Carrero, Xiaofeng Jiang, Dyke Ferber, Georg Wölflein, Li Zhang, Sanddhya Jayabalan, Tim Lenz, Zhouguang Hui, et al","venue":"npj Digital Medicine","work_id":"000086e8-fe7f-4e8a-b3f2-e00524a49084","year":2026},"citing_paper":{"arxiv_id":"2606.12291","last_updated":"2026-06-10T16:27:26Z","snapshot_observed_at":"2026-08-02T15:04:58.080617Z","submitted_at":"2026-06-10T16:27:26Z","title":"Measuring Epistemic Resilience of LLMs Under Misleading Medical Context","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-27T09:30:47.726480Z"},"links":{"citing_paper":"/paper/2606.12291"},"observation_digest":"sha256:c2109eba35e4e5a7199a87ccf0f2a5bd62a64e13b367c504f8218f38eb14e60e","observation_id":"38bcec30-d012-4b2e-a991-839b04c20f97","resolution":{"observed_at":"2026-06-27T09:40:47.653523Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.04325","last_updated":"2026-04-29T05:46:18Z","snapshot_observed_at":"2026-08-02T07:50:38.917887Z","submitted_at":"2025-08-06T11:11:40Z","title":"Beyond the Leaderboard: Rethinking Medical Benchmarks for Large Language Models","version":2},"cited_work":{"arxiv_id":"2508.04325","doi":"10.48550/arxiv.2508.04325","metadata_source":"pith","pith_arxiv_id":"2508.04325","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Beyond the Leaderboard: Rethinking Medical Benchmarks for Large Language Models","venue":"cs.CL","work_id":"b3c260eb-e603-4976-a6db-d6397c4dbe83","year":2025},"citing_paper":{"arxiv_id":"2606.12291","last_updated":"2026-06-10T16:27:26Z","snapshot_observed_at":"2026-08-02T15:04:58.080617Z","submitted_at":"2026-06-10T16:27:26Z","title":"Measuring Epistemic Resilience of LLMs Under Misleading Medical Context","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-27T09:30:47.726480Z"},"links":{"cited_paper":"/paper/2508.04325","citing_paper":"/paper/2606.12291"},"observation_digest":"sha256:16c145900f9b34ff373c81e959ae382e266ee9a0491fdefeed16efbed154ef60","observation_id":"b64375e8-78c7-4159-b8ff-7db14240cf13","resolution":{"observed_at":"2026-06-27T09:40:47.697055Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.06837","last_updated":"2026-04-21T13:20:31Z","snapshot_observed_at":"2026-07-06T19:48:23.999337Z","submitted_at":"2024-11-11T10:05:52Z","title":"Persuasion with Large Language Models: A Survey of Empirical Evidence, Study Methodologies, and Ethical Implications","version":2},"cited_work":{"arxiv_id":"2411.06837","doi":"10.48550/arxiv.2411.06837","metadata_source":"pith","pith_arxiv_id":"2411.06837","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Persuasion with Large Language Models: A Survey of Empirical Evidence, Study Methodologies, and Ethical Implications","venue":"cs.CL","work_id":"c9fd9f2e-57ac-4142-9824-724ae358dd84","year":2024},"citing_paper":{"arxiv_id":"2606.12291","last_updated":"2026-06-10T16:27:26Z","snapshot_observed_at":"2026-08-02T15:04:58.080617Z","submitted_at":"2026-06-10T16:27:26Z","title":"Measuring Epistemic Resilience of LLMs Under Misleading Medical Context","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-27T09:30:47.726480Z"},"links":{"cited_paper":"/paper/2411.06837","citing_paper":"/paper/2606.12291"},"observation_digest":"sha256:48359384d58dc97d1ec79a0072af3960337d70bf4e53c21214ccead30ae372ce","observation_id":"66d22251-a305-46e8-86ef-e56236d08886","resolution":{"observed_at":"2026-06-27T09:40:47.674649Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-06-01T21:25:52.843264+00:00","source":"crossref_status_cache"},{"observed_at":"2026-06-01T21:25:52.843264+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.13375","last_updated":"2023-04-12T16:48:39Z","snapshot_observed_at":"2026-07-06T15:07:11.623462Z","submitted_at":"2023-03-20T16:18:38Z","title":"Capabilities of GPT-4 on Medical Challenge Problems","version":2},"cited_work":{"arxiv_id":"2303.13375","doi":"10.48550/arxiv.2303.13375","metadata_source":"pith","pith_arxiv_id":"2303.13375","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Capabilities of GPT-4 on Medical Challenge Problems","venue":"cs.CL","work_id":"b8eb14ee-3d13-45e1-a013-3ddefdd77f6f","year":2023},"citing_paper":{"arxiv_id":"2606.12291","last_updated":"2026-06-10T16:27:26Z","snapshot_observed_at":"2026-08-02T15:04:58.080617Z","submitted_at":"2026-06-10T16:27:26Z","title":"Measuring Epistemic Resilience of LLMs Under Misleading Medical Context","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-27T09:30:47.726480Z"},"links":{"cited_paper":"/paper/2303.13375","citing_paper":"/paper/2606.12291"},"observation_digest":"sha256:7723ae4eb79f86950482a4bc0d15a617c7871ad3e6e2c8158c55657cfe0ff8d9","observation_id":"1d8fef7f-8bf1-4cd9-8e4e-b071d2fb5167","resolution":{"observed_at":"2026-06-27T09:40:47.694621Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2025.100949","doi":"10.1016/j.landig.2025.100949","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Wieler, Alexander W","venue":"The Lancet Digital Health","work_id":"575c5109-336e-433d-9dcf-a81134cc1524","year":2026},"citing_paper":{"arxiv_id":"2606.12291","last_updated":"2026-06-10T16:27:26Z","snapshot_observed_at":"2026-08-02T15:04:58.080617Z","submitted_at":"2026-06-10T16:27:26Z","title":"Measuring Epistemic Resilience of LLMs Under Misleading Medical Context","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-27T09:30:47.726480Z"},"links":{"citing_paper":"/paper/2606.12291"},"observation_digest":"sha256:a2716570205912d5c93de006f6afdf2e39d18aa71abb7e76397ce944f5a8820b","observation_id":"d88b5189-5ad4-4e53-9185-0cd2cf898024","resolution":{"observed_at":"2026-06-27T09:40:47.688112Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-05-25T16:53:35.026849+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-25T16:53:35.026849+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:30:47.726480Z","title":"Introducing HealthBench, May 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.12291","last_updated":"2026-06-10T16:27:26Z","snapshot_observed_at":"2026-08-02T15:04:58.080617Z","submitted_at":"2026-06-10T16:27:26Z","title":"Measuring Epistemic Resilience of LLMs Under Misleading Medical Context","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-27T09:30:47.726480Z"},"links":{"citing_paper":"/paper/2606.12291"},"observation_digest":"sha256:025d99d08757c235642e10f33352e36f93889181ae94cbbf5905d0b73e680040","observation_id":"5148f2fd-5fa3-4acf-8a4f-09af51f4093f","resolution":{"observed_at":"2026-06-27T09:30:47.726480Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:30:47.726480Z","title":"Introducing ChatGPT health, January 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.12291","last_updated":"2026-06-10T16:27:26Z","snapshot_observed_at":"2026-08-02T15:04:58.080617Z","submitted_at":"2026-06-10T16:27:26Z","title":"Measuring Epistemic Resilience of LLMs Under Misleading Medical Context","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-06-27T09:30:47.726480Z"},"links":{"citing_paper":"/paper/2606.12291"},"observation_digest":"sha256:e412047727144c4d0b96211b6f1ff138485de207785600528082e21413c89115","observation_id":"a7a54846-05e7-43af-ab70-764dbaacd8e6","resolution":{"observed_at":"2026-06-27T09:30:47.726480Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:30:47.726480Z","title":"Introducing GPT-5.4, March 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.12291","last_updated":"2026-06-10T16:27:26Z","snapshot_observed_at":"2026-08-02T15:04:58.080617Z","submitted_at":"2026-06-10T16:27:26Z","title":"Measuring Epistemic Resilience of LLMs Under Misleading Medical Context","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-27T09:30:47.726480Z"},"links":{"citing_paper":"/paper/2606.12291"},"observation_digest":"sha256:ef7c6f9dd9df53b41ef5868ab89355d4e09fd68a5b2a173cee4232736f5e013d","observation_id":"941e6f5f-006e-42ee-abf5-c930b369fb1a","resolution":{"observed_at":"2026-06-27T09:30:47.726480Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:30:47.726480Z","title":"Medmcqa: A large-scale multi-subject multi-choice dataset for medical domain question answering","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.12291","last_updated":"2026-06-10T16:27:26Z","snapshot_observed_at":"2026-08-02T15:04:58.080617Z","submitted_at":"2026-06-10T16:27:26Z","title":"Measuring Epistemic Resilience of LLMs Under Misleading Medical Context","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-06-27T09:30:47.726480Z"},"links":{"citing_paper":"/paper/2606.12291"},"observation_digest":"sha256:8db9e207ee6815d19e04387417e45d309ea095b4de1e1c4f8093f30709f4c110","observation_id":"49d70b12-958a-434a-ab60-021c82fb2059","resolution":{"observed_at":"2026-06-27T09:30:47.726480Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2023.findings-acl.847","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T00:44:06.790973Z","title":"Bowman, Amanda Askell, Roger Grosse, Danny Hernandez, Deep Ganguli, Evan Hubinger, Nicholas Schiefer, and Jared Kaplan","venue":"Findings of the Association for Computational Linguistics: ACL 2023","work_id":"14e488cd-6766-46f9-8d82-99f460765fc6","year":2023},"citing_paper":{"arxiv_id":"2606.12291","last_updated":"2026-06-10T16:27:26Z","snapshot_observed_at":"2026-08-02T15:04:58.080617Z","submitted_at":"2026-06-10T16:27:26Z","title":"Measuring Epistemic Resilience of LLMs Under Misleading Medical Context","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-06-27T09:30:47.726480Z"},"links":{"citing_paper":"/paper/2606.12291"},"observation_digest":"sha256:44f2aeba78b8ee061e074b1e25ab67a21c80292f6eb48772ba1a6406ac6f50df","observation_id":"c8402bc5-06b9-45e1-b2f0-a77ca98e549d","resolution":{"observed_at":"2026-06-27T09:40:47.692104Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-01T07:38:14.319341+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T07:38:14.319341+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:30:47.726480Z","title":"A benchmark of expert-level academic questions to assess ai capabilities.Nature, 649(8099):1139–1146, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.12291","last_updated":"2026-06-10T16:27:26Z","snapshot_observed_at":"2026-08-02T15:04:58.080617Z","submitted_at":"2026-06-10T16:27:26Z","title":"Measuring Epistemic Resilience of LLMs Under Misleading Medical Context","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-06-27T09:30:47.726480Z"},"links":{"citing_paper":"/paper/2606.12291"},"observation_digest":"sha256:90b7579fb58fc7a522d5d2dde96d67ed062ef264d525a048cd2f5961a5b7e42e","observation_id":"0ab6ef48-f502-416c-9af1-027bd2548c5f","resolution":{"observed_at":"2026-06-27T09:30:47.726480Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:30:47.726480Z","title":"Qwen3.6-35B-A3B: Agentic coding power, now open to all, April 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.12291","last_updated":"2026-06-10T16:27:26Z","snapshot_observed_at":"2026-08-02T15:04:58.080617Z","submitted_at":"2026-06-10T16:27:26Z","title":"Measuring Epistemic Resilience of LLMs Under Misleading Medical Context","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-06-27T09:30:47.726480Z"},"links":{"citing_paper":"/paper/2606.12291"},"observation_digest":"sha256:67d7cd03cb8954f7e76502439c20e16f94df5005ce62f9c56f8b948f439c2d43","observation_id":"544ca31a-b033-459b-9e6a-345ab9c37178","resolution":{"observed_at":"2026-06-27T09:30:47.726480Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1001/jamanetwor","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:40:47.688688Z","title":"Rao, Kaiz P","venue":null,"work_id":"3537d517-dc9c-45cb-af84-00d1ac7a69c6","year":2026},"citing_paper":{"arxiv_id":"2606.12291","last_updated":"2026-06-10T16:27:26Z","snapshot_observed_at":"2026-08-02T15:04:58.080617Z","submitted_at":"2026-06-10T16:27:26Z","title":"Measuring Epistemic Resilience of LLMs Under Misleading Medical Context","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-06-27T09:30:47.726480Z"},"links":{"citing_paper":"/paper/2606.12291"},"observation_digest":"sha256:3155f3d4e1e0b9975957422c9898a04739db79d5e591b7d2fcc96bba96e5b576","observation_id":"d825c699-3e00-43b2-b048-d8e047d718f7","resolution":{"observed_at":"2026-06-27T09:40:47.689981Z","resolver_source":"doi_truncated","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.07960","last_updated":"2025-05-25T02:19:37Z","snapshot_observed_at":"2026-07-30T08:34:47.046912Z","submitted_at":"2024-05-13T17:38:53Z","title":"AgentClinic: a multimodal agent benchmark to evaluate AI in simulated clinical environments","version":5},"cited_work":{"arxiv_id":"2405.07960","doi":"10.48550/arxiv.2405.07960","metadata_source":"pith","pith_arxiv_id":"2405.07960","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"AgentClinic: a multimodal agent benchmark to evaluate AI in simulated clinical environments","venue":"cs.HC","work_id":"418a0992-6f06-45f9-958d-cfdfc51c72af","year":2024},"citing_paper":{"arxiv_id":"2606.12291","last_updated":"2026-06-10T16:27:26Z","snapshot_observed_at":"2026-08-02T15:04:58.080617Z","submitted_at":"2026-06-10T16:27:26Z","title":"Measuring Epistemic Resilience of LLMs Under Misleading Medical Context","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-06-27T09:30:47.726480Z"},"links":{"cited_paper":"/paper/2405.07960","citing_paper":"/paper/2606.12291"},"observation_digest":"sha256:019111c3454f4afcc423c2774b39f48ff4bc65f0935e574ddc181f6eae37f843","observation_id":"b4f2261e-e04c-4420-869d-b162aede1ea0","resolution":{"observed_at":"2026-06-27T09:40:47.651478Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.05201","last_updated":"2026-04-06T19:50:20Z","snapshot_observed_at":"2026-08-02T22:39:49.756195Z","submitted_at":"2025-07-07T17:01:44Z","title":"MedGemma Technical Report","version":4},"cited_work":{"arxiv_id":"2507.05201","doi":"10.48550/arxiv.2507.05201","metadata_source":"pith","pith_arxiv_id":"2507.05201","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"MedGemma Technical Report","venue":"cs.AI","work_id":"3d3f25c0-31e8-4859-bb3d-0d719b47a63d","year":2025},"citing_paper":{"arxiv_id":"2606.12291","last_updated":"2026-06-10T16:27:26Z","snapshot_observed_at":"2026-08-02T15:04:58.080617Z","submitted_at":"2026-06-10T16:27:26Z","title":"Measuring Epistemic Resilience of LLMs Under Misleading Medical Context","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-06-27T09:30:47.726480Z"},"links":{"cited_paper":"/paper/2507.05201","citing_paper":"/paper/2606.12291"},"observation_digest":"sha256:1e1e792934b61269e4245276859ecfd09e2322d4b4186cd15e041425ad369c78","observation_id":"75acb012-7971-4e53-ac1e-1ca640badf4b","resolution":{"observed_at":"2026-07-03T11:28:04.906945Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.05201","last_updated":"2026-04-06T19:50:20Z","snapshot_observed_at":"2026-08-02T22:39:49.756195Z","submitted_at":"2025-07-07T17:01:44Z","title":"MedGemma Technical Report","version":4},"cited_work":{"arxiv_id":"2507.05201","doi":"10.48550/arxiv.2507.05201","metadata_source":"pith","pith_arxiv_id":"2507.05201","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"MedGemma Technical Report","venue":"cs.AI","work_id":"3d3f25c0-31e8-4859-bb3d-0d719b47a63d","year":2025},"citing_paper":{"arxiv_id":"2606.12291","last_updated":"2026-06-10T16:27:26Z","snapshot_observed_at":"2026-08-02T15:04:58.080617Z","submitted_at":"2026-06-10T16:27:26Z","title":"Measuring Epistemic Resilience of LLMs Under Misleading Medical Context","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-06-27T09:30:47.726480Z"},"links":{"cited_paper":"/paper/2507.05201","citing_paper":"/paper/2606.12291"},"observation_digest":"sha256:6824183bace78db0e043e6265064d42e3d77b5b1ca30063ca9154db367605160","observation_id":"88941836-0bfd-4bf4-97ac-daacae0e5e87","resolution":{"observed_at":"2026-06-27T09:40:47.701506Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:30:47.726480Z","title":"Bowman, Esin Durmus, Zac Hatfield-Dodds, Scott R","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.12291","last_updated":"2026-06-10T16:27:26Z","snapshot_observed_at":"2026-08-02T15:04:58.080617Z","submitted_at":"2026-06-10T16:27:26Z","title":"Measuring Epistemic Resilience of LLMs Under Misleading Medical Context","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-06-27T09:30:47.726480Z"},"links":{"citing_paper":"/paper/2606.12291"},"observation_digest":"sha256:34f0fe06ccafcaf57bb666e672afdcaaaf05691f75ab80e0714790a75fbf6e5c","observation_id":"6bad8ac1-4d39-4408-94d6-2d1db9c1f87d","resolution":{"observed_at":"2026-06-27T09:30:47.726480Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1038/s41586-023-06291-2","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T21:07:34.713492Z","title":"Large Language Models Encode Clinical Knowledge","venue":"Nature","work_id":"bd063ed4-6265-4e11-8cf5-208f7e1432ac","year":2023},"citing_paper":{"arxiv_id":"2606.12291","last_updated":"2026-06-10T16:27:26Z","snapshot_observed_at":"2026-08-02T15:04:58.080617Z","submitted_at":"2026-06-10T16:27:26Z","title":"Measuring Epistemic Resilience of LLMs Under Misleading Medical Context","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-06-27T09:30:47.726480Z"},"links":{"citing_paper":"/paper/2606.12291"},"observation_digest":"sha256:be5682bcf5e657807e61d16415944ac0ffb903d3266f6a32d03cf9dc1a024823","observation_id":"e86c6f93-bb8b-420f-adee-b5903f9810c6","resolution":{"observed_at":"2026-06-27T09:40:47.685587Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[{"edge_observation":{"observed_at":"2026-07-11T03:19:08.01801+00:00","source":"paper_reference_links","state":"open"},"event_date":"2023-07-27","event_type":"correction","notice_doi":"10.1038/s41586-023-06455-0","provenance":{"observed_at":"2026-07-11T03:08:19.417011+00:00","source":"crossref","source_record_id":"10.1038/s41586-023-06455-0->10.1038/s41586-023-06291-2:correction"}}],"reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:30:47.726480Z","title":"Toward expert-level medical question answering with large language models.Nature medicine, 31(3):943–950, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.12291","last_updated":"2026-06-10T16:27:26Z","snapshot_observed_at":"2026-08-02T15:04:58.080617Z","submitted_at":"2026-06-10T16:27:26Z","title":"Measuring Epistemic Resilience of LLMs Under Misleading Medical Context","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-06-27T09:30:47.726480Z"},"links":{"citing_paper":"/paper/2606.12291"},"observation_digest":"sha256:a2594c3ecc70f5c7ab9dd5fe2ff262d4919e49d80b78bc1cc36b0015f9ac7e4c","observation_id":"1f9089c2-00cb-4e96-81e9-ee9bd8b32776","resolution":{"observed_at":"2026-06-27T09:30:47.726480Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1038/s41591-023-02448-8","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"J., Ting, D","venue":"Nature Medicine","work_id":"455bed75-7347-42ce-b0e6-9a1a44fb18d6","year":1930},"citing_paper":{"arxiv_id":"2606.12291","last_updated":"2026-06-10T16:27:26Z","snapshot_observed_at":"2026-08-02T15:04:58.080617Z","submitted_at":"2026-06-10T16:27:26Z","title":"Measuring Epistemic Resilience of LLMs Under Misleading Medical Context","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-06-27T09:30:47.726480Z"},"links":{"citing_paper":"/paper/2606.12291"},"observation_digest":"sha256:8332f704a9aa20027f8aabadc1e08aa42cefde3bab3627e9106d842375af6752","observation_id":"06564744-66fb-43d8-9e4a-068065fa7b05","resolution":{"observed_at":"2026-06-27T09:40:47.677277Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-07-11T03:19:02.703283+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T03:19:02.703283+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:30:47.726480Z","title":"Scientists invented a fake disease","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.12291","last_updated":"2026-06-10T16:27:26Z","snapshot_observed_at":"2026-08-02T15:04:58.080617Z","submitted_at":"2026-06-10T16:27:26Z","title":"Measuring Epistemic Resilience of LLMs Under Misleading Medical Context","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-06-27T09:30:47.726480Z"},"links":{"citing_paper":"/paper/2606.12291"},"observation_digest":"sha256:924a808853813aa358fb1306f1ce154df73e1df65aad8d701b7b9fa30bceb2f8","observation_id":"2b451404-2d67-4e8f-8c24-2c9344267af2","resolution":{"observed_at":"2026-06-27T09:30:47.726480Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1038/s41586-025-08866-7","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Sara Mahdavi, Christoph er Semturs, Juraj Gottweis, Joelle Barral, Katherine Chou, Greg S","venue":"Nature","work_id":"c8c267ac-84c8-4698-ae59-76dcf1455aa7","year":2025},"citing_paper":{"arxiv_id":"2606.12291","last_updated":"2026-06-10T16:27:26Z","snapshot_observed_at":"2026-08-02T15:04:58.080617Z","submitted_at":"2026-06-10T16:27:26Z","title":"Measuring Epistemic Resilience of LLMs Under Misleading Medical Context","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-06-27T09:30:47.726480Z"},"links":{"citing_paper":"/paper/2606.12291"},"observation_digest":"sha256:2b51c41cac7b5d1e8981ba2847ea687fcce069cb746dc50412fdbfafe26c2cd0","observation_id":"56da7f00-9808-4575-ae31-8c6dedc8d968","resolution":{"observed_at":"2026-06-27T09:40:47.665957Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-07-18T07:51:13.997492+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-18T07:51:13.997492+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:30:47.726480Z","title":"A novel evaluation benchmark for medical llms illuminating safety and effectiveness in clinical domains.npj Digital Medicine, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.12291","last_updated":"2026-06-10T16:27:26Z","snapshot_observed_at":"2026-08-02T15:04:58.080617Z","submitted_at":"2026-06-10T16:27:26Z","title":"Measuring Epistemic Resilience of LLMs Under Misleading Medical Context","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-06-27T09:30:47.726480Z"},"links":{"citing_paper":"/paper/2606.12291"},"observation_digest":"sha256:fcdba36f38fbf53c977f128a3a5be5c51b7562c4ac6ecce8ff45586e15b2a1c3","observation_id":"246cfae3-a8c3-4950-b0f6-6006f339bc29","resolution":{"observed_at":"2026-06-27T09:30:47.726480Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:30:47.726480Z","title":"Understanding the infodemic and misinformation in the fight against COVID-19, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.12291","last_updated":"2026-06-10T16:27:26Z","snapshot_observed_at":"2026-08-02T15:04:58.080617Z","submitted_at":"2026-06-10T16:27:26Z","title":"Measuring Epistemic Resilience of LLMs Under Misleading Medical Context","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-06-27T09:30:47.726480Z"},"links":{"citing_paper":"/paper/2606.12291"},"observation_digest":"sha256:52f9489d483408584ba895c07511fb98a4ee993c6d90922dd368fa855cf6304b","observation_id":"6c145b93-6c3a-40ee-81fb-08fbd133268c","resolution":{"observed_at":"2026-06-27T09:30:47.726480Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:30:47.726480Z","title":"Medjourney: Benchmark and evaluation of large language models over patient clinical journey.Advances in Neural Information Processing Systems, 37:87621–87646, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.12291","last_updated":"2026-06-10T16:27:26Z","snapshot_observed_at":"2026-08-02T15:04:58.080617Z","submitted_at":"2026-06-10T16:27:26Z","title":"Measuring Epistemic Resilience of LLMs Under Misleading Medical Context","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-06-27T09:30:47.726480Z"},"links":{"citing_paper":"/paper/2606.12291"},"observation_digest":"sha256:f21fc68d54968ab86a7a578c9e7373e9ab11337cca607196957956edc1d7cb01","observation_id":"b3f29295-7fea-479c-ab2e-e5a41d1454a2","resolution":{"observed_at":"2026-06-27T09:30:47.726480Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1038/s44401-024-00004-1","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"npj Health Systems 2025 2:1 2:2-","venue":"npj Health Systems","work_id":"f55d5217-62ad-461f-9c9c-6794dc2f3d37","year":2025},"citing_paper":{"arxiv_id":"2606.12291","last_updated":"2026-06-10T16:27:26Z","snapshot_observed_at":"2026-08-02T15:04:58.080617Z","submitted_at":"2026-06-10T16:27:26Z","title":"Measuring Epistemic Resilience of LLMs Under Misleading Medical Context","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-06-27T09:30:47.726480Z"},"links":{"citing_paper":"/paper/2606.12291"},"observation_digest":"sha256:8affb517a71c6a2fa40a82ba6463fc3b2fb5044551791753e3513e1d86308ce0","observation_id":"02ea82fb-5be2-413e-813c-a31f49c1b078","resolution":{"observed_at":"2026-06-27T09:40:47.655715Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:30:47.726480Z","title":"React: Synergizing reasoning and acting in language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.12291","last_updated":"2026-06-10T16:27:26Z","snapshot_observed_at":"2026-08-02T15:04:58.080617Z","submitted_at":"2026-06-10T16:27:26Z","title":"Measuring Epistemic Resilience of LLMs Under Misleading Medical Context","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-06-27T09:30:47.726480Z"},"links":{"citing_paper":"/paper/2606.12291"},"observation_digest":"sha256:dd612d963285be3247287a0bc614bddef615bb96797bc657fcf4076d402b4b14","observation_id":"375f9888-66cb-4d10-8354-53ba2a5d62de","resolution":{"observed_at":"2026-06-27T09:30:47.726480Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:30:47.726480Z","title":"PoisonedRAG: Knowledge corruption attacks to Retrieval-Augmented generation of large language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.12291","last_updated":"2026-06-10T16:27:26Z","snapshot_observed_at":"2026-08-02T15:04:58.080617Z","submitted_at":"2026-06-10T16:27:26Z","title":"Measuring Epistemic Resilience of LLMs Under Misleading Medical Context","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-06-27T09:30:47.726480Z"},"links":{"citing_paper":"/paper/2606.12291"},"observation_digest":"sha256:c42d57f3613ee163df4ab882d6b8c419cdf3fb117af246198e7827d7925167ba","observation_id":"1476ca49-19fc-46c6-930f-65b89229fa44","resolution":{"observed_at":"2026-06-27T09:30:47.726480Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.18362","last_updated":"2025-06-06T13:00:07Z","snapshot_observed_at":"2026-07-06T20:28:24.203633Z","submitted_at":"2025-01-30T14:07:56Z","title":"MedXpertQA: Benchmarking Expert-Level Medical Reasoning and Understanding","version":3},"cited_work":{"arxiv_id":"2501.18362","doi":"10.18653/v1/2025.acl-long.452","metadata_source":"pith","pith_arxiv_id":"2501.18362","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"MedXpertQA: Benchmarking Expert-Level Medical Reasoning and Understanding","venue":"cs.AI","work_id":"17099117-68ce-46a6-a057-ac254bc140ac","year":2025},"citing_paper":{"arxiv_id":"2606.12291","last_updated":"2026-06-10T16:27:26Z","snapshot_observed_at":"2026-08-02T15:04:58.080617Z","submitted_at":"2026-06-10T16:27:26Z","title":"Measuring Epistemic Resilience of LLMs Under Misleading Medical Context","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-06-27T09:30:47.726480Z"},"links":{"cited_paper":"/paper/2501.18362","citing_paper":"/paper/2606.12291"},"observation_digest":"sha256:b905394df21c0ce88f39487f9ec59af54ebac72f5d13d562966d500d469e45d3","observation_id":"85ae5e85-f44d-490e-8969-4645295422f7","resolution":{"observed_at":"2026-07-03T11:28:04.910150Z","resolver_source":"local_arxiv","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2606.12291","last_updated":"2026-06-10T16:27:26Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-02T15:04:58.080617Z","submitted_at":"2026-06-10T16:27:26Z","title":"Measuring Epistemic Resilience of LLMs Under Misleading Medical Context"},"reference_resolution":{"displayed":51,"state_counts":{"malformed_identifier":2,"metadata_mismatch":6,"parse_uncertain":0,"unresolved":21,"verified_exact":22,"verified_fuzzy":0},"total_outbound_references":51},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 51 of 51 outbound references and 0 inbound Pith citation observations for arXiv:2606.12291."}