{"as_of":"2026-08-08T04:02:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:35b0dd2d3ab02e860d7be5bb0b8356d141b4f136e822b2b6926f3743ceaabf01","coverage":[{"denominator":53,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":53,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:29:09.919296Z","state":"measured"},{"denominator":53,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":53,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.15024/citation-record","integrity":"/paper/2505.15024/integrity","json":"/paper/2505.15024/citation-record.json","paper":"/paper/2505.15024"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:16.212622Z","title":"Zero-shot clinical acronym expansion via latent meaning cells","venue":null,"work_id":"0361d465-603f-4552-a115-75a609900832","year":2020},"citing_paper":{"arxiv_id":"2505.15024","last_updated":"2025-05-23T01:09:11Z","snapshot_observed_at":"2026-08-07T15:23:09.806231Z","submitted_at":"2025-05-21T02:13:24Z","title":"Diagnosing our datasets: How does my language model learn clinical information?","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:04.255274Z"},"links":{"citing_paper":"/paper/2505.15024"},"observation_digest":"sha256:dbb6de661484bfdad2a34e5250e3e35185d908f6346114c161d522f670be0210","observation_id":"0f234cfb-0229-43f0-9ac9-6f1a9d51fcfa","resolution":{"observed_at":"2026-08-07T15:29:16.304764Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:04.341527Z","title":"Large language models are few-shot clinical information extractors","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.15024","last_updated":"2025-05-23T01:09:11Z","snapshot_observed_at":"2026-08-07T15:23:09.806231Z","submitted_at":"2025-05-21T02:13:24Z","title":"Diagnosing our datasets: How does my language model learn clinical information?","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:04.341527Z"},"links":{"citing_paper":"/paper/2505.15024"},"observation_digest":"sha256:f3346ed36364efc6eb698ecc2e05a12bea3eda707b2469aff7fb6aa9ed8cd387","observation_id":"99a2bec7-6691-45bd-994a-27d5ecfbbace","resolution":{"observed_at":"2026-08-07T15:29:04.341527Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:15.970928Z","title":"Medical large language models are vulnerable to data-poisoning attacks","venue":null,"work_id":"af9db4cf-7113-41d6-bd61-d6d1e832056f","year":2025},"citing_paper":{"arxiv_id":"2505.15024","last_updated":"2025-05-23T01:09:11Z","snapshot_observed_at":"2026-08-07T15:23:09.806231Z","submitted_at":"2025-05-21T02:13:24Z","title":"Diagnosing our datasets: How does my language model learn clinical information?","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:04.475338Z"},"links":{"citing_paper":"/paper/2505.15024"},"observation_digest":"sha256:9aba10fda40fb8d41e0c08f49e64691ea8792313e7c69a896b85d2d5d66d71e3","observation_id":"7c118357-626c-4b5f-940f-a4a17a0a8817","resolution":{"observed_at":"2026-08-07T15:29:16.043076Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:04.616679Z","title":"Openbiollms: Advancing open-source large language models for healthcare and life sciences","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15024","last_updated":"2025-05-23T01:09:11Z","snapshot_observed_at":"2026-08-07T15:23:09.806231Z","submitted_at":"2025-05-21T02:13:24Z","title":"Diagnosing our datasets: How does my language model learn clinical information?","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:04.616679Z"},"links":{"citing_paper":"/paper/2505.15024"},"observation_digest":"sha256:984eb6941c252bd279de5ebbadc39735d89b857ea40b87e891d17abd2aab05da","observation_id":"458256da-4ca2-4769-98e0-578be6d31f5f","resolution":{"observed_at":"2026-08-07T15:29:04.616679Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.04573","last_updated":"2024-12-05T19:35:41Z","snapshot_observed_at":"2026-08-08T01:37:12.821420Z","submitted_at":"2024-12-05T19:35:41Z","title":"Give me Some Hard Questions: Synthetic Data Generation for Clinical QA","version":1},"cited_work":{"arxiv_id":"2412.04573","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.04573","snapshot_observed_at":"2026-08-07T15:29:10.912373Z","title":"Give me Some Hard Questions: Synthetic Data Generation for Clinical QA","venue":"cs.CL","work_id":"d6b15dc4-439c-44f6-8d72-83e4bee2e77f","year":2024},"citing_paper":{"arxiv_id":"2505.15024","last_updated":"2025-05-23T01:09:11Z","snapshot_observed_at":"2026-08-07T15:23:09.806231Z","submitted_at":"2025-05-21T02:13:24Z","title":"Diagnosing our datasets: How does my language model learn clinical information?","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:04.745921Z"},"links":{"cited_paper":"/paper/2412.04573","citing_paper":"/paper/2505.15024"},"observation_digest":"sha256:8d824c1a24d5e590d68c12f6be050b98b4d33435fb3f3a166bf6445f9f15ef11","observation_id":"ff145259-2474-4035-8eaa-453546d21e06","resolution":{"observed_at":"2026-08-07T15:29:11.051626Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:04.875050Z","title":"Testing and evaluation of health care applications of large language models: a systematic review","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15024","last_updated":"2025-05-23T01:09:11Z","snapshot_observed_at":"2026-08-07T15:23:09.806231Z","submitted_at":"2025-05-21T02:13:24Z","title":"Diagnosing our datasets: How does my language model learn clinical information?","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:04.875050Z"},"links":{"citing_paper":"/paper/2505.15024"},"observation_digest":"sha256:8f9b81526e3bc0053b75ee69cf799950d4b12c6ea5b911d33e1626a6a37f1bdf","observation_id":"fef211be-f041-4639-9482-fe8f1c5f8b8d","resolution":{"observed_at":"2026-08-07T15:29:04.875050Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.05506","last_updated":"2024-06-24T23:17:52Z","snapshot_observed_at":"2026-07-06T18:11:53.063337Z","submitted_at":"2024-05-09T02:33:14Z","title":"Cross-Care: Assessing the Healthcare Implications of Pre-training Data on Language Model Bias","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.05506","snapshot_observed_at":"2026-08-07T15:29:05.026476Z","title":"Cross-care: Assessing the healthcare implications of pre-training data on language model bias","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15024","last_updated":"2025-05-23T01:09:11Z","snapshot_observed_at":"2026-08-07T15:23:09.806231Z","submitted_at":"2025-05-21T02:13:24Z","title":"Diagnosing our datasets: How does my language model learn clinical information?","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:05.026476Z"},"links":{"cited_paper":"/paper/2405.05506","citing_paper":"/paper/2505.15024"},"observation_digest":"sha256:138cda467f21a564fafa50921c7a076b5c29e574d45f6530849cb6684e8e73a8","observation_id":"f556a6e8-17ee-4aab-8096-c8549633b3bb","resolution":{"observed_at":"2026-08-07T15:29:05.026476Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.16079","last_updated":"2023-11-27T18:49:43Z","snapshot_observed_at":"2026-07-06T16:53:18.275859Z","submitted_at":"2023-11-27T18:49:43Z","title":"MEDITRON-70B: Scaling Medical Pretraining for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.16079","snapshot_observed_at":"2026-08-07T15:29:05.169117Z","title":"Meditron-70b: Scaling medical pretraining for large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.15024","last_updated":"2025-05-23T01:09:11Z","snapshot_observed_at":"2026-08-07T15:23:09.806231Z","submitted_at":"2025-05-21T02:13:24Z","title":"Diagnosing our datasets: How does my language model learn clinical information?","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:05.169117Z"},"links":{"cited_paper":"/paper/2311.16079","citing_paper":"/paper/2505.15024"},"observation_digest":"sha256:5a46a85e460934ba1b58317f0ca3b291d9fda5c9fb0952c83842c9cb3aa7864d","observation_id":"7a565fea-87e9-431b-9a14-cf70f44e078d","resolution":{"observed_at":"2026-08-07T15:29:05.169117Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.06142","last_updated":"2024-08-12T13:37:31Z","snapshot_observed_at":"2026-08-04T21:49:27.462796Z","submitted_at":"2024-08-12T13:37:31Z","title":"Med42-v2: A Suite of Clinical LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.06142","snapshot_observed_at":"2026-08-07T15:29:05.268413Z","title":"Med42-v2: A suite of clinical llms","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15024","last_updated":"2025-05-23T01:09:11Z","snapshot_observed_at":"2026-08-07T15:23:09.806231Z","submitted_at":"2025-05-21T02:13:24Z","title":"Diagnosing our datasets: How does my language model learn clinical information?","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:05.268413Z"},"links":{"cited_paper":"/paper/2408.06142","citing_paper":"/paper/2505.15024"},"observation_digest":"sha256:5bc9118e7cda7d67a8a6f87f03e54b93678fd2eb6ac90fa4e60c3e9ecafd3452","observation_id":"eda3edaf-b7f7-44a1-8d7d-34eec76cafa3","resolution":{"observed_at":"2026-08-07T15:29:05.268413Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:05.379176Z","title":"Scaling instruction-finetuned language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15024","last_updated":"2025-05-23T01:09:11Z","snapshot_observed_at":"2026-08-07T15:23:09.806231Z","submitted_at":"2025-05-21T02:13:24Z","title":"Diagnosing our datasets: How does my language model learn clinical information?","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:05.379176Z"},"links":{"citing_paper":"/paper/2505.15024"},"observation_digest":"sha256:27d6b14d3d0e71c897d325f4ab4b06c5f739754398e2d6b77ae784e41e67fc7c","observation_id":"55c9f203-4b69-4d08-b725-6fb1f15a246c","resolution":{"observed_at":"2026-08-07T15:29:05.379176Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.08758","last_updated":"2021-09-30T17:20:01Z","snapshot_observed_at":"2026-08-03T11:31:09.198404Z","submitted_at":"2021-04-18T07:42:52Z","title":"Documenting Large Webtext Corpora: A Case Study on the Colossal Clean Crawled Corpus","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.08758","snapshot_observed_at":"2026-08-07T15:29:05.493446Z","title":"Documenting large webtext corpora: A case study on the colossal clean crawled corpus","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.15024","last_updated":"2025-05-23T01:09:11Z","snapshot_observed_at":"2026-08-07T15:23:09.806231Z","submitted_at":"2025-05-21T02:13:24Z","title":"Diagnosing our datasets: How does my language model learn clinical information?","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:05.493446Z"},"links":{"cited_paper":"/paper/2104.08758","citing_paper":"/paper/2505.15024"},"observation_digest":"sha256:8ae9963105300d2cc1d0bd7e5bc706ea877fa5800530a9954bb7f89891d1ea03","observation_id":"528baf99-34de-4f92-85f1-9a62ee7c0396","resolution":{"observed_at":"2026-08-07T15:29:05.493446Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-07T15:29:05.604207Z","title":"The llama 3 herd of models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15024","last_updated":"2025-05-23T01:09:11Z","snapshot_observed_at":"2026-08-07T15:23:09.806231Z","submitted_at":"2025-05-21T02:13:24Z","title":"Diagnosing our datasets: How does my language model learn clinical information?","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:05.604207Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2505.15024"},"observation_digest":"sha256:615d9453fe45e2a2b75834dacaf039593f312349a8d5d034826a7e1d9da0d5bc","observation_id":"a54525d7-39c3-4dd5-a023-af536ba65c14","resolution":{"observed_at":"2026-08-07T15:29:05.604207Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.20707","last_updated":"2024-03-05T20:02:31Z","snapshot_observed_at":"2026-07-06T16:41:19.189036Z","submitted_at":"2023-10-31T17:59:38Z","title":"What's In My Big Data?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.20707","snapshot_observed_at":"2026-08-07T15:29:05.747482Z","title":"What's in my big data? arXiv preprint arXiv:2310.20707, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.15024","last_updated":"2025-05-23T01:09:11Z","snapshot_observed_at":"2026-08-07T15:23:09.806231Z","submitted_at":"2025-05-21T02:13:24Z","title":"Diagnosing our datasets: How does my language model learn clinical information?","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:05.747482Z"},"links":{"cited_paper":"/paper/2310.20707","citing_paper":"/paper/2505.15024"},"observation_digest":"sha256:d251766d1a7c849fb25a81409d8944907de546e8f72ec0289fd6a1ca6e3059c8","observation_id":"417c29a1-1790-48b0-841d-b33fb7f82d99","resolution":{"observed_at":"2026-08-07T15:29:05.747482Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:05.892549Z","title":"Language models are surprisingly fragile to drug names in biomedical benchmarks","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15024","last_updated":"2025-05-23T01:09:11Z","snapshot_observed_at":"2026-08-07T15:23:09.806231Z","submitted_at":"2025-05-21T02:13:24Z","title":"Diagnosing our datasets: How does my language model learn clinical information?","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:05.892549Z"},"links":{"citing_paper":"/paper/2505.15024"},"observation_digest":"sha256:d6fbd987d49caf62408817538918161825cdbfc38f3c8364b12c05cbe0cf2d2d","observation_id":"06020078-e330-4d7f-b11c-206d8adcae3e","resolution":{"observed_at":"2026-08-07T15:29:05.892549Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2101.00027","last_updated":"2020-12-31T19:00:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-12-31T19:00:10Z","title":"The Pile: An 800GB Dataset of Diverse Text for Language Modeling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2101.00027","snapshot_observed_at":"2026-08-07T15:29:05.982964Z","title":"The pile: An 800gb dataset of diverse text for language modeling","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.15024","last_updated":"2025-05-23T01:09:11Z","snapshot_observed_at":"2026-08-07T15:23:09.806231Z","submitted_at":"2025-05-21T02:13:24Z","title":"Diagnosing our datasets: How does my language model learn clinical information?","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:05.982964Z"},"links":{"cited_paper":"/paper/2101.00027","citing_paper":"/paper/2505.15024"},"observation_digest":"sha256:e1d1f913ec565608c5b71ec2f73e8f766143d792353108e9de13c19ae6b06b70","observation_id":"b97d4c36-2a4c-47fc-a8b2-3c0d2fabae84","resolution":{"observed_at":"2026-08-07T15:29:05.982964Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.00838","last_updated":"2024-06-07T21:59:52Z","snapshot_observed_at":"2026-07-06T17:23:51.547578Z","submitted_at":"2024-02-01T18:28:55Z","title":"OLMo: Accelerating the Science of Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.00838","snapshot_observed_at":"2026-08-07T15:29:06.046507Z","title":"Olmo: Accelerating the science of language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15024","last_updated":"2025-05-23T01:09:11Z","snapshot_observed_at":"2026-08-07T15:23:09.806231Z","submitted_at":"2025-05-21T02:13:24Z","title":"Diagnosing our datasets: How does my language model learn clinical information?","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:06.046507Z"},"links":{"cited_paper":"/paper/2402.00838","citing_paper":"/paper/2505.15024"},"observation_digest":"sha256:a4c0e6ec8597347eb45a0b276a098b722c59347f8b787eba8531be1f25f2cc8e","observation_id":"c403848a-0623-4401-8f01-6895e11b1eb6","resolution":{"observed_at":"2026-08-07T15:29:06.046507Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.03296","last_updated":"2023-08-07T04:47:42Z","snapshot_observed_at":"2026-07-06T16:03:14.694457Z","submitted_at":"2023-08-07T04:47:42Z","title":"Studying Large Language Model Generalization with Influence Functions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.03296","snapshot_observed_at":"2026-08-07T15:29:06.156921Z","title":"Studying large language model generalization with influence functions","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.15024","last_updated":"2025-05-23T01:09:11Z","snapshot_observed_at":"2026-08-07T15:23:09.806231Z","submitted_at":"2025-05-21T02:13:24Z","title":"Diagnosing our datasets: How does my language model learn clinical information?","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:06.156921Z"},"links":{"cited_paper":"/paper/2308.03296","citing_paper":"/paper/2505.15024"},"observation_digest":"sha256:83833f4eed0c4319e34977759ea88df936689be94cd8ed41a32cf715bf1a4ead","observation_id":"1a74ded9-6b21-4a29-b9a2-cb912f8cbea5","resolution":{"observed_at":"2026-08-07T15:29:06.156921Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.08247","last_updated":"2025-03-18T21:31:51Z","snapshot_observed_at":"2026-08-07T23:01:40.564640Z","submitted_at":"2023-04-14T11:28:08Z","title":"MedAlpaca -- An Open-Source Collection of Medical Conversational AI Models and Training Data","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.08247","snapshot_observed_at":"2026-08-07T15:29:06.242115Z","title":"Medalpaca--an open-source collection of medical conversational ai models and training data","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.15024","last_updated":"2025-05-23T01:09:11Z","snapshot_observed_at":"2026-08-07T15:23:09.806231Z","submitted_at":"2025-05-21T02:13:24Z","title":"Diagnosing our datasets: How does my language model learn clinical information?","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:06.242115Z"},"links":{"cited_paper":"/paper/2304.08247","citing_paper":"/paper/2505.15024"},"observation_digest":"sha256:2245a80d95eeecfdf957fc7bc364149474874b890f4a10de24d585221602b9f5","observation_id":"e4edb8e6-236e-41c2-933c-94c03b17d46b","resolution":{"observed_at":"2026-08-07T15:29:06.242115Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.01491","last_updated":"2021-06-02T22:12:39Z","snapshot_observed_at":"2026-07-06T11:15:23.626911Z","submitted_at":"2021-06-02T22:12:39Z","title":"MedNLI Is Not Immune: Natural Language Inference Artifacts in the Clinical Domain","version":1},"cited_work":{"arxiv_id":"2106.01491","doi":null,"metadata_source":"pith","pith_arxiv_id":"2106.01491","snapshot_observed_at":"2026-08-07T15:29:10.569623Z","title":"MedNLI Is Not Immune: Natural Language Inference Artifacts in the Clinical Domain","venue":"cs.CL","work_id":"7e7636d0-a4e3-4c3e-a21f-440c773c6e8d","year":2021},"citing_paper":{"arxiv_id":"2505.15024","last_updated":"2025-05-23T01:09:11Z","snapshot_observed_at":"2026-08-07T15:23:09.806231Z","submitted_at":"2025-05-21T02:13:24Z","title":"Diagnosing our datasets: How does my language model learn clinical information?","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:06.348602Z"},"links":{"cited_paper":"/paper/2106.01491","citing_paper":"/paper/2505.15024"},"observation_digest":"sha256:a284299616f5a89563a7b2c41f852ed752cff7b05ee57ecf7eee6c4f95a9b1d1","observation_id":"30189382-66f0-4b84-ba5f-302319c7f16e","resolution":{"observed_at":"2026-08-07T15:29:10.660958Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.04118","last_updated":"2024-11-19T20:51:58Z","snapshot_observed_at":"2026-08-02T05:04:11.160645Z","submitted_at":"2024-11-06T18:51:02Z","title":"Medical Adaptation of Large Language and Vision-Language Models: Are We Making Progress?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.04118","snapshot_observed_at":"2026-08-07T15:29:06.447607Z","title":"Medical adaptation of large language and vision-language models: Are we making progress? arXiv preprint arXiv:2411.04118, 2024 a","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15024","last_updated":"2025-05-23T01:09:11Z","snapshot_observed_at":"2026-08-07T15:23:09.806231Z","submitted_at":"2025-05-21T02:13:24Z","title":"Diagnosing our datasets: How does my language model learn clinical information?","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:06.447607Z"},"links":{"cited_paper":"/paper/2411.04118","citing_paper":"/paper/2505.15024"},"observation_digest":"sha256:f8432c641ecd4332f4a27c8efb1cfbe74d13b02b121e5cd7d4ccd126204765a9","observation_id":"8c4f91dd-35ba-4664-946b-e4ecebe47a3c","resolution":{"observed_at":"2026-08-07T15:29:06.447607Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.08870","last_updated":"2025-06-28T21:17:10Z","snapshot_observed_at":"2026-08-06T10:33:54.624795Z","submitted_at":"2024-11-13T18:50:13Z","title":"The Limited Impact of Medical Adaptation of Large Language and Vision-Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.08870","snapshot_observed_at":"2026-08-07T15:29:06.507433Z","title":"The limited impact of medical adaptation of large language and vision-language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15024","last_updated":"2025-05-23T01:09:11Z","snapshot_observed_at":"2026-08-07T15:23:09.806231Z","submitted_at":"2025-05-21T02:13:24Z","title":"Diagnosing our datasets: How does my language model learn clinical information?","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:06.507433Z"},"links":{"cited_paper":"/paper/2411.08870","citing_paper":"/paper/2505.15024"},"observation_digest":"sha256:4c4e2239ab9944697ddf710f335e233541412b2746ad1b5fc365696907427b35","observation_id":"57fefea6-580c-43d7-9e02-6859db2b4497","resolution":{"observed_at":"2026-08-07T15:29:06.507433Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:06.662833Z","title":"What disease does this patient have? a large-scale open domain question answering dataset from medical exams","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.15024","last_updated":"2025-05-23T01:09:11Z","snapshot_observed_at":"2026-08-07T15:23:09.806231Z","submitted_at":"2025-05-21T02:13:24Z","title":"Diagnosing our datasets: How does my language model learn clinical information?","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:06.662833Z"},"links":{"citing_paper":"/paper/2505.15024"},"observation_digest":"sha256:a7ca38ec47deb5896962e83651e31ef5ba6eba9c2100fc845e088ce4cfa8611d","observation_id":"fb725992-b5eb-4d1e-b1a1-fb34eb9a537c","resolution":{"observed_at":"2026-08-07T15:29:06.662833Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:15.666835Z","title":"Matching patients to clinical trials with large language models","venue":null,"work_id":"6c22e9d3-8daa-4c9d-8395-11b07daba11f","year":2024},"citing_paper":{"arxiv_id":"2505.15024","last_updated":"2025-05-23T01:09:11Z","snapshot_observed_at":"2026-08-07T15:23:09.806231Z","submitted_at":"2025-05-21T02:13:24Z","title":"Diagnosing our datasets: How does my language model learn clinical information?","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:06.752942Z"},"links":{"citing_paper":"/paper/2505.15024"},"observation_digest":"sha256:c5711198c6ee4bc83fec3516613934d5f7650af101d35305ba91f8c748f9f028","observation_id":"64c726d0-4cdd-46f6-a77f-bb8f2e0ca4d3","resolution":{"observed_at":"2026-08-07T15:29:15.803447Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:15.391070Z","title":"Mimic-iii","venue":null,"work_id":"1d6df837-9c64-453f-a1cf-d43be1e28655","year":2016},"citing_paper":{"arxiv_id":"2505.15024","last_updated":"2025-05-23T01:09:11Z","snapshot_observed_at":"2026-08-07T15:23:09.806231Z","submitted_at":"2025-05-21T02:13:24Z","title":"Diagnosing our datasets: How does my language model learn clinical information?","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:06.837072Z"},"links":{"citing_paper":"/paper/2505.15024"},"observation_digest":"sha256:3c5680550e5c741f4358c0e376decfa3d09fecea5d635f3848e5a09d35fc94fe","observation_id":"1ead9fe5-3817-411d-be2f-5b0aa66b4eef","resolution":{"observed_at":"2026-08-07T15:29:15.520427Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:15.123750Z","title":"Mimic-iv","venue":null,"work_id":"0698d044-2821-4c8e-bd84-89cdff228eac","year":2021},"citing_paper":{"arxiv_id":"2505.15024","last_updated":"2025-05-23T01:09:11Z","snapshot_observed_at":"2026-08-07T15:23:09.806231Z","submitted_at":"2025-05-21T02:13:24Z","title":"Diagnosing our datasets: How does my language model learn clinical information?","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:06.918535Z"},"links":{"citing_paper":"/paper/2505.15024"},"observation_digest":"sha256:8813329f5f3841de9ba2a3e3c02b2167b966cc4e7067c27fb074f057e9ed7ed5","observation_id":"15ffc71a-bc0d-4e2b-bee2-69f2ddb0d37c","resolution":{"observed_at":"2026-08-07T15:29:15.250248Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:14.852142Z","title":"Mimic-iii, a freely accessible critical care database","venue":null,"work_id":"69c518f0-2450-448e-9316-eafbf9e82ddf","year":2016},"citing_paper":{"arxiv_id":"2505.15024","last_updated":"2025-05-23T01:09:11Z","snapshot_observed_at":"2026-08-07T15:23:09.806231Z","submitted_at":"2025-05-21T02:13:24Z","title":"Diagnosing our datasets: How does my language model learn clinical information?","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:06.991294Z"},"links":{"citing_paper":"/paper/2505.15024"},"observation_digest":"sha256:f9fed0546ee5604550cc19271ab6c6c192504104321157b97203f7c2e6e1c08b","observation_id":"708b237c-f1dd-484d-8bbb-10c6d554fe39","resolution":{"observed_at":"2026-08-07T15:29:14.970322Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:07.060881Z","title":"Mimic-cxr, a de-identified publicly available database of chest radiographs with free-text reports","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.15024","last_updated":"2025-05-23T01:09:11Z","snapshot_observed_at":"2026-08-07T15:23:09.806231Z","submitted_at":"2025-05-21T02:13:24Z","title":"Diagnosing our datasets: How does my language model learn clinical information?","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:07.060881Z"},"links":{"citing_paper":"/paper/2505.15024"},"observation_digest":"sha256:9c67e6dd968542da7ddd5a56c4d8d2aba0c4a6c0e6b9d9e6838edeebc962161a","observation_id":"447fe995-6908-4da1-98e9-c96bcdb23930","resolution":{"observed_at":"2026-08-07T15:29:07.060881Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:07.131567Z","title":"Mimic-iv, a freely accessible electronic health record dataset","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.15024","last_updated":"2025-05-23T01:09:11Z","snapshot_observed_at":"2026-08-07T15:23:09.806231Z","submitted_at":"2025-05-21T02:13:24Z","title":"Diagnosing our datasets: How does my language model learn clinical information?","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:07.131567Z"},"links":{"citing_paper":"/paper/2505.15024"},"observation_digest":"sha256:4cf5373f39dc10b4fc1f4326e8061801271445be3e8af11af56a6eba55e88a3f","observation_id":"ae0ea4dc-eb55-4283-abd5-c5356397d8fb","resolution":{"observed_at":"2026-08-07T15:29:07.131567Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:14.568784Z","title":"Large language models struggle to learn long-tail knowledge","venue":null,"work_id":"66350a65-785f-409c-b6e7-fd5794992db6","year":2023},"citing_paper":{"arxiv_id":"2505.15024","last_updated":"2025-05-23T01:09:11Z","snapshot_observed_at":"2026-08-07T15:23:09.806231Z","submitted_at":"2025-05-21T02:13:24Z","title":"Diagnosing our datasets: How does my language model learn clinical information?","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:07.276988Z"},"links":{"citing_paper":"/paper/2505.15024"},"observation_digest":"sha256:4e52f2caf196ca40c7e9dd8929448fc9fe5c0850595a7a2c9a2c2995c0caf477","observation_id":"15588577-92b1-486f-9f85-28b44b5d0892","resolution":{"observed_at":"2026-08-07T15:29:14.704615Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:14.320753Z","title":"Debunking health fake news with domain specific pre-trained model","venue":null,"work_id":"cefb97a4-0dcd-4cc9-880d-c2d56d70853f","year":2021},"citing_paper":{"arxiv_id":"2505.15024","last_updated":"2025-05-23T01:09:11Z","snapshot_observed_at":"2026-08-07T15:23:09.806231Z","submitted_at":"2025-05-21T02:13:24Z","title":"Diagnosing our datasets: How does my language model learn clinical information?","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:07.387646Z"},"links":{"citing_paper":"/paper/2505.15024"},"observation_digest":"sha256:eeac3e0169df2d45b0acf5f59bc46961300ce645b614e8c83a24f898d9ae0a63","observation_id":"148aae8c-38df-421b-9740-7b5f159d9553","resolution":{"observed_at":"2026-08-07T15:29:14.430165Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.10822","last_updated":"2024-06-06T21:58:49Z","snapshot_observed_at":"2026-07-06T17:45:35.519457Z","submitted_at":"2024-03-16T06:18:15Z","title":"Can Large Language Models abstract Medical Coded Language?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.10822","snapshot_observed_at":"2026-08-07T15:29:07.575990Z","title":"Can large language models abstract medical coded language? arXiv preprint arXiv:2403.10822, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15024","last_updated":"2025-05-23T01:09:11Z","snapshot_observed_at":"2026-08-07T15:23:09.806231Z","submitted_at":"2025-05-21T02:13:24Z","title":"Diagnosing our datasets: How does my language model learn clinical information?","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:07.575990Z"},"links":{"cited_paper":"/paper/2403.10822","citing_paper":"/paper/2505.15024"},"observation_digest":"sha256:f6663f1f494c69e00bd6e87cedf00d9abf9465cb716c8469a719b3ee002ccf53","observation_id":"be032bd8-70cb-44a5-85ad-cff94c8f0106","resolution":{"observed_at":"2026-08-07T15:29:07.575990Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.03066","last_updated":"2024-05-22T16:57:56Z","snapshot_observed_at":"2026-08-07T20:30:35.208804Z","submitted_at":"2024-05-05T22:21:15Z","title":"A scoping review of using Large Language Models (LLMs) to investigate Electronic Health Records (EHRs)","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.03066","snapshot_observed_at":"2026-08-07T15:29:07.705427Z","title":"A scoping review of using large language models (llms) to investigate electronic health records (ehrs)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15024","last_updated":"2025-05-23T01:09:11Z","snapshot_observed_at":"2026-08-07T15:23:09.806231Z","submitted_at":"2025-05-21T02:13:24Z","title":"Diagnosing our datasets: How does my language model learn clinical information?","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:07.705427Z"},"links":{"cited_paper":"/paper/2405.03066","citing_paper":"/paper/2505.15024"},"observation_digest":"sha256:6a02356c9a4b2c98229b2e3cea76360971bd8bd20b0209c4537c012e139895e0","observation_id":"653ef47e-371b-4dd2-9225-be2b3b0049d9","resolution":{"observed_at":"2026-08-07T15:29:07.705427Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.05845","last_updated":"2024-12-08T07:52:17Z","snapshot_observed_at":"2026-07-06T20:03:25.000927Z","submitted_at":"2024-12-08T07:52:17Z","title":"Are Clinical T5 Models Better for Clinical Text?","version":1},"cited_work":{"arxiv_id":"2412.05845","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.05845","snapshot_observed_at":"2026-08-07T15:29:10.180060Z","title":"Are Clinical T5 Models Better for Clinical Text?","venue":"cs.CL","work_id":"d063777d-f470-4516-80e2-895d2d6777a4","year":2024},"citing_paper":{"arxiv_id":"2505.15024","last_updated":"2025-05-23T01:09:11Z","snapshot_observed_at":"2026-08-07T15:23:09.806231Z","submitted_at":"2025-05-21T02:13:24Z","title":"Diagnosing our datasets: How does my language model learn clinical information?","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:07.815853Z"},"links":{"cited_paper":"/paper/2412.05845","citing_paper":"/paper/2505.15024"},"observation_digest":"sha256:eb5d44a4e554fc764e125c9944184c7d82bd14d41af6179bf46ff4315d8578cd","observation_id":"33b18d1d-f2a8-472d-8408-a8a9248a7f85","resolution":{"observed_at":"2026-08-07T15:29:10.339675Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.17377","last_updated":"2025-04-07T17:59:50Z","snapshot_observed_at":"2026-08-08T02:05:38.594754Z","submitted_at":"2024-01-30T19:03:49Z","title":"Infini-gram: Scaling Unbounded n-gram Language Models to a Trillion Tokens","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.17377","snapshot_observed_at":"2026-08-07T15:29:07.971245Z","title":"Infini-gram: Scaling unbounded n-gram language models to a trillion tokens","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15024","last_updated":"2025-05-23T01:09:11Z","snapshot_observed_at":"2026-08-07T15:23:09.806231Z","submitted_at":"2025-05-21T02:13:24Z","title":"Diagnosing our datasets: How does my language model learn clinical information?","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:07.971245Z"},"links":{"cited_paper":"/paper/2401.17377","citing_paper":"/paper/2505.15024"},"observation_digest":"sha256:bc898c737a5074062cb69974024983c4f3df0f0359a34d685300baeefbcd598a","observation_id":"f4c6fef2-e7be-4481-bff0-f80443ce7a4a","resolution":{"observed_at":"2026-08-07T15:29:07.971245Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1911.02782","last_updated":"2020-07-07T00:40:21Z","snapshot_observed_at":"2026-07-06T08:35:20.515972Z","submitted_at":"2019-11-07T07:34:43Z","title":"S2ORC: The Semantic Scholar Open Research Corpus","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1911.02782","snapshot_observed_at":"2026-08-07T15:29:08.141224Z","title":"S2orc: The semantic scholar open research corpus","venue":null,"work_id":null,"year":1911},"citing_paper":{"arxiv_id":"2505.15024","last_updated":"2025-05-23T01:09:11Z","snapshot_observed_at":"2026-08-07T15:23:09.806231Z","submitted_at":"2025-05-21T02:13:24Z","title":"Diagnosing our datasets: How does my language model learn clinical information?","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:08.141224Z"},"links":{"cited_paper":"/paper/1911.02782","citing_paper":"/paper/2505.15024"},"observation_digest":"sha256:de312a67e4801db63de17d6bba1290dcd5d7e4a5f17f3be6e660afdf3f5c3cfc","observation_id":"61f82fdf-f356-469a-8257-6f9df144236c","resolution":{"observed_at":"2026-08-07T15:29:08.141224Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:14.080335Z","title":"Fake or real news about covid-19? pretrained transformer model to detect potential misleading news","venue":null,"work_id":"0b2bdbcd-f0a6-4e63-999d-7088f8b63083","year":2022},"citing_paper":{"arxiv_id":"2505.15024","last_updated":"2025-05-23T01:09:11Z","snapshot_observed_at":"2026-08-07T15:23:09.806231Z","submitted_at":"2025-05-21T02:13:24Z","title":"Diagnosing our datasets: How does my language model learn clinical information?","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:08.270161Z"},"links":{"citing_paper":"/paper/2505.15024"},"observation_digest":"sha256:43f0ee69148724ce2e4a5b76ad600868edd545cb07d06cb066ba22f36b2e1445","observation_id":"ee845d4b-4873-41eb-a54d-0dac2eaf1635","resolution":{"observed_at":"2026-08-07T15:29:14.211578Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:13.821631Z","title":"Evaluating base and retrieval augmented llms with document or online support for evidence based neurology","venue":null,"work_id":"b67de047-0a35-4035-a710-3ed854304b9c","year":2025},"citing_paper":{"arxiv_id":"2505.15024","last_updated":"2025-05-23T01:09:11Z","snapshot_observed_at":"2026-08-07T15:23:09.806231Z","submitted_at":"2025-05-21T02:13:24Z","title":"Diagnosing our datasets: How does my language model learn clinical information?","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:08.439994Z"},"links":{"citing_paper":"/paper/2505.15024"},"observation_digest":"sha256:614b5f2c86af8135d435e0cd8c9fe1e25915ee469d0cb4fc0e028dac84807e4e","observation_id":"39aebfe4-fe93-4230-9a19-b669f314f29f","resolution":{"observed_at":"2026-08-07T15:29:13.930293Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:13.557711Z","title":"A sense inventory for clinical abbreviations and acronyms created using clinical notes and medical dictionary resources","venue":null,"work_id":"35f8400b-7ad3-43f7-93cf-6a3901115746","year":2014},"citing_paper":{"arxiv_id":"2505.15024","last_updated":"2025-05-23T01:09:11Z","snapshot_observed_at":"2026-08-07T15:23:09.806231Z","submitted_at":"2025-05-21T02:13:24Z","title":"Diagnosing our datasets: How does my language model learn clinical information?","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:08.670802Z"},"links":{"citing_paper":"/paper/2505.15024"},"observation_digest":"sha256:4dfd54f7eecb490ec7f366f9c4828e6a9889b9e7123cf4af99d441c7400be0c2","observation_id":"be301167-7843-4da7-b25f-917dcacc47cc","resolution":{"observed_at":"2026-08-07T15:29:13.713212Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:08.762683Z","title":"Exploring the limits of transfer learning with a unified text-to-text transformer","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.15024","last_updated":"2025-05-23T01:09:11Z","snapshot_observed_at":"2026-08-07T15:23:09.806231Z","submitted_at":"2025-05-21T02:13:24Z","title":"Diagnosing our datasets: How does my language model learn clinical information?","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:08.762683Z"},"links":{"citing_paper":"/paper/2505.15024"},"observation_digest":"sha256:7626aaa62aa6c97e78bad307b6b204057716fa367a44b75423342fcc0ecb5964","observation_id":"f7be1418-3c17-424e-a2e6-f961bb21df58","resolution":{"observed_at":"2026-08-07T15:29:08.762683Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:13.240813Z","title":"It’s time to bench the medical exam benchmark, 2025","venue":null,"work_id":"118a0d43-2914-4aed-b530-4a0a3f0579f0","year":2025},"citing_paper":{"arxiv_id":"2505.15024","last_updated":"2025-05-23T01:09:11Z","snapshot_observed_at":"2026-08-07T15:23:09.806231Z","submitted_at":"2025-05-21T02:13:24Z","title":"Diagnosing our datasets: How does my language model learn clinical information?","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:08.811657Z"},"links":{"citing_paper":"/paper/2505.15024"},"observation_digest":"sha256:55989cdeb0ac7b20ea07bb880b1d2a4a6b7314c75b9ff5b6fcd532c379d8d7ca","observation_id":"894cd7eb-1a9f-44c2-8e7b-bc09b43356d2","resolution":{"observed_at":"2026-08-07T15:29:13.382004Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.00159","last_updated":"2024-06-06T18:46:40Z","snapshot_observed_at":"2026-07-06T17:23:22.706195Z","submitted_at":"2024-01-31T20:29:50Z","title":"Dolma: an Open Corpus of Three Trillion Tokens for Language Model Pretraining Research","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.00159","snapshot_observed_at":"2026-08-07T15:29:08.866790Z","title":"Dolma: An open corpus of three trillion tokens for language model pretraining research","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15024","last_updated":"2025-05-23T01:09:11Z","snapshot_observed_at":"2026-08-07T15:23:09.806231Z","submitted_at":"2025-05-21T02:13:24Z","title":"Diagnosing our datasets: How does my language model learn clinical information?","version":2},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:08.866790Z"},"links":{"cited_paper":"/paper/2402.00159","citing_paper":"/paper/2505.15024"},"observation_digest":"sha256:291637348ce32ec21abc0705ea5b1ffb4938586bba2e6c9e06a86092d75178b4","observation_id":"a347fdee-7fcc-44c3-b722-f201398a60c4","resolution":{"observed_at":"2026-08-07T15:29:08.866790Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:12.971541Z","title":"Large language models are poor medical coders—benchmarking of medical code querying","venue":null,"work_id":"71c84d3c-b786-4046-a8a3-310e57737f50","year":2024},"citing_paper":{"arxiv_id":"2505.15024","last_updated":"2025-05-23T01:09:11Z","snapshot_observed_at":"2026-08-07T15:23:09.806231Z","submitted_at":"2025-05-21T02:13:24Z","title":"Diagnosing our datasets: How does my language model learn clinical information?","version":2},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:08.908349Z"},"links":{"citing_paper":"/paper/2505.15024"},"observation_digest":"sha256:a4cd1bf62eaab799fbebde1971055baaeafcf953989051cefd07f23a66b5c66c","observation_id":"ea42f37f-58f0-4161-8ec9-877c62f6a4c8","resolution":{"observed_at":"2026-08-07T15:29:13.086715Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:12.703251Z","title":"Prevalence of health misinformation on social media: systematic review","venue":null,"work_id":"15433afc-748b-41cf-b996-f4e0b482fd37","year":2021},"citing_paper":{"arxiv_id":"2505.15024","last_updated":"2025-05-23T01:09:11Z","snapshot_observed_at":"2026-08-07T15:23:09.806231Z","submitted_at":"2025-05-21T02:13:24Z","title":"Diagnosing our datasets: How does my language model learn clinical information?","version":2},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:08.958235Z"},"links":{"citing_paper":"/paper/2505.15024"},"observation_digest":"sha256:3c4af9eb1bb18b589217228ce6218d5d6859caa5490c4a40d87657f5d8d9f0b5","observation_id":"193c298b-b779-4c74-b865-d7a5a3faf2d5","resolution":{"observed_at":"2026-08-07T15:29:12.805583Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:09.010126Z","title":"Hashimoto","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.15024","last_updated":"2025-05-23T01:09:11Z","snapshot_observed_at":"2026-08-07T15:23:09.806231Z","submitted_at":"2025-05-21T02:13:24Z","title":"Diagnosing our datasets: How does my language model learn clinical information?","version":2},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:09.010126Z"},"links":{"citing_paper":"/paper/2505.15024"},"observation_digest":"sha256:586f5b9670039d3c98686259a2fe20a668b4dba7cebdbad8675858d8023fa3b1","observation_id":"af328636-6b24-405d-9a08-3d00738c805d","resolution":{"observed_at":"2026-08-07T15:29:09.010126Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:12.437596Z","title":"RedPajama: An Open Source Recipe to Reproduce LLaMA training dataset , April 2023","venue":null,"work_id":"778f5f0a-9faa-42c7-9a3a-3819dd6136bd","year":2023},"citing_paper":{"arxiv_id":"2505.15024","last_updated":"2025-05-23T01:09:11Z","snapshot_observed_at":"2026-08-07T15:23:09.806231Z","submitted_at":"2025-05-21T02:13:24Z","title":"Diagnosing our datasets: How does my language model learn clinical information?","version":2},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:09.060653Z"},"links":{"citing_paper":"/paper/2505.15024"},"observation_digest":"sha256:800e92f905247bd6e57def29d95a3458fd4bcaec9968db9afa4c352b1279fab7","observation_id":"3a2facdc-cb21-47dd-a922-6f946dbfdd1b","resolution":{"observed_at":"2026-08-07T15:29:12.585008Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:12.185355Z","title":"Clinical camel: An open-source expert-level medical language model with dialogue-based knowledge encoding","venue":null,"work_id":"8aa486fc-c401-43a5-a719-2dfaad00b3dd","year":2023},"citing_paper":{"arxiv_id":"2505.15024","last_updated":"2025-05-23T01:09:11Z","snapshot_observed_at":"2026-08-07T15:23:09.806231Z","submitted_at":"2025-05-21T02:13:24Z","title":"Diagnosing our datasets: How does my language model learn clinical information?","version":2},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:09.113476Z"},"links":{"citing_paper":"/paper/2505.15024"},"observation_digest":"sha256:c06b1ca76418a749d49273634e9442f88205132d09e33ecaf2462acc1ae7b50d","observation_id":"89ef4626-a47c-4e1d-9043-a7fe80bfdc97","resolution":{"observed_at":"2026-08-07T15:29:12.321384Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-07T15:29:09.166078Z","title":"Llama: Open and efficient foundation language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.15024","last_updated":"2025-05-23T01:09:11Z","snapshot_observed_at":"2026-08-07T15:23:09.806231Z","submitted_at":"2025-05-21T02:13:24Z","title":"Diagnosing our datasets: How does my language model learn clinical information?","version":2},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:09.166078Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2505.15024"},"observation_digest":"sha256:e8ef554dcc0be4bbe13f8d4f351de2b1fc0385d8c184097b71f5a9572e43e78a","observation_id":"ba398e54-45e0-46dc-ac6d-267c68b11eaf","resolution":{"observed_at":"2026-08-07T15:29:09.166078Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:11.948756Z","title":"Adapted large language models can outperform medical experts in clinical text summarization","venue":null,"work_id":"a18f9c01-bce8-4d62-aa7b-2136044a6a43","year":2024},"citing_paper":{"arxiv_id":"2505.15024","last_updated":"2025-05-23T01:09:11Z","snapshot_observed_at":"2026-08-07T15:23:09.806231Z","submitted_at":"2025-05-21T02:13:24Z","title":"Diagnosing our datasets: How does my language model learn clinical information?","version":2},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:09.232187Z"},"links":{"citing_paper":"/paper/2505.15024"},"observation_digest":"sha256:bd34d3b7d11c2f8f4d653a0daa2b7bfaedcbf51f96ca115d14377bbdea60447e","observation_id":"84648d4e-e3ab-4a3a-a53f-5a37f9bda00b","resolution":{"observed_at":"2026-08-07T15:29:12.050114Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.12372","last_updated":"2024-11-19T09:35:28Z","snapshot_observed_at":"2026-08-06T21:35:45.662025Z","submitted_at":"2024-11-19T09:35:28Z","title":"RedPajama: an Open Dataset for Training Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.12372","snapshot_observed_at":"2026-08-07T15:29:09.304268Z","title":"Redpajama: an open dataset for training large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15024","last_updated":"2025-05-23T01:09:11Z","snapshot_observed_at":"2026-08-07T15:23:09.806231Z","submitted_at":"2025-05-21T02:13:24Z","title":"Diagnosing our datasets: How does my language model learn clinical information?","version":2},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:09.304268Z"},"links":{"cited_paper":"/paper/2411.12372","citing_paper":"/paper/2505.15024"},"observation_digest":"sha256:58b90fbd6d5cb1e990ff7e254c511abfcd95d497f591e8ad640973c2ef0d2504","observation_id":"4824c5f2-d689-44d9-b29b-4d9ac1db0003","resolution":{"observed_at":"2026-08-07T15:29:09.304268Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:11.660186Z","title":"Me-llama: Foundation large language models for medical applications","venue":null,"work_id":"c456b43b-a163-45bf-ace4-78ed1ab70d54","year":2024},"citing_paper":{"arxiv_id":"2505.15024","last_updated":"2025-05-23T01:09:11Z","snapshot_observed_at":"2026-08-07T15:23:09.806231Z","submitted_at":"2025-05-21T02:13:24Z","title":"Diagnosing our datasets: How does my language model learn clinical information?","version":2},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:09.452087Z"},"links":{"citing_paper":"/paper/2505.15024"},"observation_digest":"sha256:8e9d4f1a6401bb5657acdb0ef08e9140737ae424ae088bdd37a18d8829926637","observation_id":"94fb0127-bc3f-49c5-8a98-afb4e78a4432","resolution":{"observed_at":"2026-08-07T15:29:11.787914Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:11.411527Z","title":"Almanac—retrieval-augmented language models for clinical medicine","venue":null,"work_id":"2f5be607-cbc8-4b2d-a882-4771ac0ebbb2","year":2024},"citing_paper":{"arxiv_id":"2505.15024","last_updated":"2025-05-23T01:09:11Z","snapshot_observed_at":"2026-08-07T15:23:09.806231Z","submitted_at":"2025-05-21T02:13:24Z","title":"Diagnosing our datasets: How does my language model learn clinical information?","version":2},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:09.631319Z"},"links":{"citing_paper":"/paper/2505.15024"},"observation_digest":"sha256:4c70815336927a37b3f2a39e7c094f0ba1005a24a2de24838ae212bbe4514de4","observation_id":"206aacf5-94cc-47cd-84a1-69a23639e6fb","resolution":{"observed_at":"2026-08-07T15:29:11.516515Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:11.181098Z","title":"A dataset for evaluating clinical research claims in large language models","venue":null,"work_id":"3810bc24-158c-4781-b250-1927bffdf695","year":2025},"citing_paper":{"arxiv_id":"2505.15024","last_updated":"2025-05-23T01:09:11Z","snapshot_observed_at":"2026-08-07T15:23:09.806231Z","submitted_at":"2025-05-21T02:13:24Z","title":"Diagnosing our datasets: How does my language model learn clinical information?","version":2},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:09.803009Z"},"links":{"citing_paper":"/paper/2505.15024"},"observation_digest":"sha256:ec0415983949b4486c316086f6f76f0110ed95f719b2726f974110f2f182daf6","observation_id":"14102550-5392-445e-a5c8-6da14551a5b1","resolution":{"observed_at":"2026-08-07T15:29:11.295105Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:09.919296Z","title":"Judging llm-as-a-judge with mt-bench and chatbot arena","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.15024","last_updated":"2025-05-23T01:09:11Z","snapshot_observed_at":"2026-08-07T15:23:09.806231Z","submitted_at":"2025-05-21T02:13:24Z","title":"Diagnosing our datasets: How does my language model learn clinical information?","version":2},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:09.919296Z"},"links":{"citing_paper":"/paper/2505.15024"},"observation_digest":"sha256:6e62232722d5c874d6e45845abfb4f94d98655430535a284e7f9efa4e0a32537","observation_id":"d3e7985a-3312-49a9-98c1-2a3fbbba001c","resolution":{"observed_at":"2026-08-07T15:29:09.919296Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.15024","last_updated":"2025-05-23T01:09:11Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T15:23:09.806231Z","submitted_at":"2025-05-21T02:13:24Z","title":"Diagnosing our datasets: How does my language model learn clinical information?"},"reference_resolution":{"displayed":53,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":30,"verified_exact":3,"verified_fuzzy":20},"total_outbound_references":53},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 53 of 53 outbound references and 0 inbound Pith citation observations for arXiv:2505.15024."}