{"as_of":"2026-08-08T05:54:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d6d19d65ad38a1baa2f6096b8abadfdca75892eb26c831beef6c07e35dd2d2ad","coverage":[{"denominator":29,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":29,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T05:20:14.745364Z","state":"measured"},{"denominator":29,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":29,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.08231/citation-record","integrity":"/paper/2506.08231/integrity","json":"/paper/2506.08231/citation-record.json","paper":"/paper/2506.08231"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:20:15.626216Z","title":"good enough","venue":null,"work_id":"c083c947-c973-4363-827b-54c0e0a9962f","year":2025},"citing_paper":{"arxiv_id":"2506.08231","last_updated":"2025-06-09T20:59:16Z","snapshot_observed_at":"2026-08-07T05:14:40.796573Z","submitted_at":"2025-06-09T20:59:16Z","title":"Ensuring Reliability of Curated EHR-Derived Data: The Validation of Accuracy for LLM/ML-Extracted Information and Data (VALID) Framework","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T05:20:12.648559Z"},"links":{"citing_paper":"/paper/2506.08231"},"observation_digest":"sha256:8782b95bed0db7febbae91340459813a2bd621209cc892c888092e55ab045312","observation_id":"b9983eef-9441-4a9d-a322-253488d40daf","resolution":{"observed_at":"2026-08-07T05:20:15.629452Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2024.25981","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:20:15.572123Z","title":"Use of Generative AI to Identify Helmet Status Among Patients With Micromobility-Related Injuries From Unstructured Clinical Notes","venue":null,"work_id":"b2e1530d-db97-412f-9b49-570bba82b55d","year":2024},"citing_paper":{"arxiv_id":"2506.08231","last_updated":"2025-06-09T20:59:16Z","snapshot_observed_at":"2026-08-07T05:14:40.796573Z","submitted_at":"2025-06-09T20:59:16Z","title":"Ensuring Reliability of Curated EHR-Derived Data: The Validation of Accuracy for LLM/ML-Extracted Information and Data (VALID) Framework","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T05:20:12.703173Z"},"links":{"citing_paper":"/paper/2506.08231"},"observation_digest":"sha256:4b8df60ac655747c44a53ea21aecb5c774f82af09a7dacd1246ef2ff6036437d","observation_id":"361fdfd3-affb-49ba-9b10-a321f999a2b0","resolution":{"observed_at":"2026-08-07T05:20:15.577173Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:20:12.809314Z","title":"Opportunities and Challenges for ChatGPT and Large Language Models in Biomedicine and Health","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.08231","last_updated":"2025-06-09T20:59:16Z","snapshot_observed_at":"2026-08-07T05:14:40.796573Z","submitted_at":"2025-06-09T20:59:16Z","title":"Ensuring Reliability of Curated EHR-Derived Data: The Validation of Accuracy for LLM/ML-Extracted Information and Data (VALID) Framework","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T05:20:12.809314Z"},"links":{"citing_paper":"/paper/2506.08231"},"observation_digest":"sha256:b13d50a75c1af19747f334cb9a99c775a80aae9e34fe06cf0a0461a1405c5d05","observation_id":"be81ccd2-520b-4ba9-b3e5-08fbea1ec1d5","resolution":{"observed_at":"2026-08-07T05:20:12.809314Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:20:12.990475Z","title":"Large Language Models Encode Clinical Knowledge","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.08231","last_updated":"2025-06-09T20:59:16Z","snapshot_observed_at":"2026-08-07T05:14:40.796573Z","submitted_at":"2025-06-09T20:59:16Z","title":"Ensuring Reliability of Curated EHR-Derived Data: The Validation of Accuracy for LLM/ML-Extracted Information and Data (VALID) Framework","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T05:20:12.990475Z"},"links":{"citing_paper":"/paper/2506.08231"},"observation_digest":"sha256:b0922e734c02e6587a1494661b10451731d37f8cf7a278d30342e3ec663285ee","observation_id":"abf843fd-3cd6-4859-ac68-7008d12897d0","resolution":{"observed_at":"2026-08-07T05:20:12.990475Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:20:13.063866Z","title":"A Large Language Model for Electronic Health Records","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.08231","last_updated":"2025-06-09T20:59:16Z","snapshot_observed_at":"2026-08-07T05:14:40.796573Z","submitted_at":"2025-06-09T20:59:16Z","title":"Ensuring Reliability of Curated EHR-Derived Data: The Validation of Accuracy for LLM/ML-Extracted Information and Data (VALID) Framework","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T05:20:13.063866Z"},"links":{"citing_paper":"/paper/2506.08231"},"observation_digest":"sha256:f0420b72b5c61727d4598b1031c119f989979bbb0c609b2be9559e46681df152","observation_id":"a8782495-8ee6-4132-aafb-71e14458dd82","resolution":{"observed_at":"2026-08-07T05:20:13.063866Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:20:15.614502Z","title":null,"venue":null,"work_id":"43e56859-e852-4e88-be67-6402d99ae1ad","year":2025},"citing_paper":{"arxiv_id":"2506.08231","last_updated":"2025-06-09T20:59:16Z","snapshot_observed_at":"2026-08-07T05:14:40.796573Z","submitted_at":"2025-06-09T20:59:16Z","title":"Ensuring Reliability of Curated EHR-Derived Data: The Validation of Accuracy for LLM/ML-Extracted Information and Data (VALID) Framework","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T05:20:13.165238Z"},"links":{"citing_paper":"/paper/2506.08231"},"observation_digest":"sha256:37f27dbfd785b8a767f41e373f3fd991a5be049b790214e1664c190d2add5472","observation_id":"becd1319-3196-4bf8-be6d-d77a4a079869","resolution":{"observed_at":"2026-08-07T05:20:15.618018Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1016/j.jval.2022.03.022","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:20:15.212743Z","title":"Machine Learning Methods in Health Economics and Outcomes Research—The PALISADE Checklist: A Good Practices Report of an ISPOR Task Force","venue":null,"work_id":"942b1f0a-4727-4d39-b914-1757e1228fe1","year":2022},"citing_paper":{"arxiv_id":"2506.08231","last_updated":"2025-06-09T20:59:16Z","snapshot_observed_at":"2026-08-07T05:14:40.796573Z","submitted_at":"2025-06-09T20:59:16Z","title":"Ensuring Reliability of Curated EHR-Derived Data: The Validation of Accuracy for LLM/ML-Extracted Information and Data (VALID) Framework","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T05:20:13.248463Z"},"links":{"citing_paper":"/paper/2506.08231"},"observation_digest":"sha256:69c4e8a379626315d095df21759b1b40f961c0285d43522782ddf29111be6ce3","observation_id":"8a472009-c1f4-4baf-b6ba-9cfcec131773","resolution":{"observed_at":"2026-08-07T05:20:15.216744Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1016/j.jval.2024.01.019","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:20:15.201894Z","title":"Assessing Real-World Data From Electronic Health Records for Health Technology Assessment: The SUITABILITY Checklist: A Good Practices Report of an ISPOR Task Force","venue":null,"work_id":"e3594933-6647-41fd-b199-d62cbedfa343","year":2024},"citing_paper":{"arxiv_id":"2506.08231","last_updated":"2025-06-09T20:59:16Z","snapshot_observed_at":"2026-08-07T05:14:40.796573Z","submitted_at":"2025-06-09T20:59:16Z","title":"Ensuring Reliability of Curated EHR-Derived Data: The Validation of Accuracy for LLM/ML-Extracted Information and Data (VALID) Framework","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T05:20:13.310273Z"},"links":{"citing_paper":"/paper/2506.08231"},"observation_digest":"sha256:8776c5a5604a9bfad63ce2a0142fa1f0e2e457a73780d4eacad0e8ee4ece6432","observation_id":"246e98e1-a124-478f-b804-931b6f4a988b","resolution":{"observed_at":"2026-08-07T05:20:15.205635Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2025.0128","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:20:15.503593Z","title":"Implementing Accuracy, Completeness, and Traceability for Data Reliability","venue":null,"work_id":"3a96fe02-925e-4083-8ecd-fd88ac5df354","year":2025},"citing_paper":{"arxiv_id":"2506.08231","last_updated":"2025-06-09T20:59:16Z","snapshot_observed_at":"2026-08-07T05:14:40.796573Z","submitted_at":"2025-06-09T20:59:16Z","title":"Ensuring Reliability of Curated EHR-Derived Data: The Validation of Accuracy for LLM/ML-Extracted Information and Data (VALID) Framework","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T05:20:13.401392Z"},"links":{"citing_paper":"/paper/2506.08231"},"observation_digest":"sha256:d9e072596d0c1d79fd134144dd85e6df6139104505b75d5a373412564484019e","observation_id":"79b563b8-abcf-4224-82f5-bdba995fad8f","resolution":{"observed_at":"2026-08-07T05:20:15.508598Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1038/s41467-024-46000-9","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:20:15.191982Z","title":"A Framework for Evaluating Clinical Artificial Intelligence Systems without Ground-Truth Annotations","venue":null,"work_id":"7741f72f-2de2-4a12-8f78-f5b4914240ec","year":2024},"citing_paper":{"arxiv_id":"2506.08231","last_updated":"2025-06-09T20:59:16Z","snapshot_observed_at":"2026-08-07T05:14:40.796573Z","submitted_at":"2025-06-09T20:59:16Z","title":"Ensuring Reliability of Curated EHR-Derived Data: The Validation of Accuracy for LLM/ML-Extracted Information and Data (VALID) Framework","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T05:20:13.476888Z"},"links":{"citing_paper":"/paper/2506.08231"},"observation_digest":"sha256:0d1ae7d9714e30cb27f80b218267bdd931edb9501063debed56d6ee755176588","observation_id":"1967e7c5-32ee-4b13-855b-94687372126c","resolution":{"observed_at":"2026-08-07T05:20:15.195369Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:20:15.604507Z","title":"A Reproducible and Transparent Framework for Evaluating Foundation Models (accessed on 21 May 2025)","venue":null,"work_id":"6ccd379e-a18a-41f9-8663-24bfb385a01b","year":2025},"citing_paper":{"arxiv_id":"2506.08231","last_updated":"2025-06-09T20:59:16Z","snapshot_observed_at":"2026-08-07T05:14:40.796573Z","submitted_at":"2025-06-09T20:59:16Z","title":"Ensuring Reliability of Curated EHR-Derived Data: The Validation of Accuracy for LLM/ML-Extracted Information and Data (VALID) Framework","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T05:20:13.559006Z"},"links":{"citing_paper":"/paper/2506.08231"},"observation_digest":"sha256:7709171925dadaed384f2cd49fa8169f8f29ff82fd678e4db23965a9617344c1","observation_id":"97b21d55-a684-4ca9-ac14-db6c568d9486","resolution":{"observed_at":"2026-08-07T05:20:15.607804Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2023.11809","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:20:15.422446Z","title":"Approach to Machine Learning for Extraction of Real-World Data Variables from Electronic Health Records","venue":null,"work_id":"7164b0de-e7df-40b0-8691-9e05a9468d8a","year":2023},"citing_paper":{"arxiv_id":"2506.08231","last_updated":"2025-06-09T20:59:16Z","snapshot_observed_at":"2026-08-07T05:14:40.796573Z","submitted_at":"2025-06-09T20:59:16Z","title":"Ensuring Reliability of Curated EHR-Derived Data: The Validation of Accuracy for LLM/ML-Extracted Information and Data (VALID) Framework","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T05:20:13.616768Z"},"links":{"citing_paper":"/paper/2506.08231"},"observation_digest":"sha256:3c746f480a2419681148d659a942a56de2f63be3416fce719ec19d075578773e","observation_id":"5bf18e88-aa5f-4df0-af9f-d2f7ad31f4dc","resolution":{"observed_at":"2026-08-07T05:20:15.427421Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2024.0043","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:20:15.338850Z","title":"Large Language Model Extraction of PD-L1 Biomarker Testing Details From Electronic Health Records","venue":null,"work_id":"926ce4b7-7769-4507-bef9-10542e1eb59a","year":2025},"citing_paper":{"arxiv_id":"2506.08231","last_updated":"2025-06-09T20:59:16Z","snapshot_observed_at":"2026-08-07T05:14:40.796573Z","submitted_at":"2025-06-09T20:59:16Z","title":"Ensuring Reliability of Curated EHR-Derived Data: The Validation of Accuracy for LLM/ML-Extracted Information and Data (VALID) Framework","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T05:20:13.689955Z"},"links":{"citing_paper":"/paper/2506.08231"},"observation_digest":"sha256:99ce7c92301bc5a4bd3ceec6971ca0ca0f59c634fca44727cbc006d24a1df08a","observation_id":"59095713-afb4-43d6-afcd-a541806093ad","resolution":{"observed_at":"2026-08-07T05:20:15.345991Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.3390/cancers15061853","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:20:15.180581Z","title":"Replication of Real-World Evidence in Oncology Using Electronic Health Record Data Extracted by Machine Learning","venue":null,"work_id":"17a8df07-53f2-4f21-abe5-170eca4206a3","year":2023},"citing_paper":{"arxiv_id":"2506.08231","last_updated":"2025-06-09T20:59:16Z","snapshot_observed_at":"2026-08-07T05:14:40.796573Z","submitted_at":"2025-06-09T20:59:16Z","title":"Ensuring Reliability of Curated EHR-Derived Data: The Validation of Accuracy for LLM/ML-Extracted Information and Data (VALID) Framework","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T05:20:13.734427Z"},"links":{"citing_paper":"/paper/2506.08231"},"observation_digest":"sha256:68af17f3c996dabf49f562f8a6fd1ef3b4ed529741d4144c2b23c7521b61f05d","observation_id":"e5408e6a-b7ea-41bd-b0de-16b638ceeed6","resolution":{"observed_at":"2026-08-07T05:20:15.183966Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.3390/app13106209","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:20:15.170207Z","title":"A Natural Language Processing Algorithm to Improve Completeness of ECOG Performance Status in Real-World Data","venue":null,"work_id":"73fb0f0e-a327-4a94-9a41-407595134ac4","year":2023},"citing_paper":{"arxiv_id":"2506.08231","last_updated":"2025-06-09T20:59:16Z","snapshot_observed_at":"2026-08-07T05:14:40.796573Z","submitted_at":"2025-06-09T20:59:16Z","title":"Ensuring Reliability of Curated EHR-Derived Data: The Validation of Accuracy for LLM/ML-Extracted Information and Data (VALID) Framework","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T05:20:13.812950Z"},"links":{"citing_paper":"/paper/2506.08231"},"observation_digest":"sha256:828a76658606e370b9c369124046cae9df0a9044aa4c6bb72756ddeb2d4c46a3","observation_id":"58c0e047-212b-410a-b262-e78484ed2fcd","resolution":{"observed_at":"2026-08-07T05:20:15.173703Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1200/jco.2024.42.16_suppl.11149","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:20:15.160237Z","title":"Impact of Carboplatin and Cisplatin Shortages on Treatment Patterns in Patients with Metastatic Solid Tumors","venue":null,"work_id":"9c2d6505-1612-4ed7-8411-1c5fd764345f","year":2024},"citing_paper":{"arxiv_id":"2506.08231","last_updated":"2025-06-09T20:59:16Z","snapshot_observed_at":"2026-08-07T05:14:40.796573Z","submitted_at":"2025-06-09T20:59:16Z","title":"Ensuring Reliability of Curated EHR-Derived Data: The Validation of Accuracy for LLM/ML-Extracted Information and Data (VALID) Framework","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T05:20:13.893184Z"},"links":{"citing_paper":"/paper/2506.08231"},"observation_digest":"sha256:39fed4ff8a4d77c38db50345b0e7534e69550c77724ee5ed5def241b61f67522","observation_id":"44bc6e16-4aa6-4791-b35d-69c88b9925d7","resolution":{"observed_at":"2026-08-07T05:20:15.163477Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1200/jco.2024.42.16_suppl.3610","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:20:15.150038Z","title":"Real-World CtDNA Testing Patterns, Associated Biomarkers and Sites of Metastasis in Early Stage Colorectal Cancer","venue":null,"work_id":"4a783ea3-d500-4c01-877c-bef31d3b7f7b","year":2024},"citing_paper":{"arxiv_id":"2506.08231","last_updated":"2025-06-09T20:59:16Z","snapshot_observed_at":"2026-08-07T05:14:40.796573Z","submitted_at":"2025-06-09T20:59:16Z","title":"Ensuring Reliability of Curated EHR-Derived Data: The Validation of Accuracy for LLM/ML-Extracted Information and Data (VALID) Framework","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T05:20:13.965660Z"},"links":{"citing_paper":"/paper/2506.08231"},"observation_digest":"sha256:d21e1e3ed19d25b051cd877352d038667d9b0f06a2dc13b569be15bb8dc62295","observation_id":"ae4fa896-c6c7-4165-95d4-362714b960f4","resolution":{"observed_at":"2026-08-07T05:20:15.153689Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1016/j.jval.2019.04.1631","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:20:15.139374Z","title":"PPM8 A MACHINE LEARNING MODEL FOR CANCER BIOMARKER IDENTIFICATION IN ELECTRONIC HEALTH RECORDS","venue":null,"work_id":"1543f755-e083-484d-9d4d-4c88e7ef4436","year":2019},"citing_paper":{"arxiv_id":"2506.08231","last_updated":"2025-06-09T20:59:16Z","snapshot_observed_at":"2026-08-07T05:14:40.796573Z","submitted_at":"2025-06-09T20:59:16Z","title":"Ensuring Reliability of Curated EHR-Derived Data: The Validation of Accuracy for LLM/ML-Extracted Information and Data (VALID) Framework","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T05:20:14.024604Z"},"links":{"citing_paper":"/paper/2506.08231"},"observation_digest":"sha256:8562b34532cfd9faa03aeed0e7f5851d461f1c172d272d3c71105d600f3a4f63","observation_id":"b7bcf019-60f5-4a91-a9c7-25d34b708780","resolution":{"observed_at":"2026-08-07T05:20:15.142862Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1811.12793","last_updated":"2018-12-03T16:38:29Z","snapshot_observed_at":"2026-07-06T07:18:14.810715Z","submitted_at":"2018-11-30T13:50:15Z","title":"TIFTI: A Framework for Extracting Drug Intervals from Longitudinal Clinic Notes","version":2},"cited_work":{"arxiv_id":"1811.12793","doi":"10.48550/arxiv.1811.12793","metadata_source":"pith","pith_arxiv_id":"1811.12793","snapshot_observed_at":"2026-08-07T06:16:28.064256Z","title":"TIFTI: A Framework for Extracting Drug Intervals from Longitudinal Clinic Notes","venue":"cs.CL","work_id":"5996016f-b9d1-449e-a5ce-c3d21bfcc2db","year":2018},"citing_paper":{"arxiv_id":"2506.08231","last_updated":"2025-06-09T20:59:16Z","snapshot_observed_at":"2026-08-07T05:14:40.796573Z","submitted_at":"2025-06-09T20:59:16Z","title":"Ensuring Reliability of Curated EHR-Derived Data: The Validation of Accuracy for LLM/ML-Extracted Information and Data (VALID) Framework","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T05:20:14.088647Z"},"links":{"cited_paper":"/paper/1811.12793","citing_paper":"/paper/2506.08231"},"observation_digest":"sha256:10390c6c6598ca71396f113464728d1a4af17ea4cae523b6f9c463a4ebcb8151","observation_id":"ffc6ca74-abd4-48a8-9020-17482edf2ca9","resolution":{"observed_at":"2026-08-07T05:20:15.132036Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1101/2023.03.06.23286770","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:20:15.112543Z","title":"A Hybrid Approach to Scalable Real-World Data Curation by Machine Learning and Human Experts","venue":null,"work_id":"07165e58-276b-4171-b2b1-88d1d105a06d","year":2023},"citing_paper":{"arxiv_id":"2506.08231","last_updated":"2025-06-09T20:59:16Z","snapshot_observed_at":"2026-08-07T05:14:40.796573Z","submitted_at":"2025-06-09T20:59:16Z","title":"Ensuring Reliability of Curated EHR-Derived Data: The Validation of Accuracy for LLM/ML-Extracted Information and Data (VALID) Framework","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T05:20:14.149695Z"},"links":{"citing_paper":"/paper/2506.08231"},"observation_digest":"sha256:97985befdda4d0401c306db045bf738375ff8a4c498796d38566354300ecc58e","observation_id":"1fea1acd-699a-47de-89af-38c80988c083","resolution":{"observed_at":"2026-08-07T05:20:15.115996Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1182/blood-2023-","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:20:15.101242Z","title":null,"venue":null,"work_id":"19567096-ac36-45a7-a474-ab6faeaf7e24","year":2023},"citing_paper":{"arxiv_id":"2506.08231","last_updated":"2025-06-09T20:59:16Z","snapshot_observed_at":"2026-08-07T05:14:40.796573Z","submitted_at":"2025-06-09T20:59:16Z","title":"Ensuring Reliability of Curated EHR-Derived Data: The Validation of Accuracy for LLM/ML-Extracted Information and Data (VALID) Framework","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T05:20:14.229446Z"},"links":{"citing_paper":"/paper/2506.08231"},"observation_digest":"sha256:b72fd3691af064a126d10e5bc1e11c3e23699df8859766be60b5585c90ccf960","observation_id":"0e877f65-6502-467b-a202-5de7ac1c0ca0","resolution":{"observed_at":"2026-08-07T05:20:15.105285Z","resolver_source":"doi_truncated","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:20:15.594347Z","title":null,"venue":null,"work_id":"4f145e08-3542-4ee5-80b0-e73623439642","year":2025},"citing_paper":{"arxiv_id":"2506.08231","last_updated":"2025-06-09T20:59:16Z","snapshot_observed_at":"2026-08-07T05:14:40.796573Z","submitted_at":"2025-06-09T20:59:16Z","title":"Ensuring Reliability of Curated EHR-Derived Data: The Validation of Accuracy for LLM/ML-Extracted Information and Data (VALID) Framework","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T05:20:14.285616Z"},"links":{"citing_paper":"/paper/2506.08231"},"observation_digest":"sha256:4c4f27497b7c8619e6f90a68d09403ecc32e87e87be806a2c9e5a4c3454b9ee2","observation_id":"a6e1ef1e-087e-4adc-adec-9dfa655096be","resolution":{"observed_at":"2026-08-07T05:20:15.597869Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:20:15.583474Z","title":null,"venue":null,"work_id":"584f56d4-e578-4fea-ac29-4532b3798cb0","year":2025},"citing_paper":{"arxiv_id":"2506.08231","last_updated":"2025-06-09T20:59:16Z","snapshot_observed_at":"2026-08-07T05:14:40.796573Z","submitted_at":"2025-06-09T20:59:16Z","title":"Ensuring Reliability of Curated EHR-Derived Data: The Validation of Accuracy for LLM/ML-Extracted Information and Data (VALID) Framework","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T05:20:14.350706Z"},"links":{"citing_paper":"/paper/2506.08231"},"observation_digest":"sha256:a16a3da4860d54de7c063ade1d3dcd0adc2b559ae02deda4619f3789f26292b5","observation_id":"94f90a4a-6f60-4e48-931c-a1e869d07dfc","resolution":{"observed_at":"2026-08-07T05:20:15.586505Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1200/jco.2025.43.16_suppl.e13625","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:20:15.090560Z","title":"Concordance of Response-Based Clinical Trial and Machine Learning–Generated Real-World End Points","venue":null,"work_id":"f21b1dae-b176-4411-82f4-4c650349a710","year":2025},"citing_paper":{"arxiv_id":"2506.08231","last_updated":"2025-06-09T20:59:16Z","snapshot_observed_at":"2026-08-07T05:14:40.796573Z","submitted_at":"2025-06-09T20:59:16Z","title":"Ensuring Reliability of Curated EHR-Derived Data: The Validation of Accuracy for LLM/ML-Extracted Information and Data (VALID) Framework","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T05:20:14.407537Z"},"links":{"citing_paper":"/paper/2506.08231"},"observation_digest":"sha256:1a94e9eb3cac1834066b281ef2f0e5c356004333040dd8b7d783643814170207","observation_id":"a7817ab5-9e79-4710-83da-2c6f2902b854","resolution":{"observed_at":"2026-08-07T05:20:15.094075Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1200/jco.2025.43.16_suppl.555","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:20:15.079967Z","title":"Real-World (Rw) CtDNA Testing Trends and Associated Outcomes in Patients (Pts) with Early Stage Breast Cancer (EBC)","venue":null,"work_id":"144f89b6-4420-46de-9db0-0074aeccc5bc","year":2025},"citing_paper":{"arxiv_id":"2506.08231","last_updated":"2025-06-09T20:59:16Z","snapshot_observed_at":"2026-08-07T05:14:40.796573Z","submitted_at":"2025-06-09T20:59:16Z","title":"Ensuring Reliability of Curated EHR-Derived Data: The Validation of Accuracy for LLM/ML-Extracted Information and Data (VALID) Framework","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T05:20:14.463381Z"},"links":{"citing_paper":"/paper/2506.08231"},"observation_digest":"sha256:11a7857d8a7f8b2a0189c7483ed9a119ddf9496dedf80280568d4f350f732f60","observation_id":"e083fea9-3946-4de9-a9ce-9d86bebe28d5","resolution":{"observed_at":"2026-08-07T05:20:15.083451Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.3390/cancers14133063","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:20:15.068621Z","title":"Considerations for the Use of Machine Learning Extracted Real-World Data to Support Evidence Generation: A Research-Centric Evaluation Framework","venue":null,"work_id":"8a78fdd9-c6a3-482e-98ef-ec55372eb92b","year":2022},"citing_paper":{"arxiv_id":"2506.08231","last_updated":"2025-06-09T20:59:16Z","snapshot_observed_at":"2026-08-07T05:14:40.796573Z","submitted_at":"2025-06-09T20:59:16Z","title":"Ensuring Reliability of Curated EHR-Derived Data: The Validation of Accuracy for LLM/ML-Extracted Information and Data (VALID) Framework","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T05:20:14.522181Z"},"links":{"citing_paper":"/paper/2506.08231"},"observation_digest":"sha256:8aecc9c0ddf41f2a8f865f8c47847f9c09ee2a07ca53127a24e6f973726209a1","observation_id":"14f2e62a-63c9-4bbe-953b-f2f8d9426822","resolution":{"observed_at":"2026-08-07T05:20:15.072511Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1200/cci.23.00046","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:20:15.027445Z","title":"Raising the Bar for Real-World Data in Oncology: Approaches to Quality Across Multiple Dimensions","venue":null,"work_id":"b431e429-495a-4dcf-b694-dc1d1aff6e30","year":2024},"citing_paper":{"arxiv_id":"2506.08231","last_updated":"2025-06-09T20:59:16Z","snapshot_observed_at":"2026-08-07T05:14:40.796573Z","submitted_at":"2025-06-09T20:59:16Z","title":"Ensuring Reliability of Curated EHR-Derived Data: The Validation of Accuracy for LLM/ML-Extracted Information and Data (VALID) Framework","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T05:20:14.587085Z"},"links":{"citing_paper":"/paper/2506.08231"},"observation_digest":"sha256:c9ccf4625aafcfb0462d070ce87e77444b08bded8a4b97ff738215e71222dc68","observation_id":"110dca48-95fd-47b1-a787-ff8453e51283","resolution":{"observed_at":"2026-08-07T05:20:15.060919Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/s40471-014-0027-z","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:20:14.842583Z","title":"Misclassification in Administrative Claims Data: Quantifying the Impact on Treatment Effect Estimates","venue":null,"work_id":"208f88f7-d959-4355-8f68-a640e0636825","year":2014},"citing_paper":{"arxiv_id":"2506.08231","last_updated":"2025-06-09T20:59:16Z","snapshot_observed_at":"2026-08-07T05:14:40.796573Z","submitted_at":"2025-06-09T20:59:16Z","title":"Ensuring Reliability of Curated EHR-Derived Data: The Validation of Accuracy for LLM/ML-Extracted Information and Data (VALID) Framework","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T05:20:14.663258Z"},"links":{"citing_paper":"/paper/2506.08231"},"observation_digest":"sha256:e46eedff1e054a73d146981ca2036815f75087efac5c3433a3067afe92881777","observation_id":"a350b6d1-7c66-44f5-8179-ed0970c429cb","resolution":{"observed_at":"2026-08-07T05:20:14.947626Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:20:14.745364Z","title":"Good Practices for Quantitative Bias Analysis","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2506.08231","last_updated":"2025-06-09T20:59:16Z","snapshot_observed_at":"2026-08-07T05:14:40.796573Z","submitted_at":"2025-06-09T20:59:16Z","title":"Ensuring Reliability of Curated EHR-Derived Data: The Validation of Accuracy for LLM/ML-Extracted Information and Data (VALID) Framework","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T05:20:14.745364Z"},"links":{"citing_paper":"/paper/2506.08231"},"observation_digest":"sha256:e0f4c5753b50d57006a08763c44bf5d9ab16a0d10a5f28f18fecd3a24b302dea","observation_id":"255da10b-e13d-4f30-b3c0-da640aa0b532","resolution":{"observed_at":"2026-08-07T05:20:14.745364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.08231","last_updated":"2025-06-09T20:59:16Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-07T05:14:40.796573Z","submitted_at":"2025-06-09T20:59:16Z","title":"Ensuring Reliability of Curated EHR-Derived Data: The Validation of Accuracy for LLM/ML-Extracted Information and Data (VALID) Framework"},"reference_resolution":{"displayed":29,"state_counts":{"malformed_identifier":1,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":7,"verified_exact":18,"verified_fuzzy":2},"total_outbound_references":29},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 29 of 29 outbound references and 0 inbound Pith citation observations for arXiv:2506.08231."}