{"as_of":"2026-08-05T06:04:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:27ccd0990f550b39d51b8b67d68d9bde3db749e5066b7d71c24b4f1ed455db31","coverage":[{"denominator":21,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":21,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-08T03:29:57.083691Z","state":"measured"},{"denominator":23,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":23,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-04T06:34:03.388597+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T13:17:16.965678Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-06-30T12:24:39.879150Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2604.24710","last_updated":"2026-04-27T17:17:56Z","snapshot_observed_at":"2026-07-06T23:10:42.926677Z","submitted_at":"2026-04-27T17:17:56Z","title":"Case-Specific Rubrics for Clinical AI Evaluation: Methodology, Validation, and LLM-Clinician Agreement Across 823 Encounters","version":1},"cited_work":{"arxiv_id":"2604.24710","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.24710","snapshot_observed_at":"2026-06-30T12:24:39.879150Z","title":"Case-Specific Rubrics for Clinical AI Evaluation: Methodology, Validation, and LLM-Clinician Agreement Across 823 Encounters","venue":"cs.AI","work_id":"9352a6ae-4d65-4cc7-bb25-cac96496f187","year":2026},"citing_paper":{"arxiv_id":"2605.24902","last_updated":"2026-07-15T05:29:18Z","snapshot_observed_at":"2026-08-02T13:17:15.444766Z","submitted_at":"2026-05-24T06:58:57Z","title":"When Reasoning Hurts: Source-Aware Evaluation of Frontier LLMs for Clinical SOAP Note Generation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-30T12:17:33.159344Z"},"links":{"cited_paper":"/paper/2604.24710","citing_paper":"/paper/2605.24902"},"observation_digest":"sha256:8100c9b47c2ff2cfa2402563d6062b429cee31078debc03d4e19f5a2ae85ed9f","observation_id":"65a1575c-f123-43b8-bdfb-c281e70bba87","resolution":{"observed_at":"2026-06-30T12:24:39.880564Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.24710","last_updated":"2026-04-27T17:17:56Z","snapshot_observed_at":"2026-07-06T23:10:42.926677Z","submitted_at":"2026-04-27T17:17:56Z","title":"Case-Specific Rubrics for Clinical AI Evaluation: Methodology, Validation, and LLM-Clinician Agreement Across 823 Encounters","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.24710","snapshot_observed_at":"2026-08-02T13:17:16.965678Z","title":"arXiv preprint arXiv:2604.24710","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.24902","last_updated":"2026-07-15T05:29:18Z","snapshot_observed_at":"2026-08-02T13:17:15.444766Z","submitted_at":"2026-05-24T06:58:57Z","title":"When Reasoning Hurts: Source-Aware Evaluation of Frontier LLMs for Clinical SOAP Note Generation","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-02T13:17:16.965678Z"},"links":{"cited_paper":"/paper/2604.24710","citing_paper":"/paper/2605.24902"},"observation_digest":"sha256:d1d5ab54af734a0475dc8f2b13878fc8899e3c1a545bbc862554a8a8db79d4ca","observation_id":"fc2325a6-8a90-4925-aec0-e0054a498af5","resolution":{"observed_at":"2026-08-02T13:17:16.965678Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2604.24710/citation-record","integrity":"/paper/2604.24710/integrity","json":"/paper/2604.24710/citation-record.json","paper":"/paper/2604.24710"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.11124/jbies-24-00042","metadata_source":"crossref","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Monitoring performance of clinical artificial intelligence in health care: a scoping review","venue":"JBI Evidence Synthesis","work_id":"d76417c9-e035-4072-ae65-8ce500704c3b","year":2024},"citing_paper":{"arxiv_id":"2604.24710","last_updated":"2026-04-27T17:17:56Z","snapshot_observed_at":"2026-07-06T23:10:42.926677Z","submitted_at":"2026-04-27T17:17:56Z","title":"Case-Specific Rubrics for Clinical AI Evaluation: Methodology, Validation, and LLM-Clinician Agreement Across 823 Encounters","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-08T03:29:57.083691Z"},"links":{"citing_paper":"/paper/2604.24710"},"observation_digest":"sha256:371cbc2ec04b0be17af463e6ad374f560da4fcbb7d96279500bde0e2f71731ea","observation_id":"df6a07d0-e3a2-45a7-a91c-1fb9e442ba0b","resolution":{"observed_at":"2026-05-09T00:24:29.380051Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"State of Clinical AI Report 2026","venue":null,"work_id":"830ee34a-8f1f-4aae-97f0-df0a73c3076c","year":2026},"citing_paper":{"arxiv_id":"2604.24710","last_updated":"2026-04-27T17:17:56Z","snapshot_observed_at":"2026-07-06T23:10:42.926677Z","submitted_at":"2026-04-27T17:17:56Z","title":"Case-Specific Rubrics for Clinical AI Evaluation: Methodology, Validation, and LLM-Clinician Agreement Across 823 Encounters","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-08T03:29:57.083691Z"},"links":{"citing_paper":"/paper/2604.24710"},"observation_digest":"sha256:9271d3e4431ed8349890759cc39f5f00244f070d13f213898af8fbd82bdffc12","observation_id":"1218eebf-ae67-4269-ae0a-2df5f14d1a93","resolution":{"observed_at":"2026-05-26T21:58:23.340503Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1038/s41746-025-02005-2","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T04:21:38.248292Z","title":"Evaluating clinical AI summaries with large language models as judges","venue":"npj Digital Medicine","work_id":"70d42f69-63d4-4f75-bc4c-815b55d094b5","year":2025},"citing_paper":{"arxiv_id":"2604.24710","last_updated":"2026-04-27T17:17:56Z","snapshot_observed_at":"2026-07-06T23:10:42.926677Z","submitted_at":"2026-04-27T17:17:56Z","title":"Case-Specific Rubrics for Clinical AI Evaluation: Methodology, Validation, and LLM-Clinician Agreement Across 823 Encounters","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-08T03:29:57.083691Z"},"links":{"citing_paper":"/paper/2604.24710"},"observation_digest":"sha256:fc0a94b8784b4ac449417f9b8c6dce157aef66112f9361a251b574b696d5c4a4","observation_id":"d52e4466-ebd9-4d92-96c2-3936aa81e22c","resolution":{"observed_at":"2026-05-09T00:24:29.368581Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1038/s41746-024-","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A framework for human evaluation of large language models in healthcare derived from literature review.npj Digital Medicine","venue":null,"work_id":"1d277a3c-800d-43e4-ac03-4c5c74b544e8","year":2024},"citing_paper":{"arxiv_id":"2604.24710","last_updated":"2026-04-27T17:17:56Z","snapshot_observed_at":"2026-07-06T23:10:42.926677Z","submitted_at":"2026-04-27T17:17:56Z","title":"Case-Specific Rubrics for Clinical AI Evaluation: Methodology, Validation, and LLM-Clinician Agreement Across 823 Encounters","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-08T03:29:57.083691Z"},"links":{"citing_paper":"/paper/2604.24710"},"observation_digest":"sha256:50cf2ac82c74674db674e27dc78c37b846e140da5e7a042e8b98e3ace75b4e29","observation_id":"1d63a446-306d-457d-b556-d8825fbc8135","resolution":{"observed_at":"2026-05-09T00:24:29.363967Z","resolver_source":"doi","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.4338/aci-","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The 9-Item PDQI-9 score is not useful in evaluating EMR note quality in Emergency Medicine.Applied Clinical Informatics","venue":null,"work_id":"0d71e714-4e20-4c8a-80ba-7742b35a828c","year":2017},"citing_paper":{"arxiv_id":"2604.24710","last_updated":"2026-04-27T17:17:56Z","snapshot_observed_at":"2026-07-06T23:10:42.926677Z","submitted_at":"2026-04-27T17:17:56Z","title":"Case-Specific Rubrics for Clinical AI Evaluation: Methodology, Validation, and LLM-Clinician Agreement Across 823 Encounters","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-08T03:29:57.083691Z"},"links":{"citing_paper":"/paper/2604.24710"},"observation_digest":"sha256:c7befb2769d6517f90613462a9938aeccb3cc7b4207261b35fe5196a2ada7ef0","observation_id":"b6f7ba66-13c0-4c15-9c19-970be585c320","resolution":{"observed_at":"2026-05-09T00:24:29.360188Z","resolver_source":"doi","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/s11606-023-08250-5","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Assessing the Assessment–Developing a Novel Tool for Eval- uating Clinical Notes’ Diagnostic Assessment Quality.J Gen Intern Med","venue":null,"work_id":"a99ec4e8-e0ba-4ae4-8d33-d01c308d7878","year":2023},"citing_paper":{"arxiv_id":"2604.24710","last_updated":"2026-04-27T17:17:56Z","snapshot_observed_at":"2026-07-06T23:10:42.926677Z","submitted_at":"2026-04-27T17:17:56Z","title":"Case-Specific Rubrics for Clinical AI Evaluation: Methodology, Validation, and LLM-Clinician Agreement Across 823 Encounters","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-08T03:29:57.083691Z"},"links":{"citing_paper":"/paper/2604.24710"},"observation_digest":"sha256:3ab1335c1b08b8c2f8532e8f2163bb146abd49e03bf1b673ff6cbf0c3e5227c4","observation_id":"fbee87b9-f9bb-4688-80e3-597eed91ee70","resolution":{"observed_at":"2026-05-09T00:24:29.391592Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1038/s41746-023-00773-3","metadata_source":"crossref","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The impact of inconsistent human annotations on AI driven clinical decision making","venue":"npj Digital Medicine","work_id":"83df70c3-6151-445f-a110-0e966bf25a04","year":2023},"citing_paper":{"arxiv_id":"2604.24710","last_updated":"2026-04-27T17:17:56Z","snapshot_observed_at":"2026-07-06T23:10:42.926677Z","submitted_at":"2026-04-27T17:17:56Z","title":"Case-Specific Rubrics for Clinical AI Evaluation: Methodology, Validation, and LLM-Clinician Agreement Across 823 Encounters","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-08T03:29:57.083691Z"},"links":{"citing_paper":"/paper/2604.24710"},"observation_digest":"sha256:5ece6bf5a750b229b147182ee7b83097d80e0202effc44fc2cc5c14c94e543ba","observation_id":"e39b0ac2-fa8d-43e0-ab37-6cc74e76d7d5","resolution":{"observed_at":"2026-05-09T00:24:29.442257Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Introducing HealthBench","venue":null,"work_id":"c961325e-1d84-47cc-813b-eb83c44dd670","year":2025},"citing_paper":{"arxiv_id":"2604.24710","last_updated":"2026-04-27T17:17:56Z","snapshot_observed_at":"2026-07-06T23:10:42.926677Z","submitted_at":"2026-04-27T17:17:56Z","title":"Case-Specific Rubrics for Clinical AI Evaluation: Methodology, Validation, and LLM-Clinician Agreement Across 823 Encounters","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-08T03:29:57.083691Z"},"links":{"citing_paper":"/paper/2604.24710"},"observation_digest":"sha256:9fa3db0a4d91738d8ce592d7647b31224985e8ab41e3e9057b22b9cb9901346c","observation_id":"2baa0a62-aab6-485e-b086-8abb02576483","resolution":{"observed_at":"2026-05-26T21:58:23.317333Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1038/s41591-025-04151-2","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"autonomy","venue":"Nature Medicine","work_id":"88e3fba0-155a-4a37-a547-fb1c712e9428","year":2026},"citing_paper":{"arxiv_id":"2604.24710","last_updated":"2026-04-27T17:17:56Z","snapshot_observed_at":"2026-07-06T23:10:42.926677Z","submitted_at":"2026-04-27T17:17:56Z","title":"Case-Specific Rubrics for Clinical AI Evaluation: Methodology, Validation, and LLM-Clinician Agreement Across 823 Encounters","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-08T03:29:57.083691Z"},"links":{"citing_paper":"/paper/2604.24710"},"observation_digest":"sha256:8525d4d4f7091d7293389f54c40221e78018fc671b3da3ac8a74f83850e45124","observation_id":"241f6b53-e63a-47fd-af2b-891197c89396","resolution":{"observed_at":"2026-05-09T00:24:29.496635Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-15T22:51:36.302773+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-15T22:51:36.302773+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.22405","last_updated":"2025-07-02T17:58:37Z","snapshot_observed_at":"2026-08-03T17:40:14.447460Z","submitted_at":"2025-06-27T17:27:26Z","title":"Sequential Diagnosis with Language Models","version":2},"cited_work":{"arxiv_id":"2506.22405","doi":"10.48550/arxiv.2506.22405","metadata_source":"pith","pith_arxiv_id":"2506.22405","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Sequential diagnosis with language models","venue":"cs.CL","work_id":"21677228-f8df-4248-a5d4-4fd577355cdf","year":2025},"citing_paper":{"arxiv_id":"2604.24710","last_updated":"2026-04-27T17:17:56Z","snapshot_observed_at":"2026-07-06T23:10:42.926677Z","submitted_at":"2026-04-27T17:17:56Z","title":"Case-Specific Rubrics for Clinical AI Evaluation: Methodology, Validation, and LLM-Clinician Agreement Across 823 Encounters","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-08T03:29:57.083691Z"},"links":{"cited_paper":"/paper/2506.22405","citing_paper":"/paper/2604.24710"},"observation_digest":"sha256:28795fc102a914a460c831f1b05b88d93063b43c846f7b5f3951434bae1f2e95","observation_id":"36a7e73d-e9fd-4682-80ba-695d35b6b16c","resolution":{"observed_at":"2026-05-11T22:06:14.394469Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.16947","last_updated":"2025-07-22T18:37:33Z","snapshot_observed_at":"2026-07-06T22:01:16.878652Z","submitted_at":"2025-07-22T18:37:33Z","title":"AI-based Clinical Decision Support for Primary Care: A Real-World Study","version":1},"cited_work":{"arxiv_id":"2507.16947","doi":"10.48550/arxiv.2507.16947","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.16947","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"AI-based clinical decision support for primary care: A real-world study","venue":"ArXiv.org","work_id":"2aa46bee-87d3-4b09-b0fd-58079f7c128e","year":2025},"citing_paper":{"arxiv_id":"2604.24710","last_updated":"2026-04-27T17:17:56Z","snapshot_observed_at":"2026-07-06T23:10:42.926677Z","submitted_at":"2026-04-27T17:17:56Z","title":"Case-Specific Rubrics for Clinical AI Evaluation: Methodology, Validation, and LLM-Clinician Agreement Across 823 Encounters","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-08T03:29:57.083691Z"},"links":{"cited_paper":"/paper/2507.16947","citing_paper":"/paper/2604.24710"},"observation_digest":"sha256:37e9c5e5ea59d1eadfba0dd6f980e30436f981c660629d4b9d696bbd34f67ffd","observation_id":"3d8cd92d-de23-45b0-8137-2eb238658871","resolution":{"observed_at":"2026-05-11T22:06:14.406606Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Hyperscribe","venue":null,"work_id":"c5a30340-acb3-41c2-a9f3-90d21c6b9fb1","year":2025},"citing_paper":{"arxiv_id":"2604.24710","last_updated":"2026-04-27T17:17:56Z","snapshot_observed_at":"2026-07-06T23:10:42.926677Z","submitted_at":"2026-04-27T17:17:56Z","title":"Case-Specific Rubrics for Clinical AI Evaluation: Methodology, Validation, and LLM-Clinician Agreement Across 823 Encounters","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-08T03:29:57.083691Z"},"links":{"citing_paper":"/paper/2604.24710"},"observation_digest":"sha256:d9256a9cad8f9ac0b3c92a36c6a78e5545cfd6ff54d53ba59fada3d395b66bc2","observation_id":"89ed87b0-74ba-4b45-b0ab-544eca6938de","resolution":{"observed_at":"2026-05-26T21:58:23.336733Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"canvas-hyperscribe","venue":null,"work_id":"0c992bcb-752b-47f8-bf7e-58c6212fe4a8","year":2025},"citing_paper":{"arxiv_id":"2604.24710","last_updated":"2026-04-27T17:17:56Z","snapshot_observed_at":"2026-07-06T23:10:42.926677Z","submitted_at":"2026-04-27T17:17:56Z","title":"Case-Specific Rubrics for Clinical AI Evaluation: Methodology, Validation, and LLM-Clinician Agreement Across 823 Encounters","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-08T03:29:57.083691Z"},"links":{"citing_paper":"/paper/2604.24710"},"observation_digest":"sha256:52e08b361ca3a47f797578ac75cdac87505a41bd1ba7f0da90e302a865c8ae2b","observation_id":"9c4a7649-c215-419f-a777-38efe989e0cb","resolution":{"observed_at":"2026-05-26T21:58:23.333485Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Canvas SDK Commands","venue":null,"work_id":"00bd0f0c-5981-41cf-bfa3-6634f81fd4d3","year":null},"citing_paper":{"arxiv_id":"2604.24710","last_updated":"2026-04-27T17:17:56Z","snapshot_observed_at":"2026-07-06T23:10:42.926677Z","submitted_at":"2026-04-27T17:17:56Z","title":"Case-Specific Rubrics for Clinical AI Evaluation: Methodology, Validation, and LLM-Clinician Agreement Across 823 Encounters","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-08T03:29:57.083691Z"},"links":{"citing_paper":"/paper/2604.24710"},"observation_digest":"sha256:9ad288de33586681c962e3339641413ccfc1b7263280285d2693f3c4a0635280","observation_id":"85f1dc4e-9201-440f-a623-0cd186c95eea","resolution":{"observed_at":"2026-05-26T21:58:23.323908Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"End-to-End Evaluation and Governance of Hyperscribe, an EHR-Embedded Clinical AI Agent","venue":null,"work_id":"cc239ebb-2dbc-4d0f-86ba-7b2bf5d738b5","year":null},"citing_paper":{"arxiv_id":"2604.24710","last_updated":"2026-04-27T17:17:56Z","snapshot_observed_at":"2026-07-06T23:10:42.926677Z","submitted_at":"2026-04-27T17:17:56Z","title":"Case-Specific Rubrics for Clinical AI Evaluation: Methodology, Validation, and LLM-Clinician Agreement Across 823 Encounters","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-08T03:29:57.083691Z"},"links":{"citing_paper":"/paper/2604.24710"},"observation_digest":"sha256:8d93e7d49309caefd8beba78fe90f7222460266f5fef35f162e330cd2bd94680","observation_id":"28a8a3f3-5245-43c1-862a-2c0f67b9b93a","resolution":{"observed_at":"2026-05-26T21:58:23.320777Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"ScribeBench: Dataset Usage","venue":null,"work_id":"a60b3934-a4cb-40b9-999a-01ccce23463b","year":2026},"citing_paper":{"arxiv_id":"2604.24710","last_updated":"2026-04-27T17:17:56Z","snapshot_observed_at":"2026-07-06T23:10:42.926677Z","submitted_at":"2026-04-27T17:17:56Z","title":"Case-Specific Rubrics for Clinical AI Evaluation: Methodology, Validation, and LLM-Clinician Agreement Across 823 Encounters","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-08T03:29:57.083691Z"},"links":{"citing_paper":"/paper/2604.24710"},"observation_digest":"sha256:a76b0bfb52947267b7dc06cd5f179cc9f73afc70f0036961268cee9eae8b33d2","observation_id":"7eed98ca-1527-44a7-aeb7-7c7acd12d320","resolution":{"observed_at":"2026-05-26T21:58:23.327212Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"ScribeBench: A Benchmark Dataset for Evaluating AI-Generated Medical Documentation PhysioNet","venue":null,"work_id":"2ae93087-18ab-4eba-8db5-270f21d4b45b","year":null},"citing_paper":{"arxiv_id":"2604.24710","last_updated":"2026-04-27T17:17:56Z","snapshot_observed_at":"2026-07-06T23:10:42.926677Z","submitted_at":"2026-04-27T17:17:56Z","title":"Case-Specific Rubrics for Clinical AI Evaluation: Methodology, Validation, and LLM-Clinician Agreement Across 823 Encounters","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-08T03:29:57.083691Z"},"links":{"citing_paper":"/paper/2604.24710"},"observation_digest":"sha256:6a31b96fa78692d68bd0dec927b13efe5b991cb38e3841b7a9bb63f99f770e7c","observation_id":"a633164e-b7c8-4fa2-a5d9-dde506938c90","resolution":{"observed_at":"2026-05-26T21:58:23.330528Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.2307/2332226","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"A new measure of rank correlation.Biometrika","venue":"Biometrika","work_id":"76c8c7d6-14af-4d66-b5aa-670717589b73","year":1938},"citing_paper":{"arxiv_id":"2604.24710","last_updated":"2026-04-27T17:17:56Z","snapshot_observed_at":"2026-07-06T23:10:42.926677Z","submitted_at":"2026-04-27T17:17:56Z","title":"Case-Specific Rubrics for Clinical AI Evaluation: Methodology, Validation, and LLM-Clinician Agreement Across 823 Encounters","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-08T03:29:57.083691Z"},"links":{"citing_paper":"/paper/2604.24710"},"observation_digest":"sha256:719ea78ede263a236e061f7ce1c46863568e859f78ba49965550edb425c6c656","observation_id":"31b36906-5322-461f-b422-9b6fd34a1c08","resolution":{"observed_at":"2026-05-09T00:24:29.463499Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1093/jamia/ocaf068","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Development and validation of the provider documentation summarization quality instrument for large language models","venue":"Journal of the American Medical Informatics Association","work_id":"9db2c1ab-5e71-4c76-b279-18c6b9a8afa6","year":2025},"citing_paper":{"arxiv_id":"2604.24710","last_updated":"2026-04-27T17:17:56Z","snapshot_observed_at":"2026-07-06T23:10:42.926677Z","submitted_at":"2026-04-27T17:17:56Z","title":"Case-Specific Rubrics for Clinical AI Evaluation: Methodology, Validation, and LLM-Clinician Agreement Across 823 Encounters","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-08T03:29:57.083691Z"},"links":{"citing_paper":"/paper/2604.24710"},"observation_digest":"sha256:0d9dd78363a14e4d3b48e0c124507b5d733f84ee57eb909fcf04f5d3f2f62504","observation_id":"cd016ca9-8739-47b7-9a07-c8fd5e8383f3","resolution":{"observed_at":"2026-05-09T00:24:29.485794Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1038/s41746-025-01670-7","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T06:51:44.270989Z","title":"npj Digital Medicine8, 274 (2025) https://doi.org/10.1038/s41746-025-01670-7","venue":"npj Digital Medicine","work_id":"9fe811e1-4ce8-4df7-8266-18d0bf1b8f77","year":2025},"citing_paper":{"arxiv_id":"2604.24710","last_updated":"2026-04-27T17:17:56Z","snapshot_observed_at":"2026-07-06T23:10:42.926677Z","submitted_at":"2026-04-27T17:17:56Z","title":"Case-Specific Rubrics for Clinical AI Evaluation: Methodology, Validation, and LLM-Clinician Agreement Across 823 Encounters","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-08T03:29:57.083691Z"},"links":{"citing_paper":"/paper/2604.24710"},"observation_digest":"sha256:a572df7c8802426206fbae15c3936f5a098a22a56ebf20407a561b8ae69dcd5e","observation_id":"869b051d-416e-4ac7-be74-cf89c7aedfa0","resolution":{"observed_at":"2026-05-09T00:24:29.504121Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-16T21:20:47.546272+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-16T21:20:47.546272+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1101/2025.01.29.25320859","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Benchmarking and datasets for ambient clinical documentation: a scoping review.medRxiv","venue":"medRxiv","work_id":"c5e4ef09-d032-4fb8-8719-de160a4b142f","year":2025},"citing_paper":{"arxiv_id":"2604.24710","last_updated":"2026-04-27T17:17:56Z","snapshot_observed_at":"2026-07-06T23:10:42.926677Z","submitted_at":"2026-04-27T17:17:56Z","title":"Case-Specific Rubrics for Clinical AI Evaluation: Methodology, Validation, and LLM-Clinician Agreement Across 823 Encounters","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-08T03:29:57.083691Z"},"links":{"citing_paper":"/paper/2604.24710"},"observation_digest":"sha256:9486f1a345f3bf75d86697fcd807eda48942a1ddec1d7ae059b1c96cc6f47f78","observation_id":"d422c0db-f00c-45ef-9826-8b1ef59374a9","resolution":{"observed_at":"2026-05-09T00:24:29.376228Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2604.24710","last_updated":"2026-04-27T17:17:56Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-07-06T23:10:42.926677Z","submitted_at":"2026-04-27T17:17:56Z","title":"Case-Specific Rubrics for Clinical AI Evaluation: Methodology, Validation, and LLM-Clinician Agreement Across 823 Encounters"},"reference_resolution":{"displayed":21,"state_counts":{"malformed_identifier":2,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":0,"verified_exact":9,"verified_fuzzy":8},"total_outbound_references":21},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"thesis":"As of 5 August 2026, this Paper Citation Record lists 21 of 21 outbound references and 2 inbound Pith citation observations for arXiv:2604.24710."}