{"record_type":"pith_number_record","schema_url":"https://pith.science/schemas/pith-number/v1.json","pith_number":"pith:2025:CQYNCQLVMCSGNMFXNRK5WU4MLP","short_pith_number":"pith:CQYNCQLV","schema_version":"1.0","canonical_sha256":"1430d1417560a466b0b76c55db538c5bd7c4ce6b4a1457264369d720d3545b81","source":{"kind":"arxiv","id":"2505.02722","version":1},"attestation_state":"computed","paper":{"title":"Enhancing LLMs' Clinical Reasoning with Real-World Data from a Nationwide Sepsis Registry","license":"http://creativecommons.org/licenses/by-nc-nd/4.0/","headline":"","cross_cats":["cs.LG"],"primary_cat":"cs.AI","authors_text":"Chaeeun Shim, Chae-Man Lim, Chami Im, Dong-Wan Kang, Edward Choi, Eu Suk Kim, Gee Young Suh, Han-Gil Jeong, Hee-Joon Bae, Hong Bin Kim, Junu Kim, Kyoung-Ho Song, Sejoong Kim, Seong Jin Choi, Song Mi Moon, Sungjin Park, Sung Yoon Lim, Su Yeon Lee, Yong Soo Kim","submitted_at":"2025-05-05T15:23:47Z","abstract_excerpt":"Although large language models (LLMs) have demonstrated impressive reasoning capabilities across general domains, their effectiveness in real-world clinical practice remains limited. This is likely due to their insufficient exposure to real-world clinical data during training, as such data is typically not included due to privacy concerns. To address this, we propose enhancing the clinical reasoning capabilities of LLMs by leveraging real-world clinical data. We constructed reasoning-intensive questions from a nationwide sepsis registry and fine-tuned Phi-4 on these questions using reinforceme"},"verification_status":{"content_addressed":true,"pith_receipt":true,"author_attested":false,"weak_author_claims":0,"strong_author_claims":0,"externally_anchored":false,"storage_verified":false,"citation_signatures":0,"replication_records":0,"graph_snapshot":true,"references_resolved":false,"formal_links_present":false},"canonical_record":{"source":{"id":"2505.02722","kind":"arxiv","version":1},"metadata":{"license":"http://creativecommons.org/licenses/by-nc-nd/4.0/","primary_cat":"cs.AI","submitted_at":"2025-05-05T15:23:47Z","cross_cats_sorted":["cs.LG"],"title_canon_sha256":"2eefa1ef4c6f9d2e2795a2908717062780883cc39e54fac04392f04d6ae1d3e4","abstract_canon_sha256":"2f4a9fdbd8ef516fafa12cbcb208661679682239320f67d86e2f22c3406ed5f5"},"schema_version":"1.0"},"receipt":{"kind":"pith_receipt","key_id":"pith-v1-2026-05","algorithm":"ed25519","signed_at":"2026-07-05T10:58:41.997269Z","signature_b64":"XWkE17118hsnKv620H0jGPEfIXuqHZJanC6nv8L84y70uwI70an2qHyNimUvCKld7bLt4O5gVUDm3yr5f6K7CQ==","signed_message":"canonical_sha256_bytes","builder_version":"pith-number-builder-2026-05-17-v1","receipt_version":"0.3","canonical_sha256":"1430d1417560a466b0b76c55db538c5bd7c4ce6b4a1457264369d720d3545b81","last_reissued_at":"2026-07-05T10:58:41.996769Z","signature_status":"signed_v1","first_computed_at":"2026-07-05T10:58:41.996769Z","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54"},"graph_snapshot":{"paper":{"title":"Enhancing LLMs' Clinical Reasoning with Real-World Data from a Nationwide Sepsis Registry","license":"http://creativecommons.org/licenses/by-nc-nd/4.0/","headline":"","cross_cats":["cs.LG"],"primary_cat":"cs.AI","authors_text":"Chaeeun Shim, Chae-Man Lim, Chami Im, Dong-Wan Kang, Edward Choi, Eu Suk Kim, Gee Young Suh, Han-Gil Jeong, Hee-Joon Bae, Hong Bin Kim, Junu Kim, Kyoung-Ho Song, Sejoong Kim, Seong Jin Choi, Song Mi Moon, Sungjin Park, Sung Yoon Lim, Su Yeon Lee, Yong Soo Kim","submitted_at":"2025-05-05T15:23:47Z","abstract_excerpt":"Although large language models (LLMs) have demonstrated impressive reasoning capabilities across general domains, their effectiveness in real-world clinical practice remains limited. This is likely due to their insufficient exposure to real-world clinical data during training, as such data is typically not included due to privacy concerns. To address this, we propose enhancing the clinical reasoning capabilities of LLMs by leveraging real-world clinical data. We constructed reasoning-intensive questions from a nationwide sepsis registry and fine-tuned Phi-4 on these questions using reinforceme"},"claims":{"count":0,"items":[],"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"source":{"id":"2505.02722","kind":"arxiv","version":1},"verdict":{"id":null,"model_set":{},"created_at":null,"strongest_claim":"","one_line_summary":"","pipeline_version":null,"weakest_assumption":"","pith_extraction_headline":""},"integrity":{"clean":true,"summary":{"advisory":0,"critical":0,"by_detector":{},"informational":0},"endpoint":"/pith/2505.02722/integrity.json","findings":[],"available":true,"detectors_run":[],"snapshot_sha256":"c28c3603d3b5d939e8dc4c7e95fa8dfce3d595e45f758748cecf8e644a296938"},"references":{"count":0,"sample":[],"resolved_work":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57","internal_anchors":0},"formal_canon":{"evidence_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"author_claims":{"count":0,"strong_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"builder_version":"pith-number-builder-2026-05-17-v1"},"aliases":[{"alias_kind":"arxiv","alias_value":"2505.02722","created_at":"2026-07-05T10:58:41.996829+00:00"},{"alias_kind":"arxiv_version","alias_value":"2505.02722v1","created_at":"2026-07-05T10:58:41.996829+00:00"},{"alias_kind":"doi","alias_value":"10.48550/arxiv.2505.02722","created_at":"2026-07-05T10:58:41.996829+00:00"},{"alias_kind":"pith_short_12","alias_value":"CQYNCQLVMCSG","created_at":"2026-07-05T10:58:41.996829+00:00"},{"alias_kind":"pith_short_16","alias_value":"CQYNCQLVMCSGNMFX","created_at":"2026-07-05T10:58:41.996829+00:00"},{"alias_kind":"pith_short_8","alias_value":"CQYNCQLV","created_at":"2026-07-05T10:58:41.996829+00:00"}],"events":[],"event_summary":{},"paper_claims":[],"inbound_citations":{"count":1,"internal_anchor_count":1,"sample":[{"citing_arxiv_id":"2505.24105","citing_title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","ref_index":21,"is_internal_anchor":true}]},"formal_canon":{"evidence_count":0,"sample":[],"anchors":[]},"links":{"html":"https://pith.science/pith/CQYNCQLVMCSGNMFXNRK5WU4MLP","json":"https://pith.science/pith/CQYNCQLVMCSGNMFXNRK5WU4MLP.json","graph_json":"https://pith.science/api/pith-number/CQYNCQLVMCSGNMFXNRK5WU4MLP/graph.json","events_json":"https://pith.science/api/pith-number/CQYNCQLVMCSGNMFXNRK5WU4MLP/events.json","paper":"https://pith.science/paper/CQYNCQLV"},"agent_actions":{"view_html":"https://pith.science/pith/CQYNCQLVMCSGNMFXNRK5WU4MLP","download_json":"https://pith.science/pith/CQYNCQLVMCSGNMFXNRK5WU4MLP.json","view_paper":"https://pith.science/paper/CQYNCQLV","resolve_alias":"https://pith.science/api/pith-number/resolve?arxiv=2505.02722&json=true","fetch_graph":"https://pith.science/api/pith-number/CQYNCQLVMCSGNMFXNRK5WU4MLP/graph.json","fetch_events":"https://pith.science/api/pith-number/CQYNCQLVMCSGNMFXNRK5WU4MLP/events.json","actions":{"anchor_timestamp":"https://pith.science/pith/CQYNCQLVMCSGNMFXNRK5WU4MLP/action/timestamp_anchor","attest_storage":"https://pith.science/pith/CQYNCQLVMCSGNMFXNRK5WU4MLP/action/storage_attestation","attest_author":"https://pith.science/pith/CQYNCQLVMCSGNMFXNRK5WU4MLP/action/author_attestation","sign_citation":"https://pith.science/pith/CQYNCQLVMCSGNMFXNRK5WU4MLP/action/citation_signature","submit_replication":"https://pith.science/pith/CQYNCQLVMCSGNMFXNRK5WU4MLP/action/replication_record"}},"created_at":"2026-07-05T10:58:41.996829+00:00","updated_at":"2026-07-05T10:58:41.996829+00:00"}