{"record_type":"pith_number_record","schema_url":"https://pith.science/schemas/pith-number/v1.json","pith_number":"pith:2025:3VHDQYGDA5UV6TG4NEPE4XARGL","short_pith_number":"pith:3VHDQYGD","schema_version":"1.0","canonical_sha256":"dd4e3860c307695f4cdc691e4e5c1132c3e83618de1dc9b0ac0b56fbba1ddc19","source":{"kind":"arxiv","id":"2502.03004","version":1},"attestation_state":"computed","paper":{"title":"MedBioLM: Optimizing Medical and Biological QA with Fine-Tuned Large Language Models and Retrieval-Augmented Generation","license":"http://creativecommons.org/licenses/by/4.0/","headline":"","cross_cats":["cs.AI"],"primary_cat":"cs.CL","authors_text":"Seonok Kim","submitted_at":"2025-02-05T08:58:35Z","abstract_excerpt":"Large Language Models (LLMs) have demonstrated impressive capabilities across natural language processing tasks. However, their application to specialized domains such as medicine and biology requires further optimization to ensure factual accuracy, reliability, and contextual depth. We introduce MedBioLM, a domain-adapted biomedical question-answering model designed to enhance both short-form and long-form queries. By integrating fine-tuning and retrieval-augmented generation (RAG), MedBioLM dynamically incorporates domain-specific knowledge, improving reasoning abilities and factual accuracy"},"verification_status":{"content_addressed":true,"pith_receipt":true,"author_attested":false,"weak_author_claims":0,"strong_author_claims":0,"externally_anchored":false,"storage_verified":false,"citation_signatures":0,"replication_records":0,"graph_snapshot":true,"references_resolved":false,"formal_links_present":false},"canonical_record":{"source":{"id":"2502.03004","kind":"arxiv","version":1},"metadata":{"license":"http://creativecommons.org/licenses/by/4.0/","primary_cat":"cs.CL","submitted_at":"2025-02-05T08:58:35Z","cross_cats_sorted":["cs.AI"],"title_canon_sha256":"3092b1caa633ebf9efe579b865a5322516544ddd2de5c82782488bcaf744d27e","abstract_canon_sha256":"b1a80b3052918a040b7495fed764190d888f9dc315d88c7dc286fc6dd87f3dd7"},"schema_version":"1.0"},"receipt":{"kind":"pith_receipt","key_id":"pith-v1-2026-05","algorithm":"ed25519","signed_at":"2026-07-05T10:09:58.101064Z","signature_b64":"fxyzj09Au7ECWPlyayTRW/QWAV82AcZpjD1OuaC36D/xagAvSskNvvYlEWyAA/jw5W5SuWBv9cxAsxEG6Mk3Aw==","signed_message":"canonical_sha256_bytes","builder_version":"pith-number-builder-2026-05-17-v1","receipt_version":"0.3","canonical_sha256":"dd4e3860c307695f4cdc691e4e5c1132c3e83618de1dc9b0ac0b56fbba1ddc19","last_reissued_at":"2026-07-05T10:09:58.100548Z","signature_status":"signed_v1","first_computed_at":"2026-07-05T10:09:58.100548Z","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54"},"graph_snapshot":{"paper":{"title":"MedBioLM: Optimizing Medical and Biological QA with Fine-Tuned Large Language Models and Retrieval-Augmented Generation","license":"http://creativecommons.org/licenses/by/4.0/","headline":"","cross_cats":["cs.AI"],"primary_cat":"cs.CL","authors_text":"Seonok Kim","submitted_at":"2025-02-05T08:58:35Z","abstract_excerpt":"Large Language Models (LLMs) have demonstrated impressive capabilities across natural language processing tasks. However, their application to specialized domains such as medicine and biology requires further optimization to ensure factual accuracy, reliability, and contextual depth. We introduce MedBioLM, a domain-adapted biomedical question-answering model designed to enhance both short-form and long-form queries. By integrating fine-tuning and retrieval-augmented generation (RAG), MedBioLM dynamically incorporates domain-specific knowledge, improving reasoning abilities and factual accuracy"},"claims":{"count":0,"items":[],"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"source":{"id":"2502.03004","kind":"arxiv","version":1},"verdict":{"id":null,"model_set":{},"created_at":null,"strongest_claim":"","one_line_summary":"","pipeline_version":null,"weakest_assumption":"","pith_extraction_headline":""},"integrity":{"clean":true,"summary":{"advisory":0,"critical":0,"by_detector":{},"informational":0},"endpoint":"/pith/2502.03004/integrity.json","findings":[],"available":true,"detectors_run":[],"snapshot_sha256":"c28c3603d3b5d939e8dc4c7e95fa8dfce3d595e45f758748cecf8e644a296938"},"references":{"count":0,"sample":[],"resolved_work":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57","internal_anchors":0},"formal_canon":{"evidence_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"author_claims":{"count":0,"strong_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"builder_version":"pith-number-builder-2026-05-17-v1"},"aliases":[{"alias_kind":"arxiv","alias_value":"2502.03004","created_at":"2026-07-05T10:09:58.100607+00:00"},{"alias_kind":"arxiv_version","alias_value":"2502.03004v1","created_at":"2026-07-05T10:09:58.100607+00:00"},{"alias_kind":"doi","alias_value":"10.48550/arxiv.2502.03004","created_at":"2026-07-05T10:09:58.100607+00:00"},{"alias_kind":"pith_short_12","alias_value":"3VHDQYGDA5UV","created_at":"2026-07-05T10:09:58.100607+00:00"},{"alias_kind":"pith_short_16","alias_value":"3VHDQYGDA5UV6TG4","created_at":"2026-07-05T10:09:58.100607+00:00"},{"alias_kind":"pith_short_8","alias_value":"3VHDQYGD","created_at":"2026-07-05T10:09:58.100607+00:00"}],"events":[],"event_summary":{},"paper_claims":[],"inbound_citations":{"count":4,"internal_anchor_count":1,"sample":[{"citing_arxiv_id":"2607.07761","citing_title":"Aligning Clinical Needs and AI Capabilities: A Survey on LLMs for Medical Reasoning","ref_index":110,"is_internal_anchor":true},{"citing_arxiv_id":"2605.25988","citing_title":"What Makes a Medical Checker Trainable? Diagnosing Signal Collapse and Reward Hacking in Checker-Guided RAG for Biomedical QA","ref_index":1,"is_internal_anchor":false},{"citing_arxiv_id":"2507.16307","citing_title":"Perovskite-R1: a domain-specialized large language model for intelligent discovery of precursor additives and experimental design","ref_index":23,"is_internal_anchor":false},{"citing_arxiv_id":"2510.22609","citing_title":"CLIN-LLM: A Safety-Constrained Hybrid Framework for Clinical Diagnosis and Treatment Generation","ref_index":23,"is_internal_anchor":false}]},"formal_canon":{"evidence_count":0,"sample":[],"anchors":[]},"links":{"html":"https://pith.science/pith/3VHDQYGDA5UV6TG4NEPE4XARGL","json":"https://pith.science/pith/3VHDQYGDA5UV6TG4NEPE4XARGL.json","graph_json":"https://pith.science/api/pith-number/3VHDQYGDA5UV6TG4NEPE4XARGL/graph.json","events_json":"https://pith.science/api/pith-number/3VHDQYGDA5UV6TG4NEPE4XARGL/events.json","paper":"https://pith.science/paper/3VHDQYGD"},"agent_actions":{"view_html":"https://pith.science/pith/3VHDQYGDA5UV6TG4NEPE4XARGL","download_json":"https://pith.science/pith/3VHDQYGDA5UV6TG4NEPE4XARGL.json","view_paper":"https://pith.science/paper/3VHDQYGD","resolve_alias":"https://pith.science/api/pith-number/resolve?arxiv=2502.03004&json=true","fetch_graph":"https://pith.science/api/pith-number/3VHDQYGDA5UV6TG4NEPE4XARGL/graph.json","fetch_events":"https://pith.science/api/pith-number/3VHDQYGDA5UV6TG4NEPE4XARGL/events.json","actions":{"anchor_timestamp":"https://pith.science/pith/3VHDQYGDA5UV6TG4NEPE4XARGL/action/timestamp_anchor","attest_storage":"https://pith.science/pith/3VHDQYGDA5UV6TG4NEPE4XARGL/action/storage_attestation","attest_author":"https://pith.science/pith/3VHDQYGDA5UV6TG4NEPE4XARGL/action/author_attestation","sign_citation":"https://pith.science/pith/3VHDQYGDA5UV6TG4NEPE4XARGL/action/citation_signature","submit_replication":"https://pith.science/pith/3VHDQYGDA5UV6TG4NEPE4XARGL/action/replication_record"}},"created_at":"2026-07-05T10:09:58.100607+00:00","updated_at":"2026-07-05T10:09:58.100607+00:00"}