{"record_type":"pith_number_record","schema_url":"https://pith.science/schemas/pith-number/v1.json","pith_number":"pith:2025:GO5SA7T6WYFSIBBE4W7SMVI5YQ","short_pith_number":"pith:GO5SA7T6","schema_version":"1.0","canonical_sha256":"33bb207e7eb60b240424e5bf26551dc43af0bf550486b8b1e6a35e99760cc995","source":{"kind":"arxiv","id":"2502.06351","version":2},"attestation_state":"computed","paper":{"title":"Calibrating LLMs with Information-Theoretic Evidential Deep Learning","license":"http://creativecommons.org/licenses/by-nc-sa/4.0/","headline":"","cross_cats":[],"primary_cat":"cs.LG","authors_text":"Bernd Bischl, David R\\\"ugamer, Mina Rezaei, Yawei Li","submitted_at":"2025-02-10T11:00:24Z","abstract_excerpt":"Fine-tuned large language models (LLMs) often exhibit overconfidence, particularly when trained on small datasets, resulting in poor calibration and inaccurate uncertainty estimates. Evidential Deep Learning (EDL), an uncertainty-aware approach, enables uncertainty estimation in a single forward pass, making it a promising method for calibrating fine-tuned LLMs. However, despite its computational efficiency, EDL is prone to overfitting, as its training objective can result in overly concentrated probability distributions. To mitigate this, we propose regularizing EDL by incorporating an inform"},"verification_status":{"content_addressed":true,"pith_receipt":true,"author_attested":false,"weak_author_claims":0,"strong_author_claims":0,"externally_anchored":false,"storage_verified":false,"citation_signatures":0,"replication_records":0,"graph_snapshot":true,"references_resolved":false,"formal_links_present":false},"canonical_record":{"source":{"id":"2502.06351","kind":"arxiv","version":2},"metadata":{"license":"http://creativecommons.org/licenses/by-nc-sa/4.0/","primary_cat":"cs.LG","submitted_at":"2025-02-10T11:00:24Z","cross_cats_sorted":[],"title_canon_sha256":"6d88e48d929034db17d04eef39ee341e5000930f0b3fea7e74ad4837c7355288","abstract_canon_sha256":"5173e326e55b384ef26aaaf737cf32e5f24a72fe8e2e5729f90983b99efc2c93"},"schema_version":"1.0"},"receipt":{"kind":"pith_receipt","key_id":"pith-v1-2026-05","algorithm":"ed25519","signed_at":"2026-07-05T10:12:27.736563Z","signature_b64":"4Hi3m6YMFDopyqRVitZmcJf7wLSuH69g9Ojh3dG9gBvufrVj6WYNIVB6tAOvI6XQ3vt1dnowZU7STNZgOOEcDw==","signed_message":"canonical_sha256_bytes","builder_version":"pith-number-builder-2026-05-17-v1","receipt_version":"0.3","canonical_sha256":"33bb207e7eb60b240424e5bf26551dc43af0bf550486b8b1e6a35e99760cc995","last_reissued_at":"2026-07-05T10:12:27.736072Z","signature_status":"signed_v1","first_computed_at":"2026-07-05T10:12:27.736072Z","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54"},"graph_snapshot":{"paper":{"title":"Calibrating LLMs with Information-Theoretic Evidential Deep Learning","license":"http://creativecommons.org/licenses/by-nc-sa/4.0/","headline":"","cross_cats":[],"primary_cat":"cs.LG","authors_text":"Bernd Bischl, David R\\\"ugamer, Mina Rezaei, Yawei Li","submitted_at":"2025-02-10T11:00:24Z","abstract_excerpt":"Fine-tuned large language models (LLMs) often exhibit overconfidence, particularly when trained on small datasets, resulting in poor calibration and inaccurate uncertainty estimates. Evidential Deep Learning (EDL), an uncertainty-aware approach, enables uncertainty estimation in a single forward pass, making it a promising method for calibrating fine-tuned LLMs. However, despite its computational efficiency, EDL is prone to overfitting, as its training objective can result in overly concentrated probability distributions. To mitigate this, we propose regularizing EDL by incorporating an inform"},"claims":{"count":0,"items":[],"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"source":{"id":"2502.06351","kind":"arxiv","version":2},"verdict":{"id":null,"model_set":{},"created_at":null,"strongest_claim":"","one_line_summary":"","pipeline_version":null,"weakest_assumption":"","pith_extraction_headline":""},"integrity":{"clean":true,"summary":{"advisory":0,"critical":0,"by_detector":{},"informational":0},"endpoint":"/pith/2502.06351/integrity.json","findings":[],"available":true,"detectors_run":[],"snapshot_sha256":"c28c3603d3b5d939e8dc4c7e95fa8dfce3d595e45f758748cecf8e644a296938"},"references":{"count":0,"sample":[],"resolved_work":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57","internal_anchors":0},"formal_canon":{"evidence_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"author_claims":{"count":0,"strong_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"builder_version":"pith-number-builder-2026-05-17-v1"},"aliases":[{"alias_kind":"arxiv","alias_value":"2502.06351","created_at":"2026-07-05T10:12:27.736133+00:00"},{"alias_kind":"arxiv_version","alias_value":"2502.06351v2","created_at":"2026-07-05T10:12:27.736133+00:00"},{"alias_kind":"doi","alias_value":"10.48550/arxiv.2502.06351","created_at":"2026-07-05T10:12:27.736133+00:00"},{"alias_kind":"pith_short_12","alias_value":"GO5SA7T6WYFS","created_at":"2026-07-05T10:12:27.736133+00:00"},{"alias_kind":"pith_short_16","alias_value":"GO5SA7T6WYFSIBBE","created_at":"2026-07-05T10:12:27.736133+00:00"},{"alias_kind":"pith_short_8","alias_value":"GO5SA7T6","created_at":"2026-07-05T10:12:27.736133+00:00"}],"events":[],"event_summary":{},"paper_claims":[],"inbound_citations":{"count":4,"internal_anchor_count":0,"sample":[{"citing_arxiv_id":"2606.25182","citing_title":"What Intermediate Layers Know: Detecting Jailbreaks from Entropy Dynamics","ref_index":22,"is_internal_anchor":false},{"citing_arxiv_id":"2607.02182","citing_title":"Bayesian Sparse Low-Rank Adaptation for Large Language Model Uncertainty Estimation","ref_index":5,"is_internal_anchor":false},{"citing_arxiv_id":"2605.06382","citing_title":"Rethinking Vacuity for OOD Detection in Evidential Deep Learning","ref_index":2,"is_internal_anchor":false},{"citing_arxiv_id":"2604.08627","citing_title":"Evidential Transformation Network: Turning Pretrained Models into Evidential Models for Post-hoc Uncertainty Estimation","ref_index":32,"is_internal_anchor":false}]},"formal_canon":{"evidence_count":0,"sample":[],"anchors":[]},"links":{"html":"https://pith.science/pith/GO5SA7T6WYFSIBBE4W7SMVI5YQ","json":"https://pith.science/pith/GO5SA7T6WYFSIBBE4W7SMVI5YQ.json","graph_json":"https://pith.science/api/pith-number/GO5SA7T6WYFSIBBE4W7SMVI5YQ/graph.json","events_json":"https://pith.science/api/pith-number/GO5SA7T6WYFSIBBE4W7SMVI5YQ/events.json","paper":"https://pith.science/paper/GO5SA7T6"},"agent_actions":{"view_html":"https://pith.science/pith/GO5SA7T6WYFSIBBE4W7SMVI5YQ","download_json":"https://pith.science/pith/GO5SA7T6WYFSIBBE4W7SMVI5YQ.json","view_paper":"https://pith.science/paper/GO5SA7T6","resolve_alias":"https://pith.science/api/pith-number/resolve?arxiv=2502.06351&json=true","fetch_graph":"https://pith.science/api/pith-number/GO5SA7T6WYFSIBBE4W7SMVI5YQ/graph.json","fetch_events":"https://pith.science/api/pith-number/GO5SA7T6WYFSIBBE4W7SMVI5YQ/events.json","actions":{"anchor_timestamp":"https://pith.science/pith/GO5SA7T6WYFSIBBE4W7SMVI5YQ/action/timestamp_anchor","attest_storage":"https://pith.science/pith/GO5SA7T6WYFSIBBE4W7SMVI5YQ/action/storage_attestation","attest_author":"https://pith.science/pith/GO5SA7T6WYFSIBBE4W7SMVI5YQ/action/author_attestation","sign_citation":"https://pith.science/pith/GO5SA7T6WYFSIBBE4W7SMVI5YQ/action/citation_signature","submit_replication":"https://pith.science/pith/GO5SA7T6WYFSIBBE4W7SMVI5YQ/action/replication_record"}},"created_at":"2026-07-05T10:12:27.736133+00:00","updated_at":"2026-07-05T10:12:27.736133+00:00"}