{"as_of":"2026-08-14T22:16:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:0af16f2cf07e538da0d29fe14e5be16eb912883868ae53e46c88f6a6b7f70fb9","coverage":[{"denominator":70,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":70,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-23T07:45:50.292586Z","state":"measured"},{"denominator":73,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":73,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T18:23:05.868780Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-06T12:46:04.140262Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.02904","last_updated":"2026-04-19T22:48:18Z","snapshot_observed_at":"2026-08-02T22:43:50.593390Z","submitted_at":"2024-12-03T23:14:47Z","title":"Enhancing Trust in Large Language Models via Uncertainty-Calibrated Fine-Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.02904","snapshot_observed_at":"2026-08-08T18:23:05.868780Z","title":"Enhancing trust in large language models with uncertainty-aware fine-tuning,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06884","last_updated":"2025-02-08T21:30:41Z","snapshot_observed_at":"2026-08-14T10:31:08.065305Z","submitted_at":"2025-02-08T21:30:41Z","title":"Learning Conformal Abstention Policies for Adaptive Risk Management in Large Language and Vision-Language Models","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-08T18:23:05.868780Z"},"links":{"cited_paper":"/paper/2412.02904","citing_paper":"/paper/2502.06884"},"observation_digest":"sha256:a5a373ec25f748112c07f9e8c9d6c193f67709be4669a6cb8efa6603604ce4ab","observation_id":"35bffa0d-f7a6-4747-b753-572bcd851601","resolution":{"observed_at":"2026-08-08T18:23:05.868780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.02904","last_updated":"2026-04-19T22:48:18Z","snapshot_observed_at":"2026-08-02T22:43:50.593390Z","submitted_at":"2024-12-03T23:14:47Z","title":"Enhancing Trust in Large Language Models via Uncertainty-Calibrated Fine-Tuning","version":2},"cited_work":{"arxiv_id":"2412.02904","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.02904","snapshot_observed_at":"2026-08-06T12:46:04.140262Z","title":"Enhancing Trust in Large Language Models via Uncertainty-Calibrated Fine-Tuning","venue":"cs.CL","work_id":"e0d776e2-19fa-4b45-949a-4669b9199131","year":2024},"citing_paper":{"arxiv_id":"2507.21521","last_updated":"2025-07-29T06:08:28Z","snapshot_observed_at":"2026-08-13T23:15:08.954923Z","submitted_at":"2025-07-29T06:08:28Z","title":"Optimizing Active Learning in Vision-Language Models via Parameter-Efficient Uncertainty Calibration","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T12:46:01.721794Z"},"links":{"cited_paper":"/paper/2412.02904","citing_paper":"/paper/2507.21521"},"observation_digest":"sha256:4e19a4a682e633a6077839d9c121ce549e1050963cc67e75d5263843e3da5039","observation_id":"006c82c8-55b7-406e-9150-46b26404a987","resolution":{"observed_at":"2026-08-06T12:46:04.143047Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.02904","last_updated":"2026-04-19T22:48:18Z","snapshot_observed_at":"2026-08-02T22:43:50.593390Z","submitted_at":"2024-12-03T23:14:47Z","title":"Enhancing Trust in Large Language Models via Uncertainty-Calibrated Fine-Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.02904","snapshot_observed_at":"2026-07-14T08:45:52.855783Z","title":"arXiv preprint arXiv:2412.02904 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.10855","last_updated":"2026-07-12T17:39:09Z","snapshot_observed_at":"2026-08-13T01:51:25.188567Z","submitted_at":"2026-07-12T17:39:09Z","title":"Reliability Scaling Laws for Quantized Large Language Models","version":1},"reference_index":104,"source":"arxiv_source","source_observed_at":"2026-07-14T08:45:52.855783Z"},"links":{"cited_paper":"/paper/2412.02904","citing_paper":"/paper/2607.10855"},"observation_digest":"sha256:8fffa776849d95bd17e1ac17a88c2529623d1272caa6e40a1a3814ea8e9130eb","observation_id":"7403e69b-0c10-4ef0-b6e8-2d001ad2ff57","resolution":{"observed_at":"2026-07-14T08:45:52.855783Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2412.02904/citation-record","integrity":"/paper/2412.02904/integrity","json":"/paper/2412.02904/citation-record.json","paper":"/paper/2412.02904"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A review of uncertainty quantification in deep learning: Techniques, applications and challenges","venue":null,"work_id":"44f1d9f0-eeb2-45fd-bcde-0434fa4524b2","year":2021},"citing_paper":{"arxiv_id":"2412.02904","last_updated":"2026-04-19T22:48:18Z","snapshot_observed_at":"2026-08-02T22:43:50.593390Z","submitted_at":"2024-12-03T23:14:47Z","title":"Enhancing Trust in Large Language Models via Uncertainty-Calibrated Fine-Tuning","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-05-23T07:45:50.292586Z"},"links":{"citing_paper":"/paper/2412.02904"},"observation_digest":"sha256:5764906b975034de1e87ef6495528f3b39bfbdf31a60f159492b1858daa0c553","observation_id":"8c4f40ff-de33-4af1-a60e-a61e6361b3cc","resolution":{"observed_at":"2026-05-23T07:47:42.843478Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":"2303.08774","doi":"10.1002/tea.20265","metadata_source":"pith","pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"GPT-4 Technical Report","venue":"cs.CL","work_id":"b928e041-6991-4c08-8c81-0359e4097c7b","year":2023},"citing_paper":{"arxiv_id":"2412.02904","last_updated":"2026-04-19T22:48:18Z","snapshot_observed_at":"2026-08-02T22:43:50.593390Z","submitted_at":"2024-12-03T23:14:47Z","title":"Enhancing Trust in Large Language Models via Uncertainty-Calibrated Fine-Tuning","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-05-23T07:45:50.292586Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2412.02904"},"observation_digest":"sha256:7406029a5ae9a73a7530587cfcf279da3ef8c7cff75e54c908a5f2b9ad5c992e","observation_id":"e817c20a-a86b-4df2-a03c-3e50cc15e119","resolution":{"observed_at":"2026-05-23T07:47:42.644067Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.01463","last_updated":"2023-09-26T20:52:46Z","snapshot_observed_at":"2026-08-14T19:16:28.009205Z","submitted_at":"2023-09-26T20:52:46Z","title":"Creating Trustworthy LLMs: Dealing with Hallucinations in Healthcare AI","version":1},"cited_work":{"arxiv_id":"2311.01463","doi":"10.48550/arxiv.2311.01463","metadata_source":"arxiv_reference","pith_arxiv_id":"2311.01463","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Creating trustworthy llms: Dealing with hallucinations in healthcare ai","venue":"arXiv (Cornell University)","work_id":"b8f6fc57-be21-4eb5-8e50-86afdb3042f6","year":2023},"citing_paper":{"arxiv_id":"2412.02904","last_updated":"2026-04-19T22:48:18Z","snapshot_observed_at":"2026-08-02T22:43:50.593390Z","submitted_at":"2024-12-03T23:14:47Z","title":"Enhancing Trust in Large Language Models via Uncertainty-Calibrated Fine-Tuning","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-05-23T07:45:50.292586Z"},"links":{"cited_paper":"/paper/2311.01463","citing_paper":"/paper/2412.02904"},"observation_digest":"sha256:d6bc2e25d44c096319b25a664c9970914a23b224767b76dc2f107ff6a1b5b450","observation_id":"779c328c-30d0-43a4-8ef6-dea6821ee3e0","resolution":{"observed_at":"2026-05-23T07:47:42.609359Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1606.06565","last_updated":"2016-07-25T17:23:29Z","snapshot_observed_at":"2026-07-06T05:00:46.434335Z","submitted_at":"2016-06-21T13:37:05Z","title":"Concrete Problems in AI Safety","version":2},"cited_work":{"arxiv_id":"1606.06565","doi":"10.48550/arxiv.1606.06565","metadata_source":"pith","pith_arxiv_id":"1606.06565","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Concrete Problems in AI Safety","venue":"cs.AI","work_id":"c8d14fbe-6eab-464a-95b3-778aabd82fa3","year":2016},"citing_paper":{"arxiv_id":"2412.02904","last_updated":"2026-04-19T22:48:18Z","snapshot_observed_at":"2026-08-02T22:43:50.593390Z","submitted_at":"2024-12-03T23:14:47Z","title":"Enhancing Trust in Large Language Models via Uncertainty-Calibrated Fine-Tuning","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-05-23T07:45:50.292586Z"},"links":{"cited_paper":"/paper/1606.06565","citing_paper":"/paper/2412.02904"},"observation_digest":"sha256:3d5e75e33300850ee8ab370bc5c62e108aa01ab03507f9102b0af3b15abd648f","observation_id":"7afae257-d208-4360-bbf4-eb56f0c69f5a","resolution":{"observed_at":"2026-05-23T07:47:42.616505Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-07-13T23:49:52.215761+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-13T23:49:52.215761+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Linguistic calibration of long-form generations","venue":null,"work_id":"1bd4656b-029d-493c-939d-9ce17cea3a84","year":2024},"citing_paper":{"arxiv_id":"2412.02904","last_updated":"2026-04-19T22:48:18Z","snapshot_observed_at":"2026-08-02T22:43:50.593390Z","submitted_at":"2024-12-03T23:14:47Z","title":"Enhancing Trust in Large Language Models via Uncertainty-Calibrated Fine-Tuning","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-05-23T07:45:50.292586Z"},"links":{"citing_paper":"/paper/2412.02904"},"observation_digest":"sha256:2af15c62af62d90013e18c982b160ef351d34f514bae9000c199984b003f56c4","observation_id":"076c90fa-944c-4cdb-b4a1-a3be2a4ffd4e","resolution":{"observed_at":"2026-05-23T07:47:42.964552Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Pearson correlation coefficient","venue":null,"work_id":"d9cd9e5c-3551-4519-adec-aaf751020560","year":2009},"citing_paper":{"arxiv_id":"2412.02904","last_updated":"2026-04-19T22:48:18Z","snapshot_observed_at":"2026-08-02T22:43:50.593390Z","submitted_at":"2024-12-03T23:14:47Z","title":"Enhancing Trust in Large Language Models via Uncertainty-Calibrated Fine-Tuning","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-05-23T07:45:50.292586Z"},"links":{"citing_paper":"/paper/2412.02904"},"observation_digest":"sha256:329ce009e3e47f52ec60c73ef96edd702b74c7ebf9f037268814e3e46b8ec590","observation_id":"6b0900e5-fe8a-4d70-9209-9f73205615e9","resolution":{"observed_at":"2026-05-23T07:47:42.884785Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Confabulations: a conceptual history","venue":null,"work_id":"bfb485f5-7934-454b-9440-26c2d4ef719c","year":1998},"citing_paper":{"arxiv_id":"2412.02904","last_updated":"2026-04-19T22:48:18Z","snapshot_observed_at":"2026-08-02T22:43:50.593390Z","submitted_at":"2024-12-03T23:14:47Z","title":"Enhancing Trust in Large Language Models via Uncertainty-Calibrated Fine-Tuning","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-05-23T07:45:50.292586Z"},"links":{"citing_paper":"/paper/2412.02904"},"observation_digest":"sha256:d5876336023d7df86d0f610b280106b140ac4be16846859b18e20ad910c7c883","observation_id":"f3e340c0-b8fd-4cd2-98a3-cd63015bf5fd","resolution":{"observed_at":"2026-05-23T07:47:42.868921Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Weight uncertainty in neural network","venue":null,"work_id":"7eed8023-49a6-42f8-a112-3a9369d2847c","year":2015},"citing_paper":{"arxiv_id":"2412.02904","last_updated":"2026-04-19T22:48:18Z","snapshot_observed_at":"2026-08-02T22:43:50.593390Z","submitted_at":"2024-12-03T23:14:47Z","title":"Enhancing Trust in Large Language Models via Uncertainty-Calibrated Fine-Tuning","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-05-23T07:45:50.292586Z"},"links":{"citing_paper":"/paper/2412.02904"},"observation_digest":"sha256:7b7b2624e9c02bf5264bd4b7e076956dac0141688ce0c78b84f73199af195d9c","observation_id":"dac8ab62-1a26-4aac-85c7-a8a2223b1df3","resolution":{"observed_at":"2026-05-23T07:47:42.854050Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The relationship between precision-recall and roc curves","venue":null,"work_id":"b112cc71-b448-4b85-901d-e2f694601dcf","year":2006},"citing_paper":{"arxiv_id":"2412.02904","last_updated":"2026-04-19T22:48:18Z","snapshot_observed_at":"2026-08-02T22:43:50.593390Z","submitted_at":"2024-12-03T23:14:47Z","title":"Enhancing Trust in Large Language Models via Uncertainty-Calibrated Fine-Tuning","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-05-23T07:45:50.292586Z"},"links":{"citing_paper":"/paper/2412.02904"},"observation_digest":"sha256:f8ed19cbcfaf40ac7a9b8dbe55a042ba19656bebd8fcde49a33d920137b13a1c","observation_id":"45b460ca-fc65-4bd5-adad-9e587d0d9482","resolution":{"observed_at":"2026-05-23T07:47:42.873611Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Calibration of pre-trained transformers","venue":null,"work_id":"602c6ad3-bcbe-41e6-a2de-37eabcb4b8cf","year":2020},"citing_paper":{"arxiv_id":"2412.02904","last_updated":"2026-04-19T22:48:18Z","snapshot_observed_at":"2026-08-02T22:43:50.593390Z","submitted_at":"2024-12-03T23:14:47Z","title":"Enhancing Trust in Large Language Models via Uncertainty-Calibrated Fine-Tuning","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-05-23T07:45:50.292586Z"},"links":{"citing_paper":"/paper/2412.02904"},"observation_digest":"sha256:b57605f716246f69d46c550dafbfe0bf43020b2ecc201c270a99f70c51e0b101","observation_id":"d26363ca-b7a3-40ec-935c-4fbe59399978","resolution":{"observed_at":"2026-05-23T07:47:42.925729Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17385","last_updated":"2024-02-27T10:24:50Z","snapshot_observed_at":"2026-08-13T04:09:16.903754Z","submitted_at":"2024-02-27T10:24:50Z","title":"Determinants of LLM-assisted Decision-Making","version":1},"cited_work":{"arxiv_id":"2402.17385","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.17385","snapshot_observed_at":"2026-07-04T03:59:33.533783Z","title":"Determinants of llm-assisted decision-making","venue":null,"work_id":"c883a5a1-aee0-4f2d-abeb-a4ff732681d5","year":2024},"citing_paper":{"arxiv_id":"2412.02904","last_updated":"2026-04-19T22:48:18Z","snapshot_observed_at":"2026-08-02T22:43:50.593390Z","submitted_at":"2024-12-03T23:14:47Z","title":"Enhancing Trust in Large Language Models via Uncertainty-Calibrated Fine-Tuning","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-05-23T07:45:50.292586Z"},"links":{"cited_paper":"/paper/2402.17385","citing_paper":"/paper/2412.02904"},"observation_digest":"sha256:b90e9d7611cb9faa05b2a1493acb5b8ede091e7461aeb51e3e9fb1cf7f1acb17","observation_id":"694fd0d0-24a1-46ef-a580-9355a194defc","resolution":{"observed_at":"2026-05-23T07:47:42.650331Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Lm-polygraph: Uncertainty estimation for language models","venue":null,"work_id":"2c1fd95c-63bd-43ce-9958-7412638183e7","year":2023},"citing_paper":{"arxiv_id":"2412.02904","last_updated":"2026-04-19T22:48:18Z","snapshot_observed_at":"2026-08-02T22:43:50.593390Z","submitted_at":"2024-12-03T23:14:47Z","title":"Enhancing Trust in Large Language Models via Uncertainty-Calibrated Fine-Tuning","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-05-23T07:45:50.292586Z"},"links":{"citing_paper":"/paper/2412.02904"},"observation_digest":"sha256:3e91f44ad77300b7174ffddfdc3f3146e42442fc8a5a4a145264b919ad919246","observation_id":"4489f1a7-cf65-40b5-b2b3-6c04ce7dd3c3","resolution":{"observed_at":"2026-05-23T07:47:42.997481Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T21:07:37.716446Z","title":"Detecting hallucinations in large language models using semantic entropy","venue":null,"work_id":"972a399d-a864-4bc4-9329-a8b8bcf07995","year":2024},"citing_paper":{"arxiv_id":"2412.02904","last_updated":"2026-04-19T22:48:18Z","snapshot_observed_at":"2026-08-02T22:43:50.593390Z","submitted_at":"2024-12-03T23:14:47Z","title":"Enhancing Trust in Large Language Models via Uncertainty-Calibrated Fine-Tuning","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-05-23T07:45:50.292586Z"},"links":{"citing_paper":"/paper/2412.02904"},"observation_digest":"sha256:c192c173b78376d30d1edf3c0b503640c2191c6d7988c3d332879065474b85a6","observation_id":"70e07ac5-f5b5-431a-97a7-bf241f7a32a5","resolution":{"observed_at":"2026-05-23T07:47:42.902999Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Unsupervised quality estimation for neural machine translation","venue":null,"work_id":"c1afa886-1565-4bff-bdd3-8e2296d8c0d8","year":2020},"citing_paper":{"arxiv_id":"2412.02904","last_updated":"2026-04-19T22:48:18Z","snapshot_observed_at":"2026-08-02T22:43:50.593390Z","submitted_at":"2024-12-03T23:14:47Z","title":"Enhancing Trust in Large Language Models via Uncertainty-Calibrated Fine-Tuning","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-05-23T07:45:50.292586Z"},"links":{"citing_paper":"/paper/2412.02904"},"observation_digest":"sha256:0d56dd45cfaf4c3d480fc357731897d1d79b17ddd6bc27e7232a572c344279cf","observation_id":"5dc5cacf-ae59-4055-8b2f-f4f5de16286d","resolution":{"observed_at":"2026-05-23T07:47:42.936518Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A survey of uncertainty in deep neural networks","venue":null,"work_id":"3ab156f9-c231-42d7-82c4-a3c4d3f57633","year":2023},"citing_paper":{"arxiv_id":"2412.02904","last_updated":"2026-04-19T22:48:18Z","snapshot_observed_at":"2026-08-02T22:43:50.593390Z","submitted_at":"2024-12-03T23:14:47Z","title":"Enhancing Trust in Large Language Models via Uncertainty-Calibrated Fine-Tuning","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-05-23T07:45:50.292586Z"},"links":{"citing_paper":"/paper/2412.02904"},"observation_digest":"sha256:4694d9f858aa1e8776bf6dd9e53648537f14db78eed78f25bd99d31b22be2ca8","observation_id":"83dd29a2-a3d7-4513-a78f-d562bf3d5a1d","resolution":{"observed_at":"2026-05-23T07:47:42.840171Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.08295","last_updated":"2024-04-16T12:52:47Z","snapshot_observed_at":"2026-08-03T03:29:01.959523Z","submitted_at":"2024-03-13T06:59:16Z","title":"Gemma: Open Models Based on Gemini Research and Technology","version":4},"cited_work":{"arxiv_id":"2403.08295","doi":"10.48550/arxiv.2403.08295","metadata_source":"pith","pith_arxiv_id":"2403.08295","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Gemma: Open Models Based on Gemini Research and Technology","venue":"cs.CL","work_id":"a9ea2870-df28-40b8-a9e0-a7e9a116f793","year":2024},"citing_paper":{"arxiv_id":"2412.02904","last_updated":"2026-04-19T22:48:18Z","snapshot_observed_at":"2026-08-02T22:43:50.593390Z","submitted_at":"2024-12-03T23:14:47Z","title":"Enhancing Trust in Large Language Models via Uncertainty-Calibrated Fine-Tuning","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-05-23T07:45:50.292586Z"},"links":{"cited_paper":"/paper/2403.08295","citing_paper":"/paper/2412.02904"},"observation_digest":"sha256:6ccd759779d55daf363ff1e80cd339d1a477829bc4970037d9d12180d67460e8","observation_id":"05974c82-d544-4f9a-b2d9-b84648e543fc","resolution":{"observed_at":"2026-05-23T07:47:42.637765Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-10T22:08:13.221222+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-10T22:08:13.221222+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A survey of confidence estimation and calibration in large language models","venue":null,"work_id":"05981752-d18e-49d4-83be-ecb9e856100c","year":2024},"citing_paper":{"arxiv_id":"2412.02904","last_updated":"2026-04-19T22:48:18Z","snapshot_observed_at":"2026-08-02T22:43:50.593390Z","submitted_at":"2024-12-03T23:14:47Z","title":"Enhancing Trust in Large Language Models via Uncertainty-Calibrated Fine-Tuning","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-05-23T07:45:50.292586Z"},"links":{"citing_paper":"/paper/2412.02904"},"observation_digest":"sha256:ed532953c5853ced773c5c6bafd54b41e4a955bbefb1c2257e03bc0b077a9c4c","observation_id":"0a71d798-363c-477a-b247-c28367584a7c","resolution":{"observed_at":"2026-05-23T07:47:42.829733Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"On calibration of modern neural networks","venue":null,"work_id":"5efd8bf1-a2f3-41fe-a5c7-1902f46c85ec","year":2017},"citing_paper":{"arxiv_id":"2412.02904","last_updated":"2026-04-19T22:48:18Z","snapshot_observed_at":"2026-08-02T22:43:50.593390Z","submitted_at":"2024-12-03T23:14:47Z","title":"Enhancing Trust in Large Language Models via Uncertainty-Calibrated Fine-Tuning","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-05-23T07:45:50.292586Z"},"links":{"citing_paper":"/paper/2412.02904"},"observation_digest":"sha256:f1e1ddc1aa3b4266b7e2df7870215ee2c1fd5f79e1d5f829cff552d4f81bffea","observation_id":"e0932636-c310-4de1-af9f-19454a273bd9","resolution":{"observed_at":"2026-05-23T07:47:42.932946Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Augmix: A simple data processing method to improve robustness and uncertainty","venue":null,"work_id":"9e1b3dae-0bca-4921-ae84-e623b9b6531b","year":2020},"citing_paper":{"arxiv_id":"2412.02904","last_updated":"2026-04-19T22:48:18Z","snapshot_observed_at":"2026-08-02T22:43:50.593390Z","submitted_at":"2024-12-03T23:14:47Z","title":"Enhancing Trust in Large Language Models via Uncertainty-Calibrated Fine-Tuning","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-05-23T07:45:50.292586Z"},"links":{"citing_paper":"/paper/2412.02904"},"observation_digest":"sha256:e5ed75a1be7b856c14608458c8a2ec4a34684a079dcc9e94d5246cfb77fdb45d","observation_id":"fd07a85a-214c-480b-bc6c-c7d3351df6f8","resolution":{"observed_at":"2026-05-23T07:47:43.000671Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Parameter-efficient transfer learning for nlp","venue":null,"work_id":"00f2befa-3fc1-46a1-b822-db78ff18fe89","year":2019},"citing_paper":{"arxiv_id":"2412.02904","last_updated":"2026-04-19T22:48:18Z","snapshot_observed_at":"2026-08-02T22:43:50.593390Z","submitted_at":"2024-12-03T23:14:47Z","title":"Enhancing Trust in Large Language Models via Uncertainty-Calibrated Fine-Tuning","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-05-23T07:45:50.292586Z"},"links":{"citing_paper":"/paper/2412.02904"},"observation_digest":"sha256:99885b3e4b9bdbeb93ad03d3d534f7ebb43ea4cebb85e2d44a4b01d956957f98","observation_id":"10ab343f-4110-4af6-89ec-37b59d9c2d50","resolution":{"observed_at":"2026-05-23T07:47:42.836509Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Lora: Low-rank adaptation of large language models","venue":null,"work_id":"cee21b5c-fb3e-4480-9ac7-4b4e4297866b","year":2022},"citing_paper":{"arxiv_id":"2412.02904","last_updated":"2026-04-19T22:48:18Z","snapshot_observed_at":"2026-08-02T22:43:50.593390Z","submitted_at":"2024-12-03T23:14:47Z","title":"Enhancing Trust in Large Language Models via Uncertainty-Calibrated Fine-Tuning","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-05-23T07:45:50.292586Z"},"links":{"citing_paper":"/paper/2412.02904"},"observation_digest":"sha256:58b780baa9ec9d847e1459fc95226024e681b06b0f2c7b1b050bb6abbdaaa19b","observation_id":"4132f4e0-5b84-4861-bf71-f8a995a96ad0","resolution":{"observed_at":"2026-05-23T07:47:42.989422Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T17:21:18.255617Z","title":"Survey of hallucination in natural language generation","venue":null,"work_id":"dbd7f57e-bdde-458a-aee3-71776eb61bb4","year":2023},"citing_paper":{"arxiv_id":"2412.02904","last_updated":"2026-04-19T22:48:18Z","snapshot_observed_at":"2026-08-02T22:43:50.593390Z","submitted_at":"2024-12-03T23:14:47Z","title":"Enhancing Trust in Large Language Models via Uncertainty-Calibrated Fine-Tuning","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-05-23T07:45:50.292586Z"},"links":{"citing_paper":"/paper/2412.02904"},"observation_digest":"sha256:4b656f4ae9290af407755ca471f20a1e1ddfde12599940aa7a7042d746874b25","observation_id":"c398861a-5635-4ef0-996f-91c467e5fb01","resolution":{"observed_at":"2026-05-23T07:47:42.847178Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"How can we know when language models know? on the calibration of language models for question answering","venue":null,"work_id":"38e2a0eb-a21b-4a20-8233-f333a7ad70e5","year":2021},"citing_paper":{"arxiv_id":"2412.02904","last_updated":"2026-04-19T22:48:18Z","snapshot_observed_at":"2026-08-02T22:43:50.593390Z","submitted_at":"2024-12-03T23:14:47Z","title":"Enhancing Trust in Large Language Models via Uncertainty-Calibrated Fine-Tuning","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-05-23T07:45:50.292586Z"},"links":{"citing_paper":"/paper/2412.02904"},"observation_digest":"sha256:cc996e38d176c306bb5d8d28719aa78eac330223bba4de984413abd8b4aa4472","observation_id":"c577868f-6fb5-4ebd-b735-ff5c1f722986","resolution":{"observed_at":"2026-05-23T07:47:43.009060Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Triviaqa: A large scale distantly supervised challenge dataset for reading comprehension","venue":null,"work_id":"f2a95059-1f79-4de3-87ef-dd217c7a6a53","year":2017},"citing_paper":{"arxiv_id":"2412.02904","last_updated":"2026-04-19T22:48:18Z","snapshot_observed_at":"2026-08-02T22:43:50.593390Z","submitted_at":"2024-12-03T23:14:47Z","title":"Enhancing Trust in Large Language Models via Uncertainty-Calibrated Fine-Tuning","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-05-23T07:45:50.292586Z"},"links":{"citing_paper":"/paper/2412.02904"},"observation_digest":"sha256:f0b40bd93a0b680d8a7b2eb2f151f459f8c15caa56ef88bdff6df5a0b44a2c7a","observation_id":"944d4c8f-6041-469c-b469-915b18b041d7","resolution":{"observed_at":"2026-05-23T07:47:42.881671Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.05221","last_updated":"2022-11-21T16:38:35Z","snapshot_observed_at":"2026-08-14T05:42:29.067319Z","submitted_at":"2022-07-11T22:59:39Z","title":"Language Models (Mostly) Know What They Know","version":4},"cited_work":{"arxiv_id":"2207.05221","doi":"10.1145/3618260.3649777","metadata_source":"pith","pith_arxiv_id":"2207.05221","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Language Models (Mostly) Know What They Know","venue":"cs.CL","work_id":"8ca58a10-da41-4f70-baae-7e449512e345","year":2022},"citing_paper":{"arxiv_id":"2412.02904","last_updated":"2026-04-19T22:48:18Z","snapshot_observed_at":"2026-08-02T22:43:50.593390Z","submitted_at":"2024-12-03T23:14:47Z","title":"Enhancing Trust in Large Language Models via Uncertainty-Calibrated Fine-Tuning","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-05-23T07:45:50.292586Z"},"links":{"cited_paper":"/paper/2207.05221","citing_paper":"/paper/2412.02904"},"observation_digest":"sha256:3815820c8cecb4c874f0942b17632c9f64df3e368e9ee4ba90931aca1e0856e5","observation_id":"b9983758-f1d1-4641-8a62-7b8a2c408be0","resolution":{"observed_at":"2026-05-23T07:47:42.656379Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-05-21T07:53:13.382372+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T07:53:13.382372+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Calibration-tuning: Teaching large language models to know what they don’t know","venue":null,"work_id":"764d21e4-b1bc-45c3-8e48-2843286f84ef","year":2024},"citing_paper":{"arxiv_id":"2412.02904","last_updated":"2026-04-19T22:48:18Z","snapshot_observed_at":"2026-08-02T22:43:50.593390Z","submitted_at":"2024-12-03T23:14:47Z","title":"Enhancing Trust in Large Language Models via Uncertainty-Calibrated Fine-Tuning","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-05-23T07:45:50.292586Z"},"links":{"citing_paper":"/paper/2412.02904"},"observation_digest":"sha256:c4979a0ec73dd4df9f2c7e91cc4efe1868faa685f9b73e6337fe4dcb1251654c","observation_id":"8bed5dcf-7e58-4994-9835-0be5ce409ef7","resolution":{"observed_at":"2026-05-23T07:47:42.826934Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Soft calibration objectives for neural networks","venue":null,"work_id":"39a077e4-b6df-43aa-8298-3cdd06e85349","year":2021},"citing_paper":{"arxiv_id":"2412.02904","last_updated":"2026-04-19T22:48:18Z","snapshot_observed_at":"2026-08-02T22:43:50.593390Z","submitted_at":"2024-12-03T23:14:47Z","title":"Enhancing Trust in Large Language Models via Uncertainty-Calibrated Fine-Tuning","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-05-23T07:45:50.292586Z"},"links":{"citing_paper":"/paper/2412.02904"},"observation_digest":"sha256:3c93c6133add4fe59fff78fad03ec68b9aadd3394a3d5ae8b71e5ce492ed67d9","observation_id":"fcfc0f39-8cbf-4679-a886-13fcdeea985c","resolution":{"observed_at":"2026-05-23T07:47:42.953729Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Calibrated language model fine-tuning for in-and out-of-distribution data","venue":null,"work_id":"10c36016-32d8-473c-8939-af33390fb517","year":2020},"citing_paper":{"arxiv_id":"2412.02904","last_updated":"2026-04-19T22:48:18Z","snapshot_observed_at":"2026-08-02T22:43:50.593390Z","submitted_at":"2024-12-03T23:14:47Z","title":"Enhancing Trust in Large Language Models via Uncertainty-Calibrated Fine-Tuning","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-05-23T07:45:50.292586Z"},"links":{"citing_paper":"/paper/2412.02904"},"observation_digest":"sha256:e06fba4774d4bafaa00195fd5e4eab7f28fb4b5f5bb1c74f993513b00d47969f","observation_id":"45089ce1-bd8e-4b43-96ab-e376028db727","resolution":{"observed_at":"2026-05-23T07:47:42.946714Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Improving model calibration with accuracy versus uncertainty optimization","venue":null,"work_id":"65b6bc22-6567-44a6-8db9-59e850d21c00","year":2020},"citing_paper":{"arxiv_id":"2412.02904","last_updated":"2026-04-19T22:48:18Z","snapshot_observed_at":"2026-08-02T22:43:50.593390Z","submitted_at":"2024-12-03T23:14:47Z","title":"Enhancing Trust in Large Language Models via Uncertainty-Calibrated Fine-Tuning","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-05-23T07:45:50.292586Z"},"links":{"citing_paper":"/paper/2412.02904"},"observation_digest":"sha256:8914a482a75a98546f06b02403aa3a04df5b7efab141e3f791b57b02fe90ad01","observation_id":"3508bfd4-1175-4ef1-ba2b-079634e7e76b","resolution":{"observed_at":"2026-05-23T07:47:42.985768Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Bioasq-qa: A manually curated corpus for biomedical question answering","venue":null,"work_id":"139f8516-8770-4f09-b5e4-1e0c817b559e","year":2023},"citing_paper":{"arxiv_id":"2412.02904","last_updated":"2026-04-19T22:48:18Z","snapshot_observed_at":"2026-08-02T22:43:50.593390Z","submitted_at":"2024-12-03T23:14:47Z","title":"Enhancing Trust in Large Language Models via Uncertainty-Calibrated Fine-Tuning","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-05-23T07:45:50.292586Z"},"links":{"citing_paper":"/paper/2412.02904"},"observation_digest":"sha256:b8cbf35f336affd8a3d00d92c455701307d219e172b592b35f77e7df1c029f98","observation_id":"09b8cde2-df3c-48f5-88a9-fc3a4855689c","resolution":{"observed_at":"2026-05-23T07:47:42.975779Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Semantic uncertainty: Linguistic invariances for uncertainty estimation in natural language generation","venue":null,"work_id":"ca17ea3e-952a-4eb9-aebe-f861227481f4","year":2023},"citing_paper":{"arxiv_id":"2412.02904","last_updated":"2026-04-19T22:48:18Z","snapshot_observed_at":"2026-08-02T22:43:50.593390Z","submitted_at":"2024-12-03T23:14:47Z","title":"Enhancing Trust in Large Language Models via Uncertainty-Calibrated Fine-Tuning","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-05-23T07:45:50.292586Z"},"links":{"citing_paper":"/paper/2412.02904"},"observation_digest":"sha256:292c9504b9939359ee6cad38a9708695fc5dbf193f60b0d07b45feabed3252d8","observation_id":"19478475-987a-4e32-a2d2-d0a3c9434a3c","resolution":{"observed_at":"2026-05-23T07:47:42.914544Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Beta calibration: a well-founded and easily implemented improvement on logistic calibration for binary classifiers","venue":null,"work_id":"524a522f-53ce-40dc-877c-f8a429b2a854","year":2017},"citing_paper":{"arxiv_id":"2412.02904","last_updated":"2026-04-19T22:48:18Z","snapshot_observed_at":"2026-08-02T22:43:50.593390Z","submitted_at":"2024-12-03T23:14:47Z","title":"Enhancing Trust in Large Language Models via Uncertainty-Calibrated Fine-Tuning","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-05-23T07:45:50.292586Z"},"links":{"citing_paper":"/paper/2412.02904"},"observation_digest":"sha256:435e33e075063548e90d93888888ecf05727961452f198ec2505d879bfd1ceb6","observation_id":"7e117afc-f98a-4b53-b851-c72fc2e8b0a0","resolution":{"observed_at":"2026-05-23T07:47:42.861021Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Trainable calibration measures for neural networks from kernel mean embeddings","venue":null,"work_id":"32fc4851-a32b-4251-8891-778147b35671","year":2018},"citing_paper":{"arxiv_id":"2412.02904","last_updated":"2026-04-19T22:48:18Z","snapshot_observed_at":"2026-08-02T22:43:50.593390Z","submitted_at":"2024-12-03T23:14:47Z","title":"Enhancing Trust in Large Language Models via Uncertainty-Calibrated Fine-Tuning","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-05-23T07:45:50.292586Z"},"links":{"citing_paper":"/paper/2412.02904"},"observation_digest":"sha256:96f69ffecd33c19c6f1edfaf528d4a53adb594e8555ee8b0f2aef100ec716d97","observation_id":"ef72e698-e26a-4e22-8c82-dbc2bae51cbd","resolution":{"observed_at":"2026-05-23T07:47:42.979258Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.18404","last_updated":"2023-07-08T02:20:29Z","snapshot_observed_at":"2026-08-14T20:09:44.657328Z","submitted_at":"2023-05-28T15:26:10Z","title":"Conformal Prediction with Large Language Models for Multi-Choice Question Answering","version":3},"cited_work":{"arxiv_id":"2305.18404","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.18404","snapshot_observed_at":"2026-07-04T10:09:45.306878Z","title":"arXiv preprint arXiv:2305.18404 , year=","venue":null,"work_id":"70a907ef-c945-4651-9e5c-760da19d4056","year":2023},"citing_paper":{"arxiv_id":"2412.02904","last_updated":"2026-04-19T22:48:18Z","snapshot_observed_at":"2026-08-02T22:43:50.593390Z","submitted_at":"2024-12-03T23:14:47Z","title":"Enhancing Trust in Large Language Models via Uncertainty-Calibrated Fine-Tuning","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-05-23T07:45:50.292586Z"},"links":{"cited_paper":"/paper/2305.18404","citing_paper":"/paper/2412.02904"},"observation_digest":"sha256:4cc1f5a588c641b0b16de5ba46357d45f744a2e35eb081da5925e2d746558ba6","observation_id":"43a0f19a-c374-45db-aca2-4fe1715b32cd","resolution":{"observed_at":"2026-05-23T07:47:42.631390Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Simple and scalable predictive uncertainty estimation using deep ensembles","venue":null,"work_id":"1707e459-a513-4176-a3b3-f5c9758b5fae","year":2017},"citing_paper":{"arxiv_id":"2412.02904","last_updated":"2026-04-19T22:48:18Z","snapshot_observed_at":"2026-08-02T22:43:50.593390Z","submitted_at":"2024-12-03T23:14:47Z","title":"Enhancing Trust in Large Language Models via Uncertainty-Calibrated Fine-Tuning","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-05-23T07:45:50.292586Z"},"links":{"citing_paper":"/paper/2412.02904"},"observation_digest":"sha256:ecf57ef59f131951d6d60628be0a2fe7357afc8389ef9593a1518ad2f6e11da1","observation_id":"2f546d62-5fa5-40e3-9452-f99c4ac301ca","resolution":{"observed_at":"2026-05-23T07:47:42.940150Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Automatic evaluation of machine translation quality using longest common subsequence and skip-bigram statistics","venue":null,"work_id":"9fb05479-96f1-4150-bffc-46b83aa6b997","year":2004},"citing_paper":{"arxiv_id":"2412.02904","last_updated":"2026-04-19T22:48:18Z","snapshot_observed_at":"2026-08-02T22:43:50.593390Z","submitted_at":"2024-12-03T23:14:47Z","title":"Enhancing Trust in Large Language Models via Uncertainty-Calibrated Fine-Tuning","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-05-23T07:45:50.292586Z"},"links":{"citing_paper":"/paper/2412.02904"},"observation_digest":"sha256:911aea9ea64ad1d9f1790c1da4b5fdf692f72504378090640c4cc8eade73c979","observation_id":"53538310-e50d-4214-90d5-a36a304bf034","resolution":{"observed_at":"2026-05-23T07:47:42.994479Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Generating with confidence: Uncertainty quantification for black-box large language models","venue":null,"work_id":"73ba236a-d223-42e6-9738-c0e244907db1","year":2024},"citing_paper":{"arxiv_id":"2412.02904","last_updated":"2026-04-19T22:48:18Z","snapshot_observed_at":"2026-08-02T22:43:50.593390Z","submitted_at":"2024-12-03T23:14:47Z","title":"Enhancing Trust in Large Language Models via Uncertainty-Calibrated Fine-Tuning","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-05-23T07:45:50.292586Z"},"links":{"citing_paper":"/paper/2412.02904"},"observation_digest":"sha256:2e1859e0bedf05a01ec2f56b341d95516e42cbb6aeb43b681c062f0aacf94373","observation_id":"9a63789c-ca7b-4d97-8a0f-09c6cf92299c","resolution":{"observed_at":"2026-05-23T07:47:42.918333Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Visual instruction tuning","venue":null,"work_id":"6d02d035-035e-4179-b018-4616d2401153","year":2024},"citing_paper":{"arxiv_id":"2412.02904","last_updated":"2026-04-19T22:48:18Z","snapshot_observed_at":"2026-08-02T22:43:50.593390Z","submitted_at":"2024-12-03T23:14:47Z","title":"Enhancing Trust in Large Language Models via Uncertainty-Calibrated Fine-Tuning","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-05-23T07:45:50.292586Z"},"links":{"citing_paper":"/paper/2412.02904"},"observation_digest":"sha256:53246b564eb87fddea251ca8765b635fd95604aac903c972023eac9b11a9a19e","observation_id":"459c237d-032c-4dc2-bb24-5dfeb858db34","resolution":{"observed_at":"2026-05-23T07:47:43.003563Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Pre-train, prompt, and predict: A systematic survey of prompting methods in natural language processing","venue":null,"work_id":"2482f47a-1395-4e40-97ee-9ce215c6598e","year":2023},"citing_paper":{"arxiv_id":"2412.02904","last_updated":"2026-04-19T22:48:18Z","snapshot_observed_at":"2026-08-02T22:43:50.593390Z","submitted_at":"2024-12-03T23:14:47Z","title":"Enhancing Trust in Large Language Models via Uncertainty-Calibrated Fine-Tuning","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-05-23T07:45:50.292586Z"},"links":{"citing_paper":"/paper/2412.02904"},"observation_digest":"sha256:d10dfb88feeee98e4bf68b0ac6ee2b91d0eb7fb1bb8ca9fcb992492fe28ea2d6","observation_id":"be7cd463-cc69-4619-9237-7010bf144457","resolution":{"observed_at":"2026-05-23T07:47:42.807731Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Litcab: Lightweight language model calibration over short-and long-form responses","venue":null,"work_id":"ee49f7be-63cd-4738-bb4a-3136aae8ae3c","year":2024},"citing_paper":{"arxiv_id":"2412.02904","last_updated":"2026-04-19T22:48:18Z","snapshot_observed_at":"2026-08-02T22:43:50.593390Z","submitted_at":"2024-12-03T23:14:47Z","title":"Enhancing Trust in Large Language Models via Uncertainty-Calibrated Fine-Tuning","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-05-23T07:45:50.292586Z"},"links":{"citing_paper":"/paper/2412.02904"},"observation_digest":"sha256:df52762fe36246ba1323b1427c83e43abfd30828a4c70b2105dd57610c3ba842","observation_id":"df2736f3-23b2-441b-b458-30e574ceb167","resolution":{"observed_at":"2026-05-23T07:47:42.815311Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Decoupled weight decay regularization","venue":null,"work_id":"30ece2e7-3c79-4ec7-afc1-0cb2a9c0f7d9","year":2019},"citing_paper":{"arxiv_id":"2412.02904","last_updated":"2026-04-19T22:48:18Z","snapshot_observed_at":"2026-08-02T22:43:50.593390Z","submitted_at":"2024-12-03T23:14:47Z","title":"Enhancing Trust in Large Language Models via Uncertainty-Calibrated Fine-Tuning","version":2},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-05-23T07:45:50.292586Z"},"links":{"citing_paper":"/paper/2412.02904"},"observation_digest":"sha256:857c616b9a43af4a9d7f077af2aa9c64218465de639cbce8cff1e86b068f01dc","observation_id":"f921f4d4-fb0c-4c0e-8def-cdbc819af81f","resolution":{"observed_at":"2026-05-23T07:47:42.823155Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20362","last_updated":"2024-05-30T17:56:05Z","snapshot_observed_at":"2026-08-12T23:53:53.676820Z","submitted_at":"2024-05-30T17:56:05Z","title":"Hallucination-Free? Assessing the Reliability of Leading AI Legal Research Tools","version":1},"cited_work":{"arxiv_id":"2405.20362","doi":"10.48550/arxiv.2405.20362","metadata_source":"arxiv_reference","pith_arxiv_id":"2405.20362","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Hallucination-free? assessing the reliability of leading ai legal research tools","venue":"arXiv (Cornell University)","work_id":"1076867a-51fd-43e8-a81f-e2e3bf294795","year":2024},"citing_paper":{"arxiv_id":"2412.02904","last_updated":"2026-04-19T22:48:18Z","snapshot_observed_at":"2026-08-02T22:43:50.593390Z","submitted_at":"2024-12-03T23:14:47Z","title":"Enhancing Trust in Large Language Models via Uncertainty-Calibrated Fine-Tuning","version":2},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-05-23T07:45:50.292586Z"},"links":{"cited_paper":"/paper/2405.20362","citing_paper":"/paper/2412.02904"},"observation_digest":"sha256:06960c5a1b4491c9022b0b21d9359aefdec4a5f7d424c82db0c1daf6bdb55d4f","observation_id":"8a2568bd-c6e4-4cd4-a887-6594def60e28","resolution":{"observed_at":"2026-05-23T07:47:42.623972Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T09:02:12.966903Z","title":"Uncertainty estimation in autoregressive structured prediction","venue":null,"work_id":"9015121d-5940-4612-a3bf-1395ec552180","year":2021},"citing_paper":{"arxiv_id":"2412.02904","last_updated":"2026-04-19T22:48:18Z","snapshot_observed_at":"2026-08-02T22:43:50.593390Z","submitted_at":"2024-12-03T23:14:47Z","title":"Enhancing Trust in Large Language Models via Uncertainty-Calibrated Fine-Tuning","version":2},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-05-23T07:45:50.292586Z"},"links":{"citing_paper":"/paper/2412.02904"},"observation_digest":"sha256:6a9a046360ea1dc03aa40f024b6ee9b0a56b12a15240ddabd16a060e55d8ddf5","observation_id":"815ae054-e582-44b4-afcd-2d853003aa04","resolution":{"observed_at":"2026-05-23T07:47:43.018308Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Peft: State-of-the-art parameter-efficient fine-tuning methods","venue":null,"work_id":"f8ca9434-f23d-4e10-838d-743fb3f83ae9","year":2022},"citing_paper":{"arxiv_id":"2412.02904","last_updated":"2026-04-19T22:48:18Z","snapshot_observed_at":"2026-08-02T22:43:50.593390Z","submitted_at":"2024-12-03T23:14:47Z","title":"Enhancing Trust in Large Language Models via Uncertainty-Calibrated Fine-Tuning","version":2},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-05-23T07:45:50.292586Z"},"links":{"citing_paper":"/paper/2412.02904"},"observation_digest":"sha256:31bc2f694645db1f4e687b51d5bf5609f738e922a34713f1e897f92b0a60c489","observation_id":"c7fc8831-d908-48c2-abca-a9ea00cd375b","resolution":{"observed_at":"2026-05-23T07:47:42.957522Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Ok-vqa: A visual question answering benchmark requiring external knowledge","venue":null,"work_id":"0e00f32e-fd56-42fb-908b-3603a312fc55","year":2019},"citing_paper":{"arxiv_id":"2412.02904","last_updated":"2026-04-19T22:48:18Z","snapshot_observed_at":"2026-08-02T22:43:50.593390Z","submitted_at":"2024-12-03T23:14:47Z","title":"Enhancing Trust in Large Language Models via Uncertainty-Calibrated Fine-Tuning","version":2},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-05-23T07:45:50.292586Z"},"links":{"citing_paper":"/paper/2412.02904"},"observation_digest":"sha256:fef55d48a7831bddbcf40b6997a4ece168b55a6b177bc7cc3d513366c9743232","observation_id":"897308b0-fef8-47c8-82f6-ffc94b6648fa","resolution":{"observed_at":"2026-05-23T07:47:42.818902Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Factscore: Fine-grained atomic evaluation of factual precision in long form text generation","venue":null,"work_id":"8aea9359-65bd-4412-acc3-40adb9b2e470","year":2023},"citing_paper":{"arxiv_id":"2412.02904","last_updated":"2026-04-19T22:48:18Z","snapshot_observed_at":"2026-08-02T22:43:50.593390Z","submitted_at":"2024-12-03T23:14:47Z","title":"Enhancing Trust in Large Language Models via Uncertainty-Calibrated Fine-Tuning","version":2},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-05-23T07:45:50.292586Z"},"links":{"citing_paper":"/paper/2412.02904"},"observation_digest":"sha256:615f730bc14d08236c7a918b3d34435def90ee7f8e97115e3d8ee3eb48bf6ead","observation_id":"24fbf246-66ee-461f-8b6e-6eae1ed53e81","resolution":{"observed_at":"2026-05-23T07:47:42.811861Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Revisiting the calibration of modern neural networks","venue":null,"work_id":"cb790cad-5859-4555-b4b2-da802ef4baa9","year":2021},"citing_paper":{"arxiv_id":"2412.02904","last_updated":"2026-04-19T22:48:18Z","snapshot_observed_at":"2026-08-02T22:43:50.593390Z","submitted_at":"2024-12-03T23:14:47Z","title":"Enhancing Trust in Large Language Models via Uncertainty-Calibrated Fine-Tuning","version":2},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-05-23T07:45:50.292586Z"},"links":{"citing_paper":"/paper/2412.02904"},"observation_digest":"sha256:852bc595ff528b378fda377587cee3ba908466f85aea8ac112997cc7472c97c3","observation_id":"ab9dfdb4-0095-4e4f-b730-7d0d6e69c33d","resolution":{"observed_at":"2026-05-23T07:47:42.857572Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Calibrating deep neural networks using focal loss","venue":null,"work_id":"71788280-b115-4ade-b18f-4f825a041403","year":2020},"citing_paper":{"arxiv_id":"2412.02904","last_updated":"2026-04-19T22:48:18Z","snapshot_observed_at":"2026-08-02T22:43:50.593390Z","submitted_at":"2024-12-03T23:14:47Z","title":"Enhancing Trust in Large Language Models via Uncertainty-Calibrated Fine-Tuning","version":2},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-05-23T07:45:50.292586Z"},"links":{"citing_paper":"/paper/2412.02904"},"observation_digest":"sha256:37e44f076e100dea5b0852eefe2054891d78666ddff30bd847b3943a8ba79514","observation_id":"a90da544-c2de-4192-aef7-0994e5433282","resolution":{"observed_at":"2026-05-23T07:47:43.015012Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Machine learning: a probabilistic perspective","venue":null,"work_id":"3849dafc-2d3e-4135-807b-fa12996bcdc3","year":2012},"citing_paper":{"arxiv_id":"2412.02904","last_updated":"2026-04-19T22:48:18Z","snapshot_observed_at":"2026-08-02T22:43:50.593390Z","submitted_at":"2024-12-03T23:14:47Z","title":"Enhancing Trust in Large Language Models via Uncertainty-Calibrated Fine-Tuning","version":2},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-05-23T07:45:50.292586Z"},"links":{"citing_paper":"/paper/2412.02904"},"observation_digest":"sha256:b431e97ecc174bba1dafa64826f546138ba6709bb5116883e5b0f1330513ad99","observation_id":"76f39cf0-a24c-4872-841e-60042e14ea6b","resolution":{"observed_at":"2026-05-23T07:47:43.011973Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Accuracy-rejection curves (arcs) for comparing classification methods with a reject option","venue":null,"work_id":"f0145cf7-3584-43a2-b36e-4e22579e7039","year":2009},"citing_paper":{"arxiv_id":"2412.02904","last_updated":"2026-04-19T22:48:18Z","snapshot_observed_at":"2026-08-02T22:43:50.593390Z","submitted_at":"2024-12-03T23:14:47Z","title":"Enhancing Trust in Large Language Models via Uncertainty-Calibrated Fine-Tuning","version":2},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-05-23T07:45:50.292586Z"},"links":{"citing_paper":"/paper/2412.02904"},"observation_digest":"sha256:a72a9282e7023d8b1e5d7b90b2d05c9d8b9be4c8a236ce9f26363a6cabce2469","observation_id":"aed3bb21-18cc-4052-b5da-46bd3bf62a04","resolution":{"observed_at":"2026-05-23T07:47:42.982499Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Obtaining well calibrated probabilities using bayesian binning","venue":null,"work_id":"1bc70b11-28e5-4b39-bfb1-00ae0ed7e4ea","year":2015},"citing_paper":{"arxiv_id":"2412.02904","last_updated":"2026-04-19T22:48:18Z","snapshot_observed_at":"2026-08-02T22:43:50.593390Z","submitted_at":"2024-12-03T23:14:47Z","title":"Enhancing Trust in Large Language Models via Uncertainty-Calibrated Fine-Tuning","version":2},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-05-23T07:45:50.292586Z"},"links":{"citing_paper":"/paper/2412.02904"},"observation_digest":"sha256:984bb1172db40c11eafdf8cb5f3ba94a83648542b17f34dbd4fa5726ffbb3824","observation_id":"622ad485-55c1-45fa-87c1-56648f9e94fd","resolution":{"observed_at":"2026-05-23T07:47:42.921704Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Measuring calibration in deep learning","venue":null,"work_id":"f1f62a8e-9517-4530-b6fe-96321c8bc297","year":2019},"citing_paper":{"arxiv_id":"2412.02904","last_updated":"2026-04-19T22:48:18Z","snapshot_observed_at":"2026-08-02T22:43:50.593390Z","submitted_at":"2024-12-03T23:14:47Z","title":"Enhancing Trust in Large Language Models via Uncertainty-Calibrated Fine-Tuning","version":2},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-05-23T07:45:50.292586Z"},"links":{"citing_paper":"/paper/2412.02904"},"observation_digest":"sha256:5ec6d66b8bb06d817b8ef6ed62b492e8fa61bd0416d9b37ac870e64e77558918","observation_id":"6d9e17bc-f598-4d98-b997-de34d99f535a","resolution":{"observed_at":"2026-05-23T07:47:42.888223Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13213","last_updated":"2025-08-07T01:33:12Z","snapshot_observed_at":"2026-08-13T04:14:19.187289Z","submitted_at":"2024-02-20T18:24:47Z","title":"Probabilities of Chat LLMs Are Miscalibrated but Still Predict Correctness on Multiple-Choice Q&A","version":4},"cited_work":{"arxiv_id":"2402.13213","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.13213","snapshot_observed_at":"2026-07-02T21:07:23.912546Z","title":"Softmax probabilities (mostly) predict large language model correctness on multiple-choice q&a","venue":null,"work_id":"d46c9875-4f26-41fd-8e58-2bbb5f1f8276","year":2024},"citing_paper":{"arxiv_id":"2412.02904","last_updated":"2026-04-19T22:48:18Z","snapshot_observed_at":"2026-08-02T22:43:50.593390Z","submitted_at":"2024-12-03T23:14:47Z","title":"Enhancing Trust in Large Language Models via Uncertainty-Calibrated Fine-Tuning","version":2},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-05-23T07:45:50.292586Z"},"links":{"cited_paper":"/paper/2402.13213","citing_paper":"/paper/2412.02904"},"observation_digest":"sha256:dd4d0290316a904069b3fabed12f7ec862f82135be16d3b04a3ed3f621217aad","observation_id":"6b3a3b5c-f38f-44e4-8fee-2de7ebce61bd","resolution":{"observed_at":"2026-05-23T07:47:42.669613Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Coqa: A conversational question answering challenge","venue":null,"work_id":"dbe5b557-b0a4-4e2f-b2d7-7447fd65bcfd","year":2019},"citing_paper":{"arxiv_id":"2412.02904","last_updated":"2026-04-19T22:48:18Z","snapshot_observed_at":"2026-08-02T22:43:50.593390Z","submitted_at":"2024-12-03T23:14:47Z","title":"Enhancing Trust in Large Language Models via Uncertainty-Calibrated Fine-Tuning","version":2},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-05-23T07:45:50.292586Z"},"links":{"citing_paper":"/paper/2412.02904"},"observation_digest":"sha256:c02dd8ce922f9e214525b938af30256d13c62d0628c2a0f0ef0bbb32fee1dfe5","observation_id":"82b081f2-ef31-4113-9db1-706dab67a04a","resolution":{"observed_at":"2026-05-23T07:47:42.972210Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Out-of-distribution detection and selective generation for conditional language models","venue":null,"work_id":"3593a399-22a8-4f83-ba38-8f96e7e00060","year":2022},"citing_paper":{"arxiv_id":"2412.02904","last_updated":"2026-04-19T22:48:18Z","snapshot_observed_at":"2026-08-02T22:43:50.593390Z","submitted_at":"2024-12-03T23:14:47Z","title":"Enhancing Trust in Large Language Models via Uncertainty-Calibrated Fine-Tuning","version":2},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-05-23T07:45:50.292586Z"},"links":{"citing_paper":"/paper/2412.02904"},"observation_digest":"sha256:a24c2ab717fb3a0fa1bc5f99ee7765c0c4c36e516897094fccdedb76afc149b6","observation_id":"0b6f2600-76d0-43d0-a025-4145f628b9cc","resolution":{"observed_at":"2026-05-23T07:47:42.832839Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The precision-recall plot is more informative than the roc plot when evaluating binary classifiers on imbalanced datasets","venue":null,"work_id":"1252537f-892d-439c-8591-eefa2c16b380","year":2015},"citing_paper":{"arxiv_id":"2412.02904","last_updated":"2026-04-19T22:48:18Z","snapshot_observed_at":"2026-08-02T22:43:50.593390Z","submitted_at":"2024-12-03T23:14:47Z","title":"Enhancing Trust in Large Language Models via Uncertainty-Calibrated Fine-Tuning","version":2},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-05-23T07:45:50.292586Z"},"links":{"citing_paper":"/paper/2412.02904"},"observation_digest":"sha256:941eea44c826a9db642a65ac7812dd3930a22f6e0fa39dd60856888adb4ebcc5","observation_id":"4a5e0fe5-28b2-4a7a-9dc7-5e59673661bd","resolution":{"observed_at":"2026-05-23T07:47:43.006293Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"On mixup training: Improved calibration and predictive uncertainty for deep neural networks","venue":null,"work_id":"29de7d0e-035b-4429-8ee0-9eb560872b09","year":2019},"citing_paper":{"arxiv_id":"2412.02904","last_updated":"2026-04-19T22:48:18Z","snapshot_observed_at":"2026-08-02T22:43:50.593390Z","submitted_at":"2024-12-03T23:14:47Z","title":"Enhancing Trust in Large Language Models via Uncertainty-Calibrated Fine-Tuning","version":2},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-05-23T07:45:50.292586Z"},"links":{"citing_paper":"/paper/2412.02904"},"observation_digest":"sha256:8843392790383ed240fcbd6a0874724766cddde94b0d8e4cc44106155576af7a","observation_id":"6dd8507a-d879-4fce-bfe9-d20e11192cbb","resolution":{"observed_at":"2026-05-23T07:47:42.891592Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Just ask for calibration: Strategies for eliciting calibrated confidence scores from language models fine-tuned with human feedback","venue":null,"work_id":"c928c196-da63-4df5-a3a6-37794ee50f88","year":2023},"citing_paper":{"arxiv_id":"2412.02904","last_updated":"2026-04-19T22:48:18Z","snapshot_observed_at":"2026-08-02T22:43:50.593390Z","submitted_at":"2024-12-03T23:14:47Z","title":"Enhancing Trust in Large Language Models via Uncertainty-Calibrated Fine-Tuning","version":2},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-05-23T07:45:50.292586Z"},"links":{"citing_paper":"/paper/2412.02904"},"observation_digest":"sha256:e416c6fc0e9b8b011cdd79c9dba0713c8f5bfd7464f3731dd225e2c51b357bc2","observation_id":"9a9768ce-77a1-4771-a94e-c8191cd2f8d3","resolution":{"observed_at":"2026-05-23T07:47:42.910693Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":"2307.09288","doi":"10.24963/ijcai.2025/706","metadata_source":"pith","pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","venue":"cs.CL","work_id":"68a5177f-d644-44c1-bd4f-4e5278c22f5d","year":2023},"citing_paper":{"arxiv_id":"2412.02904","last_updated":"2026-04-19T22:48:18Z","snapshot_observed_at":"2026-08-02T22:43:50.593390Z","submitted_at":"2024-12-03T23:14:47Z","title":"Enhancing Trust in Large Language Models via Uncertainty-Calibrated Fine-Tuning","version":2},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-05-23T07:45:50.292586Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2412.02904"},"observation_digest":"sha256:10d9136132892c2d24a1d8dd069ab947786b5fcdd7bed3e68424dbfe93a48a4d","observation_id":"b25f17c9-06c5-46e8-a362-f45128d13b52","resolution":{"observed_at":"2026-05-23T07:47:42.662943Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Adamix: Mixture-of-adaptations for parameter-efficient model tuning","venue":null,"work_id":"4ea5ce51-53d2-47e8-9244-fe2dcb8de6a1","year":2022},"citing_paper":{"arxiv_id":"2412.02904","last_updated":"2026-04-19T22:48:18Z","snapshot_observed_at":"2026-08-02T22:43:50.593390Z","submitted_at":"2024-12-03T23:14:47Z","title":"Enhancing Trust in Large Language Models via Uncertainty-Calibrated Fine-Tuning","version":2},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-05-23T07:45:50.292586Z"},"links":{"citing_paper":"/paper/2412.02904"},"observation_digest":"sha256:4f8e925ed3c08d5b4fdc812382c698527d0a2061a750177177ed8f272b66102f","observation_id":"9db33b92-2900-4732-8f06-6a16f165a1d5","resolution":{"observed_at":"2026-05-23T07:47:42.968779Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Neural text generation with unlikelihood training","venue":null,"work_id":"1f1309b9-fca1-4259-8ca6-dffbf11f5ea0","year":2020},"citing_paper":{"arxiv_id":"2412.02904","last_updated":"2026-04-19T22:48:18Z","snapshot_observed_at":"2026-08-02T22:43:50.593390Z","submitted_at":"2024-12-03T23:14:47Z","title":"Enhancing Trust in Large Language Models via Uncertainty-Calibrated Fine-Tuning","version":2},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-05-23T07:45:50.292586Z"},"links":{"citing_paper":"/paper/2412.02904"},"observation_digest":"sha256:afa54eac4546d2032af657bb9b5ec1a4e68702eae9d6ffa6dc9cc0f430903b09","observation_id":"752b5267-276f-4f46-904c-a8e5d336caa8","resolution":{"observed_at":"2026-05-23T07:47:42.943209Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Quantifying uncertainties in natural language processing tasks","venue":null,"work_id":"0b804551-ad1a-4a9d-8936-30458030e67a","year":2019},"citing_paper":{"arxiv_id":"2412.02904","last_updated":"2026-04-19T22:48:18Z","snapshot_observed_at":"2026-08-02T22:43:50.593390Z","submitted_at":"2024-12-03T23:14:47Z","title":"Enhancing Trust in Large Language Models via Uncertainty-Calibrated Fine-Tuning","version":2},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-05-23T07:45:50.292586Z"},"links":{"citing_paper":"/paper/2412.02904"},"observation_digest":"sha256:b5ad3ba51abeef36ae4621d0e9644de3f1832f5b3ce67c7d9e2cfbb61c7c3cac","observation_id":"ea1185c7-c458-41d2-838e-d3d340ffbfe2","resolution":{"observed_at":"2026-05-23T07:47:42.850327Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Can llms express their uncertainty? an empirical evaluation of confidence elicitation in llms","venue":null,"work_id":"405ce56d-c135-4024-850b-a0757dd222ba","year":2024},"citing_paper":{"arxiv_id":"2412.02904","last_updated":"2026-04-19T22:48:18Z","snapshot_observed_at":"2026-08-02T22:43:50.593390Z","submitted_at":"2024-12-03T23:14:47Z","title":"Enhancing Trust in Large Language Models via Uncertainty-Calibrated Fine-Tuning","version":2},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-05-23T07:45:50.292586Z"},"links":{"citing_paper":"/paper/2412.02904"},"observation_digest":"sha256:a8a4c20a4f6e213a0f41a24f1521215ef77f8b1c6735398e5abf081914d6b471","observation_id":"36d95b7a-b4c1-436e-869e-86ad2ebfc1ef","resolution":{"observed_at":"2026-05-23T07:47:42.961304Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.16856","last_updated":"2024-05-27T06:06:36Z","snapshot_observed_at":"2026-08-12T23:57:27.917408Z","submitted_at":"2024-05-27T06:06:36Z","title":"Can We Trust LLMs? Mitigate Overconfidence Bias in LLMs through Knowledge Transfer","version":1},"cited_work":{"arxiv_id":"2405.16856","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2405.16856","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Can we trust llms? mitigate overconfidence bias in llms through knowledge transfer","venue":null,"work_id":"ca860a3e-1f93-41f1-91f7-c5ca3a4ef0bd","year":2024},"citing_paper":{"arxiv_id":"2412.02904","last_updated":"2026-04-19T22:48:18Z","snapshot_observed_at":"2026-08-02T22:43:50.593390Z","submitted_at":"2024-12-03T23:14:47Z","title":"Enhancing Trust in Large Language Models via Uncertainty-Calibrated Fine-Tuning","version":2},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-05-23T07:45:50.292586Z"},"links":{"cited_paper":"/paper/2405.16856","citing_paper":"/paper/2412.02904"},"observation_digest":"sha256:f0a5983717d68825292281c5d6e5407a23e44e5744e5396265b0ff59f6c0ed33","observation_id":"42eba806-e371-41b0-9bcf-25f615400423","resolution":{"observed_at":"2026-05-23T07:47:42.601393Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Bertscore: Evaluating text generation with bert","venue":null,"work_id":"8990d1f1-4857-4088-8d90-842789c22b0a","year":2020},"citing_paper":{"arxiv_id":"2412.02904","last_updated":"2026-04-19T22:48:18Z","snapshot_observed_at":"2026-08-02T22:43:50.593390Z","submitted_at":"2024-12-03T23:14:47Z","title":"Enhancing Trust in Large Language Models via Uncertainty-Calibrated Fine-Tuning","version":2},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-05-23T07:45:50.292586Z"},"links":{"citing_paper":"/paper/2412.02904"},"observation_digest":"sha256:33f9f2cc1c5e6e01ea1f588e8b873827752023d0b6313570961172cefd9e260f","observation_id":"d69cb2ac-4030-4122-a66a-8406913022de","resolution":{"observed_at":"2026-05-23T07:47:42.929548Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"CRC standard probability and statistics tables and formulae","venue":null,"work_id":"9e87627f-8f28-4058-9f0e-c63df6972fb5","year":1999},"citing_paper":{"arxiv_id":"2412.02904","last_updated":"2026-04-19T22:48:18Z","snapshot_observed_at":"2026-08-02T22:43:50.593390Z","submitted_at":"2024-12-03T23:14:47Z","title":"Enhancing Trust in Large Language Models via Uncertainty-Calibrated Fine-Tuning","version":2},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-05-23T07:45:50.292586Z"},"links":{"citing_paper":"/paper/2412.02904"},"observation_digest":"sha256:b56fbba5bd26a5e19567d5b5f819cfcd0e66225b2391b80e8c89aca8eff73e73","observation_id":"09781487-70cc-4f3b-acb4-2ce3bc08bf83","resolution":{"observed_at":"2026-05-23T07:47:42.878265Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T00:05:48.311803Z","title":"write newline","venue":null,"work_id":"8e5fda61-e601-4df4-8204-015bee341570","year":null},"citing_paper":{"arxiv_id":"2412.02904","last_updated":"2026-04-19T22:48:18Z","snapshot_observed_at":"2026-08-02T22:43:50.593390Z","submitted_at":"2024-12-03T23:14:47Z","title":"Enhancing Trust in Large Language Models via Uncertainty-Calibrated Fine-Tuning","version":2},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-05-23T07:45:50.292586Z"},"links":{"citing_paper":"/paper/2412.02904"},"observation_digest":"sha256:e2423c0c948d9a195fa7770b53f714400f3c2cd9ea5aa7629ec38367e43bde44","observation_id":"735f14fd-96f6-4c0e-b7d0-155f34dc5ad6","resolution":{"observed_at":"2026-05-23T07:47:42.950372Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T23:55:44.012295Z","title":"@esa (Ref","venue":null,"work_id":"b058608d-98d0-4821-a4ae-403d2b7cd411","year":null},"citing_paper":{"arxiv_id":"2412.02904","last_updated":"2026-04-19T22:48:18Z","snapshot_observed_at":"2026-08-02T22:43:50.593390Z","submitted_at":"2024-12-03T23:14:47Z","title":"Enhancing Trust in Large Language Models via Uncertainty-Calibrated Fine-Tuning","version":2},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-05-23T07:45:50.292586Z"},"links":{"citing_paper":"/paper/2412.02904"},"observation_digest":"sha256:a0a6e26d6262b40af8831b0777c90ce1844d082528dc120e14e5812fc82bf4e3","observation_id":"6766b570-8f6b-471f-a352-9086ce0c387c","resolution":{"observed_at":"2026-05-23T07:47:42.907147Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T00:05:48.337191Z","title":null,"venue":null,"work_id":"ea79bfb8-d434-45e9-8607-416d3839ec5c","year":null},"citing_paper":{"arxiv_id":"2412.02904","last_updated":"2026-04-19T22:48:18Z","snapshot_observed_at":"2026-08-02T22:43:50.593390Z","submitted_at":"2024-12-03T23:14:47Z","title":"Enhancing Trust in Large Language Models via Uncertainty-Calibrated Fine-Tuning","version":2},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-05-23T07:45:50.292586Z"},"links":{"citing_paper":"/paper/2412.02904"},"observation_digest":"sha256:31b0efba76e0b532999904cb72b60a992e7d3d2c9ef137c660eea29b5591177e","observation_id":"7a866179-724f-43ba-a033-1cc7b247e640","resolution":{"observed_at":"2026-05-23T07:47:42.896182Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"d051d6aa-efca-49eb-a66d-8ea01bf21294","year":null},"citing_paper":{"arxiv_id":"2412.02904","last_updated":"2026-04-19T22:48:18Z","snapshot_observed_at":"2026-08-02T22:43:50.593390Z","submitted_at":"2024-12-03T23:14:47Z","title":"Enhancing Trust in Large Language Models via Uncertainty-Calibrated Fine-Tuning","version":2},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-05-23T07:45:50.292586Z"},"links":{"citing_paper":"/paper/2412.02904"},"observation_digest":"sha256:52a916c9d33cc8902e7ee27846a4d562f2e5b51abc710d7767419eacf001e9dc","observation_id":"a99d04e2-26f9-4a12-b171-7c2b4e881fd7","resolution":{"observed_at":"2026-05-23T07:47:42.899422Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2412.02904","last_updated":"2026-04-19T22:48:18Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-02T22:43:50.593390Z","submitted_at":"2024-12-03T23:14:47Z","title":"Enhancing Trust in Large Language Models via Uncertainty-Calibrated Fine-Tuning"},"reference_resolution":{"displayed":70,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":2,"verified_exact":10,"verified_fuzzy":57},"total_outbound_references":70},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 70 of 70 outbound references and 3 inbound Pith citation observations for arXiv:2412.02904."}