{"as_of":"2026-08-10T17:49:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d027d8537d3f6ce17a1f5dad9e187d64ed1ebbf89e7520df94d4deec84cce45f","coverage":[{"denominator":55,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":55,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:59:42.412963Z","state":"measured"},{"denominator":65,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":65,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":10,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":10,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T20:21:55.864745Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.23854","last_updated":"2025-05-29T02:04:49Z","snapshot_observed_at":"2026-08-08T05:42:18.540435Z","submitted_at":"2025-05-29T02:04:49Z","title":"Revisiting Uncertainty Estimation and Calibration of Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.23854","snapshot_observed_at":"2026-08-02T20:21:55.864745Z","title":"Revisiting uncertainty estimation and calibration of large language models.arXiv preprint arXiv:2505.23854,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.19262","last_updated":"2026-05-28T23:06:43Z","snapshot_observed_at":"2026-08-08T12:47:13.847301Z","submitted_at":"2026-02-26T20:52:27Z","title":"Empirical Characterization of Inference-Time Elicited Probability Transformations in Large Language Models","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-02T20:21:55.864745Z"},"links":{"cited_paper":"/paper/2505.23854","citing_paper":"/paper/2603.19262"},"observation_digest":"sha256:2a3c3c8e86d713534fd2dae8eeefdd0d366c7b4f9b2d5722d953a78be6058acc","observation_id":"a5ed4c11-5ded-4721-9f57-0600103d5539","resolution":{"observed_at":"2026-08-02T20:21:55.864745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23854","last_updated":"2025-05-29T02:04:49Z","snapshot_observed_at":"2026-08-08T05:42:18.540435Z","submitted_at":"2025-05-29T02:04:49Z","title":"Revisiting Uncertainty Estimation and Calibration of Large Language Models","version":1},"cited_work":{"arxiv_id":"2505.23854","doi":"10.48550/arxiv.2505.23854","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.23854","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Revisiting uncertainty estimation and calibration of large language models.arXiv preprint arXiv:2505.23854","venue":"ArXiv.org","work_id":"55c6d394-22d1-4eca-97e1-0c1daed79bad","year":2025},"citing_paper":{"arxiv_id":"2603.22161","last_updated":"2026-05-19T14:46:51Z","snapshot_observed_at":"2026-08-06T02:25:28.537505Z","submitted_at":"2026-03-23T16:23:31Z","title":"Causal Evidence that Language Models use Confidence to Drive Behavior","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-21T09:43:05.524088Z"},"links":{"cited_paper":"/paper/2505.23854","citing_paper":"/paper/2603.22161"},"observation_digest":"sha256:5e6da5b0f251d4329db12b30125c457b7c8347116a30fb53f2d15cde71730752","observation_id":"82d38082-ecdf-401c-8854-f51fd3962bd9","resolution":{"observed_at":"2026-05-21T09:44:05.672258Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23854","last_updated":"2025-05-29T02:04:49Z","snapshot_observed_at":"2026-08-08T05:42:18.540435Z","submitted_at":"2025-05-29T02:04:49Z","title":"Revisiting Uncertainty Estimation and Calibration of Large Language Models","version":1},"cited_work":{"arxiv_id":"2505.23854","doi":"10.48550/arxiv.2505.23854","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.23854","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Revisiting uncertainty estimation and calibration of large language models.arXiv preprint arXiv:2505.23854","venue":"ArXiv.org","work_id":"55c6d394-22d1-4eca-97e1-0c1daed79bad","year":2025},"citing_paper":{"arxiv_id":"2604.19781","last_updated":"2026-03-29T20:28:00Z","snapshot_observed_at":"2026-08-08T12:04:34.815625Z","submitted_at":"2026-03-29T20:28:00Z","title":"Do Small Language Models Know When They're Wrong? Confidence-Based Cascade Scoring for Educational Assessment","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-14T21:13:29.201794Z"},"links":{"cited_paper":"/paper/2505.23854","citing_paper":"/paper/2604.19781"},"observation_digest":"sha256:e621ca4c9dfa418c174e6166ede277fd890d46e2927b9cfd94092aedad5f4913","observation_id":"88f41d5f-8b82-49f5-9136-fcab8f089423","resolution":{"observed_at":"2026-05-14T21:17:58.469843Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23854","last_updated":"2025-05-29T02:04:49Z","snapshot_observed_at":"2026-08-08T05:42:18.540435Z","submitted_at":"2025-05-29T02:04:49Z","title":"Revisiting Uncertainty Estimation and Calibration of Large Language Models","version":1},"cited_work":{"arxiv_id":"2505.23854","doi":"10.48550/arxiv.2505.23854","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.23854","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Revisiting uncertainty estimation and calibration of large language models.arXiv preprint arXiv:2505.23854","venue":"ArXiv.org","work_id":"55c6d394-22d1-4eca-97e1-0c1daed79bad","year":2025},"citing_paper":{"arxiv_id":"2605.00957","last_updated":"2026-05-01T12:49:13Z","snapshot_observed_at":"2026-08-02T19:05:32.247291Z","submitted_at":"2026-05-01T12:49:13Z","title":"\"I Don't Know\" -- Towards Appropriate Trust with Certainty-Aware Retrieval Augmented Generation","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-09T18:30:03.367870Z"},"links":{"cited_paper":"/paper/2505.23854","citing_paper":"/paper/2605.00957"},"observation_digest":"sha256:1a9c2cb1794fa778747594fe1e38b88d7c1117bf119ae4d9326a9034d99433fd","observation_id":"01f33cb2-5767-4c0b-97d4-68032e0a9035","resolution":{"observed_at":"2026-05-11T16:11:11.565452Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23854","last_updated":"2025-05-29T02:04:49Z","snapshot_observed_at":"2026-08-08T05:42:18.540435Z","submitted_at":"2025-05-29T02:04:49Z","title":"Revisiting Uncertainty Estimation and Calibration of Large Language Models","version":1},"cited_work":{"arxiv_id":"2505.23854","doi":"10.48550/arxiv.2505.23854","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.23854","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Revisiting uncertainty estimation and calibration of large language models.arXiv preprint arXiv:2505.23854","venue":"ArXiv.org","work_id":"55c6d394-22d1-4eca-97e1-0c1daed79bad","year":2025},"citing_paper":{"arxiv_id":"2605.01428","last_updated":"2026-05-02T12:59:14Z","snapshot_observed_at":"2026-07-06T23:14:38.379875Z","submitted_at":"2026-05-02T12:59:14Z","title":"Hallucinations Undermine Trust; Metacognition is a Way Forward","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-09T14:29:54.924293Z"},"links":{"cited_paper":"/paper/2505.23854","citing_paper":"/paper/2605.01428"},"observation_digest":"sha256:ba1c44b54a9955974fe1a4d9f4ee16369a25278a70f4c4ea1d7e34975c3cb537","observation_id":"668e8321-cc48-42cd-af59-9e178617f734","resolution":{"observed_at":"2026-05-11T16:56:07.202112Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23854","last_updated":"2025-05-29T02:04:49Z","snapshot_observed_at":"2026-08-08T05:42:18.540435Z","submitted_at":"2025-05-29T02:04:49Z","title":"Revisiting Uncertainty Estimation and Calibration of Large Language Models","version":1},"cited_work":{"arxiv_id":"2505.23854","doi":"10.48550/arxiv.2505.23854","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.23854","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Revisiting uncertainty estimation and calibration of large language models.arXiv preprint arXiv:2505.23854","venue":"ArXiv.org","work_id":"55c6d394-22d1-4eca-97e1-0c1daed79bad","year":2025},"citing_paper":{"arxiv_id":"2605.05851","last_updated":"2026-05-07T08:24:54Z","snapshot_observed_at":"2026-08-04T15:23:48.540297Z","submitted_at":"2026-05-07T08:24:54Z","title":"Hypothesis generation and updating in large language models","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-05-08T14:43:56.125546Z"},"links":{"cited_paper":"/paper/2505.23854","citing_paper":"/paper/2605.05851"},"observation_digest":"sha256:493f699e12ef7e96af97490f9a83d81b52cf2c774c8b3c423f8fe8589b5254de","observation_id":"a9d14390-04ab-4387-9f8e-a6b2c7d95f72","resolution":{"observed_at":"2026-05-08T21:14:12.533436Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23854","last_updated":"2025-05-29T02:04:49Z","snapshot_observed_at":"2026-08-08T05:42:18.540435Z","submitted_at":"2025-05-29T02:04:49Z","title":"Revisiting Uncertainty Estimation and Calibration of Large Language Models","version":1},"cited_work":{"arxiv_id":"2505.23854","doi":"10.48550/arxiv.2505.23854","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.23854","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Revisiting uncertainty estimation and calibration of large language models.arXiv preprint arXiv:2505.23854","venue":"ArXiv.org","work_id":"55c6d394-22d1-4eca-97e1-0c1daed79bad","year":2025},"citing_paper":{"arxiv_id":"2605.11328","last_updated":"2026-05-11T23:26:30Z","snapshot_observed_at":"2026-08-02T08:39:07.747479Z","submitted_at":"2026-05-11T23:26:30Z","title":"Epistemic Uncertainty for Test-Time Discovery","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-13T01:52:41.192353Z"},"links":{"cited_paper":"/paper/2505.23854","citing_paper":"/paper/2605.11328"},"observation_digest":"sha256:4eae0c0ced29ecdd1c7a5d964fe9769cea6bda6f409256f13132587e14ea5f20","observation_id":"8b2a0696-382c-455e-9ead-adb525a9ae63","resolution":{"observed_at":"2026-05-13T01:57:06.021788Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23854","last_updated":"2025-05-29T02:04:49Z","snapshot_observed_at":"2026-08-08T05:42:18.540435Z","submitted_at":"2025-05-29T02:04:49Z","title":"Revisiting Uncertainty Estimation and Calibration of Large Language Models","version":1},"cited_work":{"arxiv_id":"2505.23854","doi":"10.48550/arxiv.2505.23854","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.23854","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Revisiting uncertainty estimation and calibration of large language models.arXiv preprint arXiv:2505.23854","venue":"ArXiv.org","work_id":"55c6d394-22d1-4eca-97e1-0c1daed79bad","year":2025},"citing_paper":{"arxiv_id":"2605.19344","last_updated":"2026-05-30T03:12:26Z","snapshot_observed_at":"2026-07-06T23:30:06.876413Z","submitted_at":"2026-05-19T04:31:38Z","title":"Retrieval-Augmented Linguistic Calibration","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-20T05:48:03.641696Z"},"links":{"cited_paper":"/paper/2505.23854","citing_paper":"/paper/2605.19344"},"observation_digest":"sha256:16ebcc57f95d3c196ea03ef577342ad1ec8411c3accaf4f82ae103e0dc56f0c7","observation_id":"61d0be8f-0d5f-463c-a19b-f51d597d8b84","resolution":{"observed_at":"2026-05-20T05:53:05.155542Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23854","last_updated":"2025-05-29T02:04:49Z","snapshot_observed_at":"2026-08-08T05:42:18.540435Z","submitted_at":"2025-05-29T02:04:49Z","title":"Revisiting Uncertainty Estimation and Calibration of Large Language Models","version":1},"cited_work":{"arxiv_id":"2505.23854","doi":"10.48550/arxiv.2505.23854","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.23854","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Revisiting uncertainty estimation and calibration of large language models.arXiv preprint arXiv:2505.23854","venue":"ArXiv.org","work_id":"55c6d394-22d1-4eca-97e1-0c1daed79bad","year":2025},"citing_paper":{"arxiv_id":"2605.19344","last_updated":"2026-05-30T03:12:26Z","snapshot_observed_at":"2026-07-06T23:30:06.876413Z","submitted_at":"2026-05-19T04:31:38Z","title":"Retrieval-Augmented Linguistic Calibration","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-30T18:36:25.106668Z"},"links":{"cited_paper":"/paper/2505.23854","citing_paper":"/paper/2605.19344"},"observation_digest":"sha256:0d48eb8e874ae0ab1835a60084419bcd0114b19b950bc6ba365eb648ee701e05","observation_id":"80de674f-289e-40eb-851c-90d35991b82e","resolution":{"observed_at":"2026-07-01T14:55:48.397448Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23854","last_updated":"2025-05-29T02:04:49Z","snapshot_observed_at":"2026-08-08T05:42:18.540435Z","submitted_at":"2025-05-29T02:04:49Z","title":"Revisiting Uncertainty Estimation and Calibration of Large Language Models","version":1},"cited_work":{"arxiv_id":"2505.23854","doi":"10.48550/arxiv.2505.23854","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.23854","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Revisiting uncertainty estimation and calibration of large language models.arXiv preprint arXiv:2505.23854","venue":"ArXiv.org","work_id":"55c6d394-22d1-4eca-97e1-0c1daed79bad","year":2025},"citing_paper":{"arxiv_id":"2606.09635","last_updated":"2026-06-08T15:33:13Z","snapshot_observed_at":"2026-08-02T03:20:14.810565Z","submitted_at":"2026-06-08T15:33:13Z","title":"Gradient-Guided Reward Optimization for Inference-time Alignment","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-06-27T16:43:04.984866Z"},"links":{"cited_paper":"/paper/2505.23854","citing_paper":"/paper/2606.09635"},"observation_digest":"sha256:3ab741079e8079dee9d199962c81a1c3861d1d0f25a6ce54f80af805f12d3f32","observation_id":"e08bc5bb-8617-45de-bc2e-9a753e99e46e","resolution":{"observed_at":"2026-07-03T01:17:30.645365Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.23854/citation-record","integrity":"/paper/2505.23854/integrity","json":"/paper/2505.23854/citation-record.json","paper":"/paper/2505.23854"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:59:37.551868Z","title":"Large language models in medicine.Nature medicine, 29(8):1930–1940, 2023","venue":null,"work_id":null,"year":1930},"citing_paper":{"arxiv_id":"2505.23854","last_updated":"2025-05-29T02:04:49Z","snapshot_observed_at":"2026-08-08T05:42:18.540435Z","submitted_at":"2025-05-29T02:04:49Z","title":"Revisiting Uncertainty Estimation and Calibration of Large Language Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T12:59:37.551868Z"},"links":{"citing_paper":"/paper/2505.23854"},"observation_digest":"sha256:dba6d96587f087344690c7ab362f980f590daa4fc137d094096b706cf95db5d7","observation_id":"eeabaf38-434a-4669-9f7d-f022633efb8e","resolution":{"observed_at":"2026-08-07T12:59:37.551868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:59:45.559154Z","title":"Adapted large language models can outperform medical experts in clinical text summa- rization.Nature medicine, 30(4):1134–1142, 2024","venue":null,"work_id":"8dcc08dd-e8d3-4548-9a40-a5bab4e853d3","year":2024},"citing_paper":{"arxiv_id":"2505.23854","last_updated":"2025-05-29T02:04:49Z","snapshot_observed_at":"2026-08-08T05:42:18.540435Z","submitted_at":"2025-05-29T02:04:49Z","title":"Revisiting Uncertainty Estimation and Calibration of Large Language Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T12:59:37.640897Z"},"links":{"citing_paper":"/paper/2505.23854"},"observation_digest":"sha256:e9283848e8696386be58416fa074af079012a10f8390a86545ec918fd84bd3c7","observation_id":"2d07b809-04ab-4715-80f3-5b9e8016ace4","resolution":{"observed_at":"2026-08-07T12:59:45.680203Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19260","last_updated":"2025-01-02T18:46:05Z","snapshot_observed_at":"2026-08-10T16:50:34.533140Z","submitted_at":"2024-12-26T15:54:10Z","title":"MEDEC: A Benchmark for Medical Error Detection and Correction in Clinical Notes","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19260","snapshot_observed_at":"2026-08-07T12:59:37.703236Z","title":"Medec: A benchmark for medical error detection and correction in clinical notes","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23854","last_updated":"2025-05-29T02:04:49Z","snapshot_observed_at":"2026-08-08T05:42:18.540435Z","submitted_at":"2025-05-29T02:04:49Z","title":"Revisiting Uncertainty Estimation and Calibration of Large Language Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T12:59:37.703236Z"},"links":{"cited_paper":"/paper/2412.19260","citing_paper":"/paper/2505.23854"},"observation_digest":"sha256:a698fb2fa785f381c88bd036000c4839d378b2a1beb6fde7f75c9646a84d6e14","observation_id":"8e9b719b-827a-40e3-ba33-cf5c4ec82e35","resolution":{"observed_at":"2026-08-07T12:59:37.703236Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:59:45.350033Z","title":"Large language models: a comprehensive survey of its applications, challenges, limitations, and future prospects.Authorea Preprints, 1:1–26, 2023","venue":null,"work_id":"2602c04d-597b-444a-9b2f-22a06282d7d5","year":2023},"citing_paper":{"arxiv_id":"2505.23854","last_updated":"2025-05-29T02:04:49Z","snapshot_observed_at":"2026-08-08T05:42:18.540435Z","submitted_at":"2025-05-29T02:04:49Z","title":"Revisiting Uncertainty Estimation and Calibration of Large Language Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T12:59:37.785893Z"},"links":{"citing_paper":"/paper/2505.23854"},"observation_digest":"sha256:1236a1336688bd23e22a901ab08a9ea6d9b22f88916c5d088a96ebf6fb63ecd7","observation_id":"ca2020b9-175c-4de5-9c69-cc56cb9257dd","resolution":{"observed_at":"2026-08-07T12:59:45.466563Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:59:37.854288Z","title":"Large language models in law: A survey.AI Open, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23854","last_updated":"2025-05-29T02:04:49Z","snapshot_observed_at":"2026-08-08T05:42:18.540435Z","submitted_at":"2025-05-29T02:04:49Z","title":"Revisiting Uncertainty Estimation and Calibration of Large Language Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T12:59:37.854288Z"},"links":{"citing_paper":"/paper/2505.23854"},"observation_digest":"sha256:4b42f0d6f3407e69ed1c84c26cf77ca0f2ef2438ae793743f58a6ab893b0e6f4","observation_id":"ef793f4e-92f1-4cf4-8dbc-b79a16f31749","resolution":{"observed_at":"2026-08-07T12:59:37.854288Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:59:45.096825Z","title":"Overreliance on ai literature review.Microsoft Research, 339:340, 2022","venue":null,"work_id":"48e399d1-5679-4120-bb49-42d62a17c448","year":2022},"citing_paper":{"arxiv_id":"2505.23854","last_updated":"2025-05-29T02:04:49Z","snapshot_observed_at":"2026-08-08T05:42:18.540435Z","submitted_at":"2025-05-29T02:04:49Z","title":"Revisiting Uncertainty Estimation and Calibration of Large Language Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T12:59:37.902306Z"},"links":{"citing_paper":"/paper/2505.23854"},"observation_digest":"sha256:e2a737a3293bb68ef9c98ccae94a9927606ad5c3507f95eb403aeab4c8590b94","observation_id":"a4e05e20-ae7b-4b17-9782-8e6d68e26011","resolution":{"observed_at":"2026-08-07T12:59:45.228040Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:59:44.886894Z","title":"Understanding the eu ai act: Requirements and next steps","venue":null,"work_id":"dea66a67-6de1-4167-bbe0-eabdb9c2a0b5","year":2024},"citing_paper":{"arxiv_id":"2505.23854","last_updated":"2025-05-29T02:04:49Z","snapshot_observed_at":"2026-08-08T05:42:18.540435Z","submitted_at":"2025-05-29T02:04:49Z","title":"Revisiting Uncertainty Estimation and Calibration of Large Language Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T12:59:37.971286Z"},"links":{"citing_paper":"/paper/2505.23854"},"observation_digest":"sha256:d72d1ba6112f5ecb1062f7de252c80063eb7665297914a100f8c7c4c1e12eb9e","observation_id":"94622b17-0103-455b-a7d1-8f179f1f1019","resolution":{"observed_at":"2026-08-07T12:59:44.987647Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:59:44.675763Z","title":"Us debt ceiling deal clears major hurdle in congress, 2023","venue":null,"work_id":"9bdb11c8-d96f-4b44-b943-e7949bd5776a","year":2023},"citing_paper":{"arxiv_id":"2505.23854","last_updated":"2025-05-29T02:04:49Z","snapshot_observed_at":"2026-08-08T05:42:18.540435Z","submitted_at":"2025-05-29T02:04:49Z","title":"Revisiting Uncertainty Estimation and Calibration of Large Language Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T12:59:38.025559Z"},"links":{"citing_paper":"/paper/2505.23854"},"observation_digest":"sha256:d35d27d73ae7b163d53344c8a76a69101b7f2e67d0aa185b16fe57de45a26c1a","observation_id":"f0fd20b6-0dbe-4484-8034-a5adc2f6d468","resolution":{"observed_at":"2026-08-07T12:59:44.776735Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:59:44.500177Z","title":"Shifting attention to relevance: Towards the uncertainty estimation of large language models","venue":null,"work_id":"4c2befdb-5138-40b3-acc4-6b88f22df12f","year":2023},"citing_paper":{"arxiv_id":"2505.23854","last_updated":"2025-05-29T02:04:49Z","snapshot_observed_at":"2026-08-08T05:42:18.540435Z","submitted_at":"2025-05-29T02:04:49Z","title":"Revisiting Uncertainty Estimation and Calibration of Large Language Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T12:59:38.065319Z"},"links":{"citing_paper":"/paper/2505.23854"},"observation_digest":"sha256:5fde2a66decf4c179250fa3d41fc2c1198894119bbdd6d9c5936c826804ecf9d","observation_id":"3d7996eb-a9ad-476e-b359-4d2f55243ef6","resolution":{"observed_at":"2026-08-07T12:59:44.558433Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:59:44.345080Z","title":"Semantic calibration of llms through the lens of temperature scaling","venue":null,"work_id":"938e3523-3eab-4cea-b584-6a44e7566d01","year":null},"citing_paper":{"arxiv_id":"2505.23854","last_updated":"2025-05-29T02:04:49Z","snapshot_observed_at":"2026-08-08T05:42:18.540435Z","submitted_at":"2025-05-29T02:04:49Z","title":"Revisiting Uncertainty Estimation and Calibration of Large Language Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T12:59:38.132286Z"},"links":{"citing_paper":"/paper/2505.23854"},"observation_digest":"sha256:9d97dc60edc2f03e1a175abea353465b1caf5a40b203f4a6d37104574d0f182c","observation_id":"ef2ee3bb-1ceb-49ee-8c0a-39e3a8832012","resolution":{"observed_at":"2026-08-07T12:59:44.398144Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.15927","last_updated":"2024-06-22T19:46:06Z","snapshot_observed_at":"2026-07-30T04:59:24.269176Z","submitted_at":"2024-06-22T19:46:06Z","title":"Semantic Entropy Probes: Robust and Cheap Hallucination Detection in LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.15927","snapshot_observed_at":"2026-08-07T12:59:38.199784Z","title":"Semantic entropy probes: Robust and cheap hallucination detection in llms.arXiv preprint arXiv:2406.15927, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23854","last_updated":"2025-05-29T02:04:49Z","snapshot_observed_at":"2026-08-08T05:42:18.540435Z","submitted_at":"2025-05-29T02:04:49Z","title":"Revisiting Uncertainty Estimation and Calibration of Large Language Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T12:59:38.199784Z"},"links":{"cited_paper":"/paper/2406.15927","citing_paper":"/paper/2505.23854"},"observation_digest":"sha256:269f5304064828bebfa5d6d4f5f6f6e06a3f8cb7e8dd859830347fd5fb25492e","observation_id":"7483b66a-e019-446d-9bc9-30d7cf093fe1","resolution":{"observed_at":"2026-08-07T12:59:38.199784Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14477","last_updated":"2025-04-22T19:00:41Z","snapshot_observed_at":"2026-08-07T16:54:12.159566Z","submitted_at":"2025-03-18T17:51:04Z","title":"Calibrating Verbal Uncertainty as a Linear Feature to Reduce Hallucinations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.14477","snapshot_observed_at":"2026-08-07T12:59:38.252917Z","title":"Calibrating verbal uncertainty as a linear feature to reduce hallucinations.arXiv preprint arXiv:2503.14477, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.23854","last_updated":"2025-05-29T02:04:49Z","snapshot_observed_at":"2026-08-08T05:42:18.540435Z","submitted_at":"2025-05-29T02:04:49Z","title":"Revisiting Uncertainty Estimation and Calibration of Large Language Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T12:59:38.252917Z"},"links":{"cited_paper":"/paper/2503.14477","citing_paper":"/paper/2505.23854"},"observation_digest":"sha256:c37fc3423568e1c7cfe73d554c9cbf2324e60789ec486906756ba2324c4c96b6","observation_id":"20371349-ad3e-46d9-b448-97107aaabb35","resolution":{"observed_at":"2026-08-07T12:59:38.252917Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:59:38.316495Z","title":"Mitigating object hallucinations in large vision-language models via attention calibration.arXiv preprint arXiv:2502.01969, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.23854","last_updated":"2025-05-29T02:04:49Z","snapshot_observed_at":"2026-08-08T05:42:18.540435Z","submitted_at":"2025-05-29T02:04:49Z","title":"Revisiting Uncertainty Estimation and Calibration of Large Language Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T12:59:38.316495Z"},"links":{"citing_paper":"/paper/2505.23854"},"observation_digest":"sha256:715099cdf2f3d24c04162b87e53b3e61b106a1c192be441349bf7f7ce212a026","observation_id":"d9a07837-1993-4910-bdd7-8388a21795f8","resolution":{"observed_at":"2026-08-07T12:59:38.316495Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.09664","last_updated":"2023-04-15T12:55:45Z","snapshot_observed_at":"2026-07-06T14:53:27.667483Z","submitted_at":"2023-02-19T20:10:07Z","title":"Semantic Uncertainty: Linguistic Invariances for Uncertainty Estimation in Natural Language Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.09664","snapshot_observed_at":"2026-08-07T12:59:38.390328Z","title":"Semantic uncertainty: Linguistic invariances for uncertainty estimation in natural language generation, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.23854","last_updated":"2025-05-29T02:04:49Z","snapshot_observed_at":"2026-08-08T05:42:18.540435Z","submitted_at":"2025-05-29T02:04:49Z","title":"Revisiting Uncertainty Estimation and Calibration of Large Language Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T12:59:38.390328Z"},"links":{"cited_paper":"/paper/2302.09664","citing_paper":"/paper/2505.23854"},"observation_digest":"sha256:5ec27261f45c87345adfa54cad7dbf32ad8d36325fc5d13938fff529ce387385","observation_id":"9d820e3e-20a4-4080-9559-74e1ee58c031","resolution":{"observed_at":"2026-08-07T12:59:38.390328Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08896","last_updated":"2023-10-11T17:43:28Z","snapshot_observed_at":"2026-07-06T15:03:55.982628Z","submitted_at":"2023-03-15T19:31:21Z","title":"SelfCheckGPT: Zero-Resource Black-Box Hallucination Detection for Generative Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08896","snapshot_observed_at":"2026-08-07T12:59:38.513072Z","title":"Selfcheckgpt: Zero-resource black-box hallucination detection for generative large language models.arXiv preprint arXiv:2303.08896, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.23854","last_updated":"2025-05-29T02:04:49Z","snapshot_observed_at":"2026-08-08T05:42:18.540435Z","submitted_at":"2025-05-29T02:04:49Z","title":"Revisiting Uncertainty Estimation and Calibration of Large Language Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T12:59:38.513072Z"},"links":{"cited_paper":"/paper/2303.08896","citing_paper":"/paper/2505.23854"},"observation_digest":"sha256:1b5bb003f514c6f9df904f2e07987576b2a700e17cd0f5c1006e48593a66d5e0","observation_id":"daf4f791-7a66-4312-9dd6-51f8d5645d6a","resolution":{"observed_at":"2026-08-07T12:59:38.513072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14975","last_updated":"2023-10-24T04:27:42Z","snapshot_observed_at":"2026-08-09T22:13:12.874121Z","submitted_at":"2023-05-24T10:12:33Z","title":"Just Ask for Calibration: Strategies for Eliciting Calibrated Confidence Scores from Language Models Fine-Tuned with Human Feedback","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.14975","snapshot_observed_at":"2026-08-07T12:59:38.624582Z","title":"Just ask for calibration: Strategies for eliciting calibrated confidence scores from language models fine-tuned with human feedback.arXiv preprint arXiv:2305.14975, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.23854","last_updated":"2025-05-29T02:04:49Z","snapshot_observed_at":"2026-08-08T05:42:18.540435Z","submitted_at":"2025-05-29T02:04:49Z","title":"Revisiting Uncertainty Estimation and Calibration of Large Language Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T12:59:38.624582Z"},"links":{"cited_paper":"/paper/2305.14975","citing_paper":"/paper/2505.23854"},"observation_digest":"sha256:73335a46fa2f4909c60ecaeb9b226fc79993e6e82b503fa873c0bfa9f9ebc6c3","observation_id":"1da2abeb-136f-4094-a287-a324fe04db61","resolution":{"observed_at":"2026-08-07T12:59:38.624582Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.13063","last_updated":"2024-03-17T04:38:48Z","snapshot_observed_at":"2026-07-06T15:45:39.649725Z","submitted_at":"2023-06-22T17:31:44Z","title":"Can LLMs Express Their Uncertainty? An Empirical Evaluation of Confidence Elicitation in LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.13063","snapshot_observed_at":"2026-08-07T12:59:38.714851Z","title":"Can llms express their uncertainty? an empirical evaluation of confidence elicitation in llms, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23854","last_updated":"2025-05-29T02:04:49Z","snapshot_observed_at":"2026-08-08T05:42:18.540435Z","submitted_at":"2025-05-29T02:04:49Z","title":"Revisiting Uncertainty Estimation and Calibration of Large Language Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T12:59:38.714851Z"},"links":{"cited_paper":"/paper/2306.13063","citing_paper":"/paper/2505.23854"},"observation_digest":"sha256:9b0e1a9ed73bbe269970d20af5351c526eb94cbf30b90453a1c6cfd8d76e4b9e","observation_id":"3252f1ca-9b54-4095-9185-67ba89f5ccee","resolution":{"observed_at":"2026-08-07T12:59:38.714851Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.16908","last_updated":"2024-09-26T08:53:01Z","snapshot_observed_at":"2026-08-07T05:46:14.988687Z","submitted_at":"2024-05-27T07:56:23Z","title":"Can Large Language Models Faithfully Express Their Intrinsic Uncertainty in Words?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.16908","snapshot_observed_at":"2026-08-07T12:59:38.828049Z","title":"Can large language models faithfully express their intrinsic uncertainty in words?arXiv preprint arXiv:2405.16908, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23854","last_updated":"2025-05-29T02:04:49Z","snapshot_observed_at":"2026-08-08T05:42:18.540435Z","submitted_at":"2025-05-29T02:04:49Z","title":"Revisiting Uncertainty Estimation and Calibration of Large Language Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T12:59:38.828049Z"},"links":{"cited_paper":"/paper/2405.16908","citing_paper":"/paper/2505.23854"},"observation_digest":"sha256:fab2016741619ff56911d5e0e6fb24efd30efcffcb37235e983a865818d10b49","observation_id":"46d5145c-d84e-4cc8-8d54-ac61ca9238c7","resolution":{"observed_at":"2026-08-07T12:59:38.828049Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.15814","last_updated":"2024-11-07T17:33:37Z","snapshot_observed_at":"2026-07-06T18:50:13.559866Z","submitted_at":"2024-07-22T17:26:12Z","title":"Perceptions of Linguistic Uncertainty by Language Models and Humans","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.15814","snapshot_observed_at":"2026-08-07T12:59:38.924855Z","title":"Perceptions of linguistic uncertainty by language models and humans.arXiv preprint arXiv:2407.15814, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23854","last_updated":"2025-05-29T02:04:49Z","snapshot_observed_at":"2026-08-08T05:42:18.540435Z","submitted_at":"2025-05-29T02:04:49Z","title":"Revisiting Uncertainty Estimation and Calibration of Large Language Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T12:59:38.924855Z"},"links":{"cited_paper":"/paper/2407.15814","citing_paper":"/paper/2505.23854"},"observation_digest":"sha256:44f5fb3f34abf6ff51abc6c7f49e43254dda4685ff5bd8e8ccbbe49f3b1cb89a","observation_id":"040bf658-455f-4dcf-a43a-841e691046fb","resolution":{"observed_at":"2026-08-07T12:59:38.924855Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.13240","last_updated":"2023-11-22T08:57:55Z","snapshot_observed_at":"2026-08-07T00:41:33.190948Z","submitted_at":"2023-11-22T08:57:55Z","title":"On the Calibration of Large Language Models and Alignment","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.13240","snapshot_observed_at":"2026-08-07T12:59:39.079405Z","title":"On the calibration of large language models and alignment.arXiv preprint arXiv:2311.13240, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.23854","last_updated":"2025-05-29T02:04:49Z","snapshot_observed_at":"2026-08-08T05:42:18.540435Z","submitted_at":"2025-05-29T02:04:49Z","title":"Revisiting Uncertainty Estimation and Calibration of Large Language Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T12:59:39.079405Z"},"links":{"cited_paper":"/paper/2311.13240","citing_paper":"/paper/2505.23854"},"observation_digest":"sha256:6fc1c1c0384208d913781c7f38d1a8d3bf05fb882674bd40940c2e3e8c8f392e","observation_id":"561c4e14-e924-45c8-ab52-42a5b1aa0943","resolution":{"observed_at":"2026-08-07T12:59:39.079405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-07T12:59:39.166999Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning.arXiv preprint arXiv:2501.12948, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.23854","last_updated":"2025-05-29T02:04:49Z","snapshot_observed_at":"2026-08-08T05:42:18.540435Z","submitted_at":"2025-05-29T02:04:49Z","title":"Revisiting Uncertainty Estimation and Calibration of Large Language Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T12:59:39.166999Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2505.23854"},"observation_digest":"sha256:5d0c89262ac40f4dbaee3c51c3b3cdb3cd2ce4134742e358ef0021813a2d615c","observation_id":"43492b8e-c07c-4c8a-a7c6-b8881390c9fd","resolution":{"observed_at":"2026-08-07T12:59:39.166999Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:59:44.260512Z","title":"Qwen2 and qwen3: The new generation open models.https://qwenlm.github","venue":null,"work_id":"eab9b3cc-7d0f-4177-b360-3e8fd1edc8f0","year":2024},"citing_paper":{"arxiv_id":"2505.23854","last_updated":"2025-05-29T02:04:49Z","snapshot_observed_at":"2026-08-08T05:42:18.540435Z","submitted_at":"2025-05-29T02:04:49Z","title":"Revisiting Uncertainty Estimation and Calibration of Large Language Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T12:59:39.236785Z"},"links":{"citing_paper":"/paper/2505.23854"},"observation_digest":"sha256:2b347a5ac8396e70ea7f058347a81125e3312e58262ba23c5866843bcb371856","observation_id":"feced0d8-d9af-428f-9ed7-f4f812140968","resolution":{"observed_at":"2026-08-07T12:59:44.275222Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:59:44.187948Z","title":"Llama 4: Multimodal intelligence","venue":null,"work_id":"2c0e1c86-2d8b-46fd-b68a-a13f18495a18","year":2025},"citing_paper":{"arxiv_id":"2505.23854","last_updated":"2025-05-29T02:04:49Z","snapshot_observed_at":"2026-08-08T05:42:18.540435Z","submitted_at":"2025-05-29T02:04:49Z","title":"Revisiting Uncertainty Estimation and Calibration of Large Language Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T12:59:39.357994Z"},"links":{"citing_paper":"/paper/2505.23854"},"observation_digest":"sha256:7734342e2048933aa90e94aa61638a3de7f6a7be4b17ab16c74ce6c8b82043c7","observation_id":"96ee5786-bd27-4fbb-ace8-6dcb53a8203a","resolution":{"observed_at":"2026-08-07T12:59:44.237880Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:59:44.105755Z","title":"Introducing o3 and o4 mini","venue":null,"work_id":"8c8a48e4-f1ce-4e96-aea5-9574f0b6d065","year":2024},"citing_paper":{"arxiv_id":"2505.23854","last_updated":"2025-05-29T02:04:49Z","snapshot_observed_at":"2026-08-08T05:42:18.540435Z","submitted_at":"2025-05-29T02:04:49Z","title":"Revisiting Uncertainty Estimation and Calibration of Large Language Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T12:59:39.442780Z"},"links":{"citing_paper":"/paper/2505.23854"},"observation_digest":"sha256:8696b925b75f13107d9c02b47049273f203509ae2a656ecad3a0f38e591286fa","observation_id":"a2a320e6-784f-4152-90fa-d40238abbb74","resolution":{"observed_at":"2026-08-07T12:59:44.141647Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:59:44.013782Z","title":"Grok-3 and the next generation of reasoning models","venue":null,"work_id":"4b8bc803-6a96-49b7-8bed-a521c5452e47","year":null},"citing_paper":{"arxiv_id":"2505.23854","last_updated":"2025-05-29T02:04:49Z","snapshot_observed_at":"2026-08-08T05:42:18.540435Z","submitted_at":"2025-05-29T02:04:49Z","title":"Revisiting Uncertainty Estimation and Calibration of Large Language Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T12:59:39.522769Z"},"links":{"citing_paper":"/paper/2505.23854"},"observation_digest":"sha256:891ada9bd61aaa2548a4c98a783debd6d79970e27278d1810b5a9c6512e0cce1","observation_id":"7ca919f0-c98c-44a9-a08d-1c3439806fef","resolution":{"observed_at":"2026-08-07T12:59:44.048562Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:59:39.709871Z","title":"TriviaQA: A large scale distantly supervised challenge dataset for reading comprehension","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.23854","last_updated":"2025-05-29T02:04:49Z","snapshot_observed_at":"2026-08-08T05:42:18.540435Z","submitted_at":"2025-05-29T02:04:49Z","title":"Revisiting Uncertainty Estimation and Calibration of Large Language Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T12:59:39.709871Z"},"links":{"citing_paper":"/paper/2505.23854"},"observation_digest":"sha256:65c5d819c8f41f4bc977040f68c97f41114f9e97e51ccdfe83d66f9b0350eca2","observation_id":"d5c417bf-1447-4da1-90d3-fdc1f4bc9285","resolution":{"observed_at":"2026-08-07T12:59:39.709871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.03300","last_updated":"2021-01-12T18:57:11Z","snapshot_observed_at":"2026-08-10T12:35:09.020030Z","submitted_at":"2020-09-07T17:59:25Z","title":"Measuring Massive Multitask Language Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.03300","snapshot_observed_at":"2026-08-07T12:59:39.781726Z","title":"Measuring massive multitask language understanding.arXiv preprint arXiv:2009.03300, 2020","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2505.23854","last_updated":"2025-05-29T02:04:49Z","snapshot_observed_at":"2026-08-08T05:42:18.540435Z","submitted_at":"2025-05-29T02:04:49Z","title":"Revisiting Uncertainty Estimation and Calibration of Large Language Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T12:59:39.781726Z"},"links":{"cited_paper":"/paper/2009.03300","citing_paper":"/paper/2505.23854"},"observation_digest":"sha256:a5e46b78a2384b8c6f752724e0061987c7501a80a9872da7a181ddc622e8e558","observation_id":"d4fb2b74-c697-4bfd-8579-261b7d2d5daa","resolution":{"observed_at":"2026-08-07T12:59:39.781726Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:59:39.839500Z","title":"Mmlu-pro: A more robust and challenging multi-task language understanding benchmark","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23854","last_updated":"2025-05-29T02:04:49Z","snapshot_observed_at":"2026-08-08T05:42:18.540435Z","submitted_at":"2025-05-29T02:04:49Z","title":"Revisiting Uncertainty Estimation and Calibration of Large Language Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T12:59:39.839500Z"},"links":{"citing_paper":"/paper/2505.23854"},"observation_digest":"sha256:6993f8f57345dfb070abfd3202f57371ec565cb7874decd6c32d10d45264fcc6","observation_id":"644fd330-d804-43e6-a659-90515ff59a9f","resolution":{"observed_at":"2026-08-07T12:59:39.839500Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:59:43.901407Z","title":"Discovering latent knowledge in language models without supervision","venue":null,"work_id":"ffa5b98f-69a7-4483-985b-3ca0ff323875","year":2022},"citing_paper":{"arxiv_id":"2505.23854","last_updated":"2025-05-29T02:04:49Z","snapshot_observed_at":"2026-08-08T05:42:18.540435Z","submitted_at":"2025-05-29T02:04:49Z","title":"Revisiting Uncertainty Estimation and Calibration of Large Language Models","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T12:59:39.912855Z"},"links":{"citing_paper":"/paper/2505.23854"},"observation_digest":"sha256:f0dbed99ee05f0bf46ac34b1af7696428b4865d8f2a7a1e7d88b39ec9103b617","observation_id":"7e671f56-039f-4d6d-9ebf-f699aafa29e0","resolution":{"observed_at":"2026-08-07T12:59:43.954047Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.05221","last_updated":"2022-11-21T16:38:35Z","snapshot_observed_at":"2026-08-06T08:34:11.887259Z","submitted_at":"2022-07-11T22:59:39Z","title":"Language Models (Mostly) Know What They Know","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.05221","snapshot_observed_at":"2026-08-07T12:59:40.012125Z","title":"Language models (mostly) know what they know.arXiv preprint arXiv:2207.05221, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.23854","last_updated":"2025-05-29T02:04:49Z","snapshot_observed_at":"2026-08-08T05:42:18.540435Z","submitted_at":"2025-05-29T02:04:49Z","title":"Revisiting Uncertainty Estimation and Calibration of Large Language Models","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T12:59:40.012125Z"},"links":{"cited_paper":"/paper/2207.05221","citing_paper":"/paper/2505.23854"},"observation_digest":"sha256:a049c042281e85c7a5e7ccfa278aea40fb3d98cc8488d5880ceeef2760c5efbb","observation_id":"d07b328d-4fc3-4dde-b7a7-3bc9cf23f8bf","resolution":{"observed_at":"2026-08-07T12:59:40.012125Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:59:40.103165Z","title":"Detecting hallucinations in large language models using semantic entropy.Nature, 630(8017):625–630, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23854","last_updated":"2025-05-29T02:04:49Z","snapshot_observed_at":"2026-08-08T05:42:18.540435Z","submitted_at":"2025-05-29T02:04:49Z","title":"Revisiting Uncertainty Estimation and Calibration of Large Language Models","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T12:59:40.103165Z"},"links":{"citing_paper":"/paper/2505.23854"},"observation_digest":"sha256:7f93ba4c923c2764a7a81f2baa53c810b32a049416c4a40cc840b19a23334fc5","observation_id":"5d544f98-6e7d-473b-832b-d53a9d3d1f1b","resolution":{"observed_at":"2026-08-07T12:59:40.103165Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:59:40.212539Z","title":"On calibration of modern neural networks","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.23854","last_updated":"2025-05-29T02:04:49Z","snapshot_observed_at":"2026-08-08T05:42:18.540435Z","submitted_at":"2025-05-29T02:04:49Z","title":"Revisiting Uncertainty Estimation and Calibration of Large Language Models","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T12:59:40.212539Z"},"links":{"citing_paper":"/paper/2505.23854"},"observation_digest":"sha256:005a3850bcacbe939c2859ea56a24ea68eb7ab245ef4286d1310b7b3f9c7e66e","observation_id":"98fdfb8b-4d9d-4f32-8da3-7de8b050e27b","resolution":{"observed_at":"2026-08-07T12:59:40.212539Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:59:43.774564Z","title":"Benchmarking uncertainty disen- tanglement: Specialized uncertainties for specialized tasks.Advances in neural information processing systems, 37:50972–51038, 2024","venue":null,"work_id":"c7768030-2224-4a33-8b95-ec54d1dc8cb5","year":2024},"citing_paper":{"arxiv_id":"2505.23854","last_updated":"2025-05-29T02:04:49Z","snapshot_observed_at":"2026-08-08T05:42:18.540435Z","submitted_at":"2025-05-29T02:04:49Z","title":"Revisiting Uncertainty Estimation and Calibration of Large Language Models","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T12:59:40.320314Z"},"links":{"citing_paper":"/paper/2505.23854"},"observation_digest":"sha256:fe92f5ab4e5ffa8d4013a51ab33b4b249f320a4530aed8292a383e9224c30d2e","observation_id":"dfd90084-708e-4ff0-a687-ead5ff14c5e0","resolution":{"observed_at":"2026-08-07T12:59:43.826331Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:59:40.430239Z","title":"Measuring calibration in deep learning","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.23854","last_updated":"2025-05-29T02:04:49Z","snapshot_observed_at":"2026-08-08T05:42:18.540435Z","submitted_at":"2025-05-29T02:04:49Z","title":"Revisiting Uncertainty Estimation and Calibration of Large Language Models","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T12:59:40.430239Z"},"links":{"citing_paper":"/paper/2505.23854"},"observation_digest":"sha256:c7dbb6467da5563877c9bcc4c5cb6c2a8d688c5de2b2e16cfe5af654fe3fb38a","observation_id":"edc5dd6f-45f2-44c5-a9fc-b7813b164eed","resolution":{"observed_at":"2026-08-07T12:59:40.430239Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:59:40.530832Z","title":"Predicting good probabilities with supervised learning","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2505.23854","last_updated":"2025-05-29T02:04:49Z","snapshot_observed_at":"2026-08-08T05:42:18.540435Z","submitted_at":"2025-05-29T02:04:49Z","title":"Revisiting Uncertainty Estimation and Calibration of Large Language Models","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T12:59:40.530832Z"},"links":{"citing_paper":"/paper/2505.23854"},"observation_digest":"sha256:586b069010dfd3090ec0f7f61864f82caa5a18e37917335094a6c8ff7b4b0d4d","observation_id":"bf21376f-ff4a-48b1-92a2-72b3e96a872f","resolution":{"observed_at":"2026-08-07T12:59:40.530832Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-10T16:40:37.411115Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-07T12:59:40.568605Z","title":"The llama 3 herd of models.arXiv preprint arXiv:2407.21783, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23854","last_updated":"2025-05-29T02:04:49Z","snapshot_observed_at":"2026-08-08T05:42:18.540435Z","submitted_at":"2025-05-29T02:04:49Z","title":"Revisiting Uncertainty Estimation and Calibration of Large Language Models","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T12:59:40.568605Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2505.23854"},"observation_digest":"sha256:194b18f88b4571d11565f29101a5e7308f6a0cbcefa5762e300fea91e54d25d0","observation_id":"46cf49c1-3722-4012-8942-0e7e3b5abdae","resolution":{"observed_at":"2026-08-07T12:59:40.568605Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-08-10T17:02:50.054809Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-08-07T12:59:40.672286Z","title":"Deepseek-v3 technical report.arXiv preprint arXiv:2412.19437, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23854","last_updated":"2025-05-29T02:04:49Z","snapshot_observed_at":"2026-08-08T05:42:18.540435Z","submitted_at":"2025-05-29T02:04:49Z","title":"Revisiting Uncertainty Estimation and Calibration of Large Language Models","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T12:59:40.672286Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2505.23854"},"observation_digest":"sha256:d755eef4f97d9344a6d82e4482bd909c7441b13e600091f93620f628bd665b94","observation_id":"dcc0c5ba-e9ed-4731-8080-4ea7282a70dd","resolution":{"observed_at":"2026-08-07T12:59:40.672286Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-07T12:59:40.769319Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23854","last_updated":"2025-05-29T02:04:49Z","snapshot_observed_at":"2026-08-08T05:42:18.540435Z","submitted_at":"2025-05-29T02:04:49Z","title":"Revisiting Uncertainty Estimation and Calibration of Large Language Models","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T12:59:40.769319Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2505.23854"},"observation_digest":"sha256:c5f09a2498cd578ad030496088fd4b6119e69bf650fe72bf7398911db6fec0a6","observation_id":"28897efc-495f-44b7-bd9a-c3e2e5921e7d","resolution":{"observed_at":"2026-08-07T12:59:40.769319Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:59:43.672638Z","title":"Identifying and mitigating vulnerabilities in llm-integrated applications","venue":null,"work_id":"c6622001-b34b-4bd0-97e7-3514f99725db","year":2024},"citing_paper":{"arxiv_id":"2505.23854","last_updated":"2025-05-29T02:04:49Z","snapshot_observed_at":"2026-08-08T05:42:18.540435Z","submitted_at":"2025-05-29T02:04:49Z","title":"Revisiting Uncertainty Estimation and Calibration of Large Language Models","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T12:59:40.902069Z"},"links":{"citing_paper":"/paper/2505.23854"},"observation_digest":"sha256:6c9dfe67af4ef6e3ad436486254ea064b5aeae8e7645e0c85bc357fd053366ab","observation_id":"dfca067e-37b5-48a8-bf61-e03739bbbe41","resolution":{"observed_at":"2026-08-07T12:59:43.707808Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.08295","last_updated":"2024-04-16T12:52:47Z","snapshot_observed_at":"2026-08-03T03:29:01.959523Z","submitted_at":"2024-03-13T06:59:16Z","title":"Gemma: Open Models Based on Gemini Research and Technology","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.08295","snapshot_observed_at":"2026-08-07T12:59:41.026953Z","title":"Gemma: Open models based on gemini research and technology.arXiv preprint arXiv:2403.08295, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23854","last_updated":"2025-05-29T02:04:49Z","snapshot_observed_at":"2026-08-08T05:42:18.540435Z","submitted_at":"2025-05-29T02:04:49Z","title":"Revisiting Uncertainty Estimation and Calibration of Large Language Models","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T12:59:41.026953Z"},"links":{"cited_paper":"/paper/2403.08295","citing_paper":"/paper/2505.23854"},"observation_digest":"sha256:879243a2112dcbb87a2ca8af7791a68a1d6ece4d5964db59099c0ed5cb809085","observation_id":"b7d3af9e-c9c5-436c-8b93-276255bf9c66","resolution":{"observed_at":"2026-08-07T12:59:41.026953Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:59:43.594233Z","title":"Introducing gpt-4o: Openai’s new omni model","venue":null,"work_id":"6c58acff-b220-4ced-8486-328d59331dbb","year":2024},"citing_paper":{"arxiv_id":"2505.23854","last_updated":"2025-05-29T02:04:49Z","snapshot_observed_at":"2026-08-08T05:42:18.540435Z","submitted_at":"2025-05-29T02:04:49Z","title":"Revisiting Uncertainty Estimation and Calibration of Large Language Models","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T12:59:41.103318Z"},"links":{"citing_paper":"/paper/2505.23854"},"observation_digest":"sha256:56a5fff8f3830555c14749a413dfbc409ed97b86c3e13444f7c574e53d37a218","observation_id":"7e56c294-799c-4035-b00d-968fef65f92d","resolution":{"observed_at":"2026-08-07T12:59:43.627738Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:59:43.511854Z","title":"Gpt-4.1 overview","venue":null,"work_id":"410e4513-b886-4695-89d3-cc92c68daf0c","year":2024},"citing_paper":{"arxiv_id":"2505.23854","last_updated":"2025-05-29T02:04:49Z","snapshot_observed_at":"2026-08-08T05:42:18.540435Z","submitted_at":"2025-05-29T02:04:49Z","title":"Revisiting Uncertainty Estimation and Calibration of Large Language Models","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T12:59:41.172123Z"},"links":{"citing_paper":"/paper/2505.23854"},"observation_digest":"sha256:d46659c4ec155ced3dae15b0c56e26e19c12a95b518ea3ae0a36b7f2b53a0ffc","observation_id":"205b571d-ccb9-4ea5-90d3-c80f83777942","resolution":{"observed_at":"2026-08-07T12:59:43.540243Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:59:43.389576Z","title":"Introducing the claude 3 model family","venue":null,"work_id":"4852fd42-e648-4b18-98bb-39cfeddc0ec2","year":2024},"citing_paper":{"arxiv_id":"2505.23854","last_updated":"2025-05-29T02:04:49Z","snapshot_observed_at":"2026-08-08T05:42:18.540435Z","submitted_at":"2025-05-29T02:04:49Z","title":"Revisiting Uncertainty Estimation and Calibration of Large Language Models","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T12:59:41.282128Z"},"links":{"citing_paper":"/paper/2505.23854"},"observation_digest":"sha256:eed1c6670faaa3587a1acd715dc5258ccbe0e9c3ab0527ad06b97a10c6cb76c6","observation_id":"512247d6-a942-4999-81d9-86498a28fed7","resolution":{"observed_at":"2026-08-07T12:59:43.455340Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05530","last_updated":"2024-12-16T17:39:39Z","snapshot_observed_at":"2026-07-06T17:41:42.995949Z","submitted_at":"2024-03-08T18:54:20Z","title":"Gemini 1.5: Unlocking multimodal understanding across millions of tokens of context","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05530","snapshot_observed_at":"2026-08-07T12:59:41.387827Z","title":"Gemini 1.5: Unlocking multimodal understanding across millions of tokens of context.arXiv preprint arXiv:2403.05530, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23854","last_updated":"2025-05-29T02:04:49Z","snapshot_observed_at":"2026-08-08T05:42:18.540435Z","submitted_at":"2025-05-29T02:04:49Z","title":"Revisiting Uncertainty Estimation and Calibration of Large Language Models","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T12:59:41.387827Z"},"links":{"cited_paper":"/paper/2403.05530","citing_paper":"/paper/2505.23854"},"observation_digest":"sha256:316c43fa1f2906b3d04abdc98014c61da9c27c13f9875a3cbd9d10ff3d93fff8","observation_id":"0d888322-b373-4cb2-a7d7-eb0df487fed1","resolution":{"observed_at":"2026-08-07T12:59:41.387827Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:59:43.295154Z","title":"Qwen3 technical report","venue":null,"work_id":"3a6f5fd9-509e-459f-a0bf-fe03caf86b30","year":2024},"citing_paper":{"arxiv_id":"2505.23854","last_updated":"2025-05-29T02:04:49Z","snapshot_observed_at":"2026-08-08T05:42:18.540435Z","submitted_at":"2025-05-29T02:04:49Z","title":"Revisiting Uncertainty Estimation and Calibration of Large Language Models","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T12:59:41.466584Z"},"links":{"citing_paper":"/paper/2505.23854"},"observation_digest":"sha256:2805decc11bbac4ac010f5b272463cd7cd4406602abfe64af2f13168e24e8c5d","observation_id":"26d9cfaa-8dd7-44ff-9a27-a25118f1dbd6","resolution":{"observed_at":"2026-08-07T12:59:43.338288Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:59:43.170578Z","title":"The kendall rank correlation coefficient.Encyclopedia of measurement and statistics, 2:508–510, 2007","venue":null,"work_id":"7a174202-72a6-4d34-982a-1c4ee438c4dc","year":2007},"citing_paper":{"arxiv_id":"2505.23854","last_updated":"2025-05-29T02:04:49Z","snapshot_observed_at":"2026-08-08T05:42:18.540435Z","submitted_at":"2025-05-29T02:04:49Z","title":"Revisiting Uncertainty Estimation and Calibration of Large Language Models","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T12:59:41.561704Z"},"links":{"citing_paper":"/paper/2505.23854"},"observation_digest":"sha256:26c223796619d29f58c40ee5bd18c2151772b433b3bc3e50323b6023f5276589","observation_id":"aa3f8ebf-8f15-438f-9205-c886c88f0e47","resolution":{"observed_at":"2026-08-07T12:59:43.219279Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:59:43.071179Z","title":"i’m not sure, but","venue":null,"work_id":"0d6c30c5-8e40-4362-b6cf-9e2496f583b9","year":2024},"citing_paper":{"arxiv_id":"2505.23854","last_updated":"2025-05-29T02:04:49Z","snapshot_observed_at":"2026-08-08T05:42:18.540435Z","submitted_at":"2025-05-29T02:04:49Z","title":"Revisiting Uncertainty Estimation and Calibration of Large Language Models","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T12:59:41.651489Z"},"links":{"citing_paper":"/paper/2505.23854"},"observation_digest":"sha256:421ff98f8134e24bccb15827e9ccdc2a29e63efb2ee02b5f9548ef794a34c8b3","observation_id":"1b059fc6-3b14-4a6c-acab-2704abb5c733","resolution":{"observed_at":"2026-08-07T12:59:43.108420Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.19187","last_updated":"2024-05-20T01:53:36Z","snapshot_observed_at":"2026-08-07T10:41:32.183020Z","submitted_at":"2023-05-30T16:31:26Z","title":"Generating with Confidence: Uncertainty Quantification for Black-box Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.19187","snapshot_observed_at":"2026-08-07T12:59:41.765614Z","title":"Generating with confidence: Uncertainty quantification for black-box large language models.arXiv preprint arXiv:2305.19187, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.23854","last_updated":"2025-05-29T02:04:49Z","snapshot_observed_at":"2026-08-08T05:42:18.540435Z","submitted_at":"2025-05-29T02:04:49Z","title":"Revisiting Uncertainty Estimation and Calibration of Large Language Models","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T12:59:41.765614Z"},"links":{"cited_paper":"/paper/2305.19187","citing_paper":"/paper/2505.23854"},"observation_digest":"sha256:91a901be77746da89315f4be04c58750e8fa92e46485c37d0111d8b5a0b76a8f","observation_id":"32c81645-cadb-4dfd-8b68-1c9f47e25d8e","resolution":{"observed_at":"2026-08-07T12:59:41.765614Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:59:41.862601Z","title":"The internal state of an llm knows when it’s lying","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.23854","last_updated":"2025-05-29T02:04:49Z","snapshot_observed_at":"2026-08-08T05:42:18.540435Z","submitted_at":"2025-05-29T02:04:49Z","title":"Revisiting Uncertainty Estimation and Calibration of Large Language Models","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T12:59:41.862601Z"},"links":{"citing_paper":"/paper/2505.23854"},"observation_digest":"sha256:116af74deb74e972858cd06714c34e8d8df35c2a71f4d3196937bb11ed8da250","observation_id":"dee90a92-4161-4657-a699-700ec5fb9550","resolution":{"observed_at":"2026-08-07T12:59:41.862601Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:59:41.990181Z","title":"Inference- time intervention: Eliciting truthful answers from a language model","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.23854","last_updated":"2025-05-29T02:04:49Z","snapshot_observed_at":"2026-08-08T05:42:18.540435Z","submitted_at":"2025-05-29T02:04:49Z","title":"Revisiting Uncertainty Estimation and Calibration of Large Language Models","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T12:59:41.990181Z"},"links":{"citing_paper":"/paper/2505.23854"},"observation_digest":"sha256:40b85a207f2a10adf070445c492f803a5bace7c7cc2c7a1c72d6243c698cd3cc","observation_id":"10675e64-2b09-480d-83f2-e5211afa71ea","resolution":{"observed_at":"2026-08-07T12:59:41.990181Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.15993","last_updated":"2024-10-23T08:33:54Z","snapshot_observed_at":"2026-08-08T05:41:54.254097Z","submitted_at":"2024-04-24T17:10:35Z","title":"Uncertainty Estimation and Quantification for LLMs: A Simple Supervised Approach","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.15993","snapshot_observed_at":"2026-08-07T12:59:42.079253Z","title":"Uncertainty estimation and quantification for llms: A simple supervised approach.arXiv preprint arXiv:2404.15993, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23854","last_updated":"2025-05-29T02:04:49Z","snapshot_observed_at":"2026-08-08T05:42:18.540435Z","submitted_at":"2025-05-29T02:04:49Z","title":"Revisiting Uncertainty Estimation and Calibration of Large Language Models","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T12:59:42.079253Z"},"links":{"cited_paper":"/paper/2404.15993","citing_paper":"/paper/2505.23854"},"observation_digest":"sha256:5fda9bfaa39a3bfae392c2c0fca6c87f00aa6a89e2e860993b0b7b506a5ccec9","observation_id":"8f7b23fa-2184-4464-a311-2d9a6e5d2f00","resolution":{"observed_at":"2026-08-07T12:59:42.079253Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.08298","last_updated":"2024-03-25T06:01:49Z","snapshot_observed_at":"2026-08-07T09:11:04.926129Z","submitted_at":"2023-11-14T16:43:29Z","title":"A Survey of Confidence Estimation and Calibration in Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.08298","snapshot_observed_at":"2026-08-07T12:59:42.188284Z","title":"A survey of confidence estimation and calibration in large language models.arXiv preprint arXiv:2311.08298, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.23854","last_updated":"2025-05-29T02:04:49Z","snapshot_observed_at":"2026-08-08T05:42:18.540435Z","submitted_at":"2025-05-29T02:04:49Z","title":"Revisiting Uncertainty Estimation and Calibration of Large Language Models","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T12:59:42.188284Z"},"links":{"cited_paper":"/paper/2311.08298","citing_paper":"/paper/2505.23854"},"observation_digest":"sha256:00315f976623486178b03765e6f7c35ab051dc8841bee75c0e371a6b8b277260","observation_id":"8068ad81-a5df-45a1-9833-b1b3eef73a3d","resolution":{"observed_at":"2026-08-07T12:59:42.188284Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15326","last_updated":"2024-10-20T07:55:44Z","snapshot_observed_at":"2026-07-06T19:36:36.994783Z","submitted_at":"2024-10-20T07:55:44Z","title":"A Survey of Uncertainty Estimation in LLMs: Theory Meets Practice","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.15326","snapshot_observed_at":"2026-08-07T12:59:42.294102Z","title":"A survey of uncertainty estimation in llms: Theory meets practice.arXiv preprint arXiv:2410.15326, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23854","last_updated":"2025-05-29T02:04:49Z","snapshot_observed_at":"2026-08-08T05:42:18.540435Z","submitted_at":"2025-05-29T02:04:49Z","title":"Revisiting Uncertainty Estimation and Calibration of Large Language Models","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T12:59:42.294102Z"},"links":{"cited_paper":"/paper/2410.15326","citing_paper":"/paper/2505.23854"},"observation_digest":"sha256:0491990244d2a2c2dcba946195280cccd73d61bdc94e88accedba74a6f1e81db","observation_id":"914ff920-0b70-419f-ae25-9d0adb44237c","resolution":{"observed_at":"2026-08-07T12:59:42.294102Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.15850","last_updated":"2025-06-03T22:16:32Z","snapshot_observed_at":"2026-08-07T16:50:07.430220Z","submitted_at":"2025-03-20T05:04:29Z","title":"Uncertainty Quantification and Confidence Calibration in Large Language Models: A Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.15850","snapshot_observed_at":"2026-08-07T12:59:42.412963Z","title":"[Aa]nswer:?[\\s]*[\\n]*([A-J])","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.23854","last_updated":"2025-05-29T02:04:49Z","snapshot_observed_at":"2026-08-08T05:42:18.540435Z","submitted_at":"2025-05-29T02:04:49Z","title":"Revisiting Uncertainty Estimation and Calibration of Large Language Models","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T12:59:42.412963Z"},"links":{"cited_paper":"/paper/2503.15850","citing_paper":"/paper/2505.23854"},"observation_digest":"sha256:22a8f2a533baf7d7356864056d18a31952e2897d2194ec0f04753b860d3c18cc","observation_id":"772fa1e4-ebcf-417f-9f15-0e801f62ac9d","resolution":{"observed_at":"2026-08-07T12:59:42.412963Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:59:39.612033Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.23854","last_updated":"2025-05-29T02:04:49Z","snapshot_observed_at":"2026-08-08T05:42:18.540435Z","submitted_at":"2025-05-29T02:04:49Z","title":"Revisiting Uncertainty Estimation and Calibration of Large Language Models","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-07T12:59:39.612033Z"},"links":{"citing_paper":"/paper/2505.23854"},"observation_digest":"sha256:b292860dd7d94453ee2e3280d48109c5b37ba589cd1ae8b3f71ec9ec1edc017e","observation_id":"3747804d-053b-4181-997c-b61cd5e3e967","resolution":{"observed_at":"2026-08-07T12:59:39.612033Z","resolver_source":null,"status":"parse_uncertain"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.23854","last_updated":"2025-05-29T02:04:49Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-08T05:42:18.540435Z","submitted_at":"2025-05-29T02:04:49Z","title":"Revisiting Uncertainty Estimation and Calibration of Large Language Models"},"reference_resolution":{"displayed":55,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":1,"unresolved":33,"verified_exact":0,"verified_fuzzy":20},"total_outbound_references":55},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 55 of 55 outbound references and 10 inbound Pith citation observations for arXiv:2505.23854."}