{"as_of":"2026-08-06T20:42:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9033b84c1a09fe93924755b4775ffc13b80f3542bccc4fbec63231bd7fc885cb","coverage":[{"denominator":29,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":29,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-21T10:38:28.533485Z","state":"measured"},{"denominator":40,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":40,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":11,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":11,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T16:59:54.843386Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"pith","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"pith"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2603.17839","last_updated":"2026-05-19T10:45:47Z","snapshot_observed_at":"2026-07-06T22:49:33.482934Z","submitted_at":"2026-03-18T15:31:43Z","title":"How do LLMs Compute Verbal Confidence","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2603.17839","snapshot_observed_at":"2026-08-02T16:59:54.843386Z","title":"How do llms compute verbal confidence.arXiv preprint arXiv:2603.17839,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2604.01457","last_updated":"2026-07-27T01:12:54Z","snapshot_observed_at":"2026-08-03T08:25:00.376375Z","submitted_at":"2026-04-01T23:06:58Z","title":"Wired for Overconfidence: A Mechanistic Perspective on Inflated Verbalized Confidence in LLMs","version":3},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-02T16:59:54.843386Z"},"links":{"cited_paper":"/paper/2603.17839","citing_paper":"/paper/2604.01457"},"observation_digest":"sha256:659e7a51f16685c7309deca1c545f887b29a20a2803cd982a1d662cd6b6ec60f","observation_id":"917d2708-72ca-4af2-8611-9e7cfb4de52e","resolution":{"observed_at":"2026-08-02T16:59:54.843386Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2603.17839","last_updated":"2026-05-19T10:45:47Z","snapshot_observed_at":"2026-07-06T22:49:33.482934Z","submitted_at":"2026-03-18T15:31:43Z","title":"How do LLMs Compute Verbal Confidence","version":3},"cited_work":{"arxiv_id":"2603.17839","doi":"10.48550/arxiv.2603.17839","metadata_source":"pith","pith_arxiv_id":"2603.17839","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"How do LLMs Compute Verbal Confidence","venue":"cs.CL","work_id":"d459cf71-3a48-4269-bf48-cecceb09d722","year":2026},"citing_paper":{"arxiv_id":"2604.22215","last_updated":"2026-04-24T04:45:21Z","snapshot_observed_at":"2026-08-03T04:21:44.322913Z","submitted_at":"2026-04-24T04:45:21Z","title":"Verbal Confidence Saturation in 3-9B Open-Weight Instruction-Tuned LLMs: A Pre-Registered Psychometric Validity Screen","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-08T12:09:07.770260Z"},"links":{"cited_paper":"/paper/2603.17839","citing_paper":"/paper/2604.22215"},"observation_digest":"sha256:501598f4d8057decb18980c0582e6944883e0f4a13b545de9ad490cb5befc8b9","observation_id":"c9e63885-a2d9-4606-9dd9-ee75b5140df0","resolution":{"observed_at":"2026-05-20T02:04:53.698588Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2603.17839","last_updated":"2026-05-19T10:45:47Z","snapshot_observed_at":"2026-07-06T22:49:33.482934Z","submitted_at":"2026-03-18T15:31:43Z","title":"How do LLMs Compute Verbal Confidence","version":3},"cited_work":{"arxiv_id":"2603.17839","doi":"10.48550/arxiv.2603.17839","metadata_source":"pith","pith_arxiv_id":"2603.17839","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"How do LLMs Compute Verbal Confidence","venue":"cs.CL","work_id":"d459cf71-3a48-4269-bf48-cecceb09d722","year":2026},"citing_paper":{"arxiv_id":"2604.22271","last_updated":"2026-05-01T09:11:21Z","snapshot_observed_at":"2026-07-06T23:08:42.301487Z","submitted_at":"2026-04-24T06:33:32Z","title":"How LLMs Detect and Correct Their Own Errors: The Role of Internal Confidence Signals","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-08T12:30:51.094216Z"},"links":{"cited_paper":"/paper/2603.17839","citing_paper":"/paper/2604.22271"},"observation_digest":"sha256:3e9a618ba1094f7299f1719ed3e4ba8116e82c303be9fe04ca955321c20adb69","observation_id":"1ba2f18b-f0fa-4d29-9862-6f8c88201457","resolution":{"observed_at":"2026-05-20T02:04:53.698588Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2603.17839","last_updated":"2026-05-19T10:45:47Z","snapshot_observed_at":"2026-07-06T22:49:33.482934Z","submitted_at":"2026-03-18T15:31:43Z","title":"How do LLMs Compute Verbal Confidence","version":3},"cited_work":{"arxiv_id":"2603.17839","doi":"10.48550/arxiv.2603.17839","metadata_source":"pith","pith_arxiv_id":"2603.17839","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"How do LLMs Compute Verbal Confidence","venue":"cs.CL","work_id":"d459cf71-3a48-4269-bf48-cecceb09d722","year":2026},"citing_paper":{"arxiv_id":"2604.24070","last_updated":"2026-04-27T05:53:26Z","snapshot_observed_at":"2026-07-06T23:10:12.016186Z","submitted_at":"2026-04-27T05:53:26Z","title":"Distilling Self-Consistency into Verbal Confidence: A Pre-Registered Negative Result and Post-Hoc Rescue on Gemma 3 4B","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-05-08T03:54:18.602500Z"},"links":{"cited_paper":"/paper/2603.17839","citing_paper":"/paper/2604.24070"},"observation_digest":"sha256:d5ae3782855dc774ae62b9dd7d8d3c0f6375933f015a1cd133e7d0c666782060","observation_id":"bda01001-2017-4f8c-8a4a-b956aa20f792","resolution":{"observed_at":"2026-05-20T02:04:53.698588Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2603.17839","last_updated":"2026-05-19T10:45:47Z","snapshot_observed_at":"2026-07-06T22:49:33.482934Z","submitted_at":"2026-03-18T15:31:43Z","title":"How do LLMs Compute Verbal Confidence","version":3},"cited_work":{"arxiv_id":"2603.17839","doi":"10.48550/arxiv.2603.17839","metadata_source":"pith","pith_arxiv_id":"2603.17839","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"How do LLMs Compute Verbal Confidence","venue":"cs.CL","work_id":"d459cf71-3a48-4269-bf48-cecceb09d722","year":2026},"citing_paper":{"arxiv_id":"2605.05851","last_updated":"2026-05-07T08:24:54Z","snapshot_observed_at":"2026-08-04T15:23:48.540297Z","submitted_at":"2026-05-07T08:24:54Z","title":"Hypothesis generation and updating in large language models","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-05-08T14:43:56.125546Z"},"links":{"cited_paper":"/paper/2603.17839","citing_paper":"/paper/2605.05851"},"observation_digest":"sha256:f565154efe80e04de79c3a86af67eb8a4aa024d62855f9d7565889972b02c850","observation_id":"cab58a57-38f9-4728-8732-bf73168dec87","resolution":{"observed_at":"2026-05-20T02:04:53.698588Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2603.17839","last_updated":"2026-05-19T10:45:47Z","snapshot_observed_at":"2026-07-06T22:49:33.482934Z","submitted_at":"2026-03-18T15:31:43Z","title":"How do LLMs Compute Verbal Confidence","version":3},"cited_work":{"arxiv_id":"2603.17839","doi":"10.48550/arxiv.2603.17839","metadata_source":"pith","pith_arxiv_id":"2603.17839","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"How do LLMs Compute Verbal Confidence","venue":"cs.CL","work_id":"d459cf71-3a48-4269-bf48-cecceb09d722","year":2026},"citing_paper":{"arxiv_id":"2605.11235","last_updated":"2026-05-11T20:50:29Z","snapshot_observed_at":"2026-07-06T23:23:06.755816Z","submitted_at":"2026-05-11T20:50:29Z","title":"Internalizing Curriculum Judgment for LLM Reinforcement Fine-Tuning","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-13T02:19:27.345348Z"},"links":{"cited_paper":"/paper/2603.17839","citing_paper":"/paper/2605.11235"},"observation_digest":"sha256:3fb2d2534394d0d93d2f2c1f1a45e49ff0a0ff6c9dcac83a576a69b9f1ab3494","observation_id":"bb55f543-1bdb-4cb5-8802-838fd3379d05","resolution":{"observed_at":"2026-05-20T02:04:53.698588Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2603.17839","last_updated":"2026-05-19T10:45:47Z","snapshot_observed_at":"2026-07-06T22:49:33.482934Z","submitted_at":"2026-03-18T15:31:43Z","title":"How do LLMs Compute Verbal Confidence","version":3},"cited_work":{"arxiv_id":"2603.17839","doi":"10.48550/arxiv.2603.17839","metadata_source":"pith","pith_arxiv_id":"2603.17839","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"How do LLMs Compute Verbal Confidence","venue":"cs.CL","work_id":"d459cf71-3a48-4269-bf48-cecceb09d722","year":2026},"citing_paper":{"arxiv_id":"2605.20745","last_updated":"2026-05-20T05:48:16Z","snapshot_observed_at":"2026-07-06T23:31:18.520630Z","submitted_at":"2026-05-20T05:48:16Z","title":"The Hidden Signal of Verifier Strictness: Controlling and Improving Step-Wise Verification via Selective Latent Steering","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-21T06:51:56.556213Z"},"links":{"cited_paper":"/paper/2603.17839","citing_paper":"/paper/2605.20745"},"observation_digest":"sha256:3792daa5666e46890ca42750965130ddcfdf90c477edecf02a55e393248f9087","observation_id":"08872acb-0634-4d40-800e-2e2f34f65117","resolution":{"observed_at":"2026-05-21T06:54:01.045732Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2603.17839","last_updated":"2026-05-19T10:45:47Z","snapshot_observed_at":"2026-07-06T22:49:33.482934Z","submitted_at":"2026-03-18T15:31:43Z","title":"How do LLMs Compute Verbal Confidence","version":3},"cited_work":{"arxiv_id":"2603.17839","doi":"10.48550/arxiv.2603.17839","metadata_source":"pith","pith_arxiv_id":"2603.17839","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"How do LLMs Compute Verbal Confidence","venue":"cs.CL","work_id":"d459cf71-3a48-4269-bf48-cecceb09d722","year":2026},"citing_paper":{"arxiv_id":"2606.24281","last_updated":"2026-06-23T08:03:20Z","snapshot_observed_at":"2026-07-06T23:58:54.018557Z","submitted_at":"2026-06-23T08:03:20Z","title":"CALIBER: Calibrating Confidence Before and After Reasoning in Language Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-26T00:19:10.687624Z"},"links":{"cited_paper":"/paper/2603.17839","citing_paper":"/paper/2606.24281"},"observation_digest":"sha256:4cad3e9f5183e61e2269eca212f0f6989e3a3ebd9634441dfc838153c8959b06","observation_id":"ded4290c-c916-45a7-8b32-8946cfaa240c","resolution":{"observed_at":"2026-07-04T16:39:58.391902Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2603.17839","last_updated":"2026-05-19T10:45:47Z","snapshot_observed_at":"2026-07-06T22:49:33.482934Z","submitted_at":"2026-03-18T15:31:43Z","title":"How do LLMs Compute Verbal Confidence","version":3},"cited_work":{"arxiv_id":"2603.17839","doi":"10.48550/arxiv.2603.17839","metadata_source":"pith","pith_arxiv_id":"2603.17839","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"How do LLMs Compute Verbal Confidence","venue":"cs.CL","work_id":"d459cf71-3a48-4269-bf48-cecceb09d722","year":2026},"citing_paper":{"arxiv_id":"2606.29490","last_updated":"2026-06-28T16:39:18Z","snapshot_observed_at":"2026-08-04T08:09:00.632813Z","submitted_at":"2026-06-28T16:39:18Z","title":"Reported Confidence in LLMs Tracks Commitment More Than Correctness","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-30T07:44:53.539382Z"},"links":{"cited_paper":"/paper/2603.17839","citing_paper":"/paper/2606.29490"},"observation_digest":"sha256:5b4769f4c91505e4a6dfe548c7739daa25c13445d53d99c245ea28358f4a7537","observation_id":"2be82f7a-b8e1-4ce7-877e-7a3c5de4f199","resolution":{"observed_at":"2026-06-30T08:04:28.800763Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2603.17839","last_updated":"2026-05-19T10:45:47Z","snapshot_observed_at":"2026-07-06T22:49:33.482934Z","submitted_at":"2026-03-18T15:31:43Z","title":"How do LLMs Compute Verbal Confidence","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2603.17839","snapshot_observed_at":"2026-08-02T06:37:39.945125Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.12447","last_updated":"2026-07-24T07:10:23Z","snapshot_observed_at":"2026-08-04T12:28:32.750580Z","submitted_at":"2026-07-14T07:24:32Z","title":"The Computational Basis of Confidence in Large Language Models","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-02T06:37:39.945125Z"},"links":{"cited_paper":"/paper/2603.17839","citing_paper":"/paper/2607.12447"},"observation_digest":"sha256:e4dd36327d78694987b287f5422c6daada9581e342a94c9924d09919cea12a91","observation_id":"98f1e473-ae9b-4673-89ca-7236a8042990","resolution":{"observed_at":"2026-08-02T06:37:39.945125Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2603.17839","last_updated":"2026-05-19T10:45:47Z","snapshot_observed_at":"2026-07-06T22:49:33.482934Z","submitted_at":"2026-03-18T15:31:43Z","title":"How do LLMs Compute Verbal Confidence","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2603.17839","snapshot_observed_at":"2026-07-30T19:24:33.900945Z","title":"ArXiv:2603.17839 [cs]","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26845","last_updated":"2026-07-29T12:33:12Z","snapshot_observed_at":"2026-08-06T05:17:22.706159Z","submitted_at":"2026-07-29T12:33:12Z","title":"Thinking Under Uncertainty: Evidence Use and Information-Seeking in Language Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-30T19:24:33.900945Z"},"links":{"cited_paper":"/paper/2603.17839","citing_paper":"/paper/2607.26845"},"observation_digest":"sha256:8437eeceebd390dd833f939b1bfca1037971bd0407d5c8ab18c2a1bfde681b98","observation_id":"5440aae2-db78-4d44-86ed-c04233837214","resolution":{"observed_at":"2026-07-30T19:24:33.900945Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2603.17839/citation-record","integrity":"/paper/2603.17839/integrity","json":"/paper/2603.17839/citation-record.json","paper":"/paper/2603.17839"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Anthropic","venue":null,"work_id":"d3680bd0-f43e-4e3b-9d99-dd667339948c","year":2025},"citing_paper":{"arxiv_id":"2603.17839","last_updated":"2026-05-19T10:45:47Z","snapshot_observed_at":"2026-07-06T22:49:33.482934Z","submitted_at":"2026-03-18T15:31:43Z","title":"How do LLMs Compute Verbal Confidence","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-21T10:38:28.533485Z"},"links":{"citing_paper":"/paper/2603.17839"},"observation_digest":"sha256:8f0a7106a7324a212027031478de30c50f8cdfc5933c54aa181913bad3befe23","observation_id":"2071036b-effb-4c3b-9515-523b916c5904","resolution":{"observed_at":"2026-05-21T10:40:01.036734Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.13734","last_updated":"2023-10-17T09:34:30Z","snapshot_observed_at":"2026-08-01T19:59:13.992395Z","submitted_at":"2023-04-26T02:49:38Z","title":"The Internal State of an LLM Knows When It's Lying","version":2},"cited_work":{"arxiv_id":"2304.13734","doi":"10.48550/arxiv.2304.13734","metadata_source":"pith","pith_arxiv_id":"2304.13734","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"The Internal State of an LLM Knows When It's Lying","venue":"cs.CL","work_id":"82fbdded-a80a-45e6-bc43-3d4139b8cac2","year":2023},"citing_paper":{"arxiv_id":"2603.17839","last_updated":"2026-05-19T10:45:47Z","snapshot_observed_at":"2026-07-06T22:49:33.482934Z","submitted_at":"2026-03-18T15:31:43Z","title":"How do LLMs Compute Verbal Confidence","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-21T10:38:28.533485Z"},"links":{"cited_paper":"/paper/2304.13734","citing_paper":"/paper/2603.17839"},"observation_digest":"sha256:5ba0633b6e5ed14d3930204a8ccdb9a0642b93c6538f571e8151bfe5632309e9","observation_id":"d291969d-3eca-4093-a1d0-3903786e1bcf","resolution":{"observed_at":"2026-05-21T10:40:00.625982Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-18T08:21:02.827078+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-18T08:21:02.827078+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"cited_work":{"arxiv_id":"2212.03827","doi":"10.48550/arxiv.2212.03827","metadata_source":"pith","pith_arxiv_id":"2212.03827","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","venue":"cs.CL","work_id":"a12b68bd-76a4-4837-ac7c-3ed5a60010d3","year":2022},"citing_paper":{"arxiv_id":"2603.17839","last_updated":"2026-05-19T10:45:47Z","snapshot_observed_at":"2026-07-06T22:49:33.482934Z","submitted_at":"2026-03-18T15:31:43Z","title":"How do LLMs Compute Verbal Confidence","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-21T10:38:28.533485Z"},"links":{"cited_paper":"/paper/2212.03827","citing_paper":"/paper/2603.17839"},"observation_digest":"sha256:b4622406cab252966555b1df09e802f6b81e0b284f3c0030537373d4d5045856","observation_id":"d64fab97-26cc-4a83-84bc-4d05345c50ef","resolution":{"observed_at":"2026-05-21T10:40:00.611725Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.10409","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-02T12:56:57.484932Z","title":"Trace length is a simple un- certainty signal in reasoning models.arXiv preprint arXiv:2510.10409","venue":null,"work_id":"32332084-8548-494f-ba04-2fef3a019e71","year":2025},"citing_paper":{"arxiv_id":"2603.17839","last_updated":"2026-05-19T10:45:47Z","snapshot_observed_at":"2026-07-06T22:49:33.482934Z","submitted_at":"2026-03-18T15:31:43Z","title":"How do LLMs Compute Verbal Confidence","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-21T10:38:28.533485Z"},"links":{"citing_paper":"/paper/2603.17839"},"observation_digest":"sha256:be2e3cb0788d4a145d651c1de16dae92ba39bdd5b990c1072aa4767432f5912d","observation_id":"ca5e39d1-085f-4f68-b494-aef04b538cff","resolution":{"observed_at":"2026-05-21T10:40:00.629780Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.08298","last_updated":"2024-03-25T06:01:49Z","snapshot_observed_at":"2026-08-02T14:28:48.623733Z","submitted_at":"2023-11-14T16:43:29Z","title":"A Survey of Confidence Estimation and Calibration in Large Language Models","version":2},"cited_work":{"arxiv_id":"2311.08298","doi":null,"metadata_source":"pith","pith_arxiv_id":"2311.08298","snapshot_observed_at":"2026-07-10T00:56:40.914419Z","title":"A survey of language model confidence esti- mation and calibration.arXiv preprint arXiv:2311.08298","venue":"cs.CL","work_id":"1a999ed9-8dc5-4b88-b33f-adad9e2e5be5","year":2023},"citing_paper":{"arxiv_id":"2603.17839","last_updated":"2026-05-19T10:45:47Z","snapshot_observed_at":"2026-07-06T22:49:33.482934Z","submitted_at":"2026-03-18T15:31:43Z","title":"How do LLMs Compute Verbal Confidence","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-21T10:38:28.533485Z"},"links":{"cited_paper":"/paper/2311.08298","citing_paper":"/paper/2603.17839"},"observation_digest":"sha256:c0eff338a152bb3ab6c46e0611c5338e49fcd9bd9bcf1ebcefeac40a63537e04","observation_id":"978a1163-3b6b-4158-87b3-e9c28d4fdfa3","resolution":{"observed_at":"2026-05-21T10:40:00.622154Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.14767","last_updated":"2023-10-13T19:01:20Z","snapshot_observed_at":"2026-08-06T20:03:14.316115Z","submitted_at":"2023-04-28T11:26:17Z","title":"Dissecting Recall of Factual Associations in Auto-Regressive Language Models","version":3},"cited_work":{"arxiv_id":"2304.14767","doi":"10.48550/arxiv.2304.14767","metadata_source":"arxiv_reference","pith_arxiv_id":"2304.14767","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2304.14767 , year=","venue":"arXiv (Cornell University)","work_id":"3aae46e3-10ef-496e-a8cf-92dc115dc8a5","year":2024},"citing_paper":{"arxiv_id":"2603.17839","last_updated":"2026-05-19T10:45:47Z","snapshot_observed_at":"2026-07-06T22:49:33.482934Z","submitted_at":"2026-03-18T15:31:43Z","title":"How do LLMs Compute Verbal Confidence","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-21T10:38:28.533485Z"},"links":{"cited_paper":"/paper/2304.14767","citing_paper":"/paper/2603.17839"},"observation_digest":"sha256:9a66f2be500089187f0967daeff69d289823bbda2530b1539fb65a4bad288586","observation_id":"ee1770bc-8d1b-4947-b9cb-4488a8f09bd7","resolution":{"observed_at":"2026-05-21T10:40:00.615877Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.15255","last_updated":"2024-04-23T17:42:29Z","snapshot_observed_at":"2026-07-31T21:25:53.647335Z","submitted_at":"2024-04-23T17:42:29Z","title":"How to use and interpret activation patching","version":1},"cited_work":{"arxiv_id":"2404.15255","doi":"10.48550/arxiv.2404.15255","metadata_source":"pith","pith_arxiv_id":"2404.15255","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"How to use and interpret activation patching","venue":"cs.LG","work_id":"b99c4234-c7d8-45fc-99bf-6b3b086e9c64","year":2024},"citing_paper":{"arxiv_id":"2603.17839","last_updated":"2026-05-19T10:45:47Z","snapshot_observed_at":"2026-07-06T22:49:33.482934Z","submitted_at":"2026-03-18T15:31:43Z","title":"How do LLMs Compute Verbal Confidence","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-21T10:38:28.533485Z"},"links":{"cited_paper":"/paper/2404.15255","citing_paper":"/paper/2603.17839"},"observation_digest":"sha256:2ed44725b66921e5fc6700be9b909906f3be7dce7d76942b642f350e5b8e505f","observation_id":"43822381-f42d-4b53-9996-33fc130ef8ed","resolution":{"observed_at":"2026-05-21T10:40:00.618738Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.20487","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-01T07:55:31.586939Z","title":"arXiv preprint arXiv:2510.20487 , year =","venue":null,"work_id":"daeb53de-3885-41f2-9d76-ea0b6900661e","year":2025},"citing_paper":{"arxiv_id":"2603.17839","last_updated":"2026-05-19T10:45:47Z","snapshot_observed_at":"2026-07-06T22:49:33.482934Z","submitted_at":"2026-03-18T15:31:43Z","title":"How do LLMs Compute Verbal Confidence","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-21T10:38:28.533485Z"},"links":{"citing_paper":"/paper/2603.17839"},"observation_digest":"sha256:56e6f9586826ade4fc44b9dbbd97010625d8289b8cff993262facdf5addb2a5d","observation_id":"f9a67b9d-08e2-4efb-b1d7-2a7999e578d5","resolution":{"observed_at":"2026-05-21T10:40:00.633194Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1705.03551","last_updated":"2017-05-13T21:12:37Z","snapshot_observed_at":"2026-08-02T11:13:42.401488Z","submitted_at":"2017-05-09T21:35:07Z","title":"TriviaQA: A Large Scale Distantly Supervised Challenge Dataset for Reading Comprehension","version":2},"cited_work":{"arxiv_id":"1705.03551","doi":"10.48550/arxiv.1705.03551","metadata_source":"pith","pith_arxiv_id":"1705.03551","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"TriviaQA: A Large Scale Distantly Supervised Challenge Dataset for Reading Comprehension","venue":"cs.CL","work_id":"f20e62ba-6265-4b97-aa8c-ddefaf2f5762","year":2017},"citing_paper":{"arxiv_id":"2603.17839","last_updated":"2026-05-19T10:45:47Z","snapshot_observed_at":"2026-07-06T22:49:33.482934Z","submitted_at":"2026-03-18T15:31:43Z","title":"How do LLMs Compute Verbal Confidence","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-21T10:38:28.533485Z"},"links":{"cited_paper":"/paper/1705.03551","citing_paper":"/paper/2603.17839"},"observation_digest":"sha256:aa973a072168dc63d0b2cde5aa3bdd48b08ed94df8b605e5232360b1fd78d57a","observation_id":"5b0350cc-9965-4152-b816-eeaaf29d7aae","resolution":{"observed_at":"2026-05-21T10:40:00.545582Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.05221","last_updated":"2022-11-21T16:38:35Z","snapshot_observed_at":"2026-08-06T08:34:11.887259Z","submitted_at":"2022-07-11T22:59:39Z","title":"Language Models (Mostly) Know What They Know","version":4},"cited_work":{"arxiv_id":"2207.05221","doi":"10.1145/3618260.3649777","metadata_source":"pith","pith_arxiv_id":"2207.05221","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Language Models (Mostly) Know What They Know","venue":"cs.CL","work_id":"8ca58a10-da41-4f70-baae-7e449512e345","year":2022},"citing_paper":{"arxiv_id":"2603.17839","last_updated":"2026-05-19T10:45:47Z","snapshot_observed_at":"2026-07-06T22:49:33.482934Z","submitted_at":"2026-03-18T15:31:43Z","title":"How do LLMs Compute Verbal Confidence","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-21T10:38:28.533485Z"},"links":{"cited_paper":"/paper/2207.05221","citing_paper":"/paper/2603.17839"},"observation_digest":"sha256:50a8cc36f0dea25090533206e925f14d5741864263e2403dc4ab88c7f3e6d57c","observation_id":"713ddb4c-558b-47cc-8bbd-9220b569bbf0","resolution":{"observed_at":"2026-05-21T10:40:00.541936Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-05-21T07:53:13.382372+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T07:53:13.382372+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.04013","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-02T01:46:26.404146Z","title":"Liu, J., Jain, J., Diab, M., and Subramani, N","venue":null,"work_id":"ef8a5e75-2ec7-4784-b7b7-954f7d433170","year":2025},"citing_paper":{"arxiv_id":"2603.17839","last_updated":"2026-05-19T10:45:47Z","snapshot_observed_at":"2026-07-06T22:49:33.482934Z","submitted_at":"2026-03-18T15:31:43Z","title":"How do LLMs Compute Verbal Confidence","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-21T10:38:28.533485Z"},"links":{"citing_paper":"/paper/2603.17839"},"observation_digest":"sha256:b5239289d7f5d69b1d2478de6a2eeb6b7e00441a717f21c6720f0643dd788d61","observation_id":"e3685beb-482a-4ea2-82da-32eda5d7a4d8","resolution":{"observed_at":"2026-05-21T10:40:00.589501Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.18183","last_updated":"2025-07-18T02:39:29Z","snapshot_observed_at":"2026-07-06T21:46:02.163343Z","submitted_at":"2025-06-22T21:46:42Z","title":"Reasoning about Uncertainty: Do Reasoning Models Know When They Don't Know?","version":3},"cited_work":{"arxiv_id":"2506.18183","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.18183","snapshot_observed_at":"2026-07-03T15:18:33.036767Z","title":"Reasoning about uncertainty: Do reason- ing models know when they don’t know?arXiv preprint arXiv:2506.18183","venue":null,"work_id":"3d0a4c9d-f7eb-4ab5-adf1-545aca207535","year":2025},"citing_paper":{"arxiv_id":"2603.17839","last_updated":"2026-05-19T10:45:47Z","snapshot_observed_at":"2026-07-06T22:49:33.482934Z","submitted_at":"2026-03-18T15:31:43Z","title":"How do LLMs Compute Verbal Confidence","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-21T10:38:28.533485Z"},"links":{"cited_paper":"/paper/2506.18183","citing_paper":"/paper/2603.17839"},"observation_digest":"sha256:d66a659d84cc4e9ef493b9032317cf3ecba44b78a7d5bd358fd57f4906ad4ce8","observation_id":"2a7e6c72-cb4d-4321-8423-576de713d3e0","resolution":{"observed_at":"2026-05-21T10:40:00.608508Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06681","last_updated":"2024-07-05T15:30:45Z","snapshot_observed_at":"2026-08-06T00:58:30.657180Z","submitted_at":"2023-12-09T04:40:46Z","title":"Steering Llama 2 via Contrastive Activation Addition","version":4},"cited_work":{"arxiv_id":"2312.06681","doi":"10.48550/arxiv.2312.06681","metadata_source":"pith","pith_arxiv_id":"2312.06681","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Steering Llama 2 via Contrastive Activation Addition","venue":"cs.CL","work_id":"3317feaa-e788-45fc-95aa-4ea20028b55b","year":2023},"citing_paper":{"arxiv_id":"2603.17839","last_updated":"2026-05-19T10:45:47Z","snapshot_observed_at":"2026-07-06T22:49:33.482934Z","submitted_at":"2026-03-18T15:31:43Z","title":"How do LLMs Compute Verbal Confidence","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-21T10:38:28.533485Z"},"links":{"cited_paper":"/paper/2312.06681","citing_paper":"/paper/2603.17839"},"observation_digest":"sha256:ce55c31b5527e807d2e0e96509352e720c19779a6d54368a8dc69629abab706e","observation_id":"91505d07-510c-45a2-b16d-47e4c7da2b3f","resolution":{"observed_at":"2026-05-21T10:40:00.549257Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-18T08:21:04.515131+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-18T08:21:04.515131+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2407.02646","doi":"10.48550/arxiv.2407.02646","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"A practical review of mechanistic interpretability for transformer-based language models.arXiv preprint arXiv:2407.02646","venue":"arXiv (Cornell University)","work_id":"9ea13e38-e81d-40a9-a461-6b3db3a5550e","year":2025},"citing_paper":{"arxiv_id":"2603.17839","last_updated":"2026-05-19T10:45:47Z","snapshot_observed_at":"2026-07-06T22:49:33.482934Z","submitted_at":"2026-03-18T15:31:43Z","title":"How do LLMs Compute Verbal Confidence","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-21T10:38:28.533485Z"},"links":{"citing_paper":"/paper/2603.17839"},"observation_digest":"sha256:84d9fa835cb17d65a8a1c99600ec648e01cb4cf1bcb05b7fe060e52ac52fd0dd","observation_id":"750c528e-5565-4b2c-82cd-78c5421b8f5e","resolution":{"observed_at":"2026-05-21T10:40:00.600898Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-06-01T22:57:53.426653+00:00","source":"crossref_status_cache"},{"observed_at":"2026-06-01T22:57:53.426653+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2510.05126","last_updated":"2026-06-18T21:02:47Z","snapshot_observed_at":"2026-08-04T13:32:25.158141Z","submitted_at":"2025-09-30T19:50:02Z","title":"Generalization of Fine-Tuned Uncertainty Communication and Metacognition in Large Language Models","version":3},"cited_work":{"arxiv_id":"2510.05126","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2510.05126","snapshot_observed_at":"2026-06-23T02:11:58.848996Z","title":"Improving metacog- nition and uncertainty communication in language mod- els.arXiv preprint arXiv:2510.05126, 2025a","venue":null,"work_id":"4ea62fae-9357-4cc7-ad44-625d983a5356","year":2025},"citing_paper":{"arxiv_id":"2603.17839","last_updated":"2026-05-19T10:45:47Z","snapshot_observed_at":"2026-07-06T22:49:33.482934Z","submitted_at":"2026-03-18T15:31:43Z","title":"How do LLMs Compute Verbal Confidence","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-21T10:38:28.533485Z"},"links":{"cited_paper":"/paper/2510.05126","citing_paper":"/paper/2603.17839"},"observation_digest":"sha256:f97a7155b883fb72c247039c70b1ac7844e00614c2951b75f967292f0b03febf","observation_id":"bd53ed0b-2a70-46e9-be04-93410ef94825","resolution":{"observed_at":"2026-06-23T02:11:58.848996Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14975","last_updated":"2023-10-24T04:27:42Z","snapshot_observed_at":"2026-07-06T15:32:25.931739Z","submitted_at":"2023-05-24T10:12:33Z","title":"Just Ask for Calibration: Strategies for Eliciting Calibrated Confidence Scores from Language Models Fine-Tuned with Human Feedback","version":2},"cited_work":{"arxiv_id":"2305.14975","doi":null,"metadata_source":"pith","pith_arxiv_id":"2305.14975","snapshot_observed_at":"2026-07-08T10:04:51.524003Z","title":"Manning, and Chelsea Finn","venue":"cs.CL","work_id":"8617eae9-ad9f-45e0-bb23-49df5b429be6","year":2023},"citing_paper":{"arxiv_id":"2603.17839","last_updated":"2026-05-19T10:45:47Z","snapshot_observed_at":"2026-07-06T22:49:33.482934Z","submitted_at":"2026-03-18T15:31:43Z","title":"How do LLMs Compute Verbal Confidence","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-21T10:38:28.533485Z"},"links":{"cited_paper":"/paper/2305.14975","citing_paper":"/paper/2603.17839"},"observation_digest":"sha256:861fd5c73a6d6a085ed2ae88733c074e07ac89d158d8bce36059d016f0b90cb0","observation_id":"e571b856-0a57-4b15-bfc3-fc1a4353dd58","resolution":{"observed_at":"2026-05-21T10:40:00.577255Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.10248","last_updated":"2024-10-10T13:20:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-20T12:21:05Z","title":"Steering Language Models With Activation Engineering","version":5},"cited_work":{"arxiv_id":"2308.10248","doi":"10.18653/v1/2024.findings-acl.611","metadata_source":"pith","pith_arxiv_id":"2308.10248","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Steering Language Models With Activation Engineering","venue":"cs.CL","work_id":"d525fe06-5560-4e97-86fc-7a0e551f5b17","year":2023},"citing_paper":{"arxiv_id":"2603.17839","last_updated":"2026-05-19T10:45:47Z","snapshot_observed_at":"2026-07-06T22:49:33.482934Z","submitted_at":"2026-03-18T15:31:43Z","title":"How do LLMs Compute Verbal Confidence","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-21T10:38:28.533485Z"},"links":{"cited_paper":"/paper/2308.10248","citing_paper":"/paper/2603.17839"},"observation_digest":"sha256:6383ff543e2cbfafe27c7e1bd4d096ee1a93d207aa9adedb9c8852b58719c2ee","observation_id":"67eb0537-02dc-4c9c-93d3-cb0fc4e758fe","resolution":{"observed_at":"2026-05-21T10:40:00.604683Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.03987","last_updated":"2023-08-12T14:57:37Z","snapshot_observed_at":"2026-08-04T09:02:49.602701Z","submitted_at":"2023-07-08T14:25:57Z","title":"A Stitch in Time Saves Nine: Detecting and Mitigating Hallucinations of LLMs by Validating Low-Confidence Generation","version":2},"cited_work":{"arxiv_id":"2307.03987","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2307.03987","snapshot_observed_at":"2026-07-02T07:26:46.313156Z","title":"arXiv preprint arXiv:2307.03987 (2023)","venue":null,"work_id":"ed2401c9-d6cb-44af-8ff9-07841e73e642","year":2023},"citing_paper":{"arxiv_id":"2603.17839","last_updated":"2026-05-19T10:45:47Z","snapshot_observed_at":"2026-07-06T22:49:33.482934Z","submitted_at":"2026-03-18T15:31:43Z","title":"How do LLMs Compute Verbal Confidence","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-21T10:38:28.533485Z"},"links":{"cited_paper":"/paper/2307.03987","citing_paper":"/paper/2603.17839"},"observation_digest":"sha256:d3e8fd2fdebed59b07c94fb12f93d1d8b9752470c9bf25a466c30d94cc036c4c","observation_id":"8f6a15ae-07e4-4c1a-acb0-6a4def1411cd","resolution":{"observed_at":"2026-05-21T10:40:00.596553Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2510.07364","last_updated":"2026-07-07T14:19:58Z","snapshot_observed_at":"2026-08-04T11:02:17.680858Z","submitted_at":"2025-10-08T17:58:28Z","title":"Base Models Know How to Reason, Thinking Models Learn When","version":4},"cited_work":{"arxiv_id":"2510.07364","doi":"10.48550/arxiv.2510.07364","metadata_source":"arxiv_reference","pith_arxiv_id":"2510.07364","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Base models know how to reason, thinking models learn when.arXiv preprint arXiv:2510.07364","venue":"Oxford University Research Archive (ORA) (University of Oxford)","work_id":"6b8f6f1f-0a24-48c7-af58-4a4206730999","year":2025},"citing_paper":{"arxiv_id":"2603.17839","last_updated":"2026-05-19T10:45:47Z","snapshot_observed_at":"2026-07-06T22:49:33.482934Z","submitted_at":"2026-03-18T15:31:43Z","title":"How do LLMs Compute Verbal Confidence","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-21T10:38:28.533485Z"},"links":{"cited_paper":"/paper/2510.07364","citing_paper":"/paper/2603.17839"},"observation_digest":"sha256:af15b85b39c4c98b6f0435d616224c553a0d3bb17f37b93afa6d126b38e86624","observation_id":"7f4f41c3-ab0d-4596-85b5-9238bc1bff32","resolution":{"observed_at":"2026-07-08T02:18:39.926237Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-05-23T16:25:06.757576+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T16:25:06.757576+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.13063","last_updated":"2024-03-17T04:38:48Z","snapshot_observed_at":"2026-07-06T15:45:39.649725Z","submitted_at":"2023-06-22T17:31:44Z","title":"Can LLMs Express Their Uncertainty? An Empirical Evaluation of Confidence Elicitation in LLMs","version":2},"cited_work":{"arxiv_id":"2306.13063","doi":"10.48550/arxiv.2306.13063","metadata_source":"pith","pith_arxiv_id":"2306.13063","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Can LLMs Express Their Uncertainty? An Empirical Evaluation of Confidence Elicitation in LLMs","venue":"cs.CL","work_id":"7c5c5f6d-fd68-4f65-ac05-5d90308e8bc2","year":2023},"citing_paper":{"arxiv_id":"2603.17839","last_updated":"2026-05-19T10:45:47Z","snapshot_observed_at":"2026-07-06T22:49:33.482934Z","submitted_at":"2026-03-18T15:31:43Z","title":"How do LLMs Compute Verbal Confidence","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-21T10:38:28.533485Z"},"links":{"cited_paper":"/paper/2306.13063","citing_paper":"/paper/2603.17839"},"observation_digest":"sha256:899ffef87790a5300718089015fb83d72b41e33d482bc3394ce7800557544c57","observation_id":"f2317251-b46c-4673-939f-1e3c263a893d","resolution":{"observed_at":"2026-05-21T10:40:00.556530Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-18T08:21:07.82596+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-18T08:21:07.82596+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2505.14489","doi":"10.48550/arxiv.2505.14489","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Reasoning models better express their confidence.arXiv preprint arXiv:2505.14489","venue":"ArXiv.org","work_id":"7055336d-2fa7-4e3b-a4f9-0f72883c2e74","year":2025},"citing_paper":{"arxiv_id":"2603.17839","last_updated":"2026-05-19T10:45:47Z","snapshot_observed_at":"2026-07-06T22:49:33.482934Z","submitted_at":"2026-03-18T15:31:43Z","title":"How do LLMs Compute Verbal Confidence","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-21T10:38:28.533485Z"},"links":{"citing_paper":"/paper/2603.17839"},"observation_digest":"sha256:72036863910afc5ff9f4c3ccf36443cfef1c3eac2daa42c42c2a22a0bd3bc295","observation_id":"576d8437-c0e4-41f9-a7b7-e7f87ac062ff","resolution":{"observed_at":"2026-05-21T10:40:00.553191Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-05-23T16:25:12.133521+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T16:25:12.133521+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16042","last_updated":"2024-01-17T04:07:06Z","snapshot_observed_at":"2026-07-06T16:24:38.375055Z","submitted_at":"2023-09-27T21:53:56Z","title":"Towards Best Practices of Activation Patching in Language Models: Metrics and Methods","version":2},"cited_work":{"arxiv_id":"2309.16042","doi":"10.48550/arxiv.2309.16042","metadata_source":"pith","pith_arxiv_id":"2309.16042","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Towards Best Practices of Activation Patching in Language Models: Metrics and Methods","venue":"cs.LG","work_id":"eead806e-b03c-49ee-91d8-a5f737969604","year":2023},"citing_paper":{"arxiv_id":"2603.17839","last_updated":"2026-05-19T10:45:47Z","snapshot_observed_at":"2026-07-06T22:49:33.482934Z","submitted_at":"2026-03-18T15:31:43Z","title":"How do LLMs Compute Verbal Confidence","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-21T10:38:28.533485Z"},"links":{"cited_paper":"/paper/2309.16042","citing_paper":"/paper/2603.17839"},"observation_digest":"sha256:5c0c13d2773e3c9af3465ca3ebf0047ec8b38688a897488190215d94a90a3294","observation_id":"614b9f79-9a84-4afe-911f-0318a4031e04","resolution":{"observed_at":"2026-05-21T10:40:00.592797Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Almost certain","venue":null,"work_id":"cdf557d9-3bb6-4b58-91c6-02df079a52c2","year":2016},"citing_paper":{"arxiv_id":"2603.17839","last_updated":"2026-05-19T10:45:47Z","snapshot_observed_at":"2026-07-06T22:49:33.482934Z","submitted_at":"2026-03-18T15:31:43Z","title":"How do LLMs Compute Verbal Confidence","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-21T10:38:28.533485Z"},"links":{"citing_paper":"/paper/2603.17839"},"observation_digest":"sha256:aaeddf3a026c7037c54d28ac9a2321f754c4428f12a12a4df2c8ed67e83ea904","observation_id":"804c98de-4109-43b9-9d3a-3a2768db66a0","resolution":{"observed_at":"2026-05-21T10:40:01.034622Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The model’s performance was 77.4%; this was determined by having GPT4o-mini mark questions (B) Distribution of Gemma’s confidence responses across the 10 classes","venue":null,"work_id":"c6e0b540-acb7-4e4a-a88c-c1e64a15ff0c","year":2017},"citing_paper":{"arxiv_id":"2603.17839","last_updated":"2026-05-19T10:45:47Z","snapshot_observed_at":"2026-07-06T22:49:33.482934Z","submitted_at":"2026-03-18T15:31:43Z","title":"How do LLMs Compute Verbal Confidence","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-21T10:38:28.533485Z"},"links":{"citing_paper":"/paper/2603.17839"},"observation_digest":"sha256:8546a34ef79b48f51c7618773bdfb3df27e2f0af3e755fa702d5200842a7c4b7","observation_id":"05d8ca97-384e-4cc2-ae1b-daaa9e29639a","resolution":{"observed_at":"2026-05-21T10:40:01.032617Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"20 How do LLMs Compute Verbal Confidence? Figure 15.Calibration and Distribution of Categorical Confidence Ratings in Qwen 2.5 7b","venue":null,"work_id":"0417e5eb-8d73-422d-b987-a4976f4d21c4","year":2017},"citing_paper":{"arxiv_id":"2603.17839","last_updated":"2026-05-19T10:45:47Z","snapshot_observed_at":"2026-07-06T22:49:33.482934Z","submitted_at":"2026-03-18T15:31:43Z","title":"How do LLMs Compute Verbal Confidence","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-21T10:38:28.533485Z"},"links":{"citing_paper":"/paper/2603.17839"},"observation_digest":"sha256:9260d23f7846cde87e454cb6ec33f2691870db09d0a6bacd93744f8a2ffe9fc7","observation_id":"cb8dd214-f650-4fe3-a512-b64dd825c513","resolution":{"observed_at":"2026-05-21T10:40:01.030450Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Almost certain","venue":null,"work_id":"74cab584-3d71-45e1-91d9-f84b2e858325","year":2023},"citing_paper":{"arxiv_id":"2603.17839","last_updated":"2026-05-19T10:45:47Z","snapshot_observed_at":"2026-07-06T22:49:33.482934Z","submitted_at":"2026-03-18T15:31:43Z","title":"How do LLMs Compute Verbal Confidence","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-21T10:38:28.533485Z"},"links":{"citing_paper":"/paper/2603.17839"},"observation_digest":"sha256:996b9c5844b49bb59fbb4299067a0d3c62e527e6257954b164171477f7cb3202","observation_id":"90194fb4-a870-4988-8bf2-392f4eb57367","resolution":{"observed_at":"2026-05-21T10:40:01.028082Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"e4d4ccfa-6c5c-46cc-8fd7-b7905f492be8","year":2022},"citing_paper":{"arxiv_id":"2603.17839","last_updated":"2026-05-19T10:45:47Z","snapshot_observed_at":"2026-07-06T22:49:33.482934Z","submitted_at":"2026-03-18T15:31:43Z","title":"How do LLMs Compute Verbal Confidence","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-21T10:38:28.533485Z"},"links":{"citing_paper":"/paper/2603.17839"},"observation_digest":"sha256:758ac703897b0363b86cddb9bf3cd3b51970d4511b8bad7e5c82de9d397829fc","observation_id":"be8370be-8779-434d-b185-262064d09d91","resolution":{"observed_at":"2026-05-21T10:40:01.025444Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Highly likely","venue":null,"work_id":"9f9f5a67-7a43-4d7a-a0e5-8fa44b383f66","year":2023},"citing_paper":{"arxiv_id":"2603.17839","last_updated":"2026-05-19T10:45:47Z","snapshot_observed_at":"2026-07-06T22:49:33.482934Z","submitted_at":"2026-03-18T15:31:43Z","title":"How do LLMs Compute Verbal Confidence","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-21T10:38:28.533485Z"},"links":{"citing_paper":"/paper/2603.17839"},"observation_digest":"sha256:95d3392ebc007527ff25156bf9559e35c7c6bd4690419df0f7a12f795e7f8e02","observation_id":"1632c308-2542-4453-9dc3-54f027f3d327","resolution":{"observed_at":"2026-05-21T10:40:01.020838Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Logprobs explained only 4.9% of variance in within-run verbal con- fidence (r= 0.23 , R2 CV = 0.049 ) and 8.4% in cross-run verbal confidence (r= 0.29 , R2 CV = 0.084)","venue":null,"work_id":"43cc0e62-f563-488a-a53c-37a7942cc4b6","year":2023},"citing_paper":{"arxiv_id":"2603.17839","last_updated":"2026-05-19T10:45:47Z","snapshot_observed_at":"2026-07-06T22:49:33.482934Z","submitted_at":"2026-03-18T15:31:43Z","title":"How do LLMs Compute Verbal Confidence","version":3},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-21T10:38:28.533485Z"},"links":{"citing_paper":"/paper/2603.17839"},"observation_digest":"sha256:885f15e28c7a72d75c12c68656b40c9103f3f5a07e36d46034569c92c401f532","observation_id":"7547dc66-51ad-4a03-aa15-dea2275643ee","resolution":{"observed_at":"2026-05-21T10:40:01.023150Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2603.17839","last_updated":"2026-05-19T10:45:47Z","latest_version":3,"primary_category":"cs.CL","snapshot_observed_at":"2026-07-06T22:49:33.482934Z","submitted_at":"2026-03-18T15:31:43Z","title":"How do LLMs Compute Verbal Confidence"},"reference_resolution":{"displayed":29,"state_counts":{"malformed_identifier":1,"metadata_mismatch":4,"parse_uncertain":0,"unresolved":1,"verified_exact":17,"verified_fuzzy":6},"total_outbound_references":29},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 29 of 29 outbound references and 11 inbound Pith citation observations for arXiv:2603.17839."}