{"as_of":"2026-08-06T18:03:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:97d7c0d98cdcb084e0828f19a2ccae95ad83935f82c269297de01caa48f7f8fe","coverage":[{"denominator":35,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":35,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-08T12:30:51.094216Z","state":"measured"},{"denominator":37,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":37,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T19:59:11.740772Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"pith","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"pith"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2604.22271","last_updated":"2026-05-01T09:11:21Z","snapshot_observed_at":"2026-07-06T23:08:42.301487Z","submitted_at":"2026-04-24T06:33:32Z","title":"How LLMs Detect and Correct Their Own Errors: The Role of Internal Confidence Signals","version":2},"cited_work":{"arxiv_id":"2604.22271","doi":"10.48550/arxiv.2604.22271","metadata_source":"pith","pith_arxiv_id":"2604.22271","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"How LLMs Detect and Correct Their Own Errors: The Role of Internal Confidence Signals","venue":"cs.LG","work_id":"f4333680-17f1-4951-8a76-7760d0b7c7eb","year":2026},"citing_paper":{"arxiv_id":"2605.05851","last_updated":"2026-05-07T08:24:54Z","snapshot_observed_at":"2026-08-04T15:23:48.540297Z","submitted_at":"2026-05-07T08:24:54Z","title":"Hypothesis generation and updating in large language models","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-05-08T14:43:56.125546Z"},"links":{"cited_paper":"/paper/2604.22271","citing_paper":"/paper/2605.05851"},"observation_digest":"sha256:bf4efcf96ea584e0fe7f854ca436cf6aa78608eee6ebc8c5d7b9aed1ba3eea38","observation_id":"ec7c6509-430e-4217-b21b-499937208c35","resolution":{"observed_at":"2026-05-08T21:14:12.052674Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.22271","last_updated":"2026-05-01T09:11:21Z","snapshot_observed_at":"2026-07-06T23:08:42.301487Z","submitted_at":"2026-04-24T06:33:32Z","title":"How LLMs Detect and Correct Their Own Errors: The Role of Internal Confidence Signals","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.22271","snapshot_observed_at":"2026-08-01T19:59:11.740772Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.16799","last_updated":"2026-07-18T12:45:49Z","snapshot_observed_at":"2026-08-01T19:59:06.207627Z","submitted_at":"2026-07-18T12:45:49Z","title":"Diagnosing Correctness Probes under Self-Judgement Confounding","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-01T19:59:11.740772Z"},"links":{"cited_paper":"/paper/2604.22271","citing_paper":"/paper/2607.16799"},"observation_digest":"sha256:ee804a2074ceb247c468e88dc3ec49d3ac076745a5a2309b88ce2c7d2fa4068e","observation_id":"55f25a3a-6841-45be-b006-c53636a7cf37","resolution":{"observed_at":"2026-08-01T19:59:11.740772Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2604.22271/citation-record","integrity":"/paper/2604.22271/integrity","json":"/paper/2604.22271/citation-record.json","paper":"/paper/2604.22271"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2304.13734","last_updated":"2023-10-17T09:34:30Z","snapshot_observed_at":"2026-08-01T19:59:13.992395Z","submitted_at":"2023-04-26T02:49:38Z","title":"The Internal State of an LLM Knows When It's Lying","version":2},"cited_work":{"arxiv_id":"2304.13734","doi":"10.48550/arxiv.2304.13734","metadata_source":"pith","pith_arxiv_id":"2304.13734","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"The Internal State of an LLM Knows When It's Lying","venue":"cs.CL","work_id":"82fbdded-a80a-45e6-bc43-3d4139b8cac2","year":2023},"citing_paper":{"arxiv_id":"2604.22271","last_updated":"2026-05-01T09:11:21Z","snapshot_observed_at":"2026-07-06T23:08:42.301487Z","submitted_at":"2026-04-24T06:33:32Z","title":"How LLMs Detect and Correct Their Own Errors: The Role of Internal Confidence Signals","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-08T12:30:51.094216Z"},"links":{"cited_paper":"/paper/2304.13734","citing_paper":"/paper/2604.22271"},"observation_digest":"sha256:5fcf4807d1b2ae396f4d9c683f642108c3ce19c10268cc2f68103e02b2bc96df","observation_id":"9b25bb24-354a-4658-9610-2ca325bcbef9","resolution":{"observed_at":"2026-05-16T00:08:36.671090Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-18T08:21:02.827078+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-18T08:21:02.827078+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The validation gap: A mechanistic analysis of how language models compute arithmetic but fail to validate it","venue":null,"work_id":"0280c2fd-df64-4f8b-9fa8-890f2a9e9294","year":2025},"citing_paper":{"arxiv_id":"2604.22271","last_updated":"2026-05-01T09:11:21Z","snapshot_observed_at":"2026-07-06T23:08:42.301487Z","submitted_at":"2026-04-24T06:33:32Z","title":"How LLMs Detect and Correct Their Own Errors: The Role of Internal Confidence Signals","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-08T12:30:51.094216Z"},"links":{"citing_paper":"/paper/2604.22271"},"observation_digest":"sha256:07b83b83bc3e62e23a975ea03c8ca23f5071d46893168bcc75f06d8649ef6ad3","observation_id":"5030ba2f-b66d-46a8-9596-3dd811c441e9","resolution":{"observed_at":"2026-05-26T13:17:48.402329Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"cited_work":{"arxiv_id":"2212.03827","doi":"10.48550/arxiv.2212.03827","metadata_source":"pith","pith_arxiv_id":"2212.03827","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","venue":"cs.CL","work_id":"a12b68bd-76a4-4837-ac7c-3ed5a60010d3","year":2022},"citing_paper":{"arxiv_id":"2604.22271","last_updated":"2026-05-01T09:11:21Z","snapshot_observed_at":"2026-07-06T23:08:42.301487Z","submitted_at":"2026-04-24T06:33:32Z","title":"How LLMs Detect and Correct Their Own Errors: The Role of Internal Confidence Signals","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-08T12:30:51.094216Z"},"links":{"cited_paper":"/paper/2212.03827","citing_paper":"/paper/2604.22271"},"observation_digest":"sha256:7b3295c78bea6b789ba83d770d34c266352aa57b642b0d4542466604e5d669a1","observation_id":"20783210-ed4f-436e-a807-f47148b73a8c","resolution":{"observed_at":"2026-05-15T20:34:08.372263Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2501.19306","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Sets: Leveraging self-verification and self-correction for improved test-time scaling","venue":null,"work_id":"23e1617a-5af3-4967-a9f6-df2c08ecae67","year":2025},"citing_paper":{"arxiv_id":"2604.22271","last_updated":"2026-05-01T09:11:21Z","snapshot_observed_at":"2026-07-06T23:08:42.301487Z","submitted_at":"2026-04-24T06:33:32Z","title":"How LLMs Detect and Correct Their Own Errors: The Role of Internal Confidence Signals","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-08T12:30:51.094216Z"},"links":{"citing_paper":"/paper/2604.22271"},"observation_digest":"sha256:fcd71039cce3f27c42ff07aff00b0edf98ccd4a6ea255feb7e3a1f01e3c992c5","observation_id":"e43b8788-a9de-4ca4-b935-f563d28f1586","resolution":{"observed_at":"2026-05-11T19:16:06.866730Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01307","last_updated":"2025-08-15T15:21:46Z","snapshot_observed_at":"2026-07-06T20:45:32.493589Z","submitted_at":"2025-03-03T08:46:22Z","title":"Cognitive Behaviors that Enable Self-Improving Reasoners, or, Four Habits of Highly Effective STaRs","version":2},"cited_work":{"arxiv_id":"2503.01307","doi":"10.48550/arxiv.2503.01307","metadata_source":"pith","pith_arxiv_id":"2503.01307","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Cognitive Behaviors that Enable Self-Improving Reasoners, or, Four Habits of Highly Effective STaRs","venue":"cs.CL","work_id":"f65a84bf-c5b4-4491-a618-18bb263c60e5","year":2025},"citing_paper":{"arxiv_id":"2604.22271","last_updated":"2026-05-01T09:11:21Z","snapshot_observed_at":"2026-07-06T23:08:42.301487Z","submitted_at":"2026-04-24T06:33:32Z","title":"How LLMs Detect and Correct Their Own Errors: The Role of Internal Confidence Signals","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-08T12:30:51.094216Z"},"links":{"cited_paper":"/paper/2503.01307","citing_paper":"/paper/2604.22271"},"observation_digest":"sha256:96525ff0d08c2724c5ce7a5e8124b9606326997613680570d67cf44a36b84166","observation_id":"e7f9b55c-5e93-429e-9c8b-0be8ad9ce277","resolution":{"observed_at":"2026-05-17T11:40:33.380427Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-09T10:48:43.212388+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-09T10:48:43.212388+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.08298","last_updated":"2024-03-25T06:01:49Z","snapshot_observed_at":"2026-08-02T14:28:48.623733Z","submitted_at":"2023-11-14T16:43:29Z","title":"A Survey of Confidence Estimation and Calibration in Large Language Models","version":2},"cited_work":{"arxiv_id":"2311.08298","doi":null,"metadata_source":"pith","pith_arxiv_id":"2311.08298","snapshot_observed_at":"2026-07-10T00:56:40.914419Z","title":"A survey of language model confidence esti- mation and calibration.arXiv preprint arXiv:2311.08298","venue":"cs.CL","work_id":"1a999ed9-8dc5-4b88-b33f-adad9e2e5be5","year":2023},"citing_paper":{"arxiv_id":"2604.22271","last_updated":"2026-05-01T09:11:21Z","snapshot_observed_at":"2026-07-06T23:08:42.301487Z","submitted_at":"2026-04-24T06:33:32Z","title":"How LLMs Detect and Correct Their Own Errors: The Role of Internal Confidence Signals","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-08T12:30:51.094216Z"},"links":{"cited_paper":"/paper/2311.08298","citing_paper":"/paper/2604.22271"},"observation_digest":"sha256:f236a23101695d3d0d650d9571613f462b874389614e93d8c2e2e5e16cd98ddc","observation_id":"821ccce8-7463-41bb-b7f3-7ad2508142b3","resolution":{"observed_at":"2026-05-11T19:16:06.961898Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.15255","last_updated":"2024-04-23T17:42:29Z","snapshot_observed_at":"2026-07-31T21:25:53.647335Z","submitted_at":"2024-04-23T17:42:29Z","title":"How to use and interpret activation patching","version":1},"cited_work":{"arxiv_id":"2404.15255","doi":"10.48550/arxiv.2404.15255","metadata_source":"pith","pith_arxiv_id":"2404.15255","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"How to use and interpret activation patching","venue":"cs.LG","work_id":"b99c4234-c7d8-45fc-99bf-6b3b086e9c64","year":2024},"citing_paper":{"arxiv_id":"2604.22271","last_updated":"2026-05-01T09:11:21Z","snapshot_observed_at":"2026-07-06T23:08:42.301487Z","submitted_at":"2026-04-24T06:33:32Z","title":"How LLMs Detect and Correct Their Own Errors: The Role of Internal Confidence Signals","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-08T12:30:51.094216Z"},"links":{"cited_paper":"/paper/2404.15255","citing_paper":"/paper/2604.22271"},"observation_digest":"sha256:88dea3f6279b5ef340ecb1ec7b50e26be4e78fc7fa7d185bffa9ebf2973a2ead","observation_id":"d42eac41-9ee6-4070-808c-79f93763e36e","resolution":{"observed_at":"2026-05-16T20:34:07.011585Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.20487","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-01T07:55:31.586939Z","title":"arXiv preprint arXiv:2510.20487 , year =","venue":null,"work_id":"daeb53de-3885-41f2-9d76-ea0b6900661e","year":2025},"citing_paper":{"arxiv_id":"2604.22271","last_updated":"2026-05-01T09:11:21Z","snapshot_observed_at":"2026-07-06T23:08:42.301487Z","submitted_at":"2026-04-24T06:33:32Z","title":"How LLMs Detect and Correct Their Own Errors: The Role of Internal Confidence Signals","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-08T12:30:51.094216Z"},"links":{"citing_paper":"/paper/2604.22271"},"observation_digest":"sha256:bfcc6ed18d3289e4ec972f93181fcb9b48b5753ade3c909c06b2ff30542237f9","observation_id":"e1f72d2e-359e-4a81-90d4-2d4fb433be96","resolution":{"observed_at":"2026-05-11T19:16:06.929215Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1705.03551","last_updated":"2017-05-13T21:12:37Z","snapshot_observed_at":"2026-08-02T11:13:42.401488Z","submitted_at":"2017-05-09T21:35:07Z","title":"TriviaQA: A Large Scale Distantly Supervised Challenge Dataset for Reading Comprehension","version":2},"cited_work":{"arxiv_id":"1705.03551","doi":"10.48550/arxiv.1705.03551","metadata_source":"pith","pith_arxiv_id":"1705.03551","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"TriviaQA: A Large Scale Distantly Supervised Challenge Dataset for Reading Comprehension","venue":"cs.CL","work_id":"f20e62ba-6265-4b97-aa8c-ddefaf2f5762","year":2017},"citing_paper":{"arxiv_id":"2604.22271","last_updated":"2026-05-01T09:11:21Z","snapshot_observed_at":"2026-07-06T23:08:42.301487Z","submitted_at":"2026-04-24T06:33:32Z","title":"How LLMs Detect and Correct Their Own Errors: The Role of Internal Confidence Signals","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-08T12:30:51.094216Z"},"links":{"cited_paper":"/paper/1705.03551","citing_paper":"/paper/2604.22271"},"observation_digest":"sha256:2be5548926c6876e32931b749ca3e9f8a1b0e5e0fac6ed7416af5785ae87442e","observation_id":"2ecb92e1-547f-4065-85a5-3e82b12f6f20","resolution":{"observed_at":"2026-05-11T19:16:07.019909Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.05221","last_updated":"2022-11-21T16:38:35Z","snapshot_observed_at":"2026-08-06T08:34:11.887259Z","submitted_at":"2022-07-11T22:59:39Z","title":"Language Models (Mostly) Know What They Know","version":4},"cited_work":{"arxiv_id":"2207.05221","doi":"10.1145/3618260.3649777","metadata_source":"pith","pith_arxiv_id":"2207.05221","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Language Models (Mostly) Know What They Know","venue":"cs.CL","work_id":"8ca58a10-da41-4f70-baae-7e449512e345","year":2022},"citing_paper":{"arxiv_id":"2604.22271","last_updated":"2026-05-01T09:11:21Z","snapshot_observed_at":"2026-07-06T23:08:42.301487Z","submitted_at":"2026-04-24T06:33:32Z","title":"How LLMs Detect and Correct Their Own Errors: The Role of Internal Confidence Signals","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-08T12:30:51.094216Z"},"links":{"cited_paper":"/paper/2207.05221","citing_paper":"/paper/2604.22271"},"observation_digest":"sha256:eafaacc50570b76839b60825fefa9fb00830605c52ba41572a2a45b16068c6c8","observation_id":"8dc26070-da47-41f8-8e9a-8ab8f1af48a1","resolution":{"observed_at":"2026-05-11T19:16:07.004691Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-05-21T07:53:13.382372+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T07:53:13.382372+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2603.17839","last_updated":"2026-05-19T10:45:47Z","snapshot_observed_at":"2026-07-06T22:49:33.482934Z","submitted_at":"2026-03-18T15:31:43Z","title":"How do LLMs Compute Verbal Confidence","version":3},"cited_work":{"arxiv_id":"2603.17839","doi":"10.48550/arxiv.2603.17839","metadata_source":"pith","pith_arxiv_id":"2603.17839","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"How do LLMs Compute Verbal Confidence","venue":"cs.CL","work_id":"d459cf71-3a48-4269-bf48-cecceb09d722","year":2026},"citing_paper":{"arxiv_id":"2604.22271","last_updated":"2026-05-01T09:11:21Z","snapshot_observed_at":"2026-07-06T23:08:42.301487Z","submitted_at":"2026-04-24T06:33:32Z","title":"How LLMs Detect and Correct Their Own Errors: The Role of Internal Confidence Signals","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-08T12:30:51.094216Z"},"links":{"cited_paper":"/paper/2603.17839","citing_paper":"/paper/2604.22271"},"observation_digest":"sha256:3e9a618ba1094f7299f1719ed3e4ba8116e82c303be9fe04ca955321c20adb69","observation_id":"1ba2f18b-f0fa-4d29-9862-6f8c88201457","resolution":{"observed_at":"2026-05-20T02:04:53.698588Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12563","last_updated":"2024-05-13T11:01:17Z","snapshot_observed_at":"2026-08-06T01:13:51.234451Z","submitted_at":"2024-02-19T21:38:02Z","title":"Confidence Matters: Revisiting Intrinsic Self-Correction Capabilities of Large Language Models","version":3},"cited_work":{"arxiv_id":"2402.12563","doi":"10.48550/arxiv.2402.12563","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.12563","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Confidence matters: Revisiting intrinsic self-correction capabilities of large language models.CoRR, abs/2402.12563","venue":"arXiv (Cornell University)","work_id":"23d5e173-aae9-4d3e-864e-1e79177c7feb","year":2023},"citing_paper":{"arxiv_id":"2604.22271","last_updated":"2026-05-01T09:11:21Z","snapshot_observed_at":"2026-07-06T23:08:42.301487Z","submitted_at":"2026-04-24T06:33:32Z","title":"How LLMs Detect and Correct Their Own Errors: The Role of Internal Confidence Signals","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-08T12:30:51.094216Z"},"links":{"cited_paper":"/paper/2402.12563","citing_paper":"/paper/2604.22271"},"observation_digest":"sha256:54a50ea23dc1e0af504ee9dd9c6c047af5efd811dbb47373cd65d373ed046263","observation_id":"1e3bd625-9049-4cd4-a4ee-379fb47e627b","resolution":{"observed_at":"2026-05-11T19:16:06.907479Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.15673","last_updated":"2024-12-23T06:03:31Z","snapshot_observed_at":"2026-07-06T18:35:17.953523Z","submitted_at":"2024-06-21T22:29:40Z","title":"Large Language Models have Intrinsic Self-Correction Ability","version":2},"cited_work":{"arxiv_id":"2406.15673","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.15673","snapshot_observed_at":"2026-07-02T12:56:56.672709Z","title":"Large language models have intrinsic self-correction ability.arXiv preprint arXiv:2406.15673, 2024a","venue":null,"work_id":"2f8813e1-00b0-4dda-848a-d526f55a4f7f","year":2024},"citing_paper":{"arxiv_id":"2604.22271","last_updated":"2026-05-01T09:11:21Z","snapshot_observed_at":"2026-07-06T23:08:42.301487Z","submitted_at":"2026-04-24T06:33:32Z","title":"How LLMs Detect and Correct Their Own Errors: The Role of Internal Confidence Signals","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-08T12:30:51.094216Z"},"links":{"cited_paper":"/paper/2406.15673","citing_paper":"/paper/2604.22271"},"observation_digest":"sha256:1469eb2f7e48d3aceef4bff689a68251df14a6544f821989946838b4e660a167","observation_id":"9980e0e0-82e5-4552-bfc5-0cc584812086","resolution":{"observed_at":"2026-05-11T19:16:06.914274Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.04013","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-02T01:46:26.404146Z","title":"Liu, J., Jain, J., Diab, M., and Subramani, N","venue":null,"work_id":"ef8a5e75-2ec7-4784-b7b7-954f7d433170","year":2025},"citing_paper":{"arxiv_id":"2604.22271","last_updated":"2026-05-01T09:11:21Z","snapshot_observed_at":"2026-07-06T23:08:42.301487Z","submitted_at":"2026-04-24T06:33:32Z","title":"How LLMs Detect and Correct Their Own Errors: The Role of Internal Confidence Signals","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-08T12:30:51.094216Z"},"links":{"citing_paper":"/paper/2604.22271"},"observation_digest":"sha256:9de08666e905b35f3fbdd687702f039049c738fae1338090cff4749d7e4394ab","observation_id":"d4c75156-e4d3-445a-b061-f949c8f73cc3","resolution":{"observed_at":"2026-05-11T19:16:06.999169Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.27328","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T08:43:14.816960Z","title":"Monte MacDiarmid, Timothy Maxwell, Nicholas Schiefer, Jesse Mu, Jared Kaplan, David Duvenaud, Samuel R","venue":null,"work_id":"19f8bfa7-6ba9-459d-9a92-2cefa675f6f2","year":2025},"citing_paper":{"arxiv_id":"2604.22271","last_updated":"2026-05-01T09:11:21Z","snapshot_observed_at":"2026-07-06T23:08:42.301487Z","submitted_at":"2026-04-24T06:33:32Z","title":"How LLMs Detect and Correct Their Own Errors: The Role of Internal Confidence Signals","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-08T12:30:51.094216Z"},"links":{"citing_paper":"/paper/2604.22271"},"observation_digest":"sha256:fabab64cf4a875bf992917af7c0ad6749ead0a0574a1dba9cb37a1de9bda8ae1","observation_id":"534693cc-b836-48db-a685-48178f0bf927","resolution":{"observed_at":"2026-05-11T19:16:06.986725Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02707","last_updated":"2025-05-18T11:18:56Z","snapshot_observed_at":"2026-08-04T21:25:41.967552Z","submitted_at":"2024-10-03T17:31:31Z","title":"LLMs Know More Than They Show: On the Intrinsic Representation of LLM Hallucinations","version":4},"cited_work":{"arxiv_id":"2410.02707","doi":"10.48550/arxiv.2410.02707","metadata_source":"pith","pith_arxiv_id":"2410.02707","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"doi:10.48550/arXiv.2410.02707 , abstract =","venue":"cs.CL","work_id":"4caa3de3-42ed-4912-8e31-07f700b338c0","year":2024},"citing_paper":{"arxiv_id":"2604.22271","last_updated":"2026-05-01T09:11:21Z","snapshot_observed_at":"2026-07-06T23:08:42.301487Z","submitted_at":"2026-04-24T06:33:32Z","title":"How LLMs Detect and Correct Their Own Errors: The Role of Internal Confidence Signals","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-08T12:30:51.094216Z"},"links":{"cited_paper":"/paper/2410.02707","citing_paper":"/paper/2604.22271"},"observation_digest":"sha256:86485bf1689522197d32b040833f8bd4418b463e4abadf0597dcd784cd7f13e3","observation_id":"b0b9c4a5-46af-43b6-85b2-1bfd588932d8","resolution":{"observed_at":"2026-05-11T19:16:06.900670Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06681","last_updated":"2024-07-05T15:30:45Z","snapshot_observed_at":"2026-08-06T00:58:30.657180Z","submitted_at":"2023-12-09T04:40:46Z","title":"Steering Llama 2 via Contrastive Activation Addition","version":4},"cited_work":{"arxiv_id":"2312.06681","doi":"10.48550/arxiv.2312.06681","metadata_source":"pith","pith_arxiv_id":"2312.06681","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Steering Llama 2 via Contrastive Activation Addition","venue":"cs.CL","work_id":"3317feaa-e788-45fc-95aa-4ea20028b55b","year":2023},"citing_paper":{"arxiv_id":"2604.22271","last_updated":"2026-05-01T09:11:21Z","snapshot_observed_at":"2026-07-06T23:08:42.301487Z","submitted_at":"2026-04-24T06:33:32Z","title":"How LLMs Detect and Correct Their Own Errors: The Role of Internal Confidence Signals","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-08T12:30:51.094216Z"},"links":{"cited_paper":"/paper/2312.06681","citing_paper":"/paper/2604.22271"},"observation_digest":"sha256:9f1f0ed6d90f21ca0f103283adcb7deebd8c5a45994d90fba4f16b84b127f0fa","observation_id":"b6047ae1-49f3-45b1-8180-8e12274e355c","resolution":{"observed_at":"2026-05-11T20:37:21.847050Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-18T08:21:04.515131+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-18T08:21:04.515131+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1038/212438a0","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mark Steyvers, Heliodoro Tejeda, Aakriti Kumar, Catarina Bel´em, Sheer Karny, Xinyue Hu, Lukas W","venue":"Nature","work_id":"a956a4bb-d53a-46d2-95ad-439fe45562ec","year":null},"citing_paper":{"arxiv_id":"2604.22271","last_updated":"2026-05-01T09:11:21Z","snapshot_observed_at":"2026-07-06T23:08:42.301487Z","submitted_at":"2026-04-24T06:33:32Z","title":"How LLMs Detect and Correct Their Own Errors: The Role of Internal Confidence Signals","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-08T12:30:51.094216Z"},"links":{"citing_paper":"/paper/2604.22271"},"observation_digest":"sha256:f2edbac364e19f645191b9a69a8f792d9e0e7e50a4a0418f98218ac0f3ec5e06","observation_id":"a813e620-4077-4b11-b988-810bb5d5c566","resolution":{"observed_at":"2026-05-08T12:34:59.025100Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.12877","last_updated":"2025-04-14T09:04:45Z","snapshot_observed_at":"2026-07-06T19:34:51.296918Z","submitted_at":"2024-10-15T08:38:20Z","title":"Improving Instruction-Following in Language Models through Activation Steering","version":2},"cited_work":{"arxiv_id":"2410.12877","doi":"10.48550/arxiv.2410.12877","metadata_source":"arxiv_reference","pith_arxiv_id":"2410.12877","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Improving instruction-following in language models through activation steering.arXiv preprint arXiv:2410.12877","venue":"arXiv (Cornell University)","work_id":"8bd9335e-1da7-44b2-a5b5-92f40e8078fc","year":2025},"citing_paper":{"arxiv_id":"2604.22271","last_updated":"2026-05-01T09:11:21Z","snapshot_observed_at":"2026-07-06T23:08:42.301487Z","submitted_at":"2026-04-24T06:33:32Z","title":"How LLMs Detect and Correct Their Own Errors: The Role of Internal Confidence Signals","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-08T12:30:51.094216Z"},"links":{"cited_paper":"/paper/2410.12877","citing_paper":"/paper/2604.22271"},"observation_digest":"sha256:295cac54b2472c897173d4d44ce1ff32a2fe472908181e1a9f1427b206258ab2","observation_id":"b6cf15a7-8050-466e-b16a-50825f8e06b2","resolution":{"observed_at":"2026-05-11T19:16:06.848179Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.19786","last_updated":"2025-03-25T15:52:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-25T15:52:34Z","title":"Gemma 3 Technical Report","version":1},"cited_work":{"arxiv_id":"2503.19786","doi":"10.1007/978-3-540-48085-3_36","metadata_source":"pith","pith_arxiv_id":"2503.19786","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Gemma 3 Technical Report","venue":"cs.CL","work_id":"f93e08bf-9e96-409b-8ac6-b8385fd17fd7","year":2025},"citing_paper":{"arxiv_id":"2604.22271","last_updated":"2026-05-01T09:11:21Z","snapshot_observed_at":"2026-07-06T23:08:42.301487Z","submitted_at":"2026-04-24T06:33:32Z","title":"How LLMs Detect and Correct Their Own Errors: The Role of Internal Confidence Signals","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-08T12:30:51.094216Z"},"links":{"cited_paper":"/paper/2503.19786","citing_paper":"/paper/2604.22271"},"observation_digest":"sha256:1befdc409de6d365baa4a7f8e280689d0281b5efabf8962a4ee9e609d479ea73","observation_id":"bf5f9c59-2590-4fb3-a9fe-939cc455157e","resolution":{"observed_at":"2026-05-11T19:16:06.993174Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14975","last_updated":"2023-10-24T04:27:42Z","snapshot_observed_at":"2026-07-06T15:32:25.931739Z","submitted_at":"2023-05-24T10:12:33Z","title":"Just Ask for Calibration: Strategies for Eliciting Calibrated Confidence Scores from Language Models Fine-Tuned with Human Feedback","version":2},"cited_work":{"arxiv_id":"2305.14975","doi":null,"metadata_source":"pith","pith_arxiv_id":"2305.14975","snapshot_observed_at":"2026-07-08T10:04:51.524003Z","title":"Manning, and Chelsea Finn","venue":"cs.CL","work_id":"8617eae9-ad9f-45e0-bb23-49df5b429be6","year":2023},"citing_paper":{"arxiv_id":"2604.22271","last_updated":"2026-05-01T09:11:21Z","snapshot_observed_at":"2026-07-06T23:08:42.301487Z","submitted_at":"2026-04-24T06:33:32Z","title":"How LLMs Detect and Correct Their Own Errors: The Role of Internal Confidence Signals","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-08T12:30:51.094216Z"},"links":{"cited_paper":"/paper/2305.14975","citing_paper":"/paper/2604.22271"},"observation_digest":"sha256:cdb54c5631f8ad1f8edfd0184cf9ae3cc2f47973c95ae3969e6aeb985ceb29e9","observation_id":"8113b983-2179-454c-896e-cce94e929d75","resolution":{"observed_at":"2026-05-11T19:16:06.940805Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.10248","last_updated":"2024-10-10T13:20:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-20T12:21:05Z","title":"Steering Language Models With Activation Engineering","version":5},"cited_work":{"arxiv_id":"2308.10248","doi":"10.18653/v1/2024.findings-acl.611","metadata_source":"pith","pith_arxiv_id":"2308.10248","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Steering Language Models With Activation Engineering","venue":"cs.CL","work_id":"d525fe06-5560-4e97-86fc-7a0e551f5b17","year":2023},"citing_paper":{"arxiv_id":"2604.22271","last_updated":"2026-05-01T09:11:21Z","snapshot_observed_at":"2026-07-06T23:08:42.301487Z","submitted_at":"2026-04-24T06:33:32Z","title":"How LLMs Detect and Correct Their Own Errors: The Role of Internal Confidence Signals","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-08T12:30:51.094216Z"},"links":{"cited_paper":"/paper/2308.10248","citing_paper":"/paper/2604.22271"},"observation_digest":"sha256:3a373d84e7ecd5160fdc779fa0f80e80e5a033045b8592cbcadd46dbffe537f6","observation_id":"f7053478-687f-4e3e-9ce3-c5596cdaec71","resolution":{"observed_at":"2026-05-11T19:16:06.852935Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2510.07364","last_updated":"2026-07-07T14:19:58Z","snapshot_observed_at":"2026-08-04T11:02:17.680858Z","submitted_at":"2025-10-08T17:58:28Z","title":"Base Models Know How to Reason, Thinking Models Learn When","version":4},"cited_work":{"arxiv_id":"2510.07364","doi":"10.48550/arxiv.2510.07364","metadata_source":"arxiv_reference","pith_arxiv_id":"2510.07364","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Base models know how to reason, thinking models learn when.arXiv preprint arXiv:2510.07364","venue":"Oxford University Research Archive (ORA) (University of Oxford)","work_id":"6b8f6f1f-0a24-48c7-af58-4a4206730999","year":2025},"citing_paper":{"arxiv_id":"2604.22271","last_updated":"2026-05-01T09:11:21Z","snapshot_observed_at":"2026-07-06T23:08:42.301487Z","submitted_at":"2026-04-24T06:33:32Z","title":"How LLMs Detect and Correct Their Own Errors: The Role of Internal Confidence Signals","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-08T12:30:51.094216Z"},"links":{"cited_paper":"/paper/2510.07364","citing_paper":"/paper/2604.22271"},"observation_digest":"sha256:ecf9b14776d0be32c7cdd94f77275d4b6d18085efcb1df316590e64060f8d528","observation_id":"7cc2956a-a5c8-4a4d-821c-3d138f211e59","resolution":{"observed_at":"2026-07-08T02:18:39.926237Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-05-23T16:25:06.757576+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T16:25:06.757576+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.12638","last_updated":"2025-07-16T21:21:03Z","snapshot_observed_at":"2026-08-06T16:40:23.931009Z","submitted_at":"2025-07-16T21:21:03Z","title":"Reasoning-Finetuning Repurposes Latent Representations in Base Models","version":1},"cited_work":{"arxiv_id":"2507.12638","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.12638","snapshot_observed_at":"2026-07-03T09:07:47.853577Z","title":"Reasoning-finetuning repurposes latent representations in base models.arXiv:2507.12638","venue":null,"work_id":"4864f7f2-e0a5-4c23-ae90-5f6fe7cb16ef","year":2025},"citing_paper":{"arxiv_id":"2604.22271","last_updated":"2026-05-01T09:11:21Z","snapshot_observed_at":"2026-07-06T23:08:42.301487Z","submitted_at":"2026-04-24T06:33:32Z","title":"How LLMs Detect and Correct Their Own Errors: The Role of Internal Confidence Signals","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-08T12:30:51.094216Z"},"links":{"cited_paper":"/paper/2507.12638","citing_paper":"/paper/2604.22271"},"observation_digest":"sha256:5a985e631592ebbe9b37120140211cef60c84d8f7d8c68267a022cf6af3cf8fd","observation_id":"941f5e68-792c-4568-ba71-b24b273bf530","resolution":{"observed_at":"2026-05-11T19:16:06.925057Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Large language models are better reasoners with self-verification","venue":null,"work_id":"6e4b27e0-5017-4989-9bc3-2d66ceff1e8e","year":2023},"citing_paper":{"arxiv_id":"2604.22271","last_updated":"2026-05-01T09:11:21Z","snapshot_observed_at":"2026-07-06T23:08:42.301487Z","submitted_at":"2026-04-24T06:33:32Z","title":"How LLMs Detect and Correct Their Own Errors: The Role of Internal Confidence Signals","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-08T12:30:51.094216Z"},"links":{"citing_paper":"/paper/2604.22271"},"observation_digest":"sha256:b30c658dd2462606c584f5d91b6822313ed6962d528196c0b44d379fd2307e02","observation_id":"42c1e059-f4eb-4d69-8b7d-e1b9485ce0f9","resolution":{"observed_at":"2026-05-26T13:17:48.383050Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A broad-coverage challenge corpus for sentence understanding through inference","venue":null,"work_id":"cfc00ff8-b163-4c31-a4ad-496c27fed2c6","year":2018},"citing_paper":{"arxiv_id":"2604.22271","last_updated":"2026-05-01T09:11:21Z","snapshot_observed_at":"2026-07-06T23:08:42.301487Z","submitted_at":"2026-04-24T06:33:32Z","title":"How LLMs Detect and Correct Their Own Errors: The Role of Internal Confidence Signals","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-08T12:30:51.094216Z"},"links":{"citing_paper":"/paper/2604.22271"},"observation_digest":"sha256:f22b383736bd601747362c93092ac3e1448afbc85d16a001f88b57e0e7126c98","observation_id":"3cb35885-4dd2-49e1-99ad-7a8ca21a32e2","resolution":{"observed_at":"2026-05-26T13:17:48.395982Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.06604","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-02T21:07:23.643783Z","title":"Know when you’re wrong: Aligning confidence with correctness for LLM error detection.arXiv preprint arXiv:2603.06604","venue":null,"work_id":"a7cb4200-0886-4e48-8458-2309bb2df865","year":2024},"citing_paper":{"arxiv_id":"2604.22271","last_updated":"2026-05-01T09:11:21Z","snapshot_observed_at":"2026-07-06T23:08:42.301487Z","submitted_at":"2026-04-24T06:33:32Z","title":"How LLMs Detect and Correct Their Own Errors: The Role of Internal Confidence Signals","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-08T12:30:51.094216Z"},"links":{"citing_paper":"/paper/2604.22271"},"observation_digest":"sha256:1fc46d46fa1d6a3400171ca3ac38d8bd68e387fed670ab14b8e851dd310f25ac","observation_id":"eb2ab648-8db5-49a3-ab25-bbb6b92e56b7","resolution":{"observed_at":"2026-05-11T19:16:06.879397Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.13063","last_updated":"2024-03-17T04:38:48Z","snapshot_observed_at":"2026-07-06T15:45:39.649725Z","submitted_at":"2023-06-22T17:31:44Z","title":"Can LLMs Express Their Uncertainty? An Empirical Evaluation of Confidence Elicitation in LLMs","version":2},"cited_work":{"arxiv_id":"2306.13063","doi":"10.48550/arxiv.2306.13063","metadata_source":"pith","pith_arxiv_id":"2306.13063","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Can LLMs Express Their Uncertainty? An Empirical Evaluation of Confidence Elicitation in LLMs","venue":"cs.CL","work_id":"7c5c5f6d-fd68-4f65-ac05-5d90308e8bc2","year":2023},"citing_paper":{"arxiv_id":"2604.22271","last_updated":"2026-05-01T09:11:21Z","snapshot_observed_at":"2026-07-06T23:08:42.301487Z","submitted_at":"2026-04-24T06:33:32Z","title":"How LLMs Detect and Correct Their Own Errors: The Role of Internal Confidence Signals","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-08T12:30:51.094216Z"},"links":{"cited_paper":"/paper/2306.13063","citing_paper":"/paper/2604.22271"},"observation_digest":"sha256:2e0deaa1f554896b72c02c71552476603598b3c743e8ed13a53200307dc35353","observation_id":"e9a4594c-8fc0-40e3-8f9c-4e21dc1fab29","resolution":{"observed_at":"2026-05-13T08:40:32.974213Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-18T08:21:07.82596+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-18T08:21:07.82596+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.04404","last_updated":"2025-02-06T08:52:43Z","snapshot_observed_at":"2026-08-05T03:12:32.063864Z","submitted_at":"2025-02-06T08:52:43Z","title":"Step Back to Leap Forward: Self-Backtracking for Boosting Reasoning of Language Models","version":1},"cited_work":{"arxiv_id":"2502.04404","doi":"10.48550/arxiv.2502.04404","metadata_source":"pith","pith_arxiv_id":"2502.04404","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Step back to leap forward: Self-backtracking for boosting reasoning of language models","venue":"cs.CL","work_id":"33a1c847-eebe-4da8-ba19-4365f0a85c4d","year":2025},"citing_paper":{"arxiv_id":"2604.22271","last_updated":"2026-05-01T09:11:21Z","snapshot_observed_at":"2026-07-06T23:08:42.301487Z","submitted_at":"2026-04-24T06:33:32Z","title":"How LLMs Detect and Correct Their Own Errors: The Role of Internal Confidence Signals","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-08T12:30:51.094216Z"},"links":{"cited_paper":"/paper/2502.04404","citing_paper":"/paper/2604.22271"},"observation_digest":"sha256:a131c85fd7c37ab58a8ebe3bb41dd1a770a69b2301c7690dd682370d561cf067","observation_id":"3834b0e4-2513-40eb-a978-fef8442e08bd","resolution":{"observed_at":"2026-05-11T19:16:06.974960Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-09T10:48:41.491834+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-09T10:48:41.491834+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1037/0033-295x.111.4.931","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Dongryeol Yoon, Seongyun Kim, Sukyung Yang, Seongjin Kim, Yireun Kim, Eunji Kim, Eunsol Choi, Yohan Kim, and Minjoon Seo","venue":"Psychological Review","work_id":"f5edb7c1-0856-4c7a-b39a-d2d177911690","year":null},"citing_paper":{"arxiv_id":"2604.22271","last_updated":"2026-05-01T09:11:21Z","snapshot_observed_at":"2026-07-06T23:08:42.301487Z","submitted_at":"2026-04-24T06:33:32Z","title":"How LLMs Detect and Correct Their Own Errors: The Role of Internal Confidence Signals","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-08T12:30:51.094216Z"},"links":{"citing_paper":"/paper/2604.22271"},"observation_digest":"sha256:ae094b62f05898363af30062a4962a6a1d5024fd13706f11d0ff5f0a4bb9b7c2","observation_id":"32ec44d1-6301-4eed-a902-62d6985ba020","resolution":{"observed_at":"2026-05-08T12:34:59.023062Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16042","last_updated":"2024-01-17T04:07:06Z","snapshot_observed_at":"2026-07-06T16:24:38.375055Z","submitted_at":"2023-09-27T21:53:56Z","title":"Towards Best Practices of Activation Patching in Language Models: Metrics and Methods","version":2},"cited_work":{"arxiv_id":"2309.16042","doi":"10.48550/arxiv.2309.16042","metadata_source":"pith","pith_arxiv_id":"2309.16042","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Towards Best Practices of Activation Patching in Language Models: Metrics and Methods","venue":"cs.LG","work_id":"eead806e-b03c-49ee-91d8-a5f737969604","year":2023},"citing_paper":{"arxiv_id":"2604.22271","last_updated":"2026-05-01T09:11:21Z","snapshot_observed_at":"2026-07-06T23:08:42.301487Z","submitted_at":"2026-04-24T06:33:32Z","title":"How LLMs Detect and Correct Their Own Errors: The Role of Internal Confidence Signals","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-08T12:30:51.094216Z"},"links":{"cited_paper":"/paper/2309.16042","citing_paper":"/paper/2604.22271"},"observation_digest":"sha256:3bb2cc692686cbcd3c0b024f16ca8be57720cc88cf07377ecd5da99842722c68","observation_id":"962167b0-6575-47b2-88b5-ae7033b700bf","resolution":{"observed_at":"2026-05-17T11:56:11.458226Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"No chance","venue":null,"work_id":"77469509-1de8-45f0-baad-9e51da928df2","year":2018},"citing_paper":{"arxiv_id":"2604.22271","last_updated":"2026-05-01T09:11:21Z","snapshot_observed_at":"2026-07-06T23:08:42.301487Z","submitted_at":"2026-04-24T06:33:32Z","title":"How LLMs Detect and Correct Their Own Errors: The Role of Internal Confidence Signals","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-08T12:30:51.094216Z"},"links":{"citing_paper":"/paper/2604.22271"},"observation_digest":"sha256:0d25bddd0a91406d2fac9ec8db7054ff39651d13ba7f198c66b71cb2cc61a852","observation_id":"e28a3b56-0f6f-4fef-8100-e8bcd0bdd24a","resolution":{"observed_at":"2026-05-26T13:17:48.390313Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"(2024); Chen et al","venue":null,"work_id":"2adca96c-db70-44ad-820f-37958a24187f","year":2024},"citing_paper":{"arxiv_id":"2604.22271","last_updated":"2026-05-01T09:11:21Z","snapshot_observed_at":"2026-07-06T23:08:42.301487Z","submitted_at":"2026-04-24T06:33:32Z","title":"How LLMs Detect and Correct Their Own Errors: The Role of Internal Confidence Signals","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-08T12:30:51.094216Z"},"links":{"citing_paper":"/paper/2604.22271"},"observation_digest":"sha256:20715e5e9c5821626543bf9b04fdec62f95c1b66195942b56dba0ccacf2cd138","observation_id":"a21256e0-0cbb-48df-833a-f3d536854f87","resolution":{"observed_at":"2026-05-26T13:17:48.370724Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"consistency heads","venue":null,"work_id":"247023f0-66d6-4201-944e-a03aff30bab9","year":2023},"citing_paper":{"arxiv_id":"2604.22271","last_updated":"2026-05-01T09:11:21Z","snapshot_observed_at":"2026-07-06T23:08:42.301487Z","submitted_at":"2026-04-24T06:33:32Z","title":"How LLMs Detect and Correct Their Own Errors: The Role of Internal Confidence Signals","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-08T12:30:51.094216Z"},"links":{"citing_paper":"/paper/2604.22271"},"observation_digest":"sha256:fa86f8906aa443e81f98d8f2fb68f3441a81fb65ed7c7be1bcba003f31ad5950","observation_id":"68540711-125d-4c3f-be9b-ecea4c63a3e1","resolution":{"observed_at":"2026-05-26T13:17:48.378105Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"the candidate’s answer","venue":null,"work_id":"0aa67a7d-1bdf-4624-92d8-4ce1faa43df3","year":2022},"citing_paper":{"arxiv_id":"2604.22271","last_updated":"2026-05-01T09:11:21Z","snapshot_observed_at":"2026-07-06T23:08:42.301487Z","submitted_at":"2026-04-24T06:33:32Z","title":"How LLMs Detect and Correct Their Own Errors: The Role of Internal Confidence Signals","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-08T12:30:51.094216Z"},"links":{"citing_paper":"/paper/2604.22271"},"observation_digest":"sha256:6d823cf51cd09dbc800b378cd4312b4fec9476105e70006697ea13ea8ebab280","observation_id":"52c3eabc-8b40-4644-b96c-7b2d6828cb3c","resolution":{"observed_at":"2026-05-26T13:17:48.374585Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2604.22271","last_updated":"2026-05-01T09:11:21Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-07-06T23:08:42.301487Z","submitted_at":"2026-04-24T06:33:32Z","title":"How LLMs Detect and Correct Their Own Errors: The Role of Internal Confidence Signals"},"reference_resolution":{"displayed":35,"state_counts":{"malformed_identifier":0,"metadata_mismatch":4,"parse_uncertain":0,"unresolved":0,"verified_exact":24,"verified_fuzzy":7},"total_outbound_references":35},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 35 of 35 outbound references and 2 inbound Pith citation observations for arXiv:2604.22271."}