{"as_of":"2026-08-10T23:16:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9305a28f52749e20cac8caf7e3f3b050cf2bb1c4491d0e8fa706dbd511615912","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":12,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":12,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":12,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":12,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:25:22.485623Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":1,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2403.08819","last_updated":"2024-06-27T16:30:32Z","snapshot_observed_at":"2026-08-07T20:52:52.136811Z","submitted_at":"2024-02-20T04:13:48Z","title":"Thermometer: Towards Universal Calibration for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.08819","snapshot_observed_at":"2026-08-07T14:25:22.485623Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19073","last_updated":"2025-07-20T15:35:43Z","snapshot_observed_at":"2026-08-10T00:41:11.948345Z","submitted_at":"2025-05-25T10:17:57Z","title":"Towards Harmonized Uncertainty Estimation for Large Language Models","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T14:25:22.485623Z"},"links":{"cited_paper":"/paper/2403.08819","citing_paper":"/paper/2505.19073"},"observation_digest":"sha256:08a6a3a67f66c9674b16a50063389c94cff00e5b5eb6b62241c0226fce74a06d","observation_id":"63a1bb91-648e-4bfd-8ae3-7a60e6c33297","resolution":{"observed_at":"2026-08-07T14:25:22.485623Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.08819","last_updated":"2024-06-27T16:30:32Z","snapshot_observed_at":"2026-08-07T20:52:52.136811Z","submitted_at":"2024-02-20T04:13:48Z","title":"Thermometer: Towards Universal Calibration for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.08819","snapshot_observed_at":"2026-08-07T13:51:12.698057Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20903","last_updated":"2025-05-27T08:51:31Z","snapshot_observed_at":"2026-08-08T06:10:57.496315Z","submitted_at":"2025-05-27T08:51:31Z","title":"Towards Objective Fine-tuning: How LLMs' Prior Knowledge Causes Potential Poor Calibration?","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T13:51:12.698057Z"},"links":{"cited_paper":"/paper/2403.08819","citing_paper":"/paper/2505.20903"},"observation_digest":"sha256:9299424e91ae9a057e07afc42005663b682e285c5bf9bf132d3681ac4179369d","observation_id":"12576635-f91a-4a4f-9475-6f495a25b7b2","resolution":{"observed_at":"2026-08-07T13:51:12.698057Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.08819","last_updated":"2024-06-27T16:30:32Z","snapshot_observed_at":"2026-08-07T20:52:52.136811Z","submitted_at":"2024-02-20T04:13:48Z","title":"Thermometer: Towards Universal Calibration for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.08819","snapshot_observed_at":"2026-08-05T22:54:25.079218Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.06225","last_updated":"2025-08-18T12:00:32Z","snapshot_observed_at":"2026-08-08T19:02:29.037600Z","submitted_at":"2025-08-08T11:11:22Z","title":"Overconfidence in LLM-as-a-Judge: Diagnosis and Confidence-Driven Solution","version":3},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-05T22:54:25.079218Z"},"links":{"cited_paper":"/paper/2403.08819","citing_paper":"/paper/2508.06225"},"observation_digest":"sha256:ba047e0c88dba52319fec33d82718e067a916b9b97434e90901a98d1bf470a7e","observation_id":"13123c1d-e4be-4616-b5c4-c48acce1a9aa","resolution":{"observed_at":"2026-08-05T22:54:25.079218Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.08819","last_updated":"2024-06-27T16:30:32Z","snapshot_observed_at":"2026-08-07T20:52:52.136811Z","submitted_at":"2024-02-20T04:13:48Z","title":"Thermometer: Towards Universal Calibration for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.08819","snapshot_observed_at":"2026-08-05T16:15:38.387545Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.18784","last_updated":"2025-08-26T08:11:50Z","snapshot_observed_at":"2026-08-05T16:15:37.799459Z","submitted_at":"2025-08-26T08:11:50Z","title":"Insights into User Interface Innovations from a Design Thinking Workshop at deRSE25","version":1},"reference_index":1987,"source":"pdf_text","source_observed_at":"2026-08-05T16:15:38.387545Z"},"links":{"cited_paper":"/paper/2403.08819","citing_paper":"/paper/2508.18784"},"observation_digest":"sha256:d1f76cb15ea929dd82f01238104261bb0f67cc38298e695a866e92fef264ee97","observation_id":"5b9dc4ac-7e07-47d2-aa6b-df7f43671200","resolution":{"observed_at":"2026-08-05T16:15:38.387545Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.08819","last_updated":"2024-06-27T16:30:32Z","snapshot_observed_at":"2026-08-07T20:52:52.136811Z","submitted_at":"2024-02-20T04:13:48Z","title":"Thermometer: Towards Universal Calibration for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.08819","snapshot_observed_at":"2026-08-04T18:53:02.742636Z","title":"Thermometer: Towards universal calibration for large language models.arXiv preprint arXiv:2403.08819,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.09675","last_updated":"2025-09-11T17:59:17Z","snapshot_observed_at":"2026-08-07T12:25:43.109797Z","submitted_at":"2025-09-11T17:59:17Z","title":"CDE: Curiosity-Driven Exploration for Efficient Reinforcement Learning in Large Language Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-04T18:53:02.742636Z"},"links":{"cited_paper":"/paper/2403.08819","citing_paper":"/paper/2509.09675"},"observation_digest":"sha256:a3b8f9b5258322a452dcda60e35834ff0150663f7affe5a737ea88c226e72102","observation_id":"5f4aa9d9-897b-4962-9273-2271b2e68222","resolution":{"observed_at":"2026-08-04T18:53:02.742636Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.08819","last_updated":"2024-06-27T16:30:32Z","snapshot_observed_at":"2026-08-07T20:52:52.136811Z","submitted_at":"2024-02-20T04:13:48Z","title":"Thermometer: Towards Universal Calibration for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.08819","snapshot_observed_at":"2026-08-02T23:14:39.507295Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.14862","last_updated":"2026-05-27T11:05:26Z","snapshot_observed_at":"2026-08-06T04:31:29.580672Z","submitted_at":"2026-02-16T15:54:52Z","title":"The Well-Tempered Classifier: Some Elementary Properties of Temperature Scaling","version":2},"reference_index":1978,"source":"pdf_text","source_observed_at":"2026-08-02T23:14:39.507295Z"},"links":{"cited_paper":"/paper/2403.08819","citing_paper":"/paper/2602.14862"},"observation_digest":"sha256:a041b4a201e37b70900a8c7b4fe007e16b9a01600856395320991b28d07912bc","observation_id":"f4904710-1229-4c68-8d01-5b32f88ff9f0","resolution":{"observed_at":"2026-08-02T23:14:39.507295Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.08819","last_updated":"2024-06-27T16:30:32Z","snapshot_observed_at":"2026-08-07T20:52:52.136811Z","submitted_at":"2024-02-20T04:13:48Z","title":"Thermometer: Towards Universal Calibration for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.08819","snapshot_observed_at":"2026-08-02T18:16:33.382429Z","title":"Thermometer: Towards universal calibration for large language models.arXiv preprint arXiv:2403.08819,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.13800","last_updated":"2026-07-16T07:01:10Z","snapshot_observed_at":"2026-08-08T04:14:58.532695Z","submitted_at":"2026-03-14T07:17:45Z","title":"Beyond Medical Diagnostics: How Medical Multimodal Large Language Models Think in Space","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-02T18:16:33.382429Z"},"links":{"cited_paper":"/paper/2403.08819","citing_paper":"/paper/2603.13800"},"observation_digest":"sha256:1bb0f9031c49cf6ef817b13307cfa5a6ae66df01336205cf59f8acb6404da1d4","observation_id":"45844de7-df57-4c1c-9478-0cdc85e30134","resolution":{"observed_at":"2026-08-02T18:16:33.382429Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.08819","last_updated":"2024-06-27T16:30:32Z","snapshot_observed_at":"2026-08-07T20:52:52.136811Z","submitted_at":"2024-02-20T04:13:48Z","title":"Thermometer: Towards Universal Calibration for Large Language Models","version":2},"cited_work":{"arxiv_id":"2403.08819","doi":"10.48550/arxiv.2403.08819","metadata_source":"arxiv_reference","pith_arxiv_id":"2403.08819","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Aviv Slobodkin, Omer Goldman, Avi Caciularu, Ido Dagan, and Shauli Ravfogel","venue":"arXiv (Cornell University)","work_id":"8ebd8cc8-be62-442b-ae1d-7e3e225f0818","year":2024},"citing_paper":{"arxiv_id":"2604.02543","last_updated":"2026-04-02T21:52:29Z","snapshot_observed_at":"2026-07-31T12:53:14.224355Z","submitted_at":"2026-04-02T21:52:29Z","title":"Overconfidence and Calibration in Medical VQA: Empirical Findings and Hallucination-Aware Mitigation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-13T21:24:55.411001Z"},"links":{"cited_paper":"/paper/2403.08819","citing_paper":"/paper/2604.02543"},"observation_digest":"sha256:a1a9324bc09d65585ae86584b1b668f4275fd4a6e85cae1054ae601c82120c69","observation_id":"4200b305-bba2-4c08-a1c7-30b03acd1c6b","resolution":{"observed_at":"2026-05-13T21:28:17.720506Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.08819","last_updated":"2024-06-27T16:30:32Z","snapshot_observed_at":"2026-08-07T20:52:52.136811Z","submitted_at":"2024-02-20T04:13:48Z","title":"Thermometer: Towards Universal Calibration for Large Language Models","version":2},"cited_work":{"arxiv_id":"2403.08819","doi":"10.48550/arxiv.2403.08819","metadata_source":"arxiv_reference","pith_arxiv_id":"2403.08819","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Aviv Slobodkin, Omer Goldman, Avi Caciularu, Ido Dagan, and Shauli Ravfogel","venue":"arXiv (Cornell University)","work_id":"8ebd8cc8-be62-442b-ae1d-7e3e225f0818","year":2024},"citing_paper":{"arxiv_id":"2604.19895","last_updated":"2026-04-21T18:17:08Z","snapshot_observed_at":"2026-07-06T23:06:26.596990Z","submitted_at":"2026-04-21T18:17:08Z","title":"Learning When Not to Decide: A Framework for Overcoming Factual Presumptuousness in AI Adjudication","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-10T02:08:24.770003Z"},"links":{"cited_paper":"/paper/2403.08819","citing_paper":"/paper/2604.19895"},"observation_digest":"sha256:56667a216ec87d110228ed61a7aaf15deba1847a608f33dc943b61134c06cc32","observation_id":"080bbfe9-ff9e-4bed-92d7-1147d9542dfb","resolution":{"observed_at":"2026-05-10T02:11:57.293912Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.08819","last_updated":"2024-06-27T16:30:32Z","snapshot_observed_at":"2026-08-07T20:52:52.136811Z","submitted_at":"2024-02-20T04:13:48Z","title":"Thermometer: Towards Universal Calibration for Large Language Models","version":2},"cited_work":{"arxiv_id":"2403.08819","doi":"10.48550/arxiv.2403.08819","metadata_source":"arxiv_reference","pith_arxiv_id":"2403.08819","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Aviv Slobodkin, Omer Goldman, Avi Caciularu, Ido Dagan, and Shauli Ravfogel","venue":"arXiv (Cornell University)","work_id":"8ebd8cc8-be62-442b-ae1d-7e3e225f0818","year":2024},"citing_paper":{"arxiv_id":"2605.13595","last_updated":"2026-05-13T14:30:39Z","snapshot_observed_at":"2026-07-06T23:25:11.623026Z","submitted_at":"2026-05-13T14:30:39Z","title":"Inducing Artificial Uncertainty in Language Models","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-14T20:11:44.878211Z"},"links":{"cited_paper":"/paper/2403.08819","citing_paper":"/paper/2605.13595"},"observation_digest":"sha256:74baa5a60ce079faec118fefcf63f935dd605ee95246d58974bfee8acbfa152f","observation_id":"8bcaf9d2-095f-421b-ae27-92c868321fe7","resolution":{"observed_at":"2026-05-14T20:12:55.364521Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.08819","last_updated":"2024-06-27T16:30:32Z","snapshot_observed_at":"2026-08-07T20:52:52.136811Z","submitted_at":"2024-02-20T04:13:48Z","title":"Thermometer: Towards Universal Calibration for Large Language Models","version":2},"cited_work":{"arxiv_id":"2403.08819","doi":"10.48550/arxiv.2403.08819","metadata_source":"arxiv_reference","pith_arxiv_id":"2403.08819","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Aviv Slobodkin, Omer Goldman, Avi Caciularu, Ido Dagan, and Shauli Ravfogel","venue":"arXiv (Cornell University)","work_id":"8ebd8cc8-be62-442b-ae1d-7e3e225f0818","year":2024},"citing_paper":{"arxiv_id":"2605.28778","last_updated":"2026-05-27T17:38:00Z","snapshot_observed_at":"2026-07-06T23:38:19.096349Z","submitted_at":"2026-05-27T17:38:00Z","title":"Can LLMs Use Linguistic Uncertainty Markers to Reliably Reflect Intrinsic Confidence?","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-06-29T12:18:36.854164Z"},"links":{"cited_paper":"/paper/2403.08819","citing_paper":"/paper/2605.28778"},"observation_digest":"sha256:334ab576c759b5f257b278055e33d700c81549cc2624de9b6a2c3d7d5291d516","observation_id":"b56c1917-6c4e-41e6-bc49-cd7948e331a5","resolution":{"observed_at":"2026-06-29T12:23:24.418967Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.08819","last_updated":"2024-06-27T16:30:32Z","snapshot_observed_at":"2026-08-07T20:52:52.136811Z","submitted_at":"2024-02-20T04:13:48Z","title":"Thermometer: Towards Universal Calibration for Large Language Models","version":2},"cited_work":{"arxiv_id":"2403.08819","doi":"10.48550/arxiv.2403.08819","metadata_source":"arxiv_reference","pith_arxiv_id":"2403.08819","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Aviv Slobodkin, Omer Goldman, Avi Caciularu, Ido Dagan, and Shauli Ravfogel","venue":"arXiv (Cornell University)","work_id":"8ebd8cc8-be62-442b-ae1d-7e3e225f0818","year":2024},"citing_paper":{"arxiv_id":"2606.32032","last_updated":"2026-06-30T17:56:01Z","snapshot_observed_at":"2026-07-07T00:05:41.920778Z","submitted_at":"2026-06-30T17:56:01Z","title":"Reinforcement Learning with Metacognitive Feedback Elicits Faithful Uncertainty Expression in LLMs","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-07-01T05:22:38.232552Z"},"links":{"cited_paper":"/paper/2403.08819","citing_paper":"/paper/2606.32032"},"observation_digest":"sha256:15909b167c822dcdedecbeb8c383b417164f5f49e63301a44879de9550f77e4d","observation_id":"c43a8b4a-a95e-4633-b093-607f86652094","resolution":{"observed_at":"2026-07-01T10:35:42.097153Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2403.08819/citation-record","integrity":"/paper/2403.08819/integrity","json":"/paper/2403.08819/citation-record.json","paper":"/paper/2403.08819"},"outbound":[],"paper":{"arxiv_id":"2403.08819","last_updated":"2024-06-27T16:30:32Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-07T20:52:52.136811Z","submitted_at":"2024-02-20T04:13:48Z","title":"Thermometer: Towards Universal Calibration for Large Language Models"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 12 inbound Pith citation observations for arXiv:2403.08819."}