{"as_of":"2026-08-11T13:21:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:942fca4a5e5d5fbb908f85f4712bd53907ecf93319f651a4ad647978cc55392f","coverage":[{"denominator":38,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":38,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T21:45:55.440332Z","state":"measured"},{"denominator":40,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":40,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-12T03:10:22.314719Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.03991","last_updated":"2025-01-07T18:48:42Z","snapshot_observed_at":"2026-08-10T21:39:58.316105Z","submitted_at":"2025-01-07T18:48:42Z","title":"Influences on LLM Calibration: A Study of Response Agreement, Loss Functions, and Prompt Styles","version":1},"cited_work":{"arxiv_id":"2501.03991","doi":"10.48550/arxiv.2501.03991","metadata_source":"arxiv_reference","pith_arxiv_id":"2501.03991","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Influences on","venue":"arXiv (Cornell University)","work_id":"f34cef3f-b293-4923-b684-685569772108","year":null},"citing_paper":{"arxiv_id":"2605.00195","last_updated":"2026-05-11T12:48:16Z","snapshot_observed_at":"2026-07-31T18:51:54.041588Z","submitted_at":"2026-04-30T20:20:59Z","title":"Diversity in Large Language Models under Supervised Fine-Tuning","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-05-09T20:32:37.788283Z"},"links":{"cited_paper":"/paper/2501.03991","citing_paper":"/paper/2605.00195"},"observation_digest":"sha256:c3b984f3d81f7c3cc6a38dee26588aa2952591c743a054ebf03a02b6cd36829f","observation_id":"e23a4143-c4fd-4ba1-9487-e5d342c18bc6","resolution":{"observed_at":"2026-05-09T20:37:32.184304Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03991","last_updated":"2025-01-07T18:48:42Z","snapshot_observed_at":"2026-08-10T21:39:58.316105Z","submitted_at":"2025-01-07T18:48:42Z","title":"Influences on LLM Calibration: A Study of Response Agreement, Loss Functions, and Prompt Styles","version":1},"cited_work":{"arxiv_id":"2501.03991","doi":"10.48550/arxiv.2501.03991","metadata_source":"arxiv_reference","pith_arxiv_id":"2501.03991","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Influences on","venue":"arXiv (Cornell University)","work_id":"f34cef3f-b293-4923-b684-685569772108","year":null},"citing_paper":{"arxiv_id":"2605.00195","last_updated":"2026-05-11T12:48:16Z","snapshot_observed_at":"2026-07-31T18:51:54.041588Z","submitted_at":"2026-04-30T20:20:59Z","title":"Diversity in Large Language Models under Supervised Fine-Tuning","version":2},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-05-12T03:10:22.314719Z"},"links":{"cited_paper":"/paper/2501.03991","citing_paper":"/paper/2605.00195"},"observation_digest":"sha256:1a0e117ceadff83898a2e61bbb010f52742b0a12588d755d2e536beee6bae0cf","observation_id":"1c83a074-fcde-4da3-b10c-d6ad65543441","resolution":{"observed_at":"2026-05-12T03:11:18.163273Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2501.03991/citation-record","integrity":"/paper/2501.03991/integrity","json":"/paper/2501.03991/citation-record.json","paper":"/paper/2501.03991"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2404.14219","last_updated":"2024-08-30T21:17:17Z","snapshot_observed_at":"2026-08-10T14:07:02.234322Z","submitted_at":"2024-04-22T14:32:33Z","title":"Phi-3 Technical Report: A Highly Capable Language Model Locally on Your Phone","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.14219","snapshot_observed_at":"2026-08-10T21:45:55.223260Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.03991","last_updated":"2025-01-07T18:48:42Z","snapshot_observed_at":"2026-08-10T21:39:58.316105Z","submitted_at":"2025-01-07T18:48:42Z","title":"Influences on LLM Calibration: A Study of Response Agreement, Loss Functions, and Prompt Styles","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-10T21:45:55.223260Z"},"links":{"cited_paper":"/paper/2404.14219","citing_paper":"/paper/2501.03991"},"observation_digest":"sha256:8bf3c803fd6eb67e495481dd0a070b336588874045f5c345ba752586c0f58a04","observation_id":"2437d2a3-1f25-4f30-8035-dab3d49d55f2","resolution":{"observed_at":"2026-08-10T21:45:55.223260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:45:55.231174Z","title":null,"venue":null,"work_id":null,"year":1950},"citing_paper":{"arxiv_id":"2501.03991","last_updated":"2025-01-07T18:48:42Z","snapshot_observed_at":"2026-08-10T21:39:58.316105Z","submitted_at":"2025-01-07T18:48:42Z","title":"Influences on LLM Calibration: A Study of Response Agreement, Loss Functions, and Prompt Styles","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-10T21:45:55.231174Z"},"links":{"citing_paper":"/paper/2501.03991"},"observation_digest":"sha256:8a41d65da16dbafbe93e5680028163338482741e5ef20c332a2815b5a0c51702","observation_id":"d4accea8-d40d-4512-a807-6766d7f8e59a","resolution":{"observed_at":"2026-08-10T21:45:55.231174Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.14735","last_updated":"2025-05-11T09:23:41Z","snapshot_observed_at":"2026-08-10T12:40:24.930519Z","submitted_at":"2023-10-23T09:15:18Z","title":"Unleashing the potential of prompt engineering for large language models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.14735","snapshot_observed_at":"2026-08-10T21:45:55.237824Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.03991","last_updated":"2025-01-07T18:48:42Z","snapshot_observed_at":"2026-08-10T21:39:58.316105Z","submitted_at":"2025-01-07T18:48:42Z","title":"Influences on LLM Calibration: A Study of Response Agreement, Loss Functions, and Prompt Styles","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-10T21:45:55.237824Z"},"links":{"cited_paper":"/paper/2310.14735","citing_paper":"/paper/2501.03991"},"observation_digest":"sha256:fccb5092062a4d66cfe1885638a7abfa53b20cdbf47b22ac0db52244e7decfe3","observation_id":"6fe7c2af-1b1f-4142-8d55-05f0dbd5efbf","resolution":{"observed_at":"2026-08-10T21:45:55.237824Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04805","last_updated":"2019-05-24T20:37:26Z","snapshot_observed_at":"2026-07-30T09:12:38.100527Z","submitted_at":"2018-10-11T00:50:01Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.04805","snapshot_observed_at":"2026-08-10T21:45:55.246319Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2501.03991","last_updated":"2025-01-07T18:48:42Z","snapshot_observed_at":"2026-08-10T21:39:58.316105Z","submitted_at":"2025-01-07T18:48:42Z","title":"Influences on LLM Calibration: A Study of Response Agreement, Loss Functions, and Prompt Styles","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-10T21:45:55.246319Z"},"links":{"cited_paper":"/paper/1810.04805","citing_paper":"/paper/2501.03991"},"observation_digest":"sha256:3ede52927126c2f7451fa0d9692947fbabe2f0f22a015d01ffb7c1667e36e107","observation_id":"9655f459-5a0d-4bc2-8e71-fcf3c3814996","resolution":{"observed_at":"2026-08-10T21:45:55.246319Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:45:56.265689Z","title":null,"venue":null,"work_id":"d3f015cd-5acf-4b98-9568-eae3eeb9a0bf","year":2017},"citing_paper":{"arxiv_id":"2501.03991","last_updated":"2025-01-07T18:48:42Z","snapshot_observed_at":"2026-08-10T21:39:58.316105Z","submitted_at":"2025-01-07T18:48:42Z","title":"Influences on LLM Calibration: A Study of Response Agreement, Loss Functions, and Prompt Styles","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-10T21:45:55.254079Z"},"links":{"citing_paper":"/paper/2501.03991"},"observation_digest":"sha256:3fd737b0072e916aa4e8e1b06458e842112fe9eb97f151e24bc75782ec6af595","observation_id":"977b23d0-960d-4453-abd3-0df00bb25af4","resolution":{"observed_at":"2026-08-10T21:45:56.271323Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:45:55.260066Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.03991","last_updated":"2025-01-07T18:48:42Z","snapshot_observed_at":"2026-08-10T21:39:58.316105Z","submitted_at":"2025-01-07T18:48:42Z","title":"Influences on LLM Calibration: A Study of Response Agreement, Loss Functions, and Prompt Styles","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-10T21:45:55.260066Z"},"links":{"citing_paper":"/paper/2501.03991"},"observation_digest":"sha256:0b8a572642b227a5ed7196564472b50ea51a453efd806c6fefe78a056ddd6d01","observation_id":"18b1d759-3c19-4c63-9ea9-c89897dd98bf","resolution":{"observed_at":"2026-08-10T21:45:55.260066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-10T16:40:37.411115Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-10T21:45:55.266290Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.03991","last_updated":"2025-01-07T18:48:42Z","snapshot_observed_at":"2026-08-10T21:39:58.316105Z","submitted_at":"2025-01-07T18:48:42Z","title":"Influences on LLM Calibration: A Study of Response Agreement, Loss Functions, and Prompt Styles","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-10T21:45:55.266290Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2501.03991"},"observation_digest":"sha256:ed71f2e22fb2faa39f0e3b3654ce6b3fa0b797564a45b9d9886aebf60724eb03","observation_id":"363c05d4-b30c-44fe-90be-f9457651271b","resolution":{"observed_at":"2026-08-10T21:45:55.266290Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:45:56.224040Z","title":"Weinberger","venue":null,"work_id":"214afc15-3820-43c8-ae1b-aa2dec82adf8","year":2017},"citing_paper":{"arxiv_id":"2501.03991","last_updated":"2025-01-07T18:48:42Z","snapshot_observed_at":"2026-08-10T21:39:58.316105Z","submitted_at":"2025-01-07T18:48:42Z","title":"Influences on LLM Calibration: A Study of Response Agreement, Loss Functions, and Prompt Styles","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-10T21:45:55.273080Z"},"links":{"citing_paper":"/paper/2501.03991"},"observation_digest":"sha256:863724f0c170064bab16ee05138eb2c4b4aaa1368f6a25d63f6c3d695be67626","observation_id":"93975104-9ac5-4b2b-af92-4c63caedd451","resolution":{"observed_at":"2026-08-10T21:45:56.229309Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:45:55.279578Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.03991","last_updated":"2025-01-07T18:48:42Z","snapshot_observed_at":"2026-08-10T21:39:58.316105Z","submitted_at":"2025-01-07T18:48:42Z","title":"Influences on LLM Calibration: A Study of Response Agreement, Loss Functions, and Prompt Styles","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-10T21:45:55.279578Z"},"links":{"citing_paper":"/paper/2501.03991"},"observation_digest":"sha256:247502e3bb1c23d6f1762a6c75e7ea47f0de5a2454f92a33f0fcbfe627259789","observation_id":"da6b8bd1-9adf-44ba-9e19-0a974c85cf97","resolution":{"observed_at":"2026-08-10T21:45:55.279578Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.04088","last_updated":"2024-01-08T18:47:34Z","snapshot_observed_at":"2026-08-08T06:16:25.839566Z","submitted_at":"2024-01-08T18:47:34Z","title":"Mixtral of Experts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.04088","snapshot_observed_at":"2026-08-10T21:45:55.285607Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.03991","last_updated":"2025-01-07T18:48:42Z","snapshot_observed_at":"2026-08-10T21:39:58.316105Z","submitted_at":"2025-01-07T18:48:42Z","title":"Influences on LLM Calibration: A Study of Response Agreement, Loss Functions, and Prompt Styles","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-10T21:45:55.285607Z"},"links":{"cited_paper":"/paper/2401.04088","citing_paper":"/paper/2501.03991"},"observation_digest":"sha256:574f0467f295ea1066720553dc9ec1c788564ca80fadef6cf1358fe9687d96a7","observation_id":"82d3a353-8b65-4b43-8054-ee8a490139cc","resolution":{"observed_at":"2026-08-10T21:45:55.285607Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:45:55.291623Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.03991","last_updated":"2025-01-07T18:48:42Z","snapshot_observed_at":"2026-08-10T21:39:58.316105Z","submitted_at":"2025-01-07T18:48:42Z","title":"Influences on LLM Calibration: A Study of Response Agreement, Loss Functions, and Prompt Styles","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-10T21:45:55.291623Z"},"links":{"citing_paper":"/paper/2501.03991"},"observation_digest":"sha256:66018aa4bc10c5fecb47c0e8f452b05b8a7ecf3030ed1f81db21e5ef337c5460","observation_id":"b4be6e2f-c567-4069-a37c-74949b1e0b61","resolution":{"observed_at":"2026-08-10T21:45:55.291623Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06209","last_updated":"2017-07-19T17:28:46Z","snapshot_observed_at":"2026-08-06T06:05:27.671303Z","submitted_at":"2017-07-19T17:28:46Z","title":"Crowdsourcing Multiple Choice Science Questions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06209","snapshot_observed_at":"2026-08-10T21:45:55.296875Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.03991","last_updated":"2025-01-07T18:48:42Z","snapshot_observed_at":"2026-08-10T21:39:58.316105Z","submitted_at":"2025-01-07T18:48:42Z","title":"Influences on LLM Calibration: A Study of Response Agreement, Loss Functions, and Prompt Styles","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-10T21:45:55.296875Z"},"links":{"cited_paper":"/paper/1707.06209","citing_paper":"/paper/2501.03991"},"observation_digest":"sha256:13dbc7b5f6596ec69cc8fd91cc971e2ca15ee4295ac1d400a587a5299b54faaf","observation_id":"b6fd4399-7601-495f-87fb-6ccacd27f204","resolution":{"observed_at":"2026-08-10T21:45:55.296875Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:45:55.302037Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.03991","last_updated":"2025-01-07T18:48:42Z","snapshot_observed_at":"2026-08-10T21:39:58.316105Z","submitted_at":"2025-01-07T18:48:42Z","title":"Influences on LLM Calibration: A Study of Response Agreement, Loss Functions, and Prompt Styles","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-10T21:45:55.302037Z"},"links":{"citing_paper":"/paper/2501.03991"},"observation_digest":"sha256:bfc0c1148d2199b177cdd8ff2b9f7c807ec92948ab5cf26dc5cc6304a0958262","observation_id":"134f8437-793e-4540-a239-9cdf0ac97f70","resolution":{"observed_at":"2026-08-10T21:45:55.302037Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2023.findings-eacl.40","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:45:55.554793Z","title":null,"venue":null,"work_id":"124063aa-c2fe-42b1-9e9d-92a5a50c418d","year":2023},"citing_paper":{"arxiv_id":"2501.03991","last_updated":"2025-01-07T18:48:42Z","snapshot_observed_at":"2026-08-10T21:39:58.316105Z","submitted_at":"2025-01-07T18:48:42Z","title":"Influences on LLM Calibration: A Study of Response Agreement, Loss Functions, and Prompt Styles","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-10T21:45:55.307831Z"},"links":{"citing_paper":"/paper/2501.03991"},"observation_digest":"sha256:fc53a9df732b4c8d33c2616d6abb14c2969138a301256a53d09b0c6028eaf9f4","observation_id":"ebaccc24-93fa-4d61-99c7-0d4886b80ac2","resolution":{"observed_at":"2026-08-10T21:45:55.564236Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.01535","last_updated":"2024-12-04T19:23:17Z","snapshot_observed_at":"2026-08-06T22:44:08.607902Z","submitted_at":"2024-05-02T17:59:35Z","title":"Prometheus 2: An Open Source Language Model Specialized in Evaluating Other Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.01535","snapshot_observed_at":"2026-08-10T21:45:55.313121Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.03991","last_updated":"2025-01-07T18:48:42Z","snapshot_observed_at":"2026-08-10T21:39:58.316105Z","submitted_at":"2025-01-07T18:48:42Z","title":"Influences on LLM Calibration: A Study of Response Agreement, Loss Functions, and Prompt Styles","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-10T21:45:55.313121Z"},"links":{"cited_paper":"/paper/2405.01535","citing_paper":"/paper/2501.03991"},"observation_digest":"sha256:71731dd71e2386651faa82af7ab9abeb64eb14c4895bca0442657d2ffb924901","observation_id":"c065bc01-aca6-499e-9fdd-dfc70ec4dbf6","resolution":{"observed_at":"2026-08-10T21:45:55.313121Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:45:55.318696Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2501.03991","last_updated":"2025-01-07T18:48:42Z","snapshot_observed_at":"2026-08-10T21:39:58.316105Z","submitted_at":"2025-01-07T18:48:42Z","title":"Influences on LLM Calibration: A Study of Response Agreement, Loss Functions, and Prompt Styles","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-10T21:45:55.318696Z"},"links":{"citing_paper":"/paper/2501.03991"},"observation_digest":"sha256:383b58c88634b54ede98f205cceb208770efe732d0aa6ca1fff949465ed438dc","observation_id":"e7fd3ae0-bc93-4cdb-ae68-e9540c7f249f","resolution":{"observed_at":"2026-08-10T21:45:55.318696Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:45:55.324814Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.03991","last_updated":"2025-01-07T18:48:42Z","snapshot_observed_at":"2026-08-10T21:39:58.316105Z","submitted_at":"2025-01-07T18:48:42Z","title":"Influences on LLM Calibration: A Study of Response Agreement, Loss Functions, and Prompt Styles","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-10T21:45:55.324814Z"},"links":{"citing_paper":"/paper/2501.03991"},"observation_digest":"sha256:abdeb46d86d8e88db91ede00ba53353b665e2f90ad6d84a8adb0aa97d510f867","observation_id":"3dd76152-0712-44d3-ad7d-3194c91e4685","resolution":{"observed_at":"2026-08-10T21:45:55.324814Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:45:55.330193Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.03991","last_updated":"2025-01-07T18:48:42Z","snapshot_observed_at":"2026-08-10T21:39:58.316105Z","submitted_at":"2025-01-07T18:48:42Z","title":"Influences on LLM Calibration: A Study of Response Agreement, Loss Functions, and Prompt Styles","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-10T21:45:55.330193Z"},"links":{"citing_paper":"/paper/2501.03991"},"observation_digest":"sha256:2dd3d3219b51287b406aa1f4ab10877eb84299286d01f5fd4d612dd7aa1f0867","observation_id":"28d3090a-ccab-4bab-853d-278f878b076f","resolution":{"observed_at":"2026-08-10T21:45:55.330193Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19208","last_updated":"2024-03-13T05:11:57Z","snapshot_observed_at":"2026-08-09T12:55:13.317965Z","submitted_at":"2023-10-30T00:30:34Z","title":"LitCab: Lightweight Language Model Calibration over Short- and Long-form Responses","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.19208","snapshot_observed_at":"2026-08-10T21:45:55.335235Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.03991","last_updated":"2025-01-07T18:48:42Z","snapshot_observed_at":"2026-08-10T21:39:58.316105Z","submitted_at":"2025-01-07T18:48:42Z","title":"Influences on LLM Calibration: A Study of Response Agreement, Loss Functions, and Prompt Styles","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-10T21:45:55.335235Z"},"links":{"cited_paper":"/paper/2310.19208","citing_paper":"/paper/2501.03991"},"observation_digest":"sha256:205945384d9d40c5c863e5285a6b0bae04029805f4cbe159b2acf6a95fa221c0","observation_id":"9ef77ced-f288-44a3-80b1-730665737ce7","resolution":{"observed_at":"2026-08-10T21:45:55.335235Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:45:55.340506Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.03991","last_updated":"2025-01-07T18:48:42Z","snapshot_observed_at":"2026-08-10T21:39:58.316105Z","submitted_at":"2025-01-07T18:48:42Z","title":"Influences on LLM Calibration: A Study of Response Agreement, Loss Functions, and Prompt Styles","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-10T21:45:55.340506Z"},"links":{"citing_paper":"/paper/2501.03991"},"observation_digest":"sha256:7aa9e7cc2070101fea7b3a92c1eebefd8c2a31d97b4a4ec25cf0434bff924ca4","observation_id":"372df8b3-dd6e-4c24-ad8d-dcd4bcf7af54","resolution":{"observed_at":"2026-08-10T21:45:55.340506Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:45:56.125646Z","title":null,"venue":null,"work_id":"901ec109-d981-40b1-b619-12751bf0f2e1","year":2020},"citing_paper":{"arxiv_id":"2501.03991","last_updated":"2025-01-07T18:48:42Z","snapshot_observed_at":"2026-08-10T21:39:58.316105Z","submitted_at":"2025-01-07T18:48:42Z","title":"Influences on LLM Calibration: A Study of Response Agreement, Loss Functions, and Prompt Styles","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-10T21:45:55.345545Z"},"links":{"citing_paper":"/paper/2501.03991"},"observation_digest":"sha256:5e1adb7505674e179d0cc1289773c2fca966addc1a3e3003ac58818c42c14e0d","observation_id":"07db8076-e51c-4e73-8c41-08e2a516f43d","resolution":{"observed_at":"2026-08-10T21:45:56.130568Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:45:55.349813Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.03991","last_updated":"2025-01-07T18:48:42Z","snapshot_observed_at":"2026-08-10T21:39:58.316105Z","submitted_at":"2025-01-07T18:48:42Z","title":"Influences on LLM Calibration: A Study of Response Agreement, Loss Functions, and Prompt Styles","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-10T21:45:55.349813Z"},"links":{"citing_paper":"/paper/2501.03991"},"observation_digest":"sha256:dc4b6401df11472361e99fff98b6e8a1829d0d0eb3d46d3c986661560cc006f5","observation_id":"dad6e6fa-fff3-4fb9-859d-998ddbae3248","resolution":{"observed_at":"2026-08-10T21:45:55.349813Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.09773","last_updated":"2024-08-19T08:01:11Z","snapshot_observed_at":"2026-08-07T02:37:14.627726Z","submitted_at":"2024-08-19T08:01:11Z","title":"Are Large Language Models More Honest in Their Probabilistic or Verbalized Confidence?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.09773","snapshot_observed_at":"2026-08-10T21:45:55.353869Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.03991","last_updated":"2025-01-07T18:48:42Z","snapshot_observed_at":"2026-08-10T21:39:58.316105Z","submitted_at":"2025-01-07T18:48:42Z","title":"Influences on LLM Calibration: A Study of Response Agreement, Loss Functions, and Prompt Styles","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-10T21:45:55.353869Z"},"links":{"cited_paper":"/paper/2408.09773","citing_paper":"/paper/2501.03991"},"observation_digest":"sha256:977cb9bcb161091bcc415909e1a8a4300a6cff33aebd04fce8a52c02121b1f9e","observation_id":"75e18df9-c47d-42a1-bab0-bab40123489a","resolution":{"observed_at":"2026-08-10T21:45:55.353869Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:45:56.099113Z","title":null,"venue":null,"work_id":"f37e37da-ccc3-49e3-b134-19f145c7f4b4","year":1999},"citing_paper":{"arxiv_id":"2501.03991","last_updated":"2025-01-07T18:48:42Z","snapshot_observed_at":"2026-08-10T21:39:58.316105Z","submitted_at":"2025-01-07T18:48:42Z","title":"Influences on LLM Calibration: A Study of Response Agreement, Loss Functions, and Prompt Styles","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-10T21:45:55.358561Z"},"links":{"citing_paper":"/paper/2501.03991"},"observation_digest":"sha256:cdecaba0970b3e2670d6eab2945594579bd0611d1573a800a4f31127327b0cb6","observation_id":"80b879ff-c89a-44b4-b2e4-181cbc11883e","resolution":{"observed_at":"2026-08-10T21:45:56.104511Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:45:56.084134Z","title":null,"venue":null,"work_id":"57c5c24a-b1d9-4a12-85f9-eb440488a254","year":2020},"citing_paper":{"arxiv_id":"2501.03991","last_updated":"2025-01-07T18:48:42Z","snapshot_observed_at":"2026-08-10T21:39:58.316105Z","submitted_at":"2025-01-07T18:48:42Z","title":"Influences on LLM Calibration: A Study of Response Agreement, Loss Functions, and Prompt Styles","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-10T21:45:55.362780Z"},"links":{"citing_paper":"/paper/2501.03991"},"observation_digest":"sha256:0af910f7675d4e6af98ef0037038e4ca07d521868c8de74dc3dc737832a97ab9","observation_id":"861caf24-c6bd-4b84-9189-ba350bda04df","resolution":{"observed_at":"2026-08-10T21:45:56.088795Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-10T21:45:55.367568Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.03991","last_updated":"2025-01-07T18:48:42Z","snapshot_observed_at":"2026-08-10T21:39:58.316105Z","submitted_at":"2025-01-07T18:48:42Z","title":"Influences on LLM Calibration: A Study of Response Agreement, Loss Functions, and Prompt Styles","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-10T21:45:55.367568Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2501.03991"},"observation_digest":"sha256:89d40f6284d3ea22326a341232e01ac687158ce0ed422fb86f8c0f5ee63d0ad7","observation_id":"70da037e-6b04-43f2-8887-60240f1d9332","resolution":{"observed_at":"2026-08-10T21:45:55.367568Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:45:55.372940Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.03991","last_updated":"2025-01-07T18:48:42Z","snapshot_observed_at":"2026-08-10T21:39:58.316105Z","submitted_at":"2025-01-07T18:48:42Z","title":"Influences on LLM Calibration: A Study of Response Agreement, Loss Functions, and Prompt Styles","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-10T21:45:55.372940Z"},"links":{"citing_paper":"/paper/2501.03991"},"observation_digest":"sha256:3fde1b8cd826548260e7d5163d697ff8e954ed4731cf1f095f9d0270712dbe28","observation_id":"69d81529-fee0-4dc7-acd6-c91bafa35aa4","resolution":{"observed_at":"2026-08-10T21:45:55.372940Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-10T21:45:55.378290Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.03991","last_updated":"2025-01-07T18:48:42Z","snapshot_observed_at":"2026-08-10T21:39:58.316105Z","submitted_at":"2025-01-07T18:48:42Z","title":"Influences on LLM Calibration: A Study of Response Agreement, Loss Functions, and Prompt Styles","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-10T21:45:55.378290Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2501.03991"},"observation_digest":"sha256:818368bca984e7c6ec842cce459149e1736580a8f42fe1dc9aa7c4e9e04b9fae","observation_id":"366aef7f-7944-4f1b-b868-6b5d828a89e9","resolution":{"observed_at":"2026-08-10T21:45:55.378290Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:45:55.387807Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.03991","last_updated":"2025-01-07T18:48:42Z","snapshot_observed_at":"2026-08-10T21:39:58.316105Z","submitted_at":"2025-01-07T18:48:42Z","title":"Influences on LLM Calibration: A Study of Response Agreement, Loss Functions, and Prompt Styles","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-10T21:45:55.387807Z"},"links":{"citing_paper":"/paper/2501.03991"},"observation_digest":"sha256:ca8f8d80b2f91ec2479e8f5edf45d299eb1e5a035dddcbc666e2c672d8416bc2","observation_id":"6dd64b09-9785-4ce2-871a-99066fc79a19","resolution":{"observed_at":"2026-08-10T21:45:55.387807Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:45:56.065594Z","title":null,"venue":null,"work_id":"81823051-1058-42f6-bd83-7ba30e5d9b49","year":2023},"citing_paper":{"arxiv_id":"2501.03991","last_updated":"2025-01-07T18:48:42Z","snapshot_observed_at":"2026-08-10T21:39:58.316105Z","submitted_at":"2025-01-07T18:48:42Z","title":"Influences on LLM Calibration: A Study of Response Agreement, Loss Functions, and Prompt Styles","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-10T21:45:55.393570Z"},"links":{"citing_paper":"/paper/2501.03991"},"observation_digest":"sha256:e3c1335a90ceaef59720283e2812d4d4efeaf5c2baff9ca75de7bc49d97f042b","observation_id":"5e0abe4a-1789-4269-8252-b65a78c52366","resolution":{"observed_at":"2026-08-10T21:45:56.072357Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:45:55.399566Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.03991","last_updated":"2025-01-07T18:48:42Z","snapshot_observed_at":"2026-08-10T21:39:58.316105Z","submitted_at":"2025-01-07T18:48:42Z","title":"Influences on LLM Calibration: A Study of Response Agreement, Loss Functions, and Prompt Styles","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-10T21:45:55.399566Z"},"links":{"citing_paper":"/paper/2501.03991"},"observation_digest":"sha256:690247d3a9172473c2137590b5fea276bda13c2a1bb5c1360a3dfd06d8d73d99","observation_id":"c2e6744a-f9d1-4f49-b42c-d932526ee4ca","resolution":{"observed_at":"2026-08-10T21:45:55.399566Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.13063","last_updated":"2024-03-17T04:38:48Z","snapshot_observed_at":"2026-07-06T15:45:39.649725Z","submitted_at":"2023-06-22T17:31:44Z","title":"Can LLMs Express Their Uncertainty? An Empirical Evaluation of Confidence Elicitation in LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.13063","snapshot_observed_at":"2026-08-10T21:45:55.405417Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.03991","last_updated":"2025-01-07T18:48:42Z","snapshot_observed_at":"2026-08-10T21:39:58.316105Z","submitted_at":"2025-01-07T18:48:42Z","title":"Influences on LLM Calibration: A Study of Response Agreement, Loss Functions, and Prompt Styles","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-10T21:45:55.405417Z"},"links":{"cited_paper":"/paper/2306.13063","citing_paper":"/paper/2501.03991"},"observation_digest":"sha256:648ea91777ed86c7ed929b691a58dec4834d35d1c43dd48d5d6f00b2862ce118","observation_id":"9eb3183a-f463-4224-a7f9-498e8e1e4d67","resolution":{"observed_at":"2026-08-10T21:45:55.405417Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10671","last_updated":"2024-09-10T13:25:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-07-15T12:35:42Z","title":"Qwen2 Technical Report","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10671","snapshot_observed_at":"2026-08-10T21:45:55.411727Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.03991","last_updated":"2025-01-07T18:48:42Z","snapshot_observed_at":"2026-08-10T21:39:58.316105Z","submitted_at":"2025-01-07T18:48:42Z","title":"Influences on LLM Calibration: A Study of Response Agreement, Loss Functions, and Prompt Styles","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-10T21:45:55.411727Z"},"links":{"cited_paper":"/paper/2407.10671","citing_paper":"/paper/2501.03991"},"observation_digest":"sha256:72d63cca6cec43ccc22835a177e80290651d079a9765ccfda6c660c172bd6d31","observation_id":"7f1e3389-1cde-4c35-9e7f-39ce8b4296ed","resolution":{"observed_at":"2026-08-10T21:45:55.411727Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:45:55.418252Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2501.03991","last_updated":"2025-01-07T18:48:42Z","snapshot_observed_at":"2026-08-10T21:39:58.316105Z","submitted_at":"2025-01-07T18:48:42Z","title":"Influences on LLM Calibration: A Study of Response Agreement, Loss Functions, and Prompt Styles","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-10T21:45:55.418252Z"},"links":{"citing_paper":"/paper/2501.03991"},"observation_digest":"sha256:76ef21e8d72e5b83927a78d877a4719796becd33d736264adb29fbeed633526c","observation_id":"57e8619a-f0e9-43e9-a684-5692d682f9b7","resolution":{"observed_at":"2026-08-10T21:45:55.418252Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:45:55.423444Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.03991","last_updated":"2025-01-07T18:48:42Z","snapshot_observed_at":"2026-08-10T21:39:58.316105Z","submitted_at":"2025-01-07T18:48:42Z","title":"Influences on LLM Calibration: A Study of Response Agreement, Loss Functions, and Prompt Styles","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-10T21:45:55.423444Z"},"links":{"citing_paper":"/paper/2501.03991"},"observation_digest":"sha256:001c84341815e0a47a77cbd8b607195dec167948b1d7739635bbeb1db9e19cca","observation_id":"85412576-37ee-46f4-952a-f5af7f6e1603","resolution":{"observed_at":"2026-08-10T21:45:55.423444Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:45:55.428399Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.03991","last_updated":"2025-01-07T18:48:42Z","snapshot_observed_at":"2026-08-10T21:39:58.316105Z","submitted_at":"2025-01-07T18:48:42Z","title":"Influences on LLM Calibration: A Study of Response Agreement, Loss Functions, and Prompt Styles","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-10T21:45:55.428399Z"},"links":{"citing_paper":"/paper/2501.03991"},"observation_digest":"sha256:965e90a86028389b8685364cdd138925d71e3d09928f06f214de887bf257fdd3","observation_id":"e6299e48-8543-4707-871c-c69a9962124b","resolution":{"observed_at":"2026-08-10T21:45:55.428399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:45:55.434586Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.03991","last_updated":"2025-01-07T18:48:42Z","snapshot_observed_at":"2026-08-10T21:39:58.316105Z","submitted_at":"2025-01-07T18:48:42Z","title":"Influences on LLM Calibration: A Study of Response Agreement, Loss Functions, and Prompt Styles","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-10T21:45:55.434586Z"},"links":{"citing_paper":"/paper/2501.03991"},"observation_digest":"sha256:7d1953b24c7b03ba7cc7b7d703154b5d27219d623cd9ad6ad9af49e5a80fb03b","observation_id":"e9d2127f-85c6-4a37-92af-0b03ad31f6c6","resolution":{"observed_at":"2026-08-10T21:45:55.434586Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:45:55.440332Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.03991","last_updated":"2025-01-07T18:48:42Z","snapshot_observed_at":"2026-08-10T21:39:58.316105Z","submitted_at":"2025-01-07T18:48:42Z","title":"Influences on LLM Calibration: A Study of Response Agreement, Loss Functions, and Prompt Styles","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-10T21:45:55.440332Z"},"links":{"citing_paper":"/paper/2501.03991"},"observation_digest":"sha256:377ea9dc1b46a1f201d4c97956f7a2063e7c5dec0aeef97c38a810638f76fdc3","observation_id":"064d0475-4941-4b4c-bc54-af5ad6faeda5","resolution":{"observed_at":"2026-08-10T21:45:55.440332Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2501.03991","last_updated":"2025-01-07T18:48:42Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-10T21:39:58.316105Z","submitted_at":"2025-01-07T18:48:42Z","title":"Influences on LLM Calibration: A Study of Response Agreement, Loss Functions, and Prompt Styles"},"reference_resolution":{"displayed":38,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":36,"verified_exact":1,"verified_fuzzy":1},"total_outbound_references":38},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 38 of 38 outbound references and 2 inbound Pith citation observations for arXiv:2501.03991."}