{"as_of":"2026-08-07T22:37:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e73717536782d661dfc86de59963c6ee717c9af1a95d800bc7ee36c4ddc1c795","coverage":[{"denominator":20,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":20,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:44:15.178000Z","state":"measured"},{"denominator":20,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":20,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.00072/citation-record","integrity":"/paper/2506.00072/integrity","json":"/paper/2506.00072/citation-record.json","paper":"/paper/2506.00072"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:44:13.407078Z","title":"Prompt engineering in consistency and reliability with the evidence -based guideline for LLMs,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00072","last_updated":"2025-05-29T17:13:26Z","snapshot_observed_at":"2026-08-07T12:38:03.915535Z","submitted_at":"2025-05-29T17:13:26Z","title":"Evaluating Prompt Engineering Techniques for Accuracy and Confidence Elicitation in Medical LLMs","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T12:44:13.407078Z"},"links":{"citing_paper":"/paper/2506.00072"},"observation_digest":"sha256:3c46e551aedc758ffbe7a7ba812d8779e057520535b39ee3fdae6c0fd512d824","observation_id":"321d4570-e7c0-4881-8276-0ef8610a301e","resolution":{"observed_at":"2026-08-07T12:44:13.407078Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.13081","last_updated":"2020-09-28T05:07:51Z","snapshot_observed_at":"2026-08-06T03:17:52.286711Z","submitted_at":"2020-09-28T05:07:51Z","title":"What Disease does this Patient Have? A Large-scale Open Domain Question Answering Dataset from Medical Exams","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.13081","snapshot_observed_at":"2026-08-07T12:44:13.493701Z","title":"What Disease does this Patient Have? A Large-scale Open Domain Question Answering Dataset from Medical Exams,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.00072","last_updated":"2025-05-29T17:13:26Z","snapshot_observed_at":"2026-08-07T12:38:03.915535Z","submitted_at":"2025-05-29T17:13:26Z","title":"Evaluating Prompt Engineering Techniques for Accuracy and Confidence Elicitation in Medical LLMs","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T12:44:13.493701Z"},"links":{"cited_paper":"/paper/2009.13081","citing_paper":"/paper/2506.00072"},"observation_digest":"sha256:8799c6fff8260b9903f84c6cbb2a369db2031b48edb75524625299ce20fe94fd","observation_id":"11292c54-d12b-46cc-a6a2-f842c2fb2cc2","resolution":{"observed_at":"2026-08-07T12:44:13.493701Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.05221","last_updated":"2022-11-21T16:38:35Z","snapshot_observed_at":"2026-08-06T08:34:11.887259Z","submitted_at":"2022-07-11T22:59:39Z","title":"Language Models (Mostly) Know What They Know","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.05221","snapshot_observed_at":"2026-08-07T12:44:13.558826Z","title":"Language Models (Mostly) Know What They Know,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.00072","last_updated":"2025-05-29T17:13:26Z","snapshot_observed_at":"2026-08-07T12:38:03.915535Z","submitted_at":"2025-05-29T17:13:26Z","title":"Evaluating Prompt Engineering Techniques for Accuracy and Confidence Elicitation in Medical LLMs","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T12:44:13.558826Z"},"links":{"cited_paper":"/paper/2207.05221","citing_paper":"/paper/2506.00072"},"observation_digest":"sha256:334eddbe87ca895b037b38f07131940a0107535ac2c0a58243d3d73ca9ffcb56","observation_id":"61cf2c04-a9ec-46f8-8751-a16c5bab99ca","resolution":{"observed_at":"2026-08-07T12:44:13.558826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.13063","last_updated":"2024-03-17T04:38:48Z","snapshot_observed_at":"2026-07-06T15:45:39.649725Z","submitted_at":"2023-06-22T17:31:44Z","title":"Can LLMs Express Their Uncertainty? An Empirical Evaluation of Confidence Elicitation in LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.13063","snapshot_observed_at":"2026-08-07T12:44:13.653907Z","title":"Can LLMs Express Their Uncertainty? An Empirical Evaluation of Con- fidence Elicitation in LLMs,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00072","last_updated":"2025-05-29T17:13:26Z","snapshot_observed_at":"2026-08-07T12:38:03.915535Z","submitted_at":"2025-05-29T17:13:26Z","title":"Evaluating Prompt Engineering Techniques for Accuracy and Confidence Elicitation in Medical LLMs","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T12:44:13.653907Z"},"links":{"cited_paper":"/paper/2306.13063","citing_paper":"/paper/2506.00072"},"observation_digest":"sha256:81e099c77e8aabe798e47c5072bb683a1ad06e9e9a38895afeb0b157bcbce60f","observation_id":"07a4576b-f33d-498c-a98c-fff796ad2d6f","resolution":{"observed_at":"2026-08-07T12:44:13.653907Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:44:15.983528Z","title":"Do Language Models Know When They’re Hallucinating References?","venue":null,"work_id":"26d41795-f2a6-4aff-b847-eec8252f283a","year":null},"citing_paper":{"arxiv_id":"2506.00072","last_updated":"2025-05-29T17:13:26Z","snapshot_observed_at":"2026-08-07T12:38:03.915535Z","submitted_at":"2025-05-29T17:13:26Z","title":"Evaluating Prompt Engineering Techniques for Accuracy and Confidence Elicitation in Medical LLMs","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T12:44:13.775387Z"},"links":{"citing_paper":"/paper/2506.00072"},"observation_digest":"sha256:f98eca05487693ee5464a8bbd8149609e3cbecf75f06c78831c64fb2c38105ce","observation_id":"732f8f56-37d2-48f7-be30-0647762929f5","resolution":{"observed_at":"2026-08-07T12:44:16.083415Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:44:15.829787Z","title":"To Believe or Not to Believe Your LLM: Iterative Prompting for Estimating Epistemic Uncertainty","venue":null,"work_id":"c52d618c-3ded-4432-9601-8daeeeef1197","year":null},"citing_paper":{"arxiv_id":"2506.00072","last_updated":"2025-05-29T17:13:26Z","snapshot_observed_at":"2026-08-07T12:38:03.915535Z","submitted_at":"2025-05-29T17:13:26Z","title":"Evaluating Prompt Engineering Techniques for Accuracy and Confidence Elicitation in Medical LLMs","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T12:44:13.913584Z"},"links":{"citing_paper":"/paper/2506.00072"},"observation_digest":"sha256:98c2ea9e7ea1b98f484a6cf1d64eb8018a0ef0175a6aa47c7a74fab827db0821","observation_id":"e9d771cd-bba3-4ecc-8608-541524ab3ee3","resolution":{"observed_at":"2026-08-07T12:44:15.897714Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.12334","last_updated":"2025-08-23T18:44:57Z","snapshot_observed_at":"2026-07-06T18:32:44.452493Z","submitted_at":"2024-06-18T06:59:24Z","title":"What Did I Do Wrong? Quantifying LLMs' Sensitivity and Consistency to Prompt Engineering","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.12334","snapshot_observed_at":"2026-08-07T12:44:14.027058Z","title":"What Did I Do Wrong? Quantifying LLMs’ Sensitivity and Consistency to Prompt Engineering,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.00072","last_updated":"2025-05-29T17:13:26Z","snapshot_observed_at":"2026-08-07T12:38:03.915535Z","submitted_at":"2025-05-29T17:13:26Z","title":"Evaluating Prompt Engineering Techniques for Accuracy and Confidence Elicitation in Medical LLMs","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T12:44:14.027058Z"},"links":{"cited_paper":"/paper/2406.12334","citing_paper":"/paper/2506.00072"},"observation_digest":"sha256:87309078c88462be769b373e2dd8fc46c3325a57d80516a1d254d160b5bd2275","observation_id":"4f02dd20-f97d-4038-8f17-d0972a1d0d27","resolution":{"observed_at":"2026-08-07T12:44:14.027058Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.02964","last_updated":"2024-08-07T18:50:48Z","snapshot_observed_at":"2026-07-06T18:57:18.298332Z","submitted_at":"2024-08-06T05:21:13Z","title":"Accuracy and Consistency of LLMs in the Registered Dietitian Exam: The Impact of Prompt Engineering and Knowledge Retrieval","version":2},"cited_work":{"arxiv_id":"2408.02964","doi":"10.48550/arxiv.2408.02964","metadata_source":"pith","pith_arxiv_id":"2408.02964","snapshot_observed_at":"2026-08-07T18:16:16.850658Z","title":"Accuracy and Consistency of LLMs in the Registered Dietitian Exam: The Impact of Prompt Engineering and Knowledge Retrieval","venue":"cs.CL","work_id":"437d2316-6e2c-436b-b4d5-236051b6e0e4","year":2024},"citing_paper":{"arxiv_id":"2506.00072","last_updated":"2025-05-29T17:13:26Z","snapshot_observed_at":"2026-08-07T12:38:03.915535Z","submitted_at":"2025-05-29T17:13:26Z","title":"Evaluating Prompt Engineering Techniques for Accuracy and Confidence Elicitation in Medical LLMs","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T12:44:14.129677Z"},"links":{"cited_paper":"/paper/2408.02964","citing_paper":"/paper/2506.00072"},"observation_digest":"sha256:3d273f4651d9d56b03f8a98c80850ee3ee7f09026d0d3c7b2938ffedac8f6278","observation_id":"f8b311c8-fed6-4e90-923c-0aa4fe80bae4","resolution":{"observed_at":"2026-08-07T12:44:15.555435Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.13907","last_updated":"2024-06-16T13:49:53Z","snapshot_observed_at":"2026-07-06T18:18:07.839497Z","submitted_at":"2024-05-22T18:28:26Z","title":"Just rephrase it! Uncertainty estimation in closed-source language models via multiple rephrased queries","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.13907","snapshot_observed_at":"2026-08-07T12:44:14.228184Z","title":"Just rephrase it! Uncertainty estimation in closed -source language models via multiple rephrased queries,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00072","last_updated":"2025-05-29T17:13:26Z","snapshot_observed_at":"2026-08-07T12:38:03.915535Z","submitted_at":"2025-05-29T17:13:26Z","title":"Evaluating Prompt Engineering Techniques for Accuracy and Confidence Elicitation in Medical LLMs","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T12:44:14.228184Z"},"links":{"cited_paper":"/paper/2405.13907","citing_paper":"/paper/2506.00072"},"observation_digest":"sha256:55c4702c30c1b74bab08bbb9fcf83b094073a458f32e9edf17bf7fad133829a0","observation_id":"5b7c87c0-0b91-4d7c-8e50-625dbf891d66","resolution":{"observed_at":"2026-08-07T12:44:14.228184Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.03441","last_updated":"2024-06-05T16:35:30Z","snapshot_observed_at":"2026-08-07T17:32:53.203831Z","submitted_at":"2024-06-05T16:35:30Z","title":"Cycles of Thought: Measuring LLM Confidence through Stable Explanations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.03441","snapshot_observed_at":"2026-08-07T12:44:14.335426Z","title":"Cycles of Thought: Measuring LLM Confidence through Stable Explanations,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00072","last_updated":"2025-05-29T17:13:26Z","snapshot_observed_at":"2026-08-07T12:38:03.915535Z","submitted_at":"2025-05-29T17:13:26Z","title":"Evaluating Prompt Engineering Techniques for Accuracy and Confidence Elicitation in Medical LLMs","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T12:44:14.335426Z"},"links":{"cited_paper":"/paper/2406.03441","citing_paper":"/paper/2506.00072"},"observation_digest":"sha256:ba47b812cb1d30b3feaba0ef2b26216534e5f21e2e54fdb6d8d155dbae28ac9e","observation_id":"6672b5a3-c938-4ce4-9f87-be8c44f01a67","resolution":{"observed_at":"2026-08-07T12:44:14.335426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:44:14.489208Z","title":"Can LLMs Learn Uncertainty on Their Own? Expressing Uncertainty Effec- tively in A Self -Training Manner,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00072","last_updated":"2025-05-29T17:13:26Z","snapshot_observed_at":"2026-08-07T12:38:03.915535Z","submitted_at":"2025-05-29T17:13:26Z","title":"Evaluating Prompt Engineering Techniques for Accuracy and Confidence Elicitation in Medical LLMs","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T12:44:14.489208Z"},"links":{"citing_paper":"/paper/2506.00072"},"observation_digest":"sha256:9bb2d4ec23eadd2addd27ab0149046b5b1d28a8de9a9f1da0654a4c903e812e9","observation_id":"9eeaba60-fdb7-4ed9-a534-dbf2b13407b5","resolution":{"observed_at":"2026-08-07T12:44:14.489208Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:44:14.604595Z","title":"Bayesian Prompt Ensembles: Model Uncertainty Estimation for Black-Box Large Language Models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00072","last_updated":"2025-05-29T17:13:26Z","snapshot_observed_at":"2026-08-07T12:38:03.915535Z","submitted_at":"2025-05-29T17:13:26Z","title":"Evaluating Prompt Engineering Techniques for Accuracy and Confidence Elicitation in Medical LLMs","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T12:44:14.604595Z"},"links":{"citing_paper":"/paper/2506.00072"},"observation_digest":"sha256:44e4c79cad32e493e6d3b2fa95f1e6b7e0e378a2894f1a66b34d0b74afb4cb8c","observation_id":"b307add0-1b13-438a-b1b6-565509be2168","resolution":{"observed_at":"2026-08-07T12:44:14.604595Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:44:15.727712Z","title":"Uncertainty Quantification for In -Context Learning of Large Language Models,","venue":null,"work_id":"5d69814d-0afb-4504-bd31-188dc77bc570","year":2024},"citing_paper":{"arxiv_id":"2506.00072","last_updated":"2025-05-29T17:13:26Z","snapshot_observed_at":"2026-08-07T12:38:03.915535Z","submitted_at":"2025-05-29T17:13:26Z","title":"Evaluating Prompt Engineering Techniques for Accuracy and Confidence Elicitation in Medical LLMs","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T12:44:14.735826Z"},"links":{"citing_paper":"/paper/2506.00072"},"observation_digest":"sha256:41b061cd64a715bd5fa8341b1c09a913bb8c16722d5b2fcac450fc6adc965d4a","observation_id":"c9240b8f-e237-4d3c-9072-3d7ac9019e90","resolution":{"observed_at":"2026-08-07T12:44:15.748927Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.16966","last_updated":"2024-06-05T20:14:15Z","snapshot_observed_at":"2026-07-06T18:05:46.922400Z","submitted_at":"2024-04-25T18:35:54Z","title":"Examining the robustness of LLM evaluation to the distributional assumptions of benchmarks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.16966","snapshot_observed_at":"2026-08-07T12:44:14.888885Z","title":"Examining the robustness of LLM evaluation to the distributional assumptions of benchmarks,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00072","last_updated":"2025-05-29T17:13:26Z","snapshot_observed_at":"2026-08-07T12:38:03.915535Z","submitted_at":"2025-05-29T17:13:26Z","title":"Evaluating Prompt Engineering Techniques for Accuracy and Confidence Elicitation in Medical LLMs","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T12:44:14.888885Z"},"links":{"cited_paper":"/paper/2404.16966","citing_paper":"/paper/2506.00072"},"observation_digest":"sha256:66916c0a8060a75a378ddf7a94653bacc7cc5a897663ddf932cb13ea159a4afa","observation_id":"6a9a8eb7-fd15-4794-8c89-37a8138a8f3d","resolution":{"observed_at":"2026-08-07T12:44:14.888885Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20974","last_updated":"2024-10-04T17:23:48Z","snapshot_observed_at":"2026-07-06T18:23:23.565502Z","submitted_at":"2024-05-31T16:21:16Z","title":"SaySelf: Teaching LLMs to Express Confidence with Self-Reflective Rationales","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.20974","snapshot_observed_at":"2026-08-07T12:44:14.955084Z","title":"SaySelf: Teaching LLMs to Express Confidence with Self-Reflective Ration- ales,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00072","last_updated":"2025-05-29T17:13:26Z","snapshot_observed_at":"2026-08-07T12:38:03.915535Z","submitted_at":"2025-05-29T17:13:26Z","title":"Evaluating Prompt Engineering Techniques for Accuracy and Confidence Elicitation in Medical LLMs","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T12:44:14.955084Z"},"links":{"cited_paper":"/paper/2405.20974","citing_paper":"/paper/2506.00072"},"observation_digest":"sha256:1bf2183a3922c2f72e45fd5feae2fa4712279914fd74484965e0f3fa3a72fde1","observation_id":"6016f046-b748-46a3-b739-b406c6ab5052","resolution":{"observed_at":"2026-08-07T12:44:14.955084Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:44:15.648146Z","title":"Large language model uncertainty proxies : discrimination and calibration for medical diagnosis and treatment,","venue":null,"work_id":"19b62e5e-00c4-4643-a6b7-fc7c6938cded","year":2024},"citing_paper":{"arxiv_id":"2506.00072","last_updated":"2025-05-29T17:13:26Z","snapshot_observed_at":"2026-08-07T12:38:03.915535Z","submitted_at":"2025-05-29T17:13:26Z","title":"Evaluating Prompt Engineering Techniques for Accuracy and Confidence Elicitation in Medical LLMs","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T12:44:15.037328Z"},"links":{"citing_paper":"/paper/2506.00072"},"observation_digest":"sha256:6f627542dcb751d52c0a98a429d98ef98cad572668bd049770ea1badcff9afce","observation_id":"0a11d125-1d7e-4168-9967-ca9553b8f26d","resolution":{"observed_at":"2026-08-07T12:44:15.678308Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.3390/electronics13234581","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:44:15.330125Z","title":"Harnessing Response Consistency for Superior LLM Performance: The Promise and Peril of Answer-Augmented Prompting,","venue":null,"work_id":"749fb967-bbd7-46bf-92ce-8e3213cf30cf","year":2024},"citing_paper":{"arxiv_id":"2506.00072","last_updated":"2025-05-29T17:13:26Z","snapshot_observed_at":"2026-08-07T12:38:03.915535Z","submitted_at":"2025-05-29T17:13:26Z","title":"Evaluating Prompt Engineering Techniques for Accuracy and Confidence Elicitation in Medical LLMs","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T12:44:15.106993Z"},"links":{"citing_paper":"/paper/2506.00072"},"observation_digest":"sha256:f779255f626fcab0847e3a2f79f3020b245985c829f8f7b8c606bed53e1e34bf","observation_id":"d451b0e4-02f1-4f76-b3b1-c428a4bca82d","resolution":{"observed_at":"2026-08-07T12:44:15.405010Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/s11023-024-09664-2","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:44:15.216982Z","title":"Reflective Artificial Intelligence,","venue":null,"work_id":"5542a3a2-85ee-4cfe-acfb-ab33891d304e","year":2024},"citing_paper":{"arxiv_id":"2506.00072","last_updated":"2025-05-29T17:13:26Z","snapshot_observed_at":"2026-08-07T12:38:03.915535Z","submitted_at":"2025-05-29T17:13:26Z","title":"Evaluating Prompt Engineering Techniques for Accuracy and Confidence Elicitation in Medical LLMs","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T12:44:15.145352Z"},"links":{"citing_paper":"/paper/2506.00072"},"observation_digest":"sha256:42c645ff027fd035215f5ff5281a5e12d74cba6712bf7b51da73a43b566c93bb","observation_id":"8979d06b-76b3-4f2d-9112-bfd7ff0242d4","resolution":{"observed_at":"2026-08-07T12:44:15.250269Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.05278","last_updated":"2025-04-07T17:24:11Z","snapshot_observed_at":"2026-08-07T16:07:51.354749Z","submitted_at":"2025-04-07T17:24:11Z","title":"The challenge of uncertainty quantification of large language models in medicine","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.05278","snapshot_observed_at":"2026-08-07T12:44:15.178000Z","title":"The challenge of uncertainty quantification of large language models in medi- cine,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.00072","last_updated":"2025-05-29T17:13:26Z","snapshot_observed_at":"2026-08-07T12:38:03.915535Z","submitted_at":"2025-05-29T17:13:26Z","title":"Evaluating Prompt Engineering Techniques for Accuracy and Confidence Elicitation in Medical LLMs","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T12:44:15.178000Z"},"links":{"cited_paper":"/paper/2504.05278","citing_paper":"/paper/2506.00072"},"observation_digest":"sha256:ac71cb20ad36a35f30b7367bbe66c11e7bccddbfa57e2575cfebba83f9aa255d","observation_id":"ddd012bd-f656-4762-ba50-88888c623c80","resolution":{"observed_at":"2026-08-07T12:44:15.178000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:44:14.806952Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00072","last_updated":"2025-05-29T17:13:26Z","snapshot_observed_at":"2026-08-07T12:38:03.915535Z","submitted_at":"2025-05-29T17:13:26Z","title":"Evaluating Prompt Engineering Techniques for Accuracy and Confidence Elicitation in Medical LLMs","version":1},"reference_index":3370,"source":"pdf_text","source_observed_at":"2026-08-07T12:44:14.806952Z"},"links":{"citing_paper":"/paper/2506.00072"},"observation_digest":"sha256:9c95dffb29920d3bb264c4fb49f64bccf3af447bb3c6002d90cf536432a19807","observation_id":"f1a83321-9c02-4459-a842-d008a5eee9ff","resolution":{"observed_at":"2026-08-07T12:44:14.806952Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.00072","last_updated":"2025-05-29T17:13:26Z","latest_version":1,"primary_category":"cs.CY","snapshot_observed_at":"2026-08-07T12:38:03.915535Z","submitted_at":"2025-05-29T17:13:26Z","title":"Evaluating Prompt Engineering Techniques for Accuracy and Confidence Elicitation in Medical LLMs"},"reference_resolution":{"displayed":20,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":13,"verified_exact":3,"verified_fuzzy":4},"total_outbound_references":20},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 20 of 20 outbound references and 0 inbound Pith citation observations for arXiv:2506.00072."}