{"as_of":"2026-08-08T03:38:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:8957d962ef54454e63267d7dcaf742fd94f6d3a87f81d87d7d9027ed703b7a77","coverage":[{"denominator":43,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":43,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:06:33.306043Z","state":"measured"},{"denominator":47,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":47,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":4,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":4,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T20:45:12.671790Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-22T07:54:43.182673Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.20047","last_updated":"2025-05-26T14:34:04Z","snapshot_observed_at":"2026-08-07T23:31:54.437843Z","submitted_at":"2025-05-26T14:34:04Z","title":"Grammars of Formal Uncertainty: When to Trust LLMs in Automated Reasoning Tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.20047","snapshot_observed_at":"2026-08-06T20:45:12.671790Z","title":"Grammars of formal uncertainty: When to trust llms in automated reasoning tasks.arXiv preprint arXiv:2505.20047, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.01903","last_updated":"2025-08-05T16:19:40Z","snapshot_observed_at":"2026-08-07T12:18:28.218519Z","submitted_at":"2025-07-02T17:19:20Z","title":"AI4Research: A Survey of Artificial Intelligence for Scientific Research","version":2},"reference_index":221,"source":"pdf_text","source_observed_at":"2026-08-06T20:45:12.671790Z"},"links":{"cited_paper":"/paper/2505.20047","citing_paper":"/paper/2507.01903"},"observation_digest":"sha256:d63ab5ac4e18ee3b4fc1971a50b7ce6b56888cdde55cbacfb3382a1b219e60d4","observation_id":"a0a854e3-0c2d-4435-9dfe-59f31b2e00ba","resolution":{"observed_at":"2026-08-06T20:45:12.671790Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.20047","last_updated":"2025-05-26T14:34:04Z","snapshot_observed_at":"2026-08-07T23:31:54.437843Z","submitted_at":"2025-05-26T14:34:04Z","title":"Grammars of Formal Uncertainty: When to Trust LLMs in Automated Reasoning Tasks","version":1},"cited_work":{"arxiv_id":"2505.20047","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.20047","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Sankar, B","venue":null,"work_id":"327078ea-08f7-4a89-b669-3d4dcddeb359","year":2025},"citing_paper":{"arxiv_id":"2605.14063","last_updated":"2026-05-19T02:22:25Z","snapshot_observed_at":"2026-08-05T21:42:17.978065Z","submitted_at":"2026-05-13T19:38:08Z","title":"Reliability-Gated Source Anchoring for Continual Test-Time Adaptation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-15T05:29:17.744966Z"},"links":{"cited_paper":"/paper/2505.20047","citing_paper":"/paper/2605.14063"},"observation_digest":"sha256:b18b9f6dc40639d499a801334c7105f3e3cf9df30008acce2a448811b9935285","observation_id":"aa54143a-4923-43ac-9b70-45b696456023","resolution":{"observed_at":"2026-05-15T05:29:46.944740Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.20047","last_updated":"2025-05-26T14:34:04Z","snapshot_observed_at":"2026-08-07T23:31:54.437843Z","submitted_at":"2025-05-26T14:34:04Z","title":"Grammars of Formal Uncertainty: When to Trust LLMs in Automated Reasoning Tasks","version":1},"cited_work":{"arxiv_id":"2505.20047","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.20047","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Sankar, B","venue":null,"work_id":"327078ea-08f7-4a89-b669-3d4dcddeb359","year":2025},"citing_paper":{"arxiv_id":"2605.14063","last_updated":"2026-05-19T02:22:25Z","snapshot_observed_at":"2026-08-05T21:42:17.978065Z","submitted_at":"2026-05-13T19:38:08Z","title":"Reliability-Gated Source Anchoring for Continual Test-Time Adaptation","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-20T20:24:01.811656Z"},"links":{"cited_paper":"/paper/2505.20047","citing_paper":"/paper/2605.14063"},"observation_digest":"sha256:2fa69539ebf7d9ec64035ba0449894914a3d640be36ef060f60c179356245343","observation_id":"108fe26f-bc3f-46f9-91bb-e3da03d1e4a8","resolution":{"observed_at":"2026-05-20T20:29:00.068897Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.20047","last_updated":"2025-05-26T14:34:04Z","snapshot_observed_at":"2026-08-07T23:31:54.437843Z","submitted_at":"2025-05-26T14:34:04Z","title":"Grammars of Formal Uncertainty: When to Trust LLMs in Automated Reasoning Tasks","version":1},"cited_work":{"arxiv_id":"2505.20047","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.20047","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Sankar, B","venue":null,"work_id":"327078ea-08f7-4a89-b669-3d4dcddeb359","year":2025},"citing_paper":{"arxiv_id":"2605.21928","last_updated":"2026-05-21T02:56:46Z","snapshot_observed_at":"2026-08-02T12:13:24.155575Z","submitted_at":"2026-05-21T02:56:46Z","title":"CausalGuard: Conformal Inference under Graph Uncertainty","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-22T07:51:41.874143Z"},"links":{"cited_paper":"/paper/2505.20047","citing_paper":"/paper/2605.21928"},"observation_digest":"sha256:95f103c6e8edb7bc1648e35b205a66d3f54a4459121c929e9ac5464a9ed7852d","observation_id":"25f15a8b-2f9e-4019-80d3-9c5bbef526f5","resolution":{"observed_at":"2026-05-22T07:54:43.185224Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.20047/citation-record","integrity":"/paper/2505.20047/integrity","json":"/paper/2505.20047/citation-record.json","paper":"/paper/2505.20047"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2203.11171","last_updated":"2023-03-07T17:57:37Z","snapshot_observed_at":"2026-07-06T12:50:22.773056Z","submitted_at":"2022-03-21T17:48:52Z","title":"Self-Consistency Improves Chain of Thought Reasoning in Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.11171","snapshot_observed_at":"2026-08-07T14:06:29.697285Z","title":"Self-consistency improves chain of thought reasoning in language models.arXiv preprint arXiv:2203.11171,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.20047","last_updated":"2025-05-26T14:34:04Z","snapshot_observed_at":"2026-08-07T23:31:54.437843Z","submitted_at":"2025-05-26T14:34:04Z","title":"Grammars of Formal Uncertainty: When to Trust LLMs in Automated Reasoning Tasks","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T14:06:29.697285Z"},"links":{"cited_paper":"/paper/2203.11171","citing_paper":"/paper/2505.20047"},"observation_digest":"sha256:4cc6201be7906d7cfb5fd36a6e07fc4e826b88cb9a318dc45473166411dc71ac","observation_id":"300f7ad8-e1ea-4eb0-9b14-e0b431907868","resolution":{"observed_at":"2026-08-07T14:06:29.697285Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:06:29.808546Z","title":"URLhttps://aclanthology.org/2021.tacl-1.21/","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.20047","last_updated":"2025-05-26T14:34:04Z","snapshot_observed_at":"2026-08-07T23:31:54.437843Z","submitted_at":"2025-05-26T14:34:04Z","title":"Grammars of Formal Uncertainty: When to Trust LLMs in Automated Reasoning Tasks","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T14:06:29.808546Z"},"links":{"citing_paper":"/paper/2505.20047"},"observation_digest":"sha256:3f81d69da18e3227290222170b31a9046ea38ba0d1962b82da375f4dc5ec65ac","observation_id":"3535cf87-e067-4d87-bf36-c89ab0beacfb","resolution":{"observed_at":"2026-08-07T14:06:29.808546Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:06:35.562840Z","title":"FOLIO: Natural language reasoning with first-order logic","venue":null,"work_id":"8adfb8f6-a540-4714-acb9-9348f8254031","year":2024},"citing_paper":{"arxiv_id":"2505.20047","last_updated":"2025-05-26T14:34:04Z","snapshot_observed_at":"2026-08-07T23:31:54.437843Z","submitted_at":"2025-05-26T14:34:04Z","title":"Grammars of Formal Uncertainty: When to Trust LLMs in Automated Reasoning Tasks","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T14:06:29.908396Z"},"links":{"citing_paper":"/paper/2505.20047"},"observation_digest":"sha256:fa853a15a3403f6acf9f1dbd3e769b35dad54a8840a26313e274657d575d0da8","observation_id":"e34a6ebb-e18b-4f4b-81fe-53d10bae56a9","resolution":{"observed_at":"2026-08-07T14:06:35.653914Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:06:34.425955Z","title":"tailedness","venue":null,"work_id":"4fee15d0-206f-49a1-832f-5e781b85be1b","year":2000},"citing_paper":{"arxiv_id":"2505.20047","last_updated":"2025-05-26T14:34:04Z","snapshot_observed_at":"2026-08-07T23:31:54.437843Z","submitted_at":"2025-05-26T14:34:04Z","title":"Grammars of Formal Uncertainty: When to Trust LLMs in Automated Reasoning Tasks","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T14:06:33.306043Z"},"links":{"citing_paper":"/paper/2505.20047"},"observation_digest":"sha256:0ffb20ee03cf459edaf904ff7cf42374de0a47bfdcc91f90ad09748fe41efbd4","observation_id":"68bba2f4-5ba6-4154-bb67-951a0485e0aa","resolution":{"observed_at":"2026-08-07T14:06:34.476109Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.07524","last_updated":"2022-11-14T16:52:32Z","snapshot_observed_at":"2026-08-07T23:33:09.684973Z","submitted_at":"2022-11-14T16:52:32Z","title":"Towards a Mathematics Formalisation Assistant using Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.07524","snapshot_observed_at":"2026-08-07T14:06:30.094004Z","title":"To- wards a Mathematics Formalisation Assistant using Large Language Models.arXiv preprint arXiv:2211.07524,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.20047","last_updated":"2025-05-26T14:34:04Z","snapshot_observed_at":"2026-08-07T23:31:54.437843Z","submitted_at":"2025-05-26T14:34:04Z","title":"Grammars of Formal Uncertainty: When to Trust LLMs in Automated Reasoning Tasks","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T14:06:30.094004Z"},"links":{"cited_paper":"/paper/2211.07524","citing_paper":"/paper/2505.20047"},"observation_digest":"sha256:81da41b3f3e0ca80426b85045996cb19651b05ff8ebea8350ee8bf4b2b8e1da8","observation_id":"17ff4aad-6d54-4831-9c44-eac50c3acc1f","resolution":{"observed_at":"2026-08-07T14:06:30.094004Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.04295","last_updated":"2023-12-05T08:38:01Z","snapshot_observed_at":"2026-08-07T23:35:18.737859Z","submitted_at":"2023-09-08T12:34:28Z","title":"FIMO: A Challenge Formal Dataset for Automated Theorem Proving","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.04295","snapshot_observed_at":"2026-08-07T14:06:30.120173Z","title":"FIMO: A Challenge Formal Dataset for Auto- mated Theorem Proving.arXiv preprint arXiv:2309.04295,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.20047","last_updated":"2025-05-26T14:34:04Z","snapshot_observed_at":"2026-08-07T23:31:54.437843Z","submitted_at":"2025-05-26T14:34:04Z","title":"Grammars of Formal Uncertainty: When to Trust LLMs in Automated Reasoning Tasks","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T14:06:30.120173Z"},"links":{"cited_paper":"/paper/2309.04295","citing_paper":"/paper/2505.20047"},"observation_digest":"sha256:383f3bb4c906e10822d22fe033b90a023e8869f479f3980bd9c714e3f29713bb","observation_id":"87665c19-5bb5-4104-922c-890f80c4f568","resolution":{"observed_at":"2026-08-07T14:06:30.120173Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.01379","last_updated":"2024-10-11T11:54:35Z","snapshot_observed_at":"2026-07-06T18:08:52.053005Z","submitted_at":"2024-05-02T15:20:01Z","title":"Verification and Refinement of Natural Language Explanations through LLM-Symbolic Theorem Proving","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.01379","snapshot_observed_at":"2026-08-07T14:06:30.223009Z","title":"Verification and Refinement of Natural Language Explanations through LLM-Symbolic Theorem Proving.arXiv preprint arXiv:2405.01379,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.20047","last_updated":"2025-05-26T14:34:04Z","snapshot_observed_at":"2026-08-07T23:31:54.437843Z","submitted_at":"2025-05-26T14:34:04Z","title":"Grammars of Formal Uncertainty: When to Trust LLMs in Automated Reasoning Tasks","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T14:06:30.223009Z"},"links":{"cited_paper":"/paper/2405.01379","citing_paper":"/paper/2505.20047"},"observation_digest":"sha256:af1687d6b93c7f3130b10fd6ac2a4bc9afa701bf462be64b4910ea368d661cd2","observation_id":"5894d4ff-3ce2-452b-828a-ad0ab1158df2","resolution":{"observed_at":"2026-08-07T14:06:30.223009Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14333","last_updated":"2024-05-23T09:03:42Z","snapshot_observed_at":"2026-07-06T18:18:25.746022Z","submitted_at":"2024-05-23T09:03:42Z","title":"DeepSeek-Prover: Advancing Theorem Proving in LLMs through Large-Scale Synthetic Data","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14333","snapshot_observed_at":"2026-08-07T14:06:30.321310Z","title":"DeepSeek-Prover: Advancing Theorem Proving in LLMs through Large-Scale Synthetic Data.arXiv preprint arXiv:2405.14333, 2024b","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.20047","last_updated":"2025-05-26T14:34:04Z","snapshot_observed_at":"2026-08-07T23:31:54.437843Z","submitted_at":"2025-05-26T14:34:04Z","title":"Grammars of Formal Uncertainty: When to Trust LLMs in Automated Reasoning Tasks","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T14:06:30.321310Z"},"links":{"cited_paper":"/paper/2405.14333","citing_paper":"/paper/2505.20047"},"observation_digest":"sha256:5606d8b4a765c5cdb91e7ce1f6e30ffd2e5aef385fbf12bf2b1f3fd2d763b05d","observation_id":"59730723-51a4-461f-82a8-a0eeb2d107c7","resolution":{"observed_at":"2026-08-07T14:06:30.321310Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14414","last_updated":"2024-05-23T10:35:08Z","snapshot_observed_at":"2026-07-06T18:18:30.066741Z","submitted_at":"2024-05-23T10:35:08Z","title":"Proving Theorems Recursively","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14414","snapshot_observed_at":"2026-08-07T14:06:30.451938Z","title":"Proving Theorems Recursively.arXiv preprint arXiv:2405.14414,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.20047","last_updated":"2025-05-26T14:34:04Z","snapshot_observed_at":"2026-08-07T23:31:54.437843Z","submitted_at":"2025-05-26T14:34:04Z","title":"Grammars of Formal Uncertainty: When to Trust LLMs in Automated Reasoning Tasks","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T14:06:30.451938Z"},"links":{"cited_paper":"/paper/2405.14414","citing_paper":"/paper/2505.20047"},"observation_digest":"sha256:95e5c42344313eedaf866174cf24a10a4dce4b9b9b24c0092f10ee6fa57e6988","observation_id":"f5f7fc77-3ba5-4e58-baec-1c94e59c31db","resolution":{"observed_at":"2026-08-07T14:06:30.451938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.07618","last_updated":"2023-11-12T07:52:32Z","snapshot_observed_at":"2026-07-06T16:46:57.403995Z","submitted_at":"2023-11-12T07:52:32Z","title":"Large Language Models' Understanding of Math: Source Criticism and Extrapolation","version":1},"cited_work":{"arxiv_id":"2311.07618","doi":null,"metadata_source":"pith","pith_arxiv_id":"2311.07618","snapshot_observed_at":"2026-08-07T14:06:34.160560Z","title":"Large Language Models' Understanding of Math: Source Criticism and Extrapolation","venue":"cs.LG","work_id":"7e5d48af-e3f7-4586-9387-d9400611cb05","year":2023},"citing_paper":{"arxiv_id":"2505.20047","last_updated":"2025-05-26T14:34:04Z","snapshot_observed_at":"2026-08-07T23:31:54.437843Z","submitted_at":"2025-05-26T14:34:04Z","title":"Grammars of Formal Uncertainty: When to Trust LLMs in Automated Reasoning Tasks","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T14:06:30.524766Z"},"links":{"cited_paper":"/paper/2311.07618","citing_paper":"/paper/2505.20047"},"observation_digest":"sha256:798d448bec1b04276cef777f9055298a6a16e7683e9f1a4fac0f023251dad0c9","observation_id":"84f816bf-9ae5-4b7d-a69b-8777ebb6bdc7","resolution":{"observed_at":"2026-08-07T14:06:34.217293Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.12196","last_updated":"2023-05-20T14:00:08Z","snapshot_observed_at":"2026-07-06T15:30:01.504305Z","submitted_at":"2023-05-20T14:00:08Z","title":"Experimental results from applying GPT-4 to an unpublished formal language","version":1},"cited_work":{"arxiv_id":"2305.12196","doi":null,"metadata_source":"pith","pith_arxiv_id":"2305.12196","snapshot_observed_at":"2026-08-07T14:06:34.037383Z","title":"Experimental results from applying GPT-4 to an unpublished formal language","venue":"cs.CL","work_id":"a28923a0-c613-4a5b-a2f2-91e2a9de0424","year":2023},"citing_paper":{"arxiv_id":"2505.20047","last_updated":"2025-05-26T14:34:04Z","snapshot_observed_at":"2026-08-07T23:31:54.437843Z","submitted_at":"2025-05-26T14:34:04Z","title":"Grammars of Formal Uncertainty: When to Trust LLMs in Automated Reasoning Tasks","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T14:06:30.595514Z"},"links":{"cited_paper":"/paper/2305.12196","citing_paper":"/paper/2505.20047"},"observation_digest":"sha256:cc77cf518298d4fbd1d1b6765d32fae9e3ea24cecce35f62dd59c19d21194d0c","observation_id":"3af7d02f-b50c-4b84-8c2e-abe168312436","resolution":{"observed_at":"2026-08-07T14:06:34.087320Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.04556","last_updated":"2024-04-02T14:35:40Z","snapshot_observed_at":"2026-08-07T23:31:29.065390Z","submitted_at":"2023-12-07T18:59:29Z","title":"Large Language Models for Mathematicians","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.04556","snapshot_observed_at":"2026-08-07T14:06:30.665664Z","title":"Large Language Models for Mathematicians.arXiv preprint arXiv:2312.04556, 2023a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.20047","last_updated":"2025-05-26T14:34:04Z","snapshot_observed_at":"2026-08-07T23:31:54.437843Z","submitted_at":"2025-05-26T14:34:04Z","title":"Grammars of Formal Uncertainty: When to Trust LLMs in Automated Reasoning Tasks","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T14:06:30.665664Z"},"links":{"cited_paper":"/paper/2312.04556","citing_paper":"/paper/2505.20047"},"observation_digest":"sha256:6edf35f9d6501f9ce4f9ce41c098cdfe1a5b9c542f53c8cc1d9197bffbf40c46","observation_id":"b7071168-7956-4444-926e-7f149b065854","resolution":{"observed_at":"2026-08-07T14:06:30.665664Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.04353","last_updated":"2024-08-08T04:15:31Z","snapshot_observed_at":"2026-08-07T23:31:29.854288Z","submitted_at":"2023-10-06T16:21:22Z","title":"An In-Context Learning Agent for Formal Theorem-Proving","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.04353","snapshot_observed_at":"2026-08-07T14:06:30.740697Z","title":"An In- Context Learning Agent for Formal Theorem-Proving.arXiv preprint arXiv:2310.04353,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.20047","last_updated":"2025-05-26T14:34:04Z","snapshot_observed_at":"2026-08-07T23:31:54.437843Z","submitted_at":"2025-05-26T14:34:04Z","title":"Grammars of Formal Uncertainty: When to Trust LLMs in Automated Reasoning Tasks","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T14:06:30.740697Z"},"links":{"cited_paper":"/paper/2310.04353","citing_paper":"/paper/2505.20047"},"observation_digest":"sha256:e51bd11a2351392d4d486cf1ae3f1d02d69ceabd0fc0a7a44143bef47c88891b","observation_id":"33f465c2-ff0d-44f4-8428-488c028241e4","resolution":{"observed_at":"2026-08-07T14:06:30.740697Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1811.00796","last_updated":"2018-11-02T09:49:18Z","snapshot_observed_at":"2026-07-06T07:12:12.754792Z","submitted_at":"2018-11-02T09:49:18Z","title":"Automated Theorem Proving in Intuitionistic Propositional Logic by Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"1811.00796","doi":null,"metadata_source":"pith","pith_arxiv_id":"1811.00796","snapshot_observed_at":"2026-08-07T14:06:33.868006Z","title":"Automated Theorem Proving in Intuitionistic Propositional Logic by Deep Reinforcement Learning","venue":"cs.LG","work_id":"10d1e21a-0954-47f0-a985-f9ac32e13b11","year":2018},"citing_paper":{"arxiv_id":"2505.20047","last_updated":"2025-05-26T14:34:04Z","snapshot_observed_at":"2026-08-07T23:31:54.437843Z","submitted_at":"2025-05-26T14:34:04Z","title":"Grammars of Formal Uncertainty: When to Trust LLMs in Automated Reasoning Tasks","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T14:06:30.809313Z"},"links":{"cited_paper":"/paper/1811.00796","citing_paper":"/paper/2505.20047"},"observation_digest":"sha256:ab8afd9a898cbef323ddb3772548b44f3077add38d736c381b5c433234056268","observation_id":"af203b79-7824-4211-af81-b60ed8f6bc56","resolution":{"observed_at":"2026-08-07T14:06:33.898352Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.07382","last_updated":"2024-07-29T20:57:44Z","snapshot_observed_at":"2026-07-06T17:58:35.401092Z","submitted_at":"2024-04-10T23:01:45Z","title":"Learn from Failure: Fine-Tuning LLMs with Trial-and-Error Data for Intuitionistic Propositional Logic Proving","version":3},"cited_work":{"arxiv_id":"2404.07382","doi":null,"metadata_source":"pith","pith_arxiv_id":"2404.07382","snapshot_observed_at":"2026-08-07T14:06:33.772398Z","title":"Learn from Failure: Fine-Tuning LLMs with Trial-and-Error Data for Intuitionistic Propositional Logic Proving","venue":"cs.AI","work_id":"ed62d116-dd46-43e5-8d64-4358dcd4be5c","year":2024},"citing_paper":{"arxiv_id":"2505.20047","last_updated":"2025-05-26T14:34:04Z","snapshot_observed_at":"2026-08-07T23:31:54.437843Z","submitted_at":"2025-05-26T14:34:04Z","title":"Grammars of Formal Uncertainty: When to Trust LLMs in Automated Reasoning Tasks","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T14:06:30.898686Z"},"links":{"cited_paper":"/paper/2404.07382","citing_paper":"/paper/2505.20047"},"observation_digest":"sha256:caf65fd8815914b9818f8dcc98ec45cd4faba92ce4af302fc81117c883fc6f86","observation_id":"81c35cd2-6997-4824-8bc3-e5bde035bdf5","resolution":{"observed_at":"2026-08-07T14:06:33.826206Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.09664","last_updated":"2023-04-15T12:55:45Z","snapshot_observed_at":"2026-07-06T14:53:27.667483Z","submitted_at":"2023-02-19T20:10:07Z","title":"Semantic Uncertainty: Linguistic Invariances for Uncertainty Estimation in Natural Language Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.09664","snapshot_observed_at":"2026-08-07T14:06:31.022782Z","title":"Semantic uncertainty: Linguistic invariances for uncertainty estimation in natural language generation.arXiv preprint arXiv:2302.09664,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.20047","last_updated":"2025-05-26T14:34:04Z","snapshot_observed_at":"2026-08-07T23:31:54.437843Z","submitted_at":"2025-05-26T14:34:04Z","title":"Grammars of Formal Uncertainty: When to Trust LLMs in Automated Reasoning Tasks","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T14:06:31.022782Z"},"links":{"cited_paper":"/paper/2302.09664","citing_paper":"/paper/2505.20047"},"observation_digest":"sha256:e7543534aa48b8b7ca6ea16a3ad17528b058bda1b54a4092927b40d7696e88b1","observation_id":"d757dba6-40e5-45d3-922b-cec9bb3913d9","resolution":{"observed_at":"2026-08-07T14:06:31.022782Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12348","last_updated":"2024-06-10T17:14:09Z","snapshot_observed_at":"2026-08-06T16:37:19.128638Z","submitted_at":"2024-02-19T18:23:36Z","title":"GTBench: Uncovering the Strategic Reasoning Limitations of LLMs via Game-Theoretic Evaluations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.12348","snapshot_observed_at":"2026-08-07T14:06:31.207570Z","title":"Gtbench: Uncovering the strategic reasoning limitations of llms via game-theoretic evaluations.arXiv preprint arXiv:2402.12348,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.20047","last_updated":"2025-05-26T14:34:04Z","snapshot_observed_at":"2026-08-07T23:31:54.437843Z","submitted_at":"2025-05-26T14:34:04Z","title":"Grammars of Formal Uncertainty: When to Trust LLMs in Automated Reasoning Tasks","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T14:06:31.207570Z"},"links":{"cited_paper":"/paper/2402.12348","citing_paper":"/paper/2505.20047"},"observation_digest":"sha256:7cb8414f59c5b33e50f3721e245fdd57be45d50124bcd8367607a798a4fe6a07","observation_id":"117a72f0-ac6a-4a25-9b3a-786bc51021ee","resolution":{"observed_at":"2026-08-07T14:06:31.207570Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:06:35.393005Z","title":"Uncertainty estimation in large language models to support biodiversity conservation","venue":null,"work_id":"10fa9b6f-f733-4b6e-a202-d46447b8aa50","year":2024},"citing_paper":{"arxiv_id":"2505.20047","last_updated":"2025-05-26T14:34:04Z","snapshot_observed_at":"2026-08-07T23:31:54.437843Z","submitted_at":"2025-05-26T14:34:04Z","title":"Grammars of Formal Uncertainty: When to Trust LLMs in Automated Reasoning Tasks","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T14:06:31.382488Z"},"links":{"citing_paper":"/paper/2505.20047"},"observation_digest":"sha256:335e502334f4595a0e3e499ad1c6b073ea0b1e90734abeb98446b79806879344","observation_id":"9248041d-88a7-4cec-ae3d-9d377ef6af79","resolution":{"observed_at":"2026-08-07T14:06:35.475117Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2002.06715","last_updated":"2020-02-20T03:38:44Z","snapshot_observed_at":"2026-08-01T10:08:45.076962Z","submitted_at":"2020-02-17T00:00:59Z","title":"BatchEnsemble: An Alternative Approach to Efficient Ensemble and Lifelong Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2002.06715","snapshot_observed_at":"2026-08-07T14:06:31.859886Z","title":"Gabriel Y","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2505.20047","last_updated":"2025-05-26T14:34:04Z","snapshot_observed_at":"2026-08-07T23:31:54.437843Z","submitted_at":"2025-05-26T14:34:04Z","title":"Grammars of Formal Uncertainty: When to Trust LLMs in Automated Reasoning Tasks","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T14:06:31.859886Z"},"links":{"cited_paper":"/paper/2002.06715","citing_paper":"/paper/2505.20047"},"observation_digest":"sha256:67865ed5b00fe8f87e8c386faab4c2818385dbd8f8593ab44aa2c73c208eb4e3","observation_id":"35d8ddcd-51b4-4bd8-913c-a753309add62","resolution":{"observed_at":"2026-08-07T14:06:31.859886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02976","last_updated":"2024-12-06T12:39:00Z","snapshot_observed_at":"2026-08-02T19:27:55.376868Z","submitted_at":"2024-09-04T13:59:38Z","title":"Hallucination Detection in LLMs: Fast and Memory-Efficient Fine-Tuned Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.02976","snapshot_observed_at":"2026-08-07T14:06:31.972141Z","title":"Xuezhi Wang, Jason Wei, Dale Schuurmans, Quoc Le, Ed Chi, Sharan Narang, Aakanksha Chowdhery, and Denny Zhou","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.20047","last_updated":"2025-05-26T14:34:04Z","snapshot_observed_at":"2026-08-07T23:31:54.437843Z","submitted_at":"2025-05-26T14:34:04Z","title":"Grammars of Formal Uncertainty: When to Trust LLMs in Automated Reasoning Tasks","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T14:06:31.972141Z"},"links":{"cited_paper":"/paper/2409.02976","citing_paper":"/paper/2505.20047"},"observation_digest":"sha256:cb26141bb3ac0dab8994f7c381f9f37a6921899b804e712fc0c1a3cc5f465b23","observation_id":"7ca760b9-ce92-4066-84e9-27a2b8c60474","resolution":{"observed_at":"2026-08-07T14:06:31.972141Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14613","last_updated":"2023-11-15T02:15:02Z","snapshot_observed_at":"2026-07-06T15:32:10.481273Z","submitted_at":"2023-05-24T01:25:38Z","title":"Selectively Answering Ambiguous Questions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.14613","snapshot_observed_at":"2026-08-07T14:06:32.093530Z","title":"org/abs/2305.14613","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.20047","last_updated":"2025-05-26T14:34:04Z","snapshot_observed_at":"2026-08-07T23:31:54.437843Z","submitted_at":"2025-05-26T14:34:04Z","title":"Grammars of Formal Uncertainty: When to Trust LLMs in Automated Reasoning Tasks","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T14:06:32.093530Z"},"links":{"cited_paper":"/paper/2305.14613","citing_paper":"/paper/2505.20047"},"observation_digest":"sha256:e8c040616812afaa0a59a0baea3a1b418cc869a572816e4d431343257dc7f81f","observation_id":"536404a5-66bb-4d0b-985c-7493657f9ddc","resolution":{"observed_at":"2026-08-07T14:06:32.093530Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08896","last_updated":"2023-10-11T17:43:28Z","snapshot_observed_at":"2026-07-06T15:03:55.982628Z","submitted_at":"2023-03-15T19:31:21Z","title":"SelfCheckGPT: Zero-Resource Black-Box Hallucination Detection for Generative Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08896","snapshot_observed_at":"2026-08-07T14:06:32.166409Z","title":"Jiuhai Chen and Jonas Mueller","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.20047","last_updated":"2025-05-26T14:34:04Z","snapshot_observed_at":"2026-08-07T23:31:54.437843Z","submitted_at":"2025-05-26T14:34:04Z","title":"Grammars of Formal Uncertainty: When to Trust LLMs in Automated Reasoning Tasks","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T14:06:32.166409Z"},"links":{"cited_paper":"/paper/2303.08896","citing_paper":"/paper/2505.20047"},"observation_digest":"sha256:dd09f24c5db37deeae300e3b50e95cf33e8bc3a260f84d9123c3d929b441e7f4","observation_id":"1db8c8c1-f61c-4f55-9fd9-cb4334c94bc3","resolution":{"observed_at":"2026-08-07T14:06:32.166409Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:06:35.170715Z","title":"URLhttps://aclanthology.org/2024.acl-long.283","venue":null,"work_id":"67d8c01e-4be4-4362-b234-f4840f9b97cf","year":2024},"citing_paper":{"arxiv_id":"2505.20047","last_updated":"2025-05-26T14:34:04Z","snapshot_observed_at":"2026-08-07T23:31:54.437843Z","submitted_at":"2025-05-26T14:34:04Z","title":"Grammars of Formal Uncertainty: When to Trust LLMs in Automated Reasoning Tasks","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T14:06:32.231112Z"},"links":{"citing_paper":"/paper/2505.20047"},"observation_digest":"sha256:c33817b19669e1a89cf6f986e8f080a4f86c2cbc148baf7d028bebcf8dd1ec1b","observation_id":"6bd4ec45-2561-4467-870b-0a729ffb7ada","resolution":{"observed_at":"2026-08-07T14:06:35.263822Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.19187","last_updated":"2024-05-20T01:53:36Z","snapshot_observed_at":"2026-08-07T10:41:32.183020Z","submitted_at":"2023-05-30T16:31:26Z","title":"Generating with Confidence: Uncertainty Quantification for Black-box Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.19187","snapshot_observed_at":"2026-08-07T14:06:32.320811Z","title":"Kumar Shridhar, Felix Laumann, and Marcus Liwicki","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.20047","last_updated":"2025-05-26T14:34:04Z","snapshot_observed_at":"2026-08-07T23:31:54.437843Z","submitted_at":"2025-05-26T14:34:04Z","title":"Grammars of Formal Uncertainty: When to Trust LLMs in Automated Reasoning Tasks","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T14:06:32.320811Z"},"links":{"cited_paper":"/paper/2305.19187","citing_paper":"/paper/2505.20047"},"observation_digest":"sha256:bf29686e124423f0f08e22a816d1921f64807a22600757b4568e8543237138a0","observation_id":"36eeba6a-9133-40de-80d8-9cf8a91cda0c","resolution":{"observed_at":"2026-08-07T14:06:32.320811Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:06:34.999713Z","title":null,"venue":null,"work_id":"25c4e1ba-e831-4014-bc74-9df2597e0037","year":1901},"citing_paper":{"arxiv_id":"2505.20047","last_updated":"2025-05-26T14:34:04Z","snapshot_observed_at":"2026-08-07T23:31:54.437843Z","submitted_at":"2025-05-26T14:34:04Z","title":"Grammars of Formal Uncertainty: When to Trust LLMs in Automated Reasoning Tasks","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T14:06:32.433013Z"},"links":{"citing_paper":"/paper/2505.20047"},"observation_digest":"sha256:4cb8b10ee1b39e9e6d3f1be61cfa5b70ba5391fef0ce809ea4a2d2649a39f7b5","observation_id":"a7feac1b-7ee4-43bd-8ef0-431544bef318","resolution":{"observed_at":"2026-08-07T14:06:35.078620Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.05922","last_updated":"2017-07-19T02:29:49Z","snapshot_observed_at":"2026-08-06T01:41:02.838863Z","submitted_at":"2017-07-19T02:29:49Z","title":"Improving Output Uncertainty Estimation and Generalization in Deep Learning via Neural Network Gaussian Processes","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.05922","snapshot_observed_at":"2026-08-07T14:06:32.571772Z","title":"Jeremiah Zhe Liu, Zi Lin, Shreyas Padhy, Dustin Tran, Tania Bedrax-Weiss, and Balaji Lakshmi- narayanan","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.20047","last_updated":"2025-05-26T14:34:04Z","snapshot_observed_at":"2026-08-07T23:31:54.437843Z","submitted_at":"2025-05-26T14:34:04Z","title":"Grammars of Formal Uncertainty: When to Trust LLMs in Automated Reasoning Tasks","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T14:06:32.571772Z"},"links":{"cited_paper":"/paper/1707.05922","citing_paper":"/paper/2505.20047"},"observation_digest":"sha256:63c1011bfe2a0479a4e1da53834d7bf1a28b0d1c7c0751b941054bd1594d18eb","observation_id":"e3b164d0-649a-4c78-b2b4-debe8abd9ef4","resolution":{"observed_at":"2026-08-07T14:06:32.571772Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.10108","last_updated":"2020-10-26T02:56:53Z","snapshot_observed_at":"2026-07-06T09:30:11.360338Z","submitted_at":"2020-06-17T19:18:22Z","title":"Simple and Principled Uncertainty Estimation with Deterministic Deep Learning via Distance Awareness","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.10108","snapshot_observed_at":"2026-08-07T14:06:32.643092Z","title":"Yijun Xiao and William Yang Wang","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2505.20047","last_updated":"2025-05-26T14:34:04Z","snapshot_observed_at":"2026-08-07T23:31:54.437843Z","submitted_at":"2025-05-26T14:34:04Z","title":"Grammars of Formal Uncertainty: When to Trust LLMs in Automated Reasoning Tasks","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T14:06:32.643092Z"},"links":{"cited_paper":"/paper/2006.10108","citing_paper":"/paper/2505.20047"},"observation_digest":"sha256:f8c98b56062c2fa916983732bd8e468fd79dc07921ef2e0b9c616ac07348309d","observation_id":"06224edf-f45c-4091-a543-53e800819559","resolution":{"observed_at":"2026-08-07T14:06:32.643092Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14975","last_updated":"2023-10-24T04:27:42Z","snapshot_observed_at":"2026-07-06T15:32:25.931739Z","submitted_at":"2023-05-24T10:12:33Z","title":"Just Ask for Calibration: Strategies for Eliciting Calibrated Confidence Scores from Language Models Fine-Tuned with Human Feedback","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.14975","snapshot_observed_at":"2026-08-07T14:06:32.927335Z","title":"Miao Xiong, Zhiyuan Hu, Xinyang Lu, Yifei Li, Jie Fu, Junxian He, and Bryan Hooi","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.20047","last_updated":"2025-05-26T14:34:04Z","snapshot_observed_at":"2026-08-07T23:31:54.437843Z","submitted_at":"2025-05-26T14:34:04Z","title":"Grammars of Formal Uncertainty: When to Trust LLMs in Automated Reasoning Tasks","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T14:06:32.927335Z"},"links":{"cited_paper":"/paper/2305.14975","citing_paper":"/paper/2505.20047"},"observation_digest":"sha256:30d619cbe5e4e1b873907b1279464f204d13e6c23629e05e69a2279a11b1368e","observation_id":"ec1db97f-76d1-473b-bdd5-ef12a1fd1741","resolution":{"observed_at":"2026-08-07T14:06:32.927335Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.13063","last_updated":"2024-03-17T04:38:48Z","snapshot_observed_at":"2026-07-06T15:45:39.649725Z","submitted_at":"2023-06-22T17:31:44Z","title":"Can LLMs Express Their Uncertainty? An Empirical Evaluation of Confidence Elicitation in LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.13063","snapshot_observed_at":"2026-08-07T14:06:33.003689Z","title":"Takeshi Kojima, Shixiang (Shane) Gu, Machel Reid, Yutaka Matsuo, and Yusuke Iwa- sawa","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.20047","last_updated":"2025-05-26T14:34:04Z","snapshot_observed_at":"2026-08-07T23:31:54.437843Z","submitted_at":"2025-05-26T14:34:04Z","title":"Grammars of Formal Uncertainty: When to Trust LLMs in Automated Reasoning Tasks","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T14:06:33.003689Z"},"links":{"cited_paper":"/paper/2306.13063","citing_paper":"/paper/2505.20047"},"observation_digest":"sha256:b9615e7d3e6250a8f82562f32c19d85be1c7bfe0b91587a5c2a0e76c2168e3c0","observation_id":"2daa234d-4abf-4815-b0d2-c7da57892170","resolution":{"observed_at":"2026-08-07T14:06:33.003689Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:06:34.824763Z","title":"Tobias Groot and Matias Valdenegro-Toro","venue":null,"work_id":"0507f964-119e-4fb8-b02e-64a2ed85ffda","year":2022},"citing_paper":{"arxiv_id":"2505.20047","last_updated":"2025-05-26T14:34:04Z","snapshot_observed_at":"2026-08-07T23:31:54.437843Z","submitted_at":"2025-05-26T14:34:04Z","title":"Grammars of Formal Uncertainty: When to Trust LLMs in Automated Reasoning Tasks","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T14:06:33.087549Z"},"links":{"citing_paper":"/paper/2505.20047"},"observation_digest":"sha256:d171004718f77cbee68ae58be61fcf6f54a3e3b9397145d41b65cb689a45899f","observation_id":"c2e52b91-94f0-4570-b6e4-070ccba28b5d","resolution":{"observed_at":"2026-08-07T14:06:34.900367Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:06:32.501189Z","title":"URLhttp://www.jstor.org/stable/2236703","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.20047","last_updated":"2025-05-26T14:34:04Z","snapshot_observed_at":"2026-08-07T23:31:54.437843Z","submitted_at":"2025-05-26T14:34:04Z","title":"Grammars of Formal Uncertainty: When to Trust LLMs in Automated Reasoning Tasks","version":1},"reference_index":1951,"source":"pdf_text","source_observed_at":"2026-08-07T14:06:32.501189Z"},"links":{"citing_paper":"/paper/2505.20047"},"observation_digest":"sha256:89468454daf2e8edc80aac05cf84260093be2eecf6ebb4515076ba4afe8595da","observation_id":"26ca16a6-c72c-45b0-8734-7d08d3e75e18","resolution":{"observed_at":"2026-08-07T14:06:32.501189Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:06:31.530258Z","title":"Dropout: a simple way to prevent neural networks from overfitting.The journal of machine learning research, 15(1):1929–1958,","venue":null,"work_id":null,"year":1929},"citing_paper":{"arxiv_id":"2505.20047","last_updated":"2025-05-26T14:34:04Z","snapshot_observed_at":"2026-08-07T23:31:54.437843Z","submitted_at":"2025-05-26T14:34:04Z","title":"Grammars of Formal Uncertainty: When to Trust LLMs in Automated Reasoning Tasks","version":1},"reference_index":1965,"source":"pdf_text","source_observed_at":"2026-08-07T14:06:31.530258Z"},"links":{"citing_paper":"/paper/2505.20047"},"observation_digest":"sha256:3f0e525ef166d0ef41b26cb20d7d812c383c99699858b40084442350f9760b4d","observation_id":"2fb398df-0607-4eb5-b251-2efd24aba0ca","resolution":{"observed_at":"2026-08-07T14:06:31.530258Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.14334","last_updated":"2022-06-13T05:04:53Z","snapshot_observed_at":"2026-08-03T04:20:54.522222Z","submitted_at":"2022-05-28T05:02:31Z","title":"Teaching Models to Express Their Uncertainty in Words","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.14334","snapshot_observed_at":"2026-08-07T14:06:32.818788Z","title":"Teaching models to express their uncertainty in words, 2022b","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.20047","last_updated":"2025-05-26T14:34:04Z","snapshot_observed_at":"2026-08-07T23:31:54.437843Z","submitted_at":"2025-05-26T14:34:04Z","title":"Grammars of Formal Uncertainty: When to Trust LLMs in Automated Reasoning Tasks","version":1},"reference_index":1996,"source":"pdf_text","source_observed_at":"2026-08-07T14:06:32.818788Z"},"links":{"cited_paper":"/paper/2205.14334","citing_paper":"/paper/2505.20047"},"observation_digest":"sha256:8579969cc841fce1a94121b85f6a677a0ecc053b8c58482d2a57d30feb648f07","observation_id":"0322fa87-bd72-4352-92b1-d471be2480f1","resolution":{"observed_at":"2026-08-07T14:06:32.818788Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:06:34.620018Z","title":"Synthesizing finite-state protocols from scenarios and requirements","venue":null,"work_id":"93df3ec4-1a6f-42ce-9ec5-609d0e230aa9","year":2014},"citing_paper":{"arxiv_id":"2505.20047","last_updated":"2025-05-26T14:34:04Z","snapshot_observed_at":"2026-08-07T23:31:54.437843Z","submitted_at":"2025-05-26T14:34:04Z","title":"Grammars of Formal Uncertainty: When to Trust LLMs in Automated Reasoning Tasks","version":1},"reference_index":1998,"source":"pdf_text","source_observed_at":"2026-08-07T14:06:33.175591Z"},"links":{"citing_paper":"/paper/2505.20047"},"observation_digest":"sha256:99b367e6a000bca7e9d071247956788d72b0d573dc7cf915952b1f3f7aace336","observation_id":"c1562269-ef36-462f-9eca-00d5ce2bc3ac","resolution":{"observed_at":"2026-08-07T14:06:34.751805Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:06:29.203613Z","title":"Language models are few-shot learners.Advances in neural information processing systems, 33:1877–1901,","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2505.20047","last_updated":"2025-05-26T14:34:04Z","snapshot_observed_at":"2026-08-07T23:31:54.437843Z","submitted_at":"2025-05-26T14:34:04Z","title":"Grammars of Formal Uncertainty: When to Trust LLMs in Automated Reasoning Tasks","version":1},"reference_index":2009,"source":"pdf_text","source_observed_at":"2026-08-07T14:06:29.203613Z"},"links":{"citing_paper":"/paper/2505.20047"},"observation_digest":"sha256:9935de066eff85da1377fb72253c2eba1341bf78a6d256ea832f9e94f997f9a2","observation_id":"7978093a-8da9-47ff-b710-e0b5b4aeedf3","resolution":{"observed_at":"2026-08-07T14:06:29.203613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.07383","last_updated":"2023-11-13T15:08:59Z","snapshot_observed_at":"2026-07-06T16:46:38.855912Z","submitted_at":"2023-11-13T15:08:59Z","title":"LM-Polygraph: Uncertainty Estimation for Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.07383","snapshot_observed_at":"2026-08-07T14:06:31.679535Z","title":"Lm- polygraph: Uncertainty estimation for language models.arXiv preprint arXiv:2311.07383,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.20047","last_updated":"2025-05-26T14:34:04Z","snapshot_observed_at":"2026-08-07T23:31:54.437843Z","submitted_at":"2025-05-26T14:34:04Z","title":"Grammars of Formal Uncertainty: When to Trust LLMs in Automated Reasoning Tasks","version":1},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-07T14:06:31.679535Z"},"links":{"cited_paper":"/paper/2311.07383","citing_paper":"/paper/2505.20047"},"observation_digest":"sha256:1bdfcfa71a0a34127de166f68e2f8f28d1578c91b4b4af74c5cad60e3b72d89b","observation_id":"147a9f44-3ac0-4450-8d3a-88f847a284b9","resolution":{"observed_at":"2026-08-07T14:06:31.679535Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1811.07253","last_updated":"2018-11-18T01:36:05Z","snapshot_observed_at":"2026-07-06T07:15:24.894360Z","submitted_at":"2018-11-18T01:36:05Z","title":"Quantifying Uncertainties in Natural Language Processing Tasks","version":1},"cited_work":{"arxiv_id":"1811.07253","doi":null,"metadata_source":"pith","pith_arxiv_id":"1811.07253","snapshot_observed_at":"2026-08-07T14:06:33.431438Z","title":"Quantifying Uncertainties in Natural Language Processing Tasks","venue":"cs.CL","work_id":"d7621b0f-9e52-4a6e-96e3-dc48dfd9ed6c","year":2018},"citing_paper":{"arxiv_id":"2505.20047","last_updated":"2025-05-26T14:34:04Z","snapshot_observed_at":"2026-08-07T23:31:54.437843Z","submitted_at":"2025-05-26T14:34:04Z","title":"Grammars of Formal Uncertainty: When to Trust LLMs in Automated Reasoning Tasks","version":1},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-07T14:06:32.739732Z"},"links":{"cited_paper":"/paper/1811.07253","citing_paper":"/paper/2505.20047"},"observation_digest":"sha256:b987c81e641a4e3c885687823bc09cdcf22f3da409871c14f124bdad23384e10","observation_id":"4111abfd-0bbd-45ff-9d42-7042cc604811","resolution":{"observed_at":"2026-08-07T14:06:33.482051Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2009.03393","last_updated":"2020-09-07T19:50:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-09-07T19:50:10Z","title":"Generative Language Modeling for Automated Theorem Proving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.03393","snapshot_observed_at":"2026-08-07T14:06:30.374808Z","title":"Generative Language Modeling for Automated Theorem Proving","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2505.20047","last_updated":"2025-05-26T14:34:04Z","snapshot_observed_at":"2026-08-07T23:31:54.437843Z","submitted_at":"2025-05-26T14:34:04Z","title":"Grammars of Formal Uncertainty: When to Trust LLMs in Automated Reasoning Tasks","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-07T14:06:30.374808Z"},"links":{"cited_paper":"/paper/2009.03393","citing_paper":"/paper/2505.20047"},"observation_digest":"sha256:239be40038248346f6bbb5e3cd793ca1b5892540faf109a24e176f96c4f525ef","observation_id":"3d942f1d-7334-4118-8833-460ceb6f8036","resolution":{"observed_at":"2026-08-07T14:06:30.374808Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-08-07T14:06:29.257173Z","title":"Evaluating large language models trained on code.arXiv preprint arXiv:2107.03374,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.20047","last_updated":"2025-05-26T14:34:04Z","snapshot_observed_at":"2026-08-07T23:31:54.437843Z","submitted_at":"2025-05-26T14:34:04Z","title":"Grammars of Formal Uncertainty: When to Trust LLMs in Automated Reasoning Tasks","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-07T14:06:29.257173Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2505.20047"},"observation_digest":"sha256:16b5dcc70b7ae12ff39d0d33337d104bb549d435114696a853ecbdeab0f6b5a3","observation_id":"1a89ae7f-4259-4120-892d-42ff6f6bd11f","resolution":{"observed_at":"2026-08-07T14:06:29.257173Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06825","last_updated":"2023-10-10T17:54:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-10T17:54:58Z","title":"Mistral 7B","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06825","snapshot_observed_at":"2026-08-07T14:06:29.362119Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.20047","last_updated":"2025-05-26T14:34:04Z","snapshot_observed_at":"2026-08-07T23:31:54.437843Z","submitted_at":"2025-05-26T14:34:04Z","title":"Grammars of Formal Uncertainty: When to Trust LLMs in Automated Reasoning Tasks","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-07T14:06:29.362119Z"},"links":{"cited_paper":"/paper/2310.06825","citing_paper":"/paper/2505.20047"},"observation_digest":"sha256:74824a4c2b9c616aa02ac279a20266670678052b444b86e40dedec1dfdce64a4","observation_id":"184b0bb3-661b-4f22-bc44-f51240de8649","resolution":{"observed_at":"2026-08-07T14:06:29.362119Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.05221","last_updated":"2022-11-21T16:38:35Z","snapshot_observed_at":"2026-08-06T08:34:11.887259Z","submitted_at":"2022-07-11T22:59:39Z","title":"Language Models (Mostly) Know What They Know","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.05221","snapshot_observed_at":"2026-08-07T14:06:29.584972Z","title":"Language models (mostly) know what they know.arXiv preprint arXiv:2207.05221,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.20047","last_updated":"2025-05-26T14:34:04Z","snapshot_observed_at":"2026-08-07T23:31:54.437843Z","submitted_at":"2025-05-26T14:34:04Z","title":"Grammars of Formal Uncertainty: When to Trust LLMs in Automated Reasoning Tasks","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-07T14:06:29.584972Z"},"links":{"cited_paper":"/paper/2207.05221","citing_paper":"/paper/2505.20047"},"observation_digest":"sha256:bc47ae68247fc4a64d327a742eb6a851d6d345ee3f4515144b060eb23386ffef","observation_id":"cf8a6316-ee8f-4984-b8ad-0f6c641219ac","resolution":{"observed_at":"2026-08-07T14:06:29.584972Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.07682","last_updated":"2022-10-26T05:06:24Z","snapshot_observed_at":"2026-08-02T15:56:35.249569Z","submitted_at":"2022-06-15T17:32:01Z","title":"Emergent Abilities of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.07682","snapshot_observed_at":"2026-08-07T14:06:29.472186Z","title":"Emergent abilities of large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.20047","last_updated":"2025-05-26T14:34:04Z","snapshot_observed_at":"2026-08-07T23:31:54.437843Z","submitted_at":"2025-05-26T14:34:04Z","title":"Grammars of Formal Uncertainty: When to Trust LLMs in Automated Reasoning Tasks","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-07T14:06:29.472186Z"},"links":{"cited_paper":"/paper/2206.07682","citing_paper":"/paper/2505.20047"},"observation_digest":"sha256:ec3002c1de77b476892951cf1d3c8035fa6aee14b153aea81f8eaa335c3c53ab","observation_id":"5f2baf8d-bde2-4b56-8c9a-d70924117819","resolution":{"observed_at":"2026-08-07T14:06:29.472186Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:06:29.995705Z","title":"doi: 10.18653/v1/2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20047","last_updated":"2025-05-26T14:34:04Z","snapshot_observed_at":"2026-08-07T23:31:54.437843Z","submitted_at":"2025-05-26T14:34:04Z","title":"Grammars of Formal Uncertainty: When to Trust LLMs in Automated Reasoning Tasks","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-07T14:06:29.995705Z"},"links":{"citing_paper":"/paper/2505.20047"},"observation_digest":"sha256:aa78f5c1e7707b08d6138a9a07276f91dedaa884cb16babdd129e81d7d869dc3","observation_id":"72b19340-8d15-42e1-bb17-b4e2376a1c54","resolution":{"observed_at":"2026-08-07T14:06:29.995705Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.20047","last_updated":"2025-05-26T14:34:04Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T23:31:54.437843Z","submitted_at":"2025-05-26T14:34:04Z","title":"Grammars of Formal Uncertainty: When to Trust LLMs in Automated Reasoning Tasks"},"reference_resolution":{"displayed":43,"state_counts":{"malformed_identifier":0,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":32,"verified_exact":3,"verified_fuzzy":6},"total_outbound_references":43},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 43 of 43 outbound references and 4 inbound Pith citation observations for arXiv:2505.20047."}