{"as_of":"2026-08-21T00:29:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:fd4261ea76c9fb46580ed421e4d7b905a691c9f370d24dbf3d9a19253eee15e8","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":36,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":36,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":36,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":36,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T00:48:19.077257Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"pith","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":18,"observed_at":"2026-08-05T02:28:24.338817Z","source":"pith"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2212.09561","last_updated":"2023-10-19T12:24:42Z","snapshot_observed_at":"2026-08-16T16:07:38.799864Z","submitted_at":"2022-12-19T15:51:52Z","title":"Large Language Models are Better Reasoners with Self-Verification","version":5},"cited_work":{"arxiv_id":"2212.09561","doi":"10.48550/arxiv.2212.09561","metadata_source":"pith","pith_arxiv_id":"2212.09561","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Large language models are better reasoners with self-verification","venue":"cs.AI","work_id":"c619fd60-f293-4770-8804-2da7d9c102c7","year":2022},"citing_paper":{"arxiv_id":"2309.11495","last_updated":"2023-09-25T15:25:49Z","snapshot_observed_at":"2026-08-12T01:35:36.884518Z","submitted_at":"2023-09-20T17:50:55Z","title":"Chain-of-Verification Reduces Hallucination in Large Language Models","version":2},"reference_index":166,"source":"arxiv_source","source_observed_at":"2026-05-18T01:06:49.811982Z"},"links":{"cited_paper":"/paper/2212.09561","citing_paper":"/paper/2309.11495"},"observation_digest":"sha256:509669adacc9e4b263eddce55ab212b5bd943e404ba79a09a767229fb4493c60","observation_id":"87d19f36-573b-4aee-bd63-bd4c465b0a80","resolution":{"observed_at":"2026-05-18T01:06:50.450011Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.09561","last_updated":"2023-10-19T12:24:42Z","snapshot_observed_at":"2026-08-16T16:07:38.799864Z","submitted_at":"2022-12-19T15:51:52Z","title":"Large Language Models are Better Reasoners with Self-Verification","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.09561","snapshot_observed_at":"2026-08-12T17:45:06.327675Z","title":"Preprint at https://arxiv.org/abs/ 2212.09561","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.13599","last_updated":"2025-01-16T03:17:25Z","snapshot_observed_at":"2026-08-18T17:55:57.379689Z","submitted_at":"2024-11-19T07:45:58Z","title":"Can ChatGPT Overcome Behavioral Biases in the Financial Sector? Classify-and-Rethink: Multi-Step Zero-Shot Reasoning in the Gold Investment","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-12T17:45:06.327675Z"},"links":{"cited_paper":"/paper/2212.09561","citing_paper":"/paper/2411.13599"},"observation_digest":"sha256:2f04fd02026dd42f4ad6166bb9b77a00a53a54f49cbcba53d1291ff69c08c7be","observation_id":"bf93e7fe-e22a-4b3d-b04a-b20630d7b83d","resolution":{"observed_at":"2026-08-12T17:45:06.327675Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.09561","last_updated":"2023-10-19T12:24:42Z","snapshot_observed_at":"2026-08-16T16:07:38.799864Z","submitted_at":"2022-12-19T15:51:52Z","title":"Large Language Models are Better Reasoners with Self-Verification","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.09561","snapshot_observed_at":"2026-08-12T13:21:05.689035Z","title":"Large language models are rea- soners with self-verification","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.16345","last_updated":"2025-02-14T09:32:11Z","snapshot_observed_at":"2026-08-20T08:22:27.878447Z","submitted_at":"2024-11-25T12:44:02Z","title":"Preference Optimization for Reasoning with Pseudo Feedback","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-12T13:21:05.689035Z"},"links":{"cited_paper":"/paper/2212.09561","citing_paper":"/paper/2411.16345"},"observation_digest":"sha256:d6d85be94910ce77e984d0f817162cab8fd97f7b3962336ce052b79ac7808eb1","observation_id":"2c0632bf-d3c1-44f4-97b5-d612d366652c","resolution":{"observed_at":"2026-08-12T13:21:05.689035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.09561","last_updated":"2023-10-19T12:24:42Z","snapshot_observed_at":"2026-08-16T16:07:38.799864Z","submitted_at":"2022-12-19T15:51:52Z","title":"Large Language Models are Better Reasoners with Self-Verification","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.09561","snapshot_observed_at":"2026-08-12T12:45:35.830417Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.16955","last_updated":"2025-02-28T21:41:21Z","snapshot_observed_at":"2026-08-19T13:30:03.079680Z","submitted_at":"2024-11-25T21:51:45Z","title":"Probing the limitations of multimodal language models for chemistry and materials research","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-12T12:45:35.830417Z"},"links":{"cited_paper":"/paper/2212.09561","citing_paper":"/paper/2411.16955"},"observation_digest":"sha256:49b5592e4aa884690f1aff8923df873edb9ce90a3141f009b2afab9da3fedce3","observation_id":"09c0690a-0e04-4c24-b199-3b1f51d64930","resolution":{"observed_at":"2026-08-12T12:45:35.830417Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.09561","last_updated":"2023-10-19T12:24:42Z","snapshot_observed_at":"2026-08-16T16:07:38.799864Z","submitted_at":"2022-12-19T15:51:52Z","title":"Large Language Models are Better Reasoners with Self-Verification","version":5},"cited_work":{"arxiv_id":"2212.09561","doi":"10.48550/arxiv.2212.09561","metadata_source":"pith","pith_arxiv_id":"2212.09561","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Large language models are better reasoners with self-verification","venue":"cs.AI","work_id":"c619fd60-f293-4770-8804-2da7d9c102c7","year":2022},"citing_paper":{"arxiv_id":"2411.18104","last_updated":"2026-05-13T18:33:16Z","snapshot_observed_at":"2026-08-08T03:07:50.153026Z","submitted_at":"2024-11-27T07:32:56Z","title":"Training and Evaluating Language Models with Template-based Data Generation","version":6},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-23T17:02:06.199875Z"},"links":{"cited_paper":"/paper/2212.09561","citing_paper":"/paper/2411.18104"},"observation_digest":"sha256:85460c0ce0747242416e4d92caea8550acf34941b78dcebd171f5fca382d1473","observation_id":"498cb045-9f24-4c94-9c8e-1c7d6ad68a5c","resolution":{"observed_at":"2026-05-23T17:03:12.419135Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.09561","last_updated":"2023-10-19T12:24:42Z","snapshot_observed_at":"2026-08-16T16:07:38.799864Z","submitted_at":"2022-12-19T15:51:52Z","title":"Large Language Models are Better Reasoners with Self-Verification","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.09561","snapshot_observed_at":"2026-08-11T17:25:59.713082Z","title":"Large language models are better reasoners with self-verification","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.10455","last_updated":"2024-12-12T07:34:09Z","snapshot_observed_at":"2026-08-20T15:11:08.238793Z","submitted_at":"2024-12-12T07:34:09Z","title":"Geo-LLaVA: A Large Multi-Modal Model for Solving Geometry Math Problems with Meta In-Context Learning","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-11T17:25:59.713082Z"},"links":{"cited_paper":"/paper/2212.09561","citing_paper":"/paper/2412.10455"},"observation_digest":"sha256:d1846124b0cdca59c7c268b7f7f297b27c686e1b3e5bbd01b8b6983c6cd3b2be","observation_id":"175b283a-c117-4639-b775-6f677e43362c","resolution":{"observed_at":"2026-08-11T17:25:59.713082Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.09561","last_updated":"2023-10-19T12:24:42Z","snapshot_observed_at":"2026-08-16T16:07:38.799864Z","submitted_at":"2022-12-19T15:51:52Z","title":"Large Language Models are Better Reasoners with Self-Verification","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.09561","snapshot_observed_at":"2026-08-10T23:21:34.248645Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.20995","last_updated":"2024-12-30T14:58:46Z","snapshot_observed_at":"2026-08-18T17:10:45.706834Z","submitted_at":"2024-12-30T14:58:46Z","title":"KARPA: A Training-free Method of Adapting Knowledge Graph as References for Large Language Model's Reasoning Path Aggregation","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-10T23:21:34.248645Z"},"links":{"cited_paper":"/paper/2212.09561","citing_paper":"/paper/2412.20995"},"observation_digest":"sha256:19da0b5e42d66dc84a7e6c416b0d2e52ce6db8bc673ba6a1f0171a5fcbe2d0b3","observation_id":"e80af26e-7d64-44e6-b171-b826f5736477","resolution":{"observed_at":"2026-08-10T23:21:34.248645Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.09561","last_updated":"2023-10-19T12:24:42Z","snapshot_observed_at":"2026-08-16T16:07:38.799864Z","submitted_at":"2022-12-19T15:51:52Z","title":"Large Language Models are Better Reasoners with Self-Verification","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.09561","snapshot_observed_at":"2026-08-10T21:35:42.098860Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.04606","last_updated":"2025-06-11T04:23:47Z","snapshot_observed_at":"2026-08-16T00:28:07.895058Z","submitted_at":"2025-01-08T16:41:31Z","title":"Enhancing Low-Cost Video Editing with Lightweight Adaptors and Temporal-Aware Inversion","version":4},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-10T21:35:42.098860Z"},"links":{"cited_paper":"/paper/2212.09561","citing_paper":"/paper/2501.04606"},"observation_digest":"sha256:a813b7bc68f40353af38d4d67a1c40647683ca29ea26d0d5df0dcaca93d06be8","observation_id":"156af699-3c21-4549-922b-f149d636c04e","resolution":{"observed_at":"2026-08-10T21:35:42.098860Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.09561","last_updated":"2023-10-19T12:24:42Z","snapshot_observed_at":"2026-08-16T16:07:38.799864Z","submitted_at":"2022-12-19T15:51:52Z","title":"Large Language Models are Better Reasoners with Self-Verification","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.09561","snapshot_observed_at":"2026-08-10T17:27:43.144154Z","title":"arXiv preprint arXiv:2212.09561","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.12226","last_updated":"2025-01-21T15:51:07Z","snapshot_observed_at":"2026-08-18T08:00:52.745622Z","submitted_at":"2025-01-21T15:51:07Z","title":"CDW-CoT: Clustered Distance-Weighted Chain-of-Thoughts Reasoning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T17:27:43.144154Z"},"links":{"cited_paper":"/paper/2212.09561","citing_paper":"/paper/2501.12226"},"observation_digest":"sha256:84cd5c2d539c0f78b53fe372c2f1faf6934e6082d2e16ca9eaf149ba15fa8cd0","observation_id":"79738a5f-8d30-4efd-8291-a70551262d76","resolution":{"observed_at":"2026-08-10T17:27:43.144154Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.09561","last_updated":"2023-10-19T12:24:42Z","snapshot_observed_at":"2026-08-16T16:07:38.799864Z","submitted_at":"2022-12-19T15:51:52Z","title":"Large Language Models are Better Reasoners with Self-Verification","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.09561","snapshot_observed_at":"2026-08-10T15:13:43.413912Z","title":"In Proceed- ings of the 62nd Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Pa- pers), pages 9426–9439, Bangkok, Thailand","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.14431","last_updated":"2025-05-28T06:18:34Z","snapshot_observed_at":"2026-08-20T10:32:10.632554Z","submitted_at":"2025-01-24T11:57:39Z","title":"Domaino1s: Guiding LLM Reasoning for Explainable Answers in High-Stakes Domains","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T15:13:43.413912Z"},"links":{"cited_paper":"/paper/2212.09561","citing_paper":"/paper/2501.14431"},"observation_digest":"sha256:1fac026f7ffbb99ee4323624c66c320af6c5a886a3bd95e275868a82a6f4c8dc","observation_id":"1654f0ae-fac7-4dab-876a-0c4cd91e19b0","resolution":{"observed_at":"2026-08-10T15:13:43.413912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.09561","last_updated":"2023-10-19T12:24:42Z","snapshot_observed_at":"2026-08-16T16:07:38.799864Z","submitted_at":"2022-12-19T15:51:52Z","title":"Large Language Models are Better Reasoners with Self-Verification","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.09561","snapshot_observed_at":"2026-08-11T20:21:29.064025Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.14731","last_updated":"2024-12-08T09:02:04Z","snapshot_observed_at":"2026-08-17T17:45:11.654208Z","submitted_at":"2024-12-08T09:02:04Z","title":"From Critique to Clarity: A Pathway to Faithful and Personalized Code Explanations with Large Language Models","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-11T20:21:29.064025Z"},"links":{"cited_paper":"/paper/2212.09561","citing_paper":"/paper/2501.14731"},"observation_digest":"sha256:01af13d5a3ae45d345b09bac7f1f2aebf000e6e813881639bd0e51835bd6ea29","observation_id":"0f2c44c4-5410-43b6-80e4-8a5068614f84","resolution":{"observed_at":"2026-08-11T20:21:29.064025Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.09561","last_updated":"2023-10-19T12:24:42Z","snapshot_observed_at":"2026-08-16T16:07:38.799864Z","submitted_at":"2022-12-19T15:51:52Z","title":"Large Language Models are Better Reasoners with Self-Verification","version":5},"cited_work":{"arxiv_id":"2212.09561","doi":"10.48550/arxiv.2212.09561","metadata_source":"pith","pith_arxiv_id":"2212.09561","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Large language models are better reasoners with self-verification","venue":"cs.AI","work_id":"c619fd60-f293-4770-8804-2da7d9c102c7","year":2022},"citing_paper":{"arxiv_id":"2503.10615","last_updated":"2025-03-18T08:52:34Z","snapshot_observed_at":"2026-08-15T09:44:57.157415Z","submitted_at":"2025-03-13T17:56:05Z","title":"R1-Onevision: Advancing Generalized Multimodal Reasoning through Cross-Modal Formalization","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-16T00:19:20.462455Z"},"links":{"cited_paper":"/paper/2212.09561","citing_paper":"/paper/2503.10615"},"observation_digest":"sha256:0084ad675d234128464ee4ac8727b9b070014c977492f858c7bf823fb6b4e572","observation_id":"2ed79e0e-0500-4585-9102-bce523ad6757","resolution":{"observed_at":"2026-05-16T00:19:20.641772Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.09561","last_updated":"2023-10-19T12:24:42Z","snapshot_observed_at":"2026-08-16T16:07:38.799864Z","submitted_at":"2022-12-19T15:51:52Z","title":"Large Language Models are Better Reasoners with Self-Verification","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.09561","snapshot_observed_at":"2026-08-16T00:48:19.077257Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.02665","last_updated":"2025-05-08T05:27:18Z","snapshot_observed_at":"2026-08-18T12:36:55.051772Z","submitted_at":"2025-05-05T14:14:59Z","title":"A Survey of Slow Thinking-based Reasoning LLMs using Reinforced Learning and Inference-time Scaling Law","version":2},"reference_index":114,"source":"pdf_text","source_observed_at":"2026-08-16T00:48:19.077257Z"},"links":{"cited_paper":"/paper/2212.09561","citing_paper":"/paper/2505.02665"},"observation_digest":"sha256:5cc95ae850fac8e864a31329bf63a2aead75ba2adf1841fb1eb8245d31d130e1","observation_id":"a222b479-f9fc-4ac7-a466-dbcabce47163","resolution":{"observed_at":"2026-08-16T00:48:19.077257Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.09561","last_updated":"2023-10-19T12:24:42Z","snapshot_observed_at":"2026-08-16T16:07:38.799864Z","submitted_at":"2022-12-19T15:51:52Z","title":"Large Language Models are Better Reasoners with Self-Verification","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.09561","snapshot_observed_at":"2026-08-15T21:45:32.135326Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.09031","last_updated":"2025-05-13T23:57:02Z","snapshot_observed_at":"2026-08-18T23:49:02.872972Z","submitted_at":"2025-05-13T23:57:02Z","title":"Improving the Reliability of LLMs: Combining CoT, RAG, Self-Consistency, and Self-Verification","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T21:45:32.135326Z"},"links":{"cited_paper":"/paper/2212.09561","citing_paper":"/paper/2505.09031"},"observation_digest":"sha256:c215549f77432594c9a82a70bf10a23357bdc67289717d2fbdd7fc656c69202f","observation_id":"4375e49a-f2ac-4fde-bc32-62f5f36fd0a2","resolution":{"observed_at":"2026-08-15T21:45:32.135326Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.09561","last_updated":"2023-10-19T12:24:42Z","snapshot_observed_at":"2026-08-16T16:07:38.799864Z","submitted_at":"2022-12-19T15:51:52Z","title":"Large Language Models are Better Reasoners with Self-Verification","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.09561","snapshot_observed_at":"2026-08-15T20:41:47.156554Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.12257","last_updated":"2025-05-18T06:33:08Z","snapshot_observed_at":"2026-08-19T12:37:03.588096Z","submitted_at":"2025-05-18T06:33:08Z","title":"LLM Context Conditioning and PWP Prompting for Multimodal Validation of Chemical Formulas","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T20:41:47.156554Z"},"links":{"cited_paper":"/paper/2212.09561","citing_paper":"/paper/2505.12257"},"observation_digest":"sha256:c1a57af8d390d05675329d56a03d2b78bf9d4d33e23e4c35021161ef35310662","observation_id":"5398508f-cb57-4102-bcaf-701f0eda6bba","resolution":{"observed_at":"2026-08-15T20:41:47.156554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.09561","last_updated":"2023-10-19T12:24:42Z","snapshot_observed_at":"2026-08-16T16:07:38.799864Z","submitted_at":"2022-12-19T15:51:52Z","title":"Large Language Models are Better Reasoners with Self-Verification","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.09561","snapshot_observed_at":"2026-08-15T20:12:31.131110Z","title":"Large language models are better reasoners with self-verification","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.13941","last_updated":"2025-05-20T05:20:53Z","snapshot_observed_at":"2026-08-17T14:57:33.654987Z","submitted_at":"2025-05-20T05:20:53Z","title":"MLZero: A Multi-Agent System for End-to-end Machine Learning Automation","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-15T20:12:31.131110Z"},"links":{"cited_paper":"/paper/2212.09561","citing_paper":"/paper/2505.13941"},"observation_digest":"sha256:80a54db02886d1b369a3feda9c2908b2429518ddda4822486ffe4e8d9058517d","observation_id":"57b78269-1397-49cc-8174-902ee5645fc5","resolution":{"observed_at":"2026-08-15T20:12:31.131110Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.09561","last_updated":"2023-10-19T12:24:42Z","snapshot_observed_at":"2026-08-16T16:07:38.799864Z","submitted_at":"2022-12-19T15:51:52Z","title":"Large Language Models are Better Reasoners with Self-Verification","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.09561","snapshot_observed_at":"2026-08-07T15:26:13.393129Z","title":"Large language models are better reasoners with self-verification","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.15242","last_updated":"2025-05-22T06:10:20Z","snapshot_observed_at":"2026-08-19T18:31:45.917541Z","submitted_at":"2025-05-21T08:18:41Z","title":"Adaptive Plan-Execute Framework for Smart Contract Security Auditing","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T15:26:13.393129Z"},"links":{"cited_paper":"/paper/2212.09561","citing_paper":"/paper/2505.15242"},"observation_digest":"sha256:3f7f1ebe1b5b18e39e1f3280cab1240a697ed0964d644da5d7c8561d123ae119","observation_id":"9c4f8dc7-3ecf-4c08-8cb1-acb93e041926","resolution":{"observed_at":"2026-08-07T15:26:13.393129Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.09561","last_updated":"2023-10-19T12:24:42Z","snapshot_observed_at":"2026-08-16T16:07:38.799864Z","submitted_at":"2022-12-19T15:51:52Z","title":"Large Language Models are Better Reasoners with Self-Verification","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.09561","snapshot_observed_at":"2026-08-07T11:04:06.854412Z","title":"Large language models are better reasoners with self-verification,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.03637","last_updated":"2025-07-07T09:53:22Z","snapshot_observed_at":"2026-08-08T03:23:19.289933Z","submitted_at":"2025-06-04T07:30:16Z","title":"RewardAnything: Generalizable Principle-Following Reward Models","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:06.854412Z"},"links":{"cited_paper":"/paper/2212.09561","citing_paper":"/paper/2506.03637"},"observation_digest":"sha256:5925157de2da81361f80833859ea3114c39fa3e27411bb8c0c83d672ceaf50c6","observation_id":"d4655333-ac14-4745-9507-ef5406937add","resolution":{"observed_at":"2026-08-07T11:04:06.854412Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.09561","last_updated":"2023-10-19T12:24:42Z","snapshot_observed_at":"2026-08-16T16:07:38.799864Z","submitted_at":"2022-12-19T15:51:52Z","title":"Large Language Models are Better Reasoners with Self-Verification","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.09561","snapshot_observed_at":"2026-08-07T10:54:30.506047Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.04185","last_updated":"2025-06-04T17:29:22Z","snapshot_observed_at":"2026-08-14T16:21:00.971846Z","submitted_at":"2025-06-04T17:29:22Z","title":"R-Search: Empowering LLM Reasoning with Search via Multi-Reward Reinforcement Learning","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T10:54:30.506047Z"},"links":{"cited_paper":"/paper/2212.09561","citing_paper":"/paper/2506.04185"},"observation_digest":"sha256:b64e6af3e1f90d5c8e27e3f4055e1715ea444a4baa5cfbc4a4aca0c247947d97","observation_id":"c931d564-86c3-4854-8096-736595ec00c7","resolution":{"observed_at":"2026-08-07T10:54:30.506047Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.09561","last_updated":"2023-10-19T12:24:42Z","snapshot_observed_at":"2026-08-16T16:07:38.799864Z","submitted_at":"2022-12-19T15:51:52Z","title":"Large Language Models are Better Reasoners with Self-Verification","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.09561","snapshot_observed_at":"2026-08-07T10:31:58.811397Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.05070","last_updated":"2025-08-05T04:45:24Z","snapshot_observed_at":"2026-08-20T08:50:52.249817Z","submitted_at":"2025-06-05T14:18:21Z","title":"RIVAL: Reinforcement Learning with Iterative and Adversarial Optimization for Machine Translation","version":2},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-07T10:31:58.811397Z"},"links":{"cited_paper":"/paper/2212.09561","citing_paper":"/paper/2506.05070"},"observation_digest":"sha256:5b327a57852269502132b6ed7e5474835540aaad55d7c90692d75b65cca1cf8f","observation_id":"7db21fb0-8274-483a-855a-770646a5f354","resolution":{"observed_at":"2026-08-07T10:31:58.811397Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.09561","last_updated":"2023-10-19T12:24:42Z","snapshot_observed_at":"2026-08-16T16:07:38.799864Z","submitted_at":"2022-12-19T15:51:52Z","title":"Large Language Models are Better Reasoners with Self-Verification","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.09561","snapshot_observed_at":"2026-08-06T10:55:15.094648Z","title":"Large language models are better reasoners with self-verification","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.23276","last_updated":"2025-08-01T12:49:36Z","snapshot_observed_at":"2026-08-18T13:29:43.194474Z","submitted_at":"2025-07-31T06:32:06Z","title":"How Far Are AI Scientists from Changing the World?","version":2},"reference_index":177,"source":"arxiv_source","source_observed_at":"2026-08-06T10:55:15.094648Z"},"links":{"cited_paper":"/paper/2212.09561","citing_paper":"/paper/2507.23276"},"observation_digest":"sha256:2cb9248a89dc22674abc2b7d1fb634da3a88d76f2debb5cac02697b4c7fc1ec5","observation_id":"949c595d-0aaa-4b59-a4a9-f583ed321d80","resolution":{"observed_at":"2026-08-06T10:55:15.094648Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.09561","last_updated":"2023-10-19T12:24:42Z","snapshot_observed_at":"2026-08-16T16:07:38.799864Z","submitted_at":"2022-12-19T15:51:52Z","title":"Large Language Models are Better Reasoners with Self-Verification","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.09561","snapshot_observed_at":"2026-08-05T23:42:37.743485Z","title":"Large language models are better reasoners with self-verification, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.05003","last_updated":"2025-08-07T03:36:38Z","snapshot_observed_at":"2026-08-09T19:42:50.597891Z","submitted_at":"2025-08-07T03:36:38Z","title":"A Multi-Stage Large Language Model Framework for Extracting Suicide-Related Social Determinants of Health","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-05T23:42:37.743485Z"},"links":{"cited_paper":"/paper/2212.09561","citing_paper":"/paper/2508.05003"},"observation_digest":"sha256:0ca0984c79f95b50c80bb193ecb5e7ccb17e134a8a8c27c98a9e3f736d00e6e3","observation_id":"9d6e1274-e8ca-44cf-bb04-e2c3c3b9917e","resolution":{"observed_at":"2026-08-05T23:42:37.743485Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.09561","last_updated":"2023-10-19T12:24:42Z","snapshot_observed_at":"2026-08-16T16:07:38.799864Z","submitted_at":"2022-12-19T15:51:52Z","title":"Large Language Models are Better Reasoners with Self-Verification","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.09561","snapshot_observed_at":"2026-08-05T10:50:33.558699Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.05360","last_updated":"2025-09-03T18:52:24Z","snapshot_observed_at":"2026-08-20T20:08:37.232265Z","submitted_at":"2025-09-03T18:52:24Z","title":"Beyond ROUGE: N-Gram Subspace Features for LLM Hallucination Detection","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-05T10:50:33.558699Z"},"links":{"cited_paper":"/paper/2212.09561","citing_paper":"/paper/2509.05360"},"observation_digest":"sha256:36a9e4c2ad3fad0bf9486d1ea6763dd662b657c1982c76b675325697e1150d7b","observation_id":"cc7c6947-caf7-4409-ba0f-e7df1fd58c6f","resolution":{"observed_at":"2026-08-05T10:50:33.558699Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.09561","last_updated":"2023-10-19T12:24:42Z","snapshot_observed_at":"2026-08-16T16:07:38.799864Z","submitted_at":"2022-12-19T15:51:52Z","title":"Large Language Models are Better Reasoners with Self-Verification","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.09561","snapshot_observed_at":"2026-08-05T04:50:32.060826Z","title":"Large language models are better reasoners with self-verification,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.05946","last_updated":"2025-09-07T06:46:03Z","snapshot_observed_at":"2026-08-19T07:13:23.982378Z","submitted_at":"2025-09-07T06:46:03Z","title":"Large Language Models for Next-Generation Wireless Network Management: A Survey and Tutorial","version":1},"reference_index":149,"source":"pdf_text","source_observed_at":"2026-08-05T04:50:32.060826Z"},"links":{"cited_paper":"/paper/2212.09561","citing_paper":"/paper/2509.05946"},"observation_digest":"sha256:de0e333b3d725f97fd3e8e9c6b3ba704d2a6410953501cba9fc3c9e46aea8263","observation_id":"841134ed-ef66-420b-b9cf-64e601b859d5","resolution":{"observed_at":"2026-08-05T04:50:32.060826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.09561","last_updated":"2023-10-19T12:24:42Z","snapshot_observed_at":"2026-08-16T16:07:38.799864Z","submitted_at":"2022-12-19T15:51:52Z","title":"Large Language Models are Better Reasoners with Self-Verification","version":5},"cited_work":{"arxiv_id":"2212.09561","doi":"10.48550/arxiv.2212.09561","metadata_source":"pith","pith_arxiv_id":"2212.09561","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Large language models are better reasoners with self-verification","venue":"cs.AI","work_id":"c619fd60-f293-4770-8804-2da7d9c102c7","year":2022},"citing_paper":{"arxiv_id":"2512.00127","last_updated":"2026-04-27T09:10:32Z","snapshot_observed_at":"2026-08-11T12:52:24.078635Z","submitted_at":"2025-11-28T07:43:43Z","title":"Generating Verifiable Chain of Thoughts from Exection-Traces","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-17T05:17:10.692544Z"},"links":{"cited_paper":"/paper/2212.09561","citing_paper":"/paper/2512.00127"},"observation_digest":"sha256:5d5cf41c53cb99332a4451f284ee4c0dbd665024e222ead82587427016cbc31f","observation_id":"47bd3797-0204-4b01-aacd-567bb566c419","resolution":{"observed_at":"2026-05-17T05:19:04.847935Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.09561","last_updated":"2023-10-19T12:24:42Z","snapshot_observed_at":"2026-08-16T16:07:38.799864Z","submitted_at":"2022-12-19T15:51:52Z","title":"Large Language Models are Better Reasoners with Self-Verification","version":5},"cited_work":{"arxiv_id":"2212.09561","doi":"10.48550/arxiv.2212.09561","metadata_source":"pith","pith_arxiv_id":"2212.09561","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Large language models are better reasoners with self-verification","venue":"cs.AI","work_id":"c619fd60-f293-4770-8804-2da7d9c102c7","year":2022},"citing_paper":{"arxiv_id":"2605.08904","last_updated":"2026-05-09T11:51:34Z","snapshot_observed_at":"2026-08-14T08:35:38.597227Z","submitted_at":"2026-05-09T11:51:34Z","title":"OPT-BENCH: Evaluating the Iterative Self-Optimization of LLM Agents in Large-Scale Search Spaces","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-05-12T02:57:15.521594Z"},"links":{"cited_paper":"/paper/2212.09561","citing_paper":"/paper/2605.08904"},"observation_digest":"sha256:81e389ddfce27a7cf385d580322e99a08119dc40f101b804f1a10bb904c6cf30","observation_id":"ddbd51d9-e49b-47bc-aca4-d7cd338d9d68","resolution":{"observed_at":"2026-05-12T03:01:18.658690Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.09561","last_updated":"2023-10-19T12:24:42Z","snapshot_observed_at":"2026-08-16T16:07:38.799864Z","submitted_at":"2022-12-19T15:51:52Z","title":"Large Language Models are Better Reasoners with Self-Verification","version":5},"cited_work":{"arxiv_id":"2212.09561","doi":"10.48550/arxiv.2212.09561","metadata_source":"pith","pith_arxiv_id":"2212.09561","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Large language models are better reasoners with self-verification","venue":"cs.AI","work_id":"c619fd60-f293-4770-8804-2da7d9c102c7","year":2022},"citing_paper":{"arxiv_id":"2606.00172","last_updated":"2026-05-29T13:21:30Z","snapshot_observed_at":"2026-08-15T08:47:28.179911Z","submitted_at":"2026-05-29T13:21:30Z","title":"CAST: Non-Privileged Clipped Asymmetric Self-Teaching with Advantage Flipping for GRPO","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-06-28T22:25:04.067339Z"},"links":{"cited_paper":"/paper/2212.09561","citing_paper":"/paper/2606.00172"},"observation_digest":"sha256:2171c556fb6fdbc27db239676c529b5b4a09611f942d8982f4f16c4b53e04994","observation_id":"dd75ecbf-70cc-414c-8d99-dfdffd878c5b","resolution":{"observed_at":"2026-07-01T19:26:01.082373Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.09561","last_updated":"2023-10-19T12:24:42Z","snapshot_observed_at":"2026-08-16T16:07:38.799864Z","submitted_at":"2022-12-19T15:51:52Z","title":"Large Language Models are Better Reasoners with Self-Verification","version":5},"cited_work":{"arxiv_id":"2212.09561","doi":"10.48550/arxiv.2212.09561","metadata_source":"pith","pith_arxiv_id":"2212.09561","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Large language models are better reasoners with self-verification","venue":"cs.AI","work_id":"c619fd60-f293-4770-8804-2da7d9c102c7","year":2022},"citing_paper":{"arxiv_id":"2606.22873","last_updated":"2026-06-25T18:44:01Z","snapshot_observed_at":"2026-08-12T17:43:10.201466Z","submitted_at":"2026-06-22T05:37:43Z","title":"SingGuard: A Policy-Adaptive Multimodal LLM Guardrail with Dynamic Reasoning","version":2},"reference_index":259,"source":"arxiv_source","source_observed_at":"2026-06-26T09:19:50.623741Z"},"links":{"cited_paper":"/paper/2212.09561","citing_paper":"/paper/2606.22873"},"observation_digest":"sha256:1746cd4499bfd497e9317478d48f3dc6c0de8ad81d1c41e8853637816c73ac0d","observation_id":"83c150a8-981a-4da6-b1c6-f40f66327281","resolution":{"observed_at":"2026-07-04T09:59:44.975482Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.09561","last_updated":"2023-10-19T12:24:42Z","snapshot_observed_at":"2026-08-16T16:07:38.799864Z","submitted_at":"2022-12-19T15:51:52Z","title":"Large Language Models are Better Reasoners with Self-Verification","version":5},"cited_work":{"arxiv_id":"2212.09561","doi":"10.48550/arxiv.2212.09561","metadata_source":"pith","pith_arxiv_id":"2212.09561","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Large language models are better reasoners with self-verification","venue":"cs.AI","work_id":"c619fd60-f293-4770-8804-2da7d9c102c7","year":2022},"citing_paper":{"arxiv_id":"2606.22873","last_updated":"2026-06-25T18:44:01Z","snapshot_observed_at":"2026-08-12T17:43:10.201466Z","submitted_at":"2026-06-22T05:37:43Z","title":"SingGuard: A Policy-Adaptive Multimodal LLM Guardrail with Dynamic Reasoning","version":3},"reference_index":258,"source":"arxiv_source","source_observed_at":"2026-06-29T01:18:19.195007Z"},"links":{"cited_paper":"/paper/2212.09561","citing_paper":"/paper/2606.22873"},"observation_digest":"sha256:f869e4b3ad3c00859b45b8d1d68b045fda93ceaf1e4fd29a271a8e981be2062d","observation_id":"767f0832-0969-4201-9252-1491ce822572","resolution":{"observed_at":"2026-07-01T18:55:59.723648Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.09561","last_updated":"2023-10-19T12:24:42Z","snapshot_observed_at":"2026-08-16T16:07:38.799864Z","submitted_at":"2022-12-19T15:51:52Z","title":"Large Language Models are Better Reasoners with Self-Verification","version":5},"cited_work":{"arxiv_id":"2212.09561","doi":"10.48550/arxiv.2212.09561","metadata_source":"pith","pith_arxiv_id":"2212.09561","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Large language models are better reasoners with self-verification","venue":"cs.AI","work_id":"c619fd60-f293-4770-8804-2da7d9c102c7","year":2022},"citing_paper":{"arxiv_id":"2606.24790","last_updated":"2026-06-23T16:46:36Z","snapshot_observed_at":"2026-08-16T07:20:12.440627Z","submitted_at":"2026-06-23T16:46:36Z","title":"Grad Detect: Gradient-Based Hallucination Detection in LLMs","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-06-25T23:59:19.950066Z"},"links":{"cited_paper":"/paper/2212.09561","citing_paper":"/paper/2606.24790"},"observation_digest":"sha256:659276d5ac8e1429c6f642aab7a0c5381cfa4a39c30f2279d6e9a70fc1294828","observation_id":"b9b49c14-c70c-40a0-b52c-d1414f2795f4","resolution":{"observed_at":"2026-06-26T00:08:43.193888Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.09561","last_updated":"2023-10-19T12:24:42Z","snapshot_observed_at":"2026-08-16T16:07:38.799864Z","submitted_at":"2022-12-19T15:51:52Z","title":"Large Language Models are Better Reasoners with Self-Verification","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.09561","snapshot_observed_at":"2026-07-11T13:53:36.775836Z","title":"arXiv preprint arXiv:2212.09561 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04763","last_updated":"2026-07-26T14:17:18Z","snapshot_observed_at":"2026-08-15T22:59:02.741838Z","submitted_at":"2026-07-06T07:56:53Z","title":"Multi-Turn On-Policy Distillation with Prefix Replay","version":1},"reference_index":297,"source":"arxiv_source","source_observed_at":"2026-07-11T13:53:36.775836Z"},"links":{"cited_paper":"/paper/2212.09561","citing_paper":"/paper/2607.04763"},"observation_digest":"sha256:1b727da2200de0be13917be5bf7072ee9b986c423bf8256cd67f13ecfabbfe50","observation_id":"ae4175c8-52ee-468f-aa47-f92b582d0f9a","resolution":{"observed_at":"2026-07-11T13:53:36.775836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.09561","last_updated":"2023-10-19T12:24:42Z","snapshot_observed_at":"2026-08-16T16:07:38.799864Z","submitted_at":"2022-12-19T15:51:52Z","title":"Large Language Models are Better Reasoners with Self-Verification","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.09561","snapshot_observed_at":"2026-08-02T08:41:07.372997Z","title":"arXiv preprint arXiv:2212.09561 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04763","last_updated":"2026-07-26T14:17:18Z","snapshot_observed_at":"2026-08-15T22:59:02.741838Z","submitted_at":"2026-07-06T07:56:53Z","title":"Multi-Turn On-Policy Distillation with Prefix Replay","version":3},"reference_index":298,"source":"arxiv_source","source_observed_at":"2026-08-02T08:41:07.372997Z"},"links":{"cited_paper":"/paper/2212.09561","citing_paper":"/paper/2607.04763"},"observation_digest":"sha256:62b09af4b46ed93f5c8447e83a6b86e65a610b74b2e611f5c4c53047a518076e","observation_id":"49858bb7-7478-4275-ac4c-80d9c5bfd1c3","resolution":{"observed_at":"2026-08-02T08:41:07.372997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.09561","last_updated":"2023-10-19T12:24:42Z","snapshot_observed_at":"2026-08-16T16:07:38.799864Z","submitted_at":"2022-12-19T15:51:52Z","title":"Large Language Models are Better Reasoners with Self-Verification","version":5},"cited_work":{"arxiv_id":"2212.09561","doi":"10.48550/arxiv.2212.09561","metadata_source":"pith","pith_arxiv_id":"2212.09561","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Large language models are better reasoners with self-verification","venue":"cs.AI","work_id":"c619fd60-f293-4770-8804-2da7d9c102c7","year":2022},"citing_paper":{"arxiv_id":"2607.05391","last_updated":"2026-07-07T17:26:37Z","snapshot_observed_at":"2026-08-12T04:52:01.599894Z","submitted_at":"2026-07-06T17:59:35Z","title":"LLM-as-a-Verifier: A General-Purpose Verification Framework","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-07-07T12:47:29.552283Z"},"links":{"cited_paper":"/paper/2212.09561","citing_paper":"/paper/2607.05391"},"observation_digest":"sha256:a94be63f5909dbace627fea91bd53af660082843dcfb30d25970e826f480b305","observation_id":"b9cd906f-3757-4a56-bb68-583c10427c95","resolution":{"observed_at":"2026-07-07T12:53:50.153069Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.09561","last_updated":"2023-10-19T12:24:42Z","snapshot_observed_at":"2026-08-16T16:07:38.799864Z","submitted_at":"2022-12-19T15:51:52Z","title":"Large Language Models are Better Reasoners with Self-Verification","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.09561","snapshot_observed_at":"2026-07-11T07:02:51.850836Z","title":"Large language models are better reasoners with self-verification, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.05391","last_updated":"2026-07-07T17:26:37Z","snapshot_observed_at":"2026-08-12T04:52:01.599894Z","submitted_at":"2026-07-06T17:59:35Z","title":"LLM-as-a-Verifier: A General-Purpose Verification Framework","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-07-11T07:02:51.850836Z"},"links":{"cited_paper":"/paper/2212.09561","citing_paper":"/paper/2607.05391"},"observation_digest":"sha256:58cc1fbfa929d7a1c81539e0fe135d8b4397fa3e5e5797cd90d865a0d982ebd2","observation_id":"23224799-541a-4ece-ad26-a35ac5686095","resolution":{"observed_at":"2026-07-11T07:02:51.850836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.09561","last_updated":"2023-10-19T12:24:42Z","snapshot_observed_at":"2026-08-16T16:07:38.799864Z","submitted_at":"2022-12-19T15:51:52Z","title":"Large Language Models are Better Reasoners with Self-Verification","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.09561","snapshot_observed_at":"2026-08-02T07:07:44.614766Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.22683","last_updated":"2026-07-13T05:02:43Z","snapshot_observed_at":"2026-08-16T02:18:40.497043Z","submitted_at":"2026-07-13T05:02:43Z","title":"Imprompt: A Language Framework for Prompt Programming","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-02T07:07:44.614766Z"},"links":{"cited_paper":"/paper/2212.09561","citing_paper":"/paper/2607.22683"},"observation_digest":"sha256:68a78d622427430fc88222daea13d12f983b38d22fa47f38f06973c7d7865b4c","observation_id":"e906efa1-9a6d-4761-96b0-bab725a45db5","resolution":{"observed_at":"2026-08-02T07:07:44.614766Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.09561","last_updated":"2023-10-19T12:24:42Z","snapshot_observed_at":"2026-08-16T16:07:38.799864Z","submitted_at":"2022-12-19T15:51:52Z","title":"Large Language Models are Better Reasoners with Self-Verification","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.09561","snapshot_observed_at":"2026-08-12T18:16:33.791240Z","title":"arXiv preprint arXiv:2212.09561 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10743","last_updated":"2026-08-11T10:00:42Z","snapshot_observed_at":"2026-08-17T17:17:48.229578Z","submitted_at":"2026-08-11T10:00:42Z","title":"Mitigating Context Interference for Reliable and Efficient Search Agents","version":1},"reference_index":88,"source":"arxiv_source","source_observed_at":"2026-08-12T18:16:33.791240Z"},"links":{"cited_paper":"/paper/2212.09561","citing_paper":"/paper/2608.10743"},"observation_digest":"sha256:7f54c7a19fabf2160ea47bb5942daf7250d69fb423423a6e40a071ee4574c0bb","observation_id":"0eae044d-bf32-423f-9d06-f6d5182eb4a1","resolution":{"observed_at":"2026-08-12T18:16:33.791240Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2212.09561/citation-record","integrity":"/paper/2212.09561/integrity","json":"/paper/2212.09561/citation-record.json","paper":"/paper/2212.09561"},"outbound":[],"paper":{"arxiv_id":"2212.09561","last_updated":"2023-10-19T12:24:42Z","latest_version":5,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-16T16:07:38.799864Z","submitted_at":"2022-12-19T15:51:52Z","title":"Large Language Models are Better Reasoners with Self-Verification"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 21 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 36 inbound Pith citation observations for arXiv:2212.09561."}