{"as_of":"2026-08-24T01:08:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:dba6855ba1d0463234cb11c7a51f1620a61727ffd6d9deee6d6cb8cf4ef58190","coverage":[{"denominator":43,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":43,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:45:33.187004Z","state":"measured"},{"denominator":75,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":75,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-23T06:30:58.430688+00:00","state":"measured"},{"denominator":32,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":32,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T15:48:29.762284Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-10T10:27:02.392963Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.23646","last_updated":"2025-05-29T16:53:41Z","snapshot_observed_at":"2026-08-20T06:05:04.363087Z","submitted_at":"2025-05-29T16:53:41Z","title":"Are Reasoning Models More Prone to Hallucination?","version":1},"cited_work":{"arxiv_id":"2505.23646","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.23646","snapshot_observed_at":"2026-07-10T10:27:02.392963Z","title":"Edward Yeo, Yuxuan Tong, Morry Niu, Graham Neu- big, and Xiang Yue","venue":"cs.CL","work_id":"cbb24d0e-0a95-46cb-a43e-115b3c4115d7","year":2025},"citing_paper":{"arxiv_id":"2506.19807","last_updated":"2026-04-16T16:50:02Z","snapshot_observed_at":"2026-08-15T07:11:21.941156Z","submitted_at":"2025-06-24T17:17:17Z","title":"KnowRL: Exploring Knowledgeable Reinforcement Learning for Factuality","version":4},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-19T07:33:08.719028Z"},"links":{"cited_paper":"/paper/2505.23646","citing_paper":"/paper/2506.19807"},"observation_digest":"sha256:70dca845aa9073b08250d3e2a25a697290010366404a4078bc5dacce18cec5c7","observation_id":"79ff357a-0c48-4bb5-88cb-bc4c57d0fe2d","resolution":{"observed_at":"2026-05-19T07:37:08.992804Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23646","last_updated":"2025-05-29T16:53:41Z","snapshot_observed_at":"2026-08-20T06:05:04.363087Z","submitted_at":"2025-05-29T16:53:41Z","title":"Are Reasoning Models More Prone to Hallucination?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.23646","snapshot_observed_at":"2026-08-06T17:54:17.983703Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.09662","last_updated":"2025-07-13T14:51:59Z","snapshot_observed_at":"2026-08-20T12:31:43.651320Z","submitted_at":"2025-07-13T14:51:59Z","title":"Towards Concise and Adaptive Thinking in Large Reasoning Models: A Survey","version":1},"reference_index":225,"source":"arxiv_source","source_observed_at":"2026-08-06T17:54:17.983703Z"},"links":{"cited_paper":"/paper/2505.23646","citing_paper":"/paper/2507.09662"},"observation_digest":"sha256:6dcb8a57ea6446b1f0d44a695fbf98901c7f0d3600a4c33b975b778beed6ad14","observation_id":"ed7f84f3-d5b6-45a2-ae67-f400ead1c0e8","resolution":{"observed_at":"2026-08-06T17:54:17.983703Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23646","last_updated":"2025-05-29T16:53:41Z","snapshot_observed_at":"2026-08-20T06:05:04.363087Z","submitted_at":"2025-05-29T16:53:41Z","title":"Are Reasoning Models More Prone to Hallucination?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.23646","snapshot_observed_at":"2026-08-05T23:10:24.533640Z","title":"Are reasoning models more prone to hallucination? arXiv preprint arXiv:2505.23646 ,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.05928","last_updated":"2025-08-08T01:24:06Z","snapshot_observed_at":"2026-08-20T04:52:52.301653Z","submitted_at":"2025-08-08T01:24:06Z","title":"Mitigating Think-Answer Mismatch in LLM Reasoning Through Noise-Aware Advantage Reweighting","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-05T23:10:24.533640Z"},"links":{"cited_paper":"/paper/2505.23646","citing_paper":"/paper/2508.05928"},"observation_digest":"sha256:8ff206c5c56e2a77af80910adb5c65a8c856ab144445ca3576b456a3cdb443aa","observation_id":"34e2174a-a21a-4f47-bbd6-334613c02e47","resolution":{"observed_at":"2026-08-05T23:10:24.533640Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23646","last_updated":"2025-05-29T16:53:41Z","snapshot_observed_at":"2026-08-20T06:05:04.363087Z","submitted_at":"2025-05-29T16:53:41Z","title":"Are Reasoning Models More Prone to Hallucination?","version":1},"cited_work":{"arxiv_id":"2505.23646","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.23646","snapshot_observed_at":"2026-07-10T10:27:02.392963Z","title":"Edward Yeo, Yuxuan Tong, Morry Niu, Graham Neu- big, and Xiang Yue","venue":"cs.CL","work_id":"cbb24d0e-0a95-46cb-a43e-115b3c4115d7","year":2025},"citing_paper":{"arxiv_id":"2508.19652","last_updated":"2026-04-27T16:28:37Z","snapshot_observed_at":"2026-08-15T16:01:07.680571Z","submitted_at":"2025-08-27T08:01:03Z","title":"Self-Rewarding Vision-Language Model via Reasoning Decomposition","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-18T21:03:31.606674Z"},"links":{"cited_paper":"/paper/2505.23646","citing_paper":"/paper/2508.19652"},"observation_digest":"sha256:1c095aca7071b228d5f547c8153489347529cc45f1c6b3ebd1634973ac57cadb","observation_id":"114e4901-c09a-4c47-a19e-8362aa4a6701","resolution":{"observed_at":"2026-05-18T21:06:50.899623Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23646","last_updated":"2025-05-29T16:53:41Z","snapshot_observed_at":"2026-08-20T06:05:04.363087Z","submitted_at":"2025-05-29T16:53:41Z","title":"Are Reasoning Models More Prone to Hallucination?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.23646","snapshot_observed_at":"2026-08-05T14:29:50.250976Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.21302","last_updated":"2025-12-09T02:27:24Z","snapshot_observed_at":"2026-08-20T18:36:35.571830Z","submitted_at":"2025-08-29T01:47:07Z","title":"Locus: Agentic Predicate Synthesis for Directed Fuzzing","version":3},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-08-05T14:29:50.250976Z"},"links":{"cited_paper":"/paper/2505.23646","citing_paper":"/paper/2508.21302"},"observation_digest":"sha256:7b5de764597e0947fce626b1851ee951c6e54c2292a4a6a82b7564929ca2ce34","observation_id":"c7945fe4-69a8-4bea-a893-2dd1e5b7484f","resolution":{"observed_at":"2026-08-05T14:29:50.250976Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23646","last_updated":"2025-05-29T16:53:41Z","snapshot_observed_at":"2026-08-20T06:05:04.363087Z","submitted_at":"2025-05-29T16:53:41Z","title":"Are Reasoning Models More Prone to Hallucination?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.23646","snapshot_observed_at":"2026-08-05T10:39:03.278036Z","title":"Are Reasoning Models More Prone to Hallucination? arXiv preprint arXiv:2505.23646, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.03871","last_updated":"2025-09-04T04:12:31Z","snapshot_observed_at":"2026-08-17T17:37:38.616375Z","submitted_at":"2025-09-04T04:12:31Z","title":"A Comprehensive Survey on Trustworthiness in Reasoning with Large Language Models","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-05T10:39:03.278036Z"},"links":{"cited_paper":"/paper/2505.23646","citing_paper":"/paper/2509.03871"},"observation_digest":"sha256:70bc9c355c87db95d0ed38102cb141c34a1e3bd0344318eb9f39491592413dcf","observation_id":"b0fcb64b-11b0-4b10-b200-be3b69dc526a","resolution":{"observed_at":"2026-08-05T10:39:03.278036Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23646","last_updated":"2025-05-29T16:53:41Z","snapshot_observed_at":"2026-08-20T06:05:04.363087Z","submitted_at":"2025-05-29T16:53:41Z","title":"Are Reasoning Models More Prone to Hallucination?","version":1},"cited_work":{"arxiv_id":"2505.23646","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.23646","snapshot_observed_at":"2026-07-10T10:27:02.392963Z","title":"Edward Yeo, Yuxuan Tong, Morry Niu, Graham Neu- big, and Xiang Yue","venue":"cs.CL","work_id":"cbb24d0e-0a95-46cb-a43e-115b3c4115d7","year":2025},"citing_paper":{"arxiv_id":"2509.21882","last_updated":"2026-05-25T20:11:55Z","snapshot_observed_at":"2026-08-15T23:13:38.962889Z","submitted_at":"2025-09-26T05:06:25Z","title":"Position: The Hidden Costs and Measurement Gaps of Reinforcement Learning with Verifiable Rewards","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-18T14:24:48.666197Z"},"links":{"cited_paper":"/paper/2505.23646","citing_paper":"/paper/2509.21882"},"observation_digest":"sha256:fa46295afc362a1ca13e8bc2a1f80f1f2ae81d2c0da3c2d14580d7bb06bb6fe1","observation_id":"2d28b91a-807b-4a7a-b5eb-a770dad92f72","resolution":{"observed_at":"2026-05-18T14:26:28.313285Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23646","last_updated":"2025-05-29T16:53:41Z","snapshot_observed_at":"2026-08-20T06:05:04.363087Z","submitted_at":"2025-05-29T16:53:41Z","title":"Are Reasoning Models More Prone to Hallucination?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.23646","snapshot_observed_at":"2026-08-15T15:48:29.762284Z","title":"Are reasoning models more prone to hallucination?arXiv preprint arXiv:2505.23646,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.21882","last_updated":"2026-05-25T20:11:55Z","snapshot_observed_at":"2026-08-15T23:13:38.962889Z","submitted_at":"2025-09-26T05:06:25Z","title":"Position: The Hidden Costs and Measurement Gaps of Reinforcement Learning with Verifiable Rewards","version":3},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-15T15:48:29.762284Z"},"links":{"cited_paper":"/paper/2505.23646","citing_paper":"/paper/2509.21882"},"observation_digest":"sha256:4f0d0a7b0218fc03292b7d53c5e87f18287d515bfac0111734d4dbe84355281e","observation_id":"282775bc-914d-45ce-aea7-297bedbd6a00","resolution":{"observed_at":"2026-08-15T15:48:29.762284Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23646","last_updated":"2025-05-29T16:53:41Z","snapshot_observed_at":"2026-08-20T06:05:04.363087Z","submitted_at":"2025-05-29T16:53:41Z","title":"Are Reasoning Models More Prone to Hallucination?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.23646","snapshot_observed_at":"2026-08-04T08:15:58.184947Z","title":"Are reasoning models more prone to hallucination? arXiv preprint arXiv:2505.23646, 2025 b","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.21978","last_updated":"2026-06-18T16:29:38Z","snapshot_observed_at":"2026-08-13T02:25:37.938690Z","submitted_at":"2025-10-24T19:08:48Z","title":"Beyond Reasoning Gains: Mitigating General-Capability Forgetting in Large Reasoning Models","version":2},"reference_index":106,"source":"arxiv_source","source_observed_at":"2026-08-04T08:15:58.184947Z"},"links":{"cited_paper":"/paper/2505.23646","citing_paper":"/paper/2510.21978"},"observation_digest":"sha256:fc927fbbb9e00e3e9df3e1f9866efd9fdccb72689a9e38203e318b32a115c79c","observation_id":"758909d7-aa6d-4bbc-bd79-e0202cbcc304","resolution":{"observed_at":"2026-08-04T08:15:58.184947Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23646","last_updated":"2025-05-29T16:53:41Z","snapshot_observed_at":"2026-08-20T06:05:04.363087Z","submitted_at":"2025-05-29T16:53:41Z","title":"Are Reasoning Models More Prone to Hallucination?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.23646","snapshot_observed_at":"2026-08-03T18:37:51.147107Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.04611","last_updated":"2026-06-29T12:38:37Z","snapshot_observed_at":"2026-08-14T10:59:40.485987Z","submitted_at":"2025-12-04T09:34:22Z","title":"PBFuzz: Agentic Directed Fuzzing for PoV Generation","version":2},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-03T18:37:51.147107Z"},"links":{"cited_paper":"/paper/2505.23646","citing_paper":"/paper/2512.04611"},"observation_digest":"sha256:67766ec2d33a6660a237238750a68a848eb4fcb4c3ce100ec3be0bac1ee3bd36","observation_id":"60341ed6-5f9a-4de9-a7a8-82da20180792","resolution":{"observed_at":"2026-08-03T18:37:51.147107Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23646","last_updated":"2025-05-29T16:53:41Z","snapshot_observed_at":"2026-08-20T06:05:04.363087Z","submitted_at":"2025-05-29T16:53:41Z","title":"Are Reasoning Models More Prone to Hallucination?","version":1},"cited_work":{"arxiv_id":"2505.23646","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.23646","snapshot_observed_at":"2026-07-10T10:27:02.392963Z","title":"Edward Yeo, Yuxuan Tong, Morry Niu, Graham Neu- big, and Xiang Yue","venue":"cs.CL","work_id":"cbb24d0e-0a95-46cb-a43e-115b3c4115d7","year":2025},"citing_paper":{"arxiv_id":"2601.03630","last_updated":"2026-05-14T03:13:06Z","snapshot_observed_at":"2026-08-17T02:45:15.646461Z","submitted_at":"2026-01-07T06:19:26Z","title":"Reasoning Model Is Superior LLM-Judge, Yet Suffers from Biases","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-16T17:18:10.045283Z"},"links":{"cited_paper":"/paper/2505.23646","citing_paper":"/paper/2601.03630"},"observation_digest":"sha256:e701c84840130a5d612e0deea31696d032a21da0d8a887e562546986b3816957","observation_id":"0b7115f5-31ec-486b-9c22-ed39e9f1025f","resolution":{"observed_at":"2026-05-16T17:21:07.939527Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23646","last_updated":"2025-05-29T16:53:41Z","snapshot_observed_at":"2026-08-20T06:05:04.363087Z","submitted_at":"2025-05-29T16:53:41Z","title":"Are Reasoning Models More Prone to Hallucination?","version":1},"cited_work":{"arxiv_id":"2505.23646","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.23646","snapshot_observed_at":"2026-07-10T10:27:02.392963Z","title":"Edward Yeo, Yuxuan Tong, Morry Niu, Graham Neu- big, and Xiang Yue","venue":"cs.CL","work_id":"cbb24d0e-0a95-46cb-a43e-115b3c4115d7","year":2025},"citing_paper":{"arxiv_id":"2601.17467","last_updated":"2026-05-05T09:21:16Z","snapshot_observed_at":"2026-08-13T07:08:41.852402Z","submitted_at":"2026-01-24T13:47:51Z","title":"Harnessing Reasoning Trajectories for Hallucination Detection via Answer-agreement Representation Shaping","version":3},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-16T11:13:17.178998Z"},"links":{"cited_paper":"/paper/2505.23646","citing_paper":"/paper/2601.17467"},"observation_digest":"sha256:1990e2be729b8384a70ba0f449eb48b86155300bce5a2af6ed55394f44f05b97","observation_id":"3e4fe3b4-ed41-4d16-bc35-8a88ed25d06a","resolution":{"observed_at":"2026-05-16T11:17:47.252671Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23646","last_updated":"2025-05-29T16:53:41Z","snapshot_observed_at":"2026-08-20T06:05:04.363087Z","submitted_at":"2025-05-29T16:53:41Z","title":"Are Reasoning Models More Prone to Hallucination?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.23646","snapshot_observed_at":"2026-08-03T06:34:30.368552Z","title":"Are reasoning models more prone to hallucination?arXiv preprint arXiv:2505.23646,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2601.22648","last_updated":"2026-05-26T11:07:20Z","snapshot_observed_at":"2026-08-16T07:38:14.972424Z","submitted_at":"2026-01-30T07:07:42Z","title":"UCPO: Uncertainty-Aware Policy Optimization","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-03T06:34:30.368552Z"},"links":{"cited_paper":"/paper/2505.23646","citing_paper":"/paper/2601.22648"},"observation_digest":"sha256:60018ab498de7be1ba0c823f848feeea1e20dfc88af9cf42c730ef360b91ce9d","observation_id":"e50f1400-c5c4-46d5-b9ce-6c0a75ab3b27","resolution":{"observed_at":"2026-08-03T06:34:30.368552Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23646","last_updated":"2025-05-29T16:53:41Z","snapshot_observed_at":"2026-08-20T06:05:04.363087Z","submitted_at":"2025-05-29T16:53:41Z","title":"Are Reasoning Models More Prone to Hallucination?","version":1},"cited_work":{"arxiv_id":"2505.23646","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.23646","snapshot_observed_at":"2026-07-10T10:27:02.392963Z","title":"Edward Yeo, Yuxuan Tong, Morry Niu, Graham Neu- big, and Xiang Yue","venue":"cs.CL","work_id":"cbb24d0e-0a95-46cb-a43e-115b3c4115d7","year":2025},"citing_paper":{"arxiv_id":"2604.02972","last_updated":"2026-04-03T11:20:16Z","snapshot_observed_at":"2026-07-06T22:52:15.263364Z","submitted_at":"2026-04-03T11:20:16Z","title":"NeuReasoner: Towards Explainable, Controllable, and Unified Reasoning via Mixture-of-Neurons","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-13T19:39:35.104581Z"},"links":{"cited_paper":"/paper/2505.23646","citing_paper":"/paper/2604.02972"},"observation_digest":"sha256:0b34eefcbd9834b151f1157c0392355fa84cd9751e3fab21d184ed054d6d6445","observation_id":"27992434-6342-4116-b2a6-5907ad0eb5c4","resolution":{"observed_at":"2026-05-13T19:43:11.307056Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23646","last_updated":"2025-05-29T16:53:41Z","snapshot_observed_at":"2026-08-20T06:05:04.363087Z","submitted_at":"2025-05-29T16:53:41Z","title":"Are Reasoning Models More Prone to Hallucination?","version":1},"cited_work":{"arxiv_id":"2505.23646","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.23646","snapshot_observed_at":"2026-07-10T10:27:02.392963Z","title":"Edward Yeo, Yuxuan Tong, Morry Niu, Graham Neu- big, and Xiang Yue","venue":"cs.CL","work_id":"cbb24d0e-0a95-46cb-a43e-115b3c4115d7","year":2025},"citing_paper":{"arxiv_id":"2604.03216","last_updated":"2026-04-03T17:44:32Z","snapshot_observed_at":"2026-08-17T12:22:54.414251Z","submitted_at":"2026-04-03T17:44:32Z","title":"BAS: A Decision-Theoretic Approach to Evaluating Large Language Model Confidence","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-05-13T19:48:13.133733Z"},"links":{"cited_paper":"/paper/2505.23646","citing_paper":"/paper/2604.03216"},"observation_digest":"sha256:291cd6c8746bdc73d8a91c784ba4c9f36497cf6bb8af7428418411c88749b1ac","observation_id":"aba974ce-b8c6-41a4-9e01-b5d9368eb48d","resolution":{"observed_at":"2026-05-13T19:53:11.918326Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23646","last_updated":"2025-05-29T16:53:41Z","snapshot_observed_at":"2026-08-20T06:05:04.363087Z","submitted_at":"2025-05-29T16:53:41Z","title":"Are Reasoning Models More Prone to Hallucination?","version":1},"cited_work":{"arxiv_id":"2505.23646","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.23646","snapshot_observed_at":"2026-07-10T10:27:02.392963Z","title":"Edward Yeo, Yuxuan Tong, Morry Niu, Graham Neu- big, and Xiang Yue","venue":"cs.CL","work_id":"cbb24d0e-0a95-46cb-a43e-115b3c4115d7","year":2025},"citing_paper":{"arxiv_id":"2604.08124","last_updated":"2026-04-09T11:44:44Z","snapshot_observed_at":"2026-07-06T22:57:18.202215Z","submitted_at":"2026-04-09T11:44:44Z","title":"Beyond Stochastic Exploration: What Makes Training Data Valuable for Agentic Search","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-10T17:23:33.537098Z"},"links":{"cited_paper":"/paper/2505.23646","citing_paper":"/paper/2604.08124"},"observation_digest":"sha256:86f4f2464365ac8127b7817aa02d59ca54fda13ada8f2a7ff11a853f5fcc9aeb","observation_id":"fe891fbc-123a-42a4-bf03-069b89b471aa","resolution":{"observed_at":"2026-05-11T06:55:59.694025Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23646","last_updated":"2025-05-29T16:53:41Z","snapshot_observed_at":"2026-08-20T06:05:04.363087Z","submitted_at":"2025-05-29T16:53:41Z","title":"Are Reasoning Models More Prone to Hallucination?","version":1},"cited_work":{"arxiv_id":"2505.23646","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.23646","snapshot_observed_at":"2026-07-10T10:27:02.392963Z","title":"Edward Yeo, Yuxuan Tong, Morry Niu, Graham Neu- big, and Xiang Yue","venue":"cs.CL","work_id":"cbb24d0e-0a95-46cb-a43e-115b3c4115d7","year":2025},"citing_paper":{"arxiv_id":"2604.10189","last_updated":"2026-04-11T12:43:13Z","snapshot_observed_at":"2026-08-11T04:22:20.545833Z","submitted_at":"2026-04-11T12:43:13Z","title":"FAITH: Factuality Alignment through Integrating Trustworthiness and Honestness","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-10T15:49:24.647773Z"},"links":{"cited_paper":"/paper/2505.23646","citing_paper":"/paper/2604.10189"},"observation_digest":"sha256:d9e2626171ae5703dafe7c9e8e83eeda9f53db22e0558c18d6ea2eff0d9b98f3","observation_id":"7187730e-26da-4f9a-b3d7-8260a7ff84d0","resolution":{"observed_at":"2026-05-11T09:50:58.732571Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23646","last_updated":"2025-05-29T16:53:41Z","snapshot_observed_at":"2026-08-20T06:05:04.363087Z","submitted_at":"2025-05-29T16:53:41Z","title":"Are Reasoning Models More Prone to Hallucination?","version":1},"cited_work":{"arxiv_id":"2505.23646","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.23646","snapshot_observed_at":"2026-07-10T10:27:02.392963Z","title":"Edward Yeo, Yuxuan Tong, Morry Niu, Graham Neu- big, and Xiang Yue","venue":"cs.CL","work_id":"cbb24d0e-0a95-46cb-a43e-115b3c4115d7","year":2025},"citing_paper":{"arxiv_id":"2604.13602","last_updated":"2026-04-15T08:11:34Z","snapshot_observed_at":"2026-08-18T06:14:17.992551Z","submitted_at":"2026-04-15T08:11:34Z","title":"Reward Hacking in the Era of Large Models: Mechanisms, Emergent Misalignment, Challenges","version":1},"reference_index":138,"source":"pdf_text","source_observed_at":"2026-05-10T13:58:53.430492Z"},"links":{"cited_paper":"/paper/2505.23646","citing_paper":"/paper/2604.13602"},"observation_digest":"sha256:4396f4463693a4889f9bd52085843f65642316440b71a3acf870b987b87ecd87","observation_id":"677574fe-79b8-4105-89bb-00f98ea3646e","resolution":{"observed_at":"2026-05-10T14:00:28.670229Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23646","last_updated":"2025-05-29T16:53:41Z","snapshot_observed_at":"2026-08-20T06:05:04.363087Z","submitted_at":"2025-05-29T16:53:41Z","title":"Are Reasoning Models More Prone to Hallucination?","version":1},"cited_work":{"arxiv_id":"2505.23646","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.23646","snapshot_observed_at":"2026-07-10T10:27:02.392963Z","title":"Edward Yeo, Yuxuan Tong, Morry Niu, Graham Neu- big, and Xiang Yue","venue":"cs.CL","work_id":"cbb24d0e-0a95-46cb-a43e-115b3c4115d7","year":2025},"citing_paper":{"arxiv_id":"2604.27859","last_updated":"2026-05-15T06:25:17Z","snapshot_observed_at":"2026-08-15T01:50:12.462125Z","submitted_at":"2026-04-30T13:43:25Z","title":"Rethinking Agentic Reinforcement Learning In Large Language Models","version":1},"reference_index":112,"source":"pdf_text","source_observed_at":"2026-05-07T06:30:09.945371Z"},"links":{"cited_paper":"/paper/2505.23646","citing_paper":"/paper/2604.27859"},"observation_digest":"sha256:e53b07aab49e4f5fe5dec4a5b98c3dadb7932a631ded72a34396206f6385a79e","observation_id":"45ed1154-8614-4d01-b251-a9cd28c96142","resolution":{"observed_at":"2026-05-12T10:21:29.678824Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23646","last_updated":"2025-05-29T16:53:41Z","snapshot_observed_at":"2026-08-20T06:05:04.363087Z","submitted_at":"2025-05-29T16:53:41Z","title":"Are Reasoning Models More Prone to Hallucination?","version":1},"cited_work":{"arxiv_id":"2505.23646","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.23646","snapshot_observed_at":"2026-07-10T10:27:02.392963Z","title":"Edward Yeo, Yuxuan Tong, Morry Niu, Graham Neu- big, and Xiang Yue","venue":"cs.CL","work_id":"cbb24d0e-0a95-46cb-a43e-115b3c4115d7","year":2025},"citing_paper":{"arxiv_id":"2604.27859","last_updated":"2026-05-15T06:25:17Z","snapshot_observed_at":"2026-08-15T01:50:12.462125Z","submitted_at":"2026-04-30T13:43:25Z","title":"Rethinking Agentic Reinforcement Learning In Large Language Models","version":2},"reference_index":112,"source":"pdf_text","source_observed_at":"2026-05-08T03:12:19.414358Z"},"links":{"cited_paper":"/paper/2505.23646","citing_paper":"/paper/2604.27859"},"observation_digest":"sha256:c1c9a559e56573150887d9ffb428d550b14acd6db029ad8d13622c4640b0810c","observation_id":"d4143ac8-7883-4f55-b155-9408091fb061","resolution":{"observed_at":"2026-05-11T22:11:17.437737Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23646","last_updated":"2025-05-29T16:53:41Z","snapshot_observed_at":"2026-08-20T06:05:04.363087Z","submitted_at":"2025-05-29T16:53:41Z","title":"Are Reasoning Models More Prone to Hallucination?","version":1},"cited_work":{"arxiv_id":"2505.23646","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.23646","snapshot_observed_at":"2026-07-10T10:27:02.392963Z","title":"Edward Yeo, Yuxuan Tong, Morry Niu, Graham Neu- big, and Xiang Yue","venue":"cs.CL","work_id":"cbb24d0e-0a95-46cb-a43e-115b3c4115d7","year":2025},"citing_paper":{"arxiv_id":"2604.27859","last_updated":"2026-05-15T06:25:17Z","snapshot_observed_at":"2026-08-15T01:50:12.462125Z","submitted_at":"2026-04-30T13:43:25Z","title":"Rethinking Agentic Reinforcement Learning In Large Language Models","version":3},"reference_index":112,"source":"pdf_text","source_observed_at":"2026-05-19T16:58:41.558250Z"},"links":{"cited_paper":"/paper/2505.23646","citing_paper":"/paper/2604.27859"},"observation_digest":"sha256:100b687f8e2e38b995e45511031fc358d6ce2b5c9caa37d726cb9c3cf0d36fd4","observation_id":"6ad3ffb4-9c23-48b7-97a4-f5d30d2a6067","resolution":{"observed_at":"2026-05-19T17:02:40.698512Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23646","last_updated":"2025-05-29T16:53:41Z","snapshot_observed_at":"2026-08-20T06:05:04.363087Z","submitted_at":"2025-05-29T16:53:41Z","title":"Are Reasoning Models More Prone to Hallucination?","version":1},"cited_work":{"arxiv_id":"2505.23646","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.23646","snapshot_observed_at":"2026-07-10T10:27:02.392963Z","title":"Edward Yeo, Yuxuan Tong, Morry Niu, Graham Neu- big, and Xiang Yue","venue":"cs.CL","work_id":"cbb24d0e-0a95-46cb-a43e-115b3c4115d7","year":2025},"citing_paper":{"arxiv_id":"2605.01428","last_updated":"2026-05-02T12:59:14Z","snapshot_observed_at":"2026-08-13T04:56:34.015426Z","submitted_at":"2026-05-02T12:59:14Z","title":"Hallucinations Undermine Trust; Metacognition is a Way Forward","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-09T14:29:54.924293Z"},"links":{"cited_paper":"/paper/2505.23646","citing_paper":"/paper/2605.01428"},"observation_digest":"sha256:c2a010cb473a81cde55bb05a69ee350bbb09344aac7c25656ac3e6cbaa2053fa","observation_id":"5806770e-c06e-409f-a0fe-baf9db39e955","resolution":{"observed_at":"2026-05-11T16:56:07.176649Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23646","last_updated":"2025-05-29T16:53:41Z","snapshot_observed_at":"2026-08-20T06:05:04.363087Z","submitted_at":"2025-05-29T16:53:41Z","title":"Are Reasoning Models More Prone to Hallucination?","version":1},"cited_work":{"arxiv_id":"2505.23646","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.23646","snapshot_observed_at":"2026-07-10T10:27:02.392963Z","title":"Edward Yeo, Yuxuan Tong, Morry Niu, Graham Neu- big, and Xiang Yue","venue":"cs.CL","work_id":"cbb24d0e-0a95-46cb-a43e-115b3c4115d7","year":2025},"citing_paper":{"arxiv_id":"2605.03050","last_updated":"2026-05-04T18:15:28Z","snapshot_observed_at":"2026-08-16T02:04:31.112040Z","submitted_at":"2026-05-04T18:15:28Z","title":"Evaluating Reasoning Models for Queries with Presuppositions","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-08T18:34:11.989362Z"},"links":{"cited_paper":"/paper/2505.23646","citing_paper":"/paper/2605.03050"},"observation_digest":"sha256:cf19032c5112ee09c6571b841b96b3df3f1632644bc285b12b5ca489eb02b8b2","observation_id":"2504cb78-6ca1-4f22-acb6-21ed89de941e","resolution":{"observed_at":"2026-05-09T06:20:41.972090Z","resolver_source":"arxiv_id","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23646","last_updated":"2025-05-29T16:53:41Z","snapshot_observed_at":"2026-08-20T06:05:04.363087Z","submitted_at":"2025-05-29T16:53:41Z","title":"Are Reasoning Models More Prone to Hallucination?","version":1},"cited_work":{"arxiv_id":"2505.23646","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.23646","snapshot_observed_at":"2026-07-10T10:27:02.392963Z","title":"Edward Yeo, Yuxuan Tong, Morry Niu, Graham Neu- big, and Xiang Yue","venue":"cs.CL","work_id":"cbb24d0e-0a95-46cb-a43e-115b3c4115d7","year":2025},"citing_paper":{"arxiv_id":"2605.28301","last_updated":"2026-05-27T10:55:24Z","snapshot_observed_at":"2026-08-12T17:12:45.615170Z","submitted_at":"2026-05-27T10:55:24Z","title":"Better Accuracies, Worse Reasoning: A Step-Level Audit of Medical Chain-of-Thought Distillation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-29T12:55:34.032143Z"},"links":{"cited_paper":"/paper/2505.23646","citing_paper":"/paper/2605.28301"},"observation_digest":"sha256:c49369875b6205dcdf1ef05de63390d67726b3308a5f71aa3156192107b9641b","observation_id":"b9742955-5b8b-46e9-a93a-aa4885be5a1d","resolution":{"observed_at":"2026-06-29T13:03:26.587768Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23646","last_updated":"2025-05-29T16:53:41Z","snapshot_observed_at":"2026-08-20T06:05:04.363087Z","submitted_at":"2025-05-29T16:53:41Z","title":"Are Reasoning Models More Prone to Hallucination?","version":1},"cited_work":{"arxiv_id":"2505.23646","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.23646","snapshot_observed_at":"2026-07-10T10:27:02.392963Z","title":"Edward Yeo, Yuxuan Tong, Morry Niu, Graham Neu- big, and Xiang Yue","venue":"cs.CL","work_id":"cbb24d0e-0a95-46cb-a43e-115b3c4115d7","year":2025},"citing_paper":{"arxiv_id":"2606.00869","last_updated":"2026-05-30T19:53:19Z","snapshot_observed_at":"2026-08-13T00:36:06.236099Z","submitted_at":"2026-05-30T19:53:19Z","title":"Enhancing LLM Metacognition via Cognitive Pairwise Training","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-28T19:01:18.153145Z"},"links":{"cited_paper":"/paper/2505.23646","citing_paper":"/paper/2606.00869"},"observation_digest":"sha256:4048990ac4bcf95698db234e768348d87a4bf5cf4f5bab2c6f524ae3a7a1da46","observation_id":"19f04b23-eba5-4293-a7d0-3b07fc25ec0c","resolution":{"observed_at":"2026-06-28T19:02:33.919996Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23646","last_updated":"2025-05-29T16:53:41Z","snapshot_observed_at":"2026-08-20T06:05:04.363087Z","submitted_at":"2025-05-29T16:53:41Z","title":"Are Reasoning Models More Prone to Hallucination?","version":1},"cited_work":{"arxiv_id":"2505.23646","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.23646","snapshot_observed_at":"2026-07-10T10:27:02.392963Z","title":"Edward Yeo, Yuxuan Tong, Morry Niu, Graham Neu- big, and Xiang Yue","venue":"cs.CL","work_id":"cbb24d0e-0a95-46cb-a43e-115b3c4115d7","year":2025},"citing_paper":{"arxiv_id":"2606.09711","last_updated":"2026-06-08T16:32:54Z","snapshot_observed_at":"2026-07-06T23:49:03.237958Z","submitted_at":"2026-06-08T16:32:54Z","title":"Proxy Reward Internalization and Mechanistic Exploitation: A Learned Precursor to Reward Hacking and Its Generalization","version":1},"reference_index":174,"source":"arxiv_source","source_observed_at":"2026-06-27T16:26:34.918099Z"},"links":{"cited_paper":"/paper/2505.23646","citing_paper":"/paper/2606.09711"},"observation_digest":"sha256:3d69840f4018d895f09b37ae2b2c1a15465d387bec825ffbf9cee9b3f8f6ddde","observation_id":"965f2cd2-5d36-4710-9627-2afc8ea65394","resolution":{"observed_at":"2026-07-03T01:37:30.555820Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23646","last_updated":"2025-05-29T16:53:41Z","snapshot_observed_at":"2026-08-20T06:05:04.363087Z","submitted_at":"2025-05-29T16:53:41Z","title":"Are Reasoning Models More Prone to Hallucination?","version":1},"cited_work":{"arxiv_id":"2505.23646","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.23646","snapshot_observed_at":"2026-07-10T10:27:02.392963Z","title":"Edward Yeo, Yuxuan Tong, Morry Niu, Graham Neu- big, and Xiang Yue","venue":"cs.CL","work_id":"cbb24d0e-0a95-46cb-a43e-115b3c4115d7","year":2025},"citing_paper":{"arxiv_id":"2607.02262","last_updated":"2026-07-02T14:50:25Z","snapshot_observed_at":"2026-08-03T11:06:03.687771Z","submitted_at":"2026-07-02T14:50:25Z","title":"CheckRLM: Effective Knowledge-Thought Coherence Checking in Retrieval-Augmented Reasoning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-03T14:26:05.982271Z"},"links":{"cited_paper":"/paper/2505.23646","citing_paper":"/paper/2607.02262"},"observation_digest":"sha256:073b9fa714ac6986a0e5bbc549c922f3a4dc30454dccccbca8d91dcf205a0ed5","observation_id":"2d016cd4-6b3b-4e58-b145-e291fe739942","resolution":{"observed_at":"2026-07-03T14:28:31.099163Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23646","last_updated":"2025-05-29T16:53:41Z","snapshot_observed_at":"2026-08-20T06:05:04.363087Z","submitted_at":"2025-05-29T16:53:41Z","title":"Are Reasoning Models More Prone to Hallucination?","version":1},"cited_work":{"arxiv_id":"2505.23646","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.23646","snapshot_observed_at":"2026-07-10T10:27:02.392963Z","title":"Edward Yeo, Yuxuan Tong, Morry Niu, Graham Neu- big, and Xiang Yue","venue":"cs.CL","work_id":"cbb24d0e-0a95-46cb-a43e-115b3c4115d7","year":2025},"citing_paper":{"arxiv_id":"2607.05861","last_updated":"2026-07-07T05:34:25Z","snapshot_observed_at":"2026-08-22T00:19:55.276276Z","submitted_at":"2026-07-07T05:34:25Z","title":"Mitigating Factual Hallucination in Large Reasoning Models via Mixed-Mode Advantage Regularization","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-08T22:25:35.119625Z"},"links":{"cited_paper":"/paper/2505.23646","citing_paper":"/paper/2607.05861"},"observation_digest":"sha256:47cb91b67ac37e865e448958016253059cc29d5f917d67b2c4b085c33c09e786","observation_id":"5d2ff7b9-f1d2-465b-bcd3-d1115e9ac8f4","resolution":{"observed_at":"2026-07-08T22:25:39.514165Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23646","last_updated":"2025-05-29T16:53:41Z","snapshot_observed_at":"2026-08-20T06:05:04.363087Z","submitted_at":"2025-05-29T16:53:41Z","title":"Are Reasoning Models More Prone to Hallucination?","version":1},"cited_work":{"arxiv_id":"2505.23646","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.23646","snapshot_observed_at":"2026-07-10T10:27:02.392963Z","title":"Edward Yeo, Yuxuan Tong, Morry Niu, Graham Neu- big, and Xiang Yue","venue":"cs.CL","work_id":"cbb24d0e-0a95-46cb-a43e-115b3c4115d7","year":2025},"citing_paper":{"arxiv_id":"2607.08268","last_updated":"2026-07-09T09:10:49Z","snapshot_observed_at":"2026-08-20T10:40:52.263302Z","submitted_at":"2026-07-09T09:10:49Z","title":"Different Teachers, Different Capabilities: Sub-1B On-Device Distillation for Structured Text Enrichment","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-10T10:20:46.103409Z"},"links":{"cited_paper":"/paper/2505.23646","citing_paper":"/paper/2607.08268"},"observation_digest":"sha256:32182e8e17f678b43f521b32710dd65f8fbf0a0ae27c62a29798e696ad346280","observation_id":"8edf9088-37b5-46e0-baac-89efd84421d0","resolution":{"observed_at":"2026-07-10T10:27:02.394320Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23646","last_updated":"2025-05-29T16:53:41Z","snapshot_observed_at":"2026-08-20T06:05:04.363087Z","submitted_at":"2025-05-29T16:53:41Z","title":"Are Reasoning Models More Prone to Hallucination?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.23646","snapshot_observed_at":"2026-08-01T14:01:27.035947Z","title":"Weihao Zeng, Yuzhen Huang, Qian Liu, Wei Liu, Ke- qing He, Zejun Ma, and Junxian He","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18915","last_updated":"2026-07-21T09:56:58Z","snapshot_observed_at":"2026-08-14T17:03:19.016798Z","submitted_at":"2026-07-21T09:56:58Z","title":"Reasoning Error from Known Fact: Step-Level Self-Consistency Group Relative Policy Optimization for LLM","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-01T14:01:27.035947Z"},"links":{"cited_paper":"/paper/2505.23646","citing_paper":"/paper/2607.18915"},"observation_digest":"sha256:717b6a9380ccc4a3b384db3cca6f1ae06b01b012bac1a8145d2c36ef5cf3698b","observation_id":"915d4965-0699-44e7-a84b-74a7ef59f8f4","resolution":{"observed_at":"2026-08-01T14:01:27.035947Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23646","last_updated":"2025-05-29T16:53:41Z","snapshot_observed_at":"2026-08-20T06:05:04.363087Z","submitted_at":"2025-05-29T16:53:41Z","title":"Are Reasoning Models More Prone to Hallucination?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.23646","snapshot_observed_at":"2026-08-01T05:52:44.046869Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.22098","last_updated":"2026-07-24T08:48:17Z","snapshot_observed_at":"2026-08-18T05:44:23.851461Z","submitted_at":"2026-07-24T08:48:17Z","title":"Reasoning Denoiser: Denoising Reasoning Traces for Hallucination Detection in Large Reasoning Models","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-01T05:52:44.046869Z"},"links":{"cited_paper":"/paper/2505.23646","citing_paper":"/paper/2607.22098"},"observation_digest":"sha256:f0511052cca82942c8b1803af3416f6160a46f92a60d2e162ee49adf2c8abd69","observation_id":"879461cf-adfa-493d-85a8-48b0f912a921","resolution":{"observed_at":"2026-08-01T05:52:44.046869Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23646","last_updated":"2025-05-29T16:53:41Z","snapshot_observed_at":"2026-08-20T06:05:04.363087Z","submitted_at":"2025-05-29T16:53:41Z","title":"Are Reasoning Models More Prone to Hallucination?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.23646","snapshot_observed_at":"2026-08-12T00:45:42.564555Z","title":"arXiv preprint arXiv:2505.23646 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07931","last_updated":"2026-08-08T05:37:13Z","snapshot_observed_at":"2026-08-17T03:30:27.382622Z","submitted_at":"2026-08-08T05:37:13Z","title":"REIN: Bridging the Gap between Reasoning and Reliability via Reflection and Abstention Alignment","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-12T00:45:42.564555Z"},"links":{"cited_paper":"/paper/2505.23646","citing_paper":"/paper/2608.07931"},"observation_digest":"sha256:a96804d5ea0492656568ff1446bc2c0f32f44dd8194d9834b698dcbd3c3425b5","observation_id":"af72fec2-53b4-4675-a088-0530417934f5","resolution":{"observed_at":"2026-08-12T00:45:42.564555Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2505.23646/citation-record","integrity":"/paper/2505.23646/integrity","json":"/paper/2505.23646/citation-record.json","paper":"/paper/2505.23646"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:45:38.727493Z","title":"Benchmarking foundation models with language- model-as-an-examiner","venue":null,"work_id":"c58885b4-f6cf-40bf-821d-20aa008e41b3","year":2023},"citing_paper":{"arxiv_id":"2505.23646","last_updated":"2025-05-29T16:53:41Z","snapshot_observed_at":"2026-08-20T06:05:04.363087Z","submitted_at":"2025-05-29T16:53:41Z","title":"Are Reasoning Models More Prone to Hallucination?","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T12:45:29.432946Z"},"links":{"citing_paper":"/paper/2505.23646"},"observation_digest":"sha256:d6ebff80c96c25a4496bfd80851421ef65a5c54286435ff999f76531cc4cde2f","observation_id":"ca6a6621-3fb8-422b-addf-2f80b7f50d0f","resolution":{"observed_at":"2026-08-07T12:45:38.902235Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:45:38.432280Z","title":"Probabilistic tree-of-thought reasoning for answering knowledge-intensive complex questions","venue":null,"work_id":"e7c17339-53c0-4b7f-b618-c05ed9f5b758","year":2023},"citing_paper":{"arxiv_id":"2505.23646","last_updated":"2025-05-29T16:53:41Z","snapshot_observed_at":"2026-08-20T06:05:04.363087Z","submitted_at":"2025-05-29T16:53:41Z","title":"Are Reasoning Models More Prone to Hallucination?","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T12:45:29.564724Z"},"links":{"citing_paper":"/paper/2505.23646"},"observation_digest":"sha256:c8e7213959be8025d41c0f34c23dcb12795def2beb80fbfe1ed29042ea1314ee","observation_id":"8630eb54-8235-433e-83f4-9041339d5d0c","resolution":{"observed_at":"2026-08-07T12:45:38.563306Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:45:38.288870Z","title":null,"venue":null,"work_id":"02c96cfa-5151-46a0-843a-4a200c521a72","year":2023},"citing_paper":{"arxiv_id":"2505.23646","last_updated":"2025-05-29T16:53:41Z","snapshot_observed_at":"2026-08-20T06:05:04.363087Z","submitted_at":"2025-05-29T16:53:41Z","title":"Are Reasoning Models More Prone to Hallucination?","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T12:45:29.686126Z"},"links":{"citing_paper":"/paper/2505.23646"},"observation_digest":"sha256:c7d16ba5b0bc7be438c409d26ded3330648b9edd8d7655c619fad14ab807790b","observation_id":"db209ddc-6810-47a8-b8a4-4b1ce94e48ea","resolution":{"observed_at":"2026-08-07T12:45:38.346192Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:45:37.987435Z","title":"Evaluating generative lan- guage models in information extraction as subjective question correction","venue":null,"work_id":"a0bf20f3-91c5-42d4-bdab-8cecc410c384","year":2024},"citing_paper":{"arxiv_id":"2505.23646","last_updated":"2025-05-29T16:53:41Z","snapshot_observed_at":"2026-08-20T06:05:04.363087Z","submitted_at":"2025-05-29T16:53:41Z","title":"Are Reasoning Models More Prone to Hallucination?","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T12:45:30.033428Z"},"links":{"citing_paper":"/paper/2505.23646"},"observation_digest":"sha256:259208d1b95e75f4da18f2728af9e285b9ca952660e66981bbcc9804f3893bca","observation_id":"64e26b98-b5c2-4d45-9b75-cbc66e09165e","resolution":{"observed_at":"2026-08-07T12:45:38.034204Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:45:37.779387Z","title":"Specializing smaller language models towards multi-step reasoning","venue":null,"work_id":"323f3e76-696a-4fb1-b620-d204c35158fa","year":2023},"citing_paper":{"arxiv_id":"2505.23646","last_updated":"2025-05-29T16:53:41Z","snapshot_observed_at":"2026-08-20T06:05:04.363087Z","submitted_at":"2025-05-29T16:53:41Z","title":"Are Reasoning Models More Prone to Hallucination?","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T12:45:30.131757Z"},"links":{"citing_paper":"/paper/2505.23646"},"observation_digest":"sha256:53bbe114275861dae39fb080bd43ec96b7955f9942ce83ae6299827d1b882a34","observation_id":"e80ed950-51b2-4214-afb8-7038c270b26b","resolution":{"observed_at":"2026-08-07T12:45:37.888465Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.19165","last_updated":"2023-05-30T16:09:19Z","snapshot_observed_at":"2026-08-19T07:02:36.987726Z","submitted_at":"2023-05-30T16:09:19Z","title":"Strategic Reasoning with Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.19165","snapshot_observed_at":"2026-08-07T12:45:30.195622Z","title":"Strategic reasoning with language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.23646","last_updated":"2025-05-29T16:53:41Z","snapshot_observed_at":"2026-08-20T06:05:04.363087Z","submitted_at":"2025-05-29T16:53:41Z","title":"Are Reasoning Models More Prone to Hallucination?","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T12:45:30.195622Z"},"links":{"cited_paper":"/paper/2305.19165","citing_paper":"/paper/2505.23646"},"observation_digest":"sha256:b90a281f54569c893c6f594d1e7e03a6b0cb65fafdae22bafd04f929506b2659","observation_id":"6b0dcafb-8675-45e9-9e65-2620201cd489","resolution":{"observed_at":"2026-08-07T12:45:30.195622Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:45:37.596643Z","title":"PAL: program-aided language models","venue":null,"work_id":"d3a2d27f-69a5-410c-b419-dfc6b23a9892","year":2023},"citing_paper":{"arxiv_id":"2505.23646","last_updated":"2025-05-29T16:53:41Z","snapshot_observed_at":"2026-08-20T06:05:04.363087Z","submitted_at":"2025-05-29T16:53:41Z","title":"Are Reasoning Models More Prone to Hallucination?","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T12:45:30.239420Z"},"links":{"citing_paper":"/paper/2505.23646"},"observation_digest":"sha256:07078d306f6911b686c732d2f528c04ac5e62b7f856acd57edd787832e30033c","observation_id":"438930a2-e28b-4ede-91d3-63367f19d084","resolution":{"observed_at":"2026-08-07T12:45:37.656370Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:45:37.359680Z","title":"A survey of confidence estimation and calibration in large language models","venue":null,"work_id":"5d5d518e-cd69-490b-9058-eb9baccc5f24","year":2024},"citing_paper":{"arxiv_id":"2505.23646","last_updated":"2025-05-29T16:53:41Z","snapshot_observed_at":"2026-08-20T06:05:04.363087Z","submitted_at":"2025-05-29T16:53:41Z","title":"Are Reasoning Models More Prone to Hallucination?","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T12:45:30.284844Z"},"links":{"citing_paper":"/paper/2505.23646"},"observation_digest":"sha256:a6350855709d9edbd4e29f695e5ed53cb302d8e91d7599b36e5a612944ce2e0f","observation_id":"2b251128-fe9b-415d-b740-f052e7509b47","resolution":{"observed_at":"2026-08-07T12:45:37.462066Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:45:37.107739Z","title":"Glm-4-0414 model series.https://github.com/THUDM/GLM-4, 2025","venue":null,"work_id":"9f59d4e1-a4fb-460d-b7bd-d87960607aa9","year":2025},"citing_paper":{"arxiv_id":"2505.23646","last_updated":"2025-05-29T16:53:41Z","snapshot_observed_at":"2026-08-20T06:05:04.363087Z","submitted_at":"2025-05-29T16:53:41Z","title":"Are Reasoning Models More Prone to Hallucination?","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T12:45:30.323199Z"},"links":{"citing_paper":"/paper/2505.23646"},"observation_digest":"sha256:34ddb29a1add48a2fef9ccfcce800eea909001cc33915141440a905b01d4c7dc","observation_id":"470596ab-9acb-4d96-8a41-7842cdde2e7f","resolution":{"observed_at":"2026-08-07T12:45:37.253199Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16339","last_updated":"2025-01-08T20:11:59Z","snapshot_observed_at":"2026-08-17T07:21:20.458339Z","submitted_at":"2024-12-20T21:00:11Z","title":"Deliberative Alignment: Reasoning Enables Safer Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.16339","snapshot_observed_at":"2026-08-07T12:45:30.366747Z","title":"Deliberative alignment: Reasoning enables safer language models.arXiv preprint CoRR, abs/2412.16339, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23646","last_updated":"2025-05-29T16:53:41Z","snapshot_observed_at":"2026-08-20T06:05:04.363087Z","submitted_at":"2025-05-29T16:53:41Z","title":"Are Reasoning Models More Prone to Hallucination?","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T12:45:30.366747Z"},"links":{"cited_paper":"/paper/2412.16339","citing_paper":"/paper/2505.23646"},"observation_digest":"sha256:9e4600c9f9bc1d65e99175b668ce62455c07286a1a0ba868c308758d7cb3e7d2","observation_id":"a3316b4b-0177-4d54-a433-db6f8f99dade","resolution":{"observed_at":"2026-08-07T12:45:30.366747Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-08-15T12:33:55.451951Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-07T12:45:30.447964Z","title":"Deepseek-R1: Incentivizing reasoning capability in llms via reinforcement learning.arXiv preprint arXiv:2501.12948, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.23646","last_updated":"2025-05-29T16:53:41Z","snapshot_observed_at":"2026-08-20T06:05:04.363087Z","submitted_at":"2025-05-29T16:53:41Z","title":"Are Reasoning Models More Prone to Hallucination?","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T12:45:30.447964Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2505.23646"},"observation_digest":"sha256:2330bec0732706b8cf8a145befc806fa44383a458cb8fa226017ab3fc807afcc","observation_id":"91d0dfb1-318b-46ce-ae62-fc8b5fde9c48","resolution":{"observed_at":"2026-08-07T12:45:30.447964Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.11456","last_updated":"2025-05-22T19:12:14Z","snapshot_observed_at":"2026-08-13T20:36:12.184426Z","submitted_at":"2025-04-15T17:59:51Z","title":"DeepMath-103K: A Large-Scale, Challenging, Decontaminated, and Verifiable Mathematical Dataset for Advancing Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.11456","snapshot_observed_at":"2026-08-07T12:45:30.515673Z","title":"Deepmath-103k: A large-scale, challenging, decontaminated, and verifiable mathematical dataset for advancing reasoning.arXiv preprint CoRR, abs/2504.11456, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.23646","last_updated":"2025-05-29T16:53:41Z","snapshot_observed_at":"2026-08-20T06:05:04.363087Z","submitted_at":"2025-05-29T16:53:41Z","title":"Are Reasoning Models More Prone to Hallucination?","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T12:45:30.515673Z"},"links":{"cited_paper":"/paper/2504.11456","citing_paper":"/paper/2505.23646"},"observation_digest":"sha256:775e954c305277b1b205533e7430be89cdb9b6352e92eafaee11f8e0880abe0a","observation_id":"aa512bf3-84d3-40c1-9c41-9a2aa9fcaaa9","resolution":{"observed_at":"2026-08-07T12:45:30.515673Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.11651","last_updated":"2025-06-13T16:15:45Z","snapshot_observed_at":"2026-08-22T13:40:38.082260Z","submitted_at":"2025-01-20T18:33:33Z","title":"T1: Advancing Language Model Reasoning through Reinforcement Learning and Inference Scaling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.11651","snapshot_observed_at":"2026-08-07T12:45:30.579622Z","title":"Advancing language model reasoning through reinforcement learning and inference scaling.arXiv preprint CoRR, abs/2501.11651, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.23646","last_updated":"2025-05-29T16:53:41Z","snapshot_observed_at":"2026-08-20T06:05:04.363087Z","submitted_at":"2025-05-29T16:53:41Z","title":"Are Reasoning Models More Prone to Hallucination?","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T12:45:30.579622Z"},"links":{"cited_paper":"/paper/2501.11651","citing_paper":"/paper/2505.23646"},"observation_digest":"sha256:a3132ad73d37bd2d840353f6d0e091a21f103105f0a2888304c1539f7a589576","observation_id":"40c01fbe-6c3c-4c25-b7f8-ab428a258bfc","resolution":{"observed_at":"2026-08-07T12:45:30.579622Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16720","last_updated":"2026-04-30T02:46:40Z","snapshot_observed_at":"2026-08-19T11:46:55.171293Z","submitted_at":"2024-12-21T18:04:31Z","title":"OpenAI o1 System Card","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.16720","snapshot_observed_at":"2026-08-07T12:45:30.651769Z","title":"Openai o1 system card.arXiv preprint CoRR, abs/2412.16720, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23646","last_updated":"2025-05-29T16:53:41Z","snapshot_observed_at":"2026-08-20T06:05:04.363087Z","submitted_at":"2025-05-29T16:53:41Z","title":"Are Reasoning Models More Prone to Hallucination?","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T12:45:30.651769Z"},"links":{"cited_paper":"/paper/2412.16720","citing_paper":"/paper/2505.23646"},"observation_digest":"sha256:952e60699b3eda3e7d1cc6abfea0f61c63e9372624f551d3a00e315e80d06011","observation_id":"ef403715-1aea-4d11-aea2-e423a916612e","resolution":{"observed_at":"2026-08-07T12:45:30.651769Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.06647","last_updated":"2024-02-02T12:21:04Z","snapshot_observed_at":"2026-08-20T03:21:15.999299Z","submitted_at":"2024-02-02T12:21:04Z","title":"A Survey on Large Language Model Hallucination via a Creativity Perspective","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.06647","snapshot_observed_at":"2026-08-07T12:45:30.769079Z","title":"A survey on large language model hallucination via a creativity perspective.arXiv preprint CoRR, abs/2402.06647, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23646","last_updated":"2025-05-29T16:53:41Z","snapshot_observed_at":"2026-08-20T06:05:04.363087Z","submitted_at":"2025-05-29T16:53:41Z","title":"Are Reasoning Models More Prone to Hallucination?","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T12:45:30.769079Z"},"links":{"cited_paper":"/paper/2402.06647","citing_paper":"/paper/2505.23646"},"observation_digest":"sha256:9b1cbc81b6f9d7175c590dbfab3172036edeb879f77e92317ebf193269c9841a","observation_id":"03549590-482c-4d85-902a-8db4f8c714f0","resolution":{"observed_at":"2026-08-07T12:45:30.769079Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:45:36.837953Z","title":"Triviaqa: A large scale distantly supervised challenge dataset for reading comprehension","venue":null,"work_id":"d174b2de-0c41-485f-a56b-399bfdc7a20f","year":2017},"citing_paper":{"arxiv_id":"2505.23646","last_updated":"2025-05-29T16:53:41Z","snapshot_observed_at":"2026-08-20T06:05:04.363087Z","submitted_at":"2025-05-29T16:53:41Z","title":"Are Reasoning Models More Prone to Hallucination?","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T12:45:30.864217Z"},"links":{"citing_paper":"/paper/2505.23646"},"observation_digest":"sha256:a5b4eb0116fcbd3e8ef90e99701cd6d90db5dc7502653f628fd750d3122bdab1","observation_id":"88f98a84-f86c-4f77-94b3-c474160d0bf5","resolution":{"observed_at":"2026-08-07T12:45:36.992094Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:45:36.579149Z","title":"Large language models are zero-shot reasoners","venue":null,"work_id":"f610f38f-72e0-42e1-a5f7-279ca6a95464","year":2022},"citing_paper":{"arxiv_id":"2505.23646","last_updated":"2025-05-29T16:53:41Z","snapshot_observed_at":"2026-08-20T06:05:04.363087Z","submitted_at":"2025-05-29T16:53:41Z","title":"Are Reasoning Models More Prone to Hallucination?","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T12:45:30.953074Z"},"links":{"citing_paper":"/paper/2505.23646"},"observation_digest":"sha256:07c56191f02d6e30bb06fa4e46502e8e46b0d943a6bcbb66aa4733fdd784b69b","observation_id":"15b3dcb4-89b1-446f-948c-c88fa2e0d32f","resolution":{"observed_at":"2026-08-07T12:45:36.702861Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15124","last_updated":"2025-04-14T22:39:09Z","snapshot_observed_at":"2026-08-17T14:11:00.232598Z","submitted_at":"2024-11-22T18:44:04Z","title":"Tulu 3: Pushing Frontiers in Open Language Model Post-Training","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.15124","snapshot_observed_at":"2026-08-07T12:45:31.066648Z","title":"T \\\" ulu 3: Pushing frontiers in open language model post-training.arXiv preprint CoRR, abs/2411.15124, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23646","last_updated":"2025-05-29T16:53:41Z","snapshot_observed_at":"2026-08-20T06:05:04.363087Z","submitted_at":"2025-05-29T16:53:41Z","title":"Are Reasoning Models More Prone to Hallucination?","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T12:45:31.066648Z"},"links":{"cited_paper":"/paper/2411.15124","citing_paper":"/paper/2505.23646"},"observation_digest":"sha256:c1193ea788642ae3ec2b76a0909e4673b59d1f36304fb31a715c075ed992d3da","observation_id":"2609dbe7-4012-4e26-99a2-adf272d1856b","resolution":{"observed_at":"2026-08-07T12:45:31.066648Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:45:36.378274Z","title":"Rlaif vs","venue":null,"work_id":"5554672a-a3e9-47b9-94bc-531e8a7586f7","year":2024},"citing_paper":{"arxiv_id":"2505.23646","last_updated":"2025-05-29T16:53:41Z","snapshot_observed_at":"2026-08-20T06:05:04.363087Z","submitted_at":"2025-05-29T16:53:41Z","title":"Are Reasoning Models More Prone to Hallucination?","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T12:45:31.158962Z"},"links":{"citing_paper":"/paper/2505.23646"},"observation_digest":"sha256:fb6045c8ab7eb5d06273c398e81415533d6137362f2f8ed1d891954c77d2f598","observation_id":"e195a010-34f7-4702-a07d-a5d9fb85bac0","resolution":{"observed_at":"2026-08-07T12:45:36.459035Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-08-18T18:18:37.449517Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-08-07T12:45:31.242447Z","title":"Deepseek-v3 technical report.arXiv preprint CoRR, abs/2412.19437, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23646","last_updated":"2025-05-29T16:53:41Z","snapshot_observed_at":"2026-08-20T06:05:04.363087Z","submitted_at":"2025-05-29T16:53:41Z","title":"Are Reasoning Models More Prone to Hallucination?","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T12:45:31.242447Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2505.23646"},"observation_digest":"sha256:dcf8670cdd026693b5b3da81acc83832e3833b8be1ac3dadd783206e83dc25cd","observation_id":"56f1643a-2951-435a-9b6a-f71f0730259c","resolution":{"observed_at":"2026-08-07T12:45:31.242447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:45:36.056797Z","title":"Deepscaler: Surpassing o1-preview with a 1.5 b model by scaling rl.Notion Blog, 2025","venue":null,"work_id":"db74e7d7-0312-4545-aba9-9e12f32e95f1","year":2025},"citing_paper":{"arxiv_id":"2505.23646","last_updated":"2025-05-29T16:53:41Z","snapshot_observed_at":"2026-08-20T06:05:04.363087Z","submitted_at":"2025-05-29T16:53:41Z","title":"Are Reasoning Models More Prone to Hallucination?","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T12:45:31.325107Z"},"links":{"citing_paper":"/paper/2505.23646"},"observation_digest":"sha256:08780b361a679c190179819140c6c9b47f43129f422dedaea3d88083de06f7c2","observation_id":"64ab248d-de27-4100-85f1-cc34eff4e2a9","resolution":{"observed_at":"2026-08-07T12:45:36.200760Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:45:35.892499Z","title":"Teaching small language models to reason","venue":null,"work_id":"9b121197-64cc-47da-bd55-05c204902311","year":2023},"citing_paper":{"arxiv_id":"2505.23646","last_updated":"2025-05-29T16:53:41Z","snapshot_observed_at":"2026-08-20T06:05:04.363087Z","submitted_at":"2025-05-29T16:53:41Z","title":"Are Reasoning Models More Prone to Hallucination?","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T12:45:31.599738Z"},"links":{"citing_paper":"/paper/2505.23646"},"observation_digest":"sha256:012253427b18c18b0f1e54a14063e80a33bc55240559407e8c8bb481eaee6d45","observation_id":"ab1aa07d-b0f7-4c67-9488-5dbead1d2b04","resolution":{"observed_at":"2026-08-07T12:45:35.936841Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.08747","last_updated":"2025-01-05T04:09:00Z","snapshot_observed_at":"2026-08-16T00:12:56.001802Z","submitted_at":"2023-08-17T02:53:23Z","title":"An Empirical Study of Catastrophic Forgetting in Large Language Models During Continual Fine-tuning","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.08747","snapshot_observed_at":"2026-08-07T12:45:31.525214Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.23646","last_updated":"2025-05-29T16:53:41Z","snapshot_observed_at":"2026-08-20T06:05:04.363087Z","submitted_at":"2025-05-29T16:53:41Z","title":"Are Reasoning Models More Prone to Hallucination?","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T12:45:31.525214Z"},"links":{"cited_paper":"/paper/2308.08747","citing_paper":"/paper/2505.23646"},"observation_digest":"sha256:5a34391e54f91ad4140c724f5d263ee9fb33cbc0e4cf39a11cb2ca87ae74ee67","observation_id":"67e848a8-2874-4084-b82c-7ec958502a50","resolution":{"observed_at":"2026-08-07T12:45:31.525214Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:45:35.571229Z","title":"Openai o3 and o4-mini system card","venue":null,"work_id":"de3c18a1-f199-427f-bae4-7c9ace505b92","year":2025},"citing_paper":{"arxiv_id":"2505.23646","last_updated":"2025-05-29T16:53:41Z","snapshot_observed_at":"2026-08-20T06:05:04.363087Z","submitted_at":"2025-05-29T16:53:41Z","title":"Are Reasoning Models More Prone to Hallucination?","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T12:45:31.759975Z"},"links":{"citing_paper":"/paper/2505.23646"},"observation_digest":"sha256:44e9d20ce3524a54be98d215ced66d13aaa8a74882fb0c5786dcf773deccc472","observation_id":"1cd9df3c-8fb6-4597-866a-55e4efd7e386","resolution":{"observed_at":"2026-08-07T12:45:35.653094Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:45:35.743840Z","title":"Cooper, and Milos Hauskrecht","venue":null,"work_id":"5874ffa8-571f-410e-bbe7-da5d45aedea3","year":2015},"citing_paper":{"arxiv_id":"2505.23646","last_updated":"2025-05-29T16:53:41Z","snapshot_observed_at":"2026-08-20T06:05:04.363087Z","submitted_at":"2025-05-29T16:53:41Z","title":"Are Reasoning Models More Prone to Hallucination?","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T12:45:31.667685Z"},"links":{"citing_paper":"/paper/2505.23646"},"observation_digest":"sha256:38fa830f0d93f093bfdb0fb4a385dd5c4669a2ef86b3cad391eea6cae3fc2ac0","observation_id":"356ea4f8-3157-4183-a873-40998bf6cb16","resolution":{"observed_at":"2026-08-07T12:45:35.815597Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:45:35.267366Z","title":"Recursive introspection: Teaching language model agents how to self-improve","venue":null,"work_id":"91f8d413-af50-47cd-aa75-fc734554badf","year":2024},"citing_paper":{"arxiv_id":"2505.23646","last_updated":"2025-05-29T16:53:41Z","snapshot_observed_at":"2026-08-20T06:05:04.363087Z","submitted_at":"2025-05-29T16:53:41Z","title":"Are Reasoning Models More Prone to Hallucination?","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T12:45:31.955464Z"},"links":{"citing_paper":"/paper/2505.23646"},"observation_digest":"sha256:4e084e7c62944c22ce65727320547d82102307084b9e6cb8eac6033ff3130e2f","observation_id":"ea9bd38b-ca7c-4f74-845d-307d038c7891","resolution":{"observed_at":"2026-08-07T12:45:35.352138Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:45:35.450026Z","title":null,"venue":null,"work_id":"0759ebb4-38b9-4825-a725-755c3795ea7d","year":2022},"citing_paper":{"arxiv_id":"2505.23646","last_updated":"2025-05-29T16:53:41Z","snapshot_observed_at":"2026-08-20T06:05:04.363087Z","submitted_at":"2025-05-29T16:53:41Z","title":"Are Reasoning Models More Prone to Hallucination?","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T12:45:31.832036Z"},"links":{"citing_paper":"/paper/2505.23646"},"observation_digest":"sha256:66accd7b4156ac6f8ed6d579a127d7f1c31ec19b78d7b5a7ff7870209ba9980c","observation_id":"6d5acb81-b9bb-4419-aff8-5b27a0c3ee0e","resolution":{"observed_at":"2026-08-07T12:45:35.506422Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:45:34.918742Z","title":"A comprehensive survey of hallucination in large language, image, video and audio foundation models","venue":null,"work_id":"f114c2e6-0d13-462f-893d-4d7d7fa45e62","year":2024},"citing_paper":{"arxiv_id":"2505.23646","last_updated":"2025-05-29T16:53:41Z","snapshot_observed_at":"2026-08-20T06:05:04.363087Z","submitted_at":"2025-05-29T16:53:41Z","title":"Are Reasoning Models More Prone to Hallucination?","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T12:45:32.199125Z"},"links":{"citing_paper":"/paper/2505.23646"},"observation_digest":"sha256:8b14c173c092e7caeb5ebf79e8fd5d9643d2519f1b5cedd0262f6833d6237c86","observation_id":"d414a14e-157b-421a-a581-8aa3cc26d32c","resolution":{"observed_at":"2026-08-07T12:45:34.985131Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:45:35.097817Z","title":"Qwen3: Think deeper, act faster","venue":null,"work_id":"ccee8414-97f8-4ed3-9ab0-e6b4a29048aa","year":2025},"citing_paper":{"arxiv_id":"2505.23646","last_updated":"2025-05-29T16:53:41Z","snapshot_observed_at":"2026-08-20T06:05:04.363087Z","submitted_at":"2025-05-29T16:53:41Z","title":"Are Reasoning Models More Prone to Hallucination?","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T12:45:32.090208Z"},"links":{"citing_paper":"/paper/2505.23646"},"observation_digest":"sha256:062da54ab1080c929cd69e08a3c0a2e402a3a886c176e0fa65b0ff2e6d66ecd2","observation_id":"57db818f-2ddd-4f3d-b0cb-d568fb68efb3","resolution":{"observed_at":"2026-08-07T12:45:35.180600Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.07608","last_updated":"2025-06-05T11:49:09Z","snapshot_observed_at":"2026-08-21T18:19:45.328365Z","submitted_at":"2025-05-12T14:30:11Z","title":"MiMo: Unlocking the Reasoning Potential of Language Model -- From Pretraining to Posttraining","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.07608","snapshot_observed_at":"2026-08-07T12:45:32.401267Z","title":"MiMo: Unlocking the reasoning potential of language model – from pretraining to posttraining.arXiv preprint CoRR, abs/2505.07608, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.23646","last_updated":"2025-05-29T16:53:41Z","snapshot_observed_at":"2026-08-20T06:05:04.363087Z","submitted_at":"2025-05-29T16:53:41Z","title":"Are Reasoning Models More Prone to Hallucination?","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T12:45:32.401267Z"},"links":{"cited_paper":"/paper/2505.07608","citing_paper":"/paper/2505.23646"},"observation_digest":"sha256:846243e2910dbd84c004af6da5e9bdc9a1c24592cdc888259e2c8f1d36a53f7f","observation_id":"52c00313-145e-46cf-a45c-ec4eee00a557","resolution":{"observed_at":"2026-08-07T12:45:32.401267Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:45:34.766819Z","title":"Mastering the game of go without human knowledge.Nat., 550:354–359, 2017","venue":null,"work_id":"60841b36-7cd2-4a6c-b908-2936b45f65bf","year":2017},"citing_paper":{"arxiv_id":"2505.23646","last_updated":"2025-05-29T16:53:41Z","snapshot_observed_at":"2026-08-20T06:05:04.363087Z","submitted_at":"2025-05-29T16:53:41Z","title":"Are Reasoning Models More Prone to Hallucination?","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T12:45:32.286470Z"},"links":{"citing_paper":"/paper/2505.23646"},"observation_digest":"sha256:fe6fd6bc2b1b88d3e47639d91f1392ba54cccdd46cc27f90e55d9d84b3f231b6","observation_id":"7925b183-83ac-43d1-830b-3802800778c3","resolution":{"observed_at":"2026-08-07T12:45:34.806426Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:45:34.461758Z","title":"Chi, Quoc V","venue":null,"work_id":"d93b3c7c-49db-4e97-8908-8eae0f104ea1","year":2022},"citing_paper":{"arxiv_id":"2505.23646","last_updated":"2025-05-29T16:53:41Z","snapshot_observed_at":"2026-08-20T06:05:04.363087Z","submitted_at":"2025-05-29T16:53:41Z","title":"Are Reasoning Models More Prone to Hallucination?","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T12:45:32.617012Z"},"links":{"citing_paper":"/paper/2505.23646"},"observation_digest":"sha256:fcc7e615d8739eac38b77e0772d6913f08ad2dc7e281bb5fdf5b835eea96bdb2","observation_id":"91fd12a6-133e-485c-8708-0c9887561bcb","resolution":{"observed_at":"2026-08-07T12:45:34.559953Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:45:34.623360Z","title":"ReFT: Reasoning with reinforced fine-tuning","venue":null,"work_id":"c1f9e502-7b23-4ab5-807f-07392e6a9796","year":2024},"citing_paper":{"arxiv_id":"2505.23646","last_updated":"2025-05-29T16:53:41Z","snapshot_observed_at":"2026-08-20T06:05:04.363087Z","submitted_at":"2025-05-29T16:53:41Z","title":"Are Reasoning Models More Prone to Hallucination?","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T12:45:32.499692Z"},"links":{"citing_paper":"/paper/2505.23646"},"observation_digest":"sha256:11527f95e1712895d074897ec5701b31296b7dbbd7ee8525c9b274b8d5324c8f","observation_id":"4d76b50d-83c9-4e0f-847c-9abacab27e97","resolution":{"observed_at":"2026-08-07T12:45:34.686068Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.09686","last_updated":"2025-01-23T08:44:44Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-16T17:37:58Z","title":"Towards Large Reasoning Models: A Survey of Reinforced Reasoning with Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.09686","snapshot_observed_at":"2026-08-07T12:45:32.811607Z","title":"Towards large reasoning models: A survey of reinforced reasoning with large language models.arXiv preprint CoRR, abs/2501.09686, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.23646","last_updated":"2025-05-29T16:53:41Z","snapshot_observed_at":"2026-08-20T06:05:04.363087Z","submitted_at":"2025-05-29T16:53:41Z","title":"Are Reasoning Models More Prone to Hallucination?","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T12:45:32.811607Z"},"links":{"cited_paper":"/paper/2501.09686","citing_paper":"/paper/2505.23646"},"observation_digest":"sha256:dab5cc02b31fcaca58edacf857c8ce3d92daf8ff9f10f28084fd4880302c55dd","observation_id":"dca250df-7db1-4195-b3a4-76afdac2d293","resolution":{"observed_at":"2026-08-07T12:45:32.811607Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.04368","last_updated":"2024-11-07T01:58:42Z","snapshot_observed_at":"2026-08-17T10:08:57.374438Z","submitted_at":"2024-11-07T01:58:42Z","title":"Measuring short-form factuality in large language models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.04368","snapshot_observed_at":"2026-08-07T12:45:32.707752Z","title":"Measuring short-form factuality in large language models.arXiv preprint CoRR, abs/2411.04368, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23646","last_updated":"2025-05-29T16:53:41Z","snapshot_observed_at":"2026-08-20T06:05:04.363087Z","submitted_at":"2025-05-29T16:53:41Z","title":"Are Reasoning Models More Prone to Hallucination?","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T12:45:32.707752Z"},"links":{"cited_paper":"/paper/2411.04368","citing_paper":"/paper/2505.23646"},"observation_digest":"sha256:766ae385ff671c440ff976201a4b4168cc13f0caf2d26aa6c0c401e95270c3be","observation_id":"fc6fa950-9580-4289-92bf-3011befb0c22","resolution":{"observed_at":"2026-08-07T12:45:32.707752Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03387","last_updated":"2025-07-29T16:23:02Z","snapshot_observed_at":"2026-08-08T04:13:22.884923Z","submitted_at":"2025-02-05T17:23:45Z","title":"LIMO: Less is More for Reasoning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.03387","snapshot_observed_at":"2026-08-07T12:45:32.921079Z","title":"LIMO: Less is more for reasoning.arXiv preprint CoRR, abs/2502.03387, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.23646","last_updated":"2025-05-29T16:53:41Z","snapshot_observed_at":"2026-08-20T06:05:04.363087Z","submitted_at":"2025-05-29T16:53:41Z","title":"Are Reasoning Models More Prone to Hallucination?","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T12:45:32.921079Z"},"links":{"cited_paper":"/paper/2502.03387","citing_paper":"/paper/2505.23646"},"observation_digest":"sha256:1e1c473860ecd22aa4b49113295a53551fe6e7586f5945292bd0d6c9b58beca5","observation_id":"a5fc8152-1f1a-4c18-ae3b-65089ce0cc19","resolution":{"observed_at":"2026-08-07T12:45:32.921079Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-08-07T12:45:32.858599Z","title":"Qwen3 technical report.arXiv preprint CoRR, abs/2505.09388, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.23646","last_updated":"2025-05-29T16:53:41Z","snapshot_observed_at":"2026-08-20T06:05:04.363087Z","submitted_at":"2025-05-29T16:53:41Z","title":"Are Reasoning Models More Prone to Hallucination?","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T12:45:32.858599Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2505.23646"},"observation_digest":"sha256:197c7bac84430e7c4b4bc78fa86bd153a0bdc2b6cc6594b321f8692d089fd742","observation_id":"b5bc901d-aaa1-4ac1-9cf3-e7f4ac9af352","resolution":{"observed_at":"2026-08-07T12:45:32.858599Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:45:34.317522Z","title":"STaR: Bootstrapping reasoning with reason- ing","venue":null,"work_id":"adf1a7ad-e9bf-45c3-ab7f-80fe631d099e","year":2022},"citing_paper":{"arxiv_id":"2505.23646","last_updated":"2025-05-29T16:53:41Z","snapshot_observed_at":"2026-08-20T06:05:04.363087Z","submitted_at":"2025-05-29T16:53:41Z","title":"Are Reasoning Models More Prone to Hallucination?","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T12:45:33.024323Z"},"links":{"citing_paper":"/paper/2505.23646"},"observation_digest":"sha256:7049a490093c338cf5a9eff69be728dbb04393181d4e16342bf53f5e9d40b727","observation_id":"47dca280-4e6f-40d1-b534-ee42cd40ee70","resolution":{"observed_at":"2026-08-07T12:45:34.358948Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14476","last_updated":"2025-05-20T01:37:34Z","snapshot_observed_at":"2026-08-18T05:01:20.543826Z","submitted_at":"2025-03-18T17:49:06Z","title":"DAPO: An Open-Source LLM Reinforcement Learning System at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.14476","snapshot_observed_at":"2026-08-07T12:45:32.967235Z","title":"DAPO:an open-source llm reinforcement learning system at scale.arXiv preprint CoRR, abs/2503.14476, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.23646","last_updated":"2025-05-29T16:53:41Z","snapshot_observed_at":"2026-08-20T06:05:04.363087Z","submitted_at":"2025-05-29T16:53:41Z","title":"Are Reasoning Models More Prone to Hallucination?","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T12:45:32.967235Z"},"links":{"cited_paper":"/paper/2503.14476","citing_paper":"/paper/2505.23646"},"observation_digest":"sha256:c85bca96b300c21671192669c66e51ac275a4c1ff5e601defd8d0b1f8b5d890d","observation_id":"d43a438e-6464-4aa2-9aca-a28846594327","resolution":{"observed_at":"2026-08-07T12:45:32.967235Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:45:34.076670Z","title":"Xing, Hao Zhang, Joseph E","venue":null,"work_id":"a2356e6b-e7d5-4ee7-a017-d443299029df","year":2023},"citing_paper":{"arxiv_id":"2505.23646","last_updated":"2025-05-29T16:53:41Z","snapshot_observed_at":"2026-08-20T06:05:04.363087Z","submitted_at":"2025-05-29T16:53:41Z","title":"Are Reasoning Models More Prone to Hallucination?","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T12:45:33.152503Z"},"links":{"citing_paper":"/paper/2505.23646"},"observation_digest":"sha256:bb2ced713a9331753101823fb1645aea82c88bf6bd71212e87ad55580b674831","observation_id":"f31e1e3a-1a83-4ce2-b23a-5c58e2000c3e","resolution":{"observed_at":"2026-08-07T12:45:34.132094Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:45:34.199949Z","title":"Automatic chain of thought prompting in large language models","venue":null,"work_id":"695f38a1-90a2-4c8f-8c0e-85b9c9636063","year":2023},"citing_paper":{"arxiv_id":"2505.23646","last_updated":"2025-05-29T16:53:41Z","snapshot_observed_at":"2026-08-20T06:05:04.363087Z","submitted_at":"2025-05-29T16:53:41Z","title":"Are Reasoning Models More Prone to Hallucination?","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T12:45:33.076015Z"},"links":{"citing_paper":"/paper/2505.23646"},"observation_digest":"sha256:94756b21e4fcb3e8dbf2750a1ffd660da2f67918eb658a6a701d7f09d8963320","observation_id":"7d6740eb-ceca-4a0f-b6c2-69ceb900e18b","resolution":{"observed_at":"2026-08-07T12:45:34.256802Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:45:33.970625Z","title":"intelligent","venue":null,"work_id":"b90bce93-5b0b-4271-b15e-84fb7db72aee","year":2023},"citing_paper":{"arxiv_id":"2505.23646","last_updated":"2025-05-29T16:53:41Z","snapshot_observed_at":"2026-08-20T06:05:04.363087Z","submitted_at":"2025-05-29T16:53:41Z","title":"Are Reasoning Models More Prone to Hallucination?","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T12:45:33.187004Z"},"links":{"citing_paper":"/paper/2505.23646"},"observation_digest":"sha256:68a2bb1c3eb863dde9e23b93f589a4ca2e59a5276d3c222d0d84e1591248e35e","observation_id":"dafcc485-78b4-4d1f-9062-b70df1e51c57","resolution":{"observed_at":"2026-08-07T12:45:34.014630Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:45:38.147136Z","title":null,"venue":null,"work_id":"45c7a4db-465d-43c6-9af6-563af54f635d","year":null},"citing_paper":{"arxiv_id":"2505.23646","last_updated":"2025-05-29T16:53:41Z","snapshot_observed_at":"2026-08-20T06:05:04.363087Z","submitted_at":"2025-05-29T16:53:41Z","title":"Are Reasoning Models More Prone to Hallucination?","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-07T12:45:29.828474Z"},"links":{"citing_paper":"/paper/2505.23646"},"observation_digest":"sha256:9d029fe7a3b89fdb89f29a6a6a3bd242a67e6332427cc9e7e76678b0a41290c4","observation_id":"cc49eaff-0066-4a58-b321-9d53deba874a","resolution":{"observed_at":"2026-08-07T12:45:38.194148Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.23646","last_updated":"2025-05-29T16:53:41Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-20T06:05:04.363087Z","submitted_at":"2025-05-29T16:53:41Z","title":"Are Reasoning Models More Prone to Hallucination?"},"reference_resolution":{"displayed":43,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":19,"verified_exact":0,"verified_fuzzy":24},"total_outbound_references":43},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"thesis":"As of 24 August 2026, this Paper Citation Record lists 43 of 43 outbound references and 32 inbound Pith citation observations for arXiv:2505.23646."}