{"as_of":"2026-08-09T01:05:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f5442240c7764af0343b540dbc4ecab63d73bb615b9060fe543b5da75e6436e8","coverage":[{"denominator":119,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T05:14:47.638235Z","state":"measured"},{"denominator":107,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":107,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":7,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":7,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T05:11:55.947139Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-01T10:15:44.913239Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.08446","last_updated":"2025-06-10T04:44:28Z","snapshot_observed_at":"2026-08-07T09:15:20.058485Z","submitted_at":"2025-06-10T04:44:28Z","title":"A Survey on Large Language Models for Mathematical Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.08446","snapshot_observed_at":"2026-08-06T05:11:55.947139Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.02208","last_updated":"2025-08-05T14:01:00Z","snapshot_observed_at":"2026-08-07T19:28:14.861679Z","submitted_at":"2025-08-04T08:59:36Z","title":"Proof2Hybrid: Automatic Mathematical Benchmark Synthesis for Proof-Centric Problems","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-06T05:11:55.947139Z"},"links":{"cited_paper":"/paper/2506.08446","citing_paper":"/paper/2508.02208"},"observation_digest":"sha256:b9ea25f774cd844132fa0a333bb1f7c139c13af0d97a8cea83427170fd610036","observation_id":"a467bf4f-b6ee-4efa-906b-c9030f76d49d","resolution":{"observed_at":"2026-08-06T05:11:55.947139Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08446","last_updated":"2025-06-10T04:44:28Z","snapshot_observed_at":"2026-08-07T09:15:20.058485Z","submitted_at":"2025-06-10T04:44:28Z","title":"A Survey on Large Language Models for Mathematical Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.08446","snapshot_observed_at":"2026-08-04T06:40:26.346269Z","title":"A survey on large language models for mathematical reasoning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.10739","last_updated":"2026-08-03T08:17:50Z","snapshot_observed_at":"2026-08-07T08:51:03.458621Z","submitted_at":"2025-12-11T15:26:28Z","title":"Intern-S1-MO: Long-horizon Reasoning Agent for Olympiad?Level Mathematical Problem Solving","version":3},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-04T06:40:26.346269Z"},"links":{"cited_paper":"/paper/2506.08446","citing_paper":"/paper/2512.10739"},"observation_digest":"sha256:a31f0fe69c804a6ef0d24d9b07bbe58cc5bcd9b5de0fb5cb7c9e5ae7447c7706","observation_id":"4884c081-abb6-484b-97b8-4ca30140d06d","resolution":{"observed_at":"2026-08-04T06:40:26.346269Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08446","last_updated":"2025-06-10T04:44:28Z","snapshot_observed_at":"2026-08-07T09:15:20.058485Z","submitted_at":"2025-06-10T04:44:28Z","title":"A Survey on Large Language Models for Mathematical Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.08446","snapshot_observed_at":"2026-08-03T10:46:46.689284Z","title":"Jason Wei, Xuezhi Wang, Dale Schuurmans, Maarten Bosma, Brian Ichter, Fei Xia, Ed Chi, Quoc Le, and Denny Zhou","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2601.09085","last_updated":"2026-06-07T02:50:09Z","snapshot_observed_at":"2026-08-03T10:46:42.013201Z","submitted_at":"2026-01-14T02:35:19Z","title":"MMR-GRPO: Accelerating GRPO-Style Training through Diversity-Aware Reward Reweighting","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-03T10:46:46.689284Z"},"links":{"cited_paper":"/paper/2506.08446","citing_paper":"/paper/2601.09085"},"observation_digest":"sha256:f7b2ea32c5f84fb8695d1b6e90b9e11a03333ae7f353c649221b11aaf1f633f3","observation_id":"3de7106d-8b8b-40ea-8e1f-b7a454f6b5a1","resolution":{"observed_at":"2026-08-03T10:46:46.689284Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08446","last_updated":"2025-06-10T04:44:28Z","snapshot_observed_at":"2026-08-07T09:15:20.058485Z","submitted_at":"2025-06-10T04:44:28Z","title":"A Survey on Large Language Models for Mathematical Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.08446","snapshot_observed_at":"2026-08-03T06:52:56.005103Z","title":"A survey on large language models for mathematical reasoning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.21909","last_updated":"2026-05-28T16:50:42Z","snapshot_observed_at":"2026-08-08T01:37:36.546626Z","submitted_at":"2026-01-29T16:00:48Z","title":"From Meta-Thought to Execution: Cognitively Aligned Post-Training for Generalizable and Reliable LLM Reasoning","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-03T06:52:56.005103Z"},"links":{"cited_paper":"/paper/2506.08446","citing_paper":"/paper/2601.21909"},"observation_digest":"sha256:da1b0f24efbe0eff2d4ef237c3b982742fce1396fd316363df0c906b67b0ded1","observation_id":"42edb151-c342-42d8-acae-edab792b795b","resolution":{"observed_at":"2026-08-03T06:52:56.005103Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08446","last_updated":"2025-06-10T04:44:28Z","snapshot_observed_at":"2026-08-07T09:15:20.058485Z","submitted_at":"2025-06-10T04:44:28Z","title":"A Survey on Large Language Models for Mathematical Reasoning","version":1},"cited_work":{"arxiv_id":"2506.08446","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.08446","snapshot_observed_at":"2026-07-01T10:15:44.913239Z","title":"arXiv preprint arXiv:2506.08446 , year=","venue":null,"work_id":"61c4bf63-4427-45d3-bba7-1cc68755fbb7","year":2025},"citing_paper":{"arxiv_id":"2605.18083","last_updated":"2026-05-18T08:59:08Z","snapshot_observed_at":"2026-07-06T23:28:59.503300Z","submitted_at":"2026-05-18T08:59:08Z","title":"A Data-Efficient Path to Multilingual LLMs: Language Expansion via Post-training PARAM$\\Delta$ Integration into Upcycled MoE","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-05-20T11:09:22.027588Z"},"links":{"cited_paper":"/paper/2506.08446","citing_paper":"/paper/2605.18083"},"observation_digest":"sha256:1d7a5566613e20cc2b6042c8417569ff04ca1b29849347bfadbf53b6ec953633","observation_id":"bbd43a06-46e9-4f69-bbbe-4fb9553c514d","resolution":{"observed_at":"2026-05-20T11:13:13.553569Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08446","last_updated":"2025-06-10T04:44:28Z","snapshot_observed_at":"2026-08-07T09:15:20.058485Z","submitted_at":"2025-06-10T04:44:28Z","title":"A Survey on Large Language Models for Mathematical Reasoning","version":1},"cited_work":{"arxiv_id":"2506.08446","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.08446","snapshot_observed_at":"2026-07-01T10:15:44.913239Z","title":"arXiv preprint arXiv:2506.08446 , year=","venue":null,"work_id":"61c4bf63-4427-45d3-bba7-1cc68755fbb7","year":2025},"citing_paper":{"arxiv_id":"2606.31308","last_updated":"2026-06-30T08:18:45Z","snapshot_observed_at":"2026-07-30T01:03:38.628473Z","submitted_at":"2026-06-30T08:18:45Z","title":"Benchmarking Large Language Models on Floating-Point Error Classification","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-07-01T05:39:01.180338Z"},"links":{"cited_paper":"/paper/2506.08446","citing_paper":"/paper/2606.31308"},"observation_digest":"sha256:76031fdd7d4fa6091f91a0499a8af8de049605e7e4698ed935c3705ec1265739","observation_id":"a805b500-b73e-4516-b016-59450b8ef7cc","resolution":{"observed_at":"2026-07-01T10:15:44.914578Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08446","last_updated":"2025-06-10T04:44:28Z","snapshot_observed_at":"2026-08-07T09:15:20.058485Z","submitted_at":"2025-06-10T04:44:28Z","title":"A Survey on Large Language Models for Mathematical Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.08446","snapshot_observed_at":"2026-07-11T15:42:50.296348Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04655","last_updated":"2026-07-06T04:20:06Z","snapshot_observed_at":"2026-08-06T12:02:55.996940Z","submitted_at":"2026-07-06T04:20:06Z","title":"FormalRx: Rectify and eXamine Semantic Failures in Autoformalization","version":1},"reference_index":136,"source":"arxiv_source","source_observed_at":"2026-07-11T15:42:50.296348Z"},"links":{"cited_paper":"/paper/2506.08446","citing_paper":"/paper/2607.04655"},"observation_digest":"sha256:98f6c76a711e928bc358ece3c8212916312f60715c6a9734acff7a23642e57a7","observation_id":"70393a12-af5c-44e1-9f0c-a4d44f2ab2b1","resolution":{"observed_at":"2026-07-11T15:42:50.296348Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2506.08446/citation-record","integrity":"/paper/2506.08446/integrity","json":"/paper/2506.08446/citation-record.json","paper":"/paper/2506.08446"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1905.13319","last_updated":"2019-05-30T21:28:12Z","snapshot_observed_at":"2026-07-06T07:56:54.143277Z","submitted_at":"2019-05-30T21:28:12Z","title":"MathQA: Towards Interpretable Math Word Problem Solving with Operation-Based Formalisms","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1905.13319","snapshot_observed_at":"2026-08-07T05:14:44.064986Z","title":"Amini, S","venue":null,"work_id":null,"year":1905},"citing_paper":{"arxiv_id":"2506.08446","last_updated":"2025-06-10T04:44:28Z","snapshot_observed_at":"2026-08-07T09:15:20.058485Z","submitted_at":"2025-06-10T04:44:28Z","title":"A Survey on Large Language Models for Mathematical Reasoning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T05:14:44.064986Z"},"links":{"cited_paper":"/paper/1905.13319","citing_paper":"/paper/2506.08446"},"observation_digest":"sha256:98d147ddccd7387509a02c6e841fb4f1258627724aacb396a1a360eab7799e5c","observation_id":"92858079-d068-4c85-b5aa-fde45d646d5c","resolution":{"observed_at":"2026-08-07T05:14:44.064986Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.00861","last_updated":"2021-12-09T21:40:22Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-01T22:24:34Z","title":"A General Language Assistant as a Laboratory for Alignment","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.00861","snapshot_observed_at":"2026-08-07T05:14:44.481427Z","title":"Askell, Y","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.08446","last_updated":"2025-06-10T04:44:28Z","snapshot_observed_at":"2026-08-07T09:15:20.058485Z","submitted_at":"2025-06-10T04:44:28Z","title":"A Survey on Large Language Models for Mathematical Reasoning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T05:14:44.481427Z"},"links":{"cited_paper":"/paper/2112.00861","citing_paper":"/paper/2506.08446"},"observation_digest":"sha256:a4ec71a51a4e684facf14318087090dc8d6a2ae981a17e102bfab31ac372d0e2","observation_id":"850786d7-7666-4924-99e1-566927d8c5ec","resolution":{"observed_at":"2026-08-07T05:14:44.481427Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.05862","last_updated":"2022-04-12T15:02:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-12T15:02:38Z","title":"Training a Helpful and Harmless Assistant with Reinforcement Learning from Human Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.05862","snapshot_observed_at":"2026-08-07T05:14:44.639711Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.08446","last_updated":"2025-06-10T04:44:28Z","snapshot_observed_at":"2026-08-07T09:15:20.058485Z","submitted_at":"2025-06-10T04:44:28Z","title":"A Survey on Large Language Models for Mathematical Reasoning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T05:14:44.639711Z"},"links":{"cited_paper":"/paper/2204.05862","citing_paper":"/paper/2506.08446"},"observation_digest":"sha256:03aec3629578864364888028ad302809d3eda974ff1eda5c7e000954e01cd4da","observation_id":"423ddb73-26b3-45a4-9256-21baaab7ffb0","resolution":{"observed_at":"2026-08-07T05:14:44.639711Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.09078","last_updated":"2025-04-01T12:48:43Z","snapshot_observed_at":"2026-08-08T09:53:22.230954Z","submitted_at":"2024-12-12T09:01:18Z","title":"Forest-of-Thought: Scaling Test-Time Compute for Enhancing LLM Reasoning","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.09078","snapshot_observed_at":"2026-08-07T05:14:44.763862Z","title":"Besta, N","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.08446","last_updated":"2025-06-10T04:44:28Z","snapshot_observed_at":"2026-08-07T09:15:20.058485Z","submitted_at":"2025-06-10T04:44:28Z","title":"A Survey on Large Language Models for Mathematical Reasoning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T05:14:44.763862Z"},"links":{"cited_paper":"/paper/2412.09078","citing_paper":"/paper/2506.08446"},"observation_digest":"sha256:67aee743a90ab6d3fac9094b0137c506e8b883c8e0bd0fa990ccb5779025e90a","observation_id":"d7f4873e-9094-4262-84c6-2291596e9148","resolution":{"observed_at":"2026-08-07T05:14:44.763862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.05410","last_updated":"2025-05-08T16:51:43Z","snapshot_observed_at":"2026-07-06T21:21:01.070459Z","submitted_at":"2025-05-08T16:51:43Z","title":"Reasoning Models Don't Always Say What They Think","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.05410","snapshot_observed_at":"2026-08-07T05:14:45.045847Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.08446","last_updated":"2025-06-10T04:44:28Z","snapshot_observed_at":"2026-08-07T09:15:20.058485Z","submitted_at":"2025-06-10T04:44:28Z","title":"A Survey on Large Language Models for Mathematical Reasoning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T05:14:45.045847Z"},"links":{"cited_paper":"/paper/2505.05410","citing_paper":"/paper/2506.08446"},"observation_digest":"sha256:a2d4bb7a7ca23b82510beed0034756fc129c7d302a16bedce8e570e0d8acf779","observation_id":"cf7e1040-bede-4c42-b203-413bc87f8b2f","resolution":{"observed_at":"2026-08-07T05:14:45.045847Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-07T05:14:45.138451Z","title":"Cobbe, V","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.08446","last_updated":"2025-06-10T04:44:28Z","snapshot_observed_at":"2026-08-07T09:15:20.058485Z","submitted_at":"2025-06-10T04:44:28Z","title":"A Survey on Large Language Models for Mathematical Reasoning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T05:14:45.138451Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2506.08446"},"observation_digest":"sha256:13b759f47aece8b20bb8bb5e15ece2a34e054d9788ecfecbd4cb1c9af4e02133","observation_id":"9c986e83-df6e-4663-9a83-cdbc962c7a3f","resolution":{"observed_at":"2026-08-07T05:14:45.138451Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17231","last_updated":"2024-04-03T15:22:35Z","snapshot_observed_at":"2026-08-01T19:29:13.449337Z","submitted_at":"2024-02-27T05:50:35Z","title":"MATHSENSEI: A Tool-Augmented Large Language Model for Mathematical Reasoning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17231","snapshot_observed_at":"2026-08-07T05:14:45.261962Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.08446","last_updated":"2025-06-10T04:44:28Z","snapshot_observed_at":"2026-08-07T09:15:20.058485Z","submitted_at":"2025-06-10T04:44:28Z","title":"A Survey on Large Language Models for Mathematical Reasoning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T05:14:45.261962Z"},"links":{"cited_paper":"/paper/2402.17231","citing_paper":"/paper/2506.08446"},"observation_digest":"sha256:cd17fb9c1462131dc57b36704bbd66f19499fac5ab66f4cdfdbf829a0fb4207a","observation_id":"6a227e99-86ec-48fe-85ab-3e4f0d033d91","resolution":{"observed_at":"2026-08-07T05:14:45.261962Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.12205","last_updated":"2024-05-20T17:45:26Z","snapshot_observed_at":"2026-07-06T18:16:51.116432Z","submitted_at":"2024-05-20T17:45:26Z","title":"Metacognitive Capabilities of LLMs: An Exploration in Mathematical Problem Solving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.12205","snapshot_observed_at":"2026-08-07T05:14:45.303181Z","title":"Didolkar, A","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.08446","last_updated":"2025-06-10T04:44:28Z","snapshot_observed_at":"2026-08-07T09:15:20.058485Z","submitted_at":"2025-06-10T04:44:28Z","title":"A Survey on Large Language Models for Mathematical Reasoning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T05:14:45.303181Z"},"links":{"cited_paper":"/paper/2405.12205","citing_paper":"/paper/2506.08446"},"observation_digest":"sha256:9a05b37c9f295ece926036b45a85c5f7b0d4a8170d38f9d670fd1ad54d4264fd","observation_id":"af8f3ab8-7235-4853-a28a-a49f70889915","resolution":{"observed_at":"2026-08-07T05:14:45.303181Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18693","last_updated":"2025-05-27T11:56:56Z","snapshot_observed_at":"2026-08-08T18:24:24.428314Z","submitted_at":"2024-10-24T12:42:04Z","title":"Unleashing LLM Reasoning Capability via Scalable Question Synthesis from Scratch","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.18693","snapshot_observed_at":"2026-08-07T05:14:45.384225Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.08446","last_updated":"2025-06-10T04:44:28Z","snapshot_observed_at":"2026-08-07T09:15:20.058485Z","submitted_at":"2025-06-10T04:44:28Z","title":"A Survey on Large Language Models for Mathematical Reasoning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T05:14:45.384225Z"},"links":{"cited_paper":"/paper/2410.18693","citing_paper":"/paper/2506.08446"},"observation_digest":"sha256:6fcf9f3f1e1fbd692878c959edf570c5a0ec85e0f0b9fab7e44e945f699fa134","observation_id":"e57622d0-4ce0-4135-96c3-45e919579e0b","resolution":{"observed_at":"2026-08-07T05:14:45.384225Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13293","last_updated":"2024-11-10T08:53:38Z","snapshot_observed_at":"2026-07-31T10:03:51.024742Z","submitted_at":"2024-10-17T07:46:49Z","title":"SBI-RAG: Enhancing Math Word Problem Solving for Students through Schema-Based Instruction and Retrieval-Augmented Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.13293","snapshot_observed_at":"2026-08-07T05:14:45.466712Z","title":"Dixit and T","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.08446","last_updated":"2025-06-10T04:44:28Z","snapshot_observed_at":"2026-08-07T09:15:20.058485Z","submitted_at":"2025-06-10T04:44:28Z","title":"A Survey on Large Language Models for Mathematical Reasoning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T05:14:45.466712Z"},"links":{"cited_paper":"/paper/2410.13293","citing_paper":"/paper/2506.08446"},"observation_digest":"sha256:8e75a1429262fdf0b8198c370f4bfd64557264cebe576a202bbeefcf70f30dda","observation_id":"dd362b00-3279-4185-b41b-39c9e8c67466","resolution":{"observed_at":"2026-08-07T05:14:45.466712Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-07T05:14:45.523595Z","title":"Dubey, A","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.08446","last_updated":"2025-06-10T04:44:28Z","snapshot_observed_at":"2026-08-07T09:15:20.058485Z","submitted_at":"2025-06-10T04:44:28Z","title":"A Survey on Large Language Models for Mathematical Reasoning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T05:14:45.523595Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2506.08446"},"observation_digest":"sha256:beea9abaf527771e94a4af7e0d757031d6a8a9a87ea5785c319d2a292485e1dc","observation_id":"e162aed7-c317-45d9-a1f4-cfce0fc533d8","resolution":{"observed_at":"2026-08-07T05:14:45.523595Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.01920","last_updated":"2025-03-01T03:42:55Z","snapshot_observed_at":"2026-08-02T16:32:10.784538Z","submitted_at":"2024-10-02T18:17:54Z","title":"Step-by-Step Reasoning for Math Problems via Twisted Sequential Monte Carlo","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.01920","snapshot_observed_at":"2026-08-07T05:14:45.672892Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.08446","last_updated":"2025-06-10T04:44:28Z","snapshot_observed_at":"2026-08-07T09:15:20.058485Z","submitted_at":"2025-06-10T04:44:28Z","title":"A Survey on Large Language Models for Mathematical Reasoning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T05:14:45.672892Z"},"links":{"cited_paper":"/paper/2410.01920","citing_paper":"/paper/2506.08446"},"observation_digest":"sha256:fbf66bcd43f6f247224895e2576ddc3da5f59e72f1ae017db8f5505985271cef","observation_id":"73df34a5-358e-4038-b81e-b0c55803c34f","resolution":{"observed_at":"2026-08-07T05:14:45.672892Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.10997","last_updated":"2024-03-27T09:16:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-18T07:47:33Z","title":"Retrieval-Augmented Generation for Large Language Models: A Survey","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.10997","snapshot_observed_at":"2026-08-07T05:14:45.862320Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.08446","last_updated":"2025-06-10T04:44:28Z","snapshot_observed_at":"2026-08-07T09:15:20.058485Z","submitted_at":"2025-06-10T04:44:28Z","title":"A Survey on Large Language Models for Mathematical Reasoning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T05:14:45.862320Z"},"links":{"cited_paper":"/paper/2312.10997","citing_paper":"/paper/2506.08446"},"observation_digest":"sha256:fcab675c5f2ff28ee8e4fd3330299b546cb72fa13c1226f26e366806f7c9546e","observation_id":"aebf84d4-8319-4a43-92aa-06539e9b5cb5","resolution":{"observed_at":"2026-08-07T05:14:45.862320Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.15683","last_updated":"2025-03-06T03:59:59Z","snapshot_observed_at":"2026-08-04T04:09:59.723541Z","submitted_at":"2024-05-24T16:21:59Z","title":"Visual Description Grounding Reduces Hallucinations and Boosts Reasoning in LVLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.15683","snapshot_observed_at":"2026-08-07T05:14:45.921793Z","title":"Ghosh, C","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.08446","last_updated":"2025-06-10T04:44:28Z","snapshot_observed_at":"2026-08-07T09:15:20.058485Z","submitted_at":"2025-06-10T04:44:28Z","title":"A Survey on Large Language Models for Mathematical Reasoning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T05:14:45.921793Z"},"links":{"cited_paper":"/paper/2405.15683","citing_paper":"/paper/2506.08446"},"observation_digest":"sha256:d60f7c4fe49c7e1240f2490fd0d299f9fc0d71f198919aacc0681f05a41ad4e1","observation_id":"7dec2777-5ca8-414d-819e-7e8cc6486355","resolution":{"observed_at":"2026-08-07T05:14:45.921793Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-07T05:14:46.022492Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.08446","last_updated":"2025-06-10T04:44:28Z","snapshot_observed_at":"2026-08-07T09:15:20.058485Z","submitted_at":"2025-06-10T04:44:28Z","title":"A Survey on Large Language Models for Mathematical Reasoning","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T05:14:46.022492Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2506.08446"},"observation_digest":"sha256:0e97544893d082914eb6d4704ef15c73e86576e808ac8e767add0cbad36dd295","observation_id":"dd7418e1-cbc1-491f-965f-cacd444a1bd3","resolution":{"observed_at":"2026-08-07T05:14:46.022492Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.15485","last_updated":"2024-05-24T12:04:54Z","snapshot_observed_at":"2026-07-06T18:19:17.573250Z","submitted_at":"2024-05-24T12:04:54Z","title":"Learning Beyond Pattern Matching? Assaying Mathematical Understanding in LLMs","version":1},"cited_work":{"arxiv_id":"2405.15485","doi":null,"metadata_source":"pith","pith_arxiv_id":"2405.15485","snapshot_observed_at":"2026-08-07T05:14:49.272966Z","title":"Learning Beyond Pattern Matching? Assaying Mathematical Understanding in LLMs","venue":"cs.AI","work_id":"f2fdf9dc-ba57-4c99-a357-92eb8d0874f7","year":2024},"citing_paper":{"arxiv_id":"2506.08446","last_updated":"2025-06-10T04:44:28Z","snapshot_observed_at":"2026-08-07T09:15:20.058485Z","submitted_at":"2025-06-10T04:44:28Z","title":"A Survey on Large Language Models for Mathematical Reasoning","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T05:14:46.082664Z"},"links":{"cited_paper":"/paper/2405.15485","citing_paper":"/paper/2506.08446"},"observation_digest":"sha256:333f943d39de3a54e46977589be17db41e720887ce84a71777533eaf69e5576c","observation_id":"43ba7354-210c-4d19-9a5a-b8be636546a3","resolution":{"observed_at":"2026-08-07T05:14:49.278348Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:14:46.160046Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.08446","last_updated":"2025-06-10T04:44:28Z","snapshot_observed_at":"2026-08-07T09:15:20.058485Z","submitted_at":"2025-06-10T04:44:28Z","title":"A Survey on Large Language Models for Mathematical Reasoning","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T05:14:46.160046Z"},"links":{"citing_paper":"/paper/2506.08446"},"observation_digest":"sha256:907a61f2f53ae5e5e4e176937755bb09f661f12aa4d9e307215e00096e3cf803","observation_id":"6bbbcc34-bb4b-4f3a-abe9-304fe9f00ac8","resolution":{"observed_at":"2026-08-07T05:14:46.160046Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14008","last_updated":"2024-06-06T13:19:44Z","snapshot_observed_at":"2026-08-03T03:39:09.398343Z","submitted_at":"2024-02-21T18:49:26Z","title":"OlympiadBench: A Challenging Benchmark for Promoting AGI with Olympiad-Level Bilingual Multimodal Scientific Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.14008","snapshot_observed_at":"2026-08-07T05:14:46.200213Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.08446","last_updated":"2025-06-10T04:44:28Z","snapshot_observed_at":"2026-08-07T09:15:20.058485Z","submitted_at":"2025-06-10T04:44:28Z","title":"A Survey on Large Language Models for Mathematical Reasoning","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T05:14:46.200213Z"},"links":{"cited_paper":"/paper/2402.14008","citing_paper":"/paper/2506.08446"},"observation_digest":"sha256:890e2c1098469704c8509947fa3edaf589efde6a387ac9caa7cd41d0bf92c779","observation_id":"989216b6-51eb-4a3c-9f83-c3722f59e5a3","resolution":{"observed_at":"2026-08-07T05:14:46.200213Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.03300","last_updated":"2021-01-12T18:57:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-09-07T17:59:25Z","title":"Measuring Massive Multitask Language Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.03300","snapshot_observed_at":"2026-08-07T05:14:46.247204Z","title":"Hendrycks, C","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2506.08446","last_updated":"2025-06-10T04:44:28Z","snapshot_observed_at":"2026-08-07T09:15:20.058485Z","submitted_at":"2025-06-10T04:44:28Z","title":"A Survey on Large Language Models for Mathematical Reasoning","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T05:14:46.247204Z"},"links":{"cited_paper":"/paper/2009.03300","citing_paper":"/paper/2506.08446"},"observation_digest":"sha256:2301e33166c660967e473e7699019e70bc5028797bd4c10e9de9610cfd5d5389","observation_id":"a5cba8e5-883a-4f8f-bdf1-5dabade57e75","resolution":{"observed_at":"2026-08-07T05:14:46.247204Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1503.02531","last_updated":"2015-03-09T15:44:49Z","snapshot_observed_at":"2026-07-06T04:11:24.157003Z","submitted_at":"2015-03-09T15:44:49Z","title":"Distilling the Knowledge in a Neural Network","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1503.02531","snapshot_observed_at":"2026-08-07T05:14:46.320248Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.08446","last_updated":"2025-06-10T04:44:28Z","snapshot_observed_at":"2026-08-07T09:15:20.058485Z","submitted_at":"2025-06-10T04:44:28Z","title":"A Survey on Large Language Models for Mathematical Reasoning","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T05:14:46.320248Z"},"links":{"cited_paper":"/paper/1503.02531","citing_paper":"/paper/2506.08446"},"observation_digest":"sha256:7c39842b76d75285cf6dd4f77c06e4ca3d815d17fcc2fe655142e79aac8de9ff","observation_id":"03bc3294-0ae2-4888-86e6-6f37b4863c03","resolution":{"observed_at":"2026-08-07T05:14:46.320248Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.06457","last_updated":"2024-08-14T02:41:48Z","snapshot_observed_at":"2026-07-06T17:28:02.037844Z","submitted_at":"2024-02-09T15:02:56Z","title":"V-STaR: Training Verifiers for Self-Taught Reasoners","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.06457","snapshot_observed_at":"2026-08-07T05:14:46.382496Z","title":"Hosseini, X","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.08446","last_updated":"2025-06-10T04:44:28Z","snapshot_observed_at":"2026-08-07T09:15:20.058485Z","submitted_at":"2025-06-10T04:44:28Z","title":"A Survey on Large Language Models for Mathematical Reasoning","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T05:14:46.382496Z"},"links":{"cited_paper":"/paper/2402.06457","citing_paper":"/paper/2506.08446"},"observation_digest":"sha256:88c632ada3358f02edc0e359f8e437c54ff0523d6daac3b5c9d62b43b264274b","observation_id":"88f00f23-29fb-4bf8-94ff-85ecf7829686","resolution":{"observed_at":"2026-08-07T05:14:46.382496Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03262","last_updated":"2025-11-10T15:11:13Z","snapshot_observed_at":"2026-08-02T05:27:47.490711Z","submitted_at":"2025-01-04T02:08:06Z","title":"REINFORCE++: Stabilizing Critic-Free Policy Optimization with Global Advantage Normalization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.03262","snapshot_observed_at":"2026-08-07T05:14:46.417579Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.08446","last_updated":"2025-06-10T04:44:28Z","snapshot_observed_at":"2026-08-07T09:15:20.058485Z","submitted_at":"2025-06-10T04:44:28Z","title":"A Survey on Large Language Models for Mathematical Reasoning","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T05:14:46.417579Z"},"links":{"cited_paper":"/paper/2501.03262","citing_paper":"/paper/2506.08446"},"observation_digest":"sha256:d856b9f9e04b508fe54d3e19a4be0da8a839882e06348bb1c0ce62faf6b96ffe","observation_id":"ba5265b3-05fc-496a-89d6-1fc3cfa8eafd","resolution":{"observed_at":"2026-08-07T05:14:46.417579Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:14:46.498596Z","title":"Huang, S","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.08446","last_updated":"2025-06-10T04:44:28Z","snapshot_observed_at":"2026-08-07T09:15:20.058485Z","submitted_at":"2025-06-10T04:44:28Z","title":"A Survey on Large Language Models for Mathematical Reasoning","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T05:14:46.498596Z"},"links":{"citing_paper":"/paper/2506.08446"},"observation_digest":"sha256:62d134313f8ef0cf9a7c39dd7028e0991e31ba1cda1d8c31b3ba04c70425d2bf","observation_id":"91187198-02ae-4605-8a1c-41e7c323ee0b","resolution":{"observed_at":"2026-08-07T05:14:46.498596Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.02333","last_updated":"2024-05-08T01:48:46Z","snapshot_observed_at":"2026-07-06T17:39:24.823145Z","submitted_at":"2024-03-04T18:58:30Z","title":"Key-Point-Driven Data Synthesis with its Enhancement on Mathematical Reasoning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.02333","snapshot_observed_at":"2026-08-07T05:14:46.545758Z","title":"Huang, X","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.08446","last_updated":"2025-06-10T04:44:28Z","snapshot_observed_at":"2026-08-07T09:15:20.058485Z","submitted_at":"2025-06-10T04:44:28Z","title":"A Survey on Large Language Models for Mathematical Reasoning","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T05:14:46.545758Z"},"links":{"cited_paper":"/paper/2403.02333","citing_paper":"/paper/2506.08446"},"observation_digest":"sha256:38ec007d7ee5caa4b028ead41faccc86a2aac8f692bef0b7ccff50fb44b3b386","observation_id":"4a3e3d71-fb7f-4721-95c4-f2d4567803fb","resolution":{"observed_at":"2026-08-07T05:14:46.545758Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.17039","last_updated":"2024-05-27T10:45:49Z","snapshot_observed_at":"2026-07-06T18:20:27.214667Z","submitted_at":"2024-05-27T10:45:49Z","title":"BWArea Model: Learning World Model, Inverse Dynamics, and Policy for Controllable Language Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.17039","snapshot_observed_at":"2026-08-07T05:14:46.615276Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.08446","last_updated":"2025-06-10T04:44:28Z","snapshot_observed_at":"2026-08-07T09:15:20.058485Z","submitted_at":"2025-06-10T04:44:28Z","title":"A Survey on Large Language Models for Mathematical Reasoning","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T05:14:46.615276Z"},"links":{"cited_paper":"/paper/2405.17039","citing_paper":"/paper/2506.08446"},"observation_digest":"sha256:0c01fa28bd5ea4ad2a950f8e0ac5877398c9164ddffc84f4f2d503e792ee4269","observation_id":"7dad16ad-24f0-45dc-bdfe-1de6f2882d3c","resolution":{"observed_at":"2026-08-07T05:14:46.615276Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.21383","last_updated":"2025-03-27T11:25:22Z","snapshot_observed_at":"2026-08-07T16:33:11.370277Z","submitted_at":"2025-03-27T11:25:22Z","title":"Controlling Large Language Model with Latent Actions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.21383","snapshot_observed_at":"2026-08-07T05:14:46.668229Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.08446","last_updated":"2025-06-10T04:44:28Z","snapshot_observed_at":"2026-08-07T09:15:20.058485Z","submitted_at":"2025-06-10T04:44:28Z","title":"A Survey on Large Language Models for Mathematical Reasoning","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T05:14:46.668229Z"},"links":{"cited_paper":"/paper/2503.21383","citing_paper":"/paper/2506.08446"},"observation_digest":"sha256:a61539a0cc7e7c17de5388fc82336baa5522c054eb0ed03564db7fdd8ff52bbe","observation_id":"98dc69be-baa6-438e-8347-93f9b4bf7439","resolution":{"observed_at":"2026-08-07T05:14:46.668229Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.18170","last_updated":"2023-06-09T05:00:30Z","snapshot_observed_at":"2026-08-04T06:30:17.541682Z","submitted_at":"2023-05-29T16:01:40Z","title":"Leveraging Training Data in Few-Shot Prompting for Numerical Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.18170","snapshot_observed_at":"2026-08-07T05:14:46.708957Z","title":"Jie and W","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.08446","last_updated":"2025-06-10T04:44:28Z","snapshot_observed_at":"2026-08-07T09:15:20.058485Z","submitted_at":"2025-06-10T04:44:28Z","title":"A Survey on Large Language Models for Mathematical Reasoning","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T05:14:46.708957Z"},"links":{"cited_paper":"/paper/2305.18170","citing_paper":"/paper/2506.08446"},"observation_digest":"sha256:ee38a6dbf587dcdaa612c4a1781e6ecb95ba579a69bc22e9977bcb9cd366c869","observation_id":"92276698-cada-47d6-9c23-96e35c64541b","resolution":{"observed_at":"2026-08-07T05:14:46.708957Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09516","last_updated":"2025-08-05T19:08:38Z","snapshot_observed_at":"2026-07-06T20:51:28.022519Z","submitted_at":"2025-03-12T16:26:39Z","title":"Search-R1: Training LLMs to Reason and Leverage Search Engines with Reinforcement Learning","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.09516","snapshot_observed_at":"2026-08-07T05:14:46.767411Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.08446","last_updated":"2025-06-10T04:44:28Z","snapshot_observed_at":"2026-08-07T09:15:20.058485Z","submitted_at":"2025-06-10T04:44:28Z","title":"A Survey on Large Language Models for Mathematical Reasoning","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T05:14:46.767411Z"},"links":{"cited_paper":"/paper/2503.09516","citing_paper":"/paper/2506.08446"},"observation_digest":"sha256:0a81fcc310b68aebe89f5a49662cf013cfc35a2d2510dff4799cb2a566de7670","observation_id":"028dd44c-b983-4b28-8faf-c48757077907","resolution":{"observed_at":"2026-08-07T05:14:46.767411Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1612.03651","last_updated":"2016-12-12T12:51:03Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2016-12-12T12:51:03Z","title":"FastText.zip: Compressing text classification models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1612.03651","snapshot_observed_at":"2026-08-07T05:14:46.871334Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.08446","last_updated":"2025-06-10T04:44:28Z","snapshot_observed_at":"2026-08-07T09:15:20.058485Z","submitted_at":"2025-06-10T04:44:28Z","title":"A Survey on Large Language Models for Mathematical Reasoning","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T05:14:46.871334Z"},"links":{"cited_paper":"/paper/1612.03651","citing_paper":"/paper/2506.08446"},"observation_digest":"sha256:af8f8e9e621b0cd89a35429215c6094fbec45b7eb1b0c3a9dd375b21078019cb","observation_id":"19f48c8d-9eca-4a63-b045-e5846f9847a8","resolution":{"observed_at":"2026-08-07T05:14:46.871334Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:14:47.204369Z","title":"Koncel-Kedziorski, S","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.08446","last_updated":"2025-06-10T04:44:28Z","snapshot_observed_at":"2026-08-07T09:15:20.058485Z","submitted_at":"2025-06-10T04:44:28Z","title":"A Survey on Large Language Models for Mathematical Reasoning","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T05:14:47.204369Z"},"links":{"citing_paper":"/paper/2506.08446"},"observation_digest":"sha256:2dbe853b337b582b580a725f043989f6e517f369558f218a3c89f0fa42635e00","observation_id":"b5831ea4-39e8-4076-8209-7b0759f037f6","resolution":{"observed_at":"2026-08-07T05:14:47.204369Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:14:47.263202Z","title":"Kwiatkowski, E","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2506.08446","last_updated":"2025-06-10T04:44:28Z","snapshot_observed_at":"2026-08-07T09:15:20.058485Z","submitted_at":"2025-06-10T04:44:28Z","title":"A Survey on Large Language Models for Mathematical Reasoning","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T05:14:47.263202Z"},"links":{"citing_paper":"/paper/2506.08446"},"observation_digest":"sha256:b55ae375b125610d4c40ca34d877d9477c8b2797cdf0bdcfcfbe7004c6ebbfd4","observation_id":"e5b75ff6-312d-4c46-bca0-bf7366a1a13e","resolution":{"observed_at":"2026-08-07T05:14:47.263202Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14083","last_updated":"2024-04-26T21:05:19Z","snapshot_observed_at":"2026-08-03T17:46:43.973917Z","submitted_at":"2024-02-21T19:17:28Z","title":"Beyond A*: Better Planning with Transformers via Search Dynamics Bootstrapping","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.14083","snapshot_observed_at":"2026-08-07T05:14:47.310647Z","title":"Lehnert, S","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.08446","last_updated":"2025-06-10T04:44:28Z","snapshot_observed_at":"2026-08-07T09:15:20.058485Z","submitted_at":"2025-06-10T04:44:28Z","title":"A Survey on Large Language Models for Mathematical Reasoning","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T05:14:47.310647Z"},"links":{"cited_paper":"/paper/2402.14083","citing_paper":"/paper/2506.08446"},"observation_digest":"sha256:276ce96a9411e91fc4f1536514105f12009c3439d5cba02f758727af0eaf9f11","observation_id":"57ddbc18-1394-495a-918c-997dabc16c9a","resolution":{"observed_at":"2026-08-07T05:14:47.310647Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.03184","last_updated":"2023-11-11T01:26:22Z","snapshot_observed_at":"2026-08-07T10:12:18.432281Z","submitted_at":"2023-10-04T22:09:28Z","title":"Retrieval-augmented Generation to Improve Math Question-Answering: Trade-offs Between Groundedness and Human Preference","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.03184","snapshot_observed_at":"2026-08-07T05:14:47.315194Z","title":"Levonian, C","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.08446","last_updated":"2025-06-10T04:44:28Z","snapshot_observed_at":"2026-08-07T09:15:20.058485Z","submitted_at":"2025-06-10T04:44:28Z","title":"A Survey on Large Language Models for Mathematical Reasoning","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T05:14:47.315194Z"},"links":{"cited_paper":"/paper/2310.03184","citing_paper":"/paper/2506.08446"},"observation_digest":"sha256:e53bbba0a0093ba96d9c6e057ed648995a5c612fa68c5d7d34187620f3e129da","observation_id":"6b9f175b-09bf-4290-a1c0-5860167f218d","resolution":{"observed_at":"2026-08-07T05:14:47.315194Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.14858","last_updated":"2022-07-01T02:15:12Z","snapshot_observed_at":"2026-08-05T15:41:22.691461Z","submitted_at":"2022-06-29T18:54:49Z","title":"Solving Quantitative Reasoning Problems with Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.14858","snapshot_observed_at":"2026-08-07T05:14:47.319519Z","title":"Lewkowycz, A","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.08446","last_updated":"2025-06-10T04:44:28Z","snapshot_observed_at":"2026-08-07T09:15:20.058485Z","submitted_at":"2025-06-10T04:44:28Z","title":"A Survey on Large Language Models for Mathematical Reasoning","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T05:14:47.319519Z"},"links":{"cited_paper":"/paper/2206.14858","citing_paper":"/paper/2506.08446"},"observation_digest":"sha256:3dd3bcde6b847938ea554eae22d43bd6c267975c4ad7fff042075cc5f2f0dae0","observation_id":"d380343b-e0fa-4e43-85c3-f8f5eb1ed691","resolution":{"observed_at":"2026-08-07T05:14:47.319519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04706","last_updated":"2024-03-07T18:00:40Z","snapshot_observed_at":"2026-08-07T09:14:55.529271Z","submitted_at":"2024-03-07T18:00:40Z","title":"Common 7B Language Models Already Possess Strong Math Capabilities","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04706","snapshot_observed_at":"2026-08-07T05:14:47.323830Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.08446","last_updated":"2025-06-10T04:44:28Z","snapshot_observed_at":"2026-08-07T09:15:20.058485Z","submitted_at":"2025-06-10T04:44:28Z","title":"A Survey on Large Language Models for Mathematical Reasoning","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T05:14:47.323830Z"},"links":{"cited_paper":"/paper/2403.04706","citing_paper":"/paper/2506.08446"},"observation_digest":"sha256:cebec2ff4fd75ddc85d736d3fc201855ff5accadf91243988629b0a8398fcf53","observation_id":"6dee0255-b8b4-4be3-b2bc-7589364559df","resolution":{"observed_at":"2026-08-07T05:14:47.323830Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.23383","last_updated":"2025-03-30T10:16:25Z","snapshot_observed_at":"2026-08-07T20:40:27.882593Z","submitted_at":"2025-03-30T10:16:25Z","title":"ToRL: Scaling Tool-Integrated RL","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.23383","snapshot_observed_at":"2026-08-07T05:14:47.327873Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.08446","last_updated":"2025-06-10T04:44:28Z","snapshot_observed_at":"2026-08-07T09:15:20.058485Z","submitted_at":"2025-06-10T04:44:28Z","title":"A Survey on Large Language Models for Mathematical Reasoning","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T05:14:47.327873Z"},"links":{"cited_paper":"/paper/2503.23383","citing_paper":"/paper/2506.08446"},"observation_digest":"sha256:522a48e938d75d9c908adb7f4dc0efc7664f3959e7545af07f9e62bcad644850","observation_id":"aca1611a-9a7e-42cc-aac2-3e1b73269c53","resolution":{"observed_at":"2026-08-07T05:14:47.327873Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.17419","last_updated":"2025-06-25T02:24:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-24T18:50:52Z","title":"From System 1 to System 2: A Survey of Reasoning Large Language Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.17419","snapshot_observed_at":"2026-08-07T05:14:47.332496Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.08446","last_updated":"2025-06-10T04:44:28Z","snapshot_observed_at":"2026-08-07T09:15:20.058485Z","submitted_at":"2025-06-10T04:44:28Z","title":"A Survey on Large Language Models for Mathematical Reasoning","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T05:14:47.332496Z"},"links":{"cited_paper":"/paper/2502.17419","citing_paper":"/paper/2506.08446"},"observation_digest":"sha256:47ed4461fe7f45da373cef19c14647c8e860ae62bd8c2f3cd049001ec2182c6e","observation_id":"a63cf0ac-1907-4a3d-8d7d-f087791850cb","resolution":{"observed_at":"2026-08-07T05:14:47.332496Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:14:47.337519Z","title":"Liang, W","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.08446","last_updated":"2025-06-10T04:44:28Z","snapshot_observed_at":"2026-08-07T09:15:20.058485Z","submitted_at":"2025-06-10T04:44:28Z","title":"A Survey on Large Language Models for Mathematical Reasoning","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T05:14:47.337519Z"},"links":{"citing_paper":"/paper/2506.08446"},"observation_digest":"sha256:4af6c2596796a6bcded13c38016c07c4f4029aba5b6862340874ccb2208c1b8b","observation_id":"09e79395-936d-46a7-98ee-7cec07e863ac","resolution":{"observed_at":"2026-08-07T05:14:47.337519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.20050","last_updated":"2023-05-31T17:24:00Z","snapshot_observed_at":"2026-08-05T13:11:04.104454Z","submitted_at":"2023-05-31T17:24:00Z","title":"Let's Verify Step by Step","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.20050","snapshot_observed_at":"2026-08-07T05:14:47.342402Z","title":"Lightman, V","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.08446","last_updated":"2025-06-10T04:44:28Z","snapshot_observed_at":"2026-08-07T09:15:20.058485Z","submitted_at":"2025-06-10T04:44:28Z","title":"A Survey on Large Language Models for Mathematical Reasoning","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T05:14:47.342402Z"},"links":{"cited_paper":"/paper/2305.20050","citing_paper":"/paper/2506.08446"},"observation_digest":"sha256:760f254cc4d162abeaa78e0ba4abf9f29ca221a14f47706687eee735de008c67","observation_id":"1df2c8fb-993f-448a-9222-7358b3fea192","resolution":{"observed_at":"2026-08-07T05:14:47.342402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.03650","last_updated":"2024-10-03T17:13:04Z","snapshot_observed_at":"2026-08-03T13:15:41.992380Z","submitted_at":"2024-09-05T16:08:19Z","title":"On the Limited Generalization Capability of the Implicit Reward Model Induced by Direct Preference Optimization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.03650","snapshot_observed_at":"2026-08-07T05:14:47.346879Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.08446","last_updated":"2025-06-10T04:44:28Z","snapshot_observed_at":"2026-08-07T09:15:20.058485Z","submitted_at":"2025-06-10T04:44:28Z","title":"A Survey on Large Language Models for Mathematical Reasoning","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T05:14:47.346879Z"},"links":{"cited_paper":"/paper/2409.03650","citing_paper":"/paper/2506.08446"},"observation_digest":"sha256:3ea88e7deecb2b1a2e2de55bac7b2fc431732762bfb9bbe5deedc47df56b09dd","observation_id":"90df85d0-0cb4-48ec-a842-12ca096028a7","resolution":{"observed_at":"2026-08-07T05:14:47.346879Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.07965","last_updated":"2025-01-08T09:07:54Z","snapshot_observed_at":"2026-08-07T08:00:00.868748Z","submitted_at":"2024-04-11T17:52:01Z","title":"Rho-1: Not All Tokens Are What You Need","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.07965","snapshot_observed_at":"2026-08-07T05:14:47.351148Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.08446","last_updated":"2025-06-10T04:44:28Z","snapshot_observed_at":"2026-08-07T09:15:20.058485Z","submitted_at":"2025-06-10T04:44:28Z","title":"A Survey on Large Language Models for Mathematical Reasoning","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T05:14:47.351148Z"},"links":{"cited_paper":"/paper/2404.07965","citing_paper":"/paper/2506.08446"},"observation_digest":"sha256:78d3c53c0b01c4b9780a8f642d8c0da7c645529df6806308e8750deb8ec64687","observation_id":"403d8a32-ff29-4590-a22e-5aee1a14e224","resolution":{"observed_at":"2026-08-07T05:14:47.351148Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.09241","last_updated":"2023-12-14T18:58:28Z","snapshot_observed_at":"2026-07-06T17:02:05.607732Z","submitted_at":"2023-12-14T18:58:28Z","title":"TinyGSM: achieving >80% on GSM8k with small language models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.09241","snapshot_observed_at":"2026-08-07T05:14:47.355966Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.08446","last_updated":"2025-06-10T04:44:28Z","snapshot_observed_at":"2026-08-07T09:15:20.058485Z","submitted_at":"2025-06-10T04:44:28Z","title":"A Survey on Large Language Models for Mathematical Reasoning","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T05:14:47.355966Z"},"links":{"cited_paper":"/paper/2312.09241","citing_paper":"/paper/2506.08446"},"observation_digest":"sha256:a4bb7e994d79f7f6f13d906f0da0408d34cd4b142d8c5e8ba9b0b2b8d047f3ab","observation_id":"cd0b74e3-e7f8-4123-afa6-7e9b08e39471","resolution":{"observed_at":"2026-08-07T05:14:47.355966Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.09003","last_updated":"2024-12-16T06:13:03Z","snapshot_observed_at":"2026-07-06T17:16:38.221230Z","submitted_at":"2024-01-17T06:48:16Z","title":"Augmenting Math Word Problems via Iterative Question Composing","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.09003","snapshot_observed_at":"2026-08-07T05:14:47.360143Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.08446","last_updated":"2025-06-10T04:44:28Z","snapshot_observed_at":"2026-08-07T09:15:20.058485Z","submitted_at":"2025-06-10T04:44:28Z","title":"A Survey on Large Language Models for Mathematical Reasoning","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T05:14:47.360143Z"},"links":{"cited_paper":"/paper/2401.09003","citing_paper":"/paper/2506.08446"},"observation_digest":"sha256:ff39f978d1408eed8b05bfb123f9c1d1a5aa9761168ba0c6f2c533c02c30c7f7","observation_id":"4cbe8432-6f43-47d5-974b-ba53821b4941","resolution":{"observed_at":"2026-08-07T05:14:47.360143Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06592","last_updated":"2024-12-11T22:59:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-05T19:25:40Z","title":"Improve Mathematical Reasoning in Language Models by Automated Process Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.06592","snapshot_observed_at":"2026-08-07T05:14:47.364517Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.08446","last_updated":"2025-06-10T04:44:28Z","snapshot_observed_at":"2026-08-07T09:15:20.058485Z","submitted_at":"2025-06-10T04:44:28Z","title":"A Survey on Large Language Models for Mathematical Reasoning","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T05:14:47.364517Z"},"links":{"cited_paper":"/paper/2406.06592","citing_paper":"/paper/2506.08446"},"observation_digest":"sha256:fe468e0f4c96ef97cbd580fdcaf35c342d0c2b0e2396817f42aa470b8af69cfd","observation_id":"34a0950d-c0c3-4a42-be75-21193a08aebf","resolution":{"observed_at":"2026-08-07T05:14:47.364517Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.15231","last_updated":"2024-04-08T11:09:35Z","snapshot_observed_at":"2026-07-06T13:15:32.315247Z","submitted_at":"2022-05-30T16:41:58Z","title":"A Survey in Mathematical Language Processing","version":2},"cited_work":{"arxiv_id":"2205.15231","doi":null,"metadata_source":"pith","pith_arxiv_id":"2205.15231","snapshot_observed_at":"2026-08-07T05:14:48.805670Z","title":"A Survey in Mathematical Language Processing","venue":"cs.CL","work_id":"d4ed7121-5e23-4c34-8cb3-9dd7f4c81667","year":2022},"citing_paper":{"arxiv_id":"2506.08446","last_updated":"2025-06-10T04:44:28Z","snapshot_observed_at":"2026-08-07T09:15:20.058485Z","submitted_at":"2025-06-10T04:44:28Z","title":"A Survey on Large Language Models for Mathematical Reasoning","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T05:14:47.368782Z"},"links":{"cited_paper":"/paper/2205.15231","citing_paper":"/paper/2506.08446"},"observation_digest":"sha256:57fa13b237f5427fbb613de9cfac146c60e06774a5977512e1321f361f99d064","observation_id":"51d62f74-a62d-42eb-aa32-a95cc4babe5a","resolution":{"observed_at":"2026-08-07T05:14:48.810229Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14734","last_updated":"2024-11-01T20:05:19Z","snapshot_observed_at":"2026-08-03T02:02:15.325394Z","submitted_at":"2024-05-23T16:01:46Z","title":"SimPO: Simple Preference Optimization with a Reference-Free Reward","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14734","snapshot_observed_at":"2026-08-07T05:14:47.373279Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.08446","last_updated":"2025-06-10T04:44:28Z","snapshot_observed_at":"2026-08-07T09:15:20.058485Z","submitted_at":"2025-06-10T04:44:28Z","title":"A Survey on Large Language Models for Mathematical Reasoning","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T05:14:47.373279Z"},"links":{"cited_paper":"/paper/2405.14734","citing_paper":"/paper/2506.08446"},"observation_digest":"sha256:8b8528fff16172fa2c4ce1383b59116f699eeebca7d54731d6ec9b3ba53a31da","observation_id":"17e0d335-3124-4d7f-94a1-32fe35b845e5","resolution":{"observed_at":"2026-08-07T05:14:47.373279Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.11147","last_updated":"2022-03-21T17:26:29Z","snapshot_observed_at":"2026-08-01T19:23:25.711617Z","submitted_at":"2022-03-21T17:26:29Z","title":"Teaching language models to support answers with verified quotes","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.11147","snapshot_observed_at":"2026-08-07T05:14:47.377791Z","title":"Menick, M","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.08446","last_updated":"2025-06-10T04:44:28Z","snapshot_observed_at":"2026-08-07T09:15:20.058485Z","submitted_at":"2025-06-10T04:44:28Z","title":"A Survey on Large Language Models for Mathematical Reasoning","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T05:14:47.377791Z"},"links":{"cited_paper":"/paper/2203.11147","citing_paper":"/paper/2506.08446"},"observation_digest":"sha256:7a4657ec6122c13beff079cc6c17599b4a01708e44f75d8936a4010b21ef4a7f","observation_id":"eaca2e78-73e7-4e72-941b-d16778da5f75","resolution":{"observed_at":"2026-08-07T05:14:47.377791Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.15772","last_updated":"2021-06-30T01:54:11Z","snapshot_observed_at":"2026-08-08T10:47:41.639824Z","submitted_at":"2021-06-30T01:54:11Z","title":"A Diverse Corpus for Evaluating and Developing English Math Word Problem Solvers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.15772","snapshot_observed_at":"2026-08-07T05:14:47.382134Z","title":"Miao, C.-C","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.08446","last_updated":"2025-06-10T04:44:28Z","snapshot_observed_at":"2026-08-07T09:15:20.058485Z","submitted_at":"2025-06-10T04:44:28Z","title":"A Survey on Large Language Models for Mathematical Reasoning","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T05:14:47.382134Z"},"links":{"cited_paper":"/paper/2106.15772","citing_paper":"/paper/2506.08446"},"observation_digest":"sha256:22e6b541e4363250b557a28ce3036f7e562b79cf8decb9016ca2597fd246cec1","observation_id":"74f17dfe-d8b2-4955-9c65-d04da26f80e8","resolution":{"observed_at":"2026-08-07T05:14:47.382134Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.05229","last_updated":"2025-08-27T16:24:39Z","snapshot_observed_at":"2026-07-06T19:29:09.714725Z","submitted_at":"2024-10-07T17:36:37Z","title":"GSM-Symbolic: Understanding the Limitations of Mathematical Reasoning in Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.05229","snapshot_observed_at":"2026-08-07T05:14:47.386262Z","title":"Mirzadeh, K","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.08446","last_updated":"2025-06-10T04:44:28Z","snapshot_observed_at":"2026-08-07T09:15:20.058485Z","submitted_at":"2025-06-10T04:44:28Z","title":"A Survey on Large Language Models for Mathematical Reasoning","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-07T05:14:47.386262Z"},"links":{"cited_paper":"/paper/2410.05229","citing_paper":"/paper/2506.08446"},"observation_digest":"sha256:b0556e3a4638b9c39e06b43202a7a1423dd79a44fb3b3c47a16225add21f11f7","observation_id":"5e987609-d3ad-4f91-abe1-e7e989bd362e","resolution":{"observed_at":"2026-08-07T05:14:47.386262Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:14:47.390452Z","title":"Mishra, M","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.08446","last_updated":"2025-06-10T04:44:28Z","snapshot_observed_at":"2026-08-07T09:15:20.058485Z","submitted_at":"2025-06-10T04:44:28Z","title":"A Survey on Large Language Models for Mathematical Reasoning","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-07T05:14:47.390452Z"},"links":{"citing_paper":"/paper/2506.08446"},"observation_digest":"sha256:2935f5f71132526bc59b52f01019afa467e6f8cffe7e19d7f6e6cde0313c8842","observation_id":"020d6ff9-4b00-424b-b5e8-73c30d22a992","resolution":{"observed_at":"2026-08-07T05:14:47.390452Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.19393","last_updated":"2025-03-01T06:07:39Z","snapshot_observed_at":"2026-07-06T20:29:11.710285Z","submitted_at":"2025-01-31T18:48:08Z","title":"s1: Simple test-time scaling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.19393","snapshot_observed_at":"2026-08-07T05:14:47.394917Z","title":"Muennighoff, Z","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.08446","last_updated":"2025-06-10T04:44:28Z","snapshot_observed_at":"2026-08-07T09:15:20.058485Z","submitted_at":"2025-06-10T04:44:28Z","title":"A Survey on Large Language Models for Mathematical Reasoning","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-07T05:14:47.394917Z"},"links":{"cited_paper":"/paper/2501.19393","citing_paper":"/paper/2506.08446"},"observation_digest":"sha256:b9cbd3991df051810174ef312a7e06eb2658f616b67cfd2eb580b6bb519ece74","observation_id":"0ae512b6-e427-4fd1-a33d-869871d40704","resolution":{"observed_at":"2026-08-07T05:14:47.394917Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.07191","last_updated":"2021-04-15T06:11:12Z","snapshot_observed_at":"2026-08-07T13:11:17.300265Z","submitted_at":"2021-03-12T10:23:47Z","title":"Are NLP Models really able to Solve Simple Math Word Problems?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.07191","snapshot_observed_at":"2026-08-07T05:14:47.399427Z","title":"Patel, S","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.08446","last_updated":"2025-06-10T04:44:28Z","snapshot_observed_at":"2026-08-07T09:15:20.058485Z","submitted_at":"2025-06-10T04:44:28Z","title":"A Survey on Large Language Models for Mathematical Reasoning","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-07T05:14:47.399427Z"},"links":{"cited_paper":"/paper/2103.07191","citing_paper":"/paper/2506.08446"},"observation_digest":"sha256:59043402116b91b680bb31141a478d4f2e2eb7f45f5c11428171a0395f531916","observation_id":"0879db80-99b2-4043-a290-81b8f3154c19","resolution":{"observed_at":"2026-08-07T05:14:47.399427Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02108","last_updated":"2025-04-16T17:50:12Z","snapshot_observed_at":"2026-08-05T19:16:49.204753Z","submitted_at":"2024-10-03T00:09:15Z","title":"ReGenesis: LLMs can Grow into Reasoning Generalists via Self-Improvement","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.02108","snapshot_observed_at":"2026-08-07T05:14:47.403953Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.08446","last_updated":"2025-06-10T04:44:28Z","snapshot_observed_at":"2026-08-07T09:15:20.058485Z","submitted_at":"2025-06-10T04:44:28Z","title":"A Survey on Large Language Models for Mathematical Reasoning","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-07T05:14:47.403953Z"},"links":{"cited_paper":"/paper/2410.02108","citing_paper":"/paper/2506.08446"},"observation_digest":"sha256:65a3a3345cafbfa47e55484afbf63c780ea4d5f59804bd5b56b5c49871623497","observation_id":"37a248a9-d6a0-4500-a2e7-2bb4d3e7da51","resolution":{"observed_at":"2026-08-07T05:14:47.403953Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:14:47.408849Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.08446","last_updated":"2025-06-10T04:44:28Z","snapshot_observed_at":"2026-08-07T09:15:20.058485Z","submitted_at":"2025-06-10T04:44:28Z","title":"A Survey on Large Language Models for Mathematical Reasoning","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-07T05:14:47.408849Z"},"links":{"citing_paper":"/paper/2506.08446"},"observation_digest":"sha256:92f001d36d8a54c2258b63f9c1711a28cd7fd256de6510f615a51755f2f373b0","observation_id":"abc2e1c9-5ec0-4dc3-8259-8f4ce574e109","resolution":{"observed_at":"2026-08-07T05:14:47.408849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-07T05:14:47.412936Z","title":"Schulman, F","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.08446","last_updated":"2025-06-10T04:44:28Z","snapshot_observed_at":"2026-08-07T09:15:20.058485Z","submitted_at":"2025-06-10T04:44:28Z","title":"A Survey on Large Language Models for Mathematical Reasoning","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-07T05:14:47.412936Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2506.08446"},"observation_digest":"sha256:430fcd883586a2b1405e438b9768b6a6a0555c25262c639ee58ae8afca459ca7","observation_id":"c41213d8-5b64-47db-a922-48ff14c5eb63","resolution":{"observed_at":"2026-08-07T05:14:47.412936Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.08146","last_updated":"2024-10-10T17:31:23Z","snapshot_observed_at":"2026-08-02T06:08:09.777151Z","submitted_at":"2024-10-10T17:31:23Z","title":"Rewarding Progress: Scaling Automated Process Verifiers for LLM Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.08146","snapshot_observed_at":"2026-08-07T05:14:47.417243Z","title":"Setlur, C","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.08446","last_updated":"2025-06-10T04:44:28Z","snapshot_observed_at":"2026-08-07T09:15:20.058485Z","submitted_at":"2025-06-10T04:44:28Z","title":"A Survey on Large Language Models for Mathematical Reasoning","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-07T05:14:47.417243Z"},"links":{"cited_paper":"/paper/2410.08146","citing_paper":"/paper/2506.08446"},"observation_digest":"sha256:1303378b30b360bd8672d73f8b7e47a21b7a4eafb0e4ee6529f5809d566623f1","observation_id":"2d292879-49e9-42b3-944b-7c8604848b27","resolution":{"observed_at":"2026-08-07T05:14:47.417243Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-07T05:14:47.421531Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.08446","last_updated":"2025-06-10T04:44:28Z","snapshot_observed_at":"2026-08-07T09:15:20.058485Z","submitted_at":"2025-06-10T04:44:28Z","title":"A Survey on Large Language Models for Mathematical Reasoning","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-07T05:14:47.421531Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2506.08446"},"observation_digest":"sha256:0e250347728ad9fe924aa5634a3676573328ab63d8beea8964b71f993ad1866d","observation_id":"362fc352-03c7-401b-9fc7-b3ea6258bbc9","resolution":{"observed_at":"2026-08-07T05:14:47.421531Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.02508","last_updated":"2025-06-16T03:29:47Z","snapshot_observed_at":"2026-08-05T03:22:49.530240Z","submitted_at":"2025-02-04T17:26:58Z","title":"Satori: Reinforcement Learning with Chain-of-Action-Thought Enhances LLM Reasoning via Autoregressive Search","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.02508","snapshot_observed_at":"2026-08-07T05:14:47.425928Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.08446","last_updated":"2025-06-10T04:44:28Z","snapshot_observed_at":"2026-08-07T09:15:20.058485Z","submitted_at":"2025-06-10T04:44:28Z","title":"A Survey on Large Language Models for Mathematical Reasoning","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-07T05:14:47.425928Z"},"links":{"cited_paper":"/paper/2502.02508","citing_paper":"/paper/2506.08446"},"observation_digest":"sha256:0af4dbe4a98b32a26253ec6124bd33ad99457ea76b2fc38ed0a73c82e2a447fe","observation_id":"9fce8929-7c3b-4dd7-9c7f-21a23129442c","resolution":{"observed_at":"2026-08-07T05:14:47.425928Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.18807","last_updated":"2024-09-24T14:08:11Z","snapshot_observed_at":"2026-07-06T19:23:29.050430Z","submitted_at":"2024-09-24T14:08:11Z","title":"LLM With Tools: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.18807","snapshot_observed_at":"2026-08-07T05:14:47.430521Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.08446","last_updated":"2025-06-10T04:44:28Z","snapshot_observed_at":"2026-08-07T09:15:20.058485Z","submitted_at":"2025-06-10T04:44:28Z","title":"A Survey on Large Language Models for Mathematical Reasoning","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-07T05:14:47.430521Z"},"links":{"cited_paper":"/paper/2409.18807","citing_paper":"/paper/2506.08446"},"observation_digest":"sha256:6585fe8723527f24197774ecd1a3cf237b16ef4b2d00ba43bdf6803b775f9a35","observation_id":"b90f843b-3951-4437-95a1-e045abff2fbc","resolution":{"observed_at":"2026-08-07T05:14:47.430521Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.03057","last_updated":"2022-10-06T17:03:34Z","snapshot_observed_at":"2026-07-06T14:00:37.875054Z","submitted_at":"2022-10-06T17:03:34Z","title":"Language Models are Multilingual Chain-of-Thought Reasoners","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.03057","snapshot_observed_at":"2026-08-07T05:14:47.435165Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.08446","last_updated":"2025-06-10T04:44:28Z","snapshot_observed_at":"2026-08-07T09:15:20.058485Z","submitted_at":"2025-06-10T04:44:28Z","title":"A Survey on Large Language Models for Mathematical Reasoning","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-07T05:14:47.435165Z"},"links":{"cited_paper":"/paper/2210.03057","citing_paper":"/paper/2506.08446"},"observation_digest":"sha256:396b6de2ef55184175bef8ad13f78dcbd0a6a4f0b32933a9aaae6298d3f68d20","observation_id":"979d1d98-7b39-45f1-8d6f-5f93bc93edda","resolution":{"observed_at":"2026-08-07T05:14:47.435165Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12183","last_updated":"2025-05-07T18:00:45Z","snapshot_observed_at":"2026-08-01T16:38:42.947080Z","submitted_at":"2024-09-18T17:55:00Z","title":"To CoT or not to CoT? Chain-of-thought helps mainly on math and symbolic reasoning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12183","snapshot_observed_at":"2026-08-07T05:14:47.445151Z","title":"Sprague, F","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.08446","last_updated":"2025-06-10T04:44:28Z","snapshot_observed_at":"2026-08-07T09:15:20.058485Z","submitted_at":"2025-06-10T04:44:28Z","title":"A Survey on Large Language Models for Mathematical Reasoning","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-07T05:14:47.445151Z"},"links":{"cited_paper":"/paper/2409.12183","citing_paper":"/paper/2506.08446"},"observation_digest":"sha256:733a0b8c699c37d4d054a9ca6f06f538e88b36a7237b9968ef6bb879c8e73d28","observation_id":"59e55a45-8989-4177-bb30-51b3d0214426","resolution":{"observed_at":"2026-08-07T05:14:47.445151Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.01325","last_updated":"2022-02-15T19:09:36Z","snapshot_observed_at":"2026-08-06T19:18:51.065158Z","submitted_at":"2020-09-02T19:54:41Z","title":"Learning to summarize from human feedback","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.01325","snapshot_observed_at":"2026-08-07T05:14:47.449825Z","title":"Stiennon, L","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2506.08446","last_updated":"2025-06-10T04:44:28Z","snapshot_observed_at":"2026-08-07T09:15:20.058485Z","submitted_at":"2025-06-10T04:44:28Z","title":"A Survey on Large Language Models for Mathematical Reasoning","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-07T05:14:47.449825Z"},"links":{"cited_paper":"/paper/2009.01325","citing_paper":"/paper/2506.08446"},"observation_digest":"sha256:084b1d060f876437771c734324e412fd4b30fc06a68b75512acf27c2568d1abf","observation_id":"d8ca55c6-c610-4492-a39b-43abdc6ec8b6","resolution":{"observed_at":"2026-08-07T05:14:47.449825Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.05301","last_updated":"2023-09-07T12:20:45Z","snapshot_observed_at":"2026-07-06T15:40:20.267344Z","submitted_at":"2023-06-08T15:46:32Z","title":"ToolAlpaca: Generalized Tool Learning for Language Models with 3000 Simulated Cases","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.05301","snapshot_observed_at":"2026-08-07T05:14:47.460598Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.08446","last_updated":"2025-06-10T04:44:28Z","snapshot_observed_at":"2026-08-07T09:15:20.058485Z","submitted_at":"2025-06-10T04:44:28Z","title":"A Survey on Large Language Models for Mathematical Reasoning","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-07T05:14:47.460598Z"},"links":{"cited_paper":"/paper/2306.05301","citing_paper":"/paper/2506.08446"},"observation_digest":"sha256:019342377adf0b8c05a093a1d67ef0e9538540bfb04f4f21d16c94acc7d04d1c","observation_id":"fcbb9b44-03ee-4613-afc5-70ca7e2c66c1","resolution":{"observed_at":"2026-08-07T05:14:47.460598Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12599","last_updated":"2025-06-03T02:14:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T02:48:14Z","title":"Kimi k1.5: Scaling Reinforcement Learning with LLMs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12599","snapshot_observed_at":"2026-08-07T05:14:47.465567Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.08446","last_updated":"2025-06-10T04:44:28Z","snapshot_observed_at":"2026-08-07T09:15:20.058485Z","submitted_at":"2025-06-10T04:44:28Z","title":"A Survey on Large Language Models for Mathematical Reasoning","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-07T05:14:47.465567Z"},"links":{"cited_paper":"/paper/2501.12599","citing_paper":"/paper/2506.08446"},"observation_digest":"sha256:1191bbec41c28b8a6d5d5ea9d738a21598cc426068cceef2bb674eb0485de212","observation_id":"6112e44e-c844-4656-900a-780d7406dd0b","resolution":{"observed_at":"2026-08-07T05:14:47.465567Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.01560","last_updated":"2024-10-05T03:54:22Z","snapshot_observed_at":"2026-07-06T19:26:02.193680Z","submitted_at":"2024-10-02T14:00:09Z","title":"OpenMathInstruct-2: Accelerating AI for Math with Massive Open-Source Instruction Data","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.01560","snapshot_observed_at":"2026-08-07T05:14:47.470616Z","title":"Toshniwal, W","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.08446","last_updated":"2025-06-10T04:44:28Z","snapshot_observed_at":"2026-08-07T09:15:20.058485Z","submitted_at":"2025-06-10T04:44:28Z","title":"A Survey on Large Language Models for Mathematical Reasoning","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-07T05:14:47.470616Z"},"links":{"cited_paper":"/paper/2410.01560","citing_paper":"/paper/2506.08446"},"observation_digest":"sha256:e6e3c402801e7599c6bebb96bc081c1a80da2658bc84417949d3ed0d468243bd","observation_id":"39fed019-8d97-404a-8f67-9f4e88353b29","resolution":{"observed_at":"2026-08-07T05:14:47.470616Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.03733","last_updated":"2024-10-18T23:53:07Z","snapshot_observed_at":"2026-07-06T19:11:09.921186Z","submitted_at":"2024-09-05T17:44:49Z","title":"Planning In Natural Language Improves LLM Search For Code Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.03733","snapshot_observed_at":"2026-08-07T05:14:47.479998Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.08446","last_updated":"2025-06-10T04:44:28Z","snapshot_observed_at":"2026-08-07T09:15:20.058485Z","submitted_at":"2025-06-10T04:44:28Z","title":"A Survey on Large Language Models for Mathematical Reasoning","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-07T05:14:47.479998Z"},"links":{"cited_paper":"/paper/2409.03733","citing_paper":"/paper/2506.08446"},"observation_digest":"sha256:757b851f7398292c1495125fb04de8f1f59f2cb0c2d8a9553d885c9db377da5e","observation_id":"ecab038f-f639-4b9f-8f6b-0ff5f54fa06d","resolution":{"observed_at":"2026-08-07T05:14:47.479998Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.10200","last_updated":"2024-05-23T20:53:59Z","snapshot_observed_at":"2026-07-06T17:30:47.845775Z","submitted_at":"2024-02-15T18:55:41Z","title":"Chain-of-Thought Reasoning Without Prompting","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.10200","snapshot_observed_at":"2026-08-07T05:14:47.484973Z","title":"Wang and D","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.08446","last_updated":"2025-06-10T04:44:28Z","snapshot_observed_at":"2026-08-07T09:15:20.058485Z","submitted_at":"2025-06-10T04:44:28Z","title":"A Survey on Large Language Models for Mathematical Reasoning","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-07T05:14:47.484973Z"},"links":{"cited_paper":"/paper/2402.10200","citing_paper":"/paper/2506.08446"},"observation_digest":"sha256:4510f5f85a621bac64962f17a5a3a6b7414bad19f78d2c34826c149de4d59771","observation_id":"54fb2e41-39d7-4389-8afe-9e00bba53076","resolution":{"observed_at":"2026-08-07T05:14:47.484973Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:14:47.489293Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.08446","last_updated":"2025-06-10T04:44:28Z","snapshot_observed_at":"2026-08-07T09:15:20.058485Z","submitted_at":"2025-06-10T04:44:28Z","title":"A Survey on Large Language Models for Mathematical Reasoning","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-07T05:14:47.489293Z"},"links":{"citing_paper":"/paper/2506.08446"},"observation_digest":"sha256:236f46fe7c5c6ff282bbbd2b74065dc25aaa554aca4df73a005e6930a790bc78","observation_id":"436646e0-5c66-404e-8563-54bd7f7feea6","resolution":{"observed_at":"2026-08-07T05:14:47.489293Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.18585","last_updated":"2025-02-18T16:51:53Z","snapshot_observed_at":"2026-08-08T15:09:27.177867Z","submitted_at":"2025-01-30T18:58:18Z","title":"Thoughts Are All Over the Place: On the Underthinking of o1-Like LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.18585","snapshot_observed_at":"2026-08-07T05:14:47.493623Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.08446","last_updated":"2025-06-10T04:44:28Z","snapshot_observed_at":"2026-08-07T09:15:20.058485Z","submitted_at":"2025-06-10T04:44:28Z","title":"A Survey on Large Language Models for Mathematical Reasoning","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-07T05:14:47.493623Z"},"links":{"cited_paper":"/paper/2501.18585","citing_paper":"/paper/2506.08446"},"observation_digest":"sha256:37a6509f994c14c37b1395608301dad88078842bec85dd3a8264c7c2105cae05","observation_id":"5071db1e-a347-4308-b909-6cc07d7a0e06","resolution":{"observed_at":"2026-08-07T05:14:47.493623Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.13339","last_updated":"2023-07-25T08:51:30Z","snapshot_observed_at":"2026-08-04T05:41:19.823896Z","submitted_at":"2023-07-25T08:51:30Z","title":"Analyzing Chain-of-Thought Prompting in Large Language Models via Gradient-based Feature Attributions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.13339","snapshot_observed_at":"2026-08-07T05:14:47.502844Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.08446","last_updated":"2025-06-10T04:44:28Z","snapshot_observed_at":"2026-08-07T09:15:20.058485Z","submitted_at":"2025-06-10T04:44:28Z","title":"A Survey on Large Language Models for Mathematical Reasoning","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-07T05:14:47.502844Z"},"links":{"cited_paper":"/paper/2307.13339","citing_paper":"/paper/2506.08446"},"observation_digest":"sha256:97b62b051c577a79c103b544fd12698da0719110eb8d94144e8397ba22240ea1","observation_id":"fc9bcd51-9b6a-45ef-9940-0bba359c9a5f","resolution":{"observed_at":"2026-08-07T05:14:47.502844Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.10719","last_updated":"2024-10-10T08:30:17Z","snapshot_observed_at":"2026-07-06T18:01:05.698046Z","submitted_at":"2024-04-16T16:51:53Z","title":"Is DPO Superior to PPO for LLM Alignment? A Comprehensive Study","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.10719","snapshot_observed_at":"2026-08-07T05:14:47.507268Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.08446","last_updated":"2025-06-10T04:44:28Z","snapshot_observed_at":"2026-08-07T09:15:20.058485Z","submitted_at":"2025-06-10T04:44:28Z","title":"A Survey on Large Language Models for Mathematical Reasoning","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-07T05:14:47.507268Z"},"links":{"cited_paper":"/paper/2404.10719","citing_paper":"/paper/2506.08446"},"observation_digest":"sha256:ebc0f0d12a001fb54e093e47b54946ac48a38a11961e7d5e9dc1eaab10916f2b","observation_id":"a9939626-aa35-4f40-89cd-667aa4f3b015","resolution":{"observed_at":"2026-08-07T05:14:47.507268Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.11936","last_updated":"2025-05-20T14:45:21Z","snapshot_observed_at":"2026-07-06T20:07:50.399527Z","submitted_at":"2024-12-16T16:21:41Z","title":"A Survey of Mathematical Reasoning in the Era of Multimodal Large Language Model: Benchmark, Method & Challenges","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.11936","snapshot_observed_at":"2026-08-07T05:14:47.511366Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.08446","last_updated":"2025-06-10T04:44:28Z","snapshot_observed_at":"2026-08-07T09:15:20.058485Z","submitted_at":"2025-06-10T04:44:28Z","title":"A Survey on Large Language Models for Mathematical Reasoning","version":1},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-07T05:14:47.511366Z"},"links":{"cited_paper":"/paper/2412.11936","citing_paper":"/paper/2506.08446"},"observation_digest":"sha256:fcbf75016a28de81075ba0d01edb19db59302fe44a21c45d3a33c4aee61c01df","observation_id":"96b8d507-a2f3-417b-807c-1d4d8df6c155","resolution":{"observed_at":"2026-08-07T05:14:47.511366Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12122","last_updated":"2024-09-18T16:45:37Z","snapshot_observed_at":"2026-07-06T19:17:41.512834Z","submitted_at":"2024-09-18T16:45:37Z","title":"Qwen2.5-Math Technical Report: Toward Mathematical Expert Model via Self-Improvement","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12122","snapshot_observed_at":"2026-08-07T05:14:47.515590Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.08446","last_updated":"2025-06-10T04:44:28Z","snapshot_observed_at":"2026-08-07T09:15:20.058485Z","submitted_at":"2025-06-10T04:44:28Z","title":"A Survey on Large Language Models for Mathematical Reasoning","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-07T05:14:47.515590Z"},"links":{"cited_paper":"/paper/2409.12122","citing_paper":"/paper/2506.08446"},"observation_digest":"sha256:5652ec69f83db3888647059bc74aaf4f6c8590ab596fb57da03f0bfeb225579a","observation_id":"0cbdd02f-672e-4ace-8d8c-e02727bc721c","resolution":{"observed_at":"2026-08-07T05:14:47.515590Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12424","last_updated":"2024-03-16T21:10:38Z","snapshot_observed_at":"2026-07-06T16:50:26.807430Z","submitted_at":"2023-11-21T08:32:38Z","title":"Looped Transformers are Better at Learning Learning Algorithms","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.12424","snapshot_observed_at":"2026-08-07T05:14:47.520785Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.08446","last_updated":"2025-06-10T04:44:28Z","snapshot_observed_at":"2026-08-07T09:15:20.058485Z","submitted_at":"2025-06-10T04:44:28Z","title":"A Survey on Large Language Models for Mathematical Reasoning","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-07T05:14:47.520785Z"},"links":{"cited_paper":"/paper/2311.12424","citing_paper":"/paper/2506.08446"},"observation_digest":"sha256:13eb5b73623c9515c1be4ca4ae246784b22f0ce5b3b3f08aa7d89ca6e56d73e8","observation_id":"ac5546ec-9df7-4b56-ab61-5bdf12648fba","resolution":{"observed_at":"2026-08-07T05:14:47.520785Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.15797","last_updated":"2025-02-10T05:31:43Z","snapshot_observed_at":"2026-08-05T21:53:24.131309Z","submitted_at":"2025-01-27T05:46:06Z","title":"LemmaHead: RAG Assisted Proof Generation Using Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.15797","snapshot_observed_at":"2026-08-07T05:14:47.525722Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.08446","last_updated":"2025-06-10T04:44:28Z","snapshot_observed_at":"2026-08-07T09:15:20.058485Z","submitted_at":"2025-06-10T04:44:28Z","title":"A Survey on Large Language Models for Mathematical Reasoning","version":1},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-07T05:14:47.525722Z"},"links":{"cited_paper":"/paper/2501.15797","citing_paper":"/paper/2506.08446"},"observation_digest":"sha256:33b094ef9f2119228ba089549c90d312d647a01c83dbc31989755a4ffbaa3fea","observation_id":"94edd8fa-aa7d-4681-978a-f0cf0230288f","resolution":{"observed_at":"2026-08-07T05:14:47.525722Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.16293","last_updated":"2024-08-29T06:49:20Z","snapshot_observed_at":"2026-08-04T04:22:16.650100Z","submitted_at":"2024-08-29T06:49:20Z","title":"Physics of Language Models: Part 2.2, How to Learn From Mistakes on Grade-School Math Problems","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.16293","snapshot_observed_at":"2026-08-07T05:14:47.530143Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.08446","last_updated":"2025-06-10T04:44:28Z","snapshot_observed_at":"2026-08-07T09:15:20.058485Z","submitted_at":"2025-06-10T04:44:28Z","title":"A Survey on Large Language Models for Mathematical Reasoning","version":1},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-07T05:14:47.530143Z"},"links":{"cited_paper":"/paper/2408.16293","citing_paper":"/paper/2506.08446"},"observation_digest":"sha256:c90ea99a3f138886e8c398d743633f56ac55b7c78d467776014a705ca28ae819","observation_id":"3124071d-b431-4a8c-b33f-7df13da07041","resolution":{"observed_at":"2026-08-07T05:14:47.530143Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03387","last_updated":"2025-07-29T16:23:02Z","snapshot_observed_at":"2026-08-08T04:13:22.884923Z","submitted_at":"2025-02-05T17:23:45Z","title":"LIMO: Less is More for Reasoning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.03387","snapshot_observed_at":"2026-08-07T05:14:47.534507Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.08446","last_updated":"2025-06-10T04:44:28Z","snapshot_observed_at":"2026-08-07T09:15:20.058485Z","submitted_at":"2025-06-10T04:44:28Z","title":"A Survey on Large Language Models for Mathematical Reasoning","version":1},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-08-07T05:14:47.534507Z"},"links":{"cited_paper":"/paper/2502.03387","citing_paper":"/paper/2506.08446"},"observation_digest":"sha256:0d7b47bf6eed6488c4a72d81d597798b3159711b4d0c4dbdaefdb6665b9e2c83","observation_id":"d4a2b4e3-7922-49d6-93be-5d8aa849c85d","resolution":{"observed_at":"2026-08-07T05:14:47.534507Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.03847","last_updated":"2025-06-18T16:07:47Z","snapshot_observed_at":"2026-08-07T23:35:20.471377Z","submitted_at":"2024-06-06T08:25:43Z","title":"Lean Workbook: A large-scale Lean problem set formalized from natural language math problems","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.03847","snapshot_observed_at":"2026-08-07T05:14:47.539027Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.08446","last_updated":"2025-06-10T04:44:28Z","snapshot_observed_at":"2026-08-07T09:15:20.058485Z","submitted_at":"2025-06-10T04:44:28Z","title":"A Survey on Large Language Models for Mathematical Reasoning","version":1},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-08-07T05:14:47.539027Z"},"links":{"cited_paper":"/paper/2406.03847","citing_paper":"/paper/2506.08446"},"observation_digest":"sha256:ec81cb664a7e1f55a1c1c19f719b0d9ac57693a0896c59b56d9f95200f6d1d2b","observation_id":"a9a9a4f4-9812-4eb0-9fc6-58f53eb32267","resolution":{"observed_at":"2026-08-07T05:14:47.539027Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14476","last_updated":"2025-05-20T01:37:34Z","snapshot_observed_at":"2026-08-02T01:40:54.187278Z","submitted_at":"2025-03-18T17:49:06Z","title":"DAPO: An Open-Source LLM Reinforcement Learning System at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.14476","snapshot_observed_at":"2026-08-07T05:14:47.543926Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.08446","last_updated":"2025-06-10T04:44:28Z","snapshot_observed_at":"2026-08-07T09:15:20.058485Z","submitted_at":"2025-06-10T04:44:28Z","title":"A Survey on Large Language Models for Mathematical Reasoning","version":1},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-08-07T05:14:47.543926Z"},"links":{"cited_paper":"/paper/2503.14476","citing_paper":"/paper/2506.08446"},"observation_digest":"sha256:c83498e3d02d996c2003248bfdef922e81dd8cc6dbe5f04700dfeb4f85b06329","observation_id":"d56dc75e-cda6-408c-84b6-5867ff745e4d","resolution":{"observed_at":"2026-08-07T05:14:47.543926Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.01981","last_updated":"2024-12-02T21:20:02Z","snapshot_observed_at":"2026-08-06T03:48:05.506841Z","submitted_at":"2024-12-02T21:20:02Z","title":"Free Process Rewards without Process Labels","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.01981","snapshot_observed_at":"2026-08-07T05:14:47.548062Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.08446","last_updated":"2025-06-10T04:44:28Z","snapshot_observed_at":"2026-08-07T09:15:20.058485Z","submitted_at":"2025-06-10T04:44:28Z","title":"A Survey on Large Language Models for Mathematical Reasoning","version":1},"reference_index":101,"source":"pdf_text","source_observed_at":"2026-08-07T05:14:47.548062Z"},"links":{"cited_paper":"/paper/2412.01981","citing_paper":"/paper/2506.08446"},"observation_digest":"sha256:08548155a482814d0be5c285dc6f51def5d0dc4622775164ca1fa0c3b4f2babe","observation_id":"bef27764-4685-468c-b21e-1d1a41041de7","resolution":{"observed_at":"2026-08-07T05:14:47.548062Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.03548","last_updated":"2024-05-23T16:34:35Z","snapshot_observed_at":"2026-08-06T17:52:58.973060Z","submitted_at":"2024-05-06T15:11:38Z","title":"MAmmoTH2: Scaling Instructions from the Web","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.03548","snapshot_observed_at":"2026-08-07T05:14:47.552410Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.08446","last_updated":"2025-06-10T04:44:28Z","snapshot_observed_at":"2026-08-07T09:15:20.058485Z","submitted_at":"2025-06-10T04:44:28Z","title":"A Survey on Large Language Models for Mathematical Reasoning","version":1},"reference_index":102,"source":"pdf_text","source_observed_at":"2026-08-07T05:14:47.552410Z"},"links":{"cited_paper":"/paper/2405.03548","citing_paper":"/paper/2506.08446"},"observation_digest":"sha256:d3242e653b06bb694e07e76ca34280fc31b956ef500c3da2dbf49713fb08fd47","observation_id":"2eca3266-6d6a-4d49-8891-57e20a7381df","resolution":{"observed_at":"2026-08-07T05:14:47.552410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.09629","last_updated":"2024-03-18T07:56:48Z","snapshot_observed_at":"2026-07-31T09:25:34.205362Z","submitted_at":"2024-03-14T17:58:16Z","title":"Quiet-STaR: Language Models Can Teach Themselves to Think Before Speaking","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.09629","snapshot_observed_at":"2026-08-07T05:14:47.557953Z","title":"Zelikman, G","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.08446","last_updated":"2025-06-10T04:44:28Z","snapshot_observed_at":"2026-08-07T09:15:20.058485Z","submitted_at":"2025-06-10T04:44:28Z","title":"A Survey on Large Language Models for Mathematical Reasoning","version":1},"reference_index":103,"source":"pdf_text","source_observed_at":"2026-08-07T05:14:47.557953Z"},"links":{"cited_paper":"/paper/2403.09629","citing_paper":"/paper/2506.08446"},"observation_digest":"sha256:30907f0f3e39a464ebf02c3c42c38185be766bf5ea940eb2ceb4f03f2f5b9c47","observation_id":"5b4ca524-062d-47ab-b6d6-e368299a1c91","resolution":{"observed_at":"2026-08-07T05:14:47.557953Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.18892","last_updated":"2025-08-06T08:42:32Z","snapshot_observed_at":"2026-07-06T20:57:57.039376Z","submitted_at":"2025-03-24T17:06:10Z","title":"SimpleRL-Zoo: Investigating and Taming Zero Reinforcement Learning for Open Base Models in the Wild","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.18892","snapshot_observed_at":"2026-08-07T05:14:47.563365Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.08446","last_updated":"2025-06-10T04:44:28Z","snapshot_observed_at":"2026-08-07T09:15:20.058485Z","submitted_at":"2025-06-10T04:44:28Z","title":"A Survey on Large Language Models for Mathematical Reasoning","version":1},"reference_index":104,"source":"pdf_text","source_observed_at":"2026-08-07T05:14:47.563365Z"},"links":{"cited_paper":"/paper/2503.18892","citing_paper":"/paper/2506.08446"},"observation_digest":"sha256:2473dc699c1e6ed10723c5d5f9ed634b7d7473fa273d1acff5d9b588c73db5f4","observation_id":"23992e21-febb-44fc-9fa7-f6724f8031a0","resolution":{"observed_at":"2026-08-07T05:14:47.563365Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1808.07290","last_updated":"2019-04-29T05:51:46Z","snapshot_observed_at":"2026-07-06T06:56:49.530908Z","submitted_at":"2018-08-22T09:18:38Z","title":"The Gap of Semantic Parsing: A Survey on Automatic Math Word Problem Solvers","version":2},"cited_work":{"arxiv_id":"1808.07290","doi":null,"metadata_source":"pith","pith_arxiv_id":"1808.07290","snapshot_observed_at":"2026-08-07T05:14:47.895751Z","title":"The Gap of Semantic Parsing: A Survey on Automatic Math Word Problem Solvers","venue":"cs.CL","work_id":"7024c635-debc-4489-bb59-a7d6237192a7","year":2018},"citing_paper":{"arxiv_id":"2506.08446","last_updated":"2025-06-10T04:44:28Z","snapshot_observed_at":"2026-08-07T09:15:20.058485Z","submitted_at":"2025-06-10T04:44:28Z","title":"A Survey on Large Language Models for Mathematical Reasoning","version":1},"reference_index":105,"source":"pdf_text","source_observed_at":"2026-08-07T05:14:47.569688Z"},"links":{"cited_paper":"/paper/1808.07290","citing_paper":"/paper/2506.08446"},"observation_digest":"sha256:8b21b57c7a2bc065d095bea7f7c97379cd96a7f7dccfe3ec19b3f533b3583079","observation_id":"f71f70ce-d610-405f-826f-a07976bbf522","resolution":{"observed_at":"2026-08-07T05:14:47.902505Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02884","last_updated":"2024-11-21T07:07:59Z","snapshot_observed_at":"2026-08-07T12:03:21.367108Z","submitted_at":"2024-10-03T18:12:29Z","title":"LLaMA-Berry: Pairwise Optimization for O1-like Olympiad-Level Mathematical Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.02884","snapshot_observed_at":"2026-08-07T05:14:47.574551Z","title":"Zhang, J","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.08446","last_updated":"2025-06-10T04:44:28Z","snapshot_observed_at":"2026-08-07T09:15:20.058485Z","submitted_at":"2025-06-10T04:44:28Z","title":"A Survey on Large Language Models for Mathematical Reasoning","version":1},"reference_index":106,"source":"pdf_text","source_observed_at":"2026-08-07T05:14:47.574551Z"},"links":{"cited_paper":"/paper/2410.02884","citing_paper":"/paper/2506.08446"},"observation_digest":"sha256:30a28a080bc9cd2a9babe04773e38c7c709f037cee1c12f8494b692ce7e022e8","observation_id":"898d3920-df61-443f-a8bb-61b92375818a","resolution":{"observed_at":"2026-08-07T05:14:47.574551Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.15240","last_updated":"2025-02-22T10:21:46Z","snapshot_observed_at":"2026-07-06T19:06:41.697671Z","submitted_at":"2024-08-27T17:57:45Z","title":"Generative Verifiers: Reward Modeling as Next-Token Prediction","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.15240","snapshot_observed_at":"2026-08-07T05:14:47.579805Z","title":"Zhang, A","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.08446","last_updated":"2025-06-10T04:44:28Z","snapshot_observed_at":"2026-08-07T09:15:20.058485Z","submitted_at":"2025-06-10T04:44:28Z","title":"A Survey on Large Language Models for Mathematical Reasoning","version":1},"reference_index":107,"source":"pdf_text","source_observed_at":"2026-08-07T05:14:47.579805Z"},"links":{"cited_paper":"/paper/2408.15240","citing_paper":"/paper/2506.08446"},"observation_digest":"sha256:cb1aae6da6f2bf20ab341e3fa36324f8080245b9e2ee2ea1b7c9d0bd487c730f","observation_id":"ec4e74dc-0903-4efc-9260-4e17c0535f2c","resolution":{"observed_at":"2026-08-07T05:14:47.579805Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07912","last_updated":"2025-08-07T23:50:47Z","snapshot_observed_at":"2026-08-07T16:06:46.405251Z","submitted_at":"2025-04-10T17:15:53Z","title":"Echo Chamber: RL Post-training Amplifies Behaviors Learned in Pretraining","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.07912","snapshot_observed_at":"2026-08-07T05:14:47.584200Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.08446","last_updated":"2025-06-10T04:44:28Z","snapshot_observed_at":"2026-08-07T09:15:20.058485Z","submitted_at":"2025-06-10T04:44:28Z","title":"A Survey on Large Language Models for Mathematical Reasoning","version":1},"reference_index":108,"source":"pdf_text","source_observed_at":"2026-08-07T05:14:47.584200Z"},"links":{"cited_paper":"/paper/2504.07912","citing_paper":"/paper/2506.08446"},"observation_digest":"sha256:13b3d180f9d32053e01a1229f5cd24fca4916892cbd1c415d809f420746778cf","observation_id":"88fa932b-ec92-4839-a37e-5fcf057a7eeb","resolution":{"observed_at":"2026-08-07T05:14:47.584200Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.18223","last_updated":"2026-03-18T05:34:39Z","snapshot_observed_at":"2026-08-06T23:27:24.356320Z","submitted_at":"2023-03-31T17:28:46Z","title":"A Survey of Large Language Models","version":19},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.18223","snapshot_observed_at":"2026-08-07T05:14:47.588776Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.08446","last_updated":"2025-06-10T04:44:28Z","snapshot_observed_at":"2026-08-07T09:15:20.058485Z","submitted_at":"2025-06-10T04:44:28Z","title":"A Survey on Large Language Models for Mathematical Reasoning","version":1},"reference_index":109,"source":"pdf_text","source_observed_at":"2026-08-07T05:14:47.588776Z"},"links":{"cited_paper":"/paper/2303.18223","citing_paper":"/paper/2506.08446"},"observation_digest":"sha256:3d988c48ff61aa8a22c0eeb362336039ae257bfda69185fe1463ba295f6dbb17","observation_id":"1c1541b2-6419-45e2-9d10-d52f09458061","resolution":{"observed_at":"2026-08-07T05:14:47.588776Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07627","last_updated":"2025-03-20T05:08:24Z","snapshot_observed_at":"2026-07-06T19:30:56.585110Z","submitted_at":"2024-10-10T05:43:07Z","title":"Automatic Curriculum Expert Iteration for Reliable LLM Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.07627","snapshot_observed_at":"2026-08-07T05:14:47.593151Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.08446","last_updated":"2025-06-10T04:44:28Z","snapshot_observed_at":"2026-08-07T09:15:20.058485Z","submitted_at":"2025-06-10T04:44:28Z","title":"A Survey on Large Language Models for Mathematical Reasoning","version":1},"reference_index":110,"source":"pdf_text","source_observed_at":"2026-08-07T05:14:47.593151Z"},"links":{"cited_paper":"/paper/2410.07627","citing_paper":"/paper/2506.08446"},"observation_digest":"sha256:390ec77147557ff1468fff71ff24b0531ec9f18b5c47f05009b18508915d9267","observation_id":"928d2302-cf88-4957-b914-7a68b47edec4","resolution":{"observed_at":"2026-08-07T05:14:47.593151Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06559","last_updated":"2025-05-26T14:03:32Z","snapshot_observed_at":"2026-08-05T20:30:49.812919Z","submitted_at":"2024-12-09T15:11:40Z","title":"ProcessBench: Identifying Process Errors in Mathematical Reasoning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.06559","snapshot_observed_at":"2026-08-07T05:14:47.598513Z","title":"Zheng, Z","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.08446","last_updated":"2025-06-10T04:44:28Z","snapshot_observed_at":"2026-08-07T09:15:20.058485Z","submitted_at":"2025-06-10T04:44:28Z","title":"A Survey on Large Language Models for Mathematical Reasoning","version":1},"reference_index":111,"source":"pdf_text","source_observed_at":"2026-08-07T05:14:47.598513Z"},"links":{"cited_paper":"/paper/2412.06559","citing_paper":"/paper/2506.08446"},"observation_digest":"sha256:7c576243e026f8138e48e01199de4c64b4ee5b61984dfd17fa4d098b1b7fc1d8","observation_id":"82526cc1-5e50-4945-93cc-1b0404f6d1a8","resolution":{"observed_at":"2026-08-07T05:14:47.598513Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2109.00110","last_updated":"2022-02-28T06:03:23Z","snapshot_observed_at":"2026-08-06T09:47:40.209642Z","submitted_at":"2021-08-31T23:21:12Z","title":"MiniF2F: a cross-system benchmark for formal Olympiad-level mathematics","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.00110","snapshot_observed_at":"2026-08-07T05:14:47.603907Z","title":"Zheng, J","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.08446","last_updated":"2025-06-10T04:44:28Z","snapshot_observed_at":"2026-08-07T09:15:20.058485Z","submitted_at":"2025-06-10T04:44:28Z","title":"A Survey on Large Language Models for Mathematical Reasoning","version":1},"reference_index":112,"source":"pdf_text","source_observed_at":"2026-08-07T05:14:47.603907Z"},"links":{"cited_paper":"/paper/2109.00110","citing_paper":"/paper/2506.08446"},"observation_digest":"sha256:96e2ba4cf4986b92252f640b3ccad63006255bfa418f38929449b10e1dde0621","observation_id":"2a3cc23c-209f-4bcb-baf2-ff5bad5522f9","resolution":{"observed_at":"2026-08-07T05:14:47.603907Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.14963","last_updated":"2025-03-27T07:08:33Z","snapshot_observed_at":"2026-07-06T18:04:17.561892Z","submitted_at":"2024-04-23T12:16:05Z","title":"Achieving >97% on GSM8K: Deeply Understanding the Problems Makes LLMs Better Solvers for Math Word Problems","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.14963","snapshot_observed_at":"2026-08-07T05:14:47.608760Z","title":"Zheng, R","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.08446","last_updated":"2025-06-10T04:44:28Z","snapshot_observed_at":"2026-08-07T09:15:20.058485Z","submitted_at":"2025-06-10T04:44:28Z","title":"A Survey on Large Language Models for Mathematical Reasoning","version":1},"reference_index":113,"source":"pdf_text","source_observed_at":"2026-08-07T05:14:47.608760Z"},"links":{"cited_paper":"/paper/2404.14963","citing_paper":"/paper/2506.08446"},"observation_digest":"sha256:12e3de1d358eefcfd97b7b3a98f6cb1cf334e051af44b7e0713c1dfaa7a4e9ff","observation_id":"dd28f020-592d-4f50-a337-ffa99d744497","resolution":{"observed_at":"2026-08-07T05:14:47.608760Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.21277","last_updated":"2025-05-21T06:08:31Z","snapshot_observed_at":"2026-08-07T15:57:57.813561Z","submitted_at":"2025-04-30T03:14:28Z","title":"Reinforced MLLM: A Survey on RL-Based Reasoning in Multimodal Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.21277","snapshot_observed_at":"2026-08-07T05:14:47.613495Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.08446","last_updated":"2025-06-10T04:44:28Z","snapshot_observed_at":"2026-08-07T09:15:20.058485Z","submitted_at":"2025-06-10T04:44:28Z","title":"A Survey on Large Language Models for Mathematical Reasoning","version":1},"reference_index":114,"source":"pdf_text","source_observed_at":"2026-08-07T05:14:47.613495Z"},"links":{"cited_paper":"/paper/2504.21277","citing_paper":"/paper/2506.08446"},"observation_digest":"sha256:edb0bad7bbfcfa785cecdc5a70f25cdd326ad600c46db0e7aed59201e4409fc9","observation_id":"ee40d895-7924-4007-a0d4-ec9278bbf768","resolution":{"observed_at":"2026-08-07T05:14:47.613495Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.09066","last_updated":"2022-11-15T06:12:28Z","snapshot_observed_at":"2026-08-06T04:36:04.765232Z","submitted_at":"2022-11-15T06:12:28Z","title":"Teaching Algorithmic Reasoning via In-context Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.09066","snapshot_observed_at":"2026-08-07T05:14:47.618381Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.08446","last_updated":"2025-06-10T04:44:28Z","snapshot_observed_at":"2026-08-07T09:15:20.058485Z","submitted_at":"2025-06-10T04:44:28Z","title":"A Survey on Large Language Models for Mathematical Reasoning","version":1},"reference_index":115,"source":"pdf_text","source_observed_at":"2026-08-07T05:14:47.618381Z"},"links":{"cited_paper":"/paper/2211.09066","citing_paper":"/paper/2506.08446"},"observation_digest":"sha256:e02d53ce1467ab56bc4c5bef3aab72770dbfc0051a9966adc901a65ea779b9af","observation_id":"4afc5bbd-4af8-4bb6-a82f-66db6fce831a","resolution":{"observed_at":"2026-08-07T05:14:47.618381Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14365","last_updated":"2024-05-23T09:43:19Z","snapshot_observed_at":"2026-07-06T18:18:30.066741Z","submitted_at":"2024-05-23T09:43:19Z","title":"JiuZhang3.0: Efficiently Improving Mathematical Reasoning by Training Small Data Synthesis Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14365","snapshot_observed_at":"2026-08-07T05:14:47.623400Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.08446","last_updated":"2025-06-10T04:44:28Z","snapshot_observed_at":"2026-08-07T09:15:20.058485Z","submitted_at":"2025-06-10T04:44:28Z","title":"A Survey on Large Language Models for Mathematical Reasoning","version":1},"reference_index":116,"source":"pdf_text","source_observed_at":"2026-08-07T05:14:47.623400Z"},"links":{"cited_paper":"/paper/2405.14365","citing_paper":"/paper/2506.08446"},"observation_digest":"sha256:574ad367bbd6c706f92faef1c4aaa7b31e8ad9c96cf4a120e343eda9664b3e6e","observation_id":"4aa692bd-fc69-43a2-88a0-5f4741231aa3","resolution":{"observed_at":"2026-08-07T05:14:47.623400Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.08593","last_updated":"2020-01-08T23:02:36Z","snapshot_observed_at":"2026-08-08T07:44:49.921146Z","submitted_at":"2019-09-18T17:33:39Z","title":"Fine-Tuning Language Models from Human Preferences","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.08593","snapshot_observed_at":"2026-08-07T05:14:47.627869Z","title":null,"venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2506.08446","last_updated":"2025-06-10T04:44:28Z","snapshot_observed_at":"2026-08-07T09:15:20.058485Z","submitted_at":"2025-06-10T04:44:28Z","title":"A Survey on Large Language Models for Mathematical Reasoning","version":1},"reference_index":117,"source":"pdf_text","source_observed_at":"2026-08-07T05:14:47.627869Z"},"links":{"cited_paper":"/paper/1909.08593","citing_paper":"/paper/2506.08446"},"observation_digest":"sha256:da5c70155259d830a981fee327e2845852f667a6420af4c9d5f5ab1cf6ee8071","observation_id":"7f9d84ea-ffff-426d-ad3c-29e9e9315946","resolution":{"observed_at":"2026-08-07T05:14:47.627869Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:14:47.632619Z","title":"An essential goal in evaluating mathematical reasoning models is to assess whether they exhibit capabilities comparable to, or exceeding, those of humans","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.08446","last_updated":"2025-06-10T04:44:28Z","snapshot_observed_at":"2026-08-07T09:15:20.058485Z","submitted_at":"2025-06-10T04:44:28Z","title":"A Survey on Large Language Models for Mathematical Reasoning","version":1},"reference_index":118,"source":"pdf_text","source_observed_at":"2026-08-07T05:14:47.632619Z"},"links":{"citing_paper":"/paper/2506.08446"},"observation_digest":"sha256:e3a6bf3fc60dabf976436679fbf3422089540d3fe2ffb961f7677f1c7b00a4dc","observation_id":"bc57096e-daec-494d-9a4e-e599ef340c00","resolution":{"observed_at":"2026-08-07T05:14:47.632619Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:14:47.638235Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.08446","last_updated":"2025-06-10T04:44:28Z","snapshot_observed_at":"2026-08-07T09:15:20.058485Z","submitted_at":"2025-06-10T04:44:28Z","title":"A Survey on Large Language Models for Mathematical Reasoning","version":1},"reference_index":119,"source":"pdf_text","source_observed_at":"2026-08-07T05:14:47.638235Z"},"links":{"citing_paper":"/paper/2506.08446"},"observation_digest":"sha256:38ade32925566df826f785605ad025b860756d5c86319cf72cd85c1c6d90173c","observation_id":"da6e38ee-19e5-4a19-a50e-bab43e9ae6f5","resolution":{"observed_at":"2026-08-07T05:14:47.638235Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.13571","last_updated":"2024-06-06T12:18:56Z","snapshot_observed_at":"2026-08-06T15:38:12.770736Z","submitted_at":"2023-10-20T15:09:46Z","title":"Why Can Large Language Models Generate Correct Chain-of-Thoughts?","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.13571","snapshot_observed_at":"2026-08-07T05:14:47.475664Z","title":"Tutunov, A","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.08446","last_updated":"2025-06-10T04:44:28Z","snapshot_observed_at":"2026-08-07T09:15:20.058485Z","submitted_at":"2025-06-10T04:44:28Z","title":"A Survey on Large Language Models for Mathematical Reasoning","version":1},"reference_index":1950,"source":"pdf_text","source_observed_at":"2026-08-07T05:14:47.475664Z"},"links":{"cited_paper":"/paper/2310.13571","citing_paper":"/paper/2506.08446"},"observation_digest":"sha256:719d10836a457756df7dc91389c2fb37fa35bdec0d42973496b3bf5a22d2acfc","observation_id":"8bd2bb36-4635-4235-80c5-9c500646881b","resolution":{"observed_at":"2026-08-07T05:14:47.475664Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.16636","last_updated":"2023-06-29T02:19:50Z","snapshot_observed_at":"2026-07-06T15:48:05.491179Z","submitted_at":"2023-06-29T02:19:50Z","title":"CMATH: Can Your Language Model Pass Chinese Elementary School Math Test?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.16636","snapshot_observed_at":"2026-08-07T05:14:47.498407Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.08446","last_updated":"2025-06-10T04:44:28Z","snapshot_observed_at":"2026-08-07T09:15:20.058485Z","submitted_at":"2025-06-10T04:44:28Z","title":"A Survey on Large Language Models for Mathematical Reasoning","version":1},"reference_index":1962,"source":"pdf_text","source_observed_at":"2026-08-07T05:14:47.498407Z"},"links":{"cited_paper":"/paper/2306.16636","citing_paper":"/paper/2506.08446"},"observation_digest":"sha256:d810ad2dee0811184f076b8dce41bf4a853dc49c0ad91fdc314b45083bb5fd9c","observation_id":"981061a7-936c-4eff-8bc3-69c427dbbfae","resolution":{"observed_at":"2026-08-07T05:14:47.498407Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.08446","last_updated":"2025-06-10T04:44:28Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-07T09:15:20.058485Z","submitted_at":"2025-06-10T04:44:28Z","title":"A Survey on Large Language Models for Mathematical Reasoning"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":97,"verified_exact":3,"verified_fuzzy":0},"total_outbound_references":119},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 100 of 119 outbound references and 7 inbound Pith citation observations for arXiv:2506.08446."}