{"as_of":"2026-08-11T15:30:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:1d1ffd2b88e2728bbdc7157c388bb3df9e9cbb8fa7f9c8d932737de9c5961a0d","coverage":[{"denominator":38,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":38,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T22:37:07.281291Z","state":"measured"},{"denominator":46,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":46,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":8,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":8,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T16:18:40.777676Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-23T04:07:30.508001Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.01478","last_updated":"2025-01-02T12:09:17Z","snapshot_observed_at":"2026-08-10T22:30:18.747616Z","submitted_at":"2025-01-02T12:09:17Z","title":"Enhancing Reasoning through Process Supervision with Monte Carlo Tree Search","version":1},"cited_work":{"arxiv_id":"2501.01478","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.01478","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Li, X., Yu, Z., and Xiong, C","venue":null,"work_id":"40b66ca2-1002-4eda-9594-78ac06a2e5c9","year":2025},"citing_paper":{"arxiv_id":"2502.00955","last_updated":"2026-04-24T08:45:39Z","snapshot_observed_at":"2026-07-06T20:29:55.352526Z","submitted_at":"2025-02-02T23:20:16Z","title":"Efficient Multi-Agent System Training with Data Influence-Oriented Tree Search","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-23T04:06:23.521344Z"},"links":{"cited_paper":"/paper/2501.01478","citing_paper":"/paper/2502.00955"},"observation_digest":"sha256:168a58cb4d96384f026243942dd218b2074ff6452e426b114cc19333b4308e6a","observation_id":"d70528af-733a-4c3f-b41a-9aa4121e462b","resolution":{"observed_at":"2026-05-23T04:07:30.515018Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.01478","last_updated":"2025-01-02T12:09:17Z","snapshot_observed_at":"2026-08-10T22:30:18.747616Z","submitted_at":"2025-01-02T12:09:17Z","title":"Enhancing Reasoning through Process Supervision with Monte Carlo Tree Search","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.01478","snapshot_observed_at":"2026-08-09T16:18:40.777676Z","title":"Enhancing reason- ing through process supervision with monte carlo tree search.arXiv preprint arXiv:2501.01478, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2502.01208","last_updated":"2025-06-20T10:54:05Z","snapshot_observed_at":"2026-08-09T16:35:47.837184Z","submitted_at":"2025-02-03T09:59:32Z","title":"On Almost Surely Safe Alignment of Large Language Models at Inference-Time","version":3},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-09T16:18:40.777676Z"},"links":{"cited_paper":"/paper/2501.01478","citing_paper":"/paper/2502.01208"},"observation_digest":"sha256:fe97aae53fea0eb0d0735b067173365fbefe5b02a4cd53844d3d24e552353960","observation_id":"ac704221-d03e-4dad-b832-cde745c3475e","resolution":{"observed_at":"2026-08-09T16:18:40.777676Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.01478","last_updated":"2025-01-02T12:09:17Z","snapshot_observed_at":"2026-08-10T22:30:18.747616Z","submitted_at":"2025-01-02T12:09:17Z","title":"Enhancing Reasoning through Process Supervision with Monte Carlo Tree Search","version":1},"cited_work":{"arxiv_id":"2501.01478","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.01478","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Li, X., Yu, Z., and Xiong, C","venue":null,"work_id":"40b66ca2-1002-4eda-9594-78ac06a2e5c9","year":2025},"citing_paper":{"arxiv_id":"2502.11271","last_updated":"2026-04-13T23:08:01Z","snapshot_observed_at":"2026-08-03T02:43:16.180683Z","submitted_at":"2025-02-16T21:18:47Z","title":"OctoTools: An Agentic Framework with Extensible Tools for Complex Reasoning","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-23T02:39:18.259822Z"},"links":{"cited_paper":"/paper/2501.01478","citing_paper":"/paper/2502.11271"},"observation_digest":"sha256:7d34b93c0a6c13020bf37f361373ac27c637ba05d3a3ed2860739cfe571cc135","observation_id":"f2319ab1-9b02-4644-be05-7f3e4858c433","resolution":{"observed_at":"2026-05-23T02:42:26.364016Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.01478","last_updated":"2025-01-02T12:09:17Z","snapshot_observed_at":"2026-08-10T22:30:18.747616Z","submitted_at":"2025-01-02T12:09:17Z","title":"Enhancing Reasoning through Process Supervision with Monte Carlo Tree Search","version":1},"cited_work":{"arxiv_id":"2501.01478","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.01478","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Li, X., Yu, Z., and Xiong, C","venue":null,"work_id":"40b66ca2-1002-4eda-9594-78ac06a2e5c9","year":2025},"citing_paper":{"arxiv_id":"2507.17746","last_updated":"2025-10-03T01:55:55Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-23T17:57:55Z","title":"Rubrics as Rewards: Reinforcement Learning Beyond Verifiable Domains","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-13T06:07:56.678339Z"},"links":{"cited_paper":"/paper/2501.01478","citing_paper":"/paper/2507.17746"},"observation_digest":"sha256:b22d1ebd86807e385d55e981be10db38199d81c2e4a9b54e6b74e253833495e4","observation_id":"218116cf-c61e-4fb7-a4af-d3ffff13e233","resolution":{"observed_at":"2026-05-13T06:07:56.795252Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.01478","last_updated":"2025-01-02T12:09:17Z","snapshot_observed_at":"2026-08-10T22:30:18.747616Z","submitted_at":"2025-01-02T12:09:17Z","title":"Enhancing Reasoning through Process Supervision with Monte Carlo Tree Search","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.01478","snapshot_observed_at":"2026-08-04T10:53:08.542610Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.08048","last_updated":"2026-07-03T14:18:07Z","snapshot_observed_at":"2026-08-05T20:53:04.046643Z","submitted_at":"2025-10-09T10:34:39Z","title":"TaoSR-AGRL: Adaptive Guided Reinforcement Learning Framework for E-commerce Search Relevance","version":4},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-04T10:53:08.542610Z"},"links":{"cited_paper":"/paper/2501.01478","citing_paper":"/paper/2510.08048"},"observation_digest":"sha256:268e6a89bfa3401ee64f38c7e1412a2a65103317c91c4ec7ab42293a47a88576","observation_id":"6a4c5a46-318a-46b7-b102-08b4c8236c83","resolution":{"observed_at":"2026-08-04T10:53:08.542610Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.01478","last_updated":"2025-01-02T12:09:17Z","snapshot_observed_at":"2026-08-10T22:30:18.747616Z","submitted_at":"2025-01-02T12:09:17Z","title":"Enhancing Reasoning through Process Supervision with Monte Carlo Tree Search","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.01478","snapshot_observed_at":"2026-07-13T23:28:12.790404Z","title":"Enhancing reasoning through process supervision with monte carlo tree search","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.16867","last_updated":"2026-06-03T09:37:20Z","snapshot_observed_at":"2026-08-06T21:47:33.826393Z","submitted_at":"2026-03-17T17:59:51Z","title":"Efficient Reasoning on the Edge","version":2},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-07-13T23:28:12.790404Z"},"links":{"cited_paper":"/paper/2501.01478","citing_paper":"/paper/2603.16867"},"observation_digest":"sha256:06776e8198e865b39bea557105eb3e936e776e32e27930d11d00e9c127d5dee0","observation_id":"4d112cfe-7240-4bba-8276-a021b17a72c6","resolution":{"observed_at":"2026-07-13T23:28:12.790404Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.01478","last_updated":"2025-01-02T12:09:17Z","snapshot_observed_at":"2026-08-10T22:30:18.747616Z","submitted_at":"2025-01-02T12:09:17Z","title":"Enhancing Reasoning through Process Supervision with Monte Carlo Tree Search","version":1},"cited_work":{"arxiv_id":"2501.01478","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.01478","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Li, X., Yu, Z., and Xiong, C","venue":null,"work_id":"40b66ca2-1002-4eda-9594-78ac06a2e5c9","year":2025},"citing_paper":{"arxiv_id":"2604.21268","last_updated":"2026-04-23T04:23:31Z","snapshot_observed_at":"2026-08-11T05:33:32.889261Z","submitted_at":"2026-04-23T04:23:31Z","title":"Measure Twice, Click Once: Co-evolving Proposer and Visual Critic via Reinforcement Learning for GUI Grounding","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-05-09T23:05:05.251150Z"},"links":{"cited_paper":"/paper/2501.01478","citing_paper":"/paper/2604.21268"},"observation_digest":"sha256:c49920e4194169503e4193f986b645a9e151d4538df7115a332cf3e31d2a51c6","observation_id":"1a44368c-2632-4ea3-9ac4-f0f4bd86b74e","resolution":{"observed_at":"2026-05-11T14:16:06.245387Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.01478","last_updated":"2025-01-02T12:09:17Z","snapshot_observed_at":"2026-08-10T22:30:18.747616Z","submitted_at":"2025-01-02T12:09:17Z","title":"Enhancing Reasoning through Process Supervision with Monte Carlo Tree Search","version":1},"cited_work":{"arxiv_id":"2501.01478","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.01478","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Li, X., Yu, Z., and Xiong, C","venue":null,"work_id":"40b66ca2-1002-4eda-9594-78ac06a2e5c9","year":2025},"citing_paper":{"arxiv_id":"2604.23333","last_updated":"2026-08-10T13:00:06Z","snapshot_observed_at":"2026-08-11T15:24:23.605174Z","submitted_at":"2026-04-25T14:40:13Z","title":"Process Supervision of Confidence Margin for Calibrated LLM Reasoning","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-05-08T08:19:09.437464Z"},"links":{"cited_paper":"/paper/2501.01478","citing_paper":"/paper/2604.23333"},"observation_digest":"sha256:a4750d6b870071ce322cb0a1706c48497d596fd2c24aa740b0f6f0d33dd07306","observation_id":"082160ae-529d-4a88-befb-decc08150de8","resolution":{"observed_at":"2026-05-11T20:41:12.130965Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2501.01478/citation-record","integrity":"/paper/2501.01478/integrity","json":"/paper/2501.01478/citation-record.json","paper":"/paper/2501.01478"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:37:07.121205Z","title":", \" * write output.state after.block = add.period write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.01478","last_updated":"2025-01-02T12:09:17Z","snapshot_observed_at":"2026-08-10T22:30:18.747616Z","submitted_at":"2025-01-02T12:09:17Z","title":"Enhancing Reasoning through Process Supervision with Monte Carlo Tree Search","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-10T22:37:07.121205Z"},"links":{"citing_paper":"/paper/2501.01478"},"observation_digest":"sha256:922564b1595764090ed68329f9b55fb214eb23a9c3a22a5474461f5dcccb98f5","observation_id":"f5b2df76-7196-4b52-ba83-7dbdb0b39d57","resolution":{"observed_at":"2026-08-10T22:37:07.121205Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:37:07.126771Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.01478","last_updated":"2025-01-02T12:09:17Z","snapshot_observed_at":"2026-08-10T22:30:18.747616Z","submitted_at":"2025-01-02T12:09:17Z","title":"Enhancing Reasoning through Process Supervision with Monte Carlo Tree Search","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-10T22:37:07.126771Z"},"links":{"citing_paper":"/paper/2501.01478"},"observation_digest":"sha256:d2b42a28b50f14ff2ad68c8d91410ce090f5ac92d4930860c8b3fb2965853fce","observation_id":"57975f3a-a23d-4a6a-ae09-043622fbee13","resolution":{"observed_at":"2026-08-10T22:37:07.126771Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:37:07.743751Z","title":"B.; Powley, E.; Whitehouse, D.; Lucas, S","venue":null,"work_id":"a9d59a74-928c-4271-9a71-6ab46f95def9","year":2012},"citing_paper":{"arxiv_id":"2501.01478","last_updated":"2025-01-02T12:09:17Z","snapshot_observed_at":"2026-08-10T22:30:18.747616Z","submitted_at":"2025-01-02T12:09:17Z","title":"Enhancing Reasoning through Process Supervision with Monte Carlo Tree Search","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-10T22:37:07.131821Z"},"links":{"citing_paper":"/paper/2501.01478"},"observation_digest":"sha256:4bc814b69f342868fe104df7229484cb6c8a1f12a74ef4a60239c9a727ce822a","observation_id":"5b29a19e-2cba-41f0-84a3-93310dc1868a","resolution":{"observed_at":"2026-08-10T22:37:07.748697Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.03553","last_updated":"2024-09-27T08:16:28Z","snapshot_observed_at":"2026-08-08T14:49:36.757543Z","submitted_at":"2024-05-06T15:20:30Z","title":"AlphaMath Almost Zero: Process Supervision without Process","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.03553","snapshot_observed_at":"2026-08-10T22:37:07.136202Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.01478","last_updated":"2025-01-02T12:09:17Z","snapshot_observed_at":"2026-08-10T22:30:18.747616Z","submitted_at":"2025-01-02T12:09:17Z","title":"Enhancing Reasoning through Process Supervision with Monte Carlo Tree Search","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-10T22:37:07.136202Z"},"links":{"cited_paper":"/paper/2405.03553","citing_paper":"/paper/2501.01478"},"observation_digest":"sha256:0e52287791cdc5085f6f27ef4c5530ae77cae6cb56635021389ef46c3d1b4ce0","observation_id":"24c1aeba-4fc0-4864-9761-631ef8d3fbc1","resolution":{"observed_at":"2026-08-10T22:37:07.136202Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-10T22:37:07.140359Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.01478","last_updated":"2025-01-02T12:09:17Z","snapshot_observed_at":"2026-08-10T22:30:18.747616Z","submitted_at":"2025-01-02T12:09:17Z","title":"Enhancing Reasoning through Process Supervision with Monte Carlo Tree Search","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-10T22:37:07.140359Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2501.01478"},"observation_digest":"sha256:2d73d3085659d63fb72c6e691cd908dd8158add3d885745eae32f85e4e2f8bf2","observation_id":"19d67743-cdd3-4f2b-8555-ba0918a27509","resolution":{"observed_at":"2026-08-10T22:37:07.140359Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:37:07.728694Z","title":null,"venue":null,"work_id":"6ce0c5e4-eb44-4b30-86d8-f22c5e9ca9de","year":2022},"citing_paper":{"arxiv_id":"2501.01478","last_updated":"2025-01-02T12:09:17Z","snapshot_observed_at":"2026-08-10T22:30:18.747616Z","submitted_at":"2025-01-02T12:09:17Z","title":"Enhancing Reasoning through Process Supervision with Monte Carlo Tree Search","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-10T22:37:07.144778Z"},"links":{"citing_paper":"/paper/2501.01478"},"observation_digest":"sha256:19a7b41649c19296f70b0a7eef590b8334aab467d3a638cfba3bfae5d087e468","observation_id":"c7b60060-c572-4cbe-84ed-4cbccc3edc0f","resolution":{"observed_at":"2026-08-10T22:37:07.734344Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14992","last_updated":"2023-10-23T07:24:28Z","snapshot_observed_at":"2026-07-06T15:32:25.931739Z","submitted_at":"2023-05-24T10:28:28Z","title":"Reasoning with Language Model is Planning with World Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.14992","snapshot_observed_at":"2026-08-10T22:37:07.149051Z","title":"J.; Wang, Z.; Wang, D","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.01478","last_updated":"2025-01-02T12:09:17Z","snapshot_observed_at":"2026-08-10T22:30:18.747616Z","submitted_at":"2025-01-02T12:09:17Z","title":"Enhancing Reasoning through Process Supervision with Monte Carlo Tree Search","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-10T22:37:07.149051Z"},"links":{"cited_paper":"/paper/2305.14992","citing_paper":"/paper/2501.01478"},"observation_digest":"sha256:8deae4c42cda67254572a11ecf8a96589faf6d56286b1ac58ed3f641db766ced","observation_id":"ff2d45d2-1e34-4f6b-b6cc-0ce91c4f35fb","resolution":{"observed_at":"2026-08-10T22:37:07.149051Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.03874","last_updated":"2021-11-08T21:30:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-03-05T18:59:39Z","title":"Measuring Mathematical Problem Solving With the MATH Dataset","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.03874","snapshot_observed_at":"2026-08-10T22:37:07.153583Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.01478","last_updated":"2025-01-02T12:09:17Z","snapshot_observed_at":"2026-08-10T22:30:18.747616Z","submitted_at":"2025-01-02T12:09:17Z","title":"Enhancing Reasoning through Process Supervision with Monte Carlo Tree Search","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-10T22:37:07.153583Z"},"links":{"cited_paper":"/paper/2103.03874","citing_paper":"/paper/2501.01478"},"observation_digest":"sha256:eb6b6416756949b48015441c410ac324a6ab1641312212aea9264c2e7e24050e","observation_id":"ee107b97-264f-47da-b83c-c89e88989671","resolution":{"observed_at":"2026-08-10T22:37:07.153583Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09685","last_updated":"2021-10-16T18:40:34Z","snapshot_observed_at":"2026-08-11T08:20:29.798517Z","submitted_at":"2021-06-17T17:37:18Z","title":"LoRA: Low-Rank Adaptation of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.09685","snapshot_observed_at":"2026-08-10T22:37:07.158461Z","title":"J.; Shen, Y.; Wallis, P.; Allen-Zhu, Z.; Li, Y.; Wang, S.; Wang, L.; and Chen, W","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.01478","last_updated":"2025-01-02T12:09:17Z","snapshot_observed_at":"2026-08-10T22:30:18.747616Z","submitted_at":"2025-01-02T12:09:17Z","title":"Enhancing Reasoning through Process Supervision with Monte Carlo Tree Search","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-10T22:37:07.158461Z"},"links":{"cited_paper":"/paper/2106.09685","citing_paper":"/paper/2501.01478"},"observation_digest":"sha256:16cc6142dbab0502ea43eaaa87daf4c43e6aa2bbd35af7ba9f48e1d95d5a31c6","observation_id":"f17f9f3e-1059-4cf9-b247-772a7dfe396d","resolution":{"observed_at":"2026-08-10T22:37:07.158461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:37:07.716390Z","title":null,"venue":null,"work_id":"e3e5f4af-b784-4285-9507-5ab8105bf635","year":2023},"citing_paper":{"arxiv_id":"2501.01478","last_updated":"2025-01-02T12:09:17Z","snapshot_observed_at":"2026-08-10T22:30:18.747616Z","submitted_at":"2025-01-02T12:09:17Z","title":"Enhancing Reasoning through Process Supervision with Monte Carlo Tree Search","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-10T22:37:07.162586Z"},"links":{"citing_paper":"/paper/2501.01478"},"observation_digest":"sha256:79c160e49a29e141345b753af05133c4b41bac7a7eba1f51bda3ba6c10fed1d1","observation_id":"b712775f-10f6-48b2-b06d-53471e17da11","resolution":{"observed_at":"2026-08-10T22:37:07.720208Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:37:07.702493Z","title":null,"venue":null,"work_id":"bca7cf0e-bac9-407e-9b32-ce363266b5f1","year":2024},"citing_paper":{"arxiv_id":"2501.01478","last_updated":"2025-01-02T12:09:17Z","snapshot_observed_at":"2026-08-10T22:30:18.747616Z","submitted_at":"2025-01-02T12:09:17Z","title":"Enhancing Reasoning through Process Supervision with Monte Carlo Tree Search","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-10T22:37:07.166305Z"},"links":{"citing_paper":"/paper/2501.01478"},"observation_digest":"sha256:7b1b8ebb83ef411fbd2a375f84a0083046f14507b016c6c2796dcfca73d83a47","observation_id":"08da027b-7ca7-4d3d-84ee-c346aaa3a911","resolution":{"observed_at":"2026-08-10T22:37:07.707315Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:37:07.169952Z","title":null,"venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2501.01478","last_updated":"2025-01-02T12:09:17Z","snapshot_observed_at":"2026-08-10T22:30:18.747616Z","submitted_at":"2025-01-02T12:09:17Z","title":"Enhancing Reasoning through Process Supervision with Monte Carlo Tree Search","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-10T22:37:07.169952Z"},"links":{"citing_paper":"/paper/2501.01478"},"observation_digest":"sha256:94c8dc4e6a63989ecd6a2d5dfeea53f6be68b9611869d21eb229adf85388dc6b","observation_id":"b73bd473-7b6a-46d8-8d69-17f499bbfc0e","resolution":{"observed_at":"2026-08-10T22:37:07.169952Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:37:07.173434Z","title":"S.; Reid, M.; Matsuo, Y.; and Iwasawa, Y","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.01478","last_updated":"2025-01-02T12:09:17Z","snapshot_observed_at":"2026-08-10T22:30:18.747616Z","submitted_at":"2025-01-02T12:09:17Z","title":"Enhancing Reasoning through Process Supervision with Monte Carlo Tree Search","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-10T22:37:07.173434Z"},"links":{"citing_paper":"/paper/2501.01478"},"observation_digest":"sha256:6d7b6507c6ff8e304c0f0e4afe5ea0ea9bec18abb277a0d1b1c42aaa78f6c298","observation_id":"fd133b34-512a-4eab-9b6c-7c236f79ee2b","resolution":{"observed_at":"2026-08-10T22:37:07.173434Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.18629","last_updated":"2024-06-26T17:43:06Z","snapshot_observed_at":"2026-08-06T00:24:52.274888Z","submitted_at":"2024-06-26T17:43:06Z","title":"Step-DPO: Step-wise Preference Optimization for Long-chain Reasoning of LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.18629","snapshot_observed_at":"2026-08-10T22:37:07.176830Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.01478","last_updated":"2025-01-02T12:09:17Z","snapshot_observed_at":"2026-08-10T22:30:18.747616Z","submitted_at":"2025-01-02T12:09:17Z","title":"Enhancing Reasoning through Process Supervision with Monte Carlo Tree Search","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-10T22:37:07.176830Z"},"links":{"cited_paper":"/paper/2406.18629","citing_paper":"/paper/2501.01478"},"observation_digest":"sha256:a3769a70af5d14945be50a6a8d7181b88858b0646bc4f98cd205c0c84befc8b9","observation_id":"93ce969c-ecec-4fb8-aeb2-2c5092d15dd2","resolution":{"observed_at":"2026-08-10T22:37:07.176830Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04706","last_updated":"2024-03-07T18:00:40Z","snapshot_observed_at":"2026-08-07T09:14:55.529271Z","submitted_at":"2024-03-07T18:00:40Z","title":"Common 7B Language Models Already Possess Strong Math Capabilities","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04706","snapshot_observed_at":"2026-08-10T22:37:07.182080Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.01478","last_updated":"2025-01-02T12:09:17Z","snapshot_observed_at":"2026-08-10T22:30:18.747616Z","submitted_at":"2025-01-02T12:09:17Z","title":"Enhancing Reasoning through Process Supervision with Monte Carlo Tree Search","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-10T22:37:07.182080Z"},"links":{"cited_paper":"/paper/2403.04706","citing_paper":"/paper/2501.01478"},"observation_digest":"sha256:f6db3a8786c4d40175203014c1149caa47633535ddd998bb39c30767b809a183","observation_id":"b23ca365-0fb4-41f0-af8d-9aafa40a5a74","resolution":{"observed_at":"2026-08-10T22:37:07.182080Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.20050","last_updated":"2023-05-31T17:24:00Z","snapshot_observed_at":"2026-08-11T13:05:29.313402Z","submitted_at":"2023-05-31T17:24:00Z","title":"Let's Verify Step by Step","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.20050","snapshot_observed_at":"2026-08-10T22:37:07.186817Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.01478","last_updated":"2025-01-02T12:09:17Z","snapshot_observed_at":"2026-08-10T22:30:18.747616Z","submitted_at":"2025-01-02T12:09:17Z","title":"Enhancing Reasoning through Process Supervision with Monte Carlo Tree Search","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-10T22:37:07.186817Z"},"links":{"cited_paper":"/paper/2305.20050","citing_paper":"/paper/2501.01478"},"observation_digest":"sha256:2700d50aeda46b98a18ef98f1e557d764522193c12a2a0f422bfe64868f37cc7","observation_id":"eee4bf86-a749-4bcc-a551-79d25ae721e7","resolution":{"observed_at":"2026-08-10T22:37:07.186817Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.09003","last_updated":"2024-12-16T06:13:03Z","snapshot_observed_at":"2026-08-09T18:26:40.385608Z","submitted_at":"2024-01-17T06:48:16Z","title":"Augmenting Math Word Problems via Iterative Question Composing","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.09003","snapshot_observed_at":"2026-08-10T22:37:07.191913Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.01478","last_updated":"2025-01-02T12:09:17Z","snapshot_observed_at":"2026-08-10T22:30:18.747616Z","submitted_at":"2025-01-02T12:09:17Z","title":"Enhancing Reasoning through Process Supervision with Monte Carlo Tree Search","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-10T22:37:07.191913Z"},"links":{"cited_paper":"/paper/2401.09003","citing_paper":"/paper/2501.01478"},"observation_digest":"sha256:fb788ff65064559aa2ee5ae87a4fa8e0ae8025da6538ac6b11e841ca877f7799","observation_id":"1bba5b30-001a-4d99-a565-31e56305cf55","resolution":{"observed_at":"2026-08-10T22:37:07.191913Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16352","last_updated":"2024-09-11T08:23:58Z","snapshot_observed_at":"2026-07-06T17:35:18.965223Z","submitted_at":"2024-02-26T07:17:25Z","title":"MathGenie: Generating Synthetic Data with Question Back-translation for Enhancing Mathematical Reasoning of LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.16352","snapshot_observed_at":"2026-08-10T22:37:07.196280Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.01478","last_updated":"2025-01-02T12:09:17Z","snapshot_observed_at":"2026-08-10T22:30:18.747616Z","submitted_at":"2025-01-02T12:09:17Z","title":"Enhancing Reasoning through Process Supervision with Monte Carlo Tree Search","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-10T22:37:07.196280Z"},"links":{"cited_paper":"/paper/2402.16352","citing_paper":"/paper/2501.01478"},"observation_digest":"sha256:0ae83a75e096a9a9ecf2fbbfcd13fa389b7c1c1d66ef4e6e0e0f74abf155dea5","observation_id":"6433f402-dee4-4a0d-937b-2454a26d11d4","resolution":{"observed_at":"2026-08-10T22:37:07.196280Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06592","last_updated":"2024-12-11T22:59:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-05T19:25:40Z","title":"Improve Mathematical Reasoning in Language Models by Automated Process Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.06592","snapshot_observed_at":"2026-08-10T22:37:07.201332Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.01478","last_updated":"2025-01-02T12:09:17Z","snapshot_observed_at":"2026-08-10T22:30:18.747616Z","submitted_at":"2025-01-02T12:09:17Z","title":"Enhancing Reasoning through Process Supervision with Monte Carlo Tree Search","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-10T22:37:07.201332Z"},"links":{"cited_paper":"/paper/2406.06592","citing_paper":"/paper/2501.01478"},"observation_digest":"sha256:db00e7a96d9513bd6a74221b93e8abf362a34c5dbacd91e51ede0b6cdcfdc354","observation_id":"9bb1f353-d7e5-488e-ace5-1cdbeee97993","resolution":{"observed_at":"2026-08-10T22:37:07.201332Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.00114","last_updated":"2021-11-30T21:32:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-11-30T21:32:46Z","title":"Show Your Work: Scratchpads for Intermediate Computation with Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.00114","snapshot_observed_at":"2026-08-10T22:37:07.205113Z","title":"J.; Gur-Ari, G.; Michalewski, H.; Austin, J.; Bieber, D.; Dohan, D.; Lewkowycz, A.; Bosma, M.; Luan, D.; et al","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.01478","last_updated":"2025-01-02T12:09:17Z","snapshot_observed_at":"2026-08-10T22:30:18.747616Z","submitted_at":"2025-01-02T12:09:17Z","title":"Enhancing Reasoning through Process Supervision with Monte Carlo Tree Search","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-10T22:37:07.205113Z"},"links":{"cited_paper":"/paper/2112.00114","citing_paper":"/paper/2501.01478"},"observation_digest":"sha256:22a75fa77e97d7a19414055a80698131c7fab7e4aa3a07cd83b7211268598f82","observation_id":"1b0534a0-c9bf-43f9-96c7-c876de3d4cec","resolution":{"observed_at":"2026-08-10T22:37:07.205113Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:37:07.208730Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.01478","last_updated":"2025-01-02T12:09:17Z","snapshot_observed_at":"2026-08-10T22:30:18.747616Z","submitted_at":"2025-01-02T12:09:17Z","title":"Enhancing Reasoning through Process Supervision with Monte Carlo Tree Search","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-10T22:37:07.208730Z"},"links":{"citing_paper":"/paper/2501.01478"},"observation_digest":"sha256:f5381c46d08b49810bd521d8932cae3708f7fbfac745d53cee18182b655c7e63","observation_id":"54a9142d-1f08-42dd-aa9c-faa5e3b58181","resolution":{"observed_at":"2026-08-10T22:37:07.208730Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.19733","last_updated":"2024-06-26T01:28:35Z","snapshot_observed_at":"2026-08-06T12:20:08.657659Z","submitted_at":"2024-04-30T17:28:05Z","title":"Iterative Reasoning Preference Optimization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.19733","snapshot_observed_at":"2026-08-10T22:37:07.212323Z","title":"Y.; Yuan, W.; Cho, K.; He, H.; Sukhbaatar, S.; and Weston, J","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.01478","last_updated":"2025-01-02T12:09:17Z","snapshot_observed_at":"2026-08-10T22:30:18.747616Z","submitted_at":"2025-01-02T12:09:17Z","title":"Enhancing Reasoning through Process Supervision with Monte Carlo Tree Search","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-10T22:37:07.212323Z"},"links":{"cited_paper":"/paper/2404.19733","citing_paper":"/paper/2501.01478"},"observation_digest":"sha256:ad582ee7b4a076ad4a39e539e2866f0982b2f043b222fd7f7688b7f31108f760","observation_id":"77338f39-53c4-4a54-9f05-b7639e288495","resolution":{"observed_at":"2026-08-10T22:37:07.212323Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.06195","last_updated":"2024-08-12T14:42:13Z","snapshot_observed_at":"2026-08-09T16:44:49.698332Z","submitted_at":"2024-08-12T14:42:13Z","title":"Mutual Reasoning Makes Smaller LLMs Stronger Problem-Solvers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.06195","snapshot_observed_at":"2026-08-10T22:37:07.216959Z","title":"L.; Yang, F.; and Yang, M","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.01478","last_updated":"2025-01-02T12:09:17Z","snapshot_observed_at":"2026-08-10T22:30:18.747616Z","submitted_at":"2025-01-02T12:09:17Z","title":"Enhancing Reasoning through Process Supervision with Monte Carlo Tree Search","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-10T22:37:07.216959Z"},"links":{"cited_paper":"/paper/2408.06195","citing_paper":"/paper/2501.01478"},"observation_digest":"sha256:db1fc4c317940cc87167752682c11cceb44be7b3dbe916414ad2a9d976d2f399","observation_id":"5f060018-ae75-420e-b3c4-0b743773ab45","resolution":{"observed_at":"2026-08-10T22:37:07.216959Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:37:07.221935Z","title":"D.; Ermon, S.; and Finn, C","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.01478","last_updated":"2025-01-02T12:09:17Z","snapshot_observed_at":"2026-08-10T22:30:18.747616Z","submitted_at":"2025-01-02T12:09:17Z","title":"Enhancing Reasoning through Process Supervision with Monte Carlo Tree Search","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-10T22:37:07.221935Z"},"links":{"citing_paper":"/paper/2501.01478"},"observation_digest":"sha256:e7b73a9494de5c3e3e684b5283d0a9b9a467dd181f2a0471fa2d9f3ab9b53219","observation_id":"d5bd4309-d09c-4526-a293-c25ae71bc7c7","resolution":{"observed_at":"2026-08-10T22:37:07.221935Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:37:07.655845Z","title":null,"venue":null,"work_id":"8ed8563c-03f2-49f6-a5b6-ba34d94353bf","year":2024},"citing_paper":{"arxiv_id":"2501.01478","last_updated":"2025-01-02T12:09:17Z","snapshot_observed_at":"2026-08-10T22:30:18.747616Z","submitted_at":"2025-01-02T12:09:17Z","title":"Enhancing Reasoning through Process Supervision with Monte Carlo Tree Search","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-10T22:37:07.226757Z"},"links":{"citing_paper":"/paper/2501.01478"},"observation_digest":"sha256:b4d8f54af89da48f31dce93087e0cfc9f84dca58eca10a989c6537290699b21a","observation_id":"b028464f-1da2-46b8-bc62-f05baa04a808","resolution":{"observed_at":"2026-08-10T22:37:07.659818Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:37:07.643140Z","title":null,"venue":null,"work_id":"1e70ef05-ef7b-4830-a51a-df904c660070","year":2022},"citing_paper":{"arxiv_id":"2501.01478","last_updated":"2025-01-02T12:09:17Z","snapshot_observed_at":"2026-08-10T22:30:18.747616Z","submitted_at":"2025-01-02T12:09:17Z","title":"Enhancing Reasoning through Process Supervision with Monte Carlo Tree Search","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-10T22:37:07.231697Z"},"links":{"citing_paper":"/paper/2501.01478"},"observation_digest":"sha256:46ef57e7e350c8a49d9d465d4cb6e9548e7ffc0548b2241e350d69ea3700832c","observation_id":"bf529c58-3dd7-445d-91a1-58d3304f8bf8","resolution":{"observed_at":"2026-08-10T22:37:07.646871Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:37:07.235916Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.01478","last_updated":"2025-01-02T12:09:17Z","snapshot_observed_at":"2026-08-10T22:30:18.747616Z","submitted_at":"2025-01-02T12:09:17Z","title":"Enhancing Reasoning through Process Supervision with Monte Carlo Tree Search","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-10T22:37:07.235916Z"},"links":{"citing_paper":"/paper/2501.01478"},"observation_digest":"sha256:8673b5b192ebe1791dd53b6024910daf72a78a687b4f302113abde2326716f8b","observation_id":"b3be68e7-b2e0-4f9f-9c3c-ef5b7bc97855","resolution":{"observed_at":"2026-08-10T22:37:07.235916Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.11171","last_updated":"2023-03-07T17:57:37Z","snapshot_observed_at":"2026-07-06T12:50:22.773056Z","submitted_at":"2022-03-21T17:48:52Z","title":"Self-Consistency Improves Chain of Thought Reasoning in Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.11171","snapshot_observed_at":"2026-08-10T22:37:07.239699Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.01478","last_updated":"2025-01-02T12:09:17Z","snapshot_observed_at":"2026-08-10T22:30:18.747616Z","submitted_at":"2025-01-02T12:09:17Z","title":"Enhancing Reasoning through Process Supervision with Monte Carlo Tree Search","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-10T22:37:07.239699Z"},"links":{"cited_paper":"/paper/2203.11171","citing_paper":"/paper/2501.01478"},"observation_digest":"sha256:b64746fa403fd7256fe96d085e1ba202d2587ce9103d5b5a34afc294d36fead7","observation_id":"ef275d07-a8e0-4015-87df-72f5d542645d","resolution":{"observed_at":"2026-08-10T22:37:07.239699Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02658","last_updated":"2024-10-14T19:33:00Z","snapshot_observed_at":"2026-08-11T14:55:25.725642Z","submitted_at":"2024-02-05T00:57:51Z","title":"Multi-step Problem Solving Through a Verifier: An Empirical Analysis on Model-induced Process Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.02658","snapshot_observed_at":"2026-08-10T22:37:07.243343Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.01478","last_updated":"2025-01-02T12:09:17Z","snapshot_observed_at":"2026-08-10T22:30:18.747616Z","submitted_at":"2025-01-02T12:09:17Z","title":"Enhancing Reasoning through Process Supervision with Monte Carlo Tree Search","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-10T22:37:07.243343Z"},"links":{"cited_paper":"/paper/2402.02658","citing_paper":"/paper/2501.01478"},"observation_digest":"sha256:9668c2b6ec455282ae52994016e777fb8211003f81b7d421f4fb8e3f702dac7c","observation_id":"9c27f02f-060e-4d4f-9852-a58bc3aa958b","resolution":{"observed_at":"2026-08-10T22:37:07.243343Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:37:07.247050Z","title":"V.; Zhou, D.; et al","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.01478","last_updated":"2025-01-02T12:09:17Z","snapshot_observed_at":"2026-08-10T22:30:18.747616Z","submitted_at":"2025-01-02T12:09:17Z","title":"Enhancing Reasoning through Process Supervision with Monte Carlo Tree Search","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-10T22:37:07.247050Z"},"links":{"citing_paper":"/paper/2501.01478"},"observation_digest":"sha256:332db7a3c9f9fd92fe7b30b327339dd5474f59f6d2ffb9dc99de4ae0001ce505","observation_id":"c3b3d7aa-ad01-427b-b44c-907d4e8a8e1c","resolution":{"observed_at":"2026-08-10T22:37:07.247050Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.00451","last_updated":"2024-06-17T22:11:49Z","snapshot_observed_at":"2026-08-10T23:49:19.260833Z","submitted_at":"2024-05-01T11:10:24Z","title":"Monte Carlo Tree Search Boosts Reasoning via Iterative Preference Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.00451","snapshot_observed_at":"2026-08-10T22:37:07.251016Z","title":"P.; Kawaguchi, K.; and Shieh, M","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.01478","last_updated":"2025-01-02T12:09:17Z","snapshot_observed_at":"2026-08-10T22:30:18.747616Z","submitted_at":"2025-01-02T12:09:17Z","title":"Enhancing Reasoning through Process Supervision with Monte Carlo Tree Search","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-10T22:37:07.251016Z"},"links":{"cited_paper":"/paper/2405.00451","citing_paper":"/paper/2501.01478"},"observation_digest":"sha256:07cec0aca466722c8d3d3d068dcf380715d854562e5c07961ecd0e950adea8f8","observation_id":"454a3d22-e998-4677-8a83-aa9d8470165a","resolution":{"observed_at":"2026-08-10T22:37:07.251016Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:37:07.611089Z","title":null,"venue":null,"work_id":"f4627803-f466-46c3-bd5b-e35f5e5bf7f9","year":2024},"citing_paper":{"arxiv_id":"2501.01478","last_updated":"2025-01-02T12:09:17Z","snapshot_observed_at":"2026-08-10T22:30:18.747616Z","submitted_at":"2025-01-02T12:09:17Z","title":"Enhancing Reasoning through Process Supervision with Monte Carlo Tree Search","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-10T22:37:07.256222Z"},"links":{"citing_paper":"/paper/2501.01478"},"observation_digest":"sha256:2ca54a97b8630b2ea1f9375e98dd95100b3891911e9d09d43de9959546545ff5","observation_id":"67dbac04-12a0-42b9-9ef5-74446cbf2291","resolution":{"observed_at":"2026-08-10T22:37:07.616524Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.12284","last_updated":"2024-05-03T17:36:07Z","snapshot_observed_at":"2026-08-02T15:00:50.388422Z","submitted_at":"2023-09-21T17:45:42Z","title":"MetaMath: Bootstrap Your Own Mathematical Questions for Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.12284","snapshot_observed_at":"2026-08-10T22:37:07.260952Z","title":"T.; Li, Z.; Weller, A.; and Liu, W","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.01478","last_updated":"2025-01-02T12:09:17Z","snapshot_observed_at":"2026-08-10T22:30:18.747616Z","submitted_at":"2025-01-02T12:09:17Z","title":"Enhancing Reasoning through Process Supervision with Monte Carlo Tree Search","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-10T22:37:07.260952Z"},"links":{"cited_paper":"/paper/2309.12284","citing_paper":"/paper/2501.01478"},"observation_digest":"sha256:0beb62c72db55e8a5c995032f3888ed599a776f5c718ada647c40ec771358866","observation_id":"680d8de7-e2cc-4ad5-9b72-79ae70a96688","resolution":{"observed_at":"2026-08-10T22:37:07.260952Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.01825","last_updated":"2023-09-13T03:57:29Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-03T15:34:01Z","title":"Scaling Relationship on Learning Mathematical Reasoning with Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.01825","snapshot_observed_at":"2026-08-10T22:37:07.265264Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.01478","last_updated":"2025-01-02T12:09:17Z","snapshot_observed_at":"2026-08-10T22:30:18.747616Z","submitted_at":"2025-01-02T12:09:17Z","title":"Enhancing Reasoning through Process Supervision with Monte Carlo Tree Search","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-10T22:37:07.265264Z"},"links":{"cited_paper":"/paper/2308.01825","citing_paper":"/paper/2501.01478"},"observation_digest":"sha256:c8f81d767503e6d959f7d5ac39a43d53d8ff8f23ad42f61eb1f6520900196187","observation_id":"cbc2bf35-3ace-434c-9700-3fa3d7a0d3a6","resolution":{"observed_at":"2026-08-10T22:37:07.265264Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:37:07.269743Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.01478","last_updated":"2025-01-02T12:09:17Z","snapshot_observed_at":"2026-08-10T22:30:18.747616Z","submitted_at":"2025-01-02T12:09:17Z","title":"Enhancing Reasoning through Process Supervision with Monte Carlo Tree Search","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-10T22:37:07.269743Z"},"links":{"citing_paper":"/paper/2501.01478"},"observation_digest":"sha256:cf8d5bfadbe4844711bf73c7e8007628297ca89547a48789e2f5bc8cb13daf4a","observation_id":"35304577-379f-4be5-8ef2-6d3ada21e8f4","resolution":{"observed_at":"2026-08-10T22:37:07.269743Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.07394","last_updated":"2024-06-13T07:19:06Z","snapshot_observed_at":"2026-07-06T18:29:00.001236Z","submitted_at":"2024-06-11T16:01:07Z","title":"Accessing GPT-4 level Mathematical Olympiad Solutions via Monte Carlo Tree Self-refine with LLaMa-3 8B","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.07394","snapshot_observed_at":"2026-08-10T22:37:07.273758Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.01478","last_updated":"2025-01-02T12:09:17Z","snapshot_observed_at":"2026-08-10T22:30:18.747616Z","submitted_at":"2025-01-02T12:09:17Z","title":"Enhancing Reasoning through Process Supervision with Monte Carlo Tree Search","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-10T22:37:07.273758Z"},"links":{"cited_paper":"/paper/2406.07394","citing_paper":"/paper/2501.01478"},"observation_digest":"sha256:7b42b27c3eb013b77d7044158b79a02b553b670ffd692cd13b4e7eb37d466830","observation_id":"a273d775-2127-4584-8354-00a1139a511e","resolution":{"observed_at":"2026-08-10T22:37:07.273758Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.03816","last_updated":"2024-11-18T05:36:16Z","snapshot_observed_at":"2026-08-04T20:04:21.125115Z","submitted_at":"2024-06-06T07:40:00Z","title":"ReST-MCTS*: LLM Self-Training via Process Reward Guided Tree Search","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.03816","snapshot_observed_at":"2026-08-10T22:37:07.277408Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.01478","last_updated":"2025-01-02T12:09:17Z","snapshot_observed_at":"2026-08-10T22:30:18.747616Z","submitted_at":"2025-01-02T12:09:17Z","title":"Enhancing Reasoning through Process Supervision with Monte Carlo Tree Search","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-10T22:37:07.277408Z"},"links":{"cited_paper":"/paper/2406.03816","citing_paper":"/paper/2501.01478"},"observation_digest":"sha256:3532ba1f8eb77967227c6d25999b1cac7de59020b1c03388dfee668b1f44815b","observation_id":"e0052e1b-d013-423c-afb1-66ecb64e6ba5","resolution":{"observed_at":"2026-08-10T22:37:07.277408Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.18223","last_updated":"2026-03-18T05:34:39Z","snapshot_observed_at":"2026-08-06T23:27:24.356320Z","submitted_at":"2023-03-31T17:28:46Z","title":"A Survey of Large Language Models","version":19},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.18223","snapshot_observed_at":"2026-08-10T22:37:07.281291Z","title":"X.; Zhou, K.; Li, J.; Tang, T.; Wang, X.; Hou, Y.; Min, Y.; Zhang, B.; Zhang, J.; Dong, Z.; et al","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.01478","last_updated":"2025-01-02T12:09:17Z","snapshot_observed_at":"2026-08-10T22:30:18.747616Z","submitted_at":"2025-01-02T12:09:17Z","title":"Enhancing Reasoning through Process Supervision with Monte Carlo Tree Search","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-10T22:37:07.281291Z"},"links":{"cited_paper":"/paper/2303.18223","citing_paper":"/paper/2501.01478"},"observation_digest":"sha256:523781447d03849eb2a2b2f505bc8663e115d7ad78179be04808e8bc394d2fca","observation_id":"79d0bb41-3d5b-4e06-9aec-b392a90e376d","resolution":{"observed_at":"2026-08-10T22:37:07.281291Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2501.01478","last_updated":"2025-01-02T12:09:17Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-10T22:30:18.747616Z","submitted_at":"2025-01-02T12:09:17Z","title":"Enhancing Reasoning through Process Supervision with Monte Carlo Tree Search"},"reference_resolution":{"displayed":38,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":37,"verified_exact":0,"verified_fuzzy":1},"total_outbound_references":38},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 38 of 38 outbound references and 8 inbound Pith citation observations for arXiv:2501.01478."}