{"as_of":"2026-08-08T03:34:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:149261111519e32da6b7b7b42fcc94f92a8134ed8489a17fde007a01ff835ab9","coverage":[{"denominator":53,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":53,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:45:20.428126Z","state":"measured"},{"denominator":53,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":53,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.17829/citation-record","integrity":"/paper/2505.17829/integrity","json":"/paper/2505.17829/citation-record.json","paper":"/paper/2505.17829"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2503.04697","last_updated":"2025-10-03T01:55:58Z","snapshot_observed_at":"2026-08-06T08:53:09.095000Z","submitted_at":"2025-03-06T18:43:29Z","title":"L1: Controlling How Long A Reasoning Model Thinks With Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.04697","snapshot_observed_at":"2026-08-07T14:45:15.860789Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17829","last_updated":"2025-05-23T12:42:50Z","snapshot_observed_at":"2026-08-07T14:37:44.536944Z","submitted_at":"2025-05-23T12:42:50Z","title":"Stepwise Reasoning Checkpoint Analysis: A Test Time Scaling Method to Enhance LLMs' Reasoning","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T14:45:15.860789Z"},"links":{"cited_paper":"/paper/2503.04697","citing_paper":"/paper/2505.17829"},"observation_digest":"sha256:03b43a378126cd026811e187fd67019e744977a6032d64cef3063466d0311987","observation_id":"cbb5158a-e8f9-4d14-893a-453804d038da","resolution":{"observed_at":"2026-08-07T14:45:15.860789Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:45:15.928935Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17829","last_updated":"2025-05-23T12:42:50Z","snapshot_observed_at":"2026-08-07T14:37:44.536944Z","submitted_at":"2025-05-23T12:42:50Z","title":"Stepwise Reasoning Checkpoint Analysis: A Test Time Scaling Method to Enhance LLMs' Reasoning","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T14:45:15.928935Z"},"links":{"citing_paper":"/paper/2505.17829"},"observation_digest":"sha256:8a448fbfa0036424fb7ed45844db0207d8ad09ef1bb512762e3caa371e6059e3","observation_id":"d84d6c05-a592-4a30-9678-7e5de1b18f6f","resolution":{"observed_at":"2026-08-07T14:45:15.928935Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.09078","last_updated":"2025-04-01T12:48:43Z","snapshot_observed_at":"2026-07-06T20:05:46.205005Z","submitted_at":"2024-12-12T09:01:18Z","title":"Forest-of-Thought: Scaling Test-Time Compute for Enhancing LLM Reasoning","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.09078","snapshot_observed_at":"2026-08-07T14:45:15.995858Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17829","last_updated":"2025-05-23T12:42:50Z","snapshot_observed_at":"2026-08-07T14:37:44.536944Z","submitted_at":"2025-05-23T12:42:50Z","title":"Stepwise Reasoning Checkpoint Analysis: A Test Time Scaling Method to Enhance LLMs' Reasoning","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T14:45:15.995858Z"},"links":{"cited_paper":"/paper/2412.09078","citing_paper":"/paper/2505.17829"},"observation_digest":"sha256:f0135448664e4048877bf20495db663de17a271ea762beed8fce89f1c9c8931d","observation_id":"8198a83c-174c-47bb-9380-71fc6c8467c9","resolution":{"observed_at":"2026-08-07T14:45:15.995858Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-08-07T14:45:16.052650Z","title":"Le, Christopher Ré, and Azalia Mirhoseini","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17829","last_updated":"2025-05-23T12:42:50Z","snapshot_observed_at":"2026-08-07T14:37:44.536944Z","submitted_at":"2025-05-23T12:42:50Z","title":"Stepwise Reasoning Checkpoint Analysis: A Test Time Scaling Method to Enhance LLMs' Reasoning","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T14:45:16.052650Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2505.17829"},"observation_digest":"sha256:1bf39d5a481006e1c6a2daf0e910923e3964f79e391f181d7b78a7f8462fd0db","observation_id":"bf5dd1f9-059f-4b2f-83db-a84b73358037","resolution":{"observed_at":"2026-08-07T14:45:16.052650Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:45:16.157711Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17829","last_updated":"2025-05-23T12:42:50Z","snapshot_observed_at":"2026-08-07T14:37:44.536944Z","submitted_at":"2025-05-23T12:42:50Z","title":"Stepwise Reasoning Checkpoint Analysis: A Test Time Scaling Method to Enhance LLMs' Reasoning","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T14:45:16.157711Z"},"links":{"citing_paper":"/paper/2505.17829"},"observation_digest":"sha256:bb462d107f611072517e7b8000790a08aee08f2f5d92c89349a3334e2c45bfe6","observation_id":"5408ac83-e892-4b72-8be3-502414775fe8","resolution":{"observed_at":"2026-08-07T14:45:16.157711Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.04548","last_updated":"2025-03-06T15:34:27Z","snapshot_observed_at":"2026-08-07T17:24:22.925386Z","submitted_at":"2025-03-06T15:34:27Z","title":"An Empirical Study on Eliciting and Improving R1-like Reasoning Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.04548","snapshot_observed_at":"2026-08-07T14:45:16.258476Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17829","last_updated":"2025-05-23T12:42:50Z","snapshot_observed_at":"2026-08-07T14:37:44.536944Z","submitted_at":"2025-05-23T12:42:50Z","title":"Stepwise Reasoning Checkpoint Analysis: A Test Time Scaling Method to Enhance LLMs' Reasoning","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T14:45:16.258476Z"},"links":{"cited_paper":"/paper/2503.04548","citing_paper":"/paper/2505.17829"},"observation_digest":"sha256:3b3f9cfdd3a80a0f633c915fec9e9062285120e75546a8bfe111be1db01d6cbc","observation_id":"622a08fe-2874-4516-9be6-0009b06f3410","resolution":{"observed_at":"2026-08-07T14:45:16.258476Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-07T14:45:16.355876Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.17829","last_updated":"2025-05-23T12:42:50Z","snapshot_observed_at":"2026-08-07T14:37:44.536944Z","submitted_at":"2025-05-23T12:42:50Z","title":"Stepwise Reasoning Checkpoint Analysis: A Test Time Scaling Method to Enhance LLMs' Reasoning","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T14:45:16.355876Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2505.17829"},"observation_digest":"sha256:34f4144cc163826484d47be2a8250e1b0b37f24256c47e7fd27c153bcb124780","observation_id":"f1958060-a26f-4663-849c-d564bdc09acb","resolution":{"observed_at":"2026-08-07T14:45:16.355876Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.15602","last_updated":"2025-06-19T07:05:12Z","snapshot_observed_at":"2026-07-06T20:26:21.639525Z","submitted_at":"2025-01-26T17:05:16Z","title":"Rethinking External Slow-Thinking: From Snowball Errors to Probability of Correct Reasoning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.15602","snapshot_observed_at":"2026-08-07T14:45:16.471846Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17829","last_updated":"2025-05-23T12:42:50Z","snapshot_observed_at":"2026-08-07T14:37:44.536944Z","submitted_at":"2025-05-23T12:42:50Z","title":"Stepwise Reasoning Checkpoint Analysis: A Test Time Scaling Method to Enhance LLMs' Reasoning","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T14:45:16.471846Z"},"links":{"cited_paper":"/paper/2501.15602","citing_paper":"/paper/2505.17829"},"observation_digest":"sha256:ac33dc6108788a79faca0fafe50b8d372517598c658d789b0200bc057a7be372","observation_id":"cc788a5d-fee3-4fcf-a0f5-5b710919b473","resolution":{"observed_at":"2026-08-07T14:45:16.471846Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-07T14:45:16.567297Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17829","last_updated":"2025-05-23T12:42:50Z","snapshot_observed_at":"2026-08-07T14:37:44.536944Z","submitted_at":"2025-05-23T12:42:50Z","title":"Stepwise Reasoning Checkpoint Analysis: A Test Time Scaling Method to Enhance LLMs' Reasoning","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T14:45:16.567297Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2505.17829"},"observation_digest":"sha256:593b886bac338d7a8f09d952f2d31a3c07a114437be9d0168e2981cd8dfb94ae","observation_id":"94ccc782-0e46-4550-b340-3a0efbd2a360","resolution":{"observed_at":"2026-08-07T14:45:16.567297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.11504","last_updated":"2024-11-18T12:04:52Z","snapshot_observed_at":"2026-07-06T19:51:54.660531Z","submitted_at":"2024-11-18T12:04:52Z","title":"Search, Verify and Feedback: Towards Next Generation Post-training Paradigm of Foundation Models via Verifier Engineering","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.11504","snapshot_observed_at":"2026-08-07T14:45:16.667323Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17829","last_updated":"2025-05-23T12:42:50Z","snapshot_observed_at":"2026-08-07T14:37:44.536944Z","submitted_at":"2025-05-23T12:42:50Z","title":"Stepwise Reasoning Checkpoint Analysis: A Test Time Scaling Method to Enhance LLMs' Reasoning","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T14:45:16.667323Z"},"links":{"cited_paper":"/paper/2411.11504","citing_paper":"/paper/2505.17829"},"observation_digest":"sha256:2f7ec38da559db98ab87e36f98a949cbcd23d0dee09a1874e24704b41c09aaa8","observation_id":"547bb6f3-c113-4139-be22-5ddb1d03a8c4","resolution":{"observed_at":"2026-08-07T14:45:16.667323Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.04519","last_updated":"2025-01-08T14:12:57Z","snapshot_observed_at":"2026-08-04T20:57:22.329262Z","submitted_at":"2025-01-08T14:12:57Z","title":"rStar-Math: Small LLMs Can Master Math Reasoning with Self-Evolved Deep Thinking","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.04519","snapshot_observed_at":"2026-08-07T14:45:16.786796Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17829","last_updated":"2025-05-23T12:42:50Z","snapshot_observed_at":"2026-08-07T14:37:44.536944Z","submitted_at":"2025-05-23T12:42:50Z","title":"Stepwise Reasoning Checkpoint Analysis: A Test Time Scaling Method to Enhance LLMs' Reasoning","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T14:45:16.786796Z"},"links":{"cited_paper":"/paper/2501.04519","citing_paper":"/paper/2505.17829"},"observation_digest":"sha256:0fe5ac29edfaa844a651e63ba49c24ac5ff3d6aa5bde7b62e39ac5276387770e","observation_id":"38b3018e-0145-4e90-a9ac-f5ecea67b504","resolution":{"observed_at":"2026-08-07T14:45:16.786796Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:45:16.870979Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17829","last_updated":"2025-05-23T12:42:50Z","snapshot_observed_at":"2026-08-07T14:37:44.536944Z","submitted_at":"2025-05-23T12:42:50Z","title":"Stepwise Reasoning Checkpoint Analysis: A Test Time Scaling Method to Enhance LLMs' Reasoning","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T14:45:16.870979Z"},"links":{"citing_paper":"/paper/2505.17829"},"observation_digest":"sha256:3803b18200559e9f9bef0ea9340f6adfdc11116491f0da35e99f39ec7f549a58","observation_id":"91b7c566-b336-4bef-aefc-352dc56b0f58","resolution":{"observed_at":"2026-08-07T14:45:16.870979Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.19361","last_updated":"2025-03-30T14:48:59Z","snapshot_observed_at":"2026-08-07T17:45:25.804804Z","submitted_at":"2025-02-26T17:59:27Z","title":"Can Large Language Models Detect Errors in Long Chain-of-Thought Reasoning?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.19361","snapshot_observed_at":"2026-08-07T14:45:16.967173Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17829","last_updated":"2025-05-23T12:42:50Z","snapshot_observed_at":"2026-08-07T14:37:44.536944Z","submitted_at":"2025-05-23T12:42:50Z","title":"Stepwise Reasoning Checkpoint Analysis: A Test Time Scaling Method to Enhance LLMs' Reasoning","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T14:45:16.967173Z"},"links":{"cited_paper":"/paper/2502.19361","citing_paper":"/paper/2505.17829"},"observation_digest":"sha256:7cf50d49344fe364799a56eeb5b5076167576df5227fa8f3047d68a06a2f682e","observation_id":"a45e6103-0b37-4c7a-ace9-db5f77a7673e","resolution":{"observed_at":"2026-08-07T14:45:16.967173Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:45:17.034269Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.17829","last_updated":"2025-05-23T12:42:50Z","snapshot_observed_at":"2026-08-07T14:37:44.536944Z","submitted_at":"2025-05-23T12:42:50Z","title":"Stepwise Reasoning Checkpoint Analysis: A Test Time Scaling Method to Enhance LLMs' Reasoning","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T14:45:17.034269Z"},"links":{"citing_paper":"/paper/2505.17829"},"observation_digest":"sha256:b7069600df657fd22fe09a4b07a78dba8941d79df2d75aebfb8855b85919bddd","observation_id":"69c03bf8-35d6-4f45-a1d2-c4ae7fd881da","resolution":{"observed_at":"2026-08-07T14:45:17.034269Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13575","last_updated":"2025-06-11T21:59:20Z","snapshot_observed_at":"2026-08-07T18:06:06.265781Z","submitted_at":"2025-02-19T09:30:38Z","title":"ETS: Efficient Tree Search for Inference-Time Scaling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13575","snapshot_observed_at":"2026-08-07T14:45:17.115091Z","title":"Mahoney, Sophia Shao, Kurt Keutzer, and Amir Gholami","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17829","last_updated":"2025-05-23T12:42:50Z","snapshot_observed_at":"2026-08-07T14:37:44.536944Z","submitted_at":"2025-05-23T12:42:50Z","title":"Stepwise Reasoning Checkpoint Analysis: A Test Time Scaling Method to Enhance LLMs' Reasoning","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T14:45:17.115091Z"},"links":{"cited_paper":"/paper/2502.13575","citing_paper":"/paper/2505.17829"},"observation_digest":"sha256:40764ed76ae34f9a49601a3b8999361d8e4b2c637b44ee09056b68c192d4d804","observation_id":"4c3263cb-f17e-41de-bd6a-ca488c2b2211","resolution":{"observed_at":"2026-08-07T14:45:17.115091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.00031","last_updated":"2025-02-25T00:21:14Z","snapshot_observed_at":"2026-08-07T17:51:38.471379Z","submitted_at":"2025-02-25T00:21:14Z","title":"Efficient Test-Time Scaling via Self-Calibration","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.00031","snapshot_observed_at":"2026-08-07T14:45:17.220177Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17829","last_updated":"2025-05-23T12:42:50Z","snapshot_observed_at":"2026-08-07T14:37:44.536944Z","submitted_at":"2025-05-23T12:42:50Z","title":"Stepwise Reasoning Checkpoint Analysis: A Test Time Scaling Method to Enhance LLMs' Reasoning","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T14:45:17.220177Z"},"links":{"cited_paper":"/paper/2503.00031","citing_paper":"/paper/2505.17829"},"observation_digest":"sha256:98cf05ef0026efd15d2a03e098024c4d6df5f9a89b542524403e2a603de7f87a","observation_id":"895124a2-d20a-4fc3-8433-9edc9e6e7bd9","resolution":{"observed_at":"2026-08-07T14:45:17.220177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.02497","last_updated":"2025-06-29T06:49:52Z","snapshot_observed_at":"2026-07-06T20:16:44.607678Z","submitted_at":"2025-01-05T10:24:20Z","title":"A Survey of Test-Time Compute: From Intuitive Inference to Deliberate Reasoning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.02497","snapshot_observed_at":"2026-08-07T14:45:17.297639Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17829","last_updated":"2025-05-23T12:42:50Z","snapshot_observed_at":"2026-08-07T14:37:44.536944Z","submitted_at":"2025-05-23T12:42:50Z","title":"Stepwise Reasoning Checkpoint Analysis: A Test Time Scaling Method to Enhance LLMs' Reasoning","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T14:45:17.297639Z"},"links":{"cited_paper":"/paper/2501.02497","citing_paper":"/paper/2505.17829"},"observation_digest":"sha256:732b2689a6a418a7cbb69239af7fdf759699db0f7a0a157ae95bf0e17f7de036","observation_id":"b0e05e90-6c61-41af-995c-45701c748fc2","resolution":{"observed_at":"2026-08-07T14:45:17.297639Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.11694","last_updated":"2024-12-31T01:38:12Z","snapshot_observed_at":"2026-07-06T19:52:03.121993Z","submitted_at":"2024-11-18T16:15:17Z","title":"Enhancing LLM Reasoning with Reward-guided Tree Search","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.11694","snapshot_observed_at":"2026-08-07T14:45:17.406362Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17829","last_updated":"2025-05-23T12:42:50Z","snapshot_observed_at":"2026-08-07T14:37:44.536944Z","submitted_at":"2025-05-23T12:42:50Z","title":"Stepwise Reasoning Checkpoint Analysis: A Test Time Scaling Method to Enhance LLMs' Reasoning","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T14:45:17.406362Z"},"links":{"cited_paper":"/paper/2411.11694","citing_paper":"/paper/2505.17829"},"observation_digest":"sha256:c31864e897fed90460de5818e5ceb2c390585205a3a171e352c3b8ce44ad1652","observation_id":"9f9ffe20-ea0b-4f37-9e95-257e32a45eae","resolution":{"observed_at":"2026-08-07T14:45:17.406362Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:45:17.487613Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17829","last_updated":"2025-05-23T12:42:50Z","snapshot_observed_at":"2026-08-07T14:37:44.536944Z","submitted_at":"2025-05-23T12:42:50Z","title":"Stepwise Reasoning Checkpoint Analysis: A Test Time Scaling Method to Enhance LLMs' Reasoning","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T14:45:17.487613Z"},"links":{"citing_paper":"/paper/2505.17829"},"observation_digest":"sha256:90fcab5e38c244b7b1427f7eacb04997e7d4b1b2406845e654747b1d5457e66e","observation_id":"1a881508-053e-43ab-953e-65baf416e635","resolution":{"observed_at":"2026-08-07T14:45:17.487613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.10480","last_updated":"2024-01-19T04:03:59Z","snapshot_observed_at":"2026-07-06T17:17:44.177514Z","submitted_at":"2024-01-19T04:03:59Z","title":"Escape Sky-high Cost: Early-stopping Self-Consistency for Multi-step Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.10480","snapshot_observed_at":"2026-08-07T14:45:17.591164Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17829","last_updated":"2025-05-23T12:42:50Z","snapshot_observed_at":"2026-08-07T14:37:44.536944Z","submitted_at":"2025-05-23T12:42:50Z","title":"Stepwise Reasoning Checkpoint Analysis: A Test Time Scaling Method to Enhance LLMs' Reasoning","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T14:45:17.591164Z"},"links":{"cited_paper":"/paper/2401.10480","citing_paper":"/paper/2505.17829"},"observation_digest":"sha256:5461ae30ab2ab0c0eefbe57fd93e1efd4bdc9f5a2217597036fcf7ad20c2c0af","observation_id":"b25cc179-2cb9-4684-876d-15fefb5f7993","resolution":{"observed_at":"2026-08-07T14:45:17.591164Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:45:17.671386Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17829","last_updated":"2025-05-23T12:42:50Z","snapshot_observed_at":"2026-08-07T14:37:44.536944Z","submitted_at":"2025-05-23T12:42:50Z","title":"Stepwise Reasoning Checkpoint Analysis: A Test Time Scaling Method to Enhance LLMs' Reasoning","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T14:45:17.671386Z"},"links":{"citing_paper":"/paper/2505.17829"},"observation_digest":"sha256:c8b1e7439d3b915ca1685d227880445dbab3696c0fa7f126a589a64c416ac93f","observation_id":"21c2f839-5f79-4d08-a540-8d2ff69b315b","resolution":{"observed_at":"2026-08-07T14:45:17.671386Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06703","last_updated":"2025-02-10T17:30:23Z","snapshot_observed_at":"2026-08-05T04:32:32.994993Z","submitted_at":"2025-02-10T17:30:23Z","title":"Can 1B LLM Surpass 405B LLM? Rethinking Compute-Optimal Test-Time Scaling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.06703","snapshot_observed_at":"2026-08-07T14:45:17.775098Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17829","last_updated":"2025-05-23T12:42:50Z","snapshot_observed_at":"2026-08-07T14:37:44.536944Z","submitted_at":"2025-05-23T12:42:50Z","title":"Stepwise Reasoning Checkpoint Analysis: A Test Time Scaling Method to Enhance LLMs' Reasoning","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T14:45:17.775098Z"},"links":{"cited_paper":"/paper/2502.06703","citing_paper":"/paper/2505.17829"},"observation_digest":"sha256:350fa1cbd07656023b90b89741f57dfb6348e64faf0c568d4beab6a6a8e79e56","observation_id":"cec42c1f-e556-47dc-b89a-fa22ea3aa623","resolution":{"observed_at":"2026-08-07T14:45:17.775098Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06592","last_updated":"2024-12-11T22:59:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-05T19:25:40Z","title":"Improve Mathematical Reasoning in Language Models by Automated Process Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.06592","snapshot_observed_at":"2026-08-07T14:45:17.861908Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17829","last_updated":"2025-05-23T12:42:50Z","snapshot_observed_at":"2026-08-07T14:37:44.536944Z","submitted_at":"2025-05-23T12:42:50Z","title":"Stepwise Reasoning Checkpoint Analysis: A Test Time Scaling Method to Enhance LLMs' Reasoning","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T14:45:17.861908Z"},"links":{"cited_paper":"/paper/2406.06592","citing_paper":"/paper/2505.17829"},"observation_digest":"sha256:e5d354934e96e0b073106aeb839f11712ec938a04400a057becb7126c495a13d","observation_id":"1249619d-e278-4318-80bc-9206c8487c21","resolution":{"observed_at":"2026-08-07T14:45:17.861908Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:45:21.637677Z","title":null,"venue":null,"work_id":"3c89070f-227c-4aa1-9c0f-3e2db7f478f2","year":2024},"citing_paper":{"arxiv_id":"2505.17829","last_updated":"2025-05-23T12:42:50Z","snapshot_observed_at":"2026-08-07T14:37:44.536944Z","submitted_at":"2025-05-23T12:42:50Z","title":"Stepwise Reasoning Checkpoint Analysis: A Test Time Scaling Method to Enhance LLMs' Reasoning","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T14:45:17.962098Z"},"links":{"citing_paper":"/paper/2505.17829"},"observation_digest":"sha256:14c184f53da9048796266977e229f3b625c7c969f63114e7ad2f3644740ef8db","observation_id":"91847d96-bfdd-4c5d-82ce-097a4fdeb616","resolution":{"observed_at":"2026-08-07T14:45:21.696466Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:45:18.067650Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17829","last_updated":"2025-05-23T12:42:50Z","snapshot_observed_at":"2026-08-07T14:37:44.536944Z","submitted_at":"2025-05-23T12:42:50Z","title":"Stepwise Reasoning Checkpoint Analysis: A Test Time Scaling Method to Enhance LLMs' Reasoning","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T14:45:18.067650Z"},"links":{"citing_paper":"/paper/2505.17829"},"observation_digest":"sha256:110a610d4e3b081ed6712298caaef1eea57e931a67b147a2928f354b800f5624","observation_id":"f3feb280-534b-4aff-be6f-08be76e2c893","resolution":{"observed_at":"2026-08-07T14:45:18.067650Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:45:18.171836Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17829","last_updated":"2025-05-23T12:42:50Z","snapshot_observed_at":"2026-08-07T14:37:44.536944Z","submitted_at":"2025-05-23T12:42:50Z","title":"Stepwise Reasoning Checkpoint Analysis: A Test Time Scaling Method to Enhance LLMs' Reasoning","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T14:45:18.171836Z"},"links":{"citing_paper":"/paper/2505.17829"},"observation_digest":"sha256:de08a32780e139957d1c0978d47a475f201ddfc08d574c2899c6e7d29b702ac0","observation_id":"8205ddc8-fe73-4af5-90ba-658f20f51cca","resolution":{"observed_at":"2026-08-07T14:45:18.171836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.08146","last_updated":"2024-10-10T17:31:23Z","snapshot_observed_at":"2026-08-02T06:08:09.777151Z","submitted_at":"2024-10-10T17:31:23Z","title":"Rewarding Progress: Scaling Automated Process Verifiers for LLM Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.08146","snapshot_observed_at":"2026-08-07T14:45:18.293852Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17829","last_updated":"2025-05-23T12:42:50Z","snapshot_observed_at":"2026-08-07T14:37:44.536944Z","submitted_at":"2025-05-23T12:42:50Z","title":"Stepwise Reasoning Checkpoint Analysis: A Test Time Scaling Method to Enhance LLMs' Reasoning","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T14:45:18.293852Z"},"links":{"cited_paper":"/paper/2410.08146","citing_paper":"/paper/2505.17829"},"observation_digest":"sha256:45b462b4bd85a284e3f669db54ddf133a5211f2fcab90c83a196dccff40f39c8","observation_id":"eb92f12a-5360-4e3d-840b-43ff23e88e91","resolution":{"observed_at":"2026-08-07T14:45:18.293852Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03314","last_updated":"2024-08-06T17:35:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-06T17:35:05Z","title":"Scaling LLM Test-Time Compute Optimally can be More Effective than Scaling Model Parameters","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.03314","snapshot_observed_at":"2026-08-07T14:45:18.388703Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17829","last_updated":"2025-05-23T12:42:50Z","snapshot_observed_at":"2026-08-07T14:37:44.536944Z","submitted_at":"2025-05-23T12:42:50Z","title":"Stepwise Reasoning Checkpoint Analysis: A Test Time Scaling Method to Enhance LLMs' Reasoning","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T14:45:18.388703Z"},"links":{"cited_paper":"/paper/2408.03314","citing_paper":"/paper/2505.17829"},"observation_digest":"sha256:4158d60b26937486ca1fd09f454bea37df8c0d6146e4ae089e81a9957054b5af","observation_id":"8e2d8aad-fc61-4f3d-927e-56495a8c0ea2","resolution":{"observed_at":"2026-08-07T14:45:18.388703Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.16419","last_updated":"2025-08-21T19:14:40Z","snapshot_observed_at":"2026-08-07T04:27:23.738927Z","submitted_at":"2025-03-20T17:59:38Z","title":"Stop Overthinking: A Survey on Efficient Reasoning for Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.16419","snapshot_observed_at":"2026-08-07T14:45:18.474040Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17829","last_updated":"2025-05-23T12:42:50Z","snapshot_observed_at":"2026-08-07T14:37:44.536944Z","submitted_at":"2025-05-23T12:42:50Z","title":"Stepwise Reasoning Checkpoint Analysis: A Test Time Scaling Method to Enhance LLMs' Reasoning","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T14:45:18.474040Z"},"links":{"cited_paper":"/paper/2503.16419","citing_paper":"/paper/2505.17829"},"observation_digest":"sha256:6bb44d08c12abca24b104ced81568c1ed6d5b53490cde6f177d30487179b007f","observation_id":"d1c1ddc5-266a-468e-8699-bb896de78f2f","resolution":{"observed_at":"2026-08-07T14:45:18.474040Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.14275","last_updated":"2022-11-25T18:19:44Z","snapshot_observed_at":"2026-08-01T02:16:43.109337Z","submitted_at":"2022-11-25T18:19:44Z","title":"Solving math word problems with process- and outcome-based feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.14275","snapshot_observed_at":"2026-08-07T14:45:18.564018Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.17829","last_updated":"2025-05-23T12:42:50Z","snapshot_observed_at":"2026-08-07T14:37:44.536944Z","submitted_at":"2025-05-23T12:42:50Z","title":"Stepwise Reasoning Checkpoint Analysis: A Test Time Scaling Method to Enhance LLMs' Reasoning","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T14:45:18.564018Z"},"links":{"cited_paper":"/paper/2211.14275","citing_paper":"/paper/2505.17829"},"observation_digest":"sha256:466a879db0bf7d44f83b2d000a20dd545f1449eec8647c270184ecb3a44f3049","observation_id":"77f4f98b-17b4-4dde-9671-f1a15288d3a4","resolution":{"observed_at":"2026-08-07T14:45:18.564018Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:45:21.462731Z","title":null,"venue":null,"work_id":"ffaeec83-e5d7-4f1c-b797-9420a0670f2a","year":2024},"citing_paper":{"arxiv_id":"2505.17829","last_updated":"2025-05-23T12:42:50Z","snapshot_observed_at":"2026-08-07T14:37:44.536944Z","submitted_at":"2025-05-23T12:42:50Z","title":"Stepwise Reasoning Checkpoint Analysis: A Test Time Scaling Method to Enhance LLMs' Reasoning","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T14:45:18.664750Z"},"links":{"citing_paper":"/paper/2505.17829"},"observation_digest":"sha256:b9cc9b89d93f488b20995fb690b11cb69326c15b4140b55d988ea023a16745eb","observation_id":"a15fb25e-acc2-4aea-84cd-154f347a5f9e","resolution":{"observed_at":"2026-08-07T14:45:21.514394Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.09671","last_updated":"2024-10-12T23:42:16Z","snapshot_observed_at":"2026-08-04T14:33:36.204296Z","submitted_at":"2024-10-12T23:42:16Z","title":"OpenR: An Open Source Framework for Advanced Reasoning with Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.09671","snapshot_observed_at":"2026-08-07T14:45:18.769402Z","title":"Ni, Linyi Yang, Ying Wen, and Weinan Zhang","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17829","last_updated":"2025-05-23T12:42:50Z","snapshot_observed_at":"2026-08-07T14:37:44.536944Z","submitted_at":"2025-05-23T12:42:50Z","title":"Stepwise Reasoning Checkpoint Analysis: A Test Time Scaling Method to Enhance LLMs' Reasoning","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T14:45:18.769402Z"},"links":{"cited_paper":"/paper/2410.09671","citing_paper":"/paper/2505.17829"},"observation_digest":"sha256:7f99593bf3a54c28f48d96e3a792ab673b41db533ded0b0c3b0d1c70cade5bd8","observation_id":"3aa87878-559e-499f-a8ea-fbc5ec7b7e47","resolution":{"observed_at":"2026-08-07T14:45:18.769402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:45:18.860070Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17829","last_updated":"2025-05-23T12:42:50Z","snapshot_observed_at":"2026-08-07T14:37:44.536944Z","submitted_at":"2025-05-23T12:42:50Z","title":"Stepwise Reasoning Checkpoint Analysis: A Test Time Scaling Method to Enhance LLMs' Reasoning","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T14:45:18.860070Z"},"links":{"citing_paper":"/paper/2505.17829"},"observation_digest":"sha256:778f541f76b27248dad41dcb3347e0f621bfbb119a6062f643b34d2edbcb953f","observation_id":"db8b369f-b0ab-4444-9dac-49822359ca93","resolution":{"observed_at":"2026-08-07T14:45:18.860070Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.06508","last_updated":"2024-10-09T03:20:02Z","snapshot_observed_at":"2026-08-05T03:22:34.062603Z","submitted_at":"2024-10-09T03:20:02Z","title":"Towards Self-Improvement of LLMs via MCTS: Leveraging Stepwise Knowledge with Curriculum Preference Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.06508","snapshot_observed_at":"2026-08-07T14:45:18.952147Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17829","last_updated":"2025-05-23T12:42:50Z","snapshot_observed_at":"2026-08-07T14:37:44.536944Z","submitted_at":"2025-05-23T12:42:50Z","title":"Stepwise Reasoning Checkpoint Analysis: A Test Time Scaling Method to Enhance LLMs' Reasoning","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T14:45:18.952147Z"},"links":{"cited_paper":"/paper/2410.06508","citing_paper":"/paper/2505.17829"},"observation_digest":"sha256:7033c748ca362d5335ca59c76ca74402f69db8603222a5c27b3a2f264334fc45","observation_id":"a085871c-a7ba-4de6-806d-5b693720461d","resolution":{"observed_at":"2026-08-07T14:45:18.952147Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:45:19.024357Z","title":"Chi, Sharan Narang, Aakanksha Chowdhery, and Denny Zhou","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17829","last_updated":"2025-05-23T12:42:50Z","snapshot_observed_at":"2026-08-07T14:37:44.536944Z","submitted_at":"2025-05-23T12:42:50Z","title":"Stepwise Reasoning Checkpoint Analysis: A Test Time Scaling Method to Enhance LLMs' Reasoning","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T14:45:19.024357Z"},"links":{"citing_paper":"/paper/2505.17829"},"observation_digest":"sha256:7e1444493c27695986a2fe0b1daf7ab37c27fe0f4340f5e5dccd5e638fcf313d","observation_id":"86aacc1c-ec73-49e0-b39a-bd72eb478738","resolution":{"observed_at":"2026-08-07T14:45:19.024357Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16144","last_updated":"2025-03-17T06:04:48Z","snapshot_observed_at":"2026-08-05T13:50:55.335296Z","submitted_at":"2024-06-23T15:50:22Z","title":"Chain-of-Probe: Examining the Necessity and Accuracy of CoT Step-by-Step","version":2},"cited_work":{"arxiv_id":"2406.16144","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.16144","snapshot_observed_at":"2026-08-07T14:45:20.719720Z","title":"Chain-of-Probe: Examining the Necessity and Accuracy of CoT Step-by-Step","venue":"cs.CL","work_id":"537a7fb5-11bd-4615-84f8-89a509cccd90","year":2024},"citing_paper":{"arxiv_id":"2505.17829","last_updated":"2025-05-23T12:42:50Z","snapshot_observed_at":"2026-08-07T14:37:44.536944Z","submitted_at":"2025-05-23T12:42:50Z","title":"Stepwise Reasoning Checkpoint Analysis: A Test Time Scaling Method to Enhance LLMs' Reasoning","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T14:45:19.073344Z"},"links":{"cited_paper":"/paper/2406.16144","citing_paper":"/paper/2505.17829"},"observation_digest":"sha256:46649b976a31783cfe8a162319f5472dda877cda28841b860182398dc7577fb0","observation_id":"38e75dee-09bc-464f-9e5b-dbbb4e5cc9e8","resolution":{"observed_at":"2026-08-07T14:45:20.790255Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:45:19.142078Z","title":"Chi, Quoc V","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.17829","last_updated":"2025-05-23T12:42:50Z","snapshot_observed_at":"2026-08-07T14:37:44.536944Z","submitted_at":"2025-05-23T12:42:50Z","title":"Stepwise Reasoning Checkpoint Analysis: A Test Time Scaling Method to Enhance LLMs' Reasoning","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T14:45:19.142078Z"},"links":{"citing_paper":"/paper/2505.17829"},"observation_digest":"sha256:6613a0aad346beb864f191e07e9a1be91c21940dfee2ccc341c4cac7c1429e2c","observation_id":"834c6eb3-761f-43ec-b151-317162dcc95a","resolution":{"observed_at":"2026-08-07T14:45:19.142078Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.18478","last_updated":"2025-06-02T14:26:19Z","snapshot_observed_at":"2026-08-07T01:30:44.496004Z","submitted_at":"2024-11-27T16:19:00Z","title":"Beyond Examples: High-level Automated Reasoning Paradigm in In-Context Learning via MCTS","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.18478","snapshot_observed_at":"2026-08-07T14:45:19.217464Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17829","last_updated":"2025-05-23T12:42:50Z","snapshot_observed_at":"2026-08-07T14:37:44.536944Z","submitted_at":"2025-05-23T12:42:50Z","title":"Stepwise Reasoning Checkpoint Analysis: A Test Time Scaling Method to Enhance LLMs' Reasoning","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T14:45:19.217464Z"},"links":{"cited_paper":"/paper/2411.18478","citing_paper":"/paper/2505.17829"},"observation_digest":"sha256:965f8ff0dbe4e47a8c57d1274cc22d93a6805ef8637a2c8cf9c8a6087abba3ac","observation_id":"e76e0fb6-1f3d-40d6-b397-352717e997df","resolution":{"observed_at":"2026-08-07T14:45:19.217464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13639","last_updated":"2024-10-22T22:05:16Z","snapshot_observed_at":"2026-08-07T03:12:05.820669Z","submitted_at":"2024-10-17T15:09:03Z","title":"A Comparative Study on Reasoning Patterns of OpenAI's o1 Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.13639","snapshot_observed_at":"2026-08-07T14:45:19.282901Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17829","last_updated":"2025-05-23T12:42:50Z","snapshot_observed_at":"2026-08-07T14:37:44.536944Z","submitted_at":"2025-05-23T12:42:50Z","title":"Stepwise Reasoning Checkpoint Analysis: A Test Time Scaling Method to Enhance LLMs' Reasoning","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T14:45:19.282901Z"},"links":{"cited_paper":"/paper/2410.13639","citing_paper":"/paper/2505.17829"},"observation_digest":"sha256:07b7e054d354d363712ac7f2251360db40213ac1b1943c17b659a3c9050e988a","observation_id":"984c6ccb-4398-4e84-a8da-5fdbe806bc49","resolution":{"observed_at":"2026-08-07T14:45:19.282901Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.07266","last_updated":"2025-05-27T02:56:52Z","snapshot_observed_at":"2026-08-07T06:50:02.841285Z","submitted_at":"2025-02-11T05:28:59Z","title":"When More is Less: Understanding Chain-of-Thought Length in LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.07266","snapshot_observed_at":"2026-08-07T14:45:19.333659Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17829","last_updated":"2025-05-23T12:42:50Z","snapshot_observed_at":"2026-08-07T14:37:44.536944Z","submitted_at":"2025-05-23T12:42:50Z","title":"Stepwise Reasoning Checkpoint Analysis: A Test Time Scaling Method to Enhance LLMs' Reasoning","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T14:45:19.333659Z"},"links":{"cited_paper":"/paper/2502.07266","citing_paper":"/paper/2505.17829"},"observation_digest":"sha256:baac53f3c84767e496a26e38a2cf2f199255e537fb53708ccf1c7c25fed42882","observation_id":"10c14ed8-4a82-4f5e-923e-154a71b61934","resolution":{"observed_at":"2026-08-07T14:45:19.333659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.16579","last_updated":"2024-11-25T17:11:54Z","snapshot_observed_at":"2026-07-06T19:56:39.115630Z","submitted_at":"2024-11-25T17:11:54Z","title":"Enhancing LLM Reasoning via Critique Models with Test-Time and Training-Time Supervision","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.16579","snapshot_observed_at":"2026-08-07T14:45:19.417118Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17829","last_updated":"2025-05-23T12:42:50Z","snapshot_observed_at":"2026-08-07T14:37:44.536944Z","submitted_at":"2025-05-23T12:42:50Z","title":"Stepwise Reasoning Checkpoint Analysis: A Test Time Scaling Method to Enhance LLMs' Reasoning","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T14:45:19.417118Z"},"links":{"cited_paper":"/paper/2411.16579","citing_paper":"/paper/2505.17829"},"observation_digest":"sha256:1708790b2e07b6ffef3fd44d42e1a0b467dd66b70e0132b19934e1a26e78cc3d","observation_id":"e23b3e40-b19e-44cb-9332-01a0262f1503","resolution":{"observed_at":"2026-08-07T14:45:19.417118Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.04682","last_updated":"2025-01-08T18:42:48Z","snapshot_observed_at":"2026-07-06T20:18:21.419068Z","submitted_at":"2025-01-08T18:42:48Z","title":"Towards System 2 Reasoning in LLMs: Learning How to Think With Meta Chain-of-Thought","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.04682","snapshot_observed_at":"2026-08-07T14:45:19.472575Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17829","last_updated":"2025-05-23T12:42:50Z","snapshot_observed_at":"2026-08-07T14:37:44.536944Z","submitted_at":"2025-05-23T12:42:50Z","title":"Stepwise Reasoning Checkpoint Analysis: A Test Time Scaling Method to Enhance LLMs' Reasoning","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-07T14:45:19.472575Z"},"links":{"cited_paper":"/paper/2501.04682","citing_paper":"/paper/2505.17829"},"observation_digest":"sha256:8f48043a9c79931082ff19731f4d6479792926ea8bd5c63ebfee1d542975050b","observation_id":"13e43f31-d822-4b72-a7f6-63725eaf9c21","resolution":{"observed_at":"2026-08-07T14:45:19.472575Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:45:19.536322Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17829","last_updated":"2025-05-23T12:42:50Z","snapshot_observed_at":"2026-08-07T14:37:44.536944Z","submitted_at":"2025-05-23T12:42:50Z","title":"Stepwise Reasoning Checkpoint Analysis: A Test Time Scaling Method to Enhance LLMs' Reasoning","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-07T14:45:19.536322Z"},"links":{"citing_paper":"/paper/2505.17829"},"observation_digest":"sha256:8295ca476dba57b3be0c777ec68193598b9cf4444ba13a96897ef75856a50771","observation_id":"85cb7881-06b8-4663-b4dc-993a664390ef","resolution":{"observed_at":"2026-08-07T14:45:19.536322Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-08-07T14:45:19.631357Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17829","last_updated":"2025-05-23T12:42:50Z","snapshot_observed_at":"2026-08-07T14:37:44.536944Z","submitted_at":"2025-05-23T12:42:50Z","title":"Stepwise Reasoning Checkpoint Analysis: A Test Time Scaling Method to Enhance LLMs' Reasoning","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-07T14:45:19.631357Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2505.17829"},"observation_digest":"sha256:f9d4a0102d80c6ede53a87cfbedab7f21e83056eba972f9370d57e7a6b90888b","observation_id":"0aee6a39-b94b-4531-8ad2-82b8a53dfab7","resolution":{"observed_at":"2026-08-07T14:45:19.631357Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:45:21.305182Z","title":null,"venue":null,"work_id":"5ec1bb9e-c394-4af5-8fd9-428134419f5b","year":2024},"citing_paper":{"arxiv_id":"2505.17829","last_updated":"2025-05-23T12:42:50Z","snapshot_observed_at":"2026-08-07T14:37:44.536944Z","submitted_at":"2025-05-23T12:42:50Z","title":"Stepwise Reasoning Checkpoint Analysis: A Test Time Scaling Method to Enhance LLMs' Reasoning","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-07T14:45:19.734663Z"},"links":{"citing_paper":"/paper/2505.17829"},"observation_digest":"sha256:63bf67d7af4c65b8fca5e19a1bdb32d44d9c57d2530dc739736001bf12b2cc8c","observation_id":"62608014-6a3b-4aaa-9240-9b01f50e2ffb","resolution":{"observed_at":"2026-08-07T14:45:21.351151Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.17256","last_updated":"2025-03-04T06:29:50Z","snapshot_observed_at":"2026-07-06T20:11:55.722067Z","submitted_at":"2024-12-23T03:58:34Z","title":"B-STaR: Monitoring and Balancing Exploration and Exploitation in Self-Taught Reasoners","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.17256","snapshot_observed_at":"2026-08-07T14:45:19.802170Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17829","last_updated":"2025-05-23T12:42:50Z","snapshot_observed_at":"2026-08-07T14:37:44.536944Z","submitted_at":"2025-05-23T12:42:50Z","title":"Stepwise Reasoning Checkpoint Analysis: A Test Time Scaling Method to Enhance LLMs' Reasoning","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-07T14:45:19.802170Z"},"links":{"cited_paper":"/paper/2412.17256","citing_paper":"/paper/2505.17829"},"observation_digest":"sha256:6eb1c8ab0b1151a2809be9b2d8e8c05f11b218c18936fcc7ee5fc51323c54f1b","observation_id":"74de4af0-8adf-4a44-9744-56519d94e536","resolution":{"observed_at":"2026-08-07T14:45:19.802170Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.07394","last_updated":"2024-06-13T07:19:06Z","snapshot_observed_at":"2026-07-06T18:29:00.001236Z","submitted_at":"2024-06-11T16:01:07Z","title":"Accessing GPT-4 level Mathematical Olympiad Solutions via Monte Carlo Tree Self-refine with LLaMa-3 8B","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.07394","snapshot_observed_at":"2026-08-07T14:45:19.883202Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17829","last_updated":"2025-05-23T12:42:50Z","snapshot_observed_at":"2026-08-07T14:37:44.536944Z","submitted_at":"2025-05-23T12:42:50Z","title":"Stepwise Reasoning Checkpoint Analysis: A Test Time Scaling Method to Enhance LLMs' Reasoning","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-07T14:45:19.883202Z"},"links":{"cited_paper":"/paper/2406.07394","citing_paper":"/paper/2505.17829"},"observation_digest":"sha256:06c3e33af289f91ee07375ed6015cbb1ef3b2dcef75c14868f610617e2e41f3f","observation_id":"fb9a8d92-a6fb-4231-9b1a-804b31ec998f","resolution":{"observed_at":"2026-08-07T14:45:19.883202Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.15240","last_updated":"2025-02-22T10:21:46Z","snapshot_observed_at":"2026-07-06T19:06:41.697671Z","submitted_at":"2024-08-27T17:57:45Z","title":"Generative Verifiers: Reward Modeling as Next-Token Prediction","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.15240","snapshot_observed_at":"2026-08-07T14:45:19.980989Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17829","last_updated":"2025-05-23T12:42:50Z","snapshot_observed_at":"2026-08-07T14:37:44.536944Z","submitted_at":"2025-05-23T12:42:50Z","title":"Stepwise Reasoning Checkpoint Analysis: A Test Time Scaling Method to Enhance LLMs' Reasoning","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-07T14:45:19.980989Z"},"links":{"cited_paper":"/paper/2408.15240","citing_paper":"/paper/2505.17829"},"observation_digest":"sha256:62d65eaa544bafea2f49f80c01fcf610db49f23a7224ee82c83302de14b3a3a3","observation_id":"f03cbe38-d485-4e5e-8883-c58344b01d95","resolution":{"observed_at":"2026-08-07T14:45:19.980989Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.24235","last_updated":"2025-05-04T15:48:08Z","snapshot_observed_at":"2026-08-07T23:06:45.603790Z","submitted_at":"2025-03-31T15:46:15Z","title":"A Survey on Test-Time Scaling in Large Language Models: What, How, Where, and How Well?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.24235","snapshot_observed_at":"2026-08-07T14:45:20.078930Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17829","last_updated":"2025-05-23T12:42:50Z","snapshot_observed_at":"2026-08-07T14:37:44.536944Z","submitted_at":"2025-05-23T12:42:50Z","title":"Stepwise Reasoning Checkpoint Analysis: A Test Time Scaling Method to Enhance LLMs' Reasoning","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-07T14:45:20.078930Z"},"links":{"cited_paper":"/paper/2503.24235","citing_paper":"/paper/2505.17829"},"observation_digest":"sha256:d1f425cadac01c413cda1a4c008fb924e505d4c89d4cb4be3a91c3252bc5c744","observation_id":"9ac2fd92-d22d-4ebe-a714-758e178760ec","resolution":{"observed_at":"2026-08-07T14:45:20.078930Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.14405","last_updated":"2024-11-25T17:57:55Z","snapshot_observed_at":"2026-07-06T19:53:56.407834Z","submitted_at":"2024-11-21T18:37:33Z","title":"Marco-o1: Towards Open Reasoning Models for Open-Ended Solutions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.14405","snapshot_observed_at":"2026-08-07T14:45:20.163992Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17829","last_updated":"2025-05-23T12:42:50Z","snapshot_observed_at":"2026-08-07T14:37:44.536944Z","submitted_at":"2025-05-23T12:42:50Z","title":"Stepwise Reasoning Checkpoint Analysis: A Test Time Scaling Method to Enhance LLMs' Reasoning","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-07T14:45:20.163992Z"},"links":{"cited_paper":"/paper/2411.14405","citing_paper":"/paper/2505.17829"},"observation_digest":"sha256:773fa8651913b3f44d79bfc367903c3ce065d71254999ff9585121fd4100e8e0","observation_id":"b5839cb0-47d4-4ac5-98dd-348c6f1c80cd","resolution":{"observed_at":"2026-08-07T14:45:20.163992Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06559","last_updated":"2025-05-26T14:03:32Z","snapshot_observed_at":"2026-08-05T20:30:49.812919Z","submitted_at":"2024-12-09T15:11:40Z","title":"ProcessBench: Identifying Process Errors in Mathematical Reasoning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.06559","snapshot_observed_at":"2026-08-07T14:45:20.276917Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17829","last_updated":"2025-05-23T12:42:50Z","snapshot_observed_at":"2026-08-07T14:37:44.536944Z","submitted_at":"2025-05-23T12:42:50Z","title":"Stepwise Reasoning Checkpoint Analysis: A Test Time Scaling Method to Enhance LLMs' Reasoning","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-07T14:45:20.276917Z"},"links":{"cited_paper":"/paper/2412.06559","citing_paper":"/paper/2505.17829"},"observation_digest":"sha256:3df98642eaa1a1cf75ae2a8d9d2e055e7010f4ea2b53ae32332d003c68594ab9","observation_id":"2e2d339d-9926-4eb1-a780-9707b0305fe9","resolution":{"observed_at":"2026-08-07T14:45:20.276917Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:45:20.356452Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.17829","last_updated":"2025-05-23T12:42:50Z","snapshot_observed_at":"2026-08-07T14:37:44.536944Z","submitted_at":"2025-05-23T12:42:50Z","title":"Stepwise Reasoning Checkpoint Analysis: A Test Time Scaling Method to Enhance LLMs' Reasoning","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-07T14:45:20.356452Z"},"links":{"citing_paper":"/paper/2505.17829"},"observation_digest":"sha256:9fefab176d9e16b5df0e4610ade2b67a55aac1d0f65c3ecfe505d21dde87500a","observation_id":"9cc3677d-eeab-4864-a7b2-214235b9b7de","resolution":{"observed_at":"2026-08-07T14:45:20.356452Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:45:20.428126Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.17829","last_updated":"2025-05-23T12:42:50Z","snapshot_observed_at":"2026-08-07T14:37:44.536944Z","submitted_at":"2025-05-23T12:42:50Z","title":"Stepwise Reasoning Checkpoint Analysis: A Test Time Scaling Method to Enhance LLMs' Reasoning","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-07T14:45:20.428126Z"},"links":{"citing_paper":"/paper/2505.17829"},"observation_digest":"sha256:35633909ac578ca5d555d19077068f53b944ce3385c7198d97bf0bcfa5510606","observation_id":"938ded77-216d-48cf-82da-478b2e82f1c6","resolution":{"observed_at":"2026-08-07T14:45:20.428126Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.17829","last_updated":"2025-05-23T12:42:50Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T14:37:44.536944Z","submitted_at":"2025-05-23T12:42:50Z","title":"Stepwise Reasoning Checkpoint Analysis: A Test Time Scaling Method to Enhance LLMs' Reasoning"},"reference_resolution":{"displayed":53,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":52,"verified_exact":1,"verified_fuzzy":0},"total_outbound_references":53},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 53 of 53 outbound references and 0 inbound Pith citation observations for arXiv:2505.17829."}