{"as_of":"2026-08-21T10:04:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:aaf0f76f29e034b70407e2181e937d98f16b8e84741d2a5a87424d4dc931bc69","coverage":[{"denominator":12,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":12,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T00:39:40.310336Z","state":"measured"},{"denominator":12,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":12,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-21T06:32:19.484+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.11573/citation-record","integrity":"/paper/2608.11573/integrity","json":"/paper/2608.11573/citation-record.json","paper":"/paper/2608.11573"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-16T00:39:40.277681Z","title":"The previous step is incorrect","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.11573","last_updated":"2026-08-12T02:31:02Z","snapshot_observed_at":"2026-08-20T14:55:31.373912Z","submitted_at":"2026-08-12T02:31:02Z","title":"Reinforcing Step-level Reasoning for Effective Self-Correction in LLMs","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-16T00:39:40.277681Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2608.11573"},"observation_digest":"sha256:7a34b539fc1eb211fd8af2482350300b5940f811fe2987f45ef2fd2d977a5bb9","observation_id":"0b4dbb9e-5496-4b0c-88aa-1b02cb3d0648","resolution":{"observed_at":"2026-08-16T00:39:40.277681Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:39:40.451380Z","title":"Step 3: We also know that cos(90◦−x) is equal to the sine of the angle x","venue":null,"work_id":"837b60ef-7f07-4f42-a6fb-19453a936829","year":null},"citing_paper":{"arxiv_id":"2608.11573","last_updated":"2026-08-12T02:31:02Z","snapshot_observed_at":"2026-08-20T14:55:31.373912Z","submitted_at":"2026-08-12T02:31:02Z","title":"Reinforcing Step-level Reasoning for Effective Self-Correction in LLMs","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-16T00:39:40.292569Z"},"links":{"citing_paper":"/paper/2608.11573"},"observation_digest":"sha256:6c4785e50da67bf365010fb49dbd02f99e4af1eb657d4ced86cf83986220986c","observation_id":"6f6ccfc7-49ed-4b0a-8822-578c9f82c82a","resolution":{"observed_at":"2026-08-16T00:39:40.455410Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:39:40.437717Z","title":"Step 4: However, statement D says that sin(90◦−x)−cos = 0","venue":null,"work_id":"8db801be-337d-495c-94fd-50316f1dba80","year":null},"citing_paper":{"arxiv_id":"2608.11573","last_updated":"2026-08-12T02:31:02Z","snapshot_observed_at":"2026-08-20T14:55:31.373912Z","submitted_at":"2026-08-12T02:31:02Z","title":"Reinforcing Step-level Reasoning for Effective Self-Correction in LLMs","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-16T00:39:40.297381Z"},"links":{"citing_paper":"/paper/2608.11573"},"observation_digest":"sha256:5f2639f9a5b110acf6994f5436b3cd389096f5f4069200283e9ffd37a081e9bc","observation_id":"a634803b-fda7-40e8-b964-d2cd3b638d6d","resolution":{"observed_at":"2026-08-16T00:39:40.442763Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:39:40.424846Z","title":"This means that statement D is also true","venue":null,"work_id":"11d6c4c0-54c1-4f0e-bd80-c28ae79539ae","year":null},"citing_paper":{"arxiv_id":"2608.11573","last_updated":"2026-08-12T02:31:02Z","snapshot_observed_at":"2026-08-20T14:55:31.373912Z","submitted_at":"2026-08-12T02:31:02Z","title":"Reinforcing Step-level Reasoning for Effective Self-Correction in LLMs","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-16T00:39:40.301184Z"},"links":{"citing_paper":"/paper/2608.11573"},"observation_digest":"sha256:d9077a04b90ee145ee345ef24fb7d0c8d9bf8917bdd78d1c605b69c8e81b4367","observation_id":"83eac602-4e30-4eba-841f-1bf4f7f69500","resolution":{"observed_at":"2026-08-16T00:39:40.429595Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:39:40.409300Z","title":"This means statement D is true","venue":null,"work_id":"25087860-1728-4c10-bbdf-ffe54625143f","year":null},"citing_paper":{"arxiv_id":"2608.11573","last_updated":"2026-08-12T02:31:02Z","snapshot_observed_at":"2026-08-20T14:55:31.373912Z","submitted_at":"2026-08-12T02:31:02Z","title":"Reinforcing Step-level Reasoning for Effective Self-Correction in LLMs","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-16T00:39:40.305111Z"},"links":{"citing_paper":"/paper/2608.11573"},"observation_digest":"sha256:fe68bb025549ff1ff94cd0537f73b847e03a0c204dbc0c47fa7330b453c0225d","observation_id":"338f381c-c27d-49bd-bb9c-c229de23e6f1","resolution":{"observed_at":"2026-08-16T00:39:40.415584Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:39:40.396496Z","title":"A\",A,N); label(","venue":null,"work_id":"fab1a007-0280-4938-a1b3-c6580acdae93","year":null},"citing_paper":{"arxiv_id":"2608.11573","last_updated":"2026-08-12T02:31:02Z","snapshot_observed_at":"2026-08-20T14:55:31.373912Z","submitted_at":"2026-08-12T02:31:02Z","title":"Reinforcing Step-level Reasoning for Effective Self-Correction in LLMs","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-16T00:39:40.310336Z"},"links":{"citing_paper":"/paper/2608.11573"},"observation_digest":"sha256:b963049c584608ac486c06b853833e88601f0ead8717942b7b9a27c8fa90d743","observation_id":"55c1e178-06dc-49be-85b3-3899a94aa7c0","resolution":{"observed_at":"2026-08-16T00:39:40.401206Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:39:40.477506Z","title":"Self-Fix Step-DPO","venue":null,"work_id":"a17273ae-c531-4cc6-8580-86b843484fee","year":2025},"citing_paper":{"arxiv_id":"2608.11573","last_updated":"2026-08-12T02:31:02Z","snapshot_observed_at":"2026-08-20T14:55:31.373912Z","submitted_at":"2026-08-12T02:31:02Z","title":"Reinforcing Step-level Reasoning for Effective Self-Correction in LLMs","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-16T00:39:40.282769Z"},"links":{"citing_paper":"/paper/2608.11573"},"observation_digest":"sha256:0e14bd4217f5527a07aaedb4f9ee24279e5447702a569b0a23ede0a099c92701","observation_id":"392bd7db-73f7-4285-908d-325c50e71ae7","resolution":{"observed_at":"2026-08-16T00:39:40.481772Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:39:40.463854Z","title":"Step 2: We also know that sin(90◦−x) is equal to the cosine of the angle x","venue":null,"work_id":"9ed44683-e17f-4164-902b-b04c145bd9f6","year":null},"citing_paper":{"arxiv_id":"2608.11573","last_updated":"2026-08-12T02:31:02Z","snapshot_observed_at":"2026-08-20T14:55:31.373912Z","submitted_at":"2026-08-12T02:31:02Z","title":"Reinforcing Step-level Reasoning for Effective Self-Correction in LLMs","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-16T00:39:40.288648Z"},"links":{"citing_paper":"/paper/2608.11573"},"observation_digest":"sha256:04b9691d40d31fe9f6c1f5a89754bf5b17ca2f541b8e153766920b54b0ded75b","observation_id":"c57ee289-d893-4cc4-9b24-f9cdefb47a5d","resolution":{"observed_at":"2026-08-16T00:39:40.468479Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-14T02:43:01.480086Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-16T00:39:40.262632Z","title":"Aaron Grattafiori, Abhimanyu Dubey, Abhinav Jauhri, Abhinav Pandey, Abhishek Kadian, Ahmad Al- Dahle, Aiesha Letman, Akhil Mathur, Alan Schelten, Alex Vaughan, et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.11573","last_updated":"2026-08-12T02:31:02Z","snapshot_observed_at":"2026-08-20T14:55:31.373912Z","submitted_at":"2026-08-12T02:31:02Z","title":"Reinforcing Step-level Reasoning for Effective Self-Correction in LLMs","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-16T00:39:40.262632Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2608.11573"},"observation_digest":"sha256:93a546b8c436dff169edc7cdb71afd83e20601a687bfd1bd02223ed06ac73f61","observation_id":"016a804a-8923-41f7-814e-e6e50390ca2c","resolution":{"observed_at":"2026-08-16T00:39:40.262632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.12853","last_updated":"2025-02-18T13:40:22Z","snapshot_observed_at":"2026-08-20T14:52:25.331105Z","submitted_at":"2025-02-18T13:40:22Z","title":"S$^2$R: Teaching LLMs to Self-verify and Self-correct via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.12853","snapshot_observed_at":"2026-08-16T00:39:40.272768Z","title":"InThe Twelfth Inter- national Conference on Learning Representations","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.11573","last_updated":"2026-08-12T02:31:02Z","snapshot_observed_at":"2026-08-20T14:55:31.373912Z","submitted_at":"2026-08-12T02:31:02Z","title":"Reinforcing Step-level Reasoning for Effective Self-Correction in LLMs","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-16T00:39:40.272768Z"},"links":{"cited_paper":"/paper/2502.12853","citing_paper":"/paper/2608.11573"},"observation_digest":"sha256:b9ec2f6751c719b134e681549df16d2ec1ef75a2b6a52e98ee97ff99755a974d","observation_id":"687c8283-b00e-4b9b-bef2-1f2890cdce7f","resolution":{"observed_at":"2026-08-16T00:39:40.272768Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09567","last_updated":"2025-07-18T15:57:54Z","snapshot_observed_at":"2026-08-08T22:33:20.124926Z","submitted_at":"2025-03-12T17:35:03Z","title":"Towards Reasoning Era: A Survey of Long Chain-of-Thought for Reasoning Large Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.09567","snapshot_observed_at":"2026-08-16T00:39:40.257518Z","title":"InFindings of the Associ- ation for Computational Linguistics: EMNLP 2024, pages 7889–7903, Miami, Florida, USA","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.11573","last_updated":"2026-08-12T02:31:02Z","snapshot_observed_at":"2026-08-20T14:55:31.373912Z","submitted_at":"2026-08-12T02:31:02Z","title":"Reinforcing Step-level Reasoning for Effective Self-Correction in LLMs","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-16T00:39:40.257518Z"},"links":{"cited_paper":"/paper/2503.09567","citing_paper":"/paper/2608.11573"},"observation_digest":"sha256:1a949c4c25bd311ca3e41ecbd91f94e6c7330656b1dbd7d36ecc35b576d30b09","observation_id":"5d20e18f-ae24-43ad-8236-ee56709e7577","resolution":{"observed_at":"2026-08-16T00:39:40.257518Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.18629","last_updated":"2024-06-26T17:43:06Z","snapshot_observed_at":"2026-08-06T00:24:52.274888Z","submitted_at":"2024-06-26T17:43:06Z","title":"Step-DPO: Step-wise Preference Optimization for Long-chain Reasoning of LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.18629","snapshot_observed_at":"2026-08-16T00:39:40.267792Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.11573","last_updated":"2026-08-12T02:31:02Z","snapshot_observed_at":"2026-08-20T14:55:31.373912Z","submitted_at":"2026-08-12T02:31:02Z","title":"Reinforcing Step-level Reasoning for Effective Self-Correction in LLMs","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-16T00:39:40.267792Z"},"links":{"cited_paper":"/paper/2406.18629","citing_paper":"/paper/2608.11573"},"observation_digest":"sha256:2f3cb33138ccaca47506d1f63eea494c8273a938947f2da36f65a4fd756b958c","observation_id":"2ba0f0b6-a43d-400e-84d0-9177250c6a24","resolution":{"observed_at":"2026-08-16T00:39:40.267792Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.11573","last_updated":"2026-08-12T02:31:02Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-20T14:55:31.373912Z","submitted_at":"2026-08-12T02:31:02Z","title":"Reinforcing Step-level Reasoning for Effective Self-Correction in LLMs"},"reference_resolution":{"displayed":12,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":5,"verified_exact":0,"verified_fuzzy":7},"total_outbound_references":12},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"thesis":"As of 21 August 2026, this Paper Citation Record lists 12 of 12 outbound references and 0 inbound Pith citation observations for arXiv:2608.11573."}