{"as_of":"2026-08-20T09:11:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:43a56503a92e40a405586ae79dc42b9c3f00399bd2bd8f9aa8968df0ffd1ad26","coverage":[{"denominator":46,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":46,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T19:33:54.839855Z","state":"measured"},{"denominator":47,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":47,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T23:01:35.680054Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-10T23:01:37.846397Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.15894","last_updated":"2025-06-18T21:35:44Z","snapshot_observed_at":"2026-08-18T19:03:02.299434Z","submitted_at":"2025-06-18T21:35:44Z","title":"Language Models can perform Single-Utterance Self-Correction of Perturbed Reasoning","version":1},"cited_work":{"arxiv_id":"2506.15894","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.15894","snapshot_observed_at":"2026-08-10T23:01:37.846397Z","title":"Language Models can perform Single-Utterance Self-Correction of Perturbed Reasoning","venue":"cs.CL","work_id":"6efc19b6-d8fb-4ad3-9130-718ae2a19cc6","year":2025},"citing_paper":{"arxiv_id":"2608.06663","last_updated":"2026-08-07T00:19:48Z","snapshot_observed_at":"2026-08-20T07:06:19.804536Z","submitted_at":"2026-08-07T00:19:48Z","title":"The Horizon Gap: Planning, Memory, Execution, Training, and Evaluation for Long-Horizon LLM Agents","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-10T23:01:35.680054Z"},"links":{"cited_paper":"/paper/2506.15894","citing_paper":"/paper/2608.06663"},"observation_digest":"sha256:c5b1737748c6b222c6b7ad836f8718df8b5ecab7cc154a1f486c1351c6efb1b0","observation_id":"db5d97df-474b-4f8f-b5c5-96f76572501f","resolution":{"observed_at":"2026-08-10T23:01:37.849405Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.15894/citation-record","integrity":"/paper/2506.15894/integrity","json":"/paper/2506.15894/citation-record.json","paper":"/paper/2506.15894"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:33:53.957224Z","title":"URL: \" 'urlintro :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.15894","last_updated":"2025-06-18T21:35:44Z","snapshot_observed_at":"2026-08-18T19:03:02.299434Z","submitted_at":"2025-06-18T21:35:44Z","title":"Language Models can perform Single-Utterance Self-Correction of Perturbed Reasoning","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-15T19:33:53.957224Z"},"links":{"citing_paper":"/paper/2506.15894"},"observation_digest":"sha256:a1412b8ba2c74527b1f5b7626691b517a7cfff25cd7b42a48a4d7fb682471e50","observation_id":"b1d2c308-0f4f-4b48-a375-6afb39218b7a","resolution":{"observed_at":"2026-08-15T19:33:53.957224Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:33:53.964661Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.15894","last_updated":"2025-06-18T21:35:44Z","snapshot_observed_at":"2026-08-18T19:03:02.299434Z","submitted_at":"2025-06-18T21:35:44Z","title":"Language Models can perform Single-Utterance Self-Correction of Perturbed Reasoning","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-15T19:33:53.964661Z"},"links":{"citing_paper":"/paper/2506.15894"},"observation_digest":"sha256:5f811e659f2dbcbe87873b1aae68ace9568bc35093ffdc01056b59ab05e29af1","observation_id":"05bb489f-7a69-4f93-bb55-4b2cc28bfa5a","resolution":{"observed_at":"2026-08-15T19:33:53.964661Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:33:55.456227Z","title":null,"venue":null,"work_id":"68b8937d-2f1a-4121-a516-2b0e84aed15f","year":2024},"citing_paper":{"arxiv_id":"2506.15894","last_updated":"2025-06-18T21:35:44Z","snapshot_observed_at":"2026-08-18T19:03:02.299434Z","submitted_at":"2025-06-18T21:35:44Z","title":"Language Models can perform Single-Utterance Self-Correction of Perturbed Reasoning","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-15T19:33:53.969867Z"},"links":{"citing_paper":"/paper/2506.15894"},"observation_digest":"sha256:351f7a0ca2af010621618dc46f28d67cb007f95fa9476bdf566579c789f8dbb2","observation_id":"767933c0-e40a-4241-a3c3-dc3818b7d4bf","resolution":{"observed_at":"2026-08-15T19:33:55.460400Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.08073","last_updated":"2022-12-15T06:19:23Z","snapshot_observed_at":"2026-08-16T03:49:00.703994Z","submitted_at":"2022-12-15T06:19:23Z","title":"Constitutional AI: Harmlessness from AI Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.08073","snapshot_observed_at":"2026-08-15T19:33:53.976508Z","title":"Bowman, Zac Hatfield-Dodds, Ben Mann, Dario Amodei, Nicholas Joseph, Sam McCandlish, Tom Brown, and Jared Kaplan","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.15894","last_updated":"2025-06-18T21:35:44Z","snapshot_observed_at":"2026-08-18T19:03:02.299434Z","submitted_at":"2025-06-18T21:35:44Z","title":"Language Models can perform Single-Utterance Self-Correction of Perturbed Reasoning","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-15T19:33:53.976508Z"},"links":{"cited_paper":"/paper/2212.08073","citing_paper":"/paper/2506.15894"},"observation_digest":"sha256:2799e3de1d5a84c8eb4198b3b23f489199fb36238bd17a63a54cca1fc67382eb","observation_id":"401b5893-0aa5-43f7-9057-64166c8d0a5d","resolution":{"observed_at":"2026-08-15T19:33:53.976508Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:33:55.442369Z","title":"Chi, Xuezhi Wang, and Denny Zhou","venue":null,"work_id":"f9a9a6c8-91b1-4281-801f-6160a0290f42","year":2024},"citing_paper":{"arxiv_id":"2506.15894","last_updated":"2025-06-18T21:35:44Z","snapshot_observed_at":"2026-08-18T19:03:02.299434Z","submitted_at":"2025-06-18T21:35:44Z","title":"Language Models can perform Single-Utterance Self-Correction of Perturbed Reasoning","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-15T19:33:53.983438Z"},"links":{"citing_paper":"/paper/2506.15894"},"observation_digest":"sha256:e1365b9eaf7d831ba4064e45c79b898cf743b1c5d39d264c254b7c7c1f293f97","observation_id":"231bf377-ee60-4a7e-9508-9b5ab3979179","resolution":{"observed_at":"2026-08-15T19:33:55.447309Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-14T02:43:01.480086Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-15T19:33:53.987138Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.15894","last_updated":"2025-06-18T21:35:44Z","snapshot_observed_at":"2026-08-18T19:03:02.299434Z","submitted_at":"2025-06-18T21:35:44Z","title":"Language Models can perform Single-Utterance Self-Correction of Perturbed Reasoning","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-15T19:33:53.987138Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2506.15894"},"observation_digest":"sha256:4d786711961951b61d58a3b0c059aee01cd09e8074e995a6232d89b52e904873","observation_id":"b3f692f1-5343-4fe2-8ad4-004663832e00","resolution":{"observed_at":"2026-08-15T19:33:53.987138Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:33:55.430326Z","title":null,"venue":null,"work_id":"afde8764-c6d8-43b7-a2d4-8f9b43fda5f4","year":2024},"citing_paper":{"arxiv_id":"2506.15894","last_updated":"2025-06-18T21:35:44Z","snapshot_observed_at":"2026-08-18T19:03:02.299434Z","submitted_at":"2025-06-18T21:35:44Z","title":"Language Models can perform Single-Utterance Self-Correction of Perturbed Reasoning","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-15T19:33:53.992309Z"},"links":{"citing_paper":"/paper/2506.15894"},"observation_digest":"sha256:cdaf6c732bfc4a5151bf0b9b9641a9c19399290141c92614ebeaa1d5cf8ecd75","observation_id":"60e2ac70-cd89-40f8-af5c-34abb15ae2e3","resolution":{"observed_at":"2026-08-15T19:33:55.434121Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01377","last_updated":"2024-07-16T03:24:39Z","snapshot_observed_at":"2026-08-14T00:28:11.851309Z","submitted_at":"2023-10-02T17:40:01Z","title":"UltraFeedback: Boosting Language Models with Scaled AI Feedback","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.01377","snapshot_observed_at":"2026-08-15T19:33:53.997464Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.15894","last_updated":"2025-06-18T21:35:44Z","snapshot_observed_at":"2026-08-18T19:03:02.299434Z","submitted_at":"2025-06-18T21:35:44Z","title":"Language Models can perform Single-Utterance Self-Correction of Perturbed Reasoning","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-15T19:33:53.997464Z"},"links":{"cited_paper":"/paper/2310.01377","citing_paper":"/paper/2506.15894"},"observation_digest":"sha256:bdc80d51d8652aefb0eb030e701aca4b72818fba6e8a27298ffd0f88273fbe89","observation_id":"d1898f2c-7a3d-4661-be7b-19dbc075f51c","resolution":{"observed_at":"2026-08-15T19:33:53.997464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:33:55.418095Z","title":null,"venue":null,"work_id":"ed8129ad-d3e4-4c7d-bf1b-6585da713db5","year":2025},"citing_paper":{"arxiv_id":"2506.15894","last_updated":"2025-06-18T21:35:44Z","snapshot_observed_at":"2026-08-18T19:03:02.299434Z","submitted_at":"2025-06-18T21:35:44Z","title":"Language Models can perform Single-Utterance Self-Correction of Perturbed Reasoning","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-15T19:33:54.002805Z"},"links":{"citing_paper":"/paper/2506.15894"},"observation_digest":"sha256:39679fca6835261f01d8e04e08b6cbe4e66b79d28c97261dd91d54010908719a","observation_id":"f752762e-1773-4986-81b3-b89f30e0f460","resolution":{"observed_at":"2026-08-15T19:33:55.422162Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14325","last_updated":"2023-05-23T17:55:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-23T17:55:11Z","title":"Improving Factuality and Reasoning in Language Models through Multiagent Debate","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.14325","snapshot_observed_at":"2026-08-15T19:33:54.011810Z","title":"Tenenbaum, and Igor Mordatch","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.15894","last_updated":"2025-06-18T21:35:44Z","snapshot_observed_at":"2026-08-18T19:03:02.299434Z","submitted_at":"2025-06-18T21:35:44Z","title":"Language Models can perform Single-Utterance Self-Correction of Perturbed Reasoning","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-15T19:33:54.011810Z"},"links":{"cited_paper":"/paper/2305.14325","citing_paper":"/paper/2506.15894"},"observation_digest":"sha256:81d088e33fc340cf8a52bc4570a4b69730bd8ba3eb7ed9424e9c3e405f5429a4","observation_id":"86d2fc19-0b9a-4aae-a417-738860ce24ad","resolution":{"observed_at":"2026-08-15T19:33:54.011810Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-15T19:33:54.018399Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.15894","last_updated":"2025-06-18T21:35:44Z","snapshot_observed_at":"2026-08-18T19:03:02.299434Z","submitted_at":"2025-06-18T21:35:44Z","title":"Language Models can perform Single-Utterance Self-Correction of Perturbed Reasoning","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-15T19:33:54.018399Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2506.15894"},"observation_digest":"sha256:4ae8e463309ad7e785f9fb8e49ac2aa8728f4a633ba7bda170270b77e888a125","observation_id":"140b795d-8291-4381-ad3a-020a04457661","resolution":{"observed_at":"2026-08-15T19:33:54.018399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:33:55.405350Z","title":null,"venue":null,"work_id":"1146eef4-26ad-48ae-8630-1a381bd20bd2","year":2024},"citing_paper":{"arxiv_id":"2506.15894","last_updated":"2025-06-18T21:35:44Z","snapshot_observed_at":"2026-08-18T19:03:02.299434Z","submitted_at":"2025-06-18T21:35:44Z","title":"Language Models can perform Single-Utterance Self-Correction of Perturbed Reasoning","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-15T19:33:54.026778Z"},"links":{"citing_paper":"/paper/2506.15894"},"observation_digest":"sha256:776b4f68068ec35bed9d7cce4d8846746b3656d8050d8636bf241ce42d4f15c1","observation_id":"91d3955b-fc8a-4e80-ad8b-25d352ccfc0c","resolution":{"observed_at":"2026-08-15T19:33:55.409265Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:33:55.391984Z","title":null,"venue":null,"work_id":"3ca31915-a55d-4654-81f6-1be71960f549","year":2021},"citing_paper":{"arxiv_id":"2506.15894","last_updated":"2025-06-18T21:35:44Z","snapshot_observed_at":"2026-08-18T19:03:02.299434Z","submitted_at":"2025-06-18T21:35:44Z","title":"Language Models can perform Single-Utterance Self-Correction of Perturbed Reasoning","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-15T19:33:54.032160Z"},"links":{"citing_paper":"/paper/2506.15894"},"observation_digest":"sha256:54690ffc5267111647a0b4275693e87f5e3b70bb531c94a6b88a2694ca3e58a7","observation_id":"d8b04f0b-980b-4800-b0ca-f052ae280288","resolution":{"observed_at":"2026-08-15T19:33:55.396518Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:33:54.039262Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.15894","last_updated":"2025-06-18T21:35:44Z","snapshot_observed_at":"2026-08-18T19:03:02.299434Z","submitted_at":"2025-06-18T21:35:44Z","title":"Language Models can perform Single-Utterance Self-Correction of Perturbed Reasoning","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-15T19:33:54.039262Z"},"links":{"citing_paper":"/paper/2506.15894"},"observation_digest":"sha256:1d046c00e304520ae9a811054f8340b4ff1fc744022917307bcda9ee9c3fdf5d","observation_id":"cb581a91-03db-47c8-b686-79d25d074d08","resolution":{"observed_at":"2026-08-15T19:33:54.039262Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:33:55.370924Z","title":null,"venue":null,"work_id":"f4e6d04c-8063-4ad1-8385-8cf5163d6234","year":2024},"citing_paper":{"arxiv_id":"2506.15894","last_updated":"2025-06-18T21:35:44Z","snapshot_observed_at":"2026-08-18T19:03:02.299434Z","submitted_at":"2025-06-18T21:35:44Z","title":"Language Models can perform Single-Utterance Self-Correction of Perturbed Reasoning","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-15T19:33:54.044405Z"},"links":{"citing_paper":"/paper/2506.15894"},"observation_digest":"sha256:06d5096a9d21a3a82eb9beafe9ae024989ea6bc37afa6db0d46dbaa9050a26e2","observation_id":"413f354c-6a2d-4abe-a8e3-ae8d44e3f7e4","resolution":{"observed_at":"2026-08-15T19:33:55.376071Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:33:54.049491Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.15894","last_updated":"2025-06-18T21:35:44Z","snapshot_observed_at":"2026-08-18T19:03:02.299434Z","submitted_at":"2025-06-18T21:35:44Z","title":"Language Models can perform Single-Utterance Self-Correction of Perturbed Reasoning","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-15T19:33:54.049491Z"},"links":{"citing_paper":"/paper/2506.15894"},"observation_digest":"sha256:ec6dc624c65dbd8ac2e67f49ba26dbca3ab56a1c590c1acff7abe3be9c3ac794","observation_id":"f7bb8bf5-ac76-4936-bd42-e703b8522403","resolution":{"observed_at":"2026-08-15T19:33:54.049491Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:33:55.353973Z","title":null,"venue":null,"work_id":"6f4667a4-9d6e-4437-bd18-85daf0f29cc3","year":2025},"citing_paper":{"arxiv_id":"2506.15894","last_updated":"2025-06-18T21:35:44Z","snapshot_observed_at":"2026-08-18T19:03:02.299434Z","submitted_at":"2025-06-18T21:35:44Z","title":"Language Models can perform Single-Utterance Self-Correction of Perturbed Reasoning","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-15T19:33:54.060725Z"},"links":{"citing_paper":"/paper/2506.15894"},"observation_digest":"sha256:3d662ce60c457e051152926bd4ac21e00c6c752b38f68b53695061bc4f949d7b","observation_id":"bcd3d7d5-5874-4033-b57f-ab8c6f30644a","resolution":{"observed_at":"2026-08-15T19:33:55.358406Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12917","last_updated":"2024-10-04T17:28:45Z","snapshot_observed_at":"2026-08-16T03:33:39.637646Z","submitted_at":"2024-09-19T17:16:21Z","title":"Training Language Models to Self-Correct via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12917","snapshot_observed_at":"2026-08-15T19:33:54.138351Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.15894","last_updated":"2025-06-18T21:35:44Z","snapshot_observed_at":"2026-08-18T19:03:02.299434Z","submitted_at":"2025-06-18T21:35:44Z","title":"Language Models can perform Single-Utterance Self-Correction of Perturbed Reasoning","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-15T19:33:54.138351Z"},"links":{"cited_paper":"/paper/2409.12917","citing_paper":"/paper/2506.15894"},"observation_digest":"sha256:9f7e2f6f62d2a9687a02ff6db27616f13fdae1738ba9f87add971108582b669c","observation_id":"6763fb24-6ec3-4412-8560-a9428f2ab164","resolution":{"observed_at":"2026-08-15T19:33:54.138351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15124","last_updated":"2025-04-14T22:39:09Z","snapshot_observed_at":"2026-08-17T14:11:00.232598Z","submitted_at":"2024-11-22T18:44:04Z","title":"Tulu 3: Pushing Frontiers in Open Language Model Post-Training","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.15124","snapshot_observed_at":"2026-08-15T19:33:54.253904Z","title":"Miranda, Alisa Liu, Nouha Dziri, Shane Lyu, Yuling Gu, Saumya Malik, Victoria Graf, Jena D","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.15894","last_updated":"2025-06-18T21:35:44Z","snapshot_observed_at":"2026-08-18T19:03:02.299434Z","submitted_at":"2025-06-18T21:35:44Z","title":"Language Models can perform Single-Utterance Self-Correction of Perturbed Reasoning","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-15T19:33:54.253904Z"},"links":{"cited_paper":"/paper/2411.15124","citing_paper":"/paper/2506.15894"},"observation_digest":"sha256:92c7bae840d5793465fd49d2e134757fcd459c99c3669eaa55b5fd4bb0a149e4","observation_id":"d4bb8cb8-160c-4c14-bee2-2166ead88fe2","resolution":{"observed_at":"2026-08-15T19:33:54.253904Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:33:55.335560Z","title":null,"venue":null,"work_id":"71af240f-bc25-4f0c-8d74-c2befd85fb6f","year":2022},"citing_paper":{"arxiv_id":"2506.15894","last_updated":"2025-06-18T21:35:44Z","snapshot_observed_at":"2026-08-18T19:03:02.299434Z","submitted_at":"2025-06-18T21:35:44Z","title":"Language Models can perform Single-Utterance Self-Correction of Perturbed Reasoning","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-15T19:33:54.301809Z"},"links":{"citing_paper":"/paper/2506.15894"},"observation_digest":"sha256:560a15c0b704ca98dedb379a2df5125022ed624a8898cdfaffca4bb71b537848","observation_id":"db55beab-6c92-4d5a-95dd-ebafc864b4c2","resolution":{"observed_at":"2026-08-15T19:33:55.344724Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:33:54.306210Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.15894","last_updated":"2025-06-18T21:35:44Z","snapshot_observed_at":"2026-08-18T19:03:02.299434Z","submitted_at":"2025-06-18T21:35:44Z","title":"Language Models can perform Single-Utterance Self-Correction of Perturbed Reasoning","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-15T19:33:54.306210Z"},"links":{"citing_paper":"/paper/2506.15894"},"observation_digest":"sha256:eb4e8eb2b212cb3a71303a21ae23e57fccd8f3f778df8e64dc237f7abfbde88c","observation_id":"4555825c-a00e-4404-a96f-4686d0d68734","resolution":{"observed_at":"2026-08-15T19:33:54.306210Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:33:55.310785Z","title":null,"venue":null,"work_id":"86f8ccc7-2dfe-4b49-9c72-71192440c1a0","year":2024},"citing_paper":{"arxiv_id":"2506.15894","last_updated":"2025-06-18T21:35:44Z","snapshot_observed_at":"2026-08-18T19:03:02.299434Z","submitted_at":"2025-06-18T21:35:44Z","title":"Language Models can perform Single-Utterance Self-Correction of Perturbed Reasoning","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-15T19:33:54.311656Z"},"links":{"citing_paper":"/paper/2506.15894"},"observation_digest":"sha256:13e683932de216ca0c28c2a2a210872d0eb24836c6f5c14d91ded0d38d3d03d7","observation_id":"c65693f1-b72d-49af-9aa9-af2de888aac5","resolution":{"observed_at":"2026-08-15T19:33:55.315004Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.19118","last_updated":"2024-10-09T02:41:21Z","snapshot_observed_at":"2026-08-15T13:46:19.286791Z","submitted_at":"2023-05-30T15:25:45Z","title":"Encouraging Divergent Thinking in Large Language Models through Multi-Agent Debate","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.19118","snapshot_observed_at":"2026-08-15T19:33:54.316387Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.15894","last_updated":"2025-06-18T21:35:44Z","snapshot_observed_at":"2026-08-18T19:03:02.299434Z","submitted_at":"2025-06-18T21:35:44Z","title":"Language Models can perform Single-Utterance Self-Correction of Perturbed Reasoning","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-15T19:33:54.316387Z"},"links":{"cited_paper":"/paper/2305.19118","citing_paper":"/paper/2506.15894"},"observation_digest":"sha256:e1c541a824f8b2d7b5f2fc8ef8441adae63962fcae29e426cc9357f9ddc7e911","observation_id":"e70d8a06-7f2b-44c5-a06d-db1b80e22db0","resolution":{"observed_at":"2026-08-15T19:33:54.316387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.20050","last_updated":"2023-05-31T17:24:00Z","snapshot_observed_at":"2026-08-17T09:42:34.746112Z","submitted_at":"2023-05-31T17:24:00Z","title":"Let's Verify Step by Step","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.20050","snapshot_observed_at":"2026-08-15T19:33:54.408880Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.15894","last_updated":"2025-06-18T21:35:44Z","snapshot_observed_at":"2026-08-18T19:03:02.299434Z","submitted_at":"2025-06-18T21:35:44Z","title":"Language Models can perform Single-Utterance Self-Correction of Perturbed Reasoning","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-15T19:33:54.408880Z"},"links":{"cited_paper":"/paper/2305.20050","citing_paper":"/paper/2506.15894"},"observation_digest":"sha256:2724791fead759c34e6c42240c5ae3ad9f9bfa14719aba915e94c38ac414ef8f","observation_id":"2f9765fa-d005-4e3c-afcd-6227c1fff95d","resolution":{"observed_at":"2026-08-15T19:33:54.408880Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01100","last_updated":"2025-07-15T01:14:25Z","snapshot_observed_at":"2026-08-18T19:02:23.250634Z","submitted_at":"2025-02-03T06:44:49Z","title":"ZebraLogic: On the Scaling Limits of LLMs for Logical Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.01100","snapshot_observed_at":"2026-08-15T19:33:54.487403Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.15894","last_updated":"2025-06-18T21:35:44Z","snapshot_observed_at":"2026-08-18T19:03:02.299434Z","submitted_at":"2025-06-18T21:35:44Z","title":"Language Models can perform Single-Utterance Self-Correction of Perturbed Reasoning","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-15T19:33:54.487403Z"},"links":{"cited_paper":"/paper/2502.01100","citing_paper":"/paper/2506.15894"},"observation_digest":"sha256:500d747edaeaa4aefca0500ed53aef724a4fba64dbcdde74279686e23119c07d","observation_id":"fa12163e-30c2-4a18-9253-27e5e5b0b02e","resolution":{"observed_at":"2026-08-15T19:33:54.487403Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:33:54.573119Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.15894","last_updated":"2025-06-18T21:35:44Z","snapshot_observed_at":"2026-08-18T19:03:02.299434Z","submitted_at":"2025-06-18T21:35:44Z","title":"Language Models can perform Single-Utterance Self-Correction of Perturbed Reasoning","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-15T19:33:54.573119Z"},"links":{"citing_paper":"/paper/2506.15894"},"observation_digest":"sha256:00cf9c76986c729acd55ab2187c4a5c1ff91dd2e55364c487d5d2e64c21f2041","observation_id":"5f4f9a31-2a7a-4a77-bb93-ef8dc401e519","resolution":{"observed_at":"2026-08-15T19:33:54.573119Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.05229","last_updated":"2025-08-27T16:24:39Z","snapshot_observed_at":"2026-08-16T08:54:56.543625Z","submitted_at":"2024-10-07T17:36:37Z","title":"GSM-Symbolic: Understanding the Limitations of Mathematical Reasoning in Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.05229","snapshot_observed_at":"2026-08-15T19:33:54.668562Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.15894","last_updated":"2025-06-18T21:35:44Z","snapshot_observed_at":"2026-08-18T19:03:02.299434Z","submitted_at":"2025-06-18T21:35:44Z","title":"Language Models can perform Single-Utterance Self-Correction of Perturbed Reasoning","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-15T19:33:54.668562Z"},"links":{"cited_paper":"/paper/2410.05229","citing_paper":"/paper/2506.15894"},"observation_digest":"sha256:5605316e72257adc079ba3e5c49a8ba79043038d2875386a40c698bff2e4f5af","observation_id":"346e8cfd-738e-496e-822f-e092824534a4","resolution":{"observed_at":"2026-08-15T19:33:54.668562Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:33:55.289247Z","title":null,"venue":null,"work_id":"9bee1a07-67fb-437b-97f8-9642c3103a77","year":2022},"citing_paper":{"arxiv_id":"2506.15894","last_updated":"2025-06-18T21:35:44Z","snapshot_observed_at":"2026-08-18T19:03:02.299434Z","submitted_at":"2025-06-18T21:35:44Z","title":"Language Models can perform Single-Utterance Self-Correction of Perturbed Reasoning","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-15T19:33:54.674842Z"},"links":{"citing_paper":"/paper/2506.15894"},"observation_digest":"sha256:11d8fc7adaf97a4b9fbe519a23375b722990b56f3a7745b1a41ac33be723e09c","observation_id":"7569cb27-3f7e-458b-8a61-43fd95cbf8bc","resolution":{"observed_at":"2026-08-15T19:33:55.294403Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:33:55.273920Z","title":null,"venue":null,"work_id":"db6d8a22-3d4c-4bc0-871d-fff01a0c0c57","year":2024},"citing_paper":{"arxiv_id":"2506.15894","last_updated":"2025-06-18T21:35:44Z","snapshot_observed_at":"2026-08-18T19:03:02.299434Z","submitted_at":"2025-06-18T21:35:44Z","title":"Language Models can perform Single-Utterance Self-Correction of Perturbed Reasoning","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-15T19:33:54.678986Z"},"links":{"citing_paper":"/paper/2506.15894"},"observation_digest":"sha256:90bfb0fbb72b31bf7e8be5d9d34222d67c93fb7575efc3eb5e949bac0b2b1b78","observation_id":"c748fb31-b814-4304-b019-bc2a8ac2b43b","resolution":{"observed_at":"2026-08-15T19:33:55.278663Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:33:55.261036Z","title":null,"venue":null,"work_id":"c343c4b1-9f94-460c-bec0-a8f49edcc497","year":2024},"citing_paper":{"arxiv_id":"2506.15894","last_updated":"2025-06-18T21:35:44Z","snapshot_observed_at":"2026-08-18T19:03:02.299434Z","submitted_at":"2025-06-18T21:35:44Z","title":"Language Models can perform Single-Utterance Self-Correction of Perturbed Reasoning","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-15T19:33:54.683691Z"},"links":{"citing_paper":"/paper/2506.15894"},"observation_digest":"sha256:d63832b96d641620b2ebd5d325dfc03e40b9e71b5caaa3155c3e77d90dcd89a7","observation_id":"90f7eaff-27b3-4eca-86d9-e9463adf087d","resolution":{"observed_at":"2026-08-15T19:33:55.265473Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:33:55.245957Z","title":null,"venue":null,"work_id":"5c7dfcab-40fe-4ce9-8963-c43a72752ee0","year":2024},"citing_paper":{"arxiv_id":"2506.15894","last_updated":"2025-06-18T21:35:44Z","snapshot_observed_at":"2026-08-18T19:03:02.299434Z","submitted_at":"2025-06-18T21:35:44Z","title":"Language Models can perform Single-Utterance Self-Correction of Perturbed Reasoning","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-15T19:33:54.688649Z"},"links":{"citing_paper":"/paper/2506.15894"},"observation_digest":"sha256:d396db1258e63f0f03d8916d0fc0cd5a7e7ce8b537b8302e7670a6a92ded213d","observation_id":"749af480-e346-4010-a420-10cd513ac6a0","resolution":{"observed_at":"2026-08-15T19:33:55.250069Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:33:55.232427Z","title":null,"venue":null,"work_id":"68b52fc3-a80f-491a-a52b-29e0f9def3b0","year":2024},"citing_paper":{"arxiv_id":"2506.15894","last_updated":"2025-06-18T21:35:44Z","snapshot_observed_at":"2026-08-18T19:03:02.299434Z","submitted_at":"2025-06-18T21:35:44Z","title":"Language Models can perform Single-Utterance Self-Correction of Perturbed Reasoning","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-15T19:33:54.692575Z"},"links":{"citing_paper":"/paper/2506.15894"},"observation_digest":"sha256:37cb8ded693cc513e75c4ecf008e1d41ae7253b23dc518f615c9f20bc675e505","observation_id":"7962bc26-7cd3-47cc-9966-9217785e872c","resolution":{"observed_at":"2026-08-15T19:33:55.237194Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2206.05802","last_updated":"2022-06-14T01:16:24Z","snapshot_observed_at":"2026-08-19T21:55:00.332987Z","submitted_at":"2022-06-12T17:40:53Z","title":"Self-critiquing models for assisting human evaluators","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.05802","snapshot_observed_at":"2026-08-15T19:33:54.696292Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.15894","last_updated":"2025-06-18T21:35:44Z","snapshot_observed_at":"2026-08-18T19:03:02.299434Z","submitted_at":"2025-06-18T21:35:44Z","title":"Language Models can perform Single-Utterance Self-Correction of Perturbed Reasoning","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-15T19:33:54.696292Z"},"links":{"cited_paper":"/paper/2206.05802","citing_paper":"/paper/2506.15894"},"observation_digest":"sha256:7d73d9e1a016f90dc19d0f194d32b5f2f3900588cf35f90f07496530433e05f7","observation_id":"241fbb96-d92a-48d8-a5bc-f84a0ea9bf5a","resolution":{"observed_at":"2026-08-15T19:33:54.696292Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:33:55.220203Z","title":null,"venue":null,"work_id":"5de5b4d0-91e4-45bc-b621-3dde7fd98ae5","year":2023},"citing_paper":{"arxiv_id":"2506.15894","last_updated":"2025-06-18T21:35:44Z","snapshot_observed_at":"2026-08-18T19:03:02.299434Z","submitted_at":"2025-06-18T21:35:44Z","title":"Language Models can perform Single-Utterance Self-Correction of Perturbed Reasoning","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-15T19:33:54.700376Z"},"links":{"citing_paper":"/paper/2506.15894"},"observation_digest":"sha256:ce5971a2122f401bd25253cc5c15ddf552ffbe3374e7c664e3fe288655c79605","observation_id":"edbf00fe-82cd-46a8-af8a-db515cee4498","resolution":{"observed_at":"2026-08-15T19:33:55.224091Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.19228","last_updated":"2024-06-27T14:52:34Z","snapshot_observed_at":"2026-08-19T10:00:50.338978Z","submitted_at":"2024-06-27T14:52:34Z","title":"Tools Fail: Detecting Silent Errors in Faulty Tools","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.19228","snapshot_observed_at":"2026-08-15T19:33:54.705127Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.15894","last_updated":"2025-06-18T21:35:44Z","snapshot_observed_at":"2026-08-18T19:03:02.299434Z","submitted_at":"2025-06-18T21:35:44Z","title":"Language Models can perform Single-Utterance Self-Correction of Perturbed Reasoning","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-15T19:33:54.705127Z"},"links":{"cited_paper":"/paper/2406.19228","citing_paper":"/paper/2506.15894"},"observation_digest":"sha256:e820b0bcf32cb7c7471d0c5257bf3b646cf9f1b2693d6ba9e5c95232ca527ee8","observation_id":"753d69a5-f42b-4084-b398-c61779d70fb9","resolution":{"observed_at":"2026-08-15T19:33:54.705127Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-15T19:33:54.710132Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.15894","last_updated":"2025-06-18T21:35:44Z","snapshot_observed_at":"2026-08-18T19:03:02.299434Z","submitted_at":"2025-06-18T21:35:44Z","title":"Language Models can perform Single-Utterance Self-Correction of Perturbed Reasoning","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-15T19:33:54.710132Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2506.15894"},"observation_digest":"sha256:941c751019a493015867614b7b17885feaf4daf0dc791088e1d958d8a5ac4007","observation_id":"38f574d4-f828-47b6-b113-164d3fd028d7","resolution":{"observed_at":"2026-08-15T19:33:54.710132Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-08-17T18:50:07.059564Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-15T19:33:54.725229Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.15894","last_updated":"2025-06-18T21:35:44Z","snapshot_observed_at":"2026-08-18T19:03:02.299434Z","submitted_at":"2025-06-18T21:35:44Z","title":"Language Models can perform Single-Utterance Self-Correction of Perturbed Reasoning","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-15T19:33:54.725229Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2506.15894"},"observation_digest":"sha256:4aa4b56a99aa3eafe7ffe22a74828dd403f54216bc1dc9ae00ec3955c5f042ea","observation_id":"ff8cb249-3223-4b65-a3f6-fb91b573330d","resolution":{"observed_at":"2026-08-15T19:33:54.725229Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.14275","last_updated":"2022-11-25T18:19:44Z","snapshot_observed_at":"2026-08-01T02:16:43.109337Z","submitted_at":"2022-11-25T18:19:44Z","title":"Solving math word problems with process- and outcome-based feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.14275","snapshot_observed_at":"2026-08-15T19:33:54.748191Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.15894","last_updated":"2025-06-18T21:35:44Z","snapshot_observed_at":"2026-08-18T19:03:02.299434Z","submitted_at":"2025-06-18T21:35:44Z","title":"Language Models can perform Single-Utterance Self-Correction of Perturbed Reasoning","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-15T19:33:54.748191Z"},"links":{"cited_paper":"/paper/2211.14275","citing_paper":"/paper/2506.15894"},"observation_digest":"sha256:f9178b62d6d3185f671a72d174e9d6b53beb4b68f4c0904436b0620c529dd602","observation_id":"ae183afd-ce1c-4221-82a3-a4d5c0c8e950","resolution":{"observed_at":"2026-08-15T19:33:54.748191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.04592","last_updated":"2023-08-08T21:23:23Z","snapshot_observed_at":"2026-08-19T09:52:49.068370Z","submitted_at":"2023-08-08T21:23:23Z","title":"Shepherd: A Critic for Language Model Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.04592","snapshot_observed_at":"2026-08-15T19:33:54.779601Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.15894","last_updated":"2025-06-18T21:35:44Z","snapshot_observed_at":"2026-08-18T19:03:02.299434Z","submitted_at":"2025-06-18T21:35:44Z","title":"Language Models can perform Single-Utterance Self-Correction of Perturbed Reasoning","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-15T19:33:54.779601Z"},"links":{"cited_paper":"/paper/2308.04592","citing_paper":"/paper/2506.15894"},"observation_digest":"sha256:5c4ecdb8b4bcd8461044949c9eab4e03eaafd0de733428822b3a04937ccadd88","observation_id":"6deb1a43-afe9-4b29-b706-271e4a2b459c","resolution":{"observed_at":"2026-08-15T19:33:54.779601Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:33:54.809246Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.15894","last_updated":"2025-06-18T21:35:44Z","snapshot_observed_at":"2026-08-18T19:03:02.299434Z","submitted_at":"2025-06-18T21:35:44Z","title":"Language Models can perform Single-Utterance Self-Correction of Perturbed Reasoning","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-15T19:33:54.809246Z"},"links":{"citing_paper":"/paper/2506.15894"},"observation_digest":"sha256:1fa0aff9e4ad23bb03bdab3a8e5fce92642251fd565749a4ee86fa4380b4f5c3","observation_id":"21af31da-cd12-4160-a864-577448c4cc70","resolution":{"observed_at":"2026-08-15T19:33:54.809246Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:33:55.193115Z","title":null,"venue":null,"work_id":"e28a03b9-86ef-4828-94a8-f6a0adadfe79","year":2023},"citing_paper":{"arxiv_id":"2506.15894","last_updated":"2025-06-18T21:35:44Z","snapshot_observed_at":"2026-08-18T19:03:02.299434Z","submitted_at":"2025-06-18T21:35:44Z","title":"Language Models can perform Single-Utterance Self-Correction of Perturbed Reasoning","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-15T19:33:54.814618Z"},"links":{"citing_paper":"/paper/2506.15894"},"observation_digest":"sha256:e73c931c66421fa450f8bf84683ac720872ec4723f2554c6b6809eab26ae5f85","observation_id":"dd3970ae-7e0a-45db-aac7-23d2643f757c","resolution":{"observed_at":"2026-08-15T19:33:55.197353Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12122","last_updated":"2024-09-18T16:45:37Z","snapshot_observed_at":"2026-08-17T18:51:13.219936Z","submitted_at":"2024-09-18T16:45:37Z","title":"Qwen2.5-Math Technical Report: Toward Mathematical Expert Model via Self-Improvement","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12122","snapshot_observed_at":"2026-08-15T19:33:54.818624Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.15894","last_updated":"2025-06-18T21:35:44Z","snapshot_observed_at":"2026-08-18T19:03:02.299434Z","submitted_at":"2025-06-18T21:35:44Z","title":"Language Models can perform Single-Utterance Self-Correction of Perturbed Reasoning","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-15T19:33:54.818624Z"},"links":{"cited_paper":"/paper/2409.12122","citing_paper":"/paper/2506.15894"},"observation_digest":"sha256:e122afc18ad48e524d6e7c3233da97ddb9b95b35793e419d4dc06c54c8dd619e","observation_id":"238b8440-db28-41ba-8ff8-9870cdbe8356","resolution":{"observed_at":"2026-08-15T19:33:54.818624Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:33:55.179391Z","title":null,"venue":null,"work_id":"976ca831-85ca-463d-aabb-bf2ed6e6b329","year":2023},"citing_paper":{"arxiv_id":"2506.15894","last_updated":"2025-06-18T21:35:44Z","snapshot_observed_at":"2026-08-18T19:03:02.299434Z","submitted_at":"2025-06-18T21:35:44Z","title":"Language Models can perform Single-Utterance Self-Correction of Perturbed Reasoning","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-15T19:33:54.822867Z"},"links":{"citing_paper":"/paper/2506.15894"},"observation_digest":"sha256:8d187acdf4cdb1b22907f12fa052707a4fd021506e384b983160c1814d4c1ee4","observation_id":"e4bea87b-c8f1-4427-b7fe-f3eacde13824","resolution":{"observed_at":"2026-08-15T19:33:55.183529Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:33:55.166353Z","title":null,"venue":null,"work_id":"e0ab8da5-a7a0-4348-8d34-488b0487eb44","year":2024},"citing_paper":{"arxiv_id":"2506.15894","last_updated":"2025-06-18T21:35:44Z","snapshot_observed_at":"2026-08-18T19:03:02.299434Z","submitted_at":"2025-06-18T21:35:44Z","title":"Language Models can perform Single-Utterance Self-Correction of Perturbed Reasoning","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-15T19:33:54.826969Z"},"links":{"citing_paper":"/paper/2506.15894"},"observation_digest":"sha256:c569547a492f54faa53398965ffd30a0834b60a907f48a865103d689254cc7ae","observation_id":"a66b659d-2a81-450e-8460-0ef3fe7e11bc","resolution":{"observed_at":"2026-08-15T19:33:55.170707Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:33:55.152673Z","title":"Chi, Quoc V Le, and Denny Zhou","venue":null,"work_id":"cfee3ac7-fc91-4354-beed-430740dfced0","year":2024},"citing_paper":{"arxiv_id":"2506.15894","last_updated":"2025-06-18T21:35:44Z","snapshot_observed_at":"2026-08-18T19:03:02.299434Z","submitted_at":"2025-06-18T21:35:44Z","title":"Language Models can perform Single-Utterance Self-Correction of Perturbed Reasoning","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-15T19:33:54.830953Z"},"links":{"citing_paper":"/paper/2506.15894"},"observation_digest":"sha256:5fac685c6364901aa75c24e78c43ed19ac1dd72698dab1416594ceda4d2873b3","observation_id":"ecbc479d-db32-4518-9269-83859b53ebc4","resolution":{"observed_at":"2026-08-15T19:33:55.157849Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:33:55.138207Z","title":null,"venue":null,"work_id":"dce99820-562b-44bf-99e2-dd61626781eb","year":2023},"citing_paper":{"arxiv_id":"2506.15894","last_updated":"2025-06-18T21:35:44Z","snapshot_observed_at":"2026-08-18T19:03:02.299434Z","submitted_at":"2025-06-18T21:35:44Z","title":"Language Models can perform Single-Utterance Self-Correction of Perturbed Reasoning","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-15T19:33:54.839855Z"},"links":{"citing_paper":"/paper/2506.15894"},"observation_digest":"sha256:050676c87219cdda60ece98bb83cc8a0ad93d1846f399b381d6195eb6f768249","observation_id":"3088eb48-3928-4417-bbc4-065c275992aa","resolution":{"observed_at":"2026-08-15T19:33:55.143610Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.15894","last_updated":"2025-06-18T21:35:44Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-18T19:03:02.299434Z","submitted_at":"2025-06-18T21:35:44Z","title":"Language Models can perform Single-Utterance Self-Correction of Perturbed Reasoning"},"reference_resolution":{"displayed":46,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":44,"verified_exact":0,"verified_fuzzy":2},"total_outbound_references":46},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 46 of 46 outbound references and 1 inbound Pith citation observation for arXiv:2506.15894."}