{"as_of":"2026-08-08T02:31:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9aa2061c33e43e166d36e6bc690ae6ff59a9475bbb5919b2947e01b6e4ffc746","coverage":[{"denominator":57,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":57,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T16:14:09.490536Z","state":"measured"},{"denominator":59,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":59,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T00:13:26.854490Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-06-28T23:22:47.413783Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.14295","last_updated":"2025-08-22T16:49:10Z","snapshot_observed_at":"2026-08-07T14:03:43.498386Z","submitted_at":"2025-07-18T18:07:38Z","title":"A Simple \"Try Again\" Can Elicit Multi-Turn LLM Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.14295","snapshot_observed_at":"2026-08-03T00:13:26.854490Z","title":"Let’s try again: Eliciting multi-turn reasoning 9 Behavioral Agentic Optimization in language models via simplistic feedback","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.11351","last_updated":"2026-06-28T23:49:44Z","snapshot_observed_at":"2026-08-03T00:13:22.529238Z","submitted_at":"2026-02-11T20:40:43Z","title":"Pushing Forward Pareto Frontiers of Proactive Agents with Behavioral Agentic Optimization","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-03T00:13:26.854490Z"},"links":{"cited_paper":"/paper/2507.14295","citing_paper":"/paper/2602.11351"},"observation_digest":"sha256:b710537f79d04f22373784e5429742132eb5f4a3eb8a7a0b169e4af4a9825033","observation_id":"f75ca2ed-f3e2-4825-8c23-754567efa4a3","resolution":{"observed_at":"2026-08-03T00:13:26.854490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.14295","last_updated":"2025-08-22T16:49:10Z","snapshot_observed_at":"2026-08-07T14:03:43.498386Z","submitted_at":"2025-07-18T18:07:38Z","title":"A Simple \"Try Again\" Can Elicit Multi-Turn LLM Reasoning","version":2},"cited_work":{"arxiv_id":"2507.14295","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.14295","snapshot_observed_at":"2026-06-28T23:22:47.413783Z","title":"A simple” try again” can elicit multi-turn llm reasoning.arXiv preprint arXiv:2507.14295,","venue":null,"work_id":"50dfaa6f-22d5-4329-9833-f066e04a3ed8","year":null},"citing_paper":{"arxiv_id":"2605.31455","last_updated":"2026-05-29T15:49:13Z","snapshot_observed_at":"2026-08-06T06:42:59.945235Z","submitted_at":"2026-05-29T15:49:13Z","title":"DRIFT: Decoupled Rollouts and Importance-Weighted Fine-Tuning for Efficient Multi-Turn Optimization","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-28T23:16:49.358792Z"},"links":{"cited_paper":"/paper/2507.14295","citing_paper":"/paper/2605.31455"},"observation_digest":"sha256:babd638bf086c1796b3b44f130e130e9d65db9f40ab388d5bc18eca74255c848","observation_id":"223af9c4-7897-4da4-9fb1-83288a4d7796","resolution":{"observed_at":"2026-06-28T23:22:47.415781Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2507.14295/citation-record","integrity":"/paper/2507.14295/integrity","json":"/paper/2507.14295/citation-record.json","paper":"/paper/2507.14295"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-06T16:14:02.177595Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.14295","last_updated":"2025-08-22T16:49:10Z","snapshot_observed_at":"2026-08-07T14:03:43.498386Z","submitted_at":"2025-07-18T18:07:38Z","title":"A Simple \"Try Again\" Can Elicit Multi-Turn LLM Reasoning","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-06T16:14:02.177595Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2507.14295"},"observation_digest":"sha256:4ed5e97f1ac2e692998c6c871d594b523aa203ec8d739d77a1c1d40c91636d27","observation_id":"17eae788-e7b5-4906-b24d-02c7ea37ba91","resolution":{"observed_at":"2026-08-06T16:14:02.177595Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-06T16:14:02.291984Z","title":"Gpt-4 technical report, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.14295","last_updated":"2025-08-22T16:49:10Z","snapshot_observed_at":"2026-08-07T14:03:43.498386Z","submitted_at":"2025-07-18T18:07:38Z","title":"A Simple \"Try Again\" Can Elicit Multi-Turn LLM Reasoning","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-06T16:14:02.291984Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2507.14295"},"observation_digest":"sha256:842069962cee4ff8ed2d49798ca9242417d8707559eb17f236ae4a993d3927df","observation_id":"ebcb6810-5c35-407c-b9ff-cab89baa01bc","resolution":{"observed_at":"2026-08-06T16:14:02.291984Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-06T16:14:02.416492Z","title":"Qwen2.5 technical report","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.14295","last_updated":"2025-08-22T16:49:10Z","snapshot_observed_at":"2026-08-07T14:03:43.498386Z","submitted_at":"2025-07-18T18:07:38Z","title":"A Simple \"Try Again\" Can Elicit Multi-Turn LLM Reasoning","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-06T16:14:02.416492Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2507.14295"},"observation_digest":"sha256:932e2f9a1ce846f4c397929e2073dfeda8565b88361bb4a874c6c4984dddbfc4","observation_id":"3df69451-78be-4620-ae58-f933f98096bf","resolution":{"observed_at":"2026-08-06T16:14:02.416492Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-06T16:14:02.648526Z","title":"Gemini: A family of highly capable multimodal models, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.14295","last_updated":"2025-08-22T16:49:10Z","snapshot_observed_at":"2026-08-07T14:03:43.498386Z","submitted_at":"2025-07-18T18:07:38Z","title":"A Simple \"Try Again\" Can Elicit Multi-Turn LLM Reasoning","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-06T16:14:02.648526Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2507.14295"},"observation_digest":"sha256:4a77cb237de257034a2e1e403fdbfe863b8aba4b4c1b7141fcbe9dc782fcebe2","observation_id":"4160e1db-202c-4c32-ac9c-371e39e8193d","resolution":{"observed_at":"2026-08-06T16:14:02.648526Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-06T16:14:03.913893Z","title":"Proximal policy optimization algorithms, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.14295","last_updated":"2025-08-22T16:49:10Z","snapshot_observed_at":"2026-08-07T14:03:43.498386Z","submitted_at":"2025-07-18T18:07:38Z","title":"A Simple \"Try Again\" Can Elicit Multi-Turn LLM Reasoning","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-06T16:14:03.913893Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2507.14295"},"observation_digest":"sha256:fc31af2808fd391e890f3862fdc1cb6a68c6592725c26b5a22851ee086b3294d","observation_id":"ce9e97a8-c8be-469b-b310-bf62adf99a20","resolution":{"observed_at":"2026-08-06T16:14:03.913893Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.19446","last_updated":"2024-02-29T18:45:56Z","snapshot_observed_at":"2026-08-07T22:12:46.006835Z","submitted_at":"2024-02-29T18:45:56Z","title":"ArCHer: Training Language Model Agents via Hierarchical Multi-Turn RL","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.19446","snapshot_observed_at":"2026-08-06T16:14:04.049831Z","title":"Archer: Training language model agents via hierarchical multi-turn rl, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.14295","last_updated":"2025-08-22T16:49:10Z","snapshot_observed_at":"2026-08-07T14:03:43.498386Z","submitted_at":"2025-07-18T18:07:38Z","title":"A Simple \"Try Again\" Can Elicit Multi-Turn LLM Reasoning","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-06T16:14:04.049831Z"},"links":{"cited_paper":"/paper/2402.19446","citing_paper":"/paper/2507.14295"},"observation_digest":"sha256:4d70c9bf308ac112e2004a4092679eaa5e854e2308c04ee1c84eba5b55b5fef8","observation_id":"6de5f99d-b149-450f-a171-fb3dcc223bb0","resolution":{"observed_at":"2026-08-06T16:14:04.049831Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.20073","last_updated":"2025-05-26T17:19:30Z","snapshot_observed_at":"2026-07-06T21:15:59.063396Z","submitted_at":"2025-04-24T17:57:08Z","title":"RAGEN: Understanding Self-Evolution in LLM Agents via Multi-Turn Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.20073","snapshot_observed_at":"2026-08-06T16:14:04.197657Z","title":"Ragen: Understanding self-evolution in llm agents via multi-turn reinforcement learning, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.14295","last_updated":"2025-08-22T16:49:10Z","snapshot_observed_at":"2026-08-07T14:03:43.498386Z","submitted_at":"2025-07-18T18:07:38Z","title":"A Simple \"Try Again\" Can Elicit Multi-Turn LLM Reasoning","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-06T16:14:04.197657Z"},"links":{"cited_paper":"/paper/2504.20073","citing_paper":"/paper/2507.14295"},"observation_digest":"sha256:9533e929b7ea0799e4a83c2b4a3f887815f098e3b9f7f868723c2a644bf674a6","observation_id":"69b166d7-93b9-4d6c-8956-1bad9a1ff0c0","resolution":{"observed_at":"2026-08-06T16:14:04.197657Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.07972","last_updated":"2024-05-30T08:55:12Z","snapshot_observed_at":"2026-08-07T10:10:50.201348Z","submitted_at":"2024-04-11T17:56:05Z","title":"OSWorld: Benchmarking Multimodal Agents for Open-Ended Tasks in Real Computer Environments","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.07972","snapshot_observed_at":"2026-08-06T16:14:04.352421Z","title":"Osworld: Benchmarking multimodal agents for open-ended tasks in real computer environments, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.14295","last_updated":"2025-08-22T16:49:10Z","snapshot_observed_at":"2026-08-07T14:03:43.498386Z","submitted_at":"2025-07-18T18:07:38Z","title":"A Simple \"Try Again\" Can Elicit Multi-Turn LLM Reasoning","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-06T16:14:04.352421Z"},"links":{"cited_paper":"/paper/2404.07972","citing_paper":"/paper/2507.14295"},"observation_digest":"sha256:60d18649789b7430e607700d9a4617d94ff58b591121a0358e6dfa20d430cb15","observation_id":"7a687a27-e2c6-419d-8403-c693e0e42247","resolution":{"observed_at":"2026-08-06T16:14:04.352421Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.21139","last_updated":"2025-06-06T07:53:20Z","snapshot_observed_at":"2026-07-06T20:14:49.976782Z","submitted_at":"2024-12-30T18:15:39Z","title":"Training Software Engineering Agents and Verifiers with SWE-Gym","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.21139","snapshot_observed_at":"2026-08-06T16:14:04.482017Z","title":"Training software engineering agents and verifiers with swe-gym, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.14295","last_updated":"2025-08-22T16:49:10Z","snapshot_observed_at":"2026-08-07T14:03:43.498386Z","submitted_at":"2025-07-18T18:07:38Z","title":"A Simple \"Try Again\" Can Elicit Multi-Turn LLM Reasoning","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-06T16:14:04.482017Z"},"links":{"cited_paper":"/paper/2412.21139","citing_paper":"/paper/2507.14295"},"observation_digest":"sha256:02bb6802ecaf01cab47ecbcccbf8e5ef6fc0c326cebfecf518a0b9bca9f69efc","observation_id":"47cd9019-307f-493d-8c78-e3e39d7fd96c","resolution":{"observed_at":"2026-08-06T16:14:04.482017Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.01206","last_updated":"2023-02-08T01:39:30Z","snapshot_observed_at":"2026-07-06T13:27:22.300465Z","submitted_at":"2022-07-04T05:30:22Z","title":"WebShop: Towards Scalable Real-World Web Interaction with Grounded Language Agents","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.01206","snapshot_observed_at":"2026-08-06T16:14:04.685622Z","title":"Webshop: Towards scalable real-world web interaction with grounded language agents, 2023 a","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.14295","last_updated":"2025-08-22T16:49:10Z","snapshot_observed_at":"2026-08-07T14:03:43.498386Z","submitted_at":"2025-07-18T18:07:38Z","title":"A Simple \"Try Again\" Can Elicit Multi-Turn LLM Reasoning","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-06T16:14:04.685622Z"},"links":{"cited_paper":"/paper/2207.01206","citing_paper":"/paper/2507.14295"},"observation_digest":"sha256:63c6bffa92e39dd191a611c5e073a1ccd99a102d79bdb2a724d418a864d79986","observation_id":"1cdbd948-6853-4fe3-8dc6-4761fff620e4","resolution":{"observed_at":"2026-08-06T16:14:04.685622Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.03768","last_updated":"2021-03-14T22:44:38Z","snapshot_observed_at":"2026-07-06T10:02:33.297722Z","submitted_at":"2020-10-08T05:13:36Z","title":"ALFWorld: Aligning Text and Embodied Environments for Interactive Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.03768","snapshot_observed_at":"2026-08-06T16:14:04.795371Z","title":"Alfworld: Aligning text and embodied environments for interactive learning, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.14295","last_updated":"2025-08-22T16:49:10Z","snapshot_observed_at":"2026-08-07T14:03:43.498386Z","submitted_at":"2025-07-18T18:07:38Z","title":"A Simple \"Try Again\" Can Elicit Multi-Turn LLM Reasoning","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-06T16:14:04.795371Z"},"links":{"cited_paper":"/paper/2010.03768","citing_paper":"/paper/2507.14295"},"observation_digest":"sha256:f7d671b6f830fa635de707b0aca0d7c54fe95ac9cb4326a64bb76cc7831de0b0","observation_id":"871f8b7a-38b5-4a3b-ba7f-27d4ff4df2bb","resolution":{"observed_at":"2026-08-06T16:14:04.795371Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.10691","last_updated":"2024-03-12T15:53:06Z","snapshot_observed_at":"2026-08-07T20:45:05.365412Z","submitted_at":"2023-09-19T15:25:42Z","title":"MINT: Evaluating LLMs in Multi-turn Interaction with Tools and Language Feedback","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.10691","snapshot_observed_at":"2026-08-06T16:14:04.918820Z","title":"Mint: Evaluating llms in multi-turn interaction with tools and language feedback, 2024 a","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.14295","last_updated":"2025-08-22T16:49:10Z","snapshot_observed_at":"2026-08-07T14:03:43.498386Z","submitted_at":"2025-07-18T18:07:38Z","title":"A Simple \"Try Again\" Can Elicit Multi-Turn LLM Reasoning","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-06T16:14:04.918820Z"},"links":{"cited_paper":"/paper/2309.10691","citing_paper":"/paper/2507.14295"},"observation_digest":"sha256:77fe024b432f253d676f44c84c09bda2280d4406a01b25c85f8d25c04c14a133","observation_id":"7e0cb956-51fa-47cc-be48-1410d9573aba","resolution":{"observed_at":"2026-08-06T16:14:04.918820Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:14:10.590357Z","title":"Simworld: A world simulator for scaling photorealistic multi-agent interactions, 2025","venue":null,"work_id":"15d5d53a-04f4-4d03-b6b9-4d4c95dce7c7","year":2025},"citing_paper":{"arxiv_id":"2507.14295","last_updated":"2025-08-22T16:49:10Z","snapshot_observed_at":"2026-08-07T14:03:43.498386Z","submitted_at":"2025-07-18T18:07:38Z","title":"A Simple \"Try Again\" Can Elicit Multi-Turn LLM Reasoning","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-06T16:14:05.133546Z"},"links":{"citing_paper":"/paper/2507.14295"},"observation_digest":"sha256:2630f086fb571797d747152b4e861044e856e145c7ae0a0b22f13f289a421903","observation_id":"ce9125b9-71b3-4eb9-9426-ede0b7403805","resolution":{"observed_at":"2026-08-06T16:14:10.660770Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:14:05.285192Z","title":"Gonzalez, and Ion Stoica","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.14295","last_updated":"2025-08-22T16:49:10Z","snapshot_observed_at":"2026-08-07T14:03:43.498386Z","submitted_at":"2025-07-18T18:07:38Z","title":"A Simple \"Try Again\" Can Elicit Multi-Turn LLM Reasoning","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-06T16:14:05.285192Z"},"links":{"citing_paper":"/paper/2507.14295"},"observation_digest":"sha256:da02eb7bf2ecce795613a03cf8b742582367aad5fa3a32c2a9de8674e241b743","observation_id":"3ddd5e56-30c2-468b-955b-142c29dd4d9b","resolution":{"observed_at":"2026-08-06T16:14:05.285192Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.02155","last_updated":"2022-03-04T07:04:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-03-04T07:04:42Z","title":"Training language models to follow instructions with human feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.02155","snapshot_observed_at":"2026-08-06T16:14:05.398814Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.14295","last_updated":"2025-08-22T16:49:10Z","snapshot_observed_at":"2026-08-07T14:03:43.498386Z","submitted_at":"2025-07-18T18:07:38Z","title":"A Simple \"Try Again\" Can Elicit Multi-Turn LLM Reasoning","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-06T16:14:05.398814Z"},"links":{"cited_paper":"/paper/2203.02155","citing_paper":"/paper/2507.14295"},"observation_digest":"sha256:0c6500cf8c551ea05e31c0972be86cc8b7fef01b54085fb2a9ed5a14cad4f433","observation_id":"ebae5172-5e07-4063-b061-45322dd9e06b","resolution":{"observed_at":"2026-08-06T16:14:05.398814Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-06T16:14:05.544503Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.14295","last_updated":"2025-08-22T16:49:10Z","snapshot_observed_at":"2026-08-07T14:03:43.498386Z","submitted_at":"2025-07-18T18:07:38Z","title":"A Simple \"Try Again\" Can Elicit Multi-Turn LLM Reasoning","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-06T16:14:05.544503Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2507.14295"},"observation_digest":"sha256:7057f04052c83b744f6b762038477883d6ea48030dc76af20345a735d67c1d16","observation_id":"5ae237ca-edbb-438a-b45f-14e8dbdf840c","resolution":{"observed_at":"2026-08-06T16:14:05.544503Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09516","last_updated":"2025-08-05T19:08:38Z","snapshot_observed_at":"2026-07-06T20:51:28.022519Z","submitted_at":"2025-03-12T16:26:39Z","title":"Search-R1: Training LLMs to Reason and Leverage Search Engines with Reinforcement Learning","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.09516","snapshot_observed_at":"2026-08-06T16:14:05.665511Z","title":"Search-r1: Training llms to reason and leverage search engines with reinforcement learning, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.14295","last_updated":"2025-08-22T16:49:10Z","snapshot_observed_at":"2026-08-07T14:03:43.498386Z","submitted_at":"2025-07-18T18:07:38Z","title":"A Simple \"Try Again\" Can Elicit Multi-Turn LLM Reasoning","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-06T16:14:05.665511Z"},"links":{"cited_paper":"/paper/2503.09516","citing_paper":"/paper/2507.14295"},"observation_digest":"sha256:62dd67dffff7f8f24c29fdc385d02dd5bdbd9d1444b1af87a4fc725d4c6ffe80","observation_id":"2cac3e1e-7103-4240-bed3-e2854c459812","resolution":{"observed_at":"2026-08-06T16:14:05.665511Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.11536","last_updated":"2025-04-17T16:46:07Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-15T18:10:22Z","title":"ReTool: Reinforcement Learning for Strategic Tool Use in LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.11536","snapshot_observed_at":"2026-08-06T16:14:05.766444Z","title":"Retool: Reinforcement learning for strategic tool use in llms, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.14295","last_updated":"2025-08-22T16:49:10Z","snapshot_observed_at":"2026-08-07T14:03:43.498386Z","submitted_at":"2025-07-18T18:07:38Z","title":"A Simple \"Try Again\" Can Elicit Multi-Turn LLM Reasoning","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-06T16:14:05.766444Z"},"links":{"cited_paper":"/paper/2504.11536","citing_paper":"/paper/2507.14295"},"observation_digest":"sha256:128f1fa0cf30f27e3449867a723c1968f4491e072331384d7305c5689d3ddbc4","observation_id":"5ae4401e-7a2f-4c3c-9d3a-980c350a22ea","resolution":{"observed_at":"2026-08-06T16:14:05.766444Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14476","last_updated":"2025-05-20T01:37:34Z","snapshot_observed_at":"2026-08-02T01:40:54.187278Z","submitted_at":"2025-03-18T17:49:06Z","title":"DAPO: An Open-Source LLM Reinforcement Learning System at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.14476","snapshot_observed_at":"2026-08-06T16:14:05.889070Z","title":"Dapo: An open-source llm reinforcement learning system at scale, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.14295","last_updated":"2025-08-22T16:49:10Z","snapshot_observed_at":"2026-08-07T14:03:43.498386Z","submitted_at":"2025-07-18T18:07:38Z","title":"A Simple \"Try Again\" Can Elicit Multi-Turn LLM Reasoning","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-06T16:14:05.889070Z"},"links":{"cited_paper":"/paper/2503.14476","citing_paper":"/paper/2507.14295"},"observation_digest":"sha256:040e543f4aee784fa9d51c17c7d4014e81fa779e15e7c4d2a4f941f8324df6fe","observation_id":"8574136e-8b3e-4922-bc44-b2c01fd2e3a9","resolution":{"observed_at":"2026-08-06T16:14:05.889070Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20783","last_updated":"2025-10-06T09:30:03Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-26T17:59:14Z","title":"Understanding R1-Zero-Like Training: A Critical Perspective","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20783","snapshot_observed_at":"2026-08-06T16:14:06.014532Z","title":"Understanding r1-zero-like training: A critical perspective","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.14295","last_updated":"2025-08-22T16:49:10Z","snapshot_observed_at":"2026-08-07T14:03:43.498386Z","submitted_at":"2025-07-18T18:07:38Z","title":"A Simple \"Try Again\" Can Elicit Multi-Turn LLM Reasoning","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-06T16:14:06.014532Z"},"links":{"cited_paper":"/paper/2503.20783","citing_paper":"/paper/2507.14295"},"observation_digest":"sha256:6febe427f41157e9f644c2ee9aa2e5ad6fdc85bcd6a5e853068142fd15c168ec","observation_id":"298c3469-3378-4fea-bdf6-944685f4ca02","resolution":{"observed_at":"2026-08-06T16:14:06.014532Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.24290","last_updated":"2025-07-05T09:01:04Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-31T16:36:05Z","title":"Open-Reasoner-Zero: An Open Source Approach to Scaling Up Reinforcement Learning on the Base Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.24290","snapshot_observed_at":"2026-08-06T16:14:06.124607Z","title":"Open-reasoner-zero: An open source approach to scaling up reinforcement learning on the base model, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.14295","last_updated":"2025-08-22T16:49:10Z","snapshot_observed_at":"2026-08-07T14:03:43.498386Z","submitted_at":"2025-07-18T18:07:38Z","title":"A Simple \"Try Again\" Can Elicit Multi-Turn LLM Reasoning","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-06T16:14:06.124607Z"},"links":{"cited_paper":"/paper/2503.24290","citing_paper":"/paper/2507.14295"},"observation_digest":"sha256:65cfe1b5363e0bb707a94d3101223f721174ba0bbee9ce6c6387b311d10df5d4","observation_id":"a1fbccc2-743f-43f9-b951-47742968c637","resolution":{"observed_at":"2026-08-06T16:14:06.124607Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.17633","last_updated":"2024-10-01T00:17:41Z","snapshot_observed_at":"2026-07-06T18:20:57.086853Z","submitted_at":"2024-05-27T20:00:38Z","title":"HEART-felt Narratives: Tracing Empathy and Narrative Style in Personal Stories with LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.17633","snapshot_observed_at":"2026-08-06T16:14:06.230944Z","title":"Kwok, Zhenguo Li, Adrian Weller, and Weiyang Liu","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.14295","last_updated":"2025-08-22T16:49:10Z","snapshot_observed_at":"2026-08-07T14:03:43.498386Z","submitted_at":"2025-07-18T18:07:38Z","title":"A Simple \"Try Again\" Can Elicit Multi-Turn LLM Reasoning","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-06T16:14:06.230944Z"},"links":{"cited_paper":"/paper/2405.17633","citing_paper":"/paper/2507.14295"},"observation_digest":"sha256:71bbb31c88dc751ebc199e8ba7a9273319b2fb007f9388d4496956fe7124a95f","observation_id":"181581e7-9293-4cf1-95a6-cbf1d8f68053","resolution":{"observed_at":"2026-08-06T16:14:06.230944Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.12524","last_updated":"2023-12-06T03:02:45Z","snapshot_observed_at":"2026-07-06T15:30:18.137347Z","submitted_at":"2023-05-21T17:51:35Z","title":"TheoremQA: A Theorem-driven Question Answering dataset","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.12524","snapshot_observed_at":"2026-08-06T16:14:06.336764Z","title":"Theoremqa: A theorem-driven question answering dataset, 2023 a","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.14295","last_updated":"2025-08-22T16:49:10Z","snapshot_observed_at":"2026-08-07T14:03:43.498386Z","submitted_at":"2025-07-18T18:07:38Z","title":"A Simple \"Try Again\" Can Elicit Multi-Turn LLM Reasoning","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-06T16:14:06.336764Z"},"links":{"cited_paper":"/paper/2305.12524","citing_paper":"/paper/2507.14295"},"observation_digest":"sha256:18916fb6c8830223f1df48c55024259f434ad2dd7c31b6da4154c4812f0d5697","observation_id":"73dc1681-ec6e-4b8f-9a9b-84e118096ee2","resolution":{"observed_at":"2026-08-06T16:14:06.336764Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1809.09600","last_updated":"2018-09-25T17:28:20Z","snapshot_observed_at":"2026-07-31T11:19:06.421362Z","submitted_at":"2018-09-25T17:28:20Z","title":"HotpotQA: A Dataset for Diverse, Explainable Multi-hop Question Answering","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1809.09600","snapshot_observed_at":"2026-08-06T16:14:06.442279Z","title":"Cohen, Ruslan Salakhutdinov, and Christopher D","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.14295","last_updated":"2025-08-22T16:49:10Z","snapshot_observed_at":"2026-08-07T14:03:43.498386Z","submitted_at":"2025-07-18T18:07:38Z","title":"A Simple \"Try Again\" Can Elicit Multi-Turn LLM Reasoning","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-06T16:14:06.442279Z"},"links":{"cited_paper":"/paper/1809.09600","citing_paper":"/paper/2507.14295"},"observation_digest":"sha256:f5e52c9a35f7258b5289f505a270afc13072f2ae408ddcf0cdd21f11927328f3","observation_id":"daabcfd0-3f11-408b-af82-a64257058c1c","resolution":{"observed_at":"2026-08-06T16:14:06.442279Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.11027","last_updated":"2022-03-14T13:08:51Z","snapshot_observed_at":"2026-07-06T12:50:15.089729Z","submitted_at":"2022-03-14T13:08:51Z","title":"Reasoning over Public and Private Data in Retrieval-Based Systems","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.11027","snapshot_observed_at":"2026-08-06T16:14:06.552532Z","title":"Reasoning over public and private data in retrieval-based systems, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.14295","last_updated":"2025-08-22T16:49:10Z","snapshot_observed_at":"2026-08-07T14:03:43.498386Z","submitted_at":"2025-07-18T18:07:38Z","title":"A Simple \"Try Again\" Can Elicit Multi-Turn LLM Reasoning","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-06T16:14:06.552532Z"},"links":{"cited_paper":"/paper/2203.11027","citing_paper":"/paper/2507.14295"},"observation_digest":"sha256:f12940ac050aaff1d92c3a748e6f7d229c03d71ceefebeade6758edd54a97738","observation_id":"e41177a8-a2d0-47bd-937b-617b59d41f6e","resolution":{"observed_at":"2026-08-06T16:14:06.552532Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.03300","last_updated":"2021-01-12T18:57:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-09-07T17:59:25Z","title":"Measuring Massive Multitask Language Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.03300","snapshot_observed_at":"2026-08-06T16:14:06.625049Z","title":"Measuring massive multitask language understanding, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.14295","last_updated":"2025-08-22T16:49:10Z","snapshot_observed_at":"2026-08-07T14:03:43.498386Z","submitted_at":"2025-07-18T18:07:38Z","title":"A Simple \"Try Again\" Can Elicit Multi-Turn LLM Reasoning","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-06T16:14:06.625049Z"},"links":{"cited_paper":"/paper/2009.03300","citing_paper":"/paper/2507.14295"},"observation_digest":"sha256:14f6325863eea456bf3ac64af663674313ece583a584b1e71e5ec3fefaba5de1","observation_id":"49182346-dc44-4c8e-b8e1-319a2d0820e8","resolution":{"observed_at":"2026-08-06T16:14:06.625049Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.01574","last_updated":"2024-11-06T02:54:00Z","snapshot_observed_at":"2026-08-06T00:29:17.674418Z","submitted_at":"2024-06-03T17:53:00Z","title":"MMLU-Pro: A More Robust and Challenging Multi-Task Language Understanding Benchmark","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.01574","snapshot_observed_at":"2026-08-06T16:14:06.701604Z","title":"Mmlu-pro: A more robust and challenging multi-task language understanding benchmark, 2024 b","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.14295","last_updated":"2025-08-22T16:49:10Z","snapshot_observed_at":"2026-08-07T14:03:43.498386Z","submitted_at":"2025-07-18T18:07:38Z","title":"A Simple \"Try Again\" Can Elicit Multi-Turn LLM Reasoning","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-06T16:14:06.701604Z"},"links":{"cited_paper":"/paper/2406.01574","citing_paper":"/paper/2507.14295"},"observation_digest":"sha256:fcb1aa991c2a85be836aaab5ff3f8e0b615479a3c6e0471d6386dbd22aa0ced6","observation_id":"afae9fdf-48b2-4f3c-856e-656045a2e324","resolution":{"observed_at":"2026-08-06T16:14:06.701604Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.09687","last_updated":"2024-02-06T18:00:18Z","snapshot_observed_at":"2026-08-06T03:16:16.175894Z","submitted_at":"2023-08-18T17:29:23Z","title":"Graph of Thoughts: Solving Elaborate Problems with Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.09687","snapshot_observed_at":"2026-08-06T16:14:06.824346Z","title":"Graph of thoughts: Solving elaborate problems with large language models, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.14295","last_updated":"2025-08-22T16:49:10Z","snapshot_observed_at":"2026-08-07T14:03:43.498386Z","submitted_at":"2025-07-18T18:07:38Z","title":"A Simple \"Try Again\" Can Elicit Multi-Turn LLM Reasoning","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-06T16:14:06.824346Z"},"links":{"cited_paper":"/paper/2308.09687","citing_paper":"/paper/2507.14295"},"observation_digest":"sha256:d8233cc6d9899b9f18798e4dae3837b8875386fd6e518d6ed40d2c6efe9e8400","observation_id":"951c7202-42bb-417f-9270-96f43c8cebe4","resolution":{"observed_at":"2026-08-06T16:14:06.824346Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.11366","last_updated":"2023-10-10T05:21:45Z","snapshot_observed_at":"2026-07-06T15:05:53.556198Z","submitted_at":"2023-03-20T18:08:50Z","title":"Reflexion: Language Agents with Verbal Reinforcement Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.11366","snapshot_observed_at":"2026-08-06T16:14:06.901577Z","title":"Reflexion: Language agents with verbal reinforcement learning, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.14295","last_updated":"2025-08-22T16:49:10Z","snapshot_observed_at":"2026-08-07T14:03:43.498386Z","submitted_at":"2025-07-18T18:07:38Z","title":"A Simple \"Try Again\" Can Elicit Multi-Turn LLM Reasoning","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-06T16:14:06.901577Z"},"links":{"cited_paper":"/paper/2303.11366","citing_paper":"/paper/2507.14295"},"observation_digest":"sha256:29ded6cea0a168c84ab585bb365c1461217300eca995355dfba61c1fe5094243","observation_id":"bc84f671-1e7f-4305-8939-c34d514f0e3a","resolution":{"observed_at":"2026-08-06T16:14:06.901577Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.07394","last_updated":"2024-06-13T07:19:06Z","snapshot_observed_at":"2026-07-06T18:29:00.001236Z","submitted_at":"2024-06-11T16:01:07Z","title":"Accessing GPT-4 level Mathematical Olympiad Solutions via Monte Carlo Tree Self-refine with LLaMa-3 8B","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.07394","snapshot_observed_at":"2026-08-06T16:14:06.999304Z","title":"Accessing gpt-4 level mathematical olympiad solutions via monte carlo tree search self-refinement, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.14295","last_updated":"2025-08-22T16:49:10Z","snapshot_observed_at":"2026-08-07T14:03:43.498386Z","submitted_at":"2025-07-18T18:07:38Z","title":"A Simple \"Try Again\" Can Elicit Multi-Turn LLM Reasoning","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-06T16:14:06.999304Z"},"links":{"cited_paper":"/paper/2406.07394","citing_paper":"/paper/2507.14295"},"observation_digest":"sha256:093877609bf1c6875ed30e5a3ecf57555cf982e5b98f9b898e8bb8ccd49cc686","observation_id":"5aeb5db2-1b6c-4c40-84b4-26c61b1f9262","resolution":{"observed_at":"2026-08-06T16:14:06.999304Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.17651","last_updated":"2023-05-25T19:13:47Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-03-30T18:30:01Z","title":"Self-Refine: Iterative Refinement with Self-Feedback","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.17651","snapshot_observed_at":"2026-08-06T16:14:07.142246Z","title":"Self-refine: Iterative refinement with self-feedback, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.14295","last_updated":"2025-08-22T16:49:10Z","snapshot_observed_at":"2026-08-07T14:03:43.498386Z","submitted_at":"2025-07-18T18:07:38Z","title":"A Simple \"Try Again\" Can Elicit Multi-Turn LLM Reasoning","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-06T16:14:07.142246Z"},"links":{"cited_paper":"/paper/2303.17651","citing_paper":"/paper/2507.14295"},"observation_digest":"sha256:a4013c7f4e7a7fdda4f58680a031ae7d3994a0134b0bbb03ddd9f17cdb398b66","observation_id":"7d33ccf3-a93e-4e24-98cf-a71390969d14","resolution":{"observed_at":"2026-08-06T16:14:07.142246Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.11738","last_updated":"2024-02-21T12:59:21Z","snapshot_observed_at":"2026-07-31T18:12:14.483728Z","submitted_at":"2023-05-19T15:19:44Z","title":"CRITIC: Large Language Models Can Self-Correct with Tool-Interactive Critiquing","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.11738","snapshot_observed_at":"2026-08-06T16:14:07.252826Z","title":"Critic: Large language models can self-correct with tool-augmented critiquing, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.14295","last_updated":"2025-08-22T16:49:10Z","snapshot_observed_at":"2026-08-07T14:03:43.498386Z","submitted_at":"2025-07-18T18:07:38Z","title":"A Simple \"Try Again\" Can Elicit Multi-Turn LLM Reasoning","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-06T16:14:07.252826Z"},"links":{"cited_paper":"/paper/2305.11738","citing_paper":"/paper/2507.14295"},"observation_digest":"sha256:32f45fbd463f392d0860e358efaef3eee3a9a518e0444043528295a9fd1f0dd7","observation_id":"ccc5a4b1-fbe3-434b-bd90-85dc181f763e","resolution":{"observed_at":"2026-08-06T16:14:07.252826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.07465","last_updated":"2024-08-14T11:19:28Z","snapshot_observed_at":"2026-08-07T16:59:22.791419Z","submitted_at":"2024-08-14T11:19:28Z","title":"Large Language Models Prompting With Episodic Memory","version":1},"cited_work":{"arxiv_id":"2408.07465","doi":null,"metadata_source":"pith","pith_arxiv_id":"2408.07465","snapshot_observed_at":"2026-08-06T16:14:10.173831Z","title":"Large Language Models Prompting With Episodic Memory","venue":"cs.CL","work_id":"79d1ae45-0414-4917-bb5f-4b3f4f717eb6","year":2024},"citing_paper":{"arxiv_id":"2507.14295","last_updated":"2025-08-22T16:49:10Z","snapshot_observed_at":"2026-08-07T14:03:43.498386Z","submitted_at":"2025-07-18T18:07:38Z","title":"A Simple \"Try Again\" Can Elicit Multi-Turn LLM Reasoning","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-06T16:14:07.377051Z"},"links":{"cited_paper":"/paper/2408.07465","citing_paper":"/paper/2507.14295"},"observation_digest":"sha256:bc6d1d45baf6ebd0a1e09347bf65a9b8f062b889d0af09953e85dae52f8e6818","observation_id":"3c18fef3-5c6c-42f0-bad3-34cd8047f5e7","resolution":{"observed_at":"2026-08-06T16:14:10.255823Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.11901","last_updated":"2024-08-21T22:54:47Z","snapshot_observed_at":"2026-07-06T17:46:25.142387Z","submitted_at":"2024-03-18T16:01:42Z","title":"Larimar: Large Language Models with Episodic Memory Control","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.11901","snapshot_observed_at":"2026-08-06T16:14:07.482480Z","title":"Larimar: Large language models with episodic memory control, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.14295","last_updated":"2025-08-22T16:49:10Z","snapshot_observed_at":"2026-08-07T14:03:43.498386Z","submitted_at":"2025-07-18T18:07:38Z","title":"A Simple \"Try Again\" Can Elicit Multi-Turn LLM Reasoning","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-06T16:14:07.482480Z"},"links":{"cited_paper":"/paper/2403.11901","citing_paper":"/paper/2507.14295"},"observation_digest":"sha256:1056b06951e41e797349213527f99ea33733b314cbef8f59216eed1a99aab2fc","observation_id":"3cb608d4-b8b8-4cbe-9b45-b488bf86d5c5","resolution":{"observed_at":"2026-08-06T16:14:07.482480Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1706.03741","last_updated":"2023-02-17T17:00:34Z","snapshot_observed_at":"2026-08-03T14:31:51.401500Z","submitted_at":"2017-06-12T17:23:59Z","title":"Deep reinforcement learning from human preferences","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.03741","snapshot_observed_at":"2026-08-06T16:14:07.581685Z","title":"Christiano, Jan Leike, Tom B","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.14295","last_updated":"2025-08-22T16:49:10Z","snapshot_observed_at":"2026-08-07T14:03:43.498386Z","submitted_at":"2025-07-18T18:07:38Z","title":"A Simple \"Try Again\" Can Elicit Multi-Turn LLM Reasoning","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-06T16:14:07.581685Z"},"links":{"cited_paper":"/paper/1706.03741","citing_paper":"/paper/2507.14295"},"observation_digest":"sha256:7961be613f7817dbb15ec32a04c35eca1a3538eec40a9c7fd56e0a5a28e962a8","observation_id":"4344a43d-7ea8-4d60-8166-252265d65b68","resolution":{"observed_at":"2026-08-06T16:14:07.581685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.00267","last_updated":"2024-09-03T14:01:54Z","snapshot_observed_at":"2026-07-06T16:13:07.384791Z","submitted_at":"2023-09-01T05:53:33Z","title":"RLAIF vs. RLHF: Scaling Reinforcement Learning from Human Feedback with AI Feedback","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.00267","snapshot_observed_at":"2026-08-06T16:14:07.594492Z","title":"Rlaif vs","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.14295","last_updated":"2025-08-22T16:49:10Z","snapshot_observed_at":"2026-08-07T14:03:43.498386Z","submitted_at":"2025-07-18T18:07:38Z","title":"A Simple \"Try Again\" Can Elicit Multi-Turn LLM Reasoning","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-06T16:14:07.594492Z"},"links":{"cited_paper":"/paper/2309.00267","citing_paper":"/paper/2507.14295"},"observation_digest":"sha256:296fd99ca21062e8409a63e7ca09c17683301b33bf1c9226685c6b48ea4a7d79","observation_id":"2e6002a7-da98-419a-a470-c755754598ea","resolution":{"observed_at":"2026-08-06T16:14:07.594492Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.04622","last_updated":"2024-07-12T16:38:12Z","snapshot_observed_at":"2026-08-02T16:31:30.812187Z","submitted_at":"2024-07-05T16:29:15Z","title":"On scalable oversight with weak LLMs judging strong LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.04622","snapshot_observed_at":"2026-08-06T16:14:07.651045Z","title":"Siegel, János Kramár, Jonah Brown-Cohen, Samuel Albanie, Jannis Bulian, Rishabh Agarwal, David Lindner, Yunhao Tang, Noah D","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.14295","last_updated":"2025-08-22T16:49:10Z","snapshot_observed_at":"2026-08-07T14:03:43.498386Z","submitted_at":"2025-07-18T18:07:38Z","title":"A Simple \"Try Again\" Can Elicit Multi-Turn LLM Reasoning","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-06T16:14:07.651045Z"},"links":{"cited_paper":"/paper/2407.04622","citing_paper":"/paper/2507.14295"},"observation_digest":"sha256:1abd89966b08f8451e708a63771dea64496bdc77958acf4aca9f3ea4cf1bb689","observation_id":"48114e8b-2682-435f-b466-1d18e8140ded","resolution":{"observed_at":"2026-08-06T16:14:07.651045Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.18290","last_updated":"2024-07-29T22:26:36Z","snapshot_observed_at":"2026-08-01T16:34:38.795326Z","submitted_at":"2023-05-29T17:57:46Z","title":"Direct Preference Optimization: Your Language Model is Secretly a Reward Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.18290","snapshot_observed_at":"2026-08-06T16:14:07.746870Z","title":"Manning, and Chelsea Finn","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.14295","last_updated":"2025-08-22T16:49:10Z","snapshot_observed_at":"2026-08-07T14:03:43.498386Z","submitted_at":"2025-07-18T18:07:38Z","title":"A Simple \"Try Again\" Can Elicit Multi-Turn LLM Reasoning","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-06T16:14:07.746870Z"},"links":{"cited_paper":"/paper/2305.18290","citing_paper":"/paper/2507.14295"},"observation_digest":"sha256:ae7046988213e8b167f9b53f164d2e1ecf2a35bd68474ba60c28356481297fdf","observation_id":"194dec1d-eefe-415e-b1a5-da239a12b62b","resolution":{"observed_at":"2026-08-06T16:14:07.746870Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.10704","last_updated":"2024-09-12T18:25:16Z","snapshot_observed_at":"2026-08-04T05:04:56.942998Z","submitted_at":"2024-03-15T21:43:46Z","title":"Parameter Efficient Reinforcement Learning from Human Feedback","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.10704","snapshot_observed_at":"2026-08-06T16:14:07.820412Z","title":"Parameter efficient reinforcement learning from human feedback, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.14295","last_updated":"2025-08-22T16:49:10Z","snapshot_observed_at":"2026-08-07T14:03:43.498386Z","submitted_at":"2025-07-18T18:07:38Z","title":"A Simple \"Try Again\" Can Elicit Multi-Turn LLM Reasoning","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-06T16:14:07.820412Z"},"links":{"cited_paper":"/paper/2403.10704","citing_paper":"/paper/2507.14295"},"observation_digest":"sha256:c9f036dad349cb4971d0fd2a40a9279588d035e3fb3a7b96ed281ee73628ad06","observation_id":"4ac7c2ab-2fef-4fce-a820-1cde53e3f2d8","resolution":{"observed_at":"2026-08-06T16:14:07.820412Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.01335","last_updated":"2024-06-14T21:17:17Z","snapshot_observed_at":"2026-07-06T17:10:56.398607Z","submitted_at":"2024-01-02T18:53:13Z","title":"Self-Play Fine-Tuning Converts Weak Language Models to Strong Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.01335","snapshot_observed_at":"2026-08-06T16:14:07.896851Z","title":"Self-play fine-tuning converts weak language models to strong language models, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.14295","last_updated":"2025-08-22T16:49:10Z","snapshot_observed_at":"2026-08-07T14:03:43.498386Z","submitted_at":"2025-07-18T18:07:38Z","title":"A Simple \"Try Again\" Can Elicit Multi-Turn LLM Reasoning","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-06T16:14:07.896851Z"},"links":{"cited_paper":"/paper/2401.01335","citing_paper":"/paper/2507.14295"},"observation_digest":"sha256:3df89ecbeb9928f9f59dd515e3daac74f36cda223a5e0063b797a14b0e6bcaa6","observation_id":"10ca8d94-9bbf-4789-a5a4-e5ad3429da5e","resolution":{"observed_at":"2026-08-06T16:14:07.896851Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16382","last_updated":"2024-06-24T07:47:34Z","snapshot_observed_at":"2026-08-07T12:09:17.461199Z","submitted_at":"2024-06-24T07:47:34Z","title":"UNO Arena for Evaluating Sequential Decision-Making Capability of Large Language Models","version":1},"cited_work":{"arxiv_id":"2406.16382","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.16382","snapshot_observed_at":"2026-08-06T16:14:09.800134Z","title":"UNO Arena for Evaluating Sequential Decision-Making Capability of Large Language Models","venue":"cs.CL","work_id":"14b4af1e-251a-40ed-98d1-10710968e6c7","year":2024},"citing_paper":{"arxiv_id":"2507.14295","last_updated":"2025-08-22T16:49:10Z","snapshot_observed_at":"2026-08-07T14:03:43.498386Z","submitted_at":"2025-07-18T18:07:38Z","title":"A Simple \"Try Again\" Can Elicit Multi-Turn LLM Reasoning","version":2},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-06T16:14:08.019297Z"},"links":{"cited_paper":"/paper/2406.16382","citing_paper":"/paper/2507.14295"},"observation_digest":"sha256:e0d71da5166b26ad16f2cd32e450968ef80993162557dc272a834031d0b54a03","observation_id":"4fc4a1fe-2bfc-4f79-8670-f9e59b038f75","resolution":{"observed_at":"2026-08-06T16:14:09.915290Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-06T16:14:08.106325Z","title":"Training verifiers to solve math word problems, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.14295","last_updated":"2025-08-22T16:49:10Z","snapshot_observed_at":"2026-08-07T14:03:43.498386Z","submitted_at":"2025-07-18T18:07:38Z","title":"A Simple \"Try Again\" Can Elicit Multi-Turn LLM Reasoning","version":2},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-06T16:14:08.106325Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2507.14295"},"observation_digest":"sha256:75deb66eaf5e1c3fb812f499f5dc7119949e0ede891424e0591356f0097f9a43","observation_id":"a65de3cd-6f1a-45ac-a9de-7ab66f3fa671","resolution":{"observed_at":"2026-08-06T16:14:08.106325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.03874","last_updated":"2021-11-08T21:30:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-03-05T18:59:39Z","title":"Measuring Mathematical Problem Solving With the MATH Dataset","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.03874","snapshot_observed_at":"2026-08-06T16:14:08.189265Z","title":"Measuring mathematical problem solving with the math dataset, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.14295","last_updated":"2025-08-22T16:49:10Z","snapshot_observed_at":"2026-08-07T14:03:43.498386Z","submitted_at":"2025-07-18T18:07:38Z","title":"A Simple \"Try Again\" Can Elicit Multi-Turn LLM Reasoning","version":2},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-06T16:14:08.189265Z"},"links":{"cited_paper":"/paper/2103.03874","citing_paper":"/paper/2507.14295"},"observation_digest":"sha256:9ffab190372cd3b79c6c61bb882bf343e1b2ce0f6a413b0797ce9adb4bb27596","observation_id":"767d4daa-4474-44d3-9b51-91a5bf50c929","resolution":{"observed_at":"2026-08-06T16:14:08.189265Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2201.11903","last_updated":"2023-01-10T23:07:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-01-28T02:33:07Z","title":"Chain-of-Thought Prompting Elicits Reasoning in Large Language Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.11903","snapshot_observed_at":"2026-08-06T16:14:08.303551Z","title":"Chain-of-thought prompting elicits reasoning in large language models, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.14295","last_updated":"2025-08-22T16:49:10Z","snapshot_observed_at":"2026-08-07T14:03:43.498386Z","submitted_at":"2025-07-18T18:07:38Z","title":"A Simple \"Try Again\" Can Elicit Multi-Turn LLM Reasoning","version":2},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-06T16:14:08.303551Z"},"links":{"cited_paper":"/paper/2201.11903","citing_paper":"/paper/2507.14295"},"observation_digest":"sha256:4cea1d6af773b6b7141921e0afb597f8d737328d0e8f37a4fb89ba486349de33","observation_id":"88d476c0-e02e-47c5-a815-cd4a96ff86cf","resolution":{"observed_at":"2026-08-06T16:14:08.303551Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.11171","last_updated":"2023-03-07T17:57:37Z","snapshot_observed_at":"2026-07-06T12:50:22.773056Z","submitted_at":"2022-03-21T17:48:52Z","title":"Self-Consistency Improves Chain of Thought Reasoning in Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.11171","snapshot_observed_at":"2026-08-06T16:14:08.374932Z","title":"Self-consistency improves chain-of-thought reasoning in language models, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.14295","last_updated":"2025-08-22T16:49:10Z","snapshot_observed_at":"2026-08-07T14:03:43.498386Z","submitted_at":"2025-07-18T18:07:38Z","title":"A Simple \"Try Again\" Can Elicit Multi-Turn LLM Reasoning","version":2},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-06T16:14:08.374932Z"},"links":{"cited_paper":"/paper/2203.11171","citing_paper":"/paper/2507.14295"},"observation_digest":"sha256:4622bb9b12d708c6ff217b42af02a0502f8d5248d17c74679630585bc6c5c277","observation_id":"6b3fe19b-6338-4233-8b83-17bb197f16bb","resolution":{"observed_at":"2026-08-06T16:14:08.374932Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.10601","last_updated":"2023-12-03T22:50:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-17T23:16:17Z","title":"Tree of Thoughts: Deliberate Problem Solving with Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.10601","snapshot_observed_at":"2026-08-06T16:14:08.466387Z","title":"Griffiths, Yuan Cao, and Karthik Narasimhan","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.14295","last_updated":"2025-08-22T16:49:10Z","snapshot_observed_at":"2026-08-07T14:03:43.498386Z","submitted_at":"2025-07-18T18:07:38Z","title":"A Simple \"Try Again\" Can Elicit Multi-Turn LLM Reasoning","version":2},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-06T16:14:08.466387Z"},"links":{"cited_paper":"/paper/2305.10601","citing_paper":"/paper/2507.14295"},"observation_digest":"sha256:758835a26290a5f8d1ed5f7cae796aa842c99cccedb793f234cc7452a55b5b42","observation_id":"7b333d75-1361-4f5f-93e1-2b7aa7042db9","resolution":{"observed_at":"2026-08-06T16:14:08.466387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.03629","last_updated":"2023-03-10T01:00:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-10-06T01:00:32Z","title":"ReAct: Synergizing Reasoning and Acting in Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.03629","snapshot_observed_at":"2026-08-06T16:14:08.565734Z","title":"React: Synergizing reasoning and acting in language models, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.14295","last_updated":"2025-08-22T16:49:10Z","snapshot_observed_at":"2026-08-07T14:03:43.498386Z","submitted_at":"2025-07-18T18:07:38Z","title":"A Simple \"Try Again\" Can Elicit Multi-Turn LLM Reasoning","version":2},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-06T16:14:08.565734Z"},"links":{"cited_paper":"/paper/2210.03629","citing_paper":"/paper/2507.14295"},"observation_digest":"sha256:0b9896a8babb0a78bfab7c974df3f3beb73d3645976dd783b344363bee3ae80e","observation_id":"86811f4b-5b09-410d-a948-d896f4aa6c56","resolution":{"observed_at":"2026-08-06T16:14:08.565734Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.10435","last_updated":"2023-01-27T15:30:27Z","snapshot_observed_at":"2026-08-07T01:22:26.004756Z","submitted_at":"2022-11-18T18:56:13Z","title":"PAL: Program-aided Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.10435","snapshot_observed_at":"2026-08-06T16:14:08.667441Z","title":"Pal: Program-aided language models, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.14295","last_updated":"2025-08-22T16:49:10Z","snapshot_observed_at":"2026-08-07T14:03:43.498386Z","submitted_at":"2025-07-18T18:07:38Z","title":"A Simple \"Try Again\" Can Elicit Multi-Turn LLM Reasoning","version":2},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-06T16:14:08.667441Z"},"links":{"cited_paper":"/paper/2211.10435","citing_paper":"/paper/2507.14295"},"observation_digest":"sha256:def7e4de448740f1db9f52ad33deec68626b516ecae27f05bc7383471557c82c","observation_id":"f9866ada-72fb-404f-a504-70cb42a61217","resolution":{"observed_at":"2026-08-06T16:14:08.667441Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.12588","last_updated":"2023-10-23T01:27:38Z","snapshot_observed_at":"2026-08-02T13:06:11.850456Z","submitted_at":"2022-11-22T21:06:00Z","title":"Program of Thoughts Prompting: Disentangling Computation from Reasoning for Numerical Reasoning Tasks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.12588","snapshot_observed_at":"2026-08-06T16:14:08.740558Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.14295","last_updated":"2025-08-22T16:49:10Z","snapshot_observed_at":"2026-08-07T14:03:43.498386Z","submitted_at":"2025-07-18T18:07:38Z","title":"A Simple \"Try Again\" Can Elicit Multi-Turn LLM Reasoning","version":2},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-06T16:14:08.740558Z"},"links":{"cited_paper":"/paper/2211.12588","citing_paper":"/paper/2507.14295"},"observation_digest":"sha256:3960e9f308022ac9c706c73aa109fe7f9b33248866c6c12295385a2585d36ffa","observation_id":"5e7c3e03-f7f3-46b8-bced-357d7694b112","resolution":{"observed_at":"2026-08-06T16:14:08.740558Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.04761","last_updated":"2023-02-09T16:49:57Z","snapshot_observed_at":"2026-07-06T14:50:07.491434Z","submitted_at":"2023-02-09T16:49:57Z","title":"Toolformer: Language Models Can Teach Themselves to Use Tools","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.04761","snapshot_observed_at":"2026-08-06T16:14:08.865042Z","title":"Toolformer: Language models can teach themselves to use tools, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.14295","last_updated":"2025-08-22T16:49:10Z","snapshot_observed_at":"2026-08-07T14:03:43.498386Z","submitted_at":"2025-07-18T18:07:38Z","title":"A Simple \"Try Again\" Can Elicit Multi-Turn LLM Reasoning","version":2},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-06T16:14:08.865042Z"},"links":{"cited_paper":"/paper/2302.04761","citing_paper":"/paper/2507.14295"},"observation_digest":"sha256:1cd964e17e407ebe1d167d964bf7d1f8dca46dd0a71c12483a9a95f88b14b59a","observation_id":"15b7b6c7-8e84-4df7-a904-398435224e19","resolution":{"observed_at":"2026-08-06T16:14:08.865042Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.20050","last_updated":"2023-05-31T17:24:00Z","snapshot_observed_at":"2026-08-05T13:11:04.104454Z","submitted_at":"2023-05-31T17:24:00Z","title":"Let's Verify Step by Step","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.20050","snapshot_observed_at":"2026-08-06T16:14:08.959676Z","title":"Let's verify step by step, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.14295","last_updated":"2025-08-22T16:49:10Z","snapshot_observed_at":"2026-08-07T14:03:43.498386Z","submitted_at":"2025-07-18T18:07:38Z","title":"A Simple \"Try Again\" Can Elicit Multi-Turn LLM Reasoning","version":2},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-06T16:14:08.959676Z"},"links":{"cited_paper":"/paper/2305.20050","citing_paper":"/paper/2507.14295"},"observation_digest":"sha256:c9637f6b3665a233bd598218ea2e093995f619b4bb4adc426c577a404d5bfc7f","observation_id":"4413c3a9-3758-45c7-8799-5a54cd77fcc4","resolution":{"observed_at":"2026-08-06T16:14:08.959676Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.16802","last_updated":"2024-10-24T09:52:59Z","snapshot_observed_at":"2026-07-06T18:20:18.770090Z","submitted_at":"2024-05-27T03:44:24Z","title":"AutoPSV: Automated Process-Supervised Verifier","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.16802","snapshot_observed_at":"2026-08-06T16:14:09.056162Z","title":"Autopsv: Automated process-supervised verifier, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.14295","last_updated":"2025-08-22T16:49:10Z","snapshot_observed_at":"2026-08-07T14:03:43.498386Z","submitted_at":"2025-07-18T18:07:38Z","title":"A Simple \"Try Again\" Can Elicit Multi-Turn LLM Reasoning","version":2},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-06T16:14:09.056162Z"},"links":{"cited_paper":"/paper/2405.16802","citing_paper":"/paper/2507.14295"},"observation_digest":"sha256:7a2b91205c4beaf36ab7fe22a08301f2ada14e63ec814c4bc3cd78d9065bea04","observation_id":"144f1987-5e3c-4b69-8ac1-a239733e5a99","resolution":{"observed_at":"2026-08-06T16:14:09.056162Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.08935","last_updated":"2024-02-19T14:07:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-14T13:41:54Z","title":"Math-Shepherd: Verify and Reinforce LLMs Step-by-step without Human Annotations","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.08935","snapshot_observed_at":"2026-08-06T16:14:09.175411Z","title":"Xu, Damai Dai, Yifei Li, Deli Chen, Y.Wu, and Zhifang Sui","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.14295","last_updated":"2025-08-22T16:49:10Z","snapshot_observed_at":"2026-08-07T14:03:43.498386Z","submitted_at":"2025-07-18T18:07:38Z","title":"A Simple \"Try Again\" Can Elicit Multi-Turn LLM Reasoning","version":2},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-06T16:14:09.175411Z"},"links":{"cited_paper":"/paper/2312.08935","citing_paper":"/paper/2507.14295"},"observation_digest":"sha256:2a95c9cff35001e960f01b8f766dcb7e37cf7a724a67a14da4213e93f369813c","observation_id":"d16cba06-c5ee-465b-89a1-82f9c7880e9c","resolution":{"observed_at":"2026-08-06T16:14:09.175411Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.08146","last_updated":"2024-10-10T17:31:23Z","snapshot_observed_at":"2026-08-02T06:08:09.777151Z","submitted_at":"2024-10-10T17:31:23Z","title":"Rewarding Progress: Scaling Automated Process Verifiers for LLM Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.08146","snapshot_observed_at":"2026-08-06T16:14:09.245253Z","title":"Rewarding progress: Scaling automated process verifiers for llm reasoning, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.14295","last_updated":"2025-08-22T16:49:10Z","snapshot_observed_at":"2026-08-07T14:03:43.498386Z","submitted_at":"2025-07-18T18:07:38Z","title":"A Simple \"Try Again\" Can Elicit Multi-Turn LLM Reasoning","version":2},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-06T16:14:09.245253Z"},"links":{"cited_paper":"/paper/2410.08146","citing_paper":"/paper/2507.14295"},"observation_digest":"sha256:82abd7ca3d8852861e23fb9dc92a623b9e434b9285e6c7175342458e49bc9aa3","observation_id":"972a76c5-c47e-4911-9642-3e5d1b12bd12","resolution":{"observed_at":"2026-08-06T16:14:09.245253Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:14:09.305497Z","title":"Ursa: Understanding and verifying chain-of-thought reasoning in large language models, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.14295","last_updated":"2025-08-22T16:49:10Z","snapshot_observed_at":"2026-08-07T14:03:43.498386Z","submitted_at":"2025-07-18T18:07:38Z","title":"A Simple \"Try Again\" Can Elicit Multi-Turn LLM Reasoning","version":2},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-06T16:14:09.305497Z"},"links":{"citing_paper":"/paper/2507.14295"},"observation_digest":"sha256:3dee649704dccc17840c273d973cc94d6de477c9ca1fe5b7b9add709e6e28f3a","observation_id":"acf55dc0-563b-4636-8500-950e53af27a0","resolution":{"observed_at":"2026-08-06T16:14:09.305497Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01798","last_updated":"2024-03-14T04:27:52Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-03T04:56:12Z","title":"Large Language Models Cannot Self-Correct Reasoning Yet","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.01798","snapshot_observed_at":"2026-08-06T16:14:09.393008Z","title":"Large language models cannot self-correct reasoning yet, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.14295","last_updated":"2025-08-22T16:49:10Z","snapshot_observed_at":"2026-08-07T14:03:43.498386Z","submitted_at":"2025-07-18T18:07:38Z","title":"A Simple \"Try Again\" Can Elicit Multi-Turn LLM Reasoning","version":2},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-06T16:14:09.393008Z"},"links":{"cited_paper":"/paper/2310.01798","citing_paper":"/paper/2507.14295"},"observation_digest":"sha256:ad6f2283760937cdd690d263640122a8591ac665863b337c7a2498554f9ef1f3","observation_id":"35ee2956-b30f-49e9-a549-c2ea74da1a31","resolution":{"observed_at":"2026-08-06T16:14:09.393008Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1506.02438","last_updated":"2018-10-20T18:55:07Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2015-06-08T11:12:48Z","title":"High-Dimensional Continuous Control Using Generalized Advantage Estimation","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1506.02438","snapshot_observed_at":"2026-08-06T16:14:09.490536Z","title":"High-dimensional continuous control using generalized advantage estimation, 2015","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2507.14295","last_updated":"2025-08-22T16:49:10Z","snapshot_observed_at":"2026-08-07T14:03:43.498386Z","submitted_at":"2025-07-18T18:07:38Z","title":"A Simple \"Try Again\" Can Elicit Multi-Turn LLM Reasoning","version":2},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-06T16:14:09.490536Z"},"links":{"cited_paper":"/paper/1506.02438","citing_paper":"/paper/2507.14295"},"observation_digest":"sha256:1afe943446d219a0be01a3e49ef57172c1302deb2cf4c9e7262afdf1e597fd58","observation_id":"1dfd7eaa-d8bf-485e-9537-a01cb4c3251c","resolution":{"observed_at":"2026-08-06T16:14:09.490536Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.14295","last_updated":"2025-08-22T16:49:10Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-07T14:03:43.498386Z","submitted_at":"2025-07-18T18:07:38Z","title":"A Simple \"Try Again\" Can Elicit Multi-Turn LLM Reasoning"},"reference_resolution":{"displayed":57,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":54,"verified_exact":2,"verified_fuzzy":1},"total_outbound_references":57},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 57 of 57 outbound references and 2 inbound Pith citation observations for arXiv:2507.14295."}