{"as_of":"2026-08-04T17:49:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:535afa153c3809eb56d9fbb69ae3e102b856ec4ce3918ddb63d687442a48c296","coverage":[{"denominator":67,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":67,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T06:40:30.140719Z","state":"measured"},{"denominator":67,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":67,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-04T06:34:03.388597+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2512.10739/citation-record","integrity":"/paper/2512.10739/integrity","json":"/paper/2512.10739/citation-record.json","paper":"/paper/2512.10739"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2503.04697","last_updated":"2025-10-03T01:55:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-06T18:43:29Z","title":"L1: Controlling How Long A Reasoning Model Thinks With Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.04697","snapshot_observed_at":"2026-08-04T06:40:23.260343Z","title":"L1: Controllinghowlongareasoningmodelthinkswithreinforcement learning.ArXiv, abs/2503.04697, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.10739","last_updated":"2026-08-03T08:17:50Z","snapshot_observed_at":"2026-08-04T17:34:49.398085Z","submitted_at":"2025-12-11T15:26:28Z","title":"Intern-S1-MO: Long-horizon Reasoning Agent for Olympiad?Level Mathematical Problem Solving","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-04T06:40:23.260343Z"},"links":{"cited_paper":"/paper/2503.04697","citing_paper":"/paper/2512.10739"},"observation_digest":"sha256:e515ff459b66e9300d83eab83ec08e6b2336de2c864d32b746dccbde3e06b218","observation_id":"7b201fa7-2edf-4822-bc7c-96f7908bcbc1","resolution":{"observed_at":"2026-08-04T06:40:23.260343Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T06:40:23.379329Z","title":"Intern-s1: A scientific multimodal foundation model.arXiv preprint arXiv:2508.15763, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.10739","last_updated":"2026-08-03T08:17:50Z","snapshot_observed_at":"2026-08-04T17:34:49.398085Z","submitted_at":"2025-12-11T15:26:28Z","title":"Intern-S1-MO: Long-horizon Reasoning Agent for Olympiad?Level Mathematical Problem Solving","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-04T06:40:23.379329Z"},"links":{"citing_paper":"/paper/2512.10739"},"observation_digest":"sha256:21bef4d28b614a1cc67a2b36b54f95ed174b77e812741887853e269343468303","observation_id":"4e30123f-1e0f-461c-bef2-97d05a189f2a","resolution":{"observed_at":"2026-08-04T06:40:23.379329Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23281","last_updated":"2026-01-14T21:39:58Z","snapshot_observed_at":"2026-08-02T10:05:44.330694Z","submitted_at":"2025-05-29T09:28:06Z","title":"MathArena: Evaluating LLMs on Uncontaminated Math Competitions","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.23281","snapshot_observed_at":"2026-08-04T06:40:23.495396Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.10739","last_updated":"2026-08-03T08:17:50Z","snapshot_observed_at":"2026-08-04T17:34:49.398085Z","submitted_at":"2025-12-11T15:26:28Z","title":"Intern-S1-MO: Long-horizon Reasoning Agent for Olympiad?Level Mathematical Problem Solving","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-04T06:40:23.495396Z"},"links":{"cited_paper":"/paper/2505.23281","citing_paper":"/paper/2512.10739"},"observation_digest":"sha256:72f652b43696551a2f29718b0e75fd4713a4bcb4095b64b3091aec26848ffa5b","observation_id":"efbee071-935c-4cbe-b658-be0b4f3f058e","resolution":{"observed_at":"2026-08-04T06:40:23.495396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.23726","last_updated":"2025-08-01T03:36:47Z","snapshot_observed_at":"2026-07-06T22:05:52.712231Z","submitted_at":"2025-07-31T17:00:30Z","title":"Seed-Prover: Deep and Broad Reasoning for Automated Theorem Proving","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.23726","snapshot_observed_at":"2026-08-04T06:40:23.612497Z","title":"Seed-prover: Deep and broad reasoning for automated theorem proving.arXiv preprint arXiv:2507.23726, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.10739","last_updated":"2026-08-03T08:17:50Z","snapshot_observed_at":"2026-08-04T17:34:49.398085Z","submitted_at":"2025-12-11T15:26:28Z","title":"Intern-S1-MO: Long-horizon Reasoning Agent for Olympiad?Level Mathematical Problem Solving","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-04T06:40:23.612497Z"},"links":{"cited_paper":"/paper/2507.23726","citing_paper":"/paper/2512.10739"},"observation_digest":"sha256:eb0c9f629c96e35e74c0a97697b9f08bcec08dc0a901d80fa45d4461eee7a31a","observation_id":"29799628-afe5-4a3d-9348-6e5c57770324","resolution":{"observed_at":"2026-08-04T06:40:23.612497Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-08-04T06:40:23.752322Z","title":"Evaluating large language models trained on code.arXiv preprint arXiv:2107.03374, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2512.10739","last_updated":"2026-08-03T08:17:50Z","snapshot_observed_at":"2026-08-04T17:34:49.398085Z","submitted_at":"2025-12-11T15:26:28Z","title":"Intern-S1-MO: Long-horizon Reasoning Agent for Olympiad?Level Mathematical Problem Solving","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-04T06:40:23.752322Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2512.10739"},"observation_digest":"sha256:7bcbe9b80b41a4cce947e69722572b3e1524b22ed3ae120b267e36cda4f55a58","observation_id":"979f597f-44f8-4126-aa3c-bf3e5dacc73e","resolution":{"observed_at":"2026-08-04T06:40:23.752322Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.06261","last_updated":"2025-12-19T14:25:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-07T17:36:04Z","title":"Gemini 2.5: Pushing the Frontier with Advanced Reasoning, Multimodality, Long Context, and Next Generation Agentic Capabilities","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.06261","snapshot_observed_at":"2026-08-04T06:40:23.898599Z","title":"Gemini 2.5: Pushing the frontier with advanced reasoning, multimodality, long context, and next generation agentic capabilities.ArXiv, abs/2507.06261, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.10739","last_updated":"2026-08-03T08:17:50Z","snapshot_observed_at":"2026-08-04T17:34:49.398085Z","submitted_at":"2025-12-11T15:26:28Z","title":"Intern-S1-MO: Long-horizon Reasoning Agent for Olympiad?Level Mathematical Problem Solving","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-04T06:40:23.898599Z"},"links":{"cited_paper":"/paper/2507.06261","citing_paper":"/paper/2512.10739"},"observation_digest":"sha256:d17f69574135e25d6099875ae88b40b60fb5e91e97de0d90c5bdcc16aa6be39f","observation_id":"24574ada-0b90-40c2-8cac-349d5496bbd8","resolution":{"observed_at":"2026-08-04T06:40:23.898599Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T06:40:24.041814Z","title":"Advanced version of gemini with deep think officially achieves gold-medal standard at the international mathematical olympiad, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.10739","last_updated":"2026-08-03T08:17:50Z","snapshot_observed_at":"2026-08-04T17:34:49.398085Z","submitted_at":"2025-12-11T15:26:28Z","title":"Intern-S1-MO: Long-horizon Reasoning Agent for Olympiad?Level Mathematical Problem Solving","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-04T06:40:24.041814Z"},"links":{"citing_paper":"/paper/2512.10739"},"observation_digest":"sha256:f3b3cef5fb1252f30e892df18898fef310141997f3cd8f2c669fac95e3fa222a","observation_id":"73278f5f-43d5-42d5-bd87-3427e81b5fd7","resolution":{"observed_at":"2026-08-04T06:40:24.041814Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17452","last_updated":"2024-02-21T12:59:22Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-29T17:59:38Z","title":"ToRA: A Tool-Integrated Reasoning Agent for Mathematical Problem Solving","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.17452","snapshot_observed_at":"2026-08-04T06:40:24.157889Z","title":"Tora: A tool-integrated reasoning agent for mathematical problem solving.ArXiv, abs/2309.17452,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2512.10739","last_updated":"2026-08-03T08:17:50Z","snapshot_observed_at":"2026-08-04T17:34:49.398085Z","submitted_at":"2025-12-11T15:26:28Z","title":"Intern-S1-MO: Long-horizon Reasoning Agent for Olympiad?Level Mathematical Problem Solving","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-04T06:40:24.157889Z"},"links":{"cited_paper":"/paper/2309.17452","citing_paper":"/paper/2512.10739"},"observation_digest":"sha256:0edd5584c30cc3da246d47791733933f1d5c044b3bf4615c139a81c7b3b47fe6","observation_id":"835dc669-3e1f-4893-9f4f-15008906d575","resolution":{"observed_at":"2026-08-04T06:40:24.157889Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-04T06:40:24.287198Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning.arXiv preprint arXiv:2501.12948, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.10739","last_updated":"2026-08-03T08:17:50Z","snapshot_observed_at":"2026-08-04T17:34:49.398085Z","submitted_at":"2025-12-11T15:26:28Z","title":"Intern-S1-MO: Long-horizon Reasoning Agent for Olympiad?Level Mathematical Problem Solving","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-04T06:40:24.287198Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2512.10739"},"observation_digest":"sha256:4f238c853aa1112587b7c64711218c75946ff7b0c43c1836e8c1771153722f90","observation_id":"1583c6ec-1618-4414-a522-ef5c0234287a","resolution":{"observed_at":"2026-08-04T06:40:24.287198Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T06:40:24.340920Z","title":"Hmmt february problem archive.https://www.hmmt.org/ www/tournaments/testing","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.10739","last_updated":"2026-08-03T08:17:50Z","snapshot_observed_at":"2026-08-04T17:34:49.398085Z","submitted_at":"2025-12-11T15:26:28Z","title":"Intern-S1-MO: Long-horizon Reasoning Agent for Olympiad?Level Mathematical Problem Solving","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-04T06:40:24.340920Z"},"links":{"citing_paper":"/paper/2512.10739"},"observation_digest":"sha256:ef1f7c1e87205bc4e5c6b89a542688807467d6906f27905965fe21445facb4e2","observation_id":"729f308b-1a61-4b24-b3f5-584588604f3b","resolution":{"observed_at":"2026-08-04T06:40:24.340920Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06453","last_updated":"2025-02-12T23:16:27Z","snapshot_observed_at":"2026-07-06T20:33:57.434346Z","submitted_at":"2025-02-10T13:31:46Z","title":"MATH-Perturb: Benchmarking LLMs' Math Reasoning Abilities against Hard Perturbations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.06453","snapshot_observed_at":"2026-08-04T06:40:24.420480Z","title":"Math-perturb: Benchmarking llms’ math reasoning abilities against hard perturbations.ArXiv, abs/2502.06453, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.10739","last_updated":"2026-08-03T08:17:50Z","snapshot_observed_at":"2026-08-04T17:34:49.398085Z","submitted_at":"2025-12-11T15:26:28Z","title":"Intern-S1-MO: Long-horizon Reasoning Agent for Olympiad?Level Mathematical Problem Solving","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-04T06:40:24.420480Z"},"links":{"cited_paper":"/paper/2502.06453","citing_paper":"/paper/2512.10739"},"observation_digest":"sha256:6884835b2d957fdbf1c9b48c5a9cb446fd619767cd7e404fd81ffa2c7b45f226","observation_id":"2cfff7d0-c4fc-4186-9736-e6af98a8b8f0","resolution":{"observed_at":"2026-08-04T06:40:24.420480Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T06:40:24.484225Z","title":"Gemini 2.5 pro capable of winning gold at imo 2025.arXiv preprint arXiv:2507.15855, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.10739","last_updated":"2026-08-03T08:17:50Z","snapshot_observed_at":"2026-08-04T17:34:49.398085Z","submitted_at":"2025-12-11T15:26:28Z","title":"Intern-S1-MO: Long-horizon Reasoning Agent for Olympiad?Level Mathematical Problem Solving","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-04T06:40:24.484225Z"},"links":{"citing_paper":"/paper/2512.10739"},"observation_digest":"sha256:1390f7f5bff894c9162623ac3588e1433ca1a1f9bc965dd9b7fe04d02ea087d8","observation_id":"b2792294-7191-4a69-bfe7-1eb41359ea78","resolution":{"observed_at":"2026-08-04T06:40:24.484225Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T06:40:24.537173Z","title":"A survey of frontiers in llm reasoning: Inference scaling, learning to reason, and agentic systems.Trans","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.10739","last_updated":"2026-08-03T08:17:50Z","snapshot_observed_at":"2026-08-04T17:34:49.398085Z","submitted_at":"2025-12-11T15:26:28Z","title":"Intern-S1-MO: Long-horizon Reasoning Agent for Olympiad?Level Mathematical Problem Solving","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-04T06:40:24.537173Z"},"links":{"citing_paper":"/paper/2512.10739"},"observation_digest":"sha256:000501a16fc6b559dec34e70cf5dba87c2c92e20f7bac0489242fcb0b43a3752","observation_id":"ae9d5220-c9a0-4ad3-9512-a51abf8654d2","resolution":{"observed_at":"2026-08-04T06:40:24.537173Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.13692","last_updated":"2024-08-01T17:18:54Z","snapshot_observed_at":"2026-07-06T18:48:37.723242Z","submitted_at":"2024-07-18T16:58:18Z","title":"Prover-Verifier Games improve legibility of LLM outputs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.13692","snapshot_observed_at":"2026-08-04T06:40:24.619908Z","title":"Prover- verifier games improve legibility of llm outputs, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.10739","last_updated":"2026-08-03T08:17:50Z","snapshot_observed_at":"2026-08-04T17:34:49.398085Z","submitted_at":"2025-12-11T15:26:28Z","title":"Intern-S1-MO: Long-horizon Reasoning Agent for Olympiad?Level Mathematical Problem Solving","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-04T06:40:24.619908Z"},"links":{"cited_paper":"/paper/2407.13692","citing_paper":"/paper/2512.10739"},"observation_digest":"sha256:088a705cf202ab56996f94c397f6c8f06200e4233c3cc6f2f41044e39ef2c754","observation_id":"2ebcdcce-ecc9-4caa-a902-5544966723a6","resolution":{"observed_at":"2026-08-04T06:40:24.619908Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.21776","last_updated":"2025-10-13T12:40:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-30T16:25:25Z","title":"WebThinker: Empowering Large Reasoning Models with Deep Research Capability","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.21776","snapshot_observed_at":"2026-08-04T06:40:24.697646Z","title":"Webthinker: Empowering large reasoning models with deep research capability.ArXiv, abs/2504.21776, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.10739","last_updated":"2026-08-03T08:17:50Z","snapshot_observed_at":"2026-08-04T17:34:49.398085Z","submitted_at":"2025-12-11T15:26:28Z","title":"Intern-S1-MO: Long-horizon Reasoning Agent for Olympiad?Level Mathematical Problem Solving","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-04T06:40:24.697646Z"},"links":{"cited_paper":"/paper/2504.21776","citing_paper":"/paper/2512.10739"},"observation_digest":"sha256:d9e1283b9b53d3ed617c47244bf73724b56036b57c52d3ee677ab637f1c4fa84","observation_id":"93227744-8493-4868-8185-a193fa6cf660","resolution":{"observed_at":"2026-08-04T06:40:24.697646Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.23383","last_updated":"2025-03-30T10:16:25Z","snapshot_observed_at":"2026-07-06T21:01:00.397040Z","submitted_at":"2025-03-30T10:16:25Z","title":"ToRL: Scaling Tool-Integrated RL","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.23383","snapshot_observed_at":"2026-08-04T06:40:24.762093Z","title":"Torl: Scaling tool-integrated rl.arXiv preprint arXiv:2503.23383, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.10739","last_updated":"2026-08-03T08:17:50Z","snapshot_observed_at":"2026-08-04T17:34:49.398085Z","submitted_at":"2025-12-11T15:26:28Z","title":"Intern-S1-MO: Long-horizon Reasoning Agent for Olympiad?Level Mathematical Problem Solving","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-04T06:40:24.762093Z"},"links":{"cited_paper":"/paper/2503.23383","citing_paper":"/paper/2512.10739"},"observation_digest":"sha256:78c99bcc4eea3374b6fdc391e031018f8172568534e0aada2e2512307daace25","observation_id":"d543d618-6245-4541-a094-87a016794b19","resolution":{"observed_at":"2026-08-04T06:40:24.762093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T06:40:24.837824Z","title":"Compassverifier: A unified and robust verifier for llms evaluation and outcome reward","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.10739","last_updated":"2026-08-03T08:17:50Z","snapshot_observed_at":"2026-08-04T17:34:49.398085Z","submitted_at":"2025-12-11T15:26:28Z","title":"Intern-S1-MO: Long-horizon Reasoning Agent for Olympiad?Level Mathematical Problem Solving","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-04T06:40:24.837824Z"},"links":{"citing_paper":"/paper/2512.10739"},"observation_digest":"sha256:3f7db1ab613d65eb0cd5f02184a1a151965bb7a4af417c4c67b8848ca02cdb11","observation_id":"f1165099-4e1e-472f-b650-fef726a1aa97","resolution":{"observed_at":"2026-08-04T06:40:24.837824Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06781","last_updated":"2025-02-10T18:57:29Z","snapshot_observed_at":"2026-07-06T20:34:11.407726Z","submitted_at":"2025-02-10T18:57:29Z","title":"Exploring the Limit of Outcome Reward for Learning Mathematical Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.06781","snapshot_observed_at":"2026-08-04T06:40:24.891449Z","title":"Exploring the limit of outcome reward for learning mathematical reasoning.arXiv preprint arXiv:2502.06781, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.10739","last_updated":"2026-08-03T08:17:50Z","snapshot_observed_at":"2026-08-04T17:34:49.398085Z","submitted_at":"2025-12-11T15:26:28Z","title":"Intern-S1-MO: Long-horizon Reasoning Agent for Olympiad?Level Mathematical Problem Solving","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-04T06:40:24.891449Z"},"links":{"cited_paper":"/paper/2502.06781","citing_paper":"/paper/2512.10739"},"observation_digest":"sha256:b70c0f61d5c6fedffe073cb86eecb5eb3aac8548ec0e7e3c989fb88aba4eba7c","observation_id":"da937472-cdc1-490a-beb9-4b79cd4fbc57","resolution":{"observed_at":"2026-08-04T06:40:24.891449Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T06:40:24.943221Z","title":"Agent rl scaling law: Agent rl with spontaneous code execution for mathematical problem solving,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2512.10739","last_updated":"2026-08-03T08:17:50Z","snapshot_observed_at":"2026-08-04T17:34:49.398085Z","submitted_at":"2025-12-11T15:26:28Z","title":"Intern-S1-MO: Long-horizon Reasoning Agent for Olympiad?Level Mathematical Problem Solving","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-04T06:40:24.943221Z"},"links":{"citing_paper":"/paper/2512.10739"},"observation_digest":"sha256:ef96d5c6dd53a4af3909a5d2edbcbb1b39fd32401498003313d80caff2ec0023","observation_id":"aa1c584d-1889-43a7-90f1-4d6295cc8023","resolution":{"observed_at":"2026-08-04T06:40:24.943221Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T06:40:25.140202Z","title":"American invitational mathematics examination (aime) problems and solutions.https://maa.org/student-programs/amc/","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.10739","last_updated":"2026-08-03T08:17:50Z","snapshot_observed_at":"2026-08-04T17:34:49.398085Z","submitted_at":"2025-12-11T15:26:28Z","title":"Intern-S1-MO: Long-horizon Reasoning Agent for Olympiad?Level Mathematical Problem Solving","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-04T06:40:25.140202Z"},"links":{"citing_paper":"/paper/2512.10739"},"observation_digest":"sha256:4371c1fc1211e47a1c41f4f15fad8cbd6e31c798528ea6cd457ee3b51981cfe8","observation_id":"fe2d36aa-692b-4d64-ad4f-0bf512bc21cf","resolution":{"observed_at":"2026-08-04T06:40:25.140202Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T06:40:25.216297Z","title":"Malt: Improving reasoning with multi-agent llm training.ArXiv, abs/2412.01928, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.10739","last_updated":"2026-08-03T08:17:50Z","snapshot_observed_at":"2026-08-04T17:34:49.398085Z","submitted_at":"2025-12-11T15:26:28Z","title":"Intern-S1-MO: Long-horizon Reasoning Agent for Olympiad?Level Mathematical Problem Solving","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-04T06:40:25.216297Z"},"links":{"citing_paper":"/paper/2512.10739"},"observation_digest":"sha256:3a86cd63f24d357d09d775942ff958fd1d9e1cdd793b6be16a5faa68452eaed6","observation_id":"d053c4c5-5559-4bd8-850b-48cec6049235","resolution":{"observed_at":"2026-08-04T06:40:25.216297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.19393","last_updated":"2025-03-01T06:07:39Z","snapshot_observed_at":"2026-07-06T20:29:11.710285Z","submitted_at":"2025-01-31T18:48:08Z","title":"s1: Simple test-time scaling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.19393","snapshot_observed_at":"2026-08-04T06:40:25.275899Z","title":"s1: Simple test-time scaling.arXiv preprint arXiv:2501.19393, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.10739","last_updated":"2026-08-03T08:17:50Z","snapshot_observed_at":"2026-08-04T17:34:49.398085Z","submitted_at":"2025-12-11T15:26:28Z","title":"Intern-S1-MO: Long-horizon Reasoning Agent for Olympiad?Level Mathematical Problem Solving","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-04T06:40:25.275899Z"},"links":{"cited_paper":"/paper/2501.19393","citing_paper":"/paper/2512.10739"},"observation_digest":"sha256:1846339fbca8d99cb260bc20bb46143cc46797750e4075c4538c4fe88c08707d","observation_id":"9a4a0a4a-c032-4bc5-95e3-127d9a40499e","resolution":{"observed_at":"2026-08-04T06:40:25.275899Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T06:40:25.351114Z","title":"Introducing openai o3 and o4-mini, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.10739","last_updated":"2026-08-03T08:17:50Z","snapshot_observed_at":"2026-08-04T17:34:49.398085Z","submitted_at":"2025-12-11T15:26:28Z","title":"Intern-S1-MO: Long-horizon Reasoning Agent for Olympiad?Level Mathematical Problem Solving","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-04T06:40:25.351114Z"},"links":{"citing_paper":"/paper/2512.10739"},"observation_digest":"sha256:c6a74526594a4ccf7b48161c3a849f0ffa93259ddc023728b06b20d58d86ceb5","observation_id":"475e95e1-0d9c-436a-a578-77bf2bb3f67e","resolution":{"observed_at":"2026-08-04T06:40:25.351114Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10925","last_updated":"2025-08-08T19:24:38Z","snapshot_observed_at":"2026-08-01T16:27:35.664983Z","submitted_at":"2025-08-08T19:24:38Z","title":"gpt-oss-120b & gpt-oss-20b Model Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.10925","snapshot_observed_at":"2026-08-04T06:40:25.428684Z","title":"gpt-oss-120b & gpt-oss-20b model card, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.10739","last_updated":"2026-08-03T08:17:50Z","snapshot_observed_at":"2026-08-04T17:34:49.398085Z","submitted_at":"2025-12-11T15:26:28Z","title":"Intern-S1-MO: Long-horizon Reasoning Agent for Olympiad?Level Mathematical Problem Solving","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-04T06:40:25.428684Z"},"links":{"cited_paper":"/paper/2508.10925","citing_paper":"/paper/2512.10739"},"observation_digest":"sha256:2e5000a38b8b4bb05d98f00f2fc3ddead5e2a5b4dc7368d4ebfda13e9942c774","observation_id":"10b45ed2-0b4f-4e54-8e93-e826ab1495af","resolution":{"observed_at":"2026-08-04T06:40:25.428684Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T06:40:25.529637Z","title":"Openai imo 2025 proofs, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.10739","last_updated":"2026-08-03T08:17:50Z","snapshot_observed_at":"2026-08-04T17:34:49.398085Z","submitted_at":"2025-12-11T15:26:28Z","title":"Intern-S1-MO: Long-horizon Reasoning Agent for Olympiad?Level Mathematical Problem Solving","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-04T06:40:25.529637Z"},"links":{"citing_paper":"/paper/2512.10739"},"observation_digest":"sha256:baa500aa948ba95cc8b1aeae72dac3364b66ae3d0cb05995d6ad8ba5d829efd3","observation_id":"7dd3c732-b590-4a79-94e9-a8e8d06217cb","resolution":{"observed_at":"2026-08-04T06:40:25.529637Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T06:40:25.589280Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.10739","last_updated":"2026-08-03T08:17:50Z","snapshot_observed_at":"2026-08-04T17:34:49.398085Z","submitted_at":"2025-12-11T15:26:28Z","title":"Intern-S1-MO: Long-horizon Reasoning Agent for Olympiad?Level Mathematical Problem Solving","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-04T06:40:25.589280Z"},"links":{"citing_paper":"/paper/2512.10739"},"observation_digest":"sha256:f0c5005d54ffee70bde155cfc688ec0e6d0f26c183062eed958415d5ec22baa0","observation_id":"3f1be116-8a29-4246-9df0-8330539a4fd0","resolution":{"observed_at":"2026-08-04T06:40:25.589280Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.21801","last_updated":"2025-07-18T08:20:23Z","snapshot_observed_at":"2026-08-02T11:46:58.603316Z","submitted_at":"2025-04-30T16:57:48Z","title":"DeepSeek-Prover-V2: Advancing Formal Mathematical Reasoning via Reinforcement Learning for Subgoal Decomposition","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.21801","snapshot_observed_at":"2026-08-04T06:40:25.685252Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.10739","last_updated":"2026-08-03T08:17:50Z","snapshot_observed_at":"2026-08-04T17:34:49.398085Z","submitted_at":"2025-12-11T15:26:28Z","title":"Intern-S1-MO: Long-horizon Reasoning Agent for Olympiad?Level Mathematical Problem Solving","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-04T06:40:25.685252Z"},"links":{"cited_paper":"/paper/2504.21801","citing_paper":"/paper/2512.10739"},"observation_digest":"sha256:3e45bed956cd4b81fe567601b53220614520559961c50c35e3ff6abc6c1433a6","observation_id":"4c4f4155-107f-4702-bed7-c21e665bb296","resolution":{"observed_at":"2026-08-04T06:40:25.685252Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.20722","last_updated":"2025-08-28T12:45:25Z","snapshot_observed_at":"2026-07-06T22:20:02.908814Z","submitted_at":"2025-08-28T12:45:25Z","title":"rStar2-Agent: Agentic Reasoning Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.20722","snapshot_observed_at":"2026-08-04T06:40:25.785903Z","title":"rstar2-agent: Agentic reasoning technical report, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.10739","last_updated":"2026-08-03T08:17:50Z","snapshot_observed_at":"2026-08-04T17:34:49.398085Z","submitted_at":"2025-12-11T15:26:28Z","title":"Intern-S1-MO: Long-horizon Reasoning Agent for Olympiad?Level Mathematical Problem Solving","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-04T06:40:25.785903Z"},"links":{"cited_paper":"/paper/2508.20722","citing_paper":"/paper/2512.10739"},"observation_digest":"sha256:11a32d86608272a8021d54015d06b67a0a35de41ac853f70cbf3b5f4915aef21","observation_id":"03de0ad8-bd7c-4deb-9eb4-a8e79f32dea3","resolution":{"observed_at":"2026-08-04T06:40:25.785903Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-04T06:40:25.875766Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.10739","last_updated":"2026-08-03T08:17:50Z","snapshot_observed_at":"2026-08-04T17:34:49.398085Z","submitted_at":"2025-12-11T15:26:28Z","title":"Intern-S1-MO: Long-horizon Reasoning Agent for Olympiad?Level Mathematical Problem Solving","version":3},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-04T06:40:25.875766Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2512.10739"},"observation_digest":"sha256:d7854845ae858e649d8ae67bb8c0683160e13d61a50b6a46325b74c98dcc7107","observation_id":"e3f43e40-60a2-41cd-b675-8500ca787fd4","resolution":{"observed_at":"2026-08-04T06:40:25.875766Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T06:40:26.033608Z","title":"Satori-r1: Incentivizing multimodal reasoning with spatial grounding and verifiable rewards.arXiv preprint arXiv:2505.19094, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.10739","last_updated":"2026-08-03T08:17:50Z","snapshot_observed_at":"2026-08-04T17:34:49.398085Z","submitted_at":"2025-12-11T15:26:28Z","title":"Intern-S1-MO: Long-horizon Reasoning Agent for Olympiad?Level Mathematical Problem Solving","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-04T06:40:26.033608Z"},"links":{"citing_paper":"/paper/2512.10739"},"observation_digest":"sha256:e4efc69cbdc448747c61d04e79ce910c9a6630a0e9ce44434c557b6ebcff82ff","observation_id":"00be9321-a837-47be-bf23-06498554a1b7","resolution":{"observed_at":"2026-08-04T06:40:26.033608Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T06:40:26.157120Z","title":"A survey of reasoning with foundation models: Concepts, methodologies, and outlook.ACM Computing Surveys, 57(11):1–43, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.10739","last_updated":"2026-08-03T08:17:50Z","snapshot_observed_at":"2026-08-04T17:34:49.398085Z","submitted_at":"2025-12-11T15:26:28Z","title":"Intern-S1-MO: Long-horizon Reasoning Agent for Olympiad?Level Mathematical Problem Solving","version":3},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-04T06:40:26.157120Z"},"links":{"citing_paper":"/paper/2512.10739"},"observation_digest":"sha256:f763c28260023fe12e754679f55050cfb9f05d26ac24311e90206c510f063722","observation_id":"e0ffad19-3c3c-4541-8f1f-17837f6a4a8e","resolution":{"observed_at":"2026-08-04T06:40:26.157120Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T06:40:26.267470Z","title":"Plan-and- solve prompting: Improving zero-shot chain-of-thought reasoning by large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2512.10739","last_updated":"2026-08-03T08:17:50Z","snapshot_observed_at":"2026-08-04T17:34:49.398085Z","submitted_at":"2025-12-11T15:26:28Z","title":"Intern-S1-MO: Long-horizon Reasoning Agent for Olympiad?Level Mathematical Problem Solving","version":3},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-04T06:40:26.267470Z"},"links":{"citing_paper":"/paper/2512.10739"},"observation_digest":"sha256:fd230e2b9ff04ede90bee36639e747405bd048f11464e0a92acf89f26e6e6a65","observation_id":"bd427e85-4ef1-4d32-891b-17ab59710af9","resolution":{"observed_at":"2026-08-04T06:40:26.267470Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08446","last_updated":"2025-06-10T04:44:28Z","snapshot_observed_at":"2026-07-06T21:39:32.912866Z","submitted_at":"2025-06-10T04:44:28Z","title":"A Survey on Large Language Models for Mathematical Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.08446","snapshot_observed_at":"2026-08-04T06:40:26.346269Z","title":"A survey on large language models for mathematical reasoning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.10739","last_updated":"2026-08-03T08:17:50Z","snapshot_observed_at":"2026-08-04T17:34:49.398085Z","submitted_at":"2025-12-11T15:26:28Z","title":"Intern-S1-MO: Long-horizon Reasoning Agent for Olympiad?Level Mathematical Problem Solving","version":3},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-04T06:40:26.346269Z"},"links":{"cited_paper":"/paper/2506.08446","citing_paper":"/paper/2512.10739"},"observation_digest":"sha256:c7962f143f18d2941b8e6ddfb67a9d74898a351422592da6cfbf0ff3eea5e7a2","observation_id":"4884c081-abb6-484b-97b8-4ca30140d06d","resolution":{"observed_at":"2026-08-04T06:40:26.346269Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T06:40:26.470372Z","title":"OPV: Outcome-based process verifier for efficient long chain-of-thought verification","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.10739","last_updated":"2026-08-03T08:17:50Z","snapshot_observed_at":"2026-08-04T17:34:49.398085Z","submitted_at":"2025-12-11T15:26:28Z","title":"Intern-S1-MO: Long-horizon Reasoning Agent for Olympiad?Level Mathematical Problem Solving","version":3},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-04T06:40:26.470372Z"},"links":{"citing_paper":"/paper/2512.10739"},"observation_digest":"sha256:4391008a2a76575428499f27209547268610b7896bc3dabb95780d3d1aa60b80","observation_id":"f707769d-30a2-4b07-897c-127aaf196d40","resolution":{"observed_at":"2026-08-04T06:40:26.470372Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T06:40:26.616335Z","title":"Grok 4, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.10739","last_updated":"2026-08-03T08:17:50Z","snapshot_observed_at":"2026-08-04T17:34:49.398085Z","submitted_at":"2025-12-11T15:26:28Z","title":"Intern-S1-MO: Long-horizon Reasoning Agent for Olympiad?Level Mathematical Problem Solving","version":3},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-04T06:40:26.616335Z"},"links":{"citing_paper":"/paper/2512.10739"},"observation_digest":"sha256:691b7e6bd49ab836ce58d973ad809dd8471030f137dc8a3918a2417d02562c89","observation_id":"182acec9-b37b-482a-a6a6-03e50247561d","resolution":{"observed_at":"2026-08-04T06:40:26.616335Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-08-04T06:40:26.760868Z","title":"Qwen3 technical report.arXiv preprint arXiv:2505.09388, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.10739","last_updated":"2026-08-03T08:17:50Z","snapshot_observed_at":"2026-08-04T17:34:49.398085Z","submitted_at":"2025-12-11T15:26:28Z","title":"Intern-S1-MO: Long-horizon Reasoning Agent for Olympiad?Level Mathematical Problem Solving","version":3},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-04T06:40:26.760868Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2512.10739"},"observation_digest":"sha256:c48d9c34bb43ddc5e8d4d399b6a402a9bd5d98b3b928b9ce1e880f4616829451","observation_id":"ffdce025-c348-45d2-87ba-e02f69d451e8","resolution":{"observed_at":"2026-08-04T06:40:26.760868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.10601","last_updated":"2023-12-03T22:50:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-17T23:16:17Z","title":"Tree of Thoughts: Deliberate Problem Solving with Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.10601","snapshot_observed_at":"2026-08-04T06:40:26.993380Z","title":"Tree of thoughts: Deliberate problem solving with large language models.ArXiv, abs/2305.10601, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2512.10739","last_updated":"2026-08-03T08:17:50Z","snapshot_observed_at":"2026-08-04T17:34:49.398085Z","submitted_at":"2025-12-11T15:26:28Z","title":"Intern-S1-MO: Long-horizon Reasoning Agent for Olympiad?Level Mathematical Problem Solving","version":3},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-04T06:40:26.993380Z"},"links":{"cited_paper":"/paper/2305.10601","citing_paper":"/paper/2512.10739"},"observation_digest":"sha256:ffa8c78cf20081610bf708ba86b26b684cb7f98b81449f59d5b2cd2184b2068c","observation_id":"741bd985-9344-4848-9c55-1d873f5a24ec","resolution":{"observed_at":"2026-08-04T06:40:26.993380Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08379","last_updated":"2025-06-10T02:43:47Z","snapshot_observed_at":"2026-07-06T21:39:28.134075Z","submitted_at":"2025-06-10T02:43:47Z","title":"Reinforce LLM Reasoning through Multi-Agent Reflection","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.08379","snapshot_observed_at":"2026-08-04T06:40:27.178080Z","title":"Reinforce llm reasoning through multi-agent reflection.ArXiv, abs/2506.08379, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.10739","last_updated":"2026-08-03T08:17:50Z","snapshot_observed_at":"2026-08-04T17:34:49.398085Z","submitted_at":"2025-12-11T15:26:28Z","title":"Intern-S1-MO: Long-horizon Reasoning Agent for Olympiad?Level Mathematical Problem Solving","version":3},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-04T06:40:27.178080Z"},"links":{"cited_paper":"/paper/2506.08379","citing_paper":"/paper/2512.10739"},"observation_digest":"sha256:96ca01f0697f02eb9eafc58962f5837c6be47e8c5f3eca6bff8b3bcabd5237eb","observation_id":"955d0567-4898-445d-a39e-c52286bacebd","resolution":{"observed_at":"2026-08-04T06:40:27.178080Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.13837","last_updated":"2025-11-24T06:11:04Z","snapshot_observed_at":"2026-07-06T21:11:34.701779Z","submitted_at":"2025-04-18T17:59:56Z","title":"Does Reinforcement Learning Really Incentivize Reasoning Capacity in LLMs Beyond the Base Model?","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.13837","snapshot_observed_at":"2026-08-04T06:40:27.371206Z","title":"Does re- inforcement learning really incentivize reasoning capacity in llms beyond the base model?ArXiv, abs/2504.13837, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.10739","last_updated":"2026-08-03T08:17:50Z","snapshot_observed_at":"2026-08-04T17:34:49.398085Z","submitted_at":"2025-12-11T15:26:28Z","title":"Intern-S1-MO: Long-horizon Reasoning Agent for Olympiad?Level Mathematical Problem Solving","version":3},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-04T06:40:27.371206Z"},"links":{"cited_paper":"/paper/2504.13837","citing_paper":"/paper/2512.10739"},"observation_digest":"sha256:c072a4bd5579b3a807253d5d7dccd42aeef1cb045198e9fb0a52d425db4b0269","observation_id":"5762b5d4-e3ab-44c7-949a-91706f00eabc","resolution":{"observed_at":"2026-08-04T06:40:27.371206Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.18892","last_updated":"2025-08-06T08:42:32Z","snapshot_observed_at":"2026-07-06T20:57:57.039376Z","submitted_at":"2025-03-24T17:06:10Z","title":"SimpleRL-Zoo: Investigating and Taming Zero Reinforcement Learning for Open Base Models in the Wild","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.18892","snapshot_observed_at":"2026-08-04T06:40:27.544092Z","title":"Simplerl- zoo: Investigating and taming zero reinforcement learning for open base models in the wild.ArXiv, abs/2503.18892, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.10739","last_updated":"2026-08-03T08:17:50Z","snapshot_observed_at":"2026-08-04T17:34:49.398085Z","submitted_at":"2025-12-11T15:26:28Z","title":"Intern-S1-MO: Long-horizon Reasoning Agent for Olympiad?Level Mathematical Problem Solving","version":3},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-04T06:40:27.544092Z"},"links":{"cited_paper":"/paper/2503.18892","citing_paper":"/paper/2512.10739"},"observation_digest":"sha256:0e9c0ec2443e7ee812d5432d00054f1e2f64ca8ea9b09d198d05213f445460dd","observation_id":"ca0b9613-7d1b-4a01-86e6-6041655acc47","resolution":{"observed_at":"2026-08-04T06:40:27.544092Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.03816","last_updated":"2024-11-18T05:36:16Z","snapshot_observed_at":"2026-08-02T15:27:30.363424Z","submitted_at":"2024-06-06T07:40:00Z","title":"ReST-MCTS*: LLM Self-Training via Process Reward Guided Tree Search","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.03816","snapshot_observed_at":"2026-08-04T06:40:27.771393Z","title":"Rest-mcts*: Llmself-trainingviapro- cess reward guided tree search.ArXiv, abs/2406.03816, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.10739","last_updated":"2026-08-03T08:17:50Z","snapshot_observed_at":"2026-08-04T17:34:49.398085Z","submitted_at":"2025-12-11T15:26:28Z","title":"Intern-S1-MO: Long-horizon Reasoning Agent for Olympiad?Level Mathematical Problem Solving","version":3},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-04T06:40:27.771393Z"},"links":{"cited_paper":"/paper/2406.03816","citing_paper":"/paper/2512.10739"},"observation_digest":"sha256:4f3312e303ba1e3ce74559a826b0105b9d19aec2b906a9ffe73cab808911cc1e","observation_id":"55537287-1e32-4ea5-97b8-a6533ee96552","resolution":{"observed_at":"2026-08-04T06:40:27.771393Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.12044","last_updated":"2024-12-02T10:17:48Z","snapshot_observed_at":"2026-07-06T18:32:32.228906Z","submitted_at":"2024-06-17T19:31:24Z","title":"ARTIST: Improving the Generation of Text-rich Images with Disentangled Diffusion Models and Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.12044","snapshot_observed_at":"2026-08-04T06:40:27.940805Z","title":"Artist: Improving the generation of text-rich images with disentangled diffusion models and large language models, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.10739","last_updated":"2026-08-03T08:17:50Z","snapshot_observed_at":"2026-08-04T17:34:49.398085Z","submitted_at":"2025-12-11T15:26:28Z","title":"Intern-S1-MO: Long-horizon Reasoning Agent for Olympiad?Level Mathematical Problem Solving","version":3},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-04T06:40:27.940805Z"},"links":{"cited_paper":"/paper/2406.12044","citing_paper":"/paper/2512.10739"},"observation_digest":"sha256:5f97bf11e25a36607c621ffeeb772e66a471736bb6f3f455f77251309ac4944f","observation_id":"d047db71-af55-4f75-9d6a-289ac171181e","resolution":{"observed_at":"2026-08-04T06:40:27.940805Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.03493","last_updated":"2022-10-07T12:28:21Z","snapshot_observed_at":"2026-07-06T14:01:50.333970Z","submitted_at":"2022-10-07T12:28:21Z","title":"Automatic Chain of Thought Prompting in Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.03493","snapshot_observed_at":"2026-08-04T06:40:28.151683Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2512.10739","last_updated":"2026-08-03T08:17:50Z","snapshot_observed_at":"2026-08-04T17:34:49.398085Z","submitted_at":"2025-12-11T15:26:28Z","title":"Intern-S1-MO: Long-horizon Reasoning Agent for Olympiad?Level Mathematical Problem Solving","version":3},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-04T06:40:28.151683Z"},"links":{"cited_paper":"/paper/2210.03493","citing_paper":"/paper/2512.10739"},"observation_digest":"sha256:4145e7f7696a91f7c0f04ac42ff742d9577cde254225c80abff865d66380808e","observation_id":"8f8665b6-ba14-4e32-bf36-4f742ab48380","resolution":{"observed_at":"2026-08-04T06:40:28.151683Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06559","last_updated":"2025-05-26T14:03:32Z","snapshot_observed_at":"2026-08-04T15:36:09.301591Z","submitted_at":"2024-12-09T15:11:40Z","title":"ProcessBench: Identifying Process Errors in Mathematical Reasoning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.06559","snapshot_observed_at":"2026-08-04T06:40:28.275289Z","title":"ProcessBench: Identifying Process Errors in Mathematical Reasoning.arXiv e-prints, art","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.10739","last_updated":"2026-08-03T08:17:50Z","snapshot_observed_at":"2026-08-04T17:34:49.398085Z","submitted_at":"2025-12-11T15:26:28Z","title":"Intern-S1-MO: Long-horizon Reasoning Agent for Olympiad?Level Mathematical Problem Solving","version":3},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-04T06:40:28.275289Z"},"links":{"cited_paper":"/paper/2412.06559","citing_paper":"/paper/2512.10739"},"observation_digest":"sha256:6df59d018e17898f4049ed7b2c439da00491f13af9d49af60fbe379658aa8c75","observation_id":"49fcb739-e383-416b-be90-8b35cff3e367","resolution":{"observed_at":"2026-08-04T06:40:28.275289Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.10625","last_updated":"2023-04-16T22:08:08Z","snapshot_observed_at":"2026-08-03T04:30:54.138138Z","submitted_at":"2022-05-21T15:34:53Z","title":"Least-to-Most Prompting Enables Complex Reasoning in Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.10625","snapshot_observed_at":"2026-08-04T06:40:28.349094Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2512.10739","last_updated":"2026-08-03T08:17:50Z","snapshot_observed_at":"2026-08-04T17:34:49.398085Z","submitted_at":"2025-12-11T15:26:28Z","title":"Intern-S1-MO: Long-horizon Reasoning Agent for Olympiad?Level Mathematical Problem Solving","version":3},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-04T06:40:28.349094Z"},"links":{"cited_paper":"/paper/2205.10625","citing_paper":"/paper/2512.10739"},"observation_digest":"sha256:bdf0bd1a723897ffab35bca25397412980296a4a38cd51ccbe6c221203185981","observation_id":"4e9bcd08-b089-48c3-8c6d-c1f9be82ef9f","resolution":{"observed_at":"2026-08-04T06:40:28.349094Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.15225","last_updated":"2025-07-21T03:56:35Z","snapshot_observed_at":"2026-07-06T22:00:08.908202Z","submitted_at":"2025-07-21T03:56:35Z","title":"Solving Formal Math Problems by Decomposition and Iterative Reflection","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.15225","snapshot_observed_at":"2026-08-04T06:40:28.465639Z","title":"Solving formal math problems by decomposition and iterative reflection","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.10739","last_updated":"2026-08-03T08:17:50Z","snapshot_observed_at":"2026-08-04T17:34:49.398085Z","submitted_at":"2025-12-11T15:26:28Z","title":"Intern-S1-MO: Long-horizon Reasoning Agent for Olympiad?Level Mathematical Problem Solving","version":3},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-04T06:40:28.465639Z"},"links":{"cited_paper":"/paper/2507.15225","citing_paper":"/paper/2512.10739"},"observation_digest":"sha256:7882c55cf32716cbee1a42a33d5ddd30101d8dfe5ddeadf876e46536982c9350","observation_id":"2e3f882a-6262-46a8-8af9-8937dd02f28a","resolution":{"observed_at":"2026-08-04T06:40:28.465639Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.16084","last_updated":"2025-06-30T15:59:26Z","snapshot_observed_at":"2026-07-06T21:13:13.686703Z","submitted_at":"2025-04-22T17:59:56Z","title":"TTRL: Test-Time Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.16084","snapshot_observed_at":"2026-08-04T06:40:28.581624Z","title":"Ttrl: Test-time reinforcement learning.arXiv preprint arXiv:2504.16084,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2512.10739","last_updated":"2026-08-03T08:17:50Z","snapshot_observed_at":"2026-08-04T17:34:49.398085Z","submitted_at":"2025-12-11T15:26:28Z","title":"Intern-S1-MO: Long-horizon Reasoning Agent for Olympiad?Level Mathematical Problem Solving","version":3},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-04T06:40:28.581624Z"},"links":{"cited_paper":"/paper/2504.16084","citing_paper":"/paper/2512.10739"},"observation_digest":"sha256:b0443e08a5deb244ebd185e11542ba29af37fa2d7eb973ba9b0a4bdaab9c286a","observation_id":"1e32ba23-e977-4d6d-861d-4a76e99e4246","resolution":{"observed_at":"2026-08-04T06:40:28.581624Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T06:40:28.699011Z","title":"The scientific ideas, methodology, analyses, and conclusions were entirely developed by the authors, while the LLMs assisted only in improving clarity and readability of the text","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2512.10739","last_updated":"2026-08-03T08:17:50Z","snapshot_observed_at":"2026-08-04T17:34:49.398085Z","submitted_at":"2025-12-11T15:26:28Z","title":"Intern-S1-MO: Long-horizon Reasoning Agent for Olympiad?Level Mathematical Problem Solving","version":3},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-04T06:40:28.699011Z"},"links":{"citing_paper":"/paper/2512.10739"},"observation_digest":"sha256:c706a54d931af093a4b2d369ae91f9f09f623679c5dec0d82128127abece6717","observation_id":"9d94b487-8f8e-44e6-8fe8-f3171af6113b","resolution":{"observed_at":"2026-08-04T06:40:28.699011Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T06:40:28.856946Z","title":"* The final answer is secondary to the correctness of the derivation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2512.10739","last_updated":"2026-08-03T08:17:50Z","snapshot_observed_at":"2026-08-04T17:34:49.398085Z","submitted_at":"2025-12-11T15:26:28Z","title":"Intern-S1-MO: Long-horizon Reasoning Agent for Olympiad?Level Mathematical Problem Solving","version":3},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-04T06:40:28.856946Z"},"links":{"citing_paper":"/paper/2512.10739"},"observation_digest":"sha256:449340fbbbb7e24f0919774658aa6418b3b25860ba91c9e9cf9191be3fd0d559","observation_id":"aba29485-3414-42eb-b095-8d676f0eee38","resolution":{"observed_at":"2026-08-04T06:40:28.856946Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T06:40:28.911587Z","title":"* If you cannot provide a complete solution, you must provide any significant ˓→partial results that you can prove with full rigor","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2512.10739","last_updated":"2026-08-03T08:17:50Z","snapshot_observed_at":"2026-08-04T17:34:49.398085Z","submitted_at":"2025-12-11T15:26:28Z","title":"Intern-S1-MO: Long-horizon Reasoning Agent for Olympiad?Level Mathematical Problem Solving","version":3},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-04T06:40:28.911587Z"},"links":{"citing_paper":"/paper/2512.10739"},"observation_digest":"sha256:0e1e1b03ba842d46471a4d2e46d9a145990092b16b98383e3f8ced3f18e8b523","observation_id":"c2e5f316-f9ae-4477-9ad1-67ef353dd8f7","resolution":{"observed_at":"2026-08-04T06:40:28.911587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T06:40:28.981973Z","title":"I have found a complete ˓→solution. The answer is","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2512.10739","last_updated":"2026-08-03T08:17:50Z","snapshot_observed_at":"2026-08-04T17:34:49.398085Z","submitted_at":"2025-12-11T15:26:28Z","title":"Intern-S1-MO: Long-horizon Reasoning Agent for Olympiad?Level Mathematical Problem Solving","version":3},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-04T06:40:28.981973Z"},"links":{"citing_paper":"/paper/2512.10739"},"observation_digest":"sha256:17c4d53d7d1c1863ae18a58d59b83e1154f56666cc3825f8a5a7d99a42a5f19b","observation_id":"2c441329-c712-4fdf-a2ab-122500e0be93","resolution":{"observed_at":"2026-08-04T06:40:28.981973Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T06:40:29.036476Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2512.10739","last_updated":"2026-08-03T08:17:50Z","snapshot_observed_at":"2026-08-04T17:34:49.398085Z","submitted_at":"2025-12-11T15:26:28Z","title":"Intern-S1-MO: Long-horizon Reasoning Agent for Olympiad?Level Mathematical Problem Solving","version":3},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-04T06:40:29.036476Z"},"links":{"citing_paper":"/paper/2512.10739"},"observation_digest":"sha256:ff3342d6ed8dbd3831696ecb72770e842c7425618dd62e6a9247a6c5ee64f317","observation_id":"21cf8029-2865-44e1-99e9-06e352a4db53","resolution":{"observed_at":"2026-08-04T06:40:29.036476Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T06:40:29.108465Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2512.10739","last_updated":"2026-08-03T08:17:50Z","snapshot_observed_at":"2026-08-04T17:34:49.398085Z","submitted_at":"2025-12-11T15:26:28Z","title":"Intern-S1-MO: Long-horizon Reasoning Agent for Olympiad?Level Mathematical Problem Solving","version":3},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-04T06:40:29.108465Z"},"links":{"citing_paper":"/paper/2512.10739"},"observation_digest":"sha256:96dc76144e40f7395237bb870aae447966bb47579b169bd779e22b6afe3a36f2","observation_id":"0327cfc5-087b-4c27-b6e8-03e36f0179c5","resolution":{"observed_at":"2026-08-04T06:40:29.108465Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T06:40:29.167770Z","title":"**Your output must adhere to the following principles and format:** #### **A","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2512.10739","last_updated":"2026-08-03T08:17:50Z","snapshot_observed_at":"2026-08-04T17:34:49.398085Z","submitted_at":"2025-12-11T15:26:28Z","title":"Intern-S1-MO: Long-horizon Reasoning Agent for Olympiad?Level Mathematical Problem Solving","version":3},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-04T06:40:29.167770Z"},"links":{"citing_paper":"/paper/2512.10739"},"observation_digest":"sha256:c6f6bd76fc0dcfc41dfc910cbec4ac9d080ecbf8b236d28864d459acbc09ce89","observation_id":"fc01cb61-3b3a-4d6c-9874-01db9a423a62","resolution":{"observed_at":"2026-08-04T06:40:29.167770Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T06:40:29.210199Z","title":"Do not include lemmas from the ‘Provided Lemmas‘ if the model ˓→utilises them","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2512.10739","last_updated":"2026-08-03T08:17:50Z","snapshot_observed_at":"2026-08-04T17:34:49.398085Z","submitted_at":"2025-12-11T15:26:28Z","title":"Intern-S1-MO: Long-horizon Reasoning Agent for Olympiad?Level Mathematical Problem Solving","version":3},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-04T06:40:29.210199Z"},"links":{"citing_paper":"/paper/2512.10739"},"observation_digest":"sha256:e7c9b67ffcd139e9cfb5374bb8b573f00d101491be0a1a91572ce4b136cc2017","observation_id":"58a4399b-03cb-45fe-bd37-aeebf37aa015","resolution":{"observed_at":"2026-08-04T06:40:29.210199Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T06:40:29.283839Z","title":"#### **B","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2512.10739","last_updated":"2026-08-03T08:17:50Z","snapshot_observed_at":"2026-08-04T17:34:49.398085Z","submitted_at":"2025-12-11T15:26:28Z","title":"Intern-S1-MO: Long-horizon Reasoning Agent for Olympiad?Level Mathematical Problem Solving","version":3},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-04T06:40:29.283839Z"},"links":{"citing_paper":"/paper/2512.10739"},"observation_digest":"sha256:1ac076903decedd793ea84f973f33ecd9fe84482db439defa2162e43d1778019","observation_id":"167a5099-19e9-44c8-a8b0-57467b6751c5","resolution":{"observed_at":"2026-08-04T06:40:29.283839Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T06:40:29.338359Z","title":"The number of ‘<lemma>...</lemma>‘ environments must match the ˓→number of lemmas extracted in this round","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2512.10739","last_updated":"2026-08-03T08:17:50Z","snapshot_observed_at":"2026-08-04T17:34:49.398085Z","submitted_at":"2025-12-11T15:26:28Z","title":"Intern-S1-MO: Long-horizon Reasoning Agent for Olympiad?Level Mathematical Problem Solving","version":3},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-04T06:40:29.338359Z"},"links":{"citing_paper":"/paper/2512.10739"},"observation_digest":"sha256:80c3623f516a93dfdab75b5e588cbab044007673fe4a867c43445d2df9cea67a","observation_id":"76dd74b7-a8cb-49b0-abd4-61bce7dc90e4","resolution":{"observed_at":"2026-08-04T06:40:29.338359Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T06:40:29.414236Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2512.10739","last_updated":"2026-08-03T08:17:50Z","snapshot_observed_at":"2026-08-04T17:34:49.398085Z","submitted_at":"2025-12-11T15:26:28Z","title":"Intern-S1-MO: Long-horizon Reasoning Agent for Olympiad?Level Mathematical Problem Solving","version":3},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-04T06:40:29.414236Z"},"links":{"citing_paper":"/paper/2512.10739"},"observation_digest":"sha256:639c3d84ada28667d52fe58bb061034310853f27889612c70068ebe3d8ac893a","observation_id":"234b8392-8a1d-4c6c-84b3-471cc6309105","resolution":{"observed_at":"2026-08-04T06:40:29.414236Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T06:40:29.424855Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2512.10739","last_updated":"2026-08-03T08:17:50Z","snapshot_observed_at":"2026-08-04T17:34:49.398085Z","submitted_at":"2025-12-11T15:26:28Z","title":"Intern-S1-MO: Long-horizon Reasoning Agent for Olympiad?Level Mathematical Problem Solving","version":3},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-04T06:40:29.424855Z"},"links":{"citing_paper":"/paper/2512.10739"},"observation_digest":"sha256:3b96d35c11b62fcbb180865d3774bde30fdb2b63bd8d177c358f883243a66672","observation_id":"90e99fdb-137e-414b-b7ff-7434b1c24b8d","resolution":{"observed_at":"2026-08-04T06:40:29.424855Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T06:40:29.558196Z","title":"- A key part of your evaluation is to verify that any use of a lemma from the Provided ˓→Lemmas library is correctly applied and that its preconditions are satisfied","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2512.10739","last_updated":"2026-08-03T08:17:50Z","snapshot_observed_at":"2026-08-04T17:34:49.398085Z","submitted_at":"2025-12-11T15:26:28Z","title":"Intern-S1-MO: Long-horizon Reasoning Agent for Olympiad?Level Mathematical Problem Solving","version":3},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-04T06:40:29.558196Z"},"links":{"citing_paper":"/paper/2512.10739"},"observation_digest":"sha256:bd67c195647929c10e0ec7daeb6c4a67e4fee75ef1ddf3ffa09fb971dc5adeab","observation_id":"4782ea6f-c436-4a6c-9bb3-bdd4f595c82c","resolution":{"observed_at":"2026-08-04T06:40:29.558196Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T06:40:29.721995Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2512.10739","last_updated":"2026-08-03T08:17:50Z","snapshot_observed_at":"2026-08-04T17:34:49.398085Z","submitted_at":"2025-12-11T15:26:28Z","title":"Intern-S1-MO: Long-horizon Reasoning Agent for Olympiad?Level Mathematical Problem Solving","version":3},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-04T06:40:29.721995Z"},"links":{"citing_paper":"/paper/2512.10739"},"observation_digest":"sha256:f78c0397af6ac6a84d36de656ddf19cf204f824841755219f96025375eb63ab6","observation_id":"86ec3dbb-a847-4be4-8be6-d1cb00e8079a","resolution":{"observed_at":"2026-08-04T06:40:29.721995Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T06:40:29.870236Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2512.10739","last_updated":"2026-08-03T08:17:50Z","snapshot_observed_at":"2026-08-04T17:34:49.398085Z","submitted_at":"2025-12-11T15:26:28Z","title":"Intern-S1-MO: Long-horizon Reasoning Agent for Olympiad?Level Mathematical Problem Solving","version":3},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-04T06:40:29.870236Z"},"links":{"citing_paper":"/paper/2512.10739"},"observation_digest":"sha256:d001eec5f36a63e05e198227727e65097a0a2806d770961120a2ca1a9dc88583","observation_id":"0853bf74-cb15-434a-b4ad-b93c5f1bf5ff","resolution":{"observed_at":"2026-08-04T06:40:29.870236Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T06:40:30.004970Z","title":"I have not found a complete solution","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2512.10739","last_updated":"2026-08-03T08:17:50Z","snapshot_observed_at":"2026-08-04T17:34:49.398085Z","submitted_at":"2025-12-11T15:26:28Z","title":"Intern-S1-MO: Long-horizon Reasoning Agent for Olympiad?Level Mathematical Problem Solving","version":3},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-04T06:40:30.004970Z"},"links":{"citing_paper":"/paper/2512.10739"},"observation_digest":"sha256:d272c9293ae4eac5dd4dcc6db27dd81542eb548fa70c3e16c87f3e507653627e","observation_id":"342af898-8b81-49fd-b8f0-3f3c45e78d86","resolution":{"observed_at":"2026-08-04T06:40:30.004970Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T06:40:30.086888Z","title":"Isosceles-Free Sets Three points form an isosceles triangle if and only if one of them is equidistant from the other two","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2512.10739","last_updated":"2026-08-03T08:17:50Z","snapshot_observed_at":"2026-08-04T17:34:49.398085Z","submitted_at":"2025-12-11T15:26:28Z","title":"Intern-S1-MO: Long-horizon Reasoning Agent for Olympiad?Level Mathematical Problem Solving","version":3},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-04T06:40:30.086888Z"},"links":{"citing_paper":"/paper/2512.10739"},"observation_digest":"sha256:f6496a89eae8a87d952e0fb65e2855a0df2ece039d611aa064028bb64a67e86a","observation_id":"40df3174-8bab-4666-bd82-5a12c079db0e","resolution":{"observed_at":"2026-08-04T06:40:30.086888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T06:40:30.140719Z","title":"Hence,(0,1)/∈𝒯","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2512.10739","last_updated":"2026-08-03T08:17:50Z","snapshot_observed_at":"2026-08-04T17:34:49.398085Z","submitted_at":"2025-12-11T15:26:28Z","title":"Intern-S1-MO: Long-horizon Reasoning Agent for Olympiad?Level Mathematical Problem Solving","version":3},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-04T06:40:30.140719Z"},"links":{"citing_paper":"/paper/2512.10739"},"observation_digest":"sha256:34c4352c1dcab9a5186044c4d87e3175fa08d5a3f5013507bd0fc9026f895f32","observation_id":"9496281c-b160-4740-aba9-22e202588db8","resolution":{"observed_at":"2026-08-04T06:40:30.140719Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T06:40:24.228569Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2512.10739","last_updated":"2026-08-03T08:17:50Z","snapshot_observed_at":"2026-08-04T17:34:49.398085Z","submitted_at":"2025-12-11T15:26:28Z","title":"Intern-S1-MO: Long-horizon Reasoning Agent for Olympiad?Level Mathematical Problem Solving","version":3},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-04T06:40:24.228569Z"},"links":{"citing_paper":"/paper/2512.10739"},"observation_digest":"sha256:17dedd6a9fdbd6f440ba8a203b2c3748b36743079d22e7629e73d268da3caa78","observation_id":"63a6d8fd-2927-4f0d-81c1-0c5092177c9d","resolution":{"observed_at":"2026-08-04T06:40:24.228569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.07773","last_updated":"2025-08-20T12:20:55Z","snapshot_observed_at":"2026-07-06T21:22:40.740091Z","submitted_at":"2025-05-12T17:23:34Z","title":"Agent RL Scaling Law: Agent RL with Spontaneous Code Execution for Mathematical Problem Solving","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.07773","snapshot_observed_at":"2026-08-04T06:40:25.051327Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2512.10739","last_updated":"2026-08-03T08:17:50Z","snapshot_observed_at":"2026-08-04T17:34:49.398085Z","submitted_at":"2025-12-11T15:26:28Z","title":"Intern-S1-MO: Long-horizon Reasoning Agent for Olympiad?Level Mathematical Problem Solving","version":3},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-04T06:40:25.051327Z"},"links":{"cited_paper":"/paper/2505.07773","citing_paper":"/paper/2512.10739"},"observation_digest":"sha256:4cda9f6463195e1de08f29def9f7f406d3f929f919fb17204aed9de0f083af46","observation_id":"7dcb72e0-1c50-4f99-8526-881157608874","resolution":{"observed_at":"2026-08-04T06:40:25.051327Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2512.10739","last_updated":"2026-08-03T08:17:50Z","latest_version":3,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-04T17:34:49.398085Z","submitted_at":"2025-12-11T15:26:28Z","title":"Intern-S1-MO: Long-horizon Reasoning Agent for Olympiad?Level Mathematical Problem Solving"},"reference_resolution":{"displayed":67,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":67,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":67},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"thesis":"As of 4 August 2026, this Paper Citation Record lists 67 of 67 outbound references and 0 inbound Pith citation observations for arXiv:2512.10739."}