{"as_of":"2026-08-22T22:18:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:6809024e75a78b265af72f21d5c71c63ad8d15f5052571582a38d63a6d488074","coverage":[{"denominator":22,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":22,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T13:07:48.934782Z","state":"measured"},{"denominator":58,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":58,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-22T06:32:14.747728+00:00","state":"measured"},{"denominator":36,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":36,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T11:23:45.383186Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-19T18:07:42.247566Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2411.16489","last_updated":"2024-11-25T15:31:27Z","snapshot_observed_at":"2026-08-21T00:33:19.968625Z","submitted_at":"2024-11-25T15:31:27Z","title":"O1 Replication Journey -- Part 2: Surpassing O1-preview through Simple Distillation, Big Progress or Bitter Lesson?","version":1},"cited_work":{"arxiv_id":"2411.16489","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.16489","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"O1 replication journey - part 2: Surpassing o1- preview through simple distillation, big progress or bitter lesson?CoRR, abs/2411.16489","venue":null,"work_id":"39511fc8-6f44-4e54-8d67-6b38c9b02994","year":2024},"citing_paper":{"arxiv_id":"2412.09413","last_updated":"2024-12-22T10:44:13Z","snapshot_observed_at":"2026-08-16T16:04:15.848709Z","submitted_at":"2024-12-12T16:20:36Z","title":"Imitate, Explore, and Self-Improve: A Reproduction Report on Slow-thinking Reasoning Systems","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-18T00:35:31.375020Z"},"links":{"cited_paper":"/paper/2411.16489","citing_paper":"/paper/2412.09413"},"observation_digest":"sha256:ee020334e014b15242eaef70fd608c9738efbc1ffbc2df500f4153daae052218","observation_id":"66aa41ce-2d57-435e-9b1f-b2da403bfdad","resolution":{"observed_at":"2026-05-18T00:35:31.460514Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.16489","last_updated":"2024-11-25T15:31:27Z","snapshot_observed_at":"2026-08-21T00:33:19.968625Z","submitted_at":"2024-11-25T15:31:27Z","title":"O1 Replication Journey -- Part 2: Surpassing O1-preview through Simple Distillation, Big Progress or Bitter Lesson?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.16489","snapshot_observed_at":"2026-08-11T12:30:38.353753Z","title":"URL https://openreview.net/forum?id=IkmD3fKBPQ","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.14135","last_updated":"2024-12-18T18:24:47Z","snapshot_observed_at":"2026-08-16T19:46:44.809444Z","submitted_at":"2024-12-18T18:24:47Z","title":"Scaling of Search and Learning: A Roadmap to Reproduce o1 from Reinforcement Learning Perspective","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-11T12:30:38.353753Z"},"links":{"cited_paper":"/paper/2411.16489","citing_paper":"/paper/2412.14135"},"observation_digest":"sha256:ea9867e9a2c3b23e5b95825ad02062335c220b17a8ce05c89262104e7cf6766c","observation_id":"e3ad2e09-c05e-4176-bd6b-08c3c5986e11","resolution":{"observed_at":"2026-08-11T12:30:38.353753Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.16489","last_updated":"2024-11-25T15:31:27Z","snapshot_observed_at":"2026-08-21T00:33:19.968625Z","submitted_at":"2024-11-25T15:31:27Z","title":"O1 Replication Journey -- Part 2: Surpassing O1-preview through Simple Distillation, Big Progress or Bitter Lesson?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.16489","snapshot_observed_at":"2026-08-11T05:32:00.307512Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.17498","last_updated":"2025-08-24T16:41:54Z","snapshot_observed_at":"2026-08-22T04:06:11.706480Z","submitted_at":"2024-12-23T11:55:33Z","title":"DRT: Deep Reasoning Translation via Long Chain-of-Thought","version":4},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-11T05:32:00.307512Z"},"links":{"cited_paper":"/paper/2411.16489","citing_paper":"/paper/2412.17498"},"observation_digest":"sha256:aa27b508b86bab1f703946168678ac463764f0bcf51cb16ad9980e109a1a8e8a","observation_id":"3cc02538-4436-4905-b06a-e67da6f96eed","resolution":{"observed_at":"2026-08-11T05:32:00.307512Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.16489","last_updated":"2024-11-25T15:31:27Z","snapshot_observed_at":"2026-08-21T00:33:19.968625Z","submitted_at":"2024-11-25T15:31:27Z","title":"O1 Replication Journey -- Part 2: Surpassing O1-preview through Simple Distillation, Big Progress or Bitter Lesson?","version":1},"cited_work":{"arxiv_id":"2411.16489","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.16489","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"O1 replication journey - part 2: Surpassing o1- preview through simple distillation, big progress or bitter lesson?CoRR, abs/2411.16489","venue":null,"work_id":"39511fc8-6f44-4e54-8d67-6b38c9b02994","year":2024},"citing_paper":{"arxiv_id":"2501.05366","last_updated":"2025-01-09T16:48:17Z","snapshot_observed_at":"2026-08-15T17:19:59.096854Z","submitted_at":"2025-01-09T16:48:17Z","title":"Search-o1: Agentic Search-Enhanced Large Reasoning Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-13T17:36:27.515468Z"},"links":{"cited_paper":"/paper/2411.16489","citing_paper":"/paper/2501.05366"},"observation_digest":"sha256:01d36bd512b90b8e1e1e843fed735bf2fed9ea1303067b50924e3726f7a93879","observation_id":"f0602ee0-5a42-4edf-8b40-80ff454a2088","resolution":{"observed_at":"2026-05-13T17:36:27.697612Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.16489","last_updated":"2024-11-25T15:31:27Z","snapshot_observed_at":"2026-08-21T00:33:19.968625Z","submitted_at":"2024-11-25T15:31:27Z","title":"O1 Replication Journey -- Part 2: Surpassing O1-preview through Simple Distillation, Big Progress or Bitter Lesson?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.16489","snapshot_observed_at":"2026-08-09T11:57:48.758762Z","title":"Math-Shepherd: Verify and reinforce LLMs step-by-step without human annotations,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02508","last_updated":"2025-06-16T03:29:47Z","snapshot_observed_at":"2026-08-17T14:30:20.233099Z","submitted_at":"2025-02-04T17:26:58Z","title":"Satori: Reinforcement Learning with Chain-of-Action-Thought Enhances LLM Reasoning via Autoregressive Search","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-09T11:57:48.758762Z"},"links":{"cited_paper":"/paper/2411.16489","citing_paper":"/paper/2502.02508"},"observation_digest":"sha256:25a1722ef5c6cb51b3e21057b7e7dfcb4d1b1c041bd972b94bf697eb90b7a4af","observation_id":"22b49c8f-5b87-473f-b689-220da3b35a17","resolution":{"observed_at":"2026-08-09T11:57:48.758762Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.16489","last_updated":"2024-11-25T15:31:27Z","snapshot_observed_at":"2026-08-21T00:33:19.968625Z","submitted_at":"2024-11-25T15:31:27Z","title":"O1 Replication Journey -- Part 2: Surpassing O1-preview through Simple Distillation, Big Progress or Bitter Lesson?","version":1},"cited_work":{"arxiv_id":"2411.16489","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.16489","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"O1 replication journey - part 2: Surpassing o1- preview through simple distillation, big progress or bitter lesson?CoRR, abs/2411.16489","venue":null,"work_id":"39511fc8-6f44-4e54-8d67-6b38c9b02994","year":2024},"citing_paper":{"arxiv_id":"2502.03387","last_updated":"2025-07-29T16:23:02Z","snapshot_observed_at":"2026-08-08T04:13:22.884923Z","submitted_at":"2025-02-05T17:23:45Z","title":"LIMO: Less is More for Reasoning","version":3},"reference_index":135,"source":"arxiv_source","source_observed_at":"2026-05-17T02:11:36.932541Z"},"links":{"cited_paper":"/paper/2411.16489","citing_paper":"/paper/2502.03387"},"observation_digest":"sha256:079df3499950e4e40daeb2a0f2f956cd9a9c0c3827710a012bec9f297dc16f75","observation_id":"45e8bf9c-1239-4860-b16f-1e329ffb8e8a","resolution":{"observed_at":"2026-05-17T02:11:37.579657Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.16489","last_updated":"2024-11-25T15:31:27Z","snapshot_observed_at":"2026-08-21T00:33:19.968625Z","submitted_at":"2024-11-25T15:31:27Z","title":"O1 Replication Journey -- Part 2: Surpassing O1-preview through Simple Distillation, Big Progress or Bitter Lesson?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.16489","snapshot_observed_at":"2026-08-08T22:03:46.368270Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04644","last_updated":"2025-07-14T20:06:23Z","snapshot_observed_at":"2026-08-19T14:56:59.327123Z","submitted_at":"2025-02-07T04:08:46Z","title":"Agentic Reasoning: A Streamlined Framework for Enhancing LLM Reasoning with Agentic Tools","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-08T22:03:46.368270Z"},"links":{"cited_paper":"/paper/2411.16489","citing_paper":"/paper/2502.04644"},"observation_digest":"sha256:598f8ab8958152fb04bae4948c4dfc4145cc7b290f08e0a35b97963cd27012f0","observation_id":"e5b2e5d4-df87-4057-8644-e02a0a752806","resolution":{"observed_at":"2026-08-08T22:03:46.368270Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.16489","last_updated":"2024-11-25T15:31:27Z","snapshot_observed_at":"2026-08-21T00:33:19.968625Z","submitted_at":"2024-11-25T15:31:27Z","title":"O1 Replication Journey -- Part 2: Surpassing O1-preview through Simple Distillation, Big Progress or Bitter Lesson?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.16489","snapshot_observed_at":"2026-08-08T19:23:26.463205Z","title":"O1 replication journey–part 2: Surpassing o1-preview through simple distillation, big progress or bitter lesson? arXiv preprint arXiv:2411.16489,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.05449","last_updated":"2025-06-01T20:14:16Z","snapshot_observed_at":"2026-08-18T23:34:51.560822Z","submitted_at":"2025-02-08T04:39:51Z","title":"Iterative Deepening Sampling as Efficient Test-Time Scaling","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-08T19:23:26.463205Z"},"links":{"cited_paper":"/paper/2411.16489","citing_paper":"/paper/2502.05449"},"observation_digest":"sha256:2c5c0b4a55a1eb8d2a82f446e19544df5817c10823a2769e3d87fc10f8e18391","observation_id":"061c1b28-cf6b-4c55-893e-19b4692aa84a","resolution":{"observed_at":"2026-08-08T19:23:26.463205Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.16489","last_updated":"2024-11-25T15:31:27Z","snapshot_observed_at":"2026-08-21T00:33:19.968625Z","submitted_at":"2024-11-25T15:31:27Z","title":"O1 Replication Journey -- Part 2: Surpassing O1-preview through Simple Distillation, Big Progress or Bitter Lesson?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.16489","snapshot_observed_at":"2026-08-08T14:40:35.955396Z","title":"O1 replication journey--part 2: Surpassing o1-preview through simple distillation, big progress or bitter lesson? arXiv preprint arXiv:2411.16489, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06703","last_updated":"2025-02-10T17:30:23Z","snapshot_observed_at":"2026-08-18T20:31:50.522103Z","submitted_at":"2025-02-10T17:30:23Z","title":"Can 1B LLM Surpass 405B LLM? Rethinking Compute-Optimal Test-Time Scaling","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-08T14:40:35.955396Z"},"links":{"cited_paper":"/paper/2411.16489","citing_paper":"/paper/2502.06703"},"observation_digest":"sha256:b04b1864baf33f7c1699247c1d1a4fceecafc2e10fa42175d2663439c5535adb","observation_id":"624dac24-83cc-4a27-be2e-2c9f3a305274","resolution":{"observed_at":"2026-08-08T14:40:35.955396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.16489","last_updated":"2024-11-25T15:31:27Z","snapshot_observed_at":"2026-08-21T00:33:19.968625Z","submitted_at":"2024-11-25T15:31:27Z","title":"O1 Replication Journey -- Part 2: Surpassing O1-preview through Simple Distillation, Big Progress or Bitter Lesson?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.16489","snapshot_observed_at":"2026-08-08T14:25:53.383766Z","title":"O1 replication journey--part 2: Surpassing o1-preview through simple distillation, big progress or bitter lesson? arXiv preprint arXiv:2411.16489 , 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06773","last_updated":"2025-02-10T18:52:04Z","snapshot_observed_at":"2026-08-13T11:53:50.444757Z","submitted_at":"2025-02-10T18:52:04Z","title":"On the Emergence of Thinking in LLMs I: Searching for the Right Intuition","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-08T14:25:53.383766Z"},"links":{"cited_paper":"/paper/2411.16489","citing_paper":"/paper/2502.06773"},"observation_digest":"sha256:470ff666d65bdc620f9346a903150b42aaa3dadc8e7c94aa68224a24ef84dbdc","observation_id":"6b593b83-c156-43af-984f-0629a2a6616e","resolution":{"observed_at":"2026-08-08T14:25:53.383766Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.16489","last_updated":"2024-11-25T15:31:27Z","snapshot_observed_at":"2026-08-21T00:33:19.968625Z","submitted_at":"2024-11-25T15:31:27Z","title":"O1 Replication Journey -- Part 2: Surpassing O1-preview through Simple Distillation, Big Progress or Bitter Lesson?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.16489","snapshot_observed_at":"2026-08-08T14:27:50.987846Z","title":"O1 replication journey–part 2: Surpassing o1-preview through simple distillation, big progress or bitter lesson? arXiv preprint arXiv:2411.16489, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06781","last_updated":"2025-02-10T18:57:29Z","snapshot_observed_at":"2026-08-16T03:56:33.383172Z","submitted_at":"2025-02-10T18:57:29Z","title":"Exploring the Limit of Outcome Reward for Learning Mathematical Reasoning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-08T14:27:50.987846Z"},"links":{"cited_paper":"/paper/2411.16489","citing_paper":"/paper/2502.06781"},"observation_digest":"sha256:a4825bc9a9149943a7fd8aad065657bafe45cda73d8615b8d897b6d5f0e74cbf","observation_id":"199ead34-9050-4d22-a51a-9b03c6f5914e","resolution":{"observed_at":"2026-08-08T14:27:50.987846Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.16489","last_updated":"2024-11-25T15:31:27Z","snapshot_observed_at":"2026-08-21T00:33:19.968625Z","submitted_at":"2024-11-25T15:31:27Z","title":"O1 Replication Journey -- Part 2: Surpassing O1-preview through Simple Distillation, Big Progress or Bitter Lesson?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.16489","snapshot_observed_at":"2026-08-07T22:52:54.335881Z","title":"O1 Replication Journey -- Part 2: Surpassing O1-preview through Simple Distillation, Big Progress or Bitter Lesson? , 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.09042","last_updated":"2025-03-27T06:45:15Z","snapshot_observed_at":"2026-08-13T21:03:43.034767Z","submitted_at":"2025-02-13T07:55:54Z","title":"Typhoon T1: An Open Thai Reasoning Model","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T22:52:54.335881Z"},"links":{"cited_paper":"/paper/2411.16489","citing_paper":"/paper/2502.09042"},"observation_digest":"sha256:c35a7c411725f8da8b154fea191a3c7b88037e32a7be7e1cc5fd334823e2e744","observation_id":"116bdcc9-7804-4ae6-8eda-34eae7c4aea3","resolution":{"observed_at":"2026-08-07T22:52:54.335881Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.16489","last_updated":"2024-11-25T15:31:27Z","snapshot_observed_at":"2026-08-21T00:33:19.968625Z","submitted_at":"2024-11-25T15:31:27Z","title":"O1 Replication Journey -- Part 2: Surpassing O1-preview through Simple Distillation, Big Progress or Bitter Lesson?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.16489","snapshot_observed_at":"2026-08-08T20:51:16.684149Z","title":"& Liu, P","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.10428","last_updated":"2025-04-05T13:51:05Z","snapshot_observed_at":"2026-08-18T02:12:46.829419Z","submitted_at":"2025-02-07T14:24:43Z","title":"Dynamic Chain-of-Thought: Towards Adaptive Deep Reasoning","version":4},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-08T20:51:16.684149Z"},"links":{"cited_paper":"/paper/2411.16489","citing_paper":"/paper/2502.10428"},"observation_digest":"sha256:27b4c6f669c5652832ed6ee6daef2430a3ac63c31e6389c447be235c90979c2f","observation_id":"c9e87381-d63c-49e1-ba34-32b38573dfa0","resolution":{"observed_at":"2026-08-08T20:51:16.684149Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.16489","last_updated":"2024-11-25T15:31:27Z","snapshot_observed_at":"2026-08-21T00:33:19.968625Z","submitted_at":"2024-11-25T15:31:27Z","title":"O1 Replication Journey -- Part 2: Surpassing O1-preview through Simple Distillation, Big Progress or Bitter Lesson?","version":1},"cited_work":{"arxiv_id":"2411.16489","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.16489","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"O1 replication journey - part 2: Surpassing o1- preview through simple distillation, big progress or bitter lesson?CoRR, abs/2411.16489","venue":null,"work_id":"39511fc8-6f44-4e54-8d67-6b38c9b02994","year":2024},"citing_paper":{"arxiv_id":"2502.17419","last_updated":"2025-06-25T02:24:46Z","snapshot_observed_at":"2026-08-20T08:13:05.630967Z","submitted_at":"2025-02-24T18:50:52Z","title":"From System 1 to System 2: A Survey of Reasoning Large Language Models","version":6},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-13T01:36:23.845366Z"},"links":{"cited_paper":"/paper/2411.16489","citing_paper":"/paper/2502.17419"},"observation_digest":"sha256:255b4f699ea2b53e2147775d757ff7934b13cdeb4a06dd351b1d6d6b61e7929c","observation_id":"a7a32e34-f39e-419b-ac8f-77a746c94ba2","resolution":{"observed_at":"2026-05-13T01:36:24.613149Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.16489","last_updated":"2024-11-25T15:31:27Z","snapshot_observed_at":"2026-08-21T00:33:19.968625Z","submitted_at":"2024-11-25T15:31:27Z","title":"O1 Replication Journey -- Part 2: Surpassing O1-preview through Simple Distillation, Big Progress or Bitter Lesson?","version":1},"cited_work":{"arxiv_id":"2411.16489","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.16489","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"O1 replication journey - part 2: Surpassing o1- preview through simple distillation, big progress or bitter lesson?CoRR, abs/2411.16489","venue":null,"work_id":"39511fc8-6f44-4e54-8d67-6b38c9b02994","year":2024},"citing_paper":{"arxiv_id":"2504.13958","last_updated":"2025-04-16T21:45:32Z","snapshot_observed_at":"2026-08-15T04:58:53.543603Z","submitted_at":"2025-04-16T21:45:32Z","title":"ToolRL: Reward is All Tool Learning Needs","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-14T00:26:48.291431Z"},"links":{"cited_paper":"/paper/2411.16489","citing_paper":"/paper/2504.13958"},"observation_digest":"sha256:9a5c16e875dc4044062c555a6202659e04e90ff8404fa12413b4b77086cecd55","observation_id":"2b513696-1e65-4f9c-b23c-63ea13f83fdf","resolution":{"observed_at":"2026-05-14T00:26:48.328841Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.16489","last_updated":"2024-11-25T15:31:27Z","snapshot_observed_at":"2026-08-21T00:33:19.968625Z","submitted_at":"2024-11-25T15:31:27Z","title":"O1 Replication Journey -- Part 2: Surpassing O1-preview through Simple Distillation, Big Progress or Bitter Lesson?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.16489","snapshot_observed_at":"2026-08-16T11:23:45.383186Z","title":"Hugging Face","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.15777","last_updated":"2025-04-22T10:38:00Z","snapshot_observed_at":"2026-08-16T11:15:50.880840Z","submitted_at":"2025-04-22T10:38:00Z","title":"Tina: Tiny Reasoning Models via LoRA","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-16T11:23:45.383186Z"},"links":{"cited_paper":"/paper/2411.16489","citing_paper":"/paper/2504.15777"},"observation_digest":"sha256:8bdeaae9f0073132facf62c322e55840759d2f1faf0c363dbfd7d4c630d8545c","observation_id":"d1d64196-4f45-4af1-9615-00bb001e7f69","resolution":{"observed_at":"2026-08-16T11:23:45.383186Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.16489","last_updated":"2024-11-25T15:31:27Z","snapshot_observed_at":"2026-08-21T00:33:19.968625Z","submitted_at":"2024-11-25T15:31:27Z","title":"O1 Replication Journey -- Part 2: Surpassing O1-preview through Simple Distillation, Big Progress or Bitter Lesson?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.16489","snapshot_observed_at":"2026-08-16T05:26:00.368244Z","title":"O1 replication journey–part 2: Surpassing o1-preview through simple distillation, big progress or bitter lesson? arXiv preprint arXiv:2411.16489, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.20708","last_updated":"2025-04-29T12:39:07Z","snapshot_observed_at":"2026-08-20T19:15:16.903509Z","submitted_at":"2025-04-29T12:39:07Z","title":"Beyond the Last Answer: Your Reasoning Trace Uncovers More than You Think","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-16T05:26:00.368244Z"},"links":{"cited_paper":"/paper/2411.16489","citing_paper":"/paper/2504.20708"},"observation_digest":"sha256:49674be3b233b86512f979633ab830aec6666b06d505c5d01bef01b4a94bdf3f","observation_id":"b18b6175-4216-42d1-913a-6ff614733e84","resolution":{"observed_at":"2026-08-16T05:26:00.368244Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.16489","last_updated":"2024-11-25T15:31:27Z","snapshot_observed_at":"2026-08-21T00:33:19.968625Z","submitted_at":"2024-11-25T15:31:27Z","title":"O1 Replication Journey -- Part 2: Surpassing O1-preview through Simple Distillation, Big Progress or Bitter Lesson?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.16489","snapshot_observed_at":"2026-08-16T00:58:05.729259Z","title":"O1 replication journey–part 2: Surpassing o1-preview through simple distillation, big progress or bitter lesson?arXiv preprint arXiv:2411.16489,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.02390","last_updated":"2025-06-13T06:25:10Z","snapshot_observed_at":"2026-08-19T14:28:24.406792Z","submitted_at":"2025-05-05T06:25:20Z","title":"Quantitative Analysis of Performance Drop in DeepSeek Model Quantization","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-16T00:58:05.729259Z"},"links":{"cited_paper":"/paper/2411.16489","citing_paper":"/paper/2505.02390"},"observation_digest":"sha256:cb027ee1f609c03339c63d27a6554b0b57290eeb4d771252f2f0a349ef6ee973","observation_id":"8dc6e9ce-ab5e-4226-9370-90e052f1ec01","resolution":{"observed_at":"2026-08-16T00:58:05.729259Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.16489","last_updated":"2024-11-25T15:31:27Z","snapshot_observed_at":"2026-08-21T00:33:19.968625Z","submitted_at":"2024-11-25T15:31:27Z","title":"O1 Replication Journey -- Part 2: Surpassing O1-preview through Simple Distillation, Big Progress or Bitter Lesson?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.16489","snapshot_observed_at":"2026-08-15T23:56:46.231895Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.03469","last_updated":"2025-05-21T06:17:56Z","snapshot_observed_at":"2026-08-20T14:00:28.683849Z","submitted_at":"2025-05-06T12:18:11Z","title":"Long-Short Chain-of-Thought Mixture Supervised Fine-Tuning Eliciting Efficient Reasoning in Large Language Models","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-15T23:56:46.231895Z"},"links":{"cited_paper":"/paper/2411.16489","citing_paper":"/paper/2505.03469"},"observation_digest":"sha256:154c3025a7c823968caef21bebabf76db08d07ad7945118d91baddc2a99e9ebc","observation_id":"2f7a70cb-b9c7-4c3a-8e27-6db77aebffb1","resolution":{"observed_at":"2026-08-15T23:56:46.231895Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.16489","last_updated":"2024-11-25T15:31:27Z","snapshot_observed_at":"2026-08-21T00:33:19.968625Z","submitted_at":"2024-11-25T15:31:27Z","title":"O1 Replication Journey -- Part 2: Surpassing O1-preview through Simple Distillation, Big Progress or Bitter Lesson?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.16489","snapshot_observed_at":"2026-08-15T23:08:00.481057Z","title":"O1 replication journey–part 2: Surpassing o1-preview through simple distillation, big progress or bitter lesson? arXiv preprint arXiv:2411.16489, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.05408","last_updated":"2025-05-08T16:50:06Z","snapshot_observed_at":"2026-08-17T01:26:11.454863Z","submitted_at":"2025-05-08T16:50:06Z","title":"Crosslingual Reasoning through Test-Time Scaling","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T23:08:00.481057Z"},"links":{"cited_paper":"/paper/2411.16489","citing_paper":"/paper/2505.05408"},"observation_digest":"sha256:bc2051eddee3bb04fd81a361606bfa74a448ed8b4e93e9d3eb827d54e2b8903f","observation_id":"fa15ad93-73f0-469b-887e-3b1abbcd8c2b","resolution":{"observed_at":"2026-08-15T23:08:00.481057Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.16489","last_updated":"2024-11-25T15:31:27Z","snapshot_observed_at":"2026-08-21T00:33:19.968625Z","submitted_at":"2024-11-25T15:31:27Z","title":"O1 Replication Journey -- Part 2: Surpassing O1-preview through Simple Distillation, Big Progress or Bitter Lesson?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.16489","snapshot_observed_at":"2026-08-07T15:44:32.005515Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.13988","last_updated":"2025-05-20T06:36:45Z","snapshot_observed_at":"2026-08-18T17:17:03.017013Z","submitted_at":"2025-05-20T06:36:45Z","title":"The Hallucination Tax of Reinforcement Finetuning","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T15:44:32.005515Z"},"links":{"cited_paper":"/paper/2411.16489","citing_paper":"/paper/2505.13988"},"observation_digest":"sha256:f776dc747c5a60f46f4d5cb097738503c1a543433246450eb21d29d2638295e2","observation_id":"25972b8f-464b-49e8-94e8-f8f5994bcaff","resolution":{"observed_at":"2026-08-07T15:44:32.005515Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.16489","last_updated":"2024-11-25T15:31:27Z","snapshot_observed_at":"2026-08-21T00:33:19.968625Z","submitted_at":"2024-11-25T15:31:27Z","title":"O1 Replication Journey -- Part 2: Surpassing O1-preview through Simple Distillation, Big Progress or Bitter Lesson?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.16489","snapshot_observed_at":"2026-08-07T15:42:21.824586Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14107","last_updated":"2026-08-17T08:06:21Z","snapshot_observed_at":"2026-08-20T23:15:26.177310Z","submitted_at":"2025-05-20T09:14:53Z","title":"DiagnosisArena: Benchmarking Diagnostic Reasoning for Large Language Models","version":4},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:21.824586Z"},"links":{"cited_paper":"/paper/2411.16489","citing_paper":"/paper/2505.14107"},"observation_digest":"sha256:eea7665e7fe1d2e0b77d5ad37150054ee4feb647bee2e2ad5359aa1ddce4fc9c","observation_id":"13095c2b-6ad1-4105-8fc5-ab73c61da6ea","resolution":{"observed_at":"2026-08-07T15:42:21.824586Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.16489","last_updated":"2024-11-25T15:31:27Z","snapshot_observed_at":"2026-08-21T00:33:19.968625Z","submitted_at":"2024-11-25T15:31:27Z","title":"O1 Replication Journey -- Part 2: Surpassing O1-preview through Simple Distillation, Big Progress or Bitter Lesson?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.16489","snapshot_observed_at":"2026-08-07T14:07:47.214181Z","title":"O1 replication journey–part 2: Surpassing o1-preview through simple distillation, big progress or bitter lesson?arXiv preprint arXiv:2411.16489, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19949","last_updated":"2025-05-26T13:15:26Z","snapshot_observed_at":"2026-08-20T03:49:01.362977Z","submitted_at":"2025-05-26T13:15:26Z","title":"Which Data Attributes Stimulate Math and Code Reasoning? An Investigation via Influence Functions","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T14:07:47.214181Z"},"links":{"cited_paper":"/paper/2411.16489","citing_paper":"/paper/2505.19949"},"observation_digest":"sha256:f6018c9ea53dce391fd8b032fba87b98df383f067a1d6198f137ff2f0169ee5f","observation_id":"93068a75-31cb-47d2-9e61-f089585532d5","resolution":{"observed_at":"2026-08-07T14:07:47.214181Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.16489","last_updated":"2024-11-25T15:31:27Z","snapshot_observed_at":"2026-08-21T00:33:19.968625Z","submitted_at":"2024-11-25T15:31:27Z","title":"O1 Replication Journey -- Part 2: Surpassing O1-preview through Simple Distillation, Big Progress or Bitter Lesson?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.16489","snapshot_observed_at":"2026-08-07T13:16:13.699004Z","title":"O1 replication journey–part 2: Surpassing o1-preview through simple distillation, big progress or bitter lesson? arXiv preprint arXiv:2411.16489, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22375","last_updated":"2025-05-29T01:59:00Z","snapshot_observed_at":"2026-08-20T00:11:32.191043Z","submitted_at":"2025-05-28T14:03:02Z","title":"Pangu Embedded: An Efficient Dual-system LLM Reasoner with Metacognition","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T13:16:13.699004Z"},"links":{"cited_paper":"/paper/2411.16489","citing_paper":"/paper/2505.22375"},"observation_digest":"sha256:7bcec64fa13baf9f352ff15cdd5e9d0021f58b455df45532635e138f5cbb60f0","observation_id":"c194fdc6-7f42-4f4f-aa43-261835bef716","resolution":{"observed_at":"2026-08-07T13:16:13.699004Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.16489","last_updated":"2024-11-25T15:31:27Z","snapshot_observed_at":"2026-08-21T00:33:19.968625Z","submitted_at":"2024-11-25T15:31:27Z","title":"O1 Replication Journey -- Part 2: Surpassing O1-preview through Simple Distillation, Big Progress or Bitter Lesson?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.16489","snapshot_observed_at":"2026-08-07T12:53:01.360490Z","title":"O1 replication journey--part 2: Surpassing o1-preview through simple distillation, big progress or bitter lesson? arXiv preprint arXiv:2411.16489, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23363","last_updated":"2025-05-29T11:40:34Z","snapshot_observed_at":"2026-08-13T15:07:02.007842Z","submitted_at":"2025-05-29T11:40:34Z","title":"Discriminative Policy Optimization for Token-Level Reward Models","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T12:53:01.360490Z"},"links":{"cited_paper":"/paper/2411.16489","citing_paper":"/paper/2505.23363"},"observation_digest":"sha256:e2b23d345a70df5e94d1605df99fa51c1fdc82ace891ce7652ce4f24e15d2679","observation_id":"4730ea76-6a7a-4f55-a2d8-0e6386a5c80f","resolution":{"observed_at":"2026-08-07T12:53:01.360490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.16489","last_updated":"2024-11-25T15:31:27Z","snapshot_observed_at":"2026-08-21T00:33:19.968625Z","submitted_at":"2024-11-25T15:31:27Z","title":"O1 Replication Journey -- Part 2: Surpassing O1-preview through Simple Distillation, Big Progress or Bitter Lesson?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.16489","snapshot_observed_at":"2026-08-07T12:35:41.259399Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24863","last_updated":"2025-05-30T17:58:36Z","snapshot_observed_at":"2026-08-20T12:36:21.991307Z","submitted_at":"2025-05-30T17:58:36Z","title":"AlphaOne: Reasoning Models Thinking Slow and Fast at Test Time","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:41.259399Z"},"links":{"cited_paper":"/paper/2411.16489","citing_paper":"/paper/2505.24863"},"observation_digest":"sha256:600385a06323ebf7d01137fdd9eaec075fcf0554b62a3946cfbab3aa015858eb","observation_id":"8ce8cbb9-e0b3-4779-90bd-79f1d93cbdd2","resolution":{"observed_at":"2026-08-07T12:35:41.259399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.16489","last_updated":"2024-11-25T15:31:27Z","snapshot_observed_at":"2026-08-21T00:33:19.968625Z","submitted_at":"2024-11-25T15:31:27Z","title":"O1 Replication Journey -- Part 2: Surpassing O1-preview through Simple Distillation, Big Progress or Bitter Lesson?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.16489","snapshot_observed_at":"2026-08-07T11:30:40.181809Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02338","last_updated":"2025-06-03T00:29:15Z","snapshot_observed_at":"2026-08-08T15:09:47.963101Z","submitted_at":"2025-06-03T00:29:15Z","title":"One Missing Piece for Open-Source Reasoning Models: A Dataset to Mitigate Cold-Starting Short CoT LLMs in RL","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T11:30:40.181809Z"},"links":{"cited_paper":"/paper/2411.16489","citing_paper":"/paper/2506.02338"},"observation_digest":"sha256:764e4bd68013e24ae0c4661b1241e84f91acc92d830398201024240185247901","observation_id":"138d07e0-6681-424c-993c-7834b5af1842","resolution":{"observed_at":"2026-08-07T11:30:40.181809Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.16489","last_updated":"2024-11-25T15:31:27Z","snapshot_observed_at":"2026-08-21T00:33:19.968625Z","submitted_at":"2024-11-25T15:31:27Z","title":"O1 Replication Journey -- Part 2: Surpassing O1-preview through Simple Distillation, Big Progress or Bitter Lesson?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.16489","snapshot_observed_at":"2026-08-06T22:23:08.994979Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.22521","last_updated":"2025-06-26T22:02:01Z","snapshot_observed_at":"2026-08-17T10:14:30.703303Z","submitted_at":"2025-06-26T22:02:01Z","title":"A Survey on Model Extraction Attacks and Defenses for Large Language Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T22:23:08.994979Z"},"links":{"cited_paper":"/paper/2411.16489","citing_paper":"/paper/2506.22521"},"observation_digest":"sha256:9275fd08f5ba1299f75674a5c032a37afa86c7d4086050deff23cf105d5c3b21","observation_id":"d7c69f25-f84b-4e19-b3ab-0bfb19014bd0","resolution":{"observed_at":"2026-08-06T22:23:08.994979Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.16489","last_updated":"2024-11-25T15:31:27Z","snapshot_observed_at":"2026-08-21T00:33:19.968625Z","submitted_at":"2024-11-25T15:31:27Z","title":"O1 Replication Journey -- Part 2: Surpassing O1-preview through Simple Distillation, Big Progress or Bitter Lesson?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.16489","snapshot_observed_at":"2026-08-15T18:22:13.260427Z","title":"O1 replication journey–part 2: Surpassing o1-preview through simple distillation, big progress or bitter lesson?,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.18178","last_updated":"2025-07-24T08:24:52Z","snapshot_observed_at":"2026-08-18T23:14:26.417163Z","submitted_at":"2025-07-24T08:24:52Z","title":"Decoupling Knowledge and Reasoning in LLMs: An Exploration Using Cognitive Dual-System Theory","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T18:22:13.260427Z"},"links":{"cited_paper":"/paper/2411.16489","citing_paper":"/paper/2507.18178"},"observation_digest":"sha256:21b501fbdb9c02bc97acd886f6ab8695a447311ac6c740411657c73a3b2878d6","observation_id":"07735104-4146-4919-a208-5bb64e9c917f","resolution":{"observed_at":"2026-08-15T18:22:13.260427Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.16489","last_updated":"2024-11-25T15:31:27Z","snapshot_observed_at":"2026-08-21T00:33:19.968625Z","submitted_at":"2024-11-25T15:31:27Z","title":"O1 Replication Journey -- Part 2: Surpassing O1-preview through Simple Distillation, Big Progress or Bitter Lesson?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.16489","snapshot_observed_at":"2026-08-05T10:38:59.955343Z","title":"O1 Replication Journey–Part 2: Surpassing O1-preview through Simple Distillation, Big Progress or Bitter Lesson? arXiv preprint arXiv:2411.16489, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.03871","last_updated":"2025-09-04T04:12:31Z","snapshot_observed_at":"2026-08-17T17:37:38.616375Z","submitted_at":"2025-09-04T04:12:31Z","title":"A Comprehensive Survey on Trustworthiness in Reasoning with Large Language Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-05T10:38:59.955343Z"},"links":{"cited_paper":"/paper/2411.16489","citing_paper":"/paper/2509.03871"},"observation_digest":"sha256:8a123a17cdcbebdaf32102c97f9e781c8d65a68f07e470f90e0bee4ffeff959c","observation_id":"24ce318b-8b3f-498d-af59-d535234a24c3","resolution":{"observed_at":"2026-08-05T10:38:59.955343Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.16489","last_updated":"2024-11-25T15:31:27Z","snapshot_observed_at":"2026-08-21T00:33:19.968625Z","submitted_at":"2024-11-25T15:31:27Z","title":"O1 Replication Journey -- Part 2: Surpassing O1-preview through Simple Distillation, Big Progress or Bitter Lesson?","version":1},"cited_work":{"arxiv_id":"2411.16489","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.16489","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"O1 replication journey - part 2: Surpassing o1- preview through simple distillation, big progress or bitter lesson?CoRR, abs/2411.16489","venue":null,"work_id":"39511fc8-6f44-4e54-8d67-6b38c9b02994","year":2024},"citing_paper":{"arxiv_id":"2512.13564","last_updated":"2026-01-13T09:33:57Z","snapshot_observed_at":"2026-08-13T14:23:02.090859Z","submitted_at":"2025-12-15T17:22:34Z","title":"Memory in the Age of AI Agents","version":2},"reference_index":192,"source":"arxiv_source","source_observed_at":"2026-05-11T18:18:19.911342Z"},"links":{"cited_paper":"/paper/2411.16489","citing_paper":"/paper/2512.13564"},"observation_digest":"sha256:7a0abe73a8bcec3d4a59592a3980856fab8698e1270b60519e7ab5c4edbc75f0","observation_id":"7f5dc798-99ad-4a9a-a694-de37ab8f8aae","resolution":{"observed_at":"2026-05-11T18:18:20.614997Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.16489","last_updated":"2024-11-25T15:31:27Z","snapshot_observed_at":"2026-08-21T00:33:19.968625Z","submitted_at":"2024-11-25T15:31:27Z","title":"O1 Replication Journey -- Part 2: Surpassing O1-preview through Simple Distillation, Big Progress or Bitter Lesson?","version":1},"cited_work":{"arxiv_id":"2411.16489","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.16489","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"O1 replication journey - part 2: Surpassing o1- preview through simple distillation, big progress or bitter lesson?CoRR, abs/2411.16489","venue":null,"work_id":"39511fc8-6f44-4e54-8d67-6b38c9b02994","year":2024},"citing_paper":{"arxiv_id":"2601.13262","last_updated":"2026-04-26T01:38:11Z","snapshot_observed_at":"2026-08-11T09:32:38.343501Z","submitted_at":"2026-01-19T17:51:00Z","title":"CURE-Med: Curriculum-Informed Reinforcement Learning for Multilingual Medical Reasoning","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-16T13:20:49.919833Z"},"links":{"cited_paper":"/paper/2411.16489","citing_paper":"/paper/2601.13262"},"observation_digest":"sha256:1db238d406c188f6b6123241bc112a3d834e81ef05ec8a92285d84662e03cb3d","observation_id":"aaf9560f-921a-406b-ab95-de86c7eaa519","resolution":{"observed_at":"2026-05-16T13:20:57.502337Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.16489","last_updated":"2024-11-25T15:31:27Z","snapshot_observed_at":"2026-08-21T00:33:19.968625Z","submitted_at":"2024-11-25T15:31:27Z","title":"O1 Replication Journey -- Part 2: Surpassing O1-preview through Simple Distillation, Big Progress or Bitter Lesson?","version":1},"cited_work":{"arxiv_id":"2411.16489","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.16489","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"O1 replication journey - part 2: Surpassing o1- preview through simple distillation, big progress or bitter lesson?CoRR, abs/2411.16489","venue":null,"work_id":"39511fc8-6f44-4e54-8d67-6b38c9b02994","year":2024},"citing_paper":{"arxiv_id":"2605.05893","last_updated":"2026-05-07T09:03:49Z","snapshot_observed_at":"2026-08-11T11:58:54.935615Z","submitted_at":"2026-05-07T09:03:49Z","title":"Logic-Regularized Verifier Elicits Reasoning from LLMs","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-05-08T10:54:01.229934Z"},"links":{"cited_paper":"/paper/2411.16489","citing_paper":"/paper/2605.05893"},"observation_digest":"sha256:3d0c6abf8347652fe6807e10e3210033afaed06e21c3320bcfc406533f7c3c41","observation_id":"4d92913c-2ecf-41cb-8814-f3b7dc39b92d","resolution":{"observed_at":"2026-05-11T19:51:10.845910Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.16489","last_updated":"2024-11-25T15:31:27Z","snapshot_observed_at":"2026-08-21T00:33:19.968625Z","submitted_at":"2024-11-25T15:31:27Z","title":"O1 Replication Journey -- Part 2: Surpassing O1-preview through Simple Distillation, Big Progress or Bitter Lesson?","version":1},"cited_work":{"arxiv_id":"2411.16489","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.16489","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"O1 replication journey - part 2: Surpassing o1- preview through simple distillation, big progress or bitter lesson?CoRR, abs/2411.16489","venue":null,"work_id":"39511fc8-6f44-4e54-8d67-6b38c9b02994","year":2024},"citing_paper":{"arxiv_id":"2605.08401","last_updated":"2026-05-15T12:46:04Z","snapshot_observed_at":"2026-08-11T06:44:47.502612Z","submitted_at":"2026-05-08T19:06:55Z","title":"AIPO: Learning to Reason from Active Interaction","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-12T01:17:28.124867Z"},"links":{"cited_paper":"/paper/2411.16489","citing_paper":"/paper/2605.08401"},"observation_digest":"sha256:dfcd49a48d989fe718dc647d2e103e6fed299c2b66909ead793119757c6c20b1","observation_id":"d3173cee-78ea-4144-98aa-f3dc22ec6d2c","resolution":{"observed_at":"2026-05-12T08:06:31.465733Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.16489","last_updated":"2024-11-25T15:31:27Z","snapshot_observed_at":"2026-08-21T00:33:19.968625Z","submitted_at":"2024-11-25T15:31:27Z","title":"O1 Replication Journey -- Part 2: Surpassing O1-preview through Simple Distillation, Big Progress or Bitter Lesson?","version":1},"cited_work":{"arxiv_id":"2411.16489","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.16489","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"O1 replication journey - part 2: Surpassing o1- preview through simple distillation, big progress or bitter lesson?CoRR, abs/2411.16489","venue":null,"work_id":"39511fc8-6f44-4e54-8d67-6b38c9b02994","year":2024},"citing_paper":{"arxiv_id":"2605.08401","last_updated":"2026-05-15T12:46:04Z","snapshot_observed_at":"2026-08-11T06:44:47.502612Z","submitted_at":"2026-05-08T19:06:55Z","title":"AIPO: Learning to Reason from Active Interaction","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-19T18:07:27.492419Z"},"links":{"cited_paper":"/paper/2411.16489","citing_paper":"/paper/2605.08401"},"observation_digest":"sha256:4f7d8ce2c57192a5f01be15bc99f2bd8eae21949c747ba5d9e2906f71469d283","observation_id":"6a6304ac-de7a-463d-8d0a-d4809d91903a","resolution":{"observed_at":"2026-05-19T18:07:42.250014Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.16489","last_updated":"2024-11-25T15:31:27Z","snapshot_observed_at":"2026-08-21T00:33:19.968625Z","submitted_at":"2024-11-25T15:31:27Z","title":"O1 Replication Journey -- Part 2: Surpassing O1-preview through Simple Distillation, Big Progress or Bitter Lesson?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.16489","snapshot_observed_at":"2026-08-12T14:10:45.482027Z","title":"arXiv preprint arXiv:2411.16489 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10928","last_updated":"2026-08-11T13:58:07Z","snapshot_observed_at":"2026-08-17T15:17:05.825896Z","submitted_at":"2026-08-11T13:58:07Z","title":"ThinkRetrieve: Retrieval-Augmented Reasoning Traces for Test-Time Scaling","version":1},"reference_index":127,"source":"arxiv_source","source_observed_at":"2026-08-12T14:10:45.482027Z"},"links":{"cited_paper":"/paper/2411.16489","citing_paper":"/paper/2608.10928"},"observation_digest":"sha256:4c78395858ec770ea94c9a197055f9e9ed88379b3df268e1a5662b4b133bec02","observation_id":"13462202-4359-43b5-b29a-21b1cd625d5f","resolution":{"observed_at":"2026-08-12T14:10:45.482027Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2411.16489/citation-record","integrity":"/paper/2411.16489/integrity","json":"/paper/2411.16489/citation-record.json","paper":"/paper/2411.16489"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:07:49.246027Z","title":null,"venue":null,"work_id":"ccbc0d30-a740-4ec1-9ffd-0dad821f160c","year":2024},"citing_paper":{"arxiv_id":"2411.16489","last_updated":"2024-11-25T15:31:27Z","snapshot_observed_at":"2026-08-21T00:33:19.968625Z","submitted_at":"2024-11-25T15:31:27Z","title":"O1 Replication Journey -- Part 2: Surpassing O1-preview through Simple Distillation, Big Progress or Bitter Lesson?","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T13:07:48.841797Z"},"links":{"citing_paper":"/paper/2411.16489"},"observation_digest":"sha256:f57732c51b790db0445a9c3be6a25157484c1675b6c6912669797d47e84360d6","observation_id":"3be880df-c1eb-4573-8879-50788f2ff16c","resolution":{"observed_at":"2026-08-12T13:07:49.250761Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.17075","last_updated":"2024-08-13T10:59:17Z","snapshot_observed_at":"2026-08-16T13:31:31.434971Z","submitted_at":"2024-07-24T08:04:00Z","title":"SAFETY-J: Evaluating Safety with Critique","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.17075","snapshot_observed_at":"2026-08-12T13:07:48.846726Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.16489","last_updated":"2024-11-25T15:31:27Z","snapshot_observed_at":"2026-08-21T00:33:19.968625Z","submitted_at":"2024-11-25T15:31:27Z","title":"O1 Replication Journey -- Part 2: Surpassing O1-preview through Simple Distillation, Big Progress or Bitter Lesson?","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-12T13:07:48.846726Z"},"links":{"cited_paper":"/paper/2407.17075","citing_paper":"/paper/2411.16489"},"observation_digest":"sha256:a6d21765994ca00f96adda40d6df4344f5f87793971dd983f1545b5971ed7018","observation_id":"56311ecc-126c-432d-92c8-07b55654ce1c","resolution":{"observed_at":"2026-08-12T13:07:48.846726Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:07:49.232147Z","title":null,"venue":null,"work_id":"1fb2aef0-eba9-4819-a48f-a3490bc9ee89","year":2024},"citing_paper":{"arxiv_id":"2411.16489","last_updated":"2024-11-25T15:31:27Z","snapshot_observed_at":"2026-08-21T00:33:19.968625Z","submitted_at":"2024-11-25T15:31:27Z","title":"O1 Replication Journey -- Part 2: Surpassing O1-preview through Simple Distillation, Big Progress or Bitter Lesson?","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-12T13:07:48.851359Z"},"links":{"citing_paper":"/paper/2411.16489"},"observation_digest":"sha256:b1429007dd08ca1f23fba49e7885aca82b78adbc5bf36556e2de442475548f89","observation_id":"4cd5ffe2-d175-49d0-b690-a5b3f25fb82b","resolution":{"observed_at":"2026-08-12T13:07:49.236647Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:07:49.217833Z","title":null,"venue":null,"work_id":"8597320d-0abe-409d-9a07-319f56fffb6e","year":2022},"citing_paper":{"arxiv_id":"2411.16489","last_updated":"2024-11-25T15:31:27Z","snapshot_observed_at":"2026-08-21T00:33:19.968625Z","submitted_at":"2024-11-25T15:31:27Z","title":"O1 Replication Journey -- Part 2: Surpassing O1-preview through Simple Distillation, Big Progress or Bitter Lesson?","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-12T13:07:48.855706Z"},"links":{"citing_paper":"/paper/2411.16489"},"observation_digest":"sha256:a398d2b488adb25e9cafa30f96492ed5b439aabb9dea38e310505adaed2f332f","observation_id":"172945e6-9bbb-437e-8818-197fcfcef603","resolution":{"observed_at":"2026-08-12T13:07:49.222231Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18982","last_updated":"2024-10-08T15:13:01Z","snapshot_observed_at":"2026-08-17T14:27:29.437009Z","submitted_at":"2024-10-08T15:13:01Z","title":"O1 Replication Journey: A Strategic Progress Report -- Part 1","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.18982","snapshot_observed_at":"2026-08-12T13:07:48.860045Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.16489","last_updated":"2024-11-25T15:31:27Z","snapshot_observed_at":"2026-08-21T00:33:19.968625Z","submitted_at":"2024-11-25T15:31:27Z","title":"O1 Replication Journey -- Part 2: Surpassing O1-preview through Simple Distillation, Big Progress or Bitter Lesson?","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-12T13:07:48.860045Z"},"links":{"cited_paper":"/paper/2410.18982","citing_paper":"/paper/2411.16489"},"observation_digest":"sha256:d11f8f7534665a036696f8118b4d568ab334277449c510399f40243c97121788","observation_id":"f744c515-47f7-455d-a333-d908b74df1e8","resolution":{"observed_at":"2026-08-12T13:07:48.860045Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03314","last_updated":"2024-08-06T17:35:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-06T17:35:05Z","title":"Scaling LLM Test-Time Compute Optimally can be More Effective than Scaling Model Parameters","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.03314","snapshot_observed_at":"2026-08-12T13:07:48.864430Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.16489","last_updated":"2024-11-25T15:31:27Z","snapshot_observed_at":"2026-08-21T00:33:19.968625Z","submitted_at":"2024-11-25T15:31:27Z","title":"O1 Replication Journey -- Part 2: Surpassing O1-preview through Simple Distillation, Big Progress or Bitter Lesson?","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-12T13:07:48.864430Z"},"links":{"cited_paper":"/paper/2408.03314","citing_paper":"/paper/2411.16489"},"observation_digest":"sha256:869f6ca2295ba82c01840027a231d6fd94113f868c5085077b7b42a3557ce43b","observation_id":"d107d821-572a-402f-a8d0-fca5d8542f9b","resolution":{"observed_at":"2026-08-12T13:07:48.864430Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:07:49.203072Z","title":null,"venue":null,"work_id":"909cccfc-512c-482d-b40f-dcd452d82a6d","year":2022},"citing_paper":{"arxiv_id":"2411.16489","last_updated":"2024-11-25T15:31:27Z","snapshot_observed_at":"2026-08-21T00:33:19.968625Z","submitted_at":"2024-11-25T15:31:27Z","title":"O1 Replication Journey -- Part 2: Surpassing O1-preview through Simple Distillation, Big Progress or Bitter Lesson?","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-12T13:07:48.869443Z"},"links":{"citing_paper":"/paper/2411.16489"},"observation_digest":"sha256:edf5019a34b9f7ecc7fad2533b326d9bd5bf19282468e6aa2cb92b085b201ac0","observation_id":"12d9312a-c90e-4715-88c8-2ae643b8e94f","resolution":{"observed_at":"2026-08-12T13:07:49.207412Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:07:49.189234Z","title":null,"venue":null,"work_id":"36f3eb35-4df5-419b-9212-f10aac960088","year":2023},"citing_paper":{"arxiv_id":"2411.16489","last_updated":"2024-11-25T15:31:27Z","snapshot_observed_at":"2026-08-21T00:33:19.968625Z","submitted_at":"2024-11-25T15:31:27Z","title":"O1 Replication Journey -- Part 2: Surpassing O1-preview through Simple Distillation, Big Progress or Bitter Lesson?","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-12T13:07:48.873612Z"},"links":{"citing_paper":"/paper/2411.16489"},"observation_digest":"sha256:aa7e74402c57d93b1129837dde3110f53e22aedde7aa356e477e070dd3bc160c","observation_id":"4c57e2a7-cf79-4414-a756-016578c6533e","resolution":{"observed_at":"2026-08-12T13:07:49.193421Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:07:49.175437Z","title":null,"venue":null,"work_id":"1bd0c4b2-a85c-4a87-bb29-dd49b3bbdea1","year":null},"citing_paper":{"arxiv_id":"2411.16489","last_updated":"2024-11-25T15:31:27Z","snapshot_observed_at":"2026-08-21T00:33:19.968625Z","submitted_at":"2024-11-25T15:31:27Z","title":"O1 Replication Journey -- Part 2: Surpassing O1-preview through Simple Distillation, Big Progress or Bitter Lesson?","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-12T13:07:48.877679Z"},"links":{"citing_paper":"/paper/2411.16489"},"observation_digest":"sha256:f479d954a85a91765f2472b2f61dc441b68c77694a94e486a2659df6c188eef5","observation_id":"90c4a1d5-1ebf-4326-95bb-e8e1cf3ab03a","resolution":{"observed_at":"2026-08-12T13:07:49.179697Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:07:49.161070Z","title":null,"venue":null,"work_id":"a1c068ab-9622-4fb5-b901-99acae98bcd9","year":null},"citing_paper":{"arxiv_id":"2411.16489","last_updated":"2024-11-25T15:31:27Z","snapshot_observed_at":"2026-08-21T00:33:19.968625Z","submitted_at":"2024-11-25T15:31:27Z","title":"O1 Replication Journey -- Part 2: Surpassing O1-preview through Simple Distillation, Big Progress or Bitter Lesson?","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-12T13:07:48.881833Z"},"links":{"citing_paper":"/paper/2411.16489"},"observation_digest":"sha256:9405ad1afaa0d6fd7c6f1509c945fe1c9e9a8d500162cf8b2d84f1500cb6c13b","observation_id":"4ed22f88-f48c-4067-9227-96267eb39f45","resolution":{"observed_at":"2026-08-12T13:07:49.165821Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:07:49.146835Z","title":null,"venue":null,"work_id":"c0b2288e-0299-4f6e-9f28-ff3223b612ae","year":2023},"citing_paper":{"arxiv_id":"2411.16489","last_updated":"2024-11-25T15:31:27Z","snapshot_observed_at":"2026-08-21T00:33:19.968625Z","submitted_at":"2024-11-25T15:31:27Z","title":"O1 Replication Journey -- Part 2: Surpassing O1-preview through Simple Distillation, Big Progress or Bitter Lesson?","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-12T13:07:48.885876Z"},"links":{"citing_paper":"/paper/2411.16489"},"observation_digest":"sha256:1957419c6bb9c7861fd459b8888d895ab8e0eac22f15e3ddcaac5cca737f0662","observation_id":"a486b82a-463a-4453-a425-1ac3cbf7b7b6","resolution":{"observed_at":"2026-08-12T13:07:49.151284Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.11171","last_updated":"2023-03-07T17:57:37Z","snapshot_observed_at":"2026-08-16T01:49:22.176843Z","submitted_at":"2022-03-21T17:48:52Z","title":"Self-Consistency Improves Chain of Thought Reasoning in Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.11171","snapshot_observed_at":"2026-08-12T13:07:48.890377Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.16489","last_updated":"2024-11-25T15:31:27Z","snapshot_observed_at":"2026-08-21T00:33:19.968625Z","submitted_at":"2024-11-25T15:31:27Z","title":"O1 Replication Journey -- Part 2: Surpassing O1-preview through Simple Distillation, Big Progress or Bitter Lesson?","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-12T13:07:48.890377Z"},"links":{"cited_paper":"/paper/2203.11171","citing_paper":"/paper/2411.16489"},"observation_digest":"sha256:73b1cf5c387bc2702e784957f331a99060dd45b1d5216534fe3e72bd97c26204","observation_id":"0c82c8ff-fc68-47f6-bc4a-ad208539e709","resolution":{"observed_at":"2026-08-12T13:07:48.890377Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.04368","last_updated":"2024-11-07T01:58:42Z","snapshot_observed_at":"2026-08-17T10:08:57.374438Z","submitted_at":"2024-11-07T01:58:42Z","title":"Measuring short-form factuality in large language models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.04368","snapshot_observed_at":"2026-08-12T13:07:48.894841Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.16489","last_updated":"2024-11-25T15:31:27Z","snapshot_observed_at":"2026-08-21T00:33:19.968625Z","submitted_at":"2024-11-25T15:31:27Z","title":"O1 Replication Journey -- Part 2: Surpassing O1-preview through Simple Distillation, Big Progress or Bitter Lesson?","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-12T13:07:48.894841Z"},"links":{"cited_paper":"/paper/2411.04368","citing_paper":"/paper/2411.16489"},"observation_digest":"sha256:a44e1352f4b8f92b61eb1430fbd9dcac94128d93a2dae2b2fa88903dbd5ac419","observation_id":"e34ef943-f0b5-4d86-bc6f-10cae8658b79","resolution":{"observed_at":"2026-08-12T13:07:48.894841Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:07:48.899312Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.16489","last_updated":"2024-11-25T15:31:27Z","snapshot_observed_at":"2026-08-21T00:33:19.968625Z","submitted_at":"2024-11-25T15:31:27Z","title":"O1 Replication Journey -- Part 2: Surpassing O1-preview through Simple Distillation, Big Progress or Bitter Lesson?","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-12T13:07:48.899312Z"},"links":{"citing_paper":"/paper/2411.16489"},"observation_digest":"sha256:f2223b52909a1586bb76c01960cd17ce19e0a8ddb9f595b5dd3f053e627afcda","observation_id":"e21f5184-e3c5-4b69-a975-5801fbf822a8","resolution":{"observed_at":"2026-08-12T13:07:48.899312Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.12244","last_updated":"2025-05-27T06:49:09Z","snapshot_observed_at":"2026-08-13T02:06:18.586697Z","submitted_at":"2023-04-24T16:31:06Z","title":"WizardLM: Empowering large pre-trained language models to follow complex instructions","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.12244","snapshot_observed_at":"2026-08-12T13:07:48.907837Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.16489","last_updated":"2024-11-25T15:31:27Z","snapshot_observed_at":"2026-08-21T00:33:19.968625Z","submitted_at":"2024-11-25T15:31:27Z","title":"O1 Replication Journey -- Part 2: Surpassing O1-preview through Simple Distillation, Big Progress or Bitter Lesson?","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-12T13:07:48.907837Z"},"links":{"cited_paper":"/paper/2304.12244","citing_paper":"/paper/2411.16489"},"observation_digest":"sha256:0d6bfbabca1b86e583a145080609d3cf570b671e61d4b2a9c0aa00c668bee149","observation_id":"2926c0c2-d735-4f6b-9007-2d01487d3dd7","resolution":{"observed_at":"2026-08-12T13:07:48.907837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10671","last_updated":"2024-09-10T13:25:53Z","snapshot_observed_at":"2026-08-17T11:08:48.802438Z","submitted_at":"2024-07-15T12:35:42Z","title":"Qwen2 Technical Report","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10671","snapshot_observed_at":"2026-08-12T13:07:48.912230Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.16489","last_updated":"2024-11-25T15:31:27Z","snapshot_observed_at":"2026-08-21T00:33:19.968625Z","submitted_at":"2024-11-25T15:31:27Z","title":"O1 Replication Journey -- Part 2: Surpassing O1-preview through Simple Distillation, Big Progress or Bitter Lesson?","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-12T13:07:48.912230Z"},"links":{"cited_paper":"/paper/2407.10671","citing_paper":"/paper/2411.16489"},"observation_digest":"sha256:d6a809953908f42bc0209253ab75201bf5bb1ed325fa0befb8a646ead5a4a0a2","observation_id":"f9cf0810-6b54-470e-a1f6-a2de28de31b7","resolution":{"observed_at":"2026-08-12T13:07:48.912230Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12122","last_updated":"2024-09-18T16:45:37Z","snapshot_observed_at":"2026-08-20T14:18:10.920944Z","submitted_at":"2024-09-18T16:45:37Z","title":"Qwen2.5-Math Technical Report: Toward Mathematical Expert Model via Self-Improvement","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12122","snapshot_observed_at":"2026-08-12T13:07:48.916845Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.16489","last_updated":"2024-11-25T15:31:27Z","snapshot_observed_at":"2026-08-21T00:33:19.968625Z","submitted_at":"2024-11-25T15:31:27Z","title":"O1 Replication Journey -- Part 2: Surpassing O1-preview through Simple Distillation, Big Progress or Bitter Lesson?","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-12T13:07:48.916845Z"},"links":{"cited_paper":"/paper/2409.12122","citing_paper":"/paper/2411.16489"},"observation_digest":"sha256:01556004515503a0111705d327b01d9ca9dbc06e1be6451701a8b3b75df4ad4d","observation_id":"98debf8b-c6f1-4da7-899e-6ac0199f1268","resolution":{"observed_at":"2026-08-12T13:07:48.916845Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.12284","last_updated":"2024-05-03T17:36:07Z","snapshot_observed_at":"2026-08-13T10:57:13.012119Z","submitted_at":"2023-09-21T17:45:42Z","title":"MetaMath: Bootstrap Your Own Mathematical Questions for Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.12284","snapshot_observed_at":"2026-08-12T13:07:48.921933Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.16489","last_updated":"2024-11-25T15:31:27Z","snapshot_observed_at":"2026-08-21T00:33:19.968625Z","submitted_at":"2024-11-25T15:31:27Z","title":"O1 Replication Journey -- Part 2: Surpassing O1-preview through Simple Distillation, Big Progress or Bitter Lesson?","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-12T13:07:48.921933Z"},"links":{"cited_paper":"/paper/2309.12284","citing_paper":"/paper/2411.16489"},"observation_digest":"sha256:821227c5d339546630bbbf878b06a42aec3c28ce1e14dd898bdb1de79e857be9","observation_id":"afb7f50d-6e80-4458-8f0f-fa3910b44744","resolution":{"observed_at":"2026-08-12T13:07:48.921933Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:07:49.114684Z","title":null,"venue":null,"work_id":"15770431-bda3-403b-84d8-0787c1fabe11","year":2022},"citing_paper":{"arxiv_id":"2411.16489","last_updated":"2024-11-25T15:31:27Z","snapshot_observed_at":"2026-08-21T00:33:19.968625Z","submitted_at":"2024-11-25T15:31:27Z","title":"O1 Replication Journey -- Part 2: Surpassing O1-preview through Simple Distillation, Big Progress or Bitter Lesson?","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-12T13:07:48.926492Z"},"links":{"citing_paper":"/paper/2411.16489"},"observation_digest":"sha256:4515cf0e952d671bc3eddf84aad5eca700f521e3ae945d47c21455bf484abc5a","observation_id":"1a9eebcf-acdb-4b9d-ba2d-326b615ac4e4","resolution":{"observed_at":"2026-08-12T13:07:49.119184Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:07:49.099329Z","title":null,"venue":null,"work_id":"e70812a6-6b94-492f-ab15-934aa979e635","year":2024},"citing_paper":{"arxiv_id":"2411.16489","last_updated":"2024-11-25T15:31:27Z","snapshot_observed_at":"2026-08-21T00:33:19.968625Z","submitted_at":"2024-11-25T15:31:27Z","title":"O1 Replication Journey -- Part 2: Surpassing O1-preview through Simple Distillation, Big Progress or Bitter Lesson?","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-12T13:07:48.930618Z"},"links":{"citing_paper":"/paper/2411.16489"},"observation_digest":"sha256:355ec04ba34a36eea107cd25c732c93a9bfc3f79678d5ae809068e9434e6972c","observation_id":"c7b0a243-9e7a-415d-99ba-e9a27fc7f44d","resolution":{"observed_at":"2026-08-12T13:07:49.105007Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1909.08593","last_updated":"2020-01-08T23:02:36Z","snapshot_observed_at":"2026-08-21T16:54:14.450108Z","submitted_at":"2019-09-18T17:33:39Z","title":"Fine-Tuning Language Models from Human Preferences","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.08593","snapshot_observed_at":"2026-08-12T13:07:48.934782Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2411.16489","last_updated":"2024-11-25T15:31:27Z","snapshot_observed_at":"2026-08-21T00:33:19.968625Z","submitted_at":"2024-11-25T15:31:27Z","title":"O1 Replication Journey -- Part 2: Surpassing O1-preview through Simple Distillation, Big Progress or Bitter Lesson?","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-12T13:07:48.934782Z"},"links":{"cited_paper":"/paper/1909.08593","citing_paper":"/paper/2411.16489"},"observation_digest":"sha256:7d093a965bfcaaa85b9b274f8462e2a2cfcce5cba451e10e459b2a3b2cc1e2a5","observation_id":"861e9aa1-cad4-4c87-8eef-94e5eb205783","resolution":{"observed_at":"2026-08-12T13:07:48.934782Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:07:48.903437Z","title":"Advances in neural information processing systems, 35:24824–24837","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.16489","last_updated":"2024-11-25T15:31:27Z","snapshot_observed_at":"2026-08-21T00:33:19.968625Z","submitted_at":"2024-11-25T15:31:27Z","title":"O1 Replication Journey -- Part 2: Surpassing O1-preview through Simple Distillation, Big Progress or Bitter Lesson?","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-12T13:07:48.903437Z"},"links":{"citing_paper":"/paper/2411.16489"},"observation_digest":"sha256:4e4849bad3244da9166bd3fff53df9e863e8c3eef26c8ac2be9842216e013494","observation_id":"296b1e12-1e7d-4a6f-ab73-fd69eb06e4cd","resolution":{"observed_at":"2026-08-12T13:07:48.903437Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2411.16489","last_updated":"2024-11-25T15:31:27Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-21T00:33:19.968625Z","submitted_at":"2024-11-25T15:31:27Z","title":"O1 Replication Journey -- Part 2: Surpassing O1-preview through Simple Distillation, Big Progress or Bitter Lesson?"},"reference_resolution":{"displayed":22,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":22,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":22},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"thesis":"As of 22 August 2026, this Paper Citation Record lists 22 of 22 outbound references and 36 inbound Pith citation observations for arXiv:2411.16489."}