{"as_of":"2026-08-07T10:33:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:aa6fc2d8537acf61bcbe3d9b5f6a4a52c42067cd0cf490f86a22a14f6f6877ca","coverage":[{"denominator":27,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":27,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T16:09:06.934747Z","state":"measured"},{"denominator":27,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":27,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.14419/citation-record","integrity":"/paper/2507.14419/integrity","json":"/paper/2507.14419/citation-record.json","paper":"/paper/2507.14419"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2310.09044","last_updated":"2023-10-13T12:12:34Z","snapshot_observed_at":"2026-07-06T16:32:27.303662Z","submitted_at":"2023-10-13T12:12:34Z","title":"KCTS: Knowledge-Constrained Tree Search Decoding with Token-Level Hallucination Detection","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.09044","snapshot_observed_at":"2026-08-06T16:09:04.122606Z","title":"DeepSeek-AI","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.14419","last_updated":"2025-07-19T00:28:10Z","snapshot_observed_at":"2026-08-07T09:54:31.530680Z","submitted_at":"2025-07-19T00:28:10Z","title":"It's Not That Simple. An Analysis of Simple Test-Time Scaling","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T16:09:04.122606Z"},"links":{"cited_paper":"/paper/2310.09044","citing_paper":"/paper/2507.14419"},"observation_digest":"sha256:4c92c51998ecb84df79cfdace0121e3aa07e9fe96d78652bd31a5411e60d715d","observation_id":"1616d673-4dd0-485b-985a-3085911dca6d","resolution":{"observed_at":"2026-08-06T16:09:04.122606Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-06T16:09:04.187424Z","title":"Xidong Feng, Ziyu Wan, Muning Wen, Stephen Marcus McAleer, Ying Wen, Weinan Zhang, and Jun Wang","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.14419","last_updated":"2025-07-19T00:28:10Z","snapshot_observed_at":"2026-08-07T09:54:31.530680Z","submitted_at":"2025-07-19T00:28:10Z","title":"It's Not That Simple. An Analysis of Simple Test-Time Scaling","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T16:09:04.187424Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2507.14419"},"observation_digest":"sha256:ff212807f9dd0d7f7a90a4ae911d1958cd5d65f18dfab3fee3edba707c0b3fac","observation_id":"5231d89a-6cc3-4559-b7ce-2cdb49bf5719","resolution":{"observed_at":"2026-08-06T16:09:04.187424Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17179","last_updated":"2024-02-09T00:13:46Z","snapshot_observed_at":"2026-07-06T16:25:25.534843Z","submitted_at":"2023-09-29T12:20:19Z","title":"Alphazero-like Tree-Search can Guide Large Language Model Decoding and Training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.17179","snapshot_observed_at":"2026-08-06T16:09:04.281051Z","title":"Kanishk Gandhi, Denise Lee, Gabriel Grand, Muxin Liu, Winson Cheng, Archit Sharma, and Noah D","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.14419","last_updated":"2025-07-19T00:28:10Z","snapshot_observed_at":"2026-08-07T09:54:31.530680Z","submitted_at":"2025-07-19T00:28:10Z","title":"It's Not That Simple. An Analysis of Simple Test-Time Scaling","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T16:09:04.281051Z"},"links":{"cited_paper":"/paper/2309.17179","citing_paper":"/paper/2507.14419"},"observation_digest":"sha256:c60d6a833375e25abbe9271964a1d2bea5b59b2a739b81c878073c2451adae66","observation_id":"2a39a040-6db1-4621-9b31-ed1e1b145f3a","resolution":{"observed_at":"2026-08-06T16:09:04.281051Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.03683","last_updated":"2024-04-01T06:50:52Z","snapshot_observed_at":"2026-08-06T11:34:00.528900Z","submitted_at":"2024-04-01T06:50:52Z","title":"Stream of Search (SoS): Learning to Search in Language","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.03683","snapshot_observed_at":"2026-08-06T16:09:04.402455Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.14419","last_updated":"2025-07-19T00:28:10Z","snapshot_observed_at":"2026-08-07T09:54:31.530680Z","submitted_at":"2025-07-19T00:28:10Z","title":"It's Not That Simple. An Analysis of Simple Test-Time Scaling","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T16:09:04.402455Z"},"links":{"cited_paper":"/paper/2404.03683","citing_paper":"/paper/2507.14419"},"observation_digest":"sha256:919d8ebdfb1384336171c0537e2a855c980818f72a98fcb4026344cdcad707bd","observation_id":"5bd1b6a5-fe47-4c10-9c4d-37b73e4d41e1","resolution":{"observed_at":"2026-08-06T16:09:04.402455Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:09:07.911596Z","title":"Accessed: 2025-03-26","venue":null,"work_id":"0fed443a-9315-4d2a-bcfb-9fc28fec29e6","year":2025},"citing_paper":{"arxiv_id":"2507.14419","last_updated":"2025-07-19T00:28:10Z","snapshot_observed_at":"2026-08-07T09:54:31.530680Z","submitted_at":"2025-07-19T00:28:10Z","title":"It's Not That Simple. An Analysis of Simple Test-Time Scaling","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T16:09:04.473476Z"},"links":{"citing_paper":"/paper/2507.14419"},"observation_digest":"sha256:337c81d49d7bf7fc007aac9dc2b0409c3eaad9bf0c9ae52a352fb21a9d798eca","observation_id":"3a7b2f06-1c87-4437-b501-b5ad243d8677","resolution":{"observed_at":"2026-08-06T16:09:08.002681Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.06135","last_updated":"2023-03-30T18:28:05Z","snapshot_observed_at":"2026-08-06T05:58:55.987794Z","submitted_at":"2023-03-10T18:53:52Z","title":"Rewarding Chatbots for Real-World Engagement with Millions of Users","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.06135","snapshot_observed_at":"2026-08-06T16:09:04.740135Z","title":"Carlos E Jimenez, John Yang, Alexander Wettig, Shunyu Yao, Kexin Pei, Ofir Press, and Karthik R Narasimhan","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.14419","last_updated":"2025-07-19T00:28:10Z","snapshot_observed_at":"2026-08-07T09:54:31.530680Z","submitted_at":"2025-07-19T00:28:10Z","title":"It's Not That Simple. An Analysis of Simple Test-Time Scaling","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T16:09:04.740135Z"},"links":{"cited_paper":"/paper/2303.06135","citing_paper":"/paper/2507.14419"},"observation_digest":"sha256:a2beffea64f495fda559e11277793f6a111576fa138f8004685b9473b1a8e97f","observation_id":"2b2eba29-5b23-454f-9ea9-301c316c0e1f","resolution":{"observed_at":"2026-08-06T16:09:04.740135Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12599","last_updated":"2025-06-03T02:14:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T02:48:14Z","title":"Kimi k1.5: Scaling Reinforcement Learning with LLMs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12599","snapshot_observed_at":"2026-08-06T16:09:04.830836Z","title":"Jiacheng Liu, Andrew Cohen, Ramakanth Pasunuru, Yejin Choi, Hannaneh Hajishirzi, and Asli Celikyilmaz","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.14419","last_updated":"2025-07-19T00:28:10Z","snapshot_observed_at":"2026-08-07T09:54:31.530680Z","submitted_at":"2025-07-19T00:28:10Z","title":"It's Not That Simple. An Analysis of Simple Test-Time Scaling","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T16:09:04.830836Z"},"links":{"cited_paper":"/paper/2501.12599","citing_paper":"/paper/2507.14419"},"observation_digest":"sha256:55b28da573a4e2cf296659104de9a299c634fc1c3f7e1a1b884b856c08b0dec7","observation_id":"8d5495d8-dcf5-49f1-a9b5-ad9236aa4942","resolution":{"observed_at":"2026-08-06T16:09:04.830836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.15028","last_updated":"2024-04-02T17:51:49Z","snapshot_observed_at":"2026-07-06T16:23:53.247204Z","submitted_at":"2023-09-26T15:57:57Z","title":"Don't throw away your value model! Generating more preferable text with Value-Guided Monte-Carlo Tree Search decoding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.15028","snapshot_observed_at":"2026-08-06T16:09:04.911668Z","title":"Michael Luo, Sijun Tan, Justin Wong, Xiaoxiang Shi, William Y","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.14419","last_updated":"2025-07-19T00:28:10Z","snapshot_observed_at":"2026-08-07T09:54:31.530680Z","submitted_at":"2025-07-19T00:28:10Z","title":"It's Not That Simple. An Analysis of Simple Test-Time Scaling","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T16:09:04.911668Z"},"links":{"cited_paper":"/paper/2309.15028","citing_paper":"/paper/2507.14419"},"observation_digest":"sha256:ec302ef394ee77ac357ab00df06b27f7f9ef985495267f57109d03155d63b532","observation_id":"dba945db-1dd1-4fc4-8e32-1c4c6db77b99","resolution":{"observed_at":"2026-08-06T16:09:04.911668Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.19393","last_updated":"2025-03-01T06:07:39Z","snapshot_observed_at":"2026-07-06T20:29:11.710285Z","submitted_at":"2025-01-31T18:48:08Z","title":"s1: Simple test-time scaling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.19393","snapshot_observed_at":"2026-08-06T16:09:05.062891Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.14419","last_updated":"2025-07-19T00:28:10Z","snapshot_observed_at":"2026-08-07T09:54:31.530680Z","submitted_at":"2025-07-19T00:28:10Z","title":"It's Not That Simple. An Analysis of Simple Test-Time Scaling","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T16:09:05.062891Z"},"links":{"cited_paper":"/paper/2501.19393","citing_paper":"/paper/2507.14419"},"observation_digest":"sha256:591f9f9f37ef3bffdf787beaabafee1f1cae19191ab135a640d3407fa894b1a3","observation_id":"e642f830-5024-48fb-a6d2-eeb6e5876820","resolution":{"observed_at":"2026-08-06T16:09:05.062891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.00114","last_updated":"2021-11-30T21:32:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-11-30T21:32:46Z","title":"Show Your Work: Scratchpads for Intermediate Computation with Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.00114","snapshot_observed_at":"2026-08-06T16:09:05.173663Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.14419","last_updated":"2025-07-19T00:28:10Z","snapshot_observed_at":"2026-08-07T09:54:31.530680Z","submitted_at":"2025-07-19T00:28:10Z","title":"It's Not That Simple. An Analysis of Simple Test-Time Scaling","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T16:09:05.173663Z"},"links":{"cited_paper":"/paper/2112.00114","citing_paper":"/paper/2507.14419"},"observation_digest":"sha256:181be23e499eca891b5b6dbb07cd1c6b87be599a703357b1971140b509dac2a8","observation_id":"8d851a03-0dea-4b3c-b7f1-b53a3a1975fb","resolution":{"observed_at":"2026-08-06T16:09:05.173663Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:09:07.741124Z","title":"Accessed: 2025-03-26","venue":null,"work_id":"5346094c-32c6-4151-bdb5-de07d9cd9c22","year":2025},"citing_paper":{"arxiv_id":"2507.14419","last_updated":"2025-07-19T00:28:10Z","snapshot_observed_at":"2026-08-07T09:54:31.530680Z","submitted_at":"2025-07-19T00:28:10Z","title":"It's Not That Simple. An Analysis of Simple Test-Time Scaling","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T16:09:05.313138Z"},"links":{"citing_paper":"/paper/2507.14419"},"observation_digest":"sha256:6fd5597b37470c9b022db423b541cd0bedf3e636b5c71343c562ad8f06f9fe91","observation_id":"425dbdef-37d9-4bce-8336-a06c7efbd413","resolution":{"observed_at":"2026-08-06T16:09:07.825754Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03314","last_updated":"2024-08-06T17:35:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-06T17:35:05Z","title":"Scaling LLM Test-Time Compute Optimally can be More Effective than Scaling Model Parameters","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.03314","snapshot_observed_at":"2026-08-06T16:09:05.450870Z","title":"Kaya Stechly, Matthew Marquez, and Subbarao Kambhampati","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.14419","last_updated":"2025-07-19T00:28:10Z","snapshot_observed_at":"2026-08-07T09:54:31.530680Z","submitted_at":"2025-07-19T00:28:10Z","title":"It's Not That Simple. An Analysis of Simple Test-Time Scaling","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T16:09:05.450870Z"},"links":{"cited_paper":"/paper/2408.03314","citing_paper":"/paper/2507.14419"},"observation_digest":"sha256:1079b851940fe8141b40c23ba4065c6175be515b4807d841c2e1480f481c3fde","observation_id":"9846710a-07a5-49e6-91e8-eee876a6c015","resolution":{"observed_at":"2026-08-06T16:09:05.450870Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.12397","last_updated":"2023-10-19T00:56:37Z","snapshot_observed_at":"2026-07-06T16:35:23.723152Z","submitted_at":"2023-10-19T00:56:37Z","title":"GPT-4 Doesn't Know It's Wrong: An Analysis of Iterative Prompting for Reasoning Problems","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.12397","snapshot_observed_at":"2026-08-06T16:09:05.621221Z","title":"Kaya Stechly, Karthik Valmeekam, and Subbarao Kambhampati","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.14419","last_updated":"2025-07-19T00:28:10Z","snapshot_observed_at":"2026-08-07T09:54:31.530680Z","submitted_at":"2025-07-19T00:28:10Z","title":"It's Not That Simple. An Analysis of Simple Test-Time Scaling","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T16:09:05.621221Z"},"links":{"cited_paper":"/paper/2310.12397","citing_paper":"/paper/2507.14419"},"observation_digest":"sha256:77dfac1c31086d0f2151a11ebeebffe1b9a3693d41b3df8a1fcdd7b6f6ef7120","observation_id":"e490b109-c17f-4cd5-a8c2-c1fc2c6ca889","resolution":{"observed_at":"2026-08-06T16:09:05.621221Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-06T16:09:05.727718Z","title":"Xuezhi Wang, Jason Wei, Dale Schuurmans, Quoc Le, Ed Chi, Sharan Narang, Aakanksha Chowdhery, and Denny Zhou","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.14419","last_updated":"2025-07-19T00:28:10Z","snapshot_observed_at":"2026-08-07T09:54:31.530680Z","submitted_at":"2025-07-19T00:28:10Z","title":"It's Not That Simple. An Analysis of Simple Test-Time Scaling","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T16:09:05.727718Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2507.14419"},"observation_digest":"sha256:50e4e6b6df02cea4146fa2468188fe667c6d654919f0c69e9a75acbddb1d56ec","observation_id":"13dce90c-d178-4a3d-af4b-f92c5057619c","resolution":{"observed_at":"2026-08-06T16:09:05.727718Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.11171","last_updated":"2023-03-07T17:57:37Z","snapshot_observed_at":"2026-07-06T12:50:22.773056Z","submitted_at":"2022-03-21T17:48:52Z","title":"Self-Consistency Improves Chain of Thought Reasoning in Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.11171","snapshot_observed_at":"2026-08-06T16:09:05.883911Z","title":"Yue Wang, Qiuzhi Liu, Jiahao Xu, Tian Liang, Xingyu Chen, Zhiwei He, Linfeng Song, Dian Yu, Juntao Li, Zhuosheng Zhang, Rui Wang, Zhaopeng Tu, Haitao Mi, and Dong Yu","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.14419","last_updated":"2025-07-19T00:28:10Z","snapshot_observed_at":"2026-08-07T09:54:31.530680Z","submitted_at":"2025-07-19T00:28:10Z","title":"It's Not That Simple. An Analysis of Simple Test-Time Scaling","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T16:09:05.883911Z"},"links":{"cited_paper":"/paper/2203.11171","citing_paper":"/paper/2507.14419"},"observation_digest":"sha256:cca9217beff2b2bc22c1a40733c68b9d5d23ada889ce35dfd4546b5ee7fc1781","observation_id":"2f697e7b-534d-47fd-8537-d7a287e2882e","resolution":{"observed_at":"2026-08-06T16:09:05.883911Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.18585","last_updated":"2025-02-18T16:51:53Z","snapshot_observed_at":"2026-07-06T20:28:33.378335Z","submitted_at":"2025-01-30T18:58:18Z","title":"Thoughts Are All Over the Place: On the Underthinking of o1-Like LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.18585","snapshot_observed_at":"2026-08-06T16:09:06.009237Z","title":"Jason Wei, Xuezhi Wang, Dale Schuurmans, Maarten Bosma, Brian Ichter, Fei Xia, Ed Chi, Quoc Le, and Denny Zhou","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.14419","last_updated":"2025-07-19T00:28:10Z","snapshot_observed_at":"2026-08-07T09:54:31.530680Z","submitted_at":"2025-07-19T00:28:10Z","title":"It's Not That Simple. An Analysis of Simple Test-Time Scaling","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T16:09:06.009237Z"},"links":{"cited_paper":"/paper/2501.18585","citing_paper":"/paper/2507.14419"},"observation_digest":"sha256:f5e83756346bed93d785e7633a99715b5c4b62d4b9f1bf233a1b404a137fd8c6","observation_id":"862812bc-f356-4f09-840b-3bab5c256cfe","resolution":{"observed_at":"2026-08-06T16:09:06.009237Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2201.11903","last_updated":"2023-01-10T23:07:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-01-28T02:33:07Z","title":"Chain-of-Thought Prompting Elicits Reasoning in Large Language Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.11903","snapshot_observed_at":"2026-08-06T16:09:06.171068Z","title":"Yangzhen Wu, Zhiqing Sun, Shanda Li, Sean Welleck, and Yiming Yang","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.14419","last_updated":"2025-07-19T00:28:10Z","snapshot_observed_at":"2026-08-07T09:54:31.530680Z","submitted_at":"2025-07-19T00:28:10Z","title":"It's Not That Simple. An Analysis of Simple Test-Time Scaling","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T16:09:06.171068Z"},"links":{"cited_paper":"/paper/2201.11903","citing_paper":"/paper/2507.14419"},"observation_digest":"sha256:e32e6f1911448d27c13a7215fb199b6126b5ffc33e0e180cd5df02faaeb34f46","observation_id":"0d24e271-2bb9-4483-b848-69cc9b7c9ff8","resolution":{"observed_at":"2026-08-06T16:09:06.171068Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00724","last_updated":"2025-03-03T07:53:32Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-01T17:16:04Z","title":"Inference Scaling Laws: An Empirical Analysis of Compute-Optimal Inference for Problem-Solving with Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00724","snapshot_observed_at":"2026-08-06T16:09:06.343306Z","title":"Yuxi Xie, Kenji Kawaguchi, Yiran Zhao, Xu Zhao, Min-Yen Kan, Junxian He, and Qizhe Xie","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.14419","last_updated":"2025-07-19T00:28:10Z","snapshot_observed_at":"2026-08-07T09:54:31.530680Z","submitted_at":"2025-07-19T00:28:10Z","title":"It's Not That Simple. An Analysis of Simple Test-Time Scaling","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T16:09:06.343306Z"},"links":{"cited_paper":"/paper/2408.00724","citing_paper":"/paper/2507.14419"},"observation_digest":"sha256:8d53ae08a29c0570fa47caba052e1c69a34bb772e0892b1bd8ffaff58d98726e","observation_id":"0585e424-feaf-4a11-a316-e6e23ca7574f","resolution":{"observed_at":"2026-08-06T16:09:06.343306Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.08152","last_updated":"2024-08-15T13:40:03Z","snapshot_observed_at":"2026-07-06T19:01:06.124684Z","submitted_at":"2024-08-15T13:40:03Z","title":"DeepSeek-Prover-V1.5: Harnessing Proof Assistant Feedback for Reinforcement Learning and Monte-Carlo Tree Search","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.08152","snapshot_observed_at":"2026-08-06T16:09:06.494941Z","title":"Yixin Ye, Zhen Huang, Yang Xiao, Ethan Chern, Shijie Xia, and Pengfei Liu","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.14419","last_updated":"2025-07-19T00:28:10Z","snapshot_observed_at":"2026-08-07T09:54:31.530680Z","submitted_at":"2025-07-19T00:28:10Z","title":"It's Not That Simple. An Analysis of Simple Test-Time Scaling","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T16:09:06.494941Z"},"links":{"cited_paper":"/paper/2408.08152","citing_paper":"/paper/2507.14419"},"observation_digest":"sha256:6b313813583629f7fe9aac4a159d6e3fb8debf48c5e1110b49e3116a79ca0e14","observation_id":"9c665c9f-b7e4-4dc8-8d47-e0efc2e95bb7","resolution":{"observed_at":"2026-08-06T16:09:06.494941Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03387","last_updated":"2025-07-29T16:23:02Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-05T17:23:45Z","title":"LIMO: Less is More for Reasoning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.03387","snapshot_observed_at":"2026-08-06T16:09:06.614864Z","title":"Edward Yeo, Yuxuan Tong, Morry Niu, Graham Neubig, and Xiang Yue","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.14419","last_updated":"2025-07-19T00:28:10Z","snapshot_observed_at":"2026-08-07T09:54:31.530680Z","submitted_at":"2025-07-19T00:28:10Z","title":"It's Not That Simple. An Analysis of Simple Test-Time Scaling","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T16:09:06.614864Z"},"links":{"cited_paper":"/paper/2502.03387","citing_paper":"/paper/2507.14419"},"observation_digest":"sha256:0d88c996c62b696ec677964a7bde005139332621879a28f6d4b5fb2698e37145","observation_id":"49d7a066-9c35-4052-b442-a4c847089f4f","resolution":{"observed_at":"2026-08-06T16:09:06.614864Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03373","last_updated":"2025-02-05T17:13:32Z","snapshot_observed_at":"2026-07-06T20:31:41.231839Z","submitted_at":"2025-02-05T17:13:32Z","title":"Demystifying Long Chain-of-Thought Reasoning in LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.03373","snapshot_observed_at":"2026-08-06T16:09:06.765738Z","title":"Weihao Zeng, Yuzhen Huang, Wei Liu, Keqing He, Qian Liu, Zejun Ma, and Junxian He","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.14419","last_updated":"2025-07-19T00:28:10Z","snapshot_observed_at":"2026-08-07T09:54:31.530680Z","submitted_at":"2025-07-19T00:28:10Z","title":"It's Not That Simple. An Analysis of Simple Test-Time Scaling","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T16:09:06.765738Z"},"links":{"cited_paper":"/paper/2502.03373","citing_paper":"/paper/2507.14419"},"observation_digest":"sha256:079c4736b865dc6b8b4604cf5a4b13934a926d00463294197c5a67c407ff36e0","observation_id":"2c04983f-9390-4f99-90d9-f94622b3c594","resolution":{"observed_at":"2026-08-06T16:09:06.765738Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.05510","last_updated":"2023-03-09T18:59:47Z","snapshot_observed_at":"2026-07-06T15:00:58.804337Z","submitted_at":"2023-03-09T18:59:47Z","title":"Planning with Large Language Models for Code Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.05510","snapshot_observed_at":"2026-08-06T16:09:06.934747Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.14419","last_updated":"2025-07-19T00:28:10Z","snapshot_observed_at":"2026-08-07T09:54:31.530680Z","submitted_at":"2025-07-19T00:28:10Z","title":"It's Not That Simple. An Analysis of Simple Test-Time Scaling","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T16:09:06.934747Z"},"links":{"cited_paper":"/paper/2303.05510","citing_paper":"/paper/2507.14419"},"observation_digest":"sha256:bbcd4561f4a919c2e58ee79b4be35188a2b23eb54ac9d755bbb15a2b0b0fdd37","observation_id":"bbdf5ee1-a7e9-4875-926d-c0dd4acb0659","resolution":{"observed_at":"2026-08-06T16:09:06.934747Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:09:08.115064Z","title":"Xingyu Chen, Jiahao Xu, Tian Liang, Zhiwei He, Jianhui Pang, Dian Yu, Linfeng Song, Qiuzhi Liu, Mengfei Zhou, Zhuosheng Zhang, Rui Wang, Zhaopeng Tu, Haitao Mi, and Dong Yu","venue":null,"work_id":"139e63f9-487f-45ad-a7d6-94ebfb2becfb","year":2020},"citing_paper":{"arxiv_id":"2507.14419","last_updated":"2025-07-19T00:28:10Z","snapshot_observed_at":"2026-08-07T09:54:31.530680Z","submitted_at":"2025-07-19T00:28:10Z","title":"It's Not That Simple. An Analysis of Simple Test-Time Scaling","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-06T16:09:04.026907Z"},"links":{"citing_paper":"/paper/2507.14419"},"observation_digest":"sha256:cc3280c2aa2dba8ab51969d7def487a157b14d1fede88f2e2b3ca86b53d2a15d","observation_id":"c9565a23-3c7d-4e6c-ad50-fe44218488f9","resolution":{"observed_at":"2026-08-06T16:09:08.245962Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2103.03874","last_updated":"2021-11-08T21:30:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-03-05T18:59:39Z","title":"Measuring Mathematical Problem Solving With the MATH Dataset","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.03874","snapshot_observed_at":"2026-08-06T16:09:04.605352Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.14419","last_updated":"2025-07-19T00:28:10Z","snapshot_observed_at":"2026-08-07T09:54:31.530680Z","submitted_at":"2025-07-19T00:28:10Z","title":"It's Not That Simple. An Analysis of Simple Test-Time Scaling","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-06T16:09:04.605352Z"},"links":{"cited_paper":"/paper/2103.03874","citing_paper":"/paper/2507.14419"},"observation_digest":"sha256:b7a702f49d077cf96748bbf4120aad9efb88e3e81c91d37016e03ff13b802239","observation_id":"b2ab9dd1-5f22-4f82-a79b-99d6b2e5e7bf","resolution":{"observed_at":"2026-08-06T16:09:04.605352Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16609","last_updated":"2023-09-28T17:07:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-28T17:07:49Z","title":"Qwen Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16609","snapshot_observed_at":"2026-08-06T16:09:03.858313Z","title":"Bradley Brown, Jordan Juravsky, Ryan Ehrlich, Ronald Clark, Quoc V","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.14419","last_updated":"2025-07-19T00:28:10Z","snapshot_observed_at":"2026-08-07T09:54:31.530680Z","submitted_at":"2025-07-19T00:28:10Z","title":"It's Not That Simple. An Analysis of Simple Test-Time Scaling","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-06T16:09:03.858313Z"},"links":{"cited_paper":"/paper/2309.16609","citing_paper":"/paper/2507.14419"},"observation_digest":"sha256:4b29d3978985649f9d33d69c20a39ae00fcd5a8857945481ac165466d820c3bb","observation_id":"1edf09c2-9f43-4316-8882-eeab12e7a859","resolution":{"observed_at":"2026-08-06T16:09:03.858313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-08-06T16:09:03.927810Z","title":null,"venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2507.14419","last_updated":"2025-07-19T00:28:10Z","snapshot_observed_at":"2026-08-07T09:54:31.530680Z","submitted_at":"2025-07-19T00:28:10Z","title":"It's Not That Simple. An Analysis of Simple Test-Time Scaling","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-06T16:09:03.927810Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2507.14419"},"observation_digest":"sha256:8b75d5a8753670c9562d056baea16147a45106d50cecb93a51d3245355c0a490","observation_id":"66639b2f-fa3d-478d-9316-11e70abed175","resolution":{"observed_at":"2026-08-06T16:09:03.927810Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.21187","last_updated":"2025-02-01T07:57:37Z","snapshot_observed_at":"2026-08-01T16:43:44.704797Z","submitted_at":"2024-12-30T18:55:12Z","title":"Do NOT Think That Much for 2+3=? On the Overthinking of o1-Like LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.21187","snapshot_observed_at":"2026-08-06T16:09:04.090730Z","title":"Sehyun Choi, Tianqing Fang, Zhaowei Wang, and Yangqiu Song","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.14419","last_updated":"2025-07-19T00:28:10Z","snapshot_observed_at":"2026-08-07T09:54:31.530680Z","submitted_at":"2025-07-19T00:28:10Z","title":"It's Not That Simple. An Analysis of Simple Test-Time Scaling","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-06T16:09:04.090730Z"},"links":{"cited_paper":"/paper/2412.21187","citing_paper":"/paper/2507.14419"},"observation_digest":"sha256:345fd98e4fd1bd3e4f4fc0c458b2699de1d40a8d9ed1bf510ecf8a951298331f","observation_id":"57540151-6150-408d-8677-2867d09389e4","resolution":{"observed_at":"2026-08-06T16:09:04.090730Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.14419","last_updated":"2025-07-19T00:28:10Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-07T09:54:31.530680Z","submitted_at":"2025-07-19T00:28:10Z","title":"It's Not That Simple. An Analysis of Simple Test-Time Scaling"},"reference_resolution":{"displayed":27,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":24,"verified_exact":0,"verified_fuzzy":3},"total_outbound_references":27},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 27 of 27 outbound references and 0 inbound Pith citation observations for arXiv:2507.14419."}