{"as_of":"2026-08-07T22:16:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:48b4cb98c73a225308a56bc9eb160589c289b34dae45333632754485732f3d6e","coverage":[{"denominator":20,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":20,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T14:43:53.459773Z","state":"measured"},{"denominator":20,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":20,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.18122/citation-record","integrity":"/paper/2507.18122/integrity","json":"/paper/2507.18122/citation-record.json","paper":"/paper/2507.18122"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.15134","last_updated":"2025-05-21T05:39:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-21T05:39:11Z","title":"The Unreasonable Effectiveness of Entropy Minimization in LLM Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.15134","snapshot_observed_at":"2026-08-06T14:43:52.327498Z","title":"The unreasonable effectiveness of entropy minimization in llm reasoning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.18122","last_updated":"2025-07-24T06:17:39Z","snapshot_observed_at":"2026-08-06T14:36:16.245142Z","submitted_at":"2025-07-24T06:17:39Z","title":"Maximizing Prefix-Confidence at Test-Time Efficiently Improves Mathematical Reasoning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T14:43:52.327498Z"},"links":{"cited_paper":"/paper/2505.15134","citing_paper":"/paper/2507.18122"},"observation_digest":"sha256:6ea062bcb502011d00e5c614339e11c9e7695a92973e08220d8d9ad0faff9f32","observation_id":"a15ac6c0-6e00-44c6-a210-91eb0c19da9c","resolution":{"observed_at":"2026-08-06T14:43:52.327498Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-06T14:43:52.552476Z","title":"Training verifiers to solve math word problems","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.18122","last_updated":"2025-07-24T06:17:39Z","snapshot_observed_at":"2026-08-06T14:36:16.245142Z","submitted_at":"2025-07-24T06:17:39Z","title":"Maximizing Prefix-Confidence at Test-Time Efficiently Improves Mathematical Reasoning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T14:43:52.552476Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2507.18122"},"observation_digest":"sha256:52d70799d8bd3de568fa57c9998c778b4cf84ee682ce8503840cff6e9f43428d","observation_id":"cfba05aa-50a3-4f52-af4f-a09d79aacc65","resolution":{"observed_at":"2026-08-06T14:43:52.552476Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.02875","last_updated":"2025-03-04T18:56:03Z","snapshot_observed_at":"2026-08-07T17:29:34.418079Z","submitted_at":"2025-03-04T18:56:03Z","title":"The First Few Tokens Are All You Need: An Efficient and Effective Unsupervised Prefix Fine-Tuning Method for Reasoning Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.02875","snapshot_observed_at":"2026-08-06T14:43:52.762807Z","title":"The first few tokens are all you need: An efficient and effective unsupervised prefix fine-tuning method for reasoning models.arXiv preprint arXiv:2503.02875,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.18122","last_updated":"2025-07-24T06:17:39Z","snapshot_observed_at":"2026-08-06T14:36:16.245142Z","submitted_at":"2025-07-24T06:17:39Z","title":"Maximizing Prefix-Confidence at Test-Time Efficiently Improves Mathematical Reasoning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T14:43:52.762807Z"},"links":{"cited_paper":"/paper/2503.02875","citing_paper":"/paper/2507.18122"},"observation_digest":"sha256:7bda05fb87971e1bf115631a1c3fcaad321510e1078328c2d83381d1857d7585","observation_id":"7f73b8d6-5b7a-4b5c-b1bf-4b822c840406","resolution":{"observed_at":"2026-08-06T14:43:52.762807Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:52.767584Z","title":"Scalable best-of-n selection for large language models via self-certainty","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.18122","last_updated":"2025-07-24T06:17:39Z","snapshot_observed_at":"2026-08-06T14:36:16.245142Z","submitted_at":"2025-07-24T06:17:39Z","title":"Maximizing Prefix-Confidence at Test-Time Efficiently Improves Mathematical Reasoning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T14:43:52.767584Z"},"links":{"citing_paper":"/paper/2507.18122"},"observation_digest":"sha256:2298827fc6f960779b3d04f481f242640489fc61a1e1f50d60ff1b88e4bc0ea5","observation_id":"97bdacca-4e0c-40f5-aade-522e854e6551","resolution":{"observed_at":"2026-08-06T14:43:52.767584Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:54.000964Z","title":"This is likely because we only ever perform few gradient steps on top of the base model, and thus catastrophic forgetting does not occur","venue":null,"work_id":"961adf22-0342-44a6-8641-067aef2d3cfc","year":2025},"citing_paper":{"arxiv_id":"2507.18122","last_updated":"2025-07-24T06:17:39Z","snapshot_observed_at":"2026-08-06T14:36:16.245142Z","submitted_at":"2025-07-24T06:17:39Z","title":"Maximizing Prefix-Confidence at Test-Time Efficiently Improves Mathematical Reasoning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T14:43:53.459773Z"},"links":{"citing_paper":"/paper/2507.18122"},"observation_digest":"sha256:36ffadcaec762d8471fc827fae753ded6dc35e5e693fcbe76e2caa38d2c6d7cb","observation_id":"42b667d2-358f-497d-b686-0e1928dc395a","resolution":{"observed_at":"2026-08-06T14:43:54.007293Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.06395","last_updated":"2025-06-11T06:21:59Z","snapshot_observed_at":"2026-08-07T10:14:35.703733Z","submitted_at":"2025-06-05T19:55:15Z","title":"Confidence Is All You Need: Few-Shot RL Fine-Tuning of Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.06395","snapshot_observed_at":"2026-08-06T14:43:52.966250Z","title":"Confidence is all you need: Few-shot rl fine-tuning of language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.18122","last_updated":"2025-07-24T06:17:39Z","snapshot_observed_at":"2026-08-06T14:36:16.245142Z","submitted_at":"2025-07-24T06:17:39Z","title":"Maximizing Prefix-Confidence at Test-Time Efficiently Improves Mathematical Reasoning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T14:43:52.966250Z"},"links":{"cited_paper":"/paper/2506.06395","citing_paper":"/paper/2507.18122"},"observation_digest":"sha256:52ab26c6027012387947f31956c4e4c38ce5231acb1cee94ca5c69887344f839","observation_id":"bfc426df-37f3-4055-877d-698b692486d3","resolution":{"observed_at":"2026-08-06T14:43:52.966250Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.22660","last_updated":"2025-06-27T17:25:28Z","snapshot_observed_at":"2026-08-07T12:59:59.342982Z","submitted_at":"2025-05-28T17:59:37Z","title":"Maximizing Confidence Alone Improves Reasoning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.22660","snapshot_observed_at":"2026-08-06T14:43:53.050703Z","title":"Maximizing confidence alone improves reasoning.arXiv preprint arXiv:2505.22660,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.18122","last_updated":"2025-07-24T06:17:39Z","snapshot_observed_at":"2026-08-06T14:36:16.245142Z","submitted_at":"2025-07-24T06:17:39Z","title":"Maximizing Prefix-Confidence at Test-Time Efficiently Improves Mathematical Reasoning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T14:43:53.050703Z"},"links":{"cited_paper":"/paper/2505.22660","citing_paper":"/paper/2507.18122"},"observation_digest":"sha256:a5f8264fbbe2539056e8d0f9526922e3e12ee4ddcadfb0afdb07118a0f4513cb","observation_id":"7674c89e-55f4-45ef-843d-a13a5366a41c","resolution":{"observed_at":"2026-08-06T14:43:53.050703Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.13351","last_updated":"2026-05-07T20:19:13Z","snapshot_observed_at":"2026-07-31T17:48:52.945760Z","submitted_at":"2025-06-16T10:43:38Z","title":"Direct Reasoning Optimization: Token-Level Reasoning Reflectivity Meets Rubric Gates for Unverifiable Tasks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.13351","snapshot_observed_at":"2026-08-06T14:43:53.202824Z","title":"Direct reasoning optimization: Llms can reward and refine their own reasoning for open-ended tasks","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.18122","last_updated":"2025-07-24T06:17:39Z","snapshot_observed_at":"2026-08-06T14:36:16.245142Z","submitted_at":"2025-07-24T06:17:39Z","title":"Maximizing Prefix-Confidence at Test-Time Efficiently Improves Mathematical Reasoning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T14:43:53.202824Z"},"links":{"cited_paper":"/paper/2506.13351","citing_paper":"/paper/2507.18122"},"observation_digest":"sha256:634deec02996b7d9fcf49b08aacce974d6257474cc72c879cad01973df5b796e","observation_id":"c8e74a0b-eb49-4bc3-8944-0735c0ff6bcf","resolution":{"observed_at":"2026-08-06T14:43:53.202824Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12122","last_updated":"2024-09-18T16:45:37Z","snapshot_observed_at":"2026-07-06T19:17:41.512834Z","submitted_at":"2024-09-18T16:45:37Z","title":"Qwen2.5-Math Technical Report: Toward Mathematical Expert Model via Self-Improvement","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12122","snapshot_observed_at":"2026-08-06T14:43:53.286899Z","title":"Qwen2.5-math technical report: Toward mathematical expert model via self-improvement","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.18122","last_updated":"2025-07-24T06:17:39Z","snapshot_observed_at":"2026-08-06T14:36:16.245142Z","submitted_at":"2025-07-24T06:17:39Z","title":"Maximizing Prefix-Confidence at Test-Time Efficiently Improves Mathematical Reasoning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T14:43:53.286899Z"},"links":{"cited_paper":"/paper/2409.12122","citing_paper":"/paper/2507.18122"},"observation_digest":"sha256:99bd0665f71d75ba01f6dc89e857d6577ac196c62340b5af395a77e6a1e3f99d","observation_id":"7b8425a9-9ec3-4a30-bb7f-dd8adec0dc74","resolution":{"observed_at":"2026-08-06T14:43:53.286899Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.03335","last_updated":"2025-10-16T08:23:36Z","snapshot_observed_at":"2026-07-06T21:19:34.329442Z","submitted_at":"2025-05-06T09:08:00Z","title":"Absolute Zero: Reinforced Self-play Reasoning with Zero Data","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.03335","snapshot_observed_at":"2026-08-06T14:43:53.345503Z","title":"Absolute zero: Reinforced self-play reasoning with zero data","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.18122","last_updated":"2025-07-24T06:17:39Z","snapshot_observed_at":"2026-08-06T14:36:16.245142Z","submitted_at":"2025-07-24T06:17:39Z","title":"Maximizing Prefix-Confidence at Test-Time Efficiently Improves Mathematical Reasoning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T14:43:53.345503Z"},"links":{"cited_paper":"/paper/2505.03335","citing_paper":"/paper/2507.18122"},"observation_digest":"sha256:1086a5d7befff71560de15700ad96b805baaaa1ae9be11ce3ec4309138ae24ad","observation_id":"27fc7542-72c9-4dd0-94a4-291aacb9c434","resolution":{"observed_at":"2026-08-06T14:43:53.345503Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:53.446619Z","title":"Self-adapting language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.18122","last_updated":"2025-07-24T06:17:39Z","snapshot_observed_at":"2026-08-06T14:36:16.245142Z","submitted_at":"2025-07-24T06:17:39Z","title":"Maximizing Prefix-Confidence at Test-Time Efficiently Improves Mathematical Reasoning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T14:43:53.446619Z"},"links":{"citing_paper":"/paper/2507.18122"},"observation_digest":"sha256:47d794374f357af9340b6096eae738088751cbe202d4e2a52e2516e3bc1d8a24","observation_id":"acdc95ec-eef2-4b19-8106-6f28a91c8166","resolution":{"observed_at":"2026-08-06T14:43:53.446619Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:54.039283Z","title":"A Additional Confidence Measures • Negative entropy (token-level) − 1 n ∑n i=1 H(π(yi | x, y<i)) =− 1 n ∑n i=1 ∑V j=1 π(yi = j | x, y<i) log π(yi = j | x, y<i)","venue":null,"work_id":"ccafc9ac-7d66-4d98-ac2f-59d5c7d2cbd1","year":2025},"citing_paper":{"arxiv_id":"2507.18122","last_updated":"2025-07-24T06:17:39Z","snapshot_observed_at":"2026-08-06T14:36:16.245142Z","submitted_at":"2025-07-24T06:17:39Z","title":"Maximizing Prefix-Confidence at Test-Time Efficiently Improves Mathematical Reasoning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T14:43:53.450939Z"},"links":{"citing_paper":"/paper/2507.18122"},"observation_digest":"sha256:aface7edc986d1cf0cf738331977aa613bfa52617e5da29a03668295304352aa","observation_id":"31f970a2-3cf1-41c7-8c0b-f3ef5babd73a","resolution":{"observed_at":"2026-08-06T14:43:54.045748Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:54.019101Z","title":"Since the SGD optimizer uses less memory and compute, we continued using SGD for the rest of the experiments","venue":null,"work_id":"556fd8d7-3cc4-4a6b-96b9-ae7f901aac14","year":2025},"citing_paper":{"arxiv_id":"2507.18122","last_updated":"2025-07-24T06:17:39Z","snapshot_observed_at":"2026-08-06T14:36:16.245142Z","submitted_at":"2025-07-24T06:17:39Z","title":"Maximizing Prefix-Confidence at Test-Time Efficiently Improves Mathematical Reasoning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T14:43:53.455364Z"},"links":{"citing_paper":"/paper/2507.18122"},"observation_digest":"sha256:2cdb34b15ebfb7fa74989f0de05b654449daf5cd7d7972881c782bcbad14c135","observation_id":"77d7fea7-9e0b-4014-ba66-8eefbc581c99","resolution":{"observed_at":"2026-08-06T14:43:54.024139Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:43:54.057764Z","title":"Dynamic evaluation of neural sequence models","venue":null,"work_id":"b7fd611a-f0dd-4d83-836e-1f2de45b71bb","year":2025},"citing_paper":{"arxiv_id":"2507.18122","last_updated":"2025-07-24T06:17:39Z","snapshot_observed_at":"2026-08-06T14:36:16.245142Z","submitted_at":"2025-07-24T06:17:39Z","title":"Maximizing Prefix-Confidence at Test-Time Efficiently Improves Mathematical Reasoning","version":1},"reference_index":2015,"source":"pdf_text","source_observed_at":"2026-08-06T14:43:52.780354Z"},"links":{"citing_paper":"/paper/2507.18122"},"observation_digest":"sha256:51396cf399fc4dc8b7c01afc03b2b2ff84bdc6c4bf26cd6fd0ccf0df72dc9319","observation_id":"d9fb6dec-c749-409a-a738-dfbb35ae1374","resolution":{"observed_at":"2026-08-06T14:43:54.062319Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1904.08378","last_updated":"2019-04-17T17:26:01Z","snapshot_observed_at":"2026-08-05T20:05:19.093291Z","submitted_at":"2019-04-17T17:26:01Z","title":"Dynamic Evaluation of Transformer Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.08378","snapshot_observed_at":"2026-08-06T14:43:52.841235Z","title":"Dynamic evaluation of transformer language models","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"2507.18122","last_updated":"2025-07-24T06:17:39Z","snapshot_observed_at":"2026-08-06T14:36:16.245142Z","submitted_at":"2025-07-24T06:17:39Z","title":"Maximizing Prefix-Confidence at Test-Time Efficiently Improves Mathematical Reasoning","version":1},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-06T14:43:52.841235Z"},"links":{"cited_paper":"/paper/1904.08378","citing_paper":"/paper/2507.18122"},"observation_digest":"sha256:0056fd40eefa2c9c16282756ab3797bd6cdebe3627d8d99fa2fc9740febd4b22","observation_id":"8bea7096-5765-490a-b22e-fa3868e39214","resolution":{"observed_at":"2026-08-06T14:43:52.841235Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01612","last_updated":"2025-02-13T05:32:54Z","snapshot_observed_at":"2026-07-06T20:30:26.881629Z","submitted_at":"2025-02-03T18:45:22Z","title":"Self-Improving Transformers Overcome Easy-to-Hard and Length Generalization Challenges","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.01612","snapshot_observed_at":"2026-08-06T14:43:52.912793Z","title":"Self-improving transformers overcome easy-to-hard and length generalization challenges","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.18122","last_updated":"2025-07-24T06:17:39Z","snapshot_observed_at":"2026-08-06T14:36:16.245142Z","submitted_at":"2025-07-24T06:17:39Z","title":"Maximizing Prefix-Confidence at Test-Time Efficiently Improves Mathematical Reasoning","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-06T14:43:52.912793Z"},"links":{"cited_paper":"/paper/2502.01612","citing_paper":"/paper/2507.18122"},"observation_digest":"sha256:b34d4c71e01d29f01f1c5bf7ef782e6271e857cbb79154955901b19118d14290","observation_id":"01bcdfc3-ed00-44d6-a6c4-7d5a244f1fd2","resolution":{"observed_at":"2026-08-06T14:43:52.912793Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.04620","last_updated":"2025-08-31T18:32:59Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-07-05T16:23:20Z","title":"Learning to (Learn at Test Time): RNNs with Expressive Hidden States","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.04620","snapshot_observed_at":"2026-08-06T14:43:53.124912Z","title":"Learning to (learn at test time): Rnns with expressive hidden states","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.18122","last_updated":"2025-07-24T06:17:39Z","snapshot_observed_at":"2026-08-06T14:36:16.245142Z","submitted_at":"2025-07-24T06:17:39Z","title":"Maximizing Prefix-Confidence at Test-Time Efficiently Improves Mathematical Reasoning","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-06T14:43:53.124912Z"},"links":{"cited_paper":"/paper/2407.04620","citing_paper":"/paper/2507.18122"},"observation_digest":"sha256:2aefae18d4f905144240af06b6e1d98f2464ea014863c5c4672fe2e342575671","observation_id":"56935697-518f-45f0-baba-7c650617d06e","resolution":{"observed_at":"2026-08-06T14:43:53.124912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.05298","last_updated":"2025-04-07T17:56:31Z","snapshot_observed_at":"2026-08-07T16:07:51.376018Z","submitted_at":"2025-04-07T17:56:31Z","title":"One-Minute Video Generation with Test-Time Training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.05298","snapshot_observed_at":"2026-08-06T14:43:52.690948Z","title":"One-minute video generation with test-time training","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.18122","last_updated":"2025-07-24T06:17:39Z","snapshot_observed_at":"2026-08-06T14:36:16.245142Z","submitted_at":"2025-07-24T06:17:39Z","title":"Maximizing Prefix-Confidence at Test-Time Efficiently Improves Mathematical Reasoning","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-06T14:43:52.690948Z"},"links":{"cited_paper":"/paper/2504.05298","citing_paper":"/paper/2507.18122"},"observation_digest":"sha256:f94733f75db689e4bea50c4c0516d90ebe35b0dd51207ab9a71fe3522131a631","observation_id":"792599a0-d512-40dc-aea2-acf4974531e8","resolution":{"observed_at":"2026-08-06T14:43:52.690948Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.05812","last_updated":"2025-05-18T13:41:33Z","snapshot_observed_at":"2026-08-07T16:07:37.899880Z","submitted_at":"2025-04-08T08:48:51Z","title":"Right Question is Already Half the Answer: Fully Unsupervised LLM Reasoning Incentivization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.05812","snapshot_observed_at":"2026-08-06T14:43:53.296475Z","title":"Right question is already half the answer: Fully unsupervised llm reasoning incentivization","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.18122","last_updated":"2025-07-24T06:17:39Z","snapshot_observed_at":"2026-08-06T14:36:16.245142Z","submitted_at":"2025-07-24T06:17:39Z","title":"Maximizing Prefix-Confidence at Test-Time Efficiently Improves Mathematical Reasoning","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-06T14:43:53.296475Z"},"links":{"cited_paper":"/paper/2504.05812","citing_paper":"/paper/2507.18122"},"observation_digest":"sha256:cbc720b5085737b6b9413ff30035eba692279af163a9e914f6e5a90e76f14886","observation_id":"f4ab2f1a-28d1-45fc-9b71-6c201380e3f5","resolution":{"observed_at":"2026-08-06T14:43:53.296475Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14136","last_updated":"2025-07-30T13:53:32Z","snapshot_observed_at":"2026-08-07T15:37:27.738096Z","submitted_at":"2025-05-20T09:39:54Z","title":"Local Mixtures of Experts: Essentially Free Test-Time Training via Model Merging","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.14136","snapshot_observed_at":"2026-08-06T14:43:52.414007Z","title":"Local mixtures of experts: Essentially free test-time training via model merging","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.18122","last_updated":"2025-07-24T06:17:39Z","snapshot_observed_at":"2026-08-06T14:36:16.245142Z","submitted_at":"2025-07-24T06:17:39Z","title":"Maximizing Prefix-Confidence at Test-Time Efficiently Improves Mathematical Reasoning","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-06T14:43:52.414007Z"},"links":{"cited_paper":"/paper/2505.14136","citing_paper":"/paper/2507.18122"},"observation_digest":"sha256:267d8d530b1026a9d9336e3a7292fbd8dc033bf1148e89f49c7302fbc843466b","observation_id":"b2ec1165-c56b-4de8-86c4-693909690b61","resolution":{"observed_at":"2026-08-06T14:43:52.414007Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.18122","last_updated":"2025-07-24T06:17:39Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-06T14:36:16.245142Z","submitted_at":"2025-07-24T06:17:39Z","title":"Maximizing Prefix-Confidence at Test-Time Efficiently Improves Mathematical Reasoning"},"reference_resolution":{"displayed":20,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":16,"verified_exact":0,"verified_fuzzy":4},"total_outbound_references":20},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 20 of 20 outbound references and 0 inbound Pith citation observations for arXiv:2507.18122."}