{"as_of":"2026-08-07T18:02:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a9c4257373de97ef878edbfee727fb6933fd9edcb4876830c497d51b6054c3a4","coverage":[{"denominator":36,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":36,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T23:00:46.016123Z","state":"measured"},{"denominator":39,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":39,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T22:25:54.860141Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T08:09:40.738273Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.20160","last_updated":"2025-08-08T09:23:42Z","snapshot_observed_at":"2026-08-06T22:52:54.526678Z","submitted_at":"2025-06-25T06:29:18Z","title":"AALC: Large Language Model Efficient Reasoning via Adaptive Accuracy-Length Control","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.20160","snapshot_observed_at":"2026-08-04T22:25:54.860141Z","title":"Aalc: Large language model efficient reasoning via adaptive accuracy-length control.ArXiv, abs/2506.20160, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.07339","last_updated":"2025-09-09T02:31:16Z","snapshot_observed_at":"2026-08-06T03:19:26.122470Z","submitted_at":"2025-09-09T02:31:16Z","title":"Performative Thinking? The Brittle Correlation Between CoT Length and Problem Complexity","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-04T22:25:54.860141Z"},"links":{"cited_paper":"/paper/2506.20160","citing_paper":"/paper/2509.07339"},"observation_digest":"sha256:3c8b22f083f791929addd98c1dce298695741ca336a7cdeb26e4df96644e5362","observation_id":"6de193bf-8222-4a06-9f53-3ac1ecdb7cc1","resolution":{"observed_at":"2026-08-04T22:25:54.860141Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.20160","last_updated":"2025-08-08T09:23:42Z","snapshot_observed_at":"2026-08-06T22:52:54.526678Z","submitted_at":"2025-06-25T06:29:18Z","title":"AALC: Large Language Model Efficient Reasoning via Adaptive Accuracy-Length Control","version":2},"cited_work":{"arxiv_id":"2506.20160","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.20160","snapshot_observed_at":"2026-07-04T08:09:40.738273Z","title":"Aalc: Large language model efficient reasoning via adaptive accuracy-length control","venue":null,"work_id":"899bfd26-fd51-4013-a4ba-dde51db36f97","year":2025},"citing_paper":{"arxiv_id":"2605.22211","last_updated":"2026-05-21T09:16:27Z","snapshot_observed_at":"2026-07-06T23:32:35.159280Z","submitted_at":"2026-05-21T09:16:27Z","title":"CLORE: Content-Level Optimization for Reasoning Efficiency","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-22T05:50:23.111591Z"},"links":{"cited_paper":"/paper/2506.20160","citing_paper":"/paper/2605.22211"},"observation_digest":"sha256:ae57f56ca549af11917177b715eff821436c349870c9e00bda1509793db79945","observation_id":"5d88afe3-db78-4c7c-8106-7475dddf4cd3","resolution":{"observed_at":"2026-05-22T05:51:08.318894Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.20160","last_updated":"2025-08-08T09:23:42Z","snapshot_observed_at":"2026-08-06T22:52:54.526678Z","submitted_at":"2025-06-25T06:29:18Z","title":"AALC: Large Language Model Efficient Reasoning via Adaptive Accuracy-Length Control","version":2},"cited_work":{"arxiv_id":"2506.20160","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.20160","snapshot_observed_at":"2026-07-04T08:09:40.738273Z","title":"Aalc: Large language model efficient reasoning via adaptive accuracy-length control","venue":null,"work_id":"899bfd26-fd51-4013-a4ba-dde51db36f97","year":2025},"citing_paper":{"arxiv_id":"2606.21943","last_updated":"2026-06-20T08:20:41Z","snapshot_observed_at":"2026-07-06T23:56:54.959593Z","submitted_at":"2026-06-20T08:20:41Z","title":"Modularized Reinforcement Learning on LLMs: From MDP Creation to Exploration and Learning","version":1},"reference_index":104,"source":"pdf_text","source_observed_at":"2026-06-26T12:15:08.304150Z"},"links":{"cited_paper":"/paper/2506.20160","citing_paper":"/paper/2606.21943"},"observation_digest":"sha256:ea26e4ab09ad7df406bf9c9a8ecbad6f8609f5dc1b757c7331b11b47a1d297ce","observation_id":"f950d19c-89b2-4864-acdf-d5e68e676675","resolution":{"observed_at":"2026-07-04T08:09:40.739876Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.20160/citation-record","integrity":"/paper/2506.20160/integrity","json":"/paper/2506.20160/citation-record.json","paper":"/paper/2506.20160"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2503.04697","last_updated":"2025-10-03T01:55:58Z","snapshot_observed_at":"2026-08-06T08:53:09.095000Z","submitted_at":"2025-03-06T18:43:29Z","title":"L1: Controlling How Long A Reasoning Model Thinks With Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.04697","snapshot_observed_at":"2026-08-06T23:00:45.896824Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.20160","last_updated":"2025-08-08T09:23:42Z","snapshot_observed_at":"2026-08-06T22:52:54.526678Z","submitted_at":"2025-06-25T06:29:18Z","title":"AALC: Large Language Model Efficient Reasoning via Adaptive Accuracy-Length Control","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-06T23:00:45.896824Z"},"links":{"cited_paper":"/paper/2503.04697","citing_paper":"/paper/2506.20160"},"observation_digest":"sha256:b74af83d670b64023e6c67813ac77fba659e20d2372d98cd489a7016c751786c","observation_id":"028d8f70-57d9-4559-8059-0b3590c47a08","resolution":{"observed_at":"2026-08-06T23:00:45.896824Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:00:45.900579Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.20160","last_updated":"2025-08-08T09:23:42Z","snapshot_observed_at":"2026-08-06T22:52:54.526678Z","submitted_at":"2025-06-25T06:29:18Z","title":"AALC: Large Language Model Efficient Reasoning via Adaptive Accuracy-Length Control","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-06T23:00:45.900579Z"},"links":{"citing_paper":"/paper/2506.20160"},"observation_digest":"sha256:ac7c76ddcaf7c6664400ad8523799568c282eb23e743e3cee019d44dfd987227","observation_id":"2c51a3ec-deff-414c-8709-9a28cb4b9e15","resolution":{"observed_at":"2026-08-06T23:00:45.900579Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.21187","last_updated":"2025-02-01T07:57:37Z","snapshot_observed_at":"2026-08-01T16:43:44.704797Z","submitted_at":"2024-12-30T18:55:12Z","title":"Do NOT Think That Much for 2+3=? On the Overthinking of o1-Like LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.21187","snapshot_observed_at":"2026-08-06T23:00:45.903761Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.20160","last_updated":"2025-08-08T09:23:42Z","snapshot_observed_at":"2026-08-06T22:52:54.526678Z","submitted_at":"2025-06-25T06:29:18Z","title":"AALC: Large Language Model Efficient Reasoning via Adaptive Accuracy-Length Control","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-06T23:00:45.903761Z"},"links":{"cited_paper":"/paper/2412.21187","citing_paper":"/paper/2506.20160"},"observation_digest":"sha256:a8913bd2b4e1c1a78f7bd3e14f7b7505ae1002ada16890df3c2b459366981e23","observation_id":"ae850b0c-3698-4c75-9a6d-d80d830f0df4","resolution":{"observed_at":"2026-08-06T23:00:45.903761Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-06T23:00:45.908171Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.20160","last_updated":"2025-08-08T09:23:42Z","snapshot_observed_at":"2026-08-06T22:52:54.526678Z","submitted_at":"2025-06-25T06:29:18Z","title":"AALC: Large Language Model Efficient Reasoning via Adaptive Accuracy-Length Control","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-06T23:00:45.908171Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2506.20160"},"observation_digest":"sha256:bed0c5b7363bcb093844be5f057ce62c256cf9f3498d73465baf3b94c2c9f13e","observation_id":"fa7b49d4-7307-44d6-beb0-a94e6a2634d7","resolution":{"observed_at":"2026-08-06T23:00:45.908171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.16235","last_updated":"2025-02-27T06:39:06Z","snapshot_observed_at":"2026-08-07T17:56:27.359357Z","submitted_at":"2025-02-22T14:13:37Z","title":"Dynamic Parallel Tree Search for Efficient LLM Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.16235","snapshot_observed_at":"2026-08-06T23:00:45.915401Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.20160","last_updated":"2025-08-08T09:23:42Z","snapshot_observed_at":"2026-08-06T22:52:54.526678Z","submitted_at":"2025-06-25T06:29:18Z","title":"AALC: Large Language Model Efficient Reasoning via Adaptive Accuracy-Length Control","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-06T23:00:45.915401Z"},"links":{"cited_paper":"/paper/2502.16235","citing_paper":"/paper/2506.20160"},"observation_digest":"sha256:41dbc3de5b2255ae63ad6746c04aa4a3a14dcafb0bac3739fd544e83d80c4a09","observation_id":"ad293dbc-b6e4-4eeb-b56f-d774d25b3502","resolution":{"observed_at":"2026-08-06T23:00:45.915401Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01307","last_updated":"2025-08-15T15:21:46Z","snapshot_observed_at":"2026-07-06T20:45:32.493589Z","submitted_at":"2025-03-03T08:46:22Z","title":"Cognitive Behaviors that Enable Self-Improving Reasoners, or, Four Habits of Highly Effective STaRs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.01307","snapshot_observed_at":"2026-08-06T23:00:45.919023Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.20160","last_updated":"2025-08-08T09:23:42Z","snapshot_observed_at":"2026-08-06T22:52:54.526678Z","submitted_at":"2025-06-25T06:29:18Z","title":"AALC: Large Language Model Efficient Reasoning via Adaptive Accuracy-Length Control","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-06T23:00:45.919023Z"},"links":{"cited_paper":"/paper/2503.01307","citing_paper":"/paper/2506.20160"},"observation_digest":"sha256:d3b56fc9381457f68514ecf1bf00348e11f51b2716950212e14f3427186c2cba","observation_id":"82a1a69e-fe1b-4351-b3a5-b337fe4eedd5","resolution":{"observed_at":"2026-08-06T23:00:45.919023Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.03683","last_updated":"2024-04-01T06:50:52Z","snapshot_observed_at":"2026-08-06T11:34:00.528900Z","submitted_at":"2024-04-01T06:50:52Z","title":"Stream of Search (SoS): Learning to Search in Language","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.03683","snapshot_observed_at":"2026-08-06T23:00:45.922750Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.20160","last_updated":"2025-08-08T09:23:42Z","snapshot_observed_at":"2026-08-06T22:52:54.526678Z","submitted_at":"2025-06-25T06:29:18Z","title":"AALC: Large Language Model Efficient Reasoning via Adaptive Accuracy-Length Control","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-06T23:00:45.922750Z"},"links":{"cited_paper":"/paper/2404.03683","citing_paper":"/paper/2506.20160"},"observation_digest":"sha256:2ee4dfceaa56c67db4227a9d8e89ce8aa26eb3681ac4c7e25c6461671da614d8","observation_id":"53017cde-e94e-400d-b014-c230cbbd76ed","resolution":{"observed_at":"2026-08-06T23:00:45.922750Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-06T23:00:45.926589Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.20160","last_updated":"2025-08-08T09:23:42Z","snapshot_observed_at":"2026-08-06T22:52:54.526678Z","submitted_at":"2025-06-25T06:29:18Z","title":"AALC: Large Language Model Efficient Reasoning via Adaptive Accuracy-Length Control","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-06T23:00:45.926589Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2506.20160"},"observation_digest":"sha256:38407aea85b1374bedd181b37c9c6fd484d3953c6b4f0dde4efdf44b4faee658","observation_id":"448dc033-1c61-429f-ba42-057fddb0a7a2","resolution":{"observed_at":"2026-08-06T23:00:45.926589Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18547","last_updated":"2025-06-02T00:44:09Z","snapshot_observed_at":"2026-08-05T13:27:46.877171Z","submitted_at":"2024-12-24T16:55:45Z","title":"Token-Budget-Aware LLM Reasoning","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.18547","snapshot_observed_at":"2026-08-06T23:00:45.930316Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.20160","last_updated":"2025-08-08T09:23:42Z","snapshot_observed_at":"2026-08-06T22:52:54.526678Z","submitted_at":"2025-06-25T06:29:18Z","title":"AALC: Large Language Model Efficient Reasoning via Adaptive Accuracy-Length Control","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-06T23:00:45.930316Z"},"links":{"cited_paper":"/paper/2412.18547","citing_paper":"/paper/2506.20160"},"observation_digest":"sha256:f1b88212cd5bee5ad97fe597596736a3c9e34f5e2ad02dab031b922583d79b95","observation_id":"60c79c20-6b7c-400e-b27d-7e8872c995d6","resolution":{"observed_at":"2026-08-06T23:00:45.930316Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06769","last_updated":"2025-11-03T00:53:34Z","snapshot_observed_at":"2026-08-07T06:05:27.895209Z","submitted_at":"2024-12-09T18:55:56Z","title":"Training Large Language Models to Reason in a Continuous Latent Space","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.06769","snapshot_observed_at":"2026-08-06T23:00:45.933807Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.20160","last_updated":"2025-08-08T09:23:42Z","snapshot_observed_at":"2026-08-06T22:52:54.526678Z","submitted_at":"2025-06-25T06:29:18Z","title":"AALC: Large Language Model Efficient Reasoning via Adaptive Accuracy-Length Control","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-06T23:00:45.933807Z"},"links":{"cited_paper":"/paper/2412.06769","citing_paper":"/paper/2506.20160"},"observation_digest":"sha256:b721e4191f1e136d9e7877d532ee4603cca3eea940937ffff7f389c90cc07710","observation_id":"e4b8a9b6-6ee3-44a8-bc64-b4d5b7b7564a","resolution":{"observed_at":"2026-08-06T23:00:45.933807Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.03874","last_updated":"2021-11-08T21:30:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-03-05T18:59:39Z","title":"Measuring Mathematical Problem Solving With the MATH Dataset","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.03874","snapshot_observed_at":"2026-08-06T23:00:45.937187Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.20160","last_updated":"2025-08-08T09:23:42Z","snapshot_observed_at":"2026-08-06T22:52:54.526678Z","submitted_at":"2025-06-25T06:29:18Z","title":"AALC: Large Language Model Efficient Reasoning via Adaptive Accuracy-Length Control","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-06T23:00:45.937187Z"},"links":{"cited_paper":"/paper/2103.03874","citing_paper":"/paper/2506.20160"},"observation_digest":"sha256:55af31f5e98bd2f5daf4d65c871958a6deb0c01cca183033886916062b7fdc5e","observation_id":"216f8985-8b3c-4d77-b1e9-733e96516dae","resolution":{"observed_at":"2026-08-06T23:00:45.937187Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.00031","last_updated":"2025-02-25T00:21:14Z","snapshot_observed_at":"2026-08-07T17:51:38.471379Z","submitted_at":"2025-02-25T00:21:14Z","title":"Efficient Test-Time Scaling via Self-Calibration","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.00031","snapshot_observed_at":"2026-08-06T23:00:45.940404Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.20160","last_updated":"2025-08-08T09:23:42Z","snapshot_observed_at":"2026-08-06T22:52:54.526678Z","submitted_at":"2025-06-25T06:29:18Z","title":"AALC: Large Language Model Efficient Reasoning via Adaptive Accuracy-Length Control","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-06T23:00:45.940404Z"},"links":{"cited_paper":"/paper/2503.00031","citing_paper":"/paper/2506.20160"},"observation_digest":"sha256:fa8b3ff69a46ffe07084896fb300375fe2f0e5d96b95ef0b7e600c53b1ce27b9","observation_id":"f612e9d5-3c2c-4b20-9423-4174e9aa716c","resolution":{"observed_at":"2026-08-06T23:00:45.940404Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-06T23:00:45.943511Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.20160","last_updated":"2025-08-08T09:23:42Z","snapshot_observed_at":"2026-08-06T22:52:54.526678Z","submitted_at":"2025-06-25T06:29:18Z","title":"AALC: Large Language Model Efficient Reasoning via Adaptive Accuracy-Length Control","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-06T23:00:45.943511Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2506.20160"},"observation_digest":"sha256:fac915ee0ece46b2fb91b9da98747c0f12b2d4fc515d155c8abf538ff3dc61db","observation_id":"c1015e36-2a21-44ef-a067-8532f97fd935","resolution":{"observed_at":"2026-08-06T23:00:45.943511Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.19324","last_updated":"2025-06-26T03:14:46Z","snapshot_observed_at":"2026-07-06T20:29:07.258163Z","submitted_at":"2025-01-31T17:19:57Z","title":"Reward-Guided Speculative Decoding for Efficient LLM Reasoning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.19324","snapshot_observed_at":"2026-08-06T23:00:45.946584Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.20160","last_updated":"2025-08-08T09:23:42Z","snapshot_observed_at":"2026-08-06T22:52:54.526678Z","submitted_at":"2025-06-25T06:29:18Z","title":"AALC: Large Language Model Efficient Reasoning via Adaptive Accuracy-Length Control","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-06T23:00:45.946584Z"},"links":{"cited_paper":"/paper/2501.19324","citing_paper":"/paper/2506.20160"},"observation_digest":"sha256:6de6fde35b03f7a5bea651d345a8396c3ad1dfa2e83cbec5f2cd25d1ffede198","observation_id":"87c8092e-3e82-4317-b042-40fe4076d637","resolution":{"observed_at":"2026-08-06T23:00:45.946584Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12570","last_updated":"2025-01-29T03:11:03Z","snapshot_observed_at":"2026-07-06T20:24:12.803909Z","submitted_at":"2025-01-22T01:35:11Z","title":"O1-Pruner: Length-Harmonizing Fine-Tuning for O1-Like Reasoning Pruning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12570","snapshot_observed_at":"2026-08-06T23:00:45.950071Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.20160","last_updated":"2025-08-08T09:23:42Z","snapshot_observed_at":"2026-08-06T22:52:54.526678Z","submitted_at":"2025-06-25T06:29:18Z","title":"AALC: Large Language Model Efficient Reasoning via Adaptive Accuracy-Length Control","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-06T23:00:45.950071Z"},"links":{"cited_paper":"/paper/2501.12570","citing_paper":"/paper/2506.20160"},"observation_digest":"sha256:2e1877da3dae3fe566efa1cb49d83bfc46c84d30383ecbddc3a5a01c4282a615","observation_id":"cf4e3ade-d53a-43b3-a0f6-3dac76332cdb","resolution":{"observed_at":"2026-08-06T23:00:45.950071Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.09601","last_updated":"2025-02-13T18:52:36Z","snapshot_observed_at":"2026-07-06T20:36:12.548343Z","submitted_at":"2025-02-13T18:52:36Z","title":"CoT-Valve: Length-Compressible Chain-of-Thought Tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.09601","snapshot_observed_at":"2026-08-06T23:00:45.953639Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.20160","last_updated":"2025-08-08T09:23:42Z","snapshot_observed_at":"2026-08-06T22:52:54.526678Z","submitted_at":"2025-06-25T06:29:18Z","title":"AALC: Large Language Model Efficient Reasoning via Adaptive Accuracy-Length Control","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-06T23:00:45.953639Z"},"links":{"cited_paper":"/paper/2502.09601","citing_paper":"/paper/2506.20160"},"observation_digest":"sha256:9a9e01eea7b853192cce0cd9c9d218193c54807f305865e1a4b8e9c32a38f98d","observation_id":"d804eaa1-86e2-4ab3-9e99-aa1d0a19528b","resolution":{"observed_at":"2026-08-06T23:00:45.953639Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.19825","last_updated":"2025-01-23T08:45:52Z","snapshot_observed_at":"2026-08-06T05:46:44.376142Z","submitted_at":"2024-07-29T09:21:52Z","title":"Concise Thoughts: Impact of Output Length on LLM Reasoning and Cost","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.19825","snapshot_observed_at":"2026-08-06T23:00:45.956715Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.20160","last_updated":"2025-08-08T09:23:42Z","snapshot_observed_at":"2026-08-06T22:52:54.526678Z","submitted_at":"2025-06-25T06:29:18Z","title":"AALC: Large Language Model Efficient Reasoning via Adaptive Accuracy-Length Control","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-06T23:00:45.956715Z"},"links":{"cited_paper":"/paper/2407.19825","citing_paper":"/paper/2506.20160"},"observation_digest":"sha256:bb20451bf71705e5c3ad9b11e7b2f00b384bf1f0c6147702cf8ec05d5125b04d","observation_id":"6cb5d714-993a-4e72-a0b2-1fb85c0d94ad","resolution":{"observed_at":"2026-08-06T23:00:45.956715Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:00:46.509244Z","title":null,"venue":null,"work_id":"9cb00add-e880-4b56-a816-7476e6079be9","year":2024},"citing_paper":{"arxiv_id":"2506.20160","last_updated":"2025-08-08T09:23:42Z","snapshot_observed_at":"2026-08-06T22:52:54.526678Z","submitted_at":"2025-06-25T06:29:18Z","title":"AALC: Large Language Model Efficient Reasoning via Adaptive Accuracy-Length Control","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-06T23:00:45.960079Z"},"links":{"citing_paper":"/paper/2506.20160"},"observation_digest":"sha256:91acd9ccb18ab603623944ef56e3102f0fcae997c6618a9e4c34f8724a003f21","observation_id":"0c579da2-e237-4b86-98a2-33bd6d1ef0cb","resolution":{"observed_at":"2026-08-06T23:00:46.512187Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:00:45.963094Z","title":null,"venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2506.20160","last_updated":"2025-08-08T09:23:42Z","snapshot_observed_at":"2026-08-06T22:52:54.526678Z","submitted_at":"2025-06-25T06:29:18Z","title":"AALC: Large Language Model Efficient Reasoning via Adaptive Accuracy-Length Control","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-06T23:00:45.963094Z"},"links":{"citing_paper":"/paper/2506.20160"},"observation_digest":"sha256:4afd7814ee262c8ed3955f26d3a977eb80330aafc40b206e6ac84214d23c2749","observation_id":"efcdbe51-b50e-4af5-bbf4-25258f9e38af","resolution":{"observed_at":"2026-08-06T23:00:45.963094Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:00:45.965958Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.20160","last_updated":"2025-08-08T09:23:42Z","snapshot_observed_at":"2026-08-06T22:52:54.526678Z","submitted_at":"2025-06-25T06:29:18Z","title":"AALC: Large Language Model Efficient Reasoning via Adaptive Accuracy-Length Control","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-06T23:00:45.965958Z"},"links":{"citing_paper":"/paper/2506.20160"},"observation_digest":"sha256:3946d1cc0786099591a8714cf4814297025237712b0a6a1f8f670e8b12afd614","observation_id":"01ec6ab3-dba8-4423-a9a4-f05e5b4d0186","resolution":{"observed_at":"2026-08-06T23:00:45.965958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-06T23:00:45.969632Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.20160","last_updated":"2025-08-08T09:23:42Z","snapshot_observed_at":"2026-08-06T22:52:54.526678Z","submitted_at":"2025-06-25T06:29:18Z","title":"AALC: Large Language Model Efficient Reasoning via Adaptive Accuracy-Length Control","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-06T23:00:45.969632Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2506.20160"},"observation_digest":"sha256:409acde702a1e9a14902936f1e00522c54e1b1c1692ff46aeb1217d9b951b21f","observation_id":"da0df22c-2792-421a-813d-1f42414d183b","resolution":{"observed_at":"2026-08-06T23:00:45.969632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-06T23:00:45.972704Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.20160","last_updated":"2025-08-08T09:23:42Z","snapshot_observed_at":"2026-08-06T22:52:54.526678Z","submitted_at":"2025-06-25T06:29:18Z","title":"AALC: Large Language Model Efficient Reasoning via Adaptive Accuracy-Length Control","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-06T23:00:45.972704Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2506.20160"},"observation_digest":"sha256:8e9a59eb4848c6b7ed5f6e8c4862862bceee0d08832dd64ba4b66ed534d0d334","observation_id":"5680a04d-81fc-49b7-903a-969de894eacc","resolution":{"observed_at":"2026-08-06T23:00:45.972704Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:00:45.975727Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.20160","last_updated":"2025-08-08T09:23:42Z","snapshot_observed_at":"2026-08-06T22:52:54.526678Z","submitted_at":"2025-06-25T06:29:18Z","title":"AALC: Large Language Model Efficient Reasoning via Adaptive Accuracy-Length Control","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-06T23:00:45.975727Z"},"links":{"citing_paper":"/paper/2506.20160"},"observation_digest":"sha256:19db2dafd221ba163133006176112a68db387ca5ad16cccb2b801c3491998cc2","observation_id":"013d035e-3640-449a-b09d-7a2b16054c46","resolution":{"observed_at":"2026-08-06T23:00:45.975727Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.03716","last_updated":"2024-07-10T23:15:49Z","snapshot_observed_at":"2026-08-03T14:09:43.107865Z","submitted_at":"2023-10-05T17:38:28Z","title":"A Long Way to Go: Investigating Length Correlations in RLHF","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.03716","snapshot_observed_at":"2026-08-06T23:00:45.978822Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.20160","last_updated":"2025-08-08T09:23:42Z","snapshot_observed_at":"2026-08-06T22:52:54.526678Z","submitted_at":"2025-06-25T06:29:18Z","title":"AALC: Large Language Model Efficient Reasoning via Adaptive Accuracy-Length Control","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-06T23:00:45.978822Z"},"links":{"cited_paper":"/paper/2310.03716","citing_paper":"/paper/2506.20160"},"observation_digest":"sha256:c7f091209dff5f1ff92b6079270113d27a9d93118ccd72103c90d58b5ae2493f","observation_id":"73af5cdd-1b0c-49a1-ad4f-8d4ee91000e7","resolution":{"observed_at":"2026-08-06T23:00:45.978822Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.16419","last_updated":"2025-08-21T19:14:40Z","snapshot_observed_at":"2026-08-07T04:27:23.738927Z","submitted_at":"2025-03-20T17:59:38Z","title":"Stop Overthinking: A Survey on Efficient Reasoning for Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.16419","snapshot_observed_at":"2026-08-06T23:00:45.981739Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.20160","last_updated":"2025-08-08T09:23:42Z","snapshot_observed_at":"2026-08-06T22:52:54.526678Z","submitted_at":"2025-06-25T06:29:18Z","title":"AALC: Large Language Model Efficient Reasoning via Adaptive Accuracy-Length Control","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-06T23:00:45.981739Z"},"links":{"cited_paper":"/paper/2503.16419","citing_paper":"/paper/2506.20160"},"observation_digest":"sha256:4060f785c4c939e71b01ee9cee4675ae81129bc04b4ccb502af58ce8996bb518","observation_id":"2174a9ed-70da-44e2-b8a5-fd7b4ef85990","resolution":{"observed_at":"2026-08-06T23:00:45.981739Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12599","last_updated":"2025-06-03T02:14:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T02:48:14Z","title":"Kimi k1.5: Scaling Reinforcement Learning with LLMs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12599","snapshot_observed_at":"2026-08-06T23:00:45.985276Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.20160","last_updated":"2025-08-08T09:23:42Z","snapshot_observed_at":"2026-08-06T22:52:54.526678Z","submitted_at":"2025-06-25T06:29:18Z","title":"AALC: Large Language Model Efficient Reasoning via Adaptive Accuracy-Length Control","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-06T23:00:45.985276Z"},"links":{"cited_paper":"/paper/2501.12599","citing_paper":"/paper/2506.20160"},"observation_digest":"sha256:5721af622d6797b3cd6db60feee336385f577b3bfbe6d3cb77ce9879a0345c3a","observation_id":"d33cdebf-6fe4-4c04-8420-fbbc123ce694","resolution":{"observed_at":"2026-08-06T23:00:45.985276Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:00:46.494135Z","title":null,"venue":null,"work_id":"c149899a-5105-467e-bf8c-1641249d3d5d","year":2024},"citing_paper":{"arxiv_id":"2506.20160","last_updated":"2025-08-08T09:23:42Z","snapshot_observed_at":"2026-08-06T22:52:54.526678Z","submitted_at":"2025-06-25T06:29:18Z","title":"AALC: Large Language Model Efficient Reasoning via Adaptive Accuracy-Length Control","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-06T23:00:45.988318Z"},"links":{"citing_paper":"/paper/2506.20160"},"observation_digest":"sha256:1fae7ab576335ee778a5e30d65123c39cbf70bda154f0d8300f92530ccd2bd82","observation_id":"bdd5cc72-defb-4ab4-83bd-5fc1d5590200","resolution":{"observed_at":"2026-08-06T23:00:46.498123Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:00:45.991290Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.20160","last_updated":"2025-08-08T09:23:42Z","snapshot_observed_at":"2026-08-06T22:52:54.526678Z","submitted_at":"2025-06-25T06:29:18Z","title":"AALC: Large Language Model Efficient Reasoning via Adaptive Accuracy-Length Control","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-06T23:00:45.991290Z"},"links":{"citing_paper":"/paper/2506.20160"},"observation_digest":"sha256:d95a72834e3cd2147495641d24a9b8c422d51807f7d4ab087f53ff27b9fa53a9","observation_id":"bb1390ef-1d8f-4b31-a3e4-09f926b61d61","resolution":{"observed_at":"2026-08-06T23:00:45.991290Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14768","last_updated":"2025-02-20T17:49:26Z","snapshot_observed_at":"2026-08-04T12:32:53.090165Z","submitted_at":"2025-02-20T17:49:26Z","title":"Logic-RL: Unleashing LLM Reasoning with Rule-Based Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14768","snapshot_observed_at":"2026-08-06T23:00:45.994143Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.20160","last_updated":"2025-08-08T09:23:42Z","snapshot_observed_at":"2026-08-06T22:52:54.526678Z","submitted_at":"2025-06-25T06:29:18Z","title":"AALC: Large Language Model Efficient Reasoning via Adaptive Accuracy-Length Control","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-06T23:00:45.994143Z"},"links":{"cited_paper":"/paper/2502.14768","citing_paper":"/paper/2506.20160"},"observation_digest":"sha256:cf33951e99eb31ab07837dda2cfb90248050ff6905f1b9c4dc6bd9f1fffa7356","observation_id":"586de41a-4eda-4c63-8d24-d71123b0f776","resolution":{"observed_at":"2026-08-06T23:00:45.994143Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.18600","last_updated":"2025-03-03T17:08:21Z","snapshot_observed_at":"2026-08-07T17:49:06.764625Z","submitted_at":"2025-02-25T19:36:06Z","title":"Chain of Draft: Thinking Faster by Writing Less","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.18600","snapshot_observed_at":"2026-08-06T23:00:45.997171Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.20160","last_updated":"2025-08-08T09:23:42Z","snapshot_observed_at":"2026-08-06T22:52:54.526678Z","submitted_at":"2025-06-25T06:29:18Z","title":"AALC: Large Language Model Efficient Reasoning via Adaptive Accuracy-Length Control","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-06T23:00:45.997171Z"},"links":{"cited_paper":"/paper/2502.18600","citing_paper":"/paper/2506.20160"},"observation_digest":"sha256:369e5a4b34e126313e95f25d9a9be30125b1a159e8ecd183485361db9f4aebeb","observation_id":"be903c9c-f430-4240-9273-57a3ac2a220f","resolution":{"observed_at":"2026-08-06T23:00:45.997171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.12134","last_updated":"2025-05-27T14:54:51Z","snapshot_observed_at":"2026-07-06T20:38:06.085744Z","submitted_at":"2025-02-17T18:52:29Z","title":"SoftCoT: Soft Chain-of-Thought for Efficient Reasoning with LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.12134","snapshot_observed_at":"2026-08-06T23:00:46.000277Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.20160","last_updated":"2025-08-08T09:23:42Z","snapshot_observed_at":"2026-08-06T22:52:54.526678Z","submitted_at":"2025-06-25T06:29:18Z","title":"AALC: Large Language Model Efficient Reasoning via Adaptive Accuracy-Length Control","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-06T23:00:46.000277Z"},"links":{"cited_paper":"/paper/2502.12134","citing_paper":"/paper/2506.20160"},"observation_digest":"sha256:ef4dc5e9a0c98a537505c12ba621fb53c1b775e81f7db0d5fbd87fa26822044b","observation_id":"a0b0adeb-d9eb-4aa4-a2de-3b39ae992cd8","resolution":{"observed_at":"2026-08-06T23:00:46.000277Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12122","last_updated":"2024-09-18T16:45:37Z","snapshot_observed_at":"2026-07-06T19:17:41.512834Z","submitted_at":"2024-09-18T16:45:37Z","title":"Qwen2.5-Math Technical Report: Toward Mathematical Expert Model via Self-Improvement","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12122","snapshot_observed_at":"2026-08-06T23:00:46.003373Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.20160","last_updated":"2025-08-08T09:23:42Z","snapshot_observed_at":"2026-08-06T22:52:54.526678Z","submitted_at":"2025-06-25T06:29:18Z","title":"AALC: Large Language Model Efficient Reasoning via Adaptive Accuracy-Length Control","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-06T23:00:46.003373Z"},"links":{"cited_paper":"/paper/2409.12122","citing_paper":"/paper/2506.20160"},"observation_digest":"sha256:5f7eabaa9a46210254426d8f1fbd147022c309dbb5c08cfed77a5e8a114d5519","observation_id":"c8520840-ecac-4902-af23-f715669b8f1c","resolution":{"observed_at":"2026-08-06T23:00:46.003373Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03373","last_updated":"2025-02-05T17:13:32Z","snapshot_observed_at":"2026-07-06T20:31:41.231839Z","submitted_at":"2025-02-05T17:13:32Z","title":"Demystifying Long Chain-of-Thought Reasoning in LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.03373","snapshot_observed_at":"2026-08-06T23:00:46.006441Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.20160","last_updated":"2025-08-08T09:23:42Z","snapshot_observed_at":"2026-08-06T22:52:54.526678Z","submitted_at":"2025-06-25T06:29:18Z","title":"AALC: Large Language Model Efficient Reasoning via Adaptive Accuracy-Length Control","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-06T23:00:46.006441Z"},"links":{"cited_paper":"/paper/2502.03373","citing_paper":"/paper/2506.20160"},"observation_digest":"sha256:ba00c571fbee01a91c7b0b19ff054a56664eb27884a25bf2ea8bc260c9798b5a","observation_id":"f23292b8-40c2-479e-8528-627182226e2c","resolution":{"observed_at":"2026-08-06T23:00:46.006441Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.18892","last_updated":"2025-08-06T08:42:32Z","snapshot_observed_at":"2026-07-06T20:57:57.039376Z","submitted_at":"2025-03-24T17:06:10Z","title":"SimpleRL-Zoo: Investigating and Taming Zero Reinforcement Learning for Open Base Models in the Wild","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.18892","snapshot_observed_at":"2026-08-06T23:00:46.009533Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.20160","last_updated":"2025-08-08T09:23:42Z","snapshot_observed_at":"2026-08-06T22:52:54.526678Z","submitted_at":"2025-06-25T06:29:18Z","title":"AALC: Large Language Model Efficient Reasoning via Adaptive Accuracy-Length Control","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-06T23:00:46.009533Z"},"links":{"cited_paper":"/paper/2503.18892","citing_paper":"/paper/2506.20160"},"observation_digest":"sha256:2c616b0b7cdcce6fb5b9b2fd4eda614fcb524bca8d4118839a2a14dbbd3798e8","observation_id":"99bbdf07-81ba-4a53-b0b2-6281b18b62f8","resolution":{"observed_at":"2026-08-06T23:00:46.009533Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:00:46.012857Z","title":"URL: \" 'urlintro :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.20160","last_updated":"2025-08-08T09:23:42Z","snapshot_observed_at":"2026-08-06T22:52:54.526678Z","submitted_at":"2025-06-25T06:29:18Z","title":"AALC: Large Language Model Efficient Reasoning via Adaptive Accuracy-Length Control","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-06T23:00:46.012857Z"},"links":{"citing_paper":"/paper/2506.20160"},"observation_digest":"sha256:ab59aeddab6b5152291a9d55023a1405ca27b91192f578518fb5950dc5658da0","observation_id":"5fffbe27-ff66-48bf-8c31-0a0babefdc1d","resolution":{"observed_at":"2026-08-06T23:00:46.012857Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:00:46.016123Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.20160","last_updated":"2025-08-08T09:23:42Z","snapshot_observed_at":"2026-08-06T22:52:54.526678Z","submitted_at":"2025-06-25T06:29:18Z","title":"AALC: Large Language Model Efficient Reasoning via Adaptive Accuracy-Length Control","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-06T23:00:46.016123Z"},"links":{"citing_paper":"/paper/2506.20160"},"observation_digest":"sha256:655724c5be023ac9aaa4023e2e89ab5f79a1cd3ccb4d4bb8eb2bc81f1b0437ad","observation_id":"8fe7e63c-9129-4915-b5da-a4355ac9346d","resolution":{"observed_at":"2026-08-06T23:00:46.016123Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.20160","last_updated":"2025-08-08T09:23:42Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-06T22:52:54.526678Z","submitted_at":"2025-06-25T06:29:18Z","title":"AALC: Large Language Model Efficient Reasoning via Adaptive Accuracy-Length Control"},"reference_resolution":{"displayed":36,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":36,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":36},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 36 of 36 outbound references and 3 inbound Pith citation observations for arXiv:2506.20160."}