{"as_of":"2026-08-06T16:27:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:262e59abb0199c2da960610c323a3011cd0bacfcdf7c12945c9663ccb1fee8aa","coverage":[{"denominator":51,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":51,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T17:04:38.789376Z","state":"measured"},{"denominator":59,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":59,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":8,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":8,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T13:52:06.706334Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-04T09:19:43.908502Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2508.17196","last_updated":"2025-08-29T14:42:16Z","snapshot_observed_at":"2026-08-06T13:40:01.864747Z","submitted_at":"2025-08-24T03:17:50Z","title":"BudgetThinker: Empowering Budget-aware LLM Reasoning with Control Tokens","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.17196","snapshot_observed_at":"2026-08-05T13:52:06.706334Z","title":"Budgetthinker: Empowering budget-aware llm reasoning with control tokens","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.04475","last_updated":"2025-08-30T03:09:07Z","snapshot_observed_at":"2026-08-06T15:46:43.575429Z","submitted_at":"2025-08-30T03:09:07Z","title":"ParaThinker: Native Parallel Thinking as a New Paradigm to Scale LLM Test-time Compute","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-05T13:52:06.706334Z"},"links":{"cited_paper":"/paper/2508.17196","citing_paper":"/paper/2509.04475"},"observation_digest":"sha256:1c16d69df5f820293086b14dd32a9dc01137c4f8509aa90b52bc6469f97e01b6","observation_id":"083bd7ef-885d-468b-a919-1b36b93071cf","resolution":{"observed_at":"2026-08-05T13:52:06.706334Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.17196","last_updated":"2025-08-29T14:42:16Z","snapshot_observed_at":"2026-08-06T13:40:01.864747Z","submitted_at":"2025-08-24T03:17:50Z","title":"BudgetThinker: Empowering Budget-aware LLM Reasoning with Control Tokens","version":2},"cited_work":{"arxiv_id":"2508.17196","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.17196","snapshot_observed_at":"2026-07-04T09:19:43.908502Z","title":"Budgetthinker: Empowering budget-aware llm reasoning with control tokens","venue":"cs.LG","work_id":"4a84c6c5-bcb7-419f-bca8-857542b3abcf","year":2025},"citing_paper":{"arxiv_id":"2605.07021","last_updated":"2026-05-20T02:19:39Z","snapshot_observed_at":"2026-08-02T16:20:14.264105Z","submitted_at":"2026-05-07T23:05:50Z","title":"Behavior Cue Reasoning: Monitorable Reasoning Improves Efficiency and Safety through Oversight","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-11T00:54:25.549158Z"},"links":{"cited_paper":"/paper/2508.17196","citing_paper":"/paper/2605.07021"},"observation_digest":"sha256:045573550d39f9d36c2cdc7457cd40d5977abc0b9010837340d37f2f04cd4e60","observation_id":"c9e57aa4-f463-45e6-8cf1-8cf211895468","resolution":{"observed_at":"2026-06-10T02:10:31.848495Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.17196","last_updated":"2025-08-29T14:42:16Z","snapshot_observed_at":"2026-08-06T13:40:01.864747Z","submitted_at":"2025-08-24T03:17:50Z","title":"BudgetThinker: Empowering Budget-aware LLM Reasoning with Control Tokens","version":2},"cited_work":{"arxiv_id":"2508.17196","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.17196","snapshot_observed_at":"2026-07-04T09:19:43.908502Z","title":"Budgetthinker: Empowering budget-aware llm reasoning with control tokens","venue":"cs.LG","work_id":"4a84c6c5-bcb7-419f-bca8-857542b3abcf","year":2025},"citing_paper":{"arxiv_id":"2605.07021","last_updated":"2026-05-20T02:19:39Z","snapshot_observed_at":"2026-08-02T16:20:14.264105Z","submitted_at":"2026-05-07T23:05:50Z","title":"Behavior Cue Reasoning: Monitorable Reasoning Improves Efficiency and Safety through Oversight","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-21T08:29:09.122055Z"},"links":{"cited_paper":"/paper/2508.17196","citing_paper":"/paper/2605.07021"},"observation_digest":"sha256:e7e11cfee4378ac12b110defe1f6de418eb2ab17bc88715637fe16434138d201","observation_id":"390237b0-cb78-49c0-9039-5114b255846e","resolution":{"observed_at":"2026-06-10T02:10:31.848495Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.17196","last_updated":"2025-08-29T14:42:16Z","snapshot_observed_at":"2026-08-06T13:40:01.864747Z","submitted_at":"2025-08-24T03:17:50Z","title":"BudgetThinker: Empowering Budget-aware LLM Reasoning with Control Tokens","version":2},"cited_work":{"arxiv_id":"2508.17196","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.17196","snapshot_observed_at":"2026-07-04T09:19:43.908502Z","title":"Budgetthinker: Empowering budget-aware llm reasoning with control tokens","venue":"cs.LG","work_id":"4a84c6c5-bcb7-419f-bca8-857542b3abcf","year":2025},"citing_paper":{"arxiv_id":"2605.11625","last_updated":"2026-05-12T06:51:31Z","snapshot_observed_at":"2026-07-06T23:23:26.077921Z","submitted_at":"2026-05-12T06:51:31Z","title":"Nice Fold or Hero Call: Learning Budget-Efficient Thinking for Adaptive Reasoning","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-13T01:31:21.377700Z"},"links":{"cited_paper":"/paper/2508.17196","citing_paper":"/paper/2605.11625"},"observation_digest":"sha256:5b882ec9917b0aa4ce6f712edf1687fb8d8144e99bcc10d1f7bc3b064314def2","observation_id":"10a4296f-8426-4ae9-a6f7-36ad1042a4a4","resolution":{"observed_at":"2026-06-10T02:10:31.848495Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.17196","last_updated":"2025-08-29T14:42:16Z","snapshot_observed_at":"2026-08-06T13:40:01.864747Z","submitted_at":"2025-08-24T03:17:50Z","title":"BudgetThinker: Empowering Budget-aware LLM Reasoning with Control Tokens","version":2},"cited_work":{"arxiv_id":"2508.17196","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.17196","snapshot_observed_at":"2026-07-04T09:19:43.908502Z","title":"Budgetthinker: Empowering budget-aware llm reasoning with control tokens","venue":"cs.LG","work_id":"4a84c6c5-bcb7-419f-bca8-857542b3abcf","year":2025},"citing_paper":{"arxiv_id":"2605.25424","last_updated":"2026-05-25T04:52:10Z","snapshot_observed_at":"2026-08-06T09:20:38.905278Z","submitted_at":"2026-05-25T04:52:10Z","title":"SeqRoute: Global Budget-Aware Sequential LLM Routing via Offline Reinforcement Learning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-29T23:13:41.456647Z"},"links":{"cited_paper":"/paper/2508.17196","citing_paper":"/paper/2605.25424"},"observation_digest":"sha256:6f68d2a8142dfadc7d386cd554f9b833584d4965a94c5c0c78d75680f9acc4ca","observation_id":"848aec1c-dd84-4d60-9975-a8ae4b9cfe33","resolution":{"observed_at":"2026-06-29T23:14:01.063823Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.17196","last_updated":"2025-08-29T14:42:16Z","snapshot_observed_at":"2026-08-06T13:40:01.864747Z","submitted_at":"2025-08-24T03:17:50Z","title":"BudgetThinker: Empowering Budget-aware LLM Reasoning with Control Tokens","version":2},"cited_work":{"arxiv_id":"2508.17196","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.17196","snapshot_observed_at":"2026-07-04T09:19:43.908502Z","title":"Budgetthinker: Empowering budget-aware llm reasoning with control tokens","venue":"cs.LG","work_id":"4a84c6c5-bcb7-419f-bca8-857542b3abcf","year":2025},"citing_paper":{"arxiv_id":"2606.22716","last_updated":"2026-06-21T23:27:12Z","snapshot_observed_at":"2026-08-02T15:57:58.597260Z","submitted_at":"2026-06-21T23:27:12Z","title":"Beyond Penalizing Mistakes: Stabilizing Efficiency Training in Large Reasoning Models via Adaptive Correct-Only Rewards","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-06-26T10:12:30.692295Z"},"links":{"cited_paper":"/paper/2508.17196","citing_paper":"/paper/2606.22716"},"observation_digest":"sha256:08c7e3c4ac51d713ab9ea13cddfe6f9fda37c4724e4e4d246a2759032a7c5aa5","observation_id":"dd56690c-c54f-4196-98cd-81bfbd7fb5a0","resolution":{"observed_at":"2026-07-04T09:19:43.909728Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.17196","last_updated":"2025-08-29T14:42:16Z","snapshot_observed_at":"2026-08-06T13:40:01.864747Z","submitted_at":"2025-08-24T03:17:50Z","title":"BudgetThinker: Empowering Budget-aware LLM Reasoning with Control Tokens","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.17196","snapshot_observed_at":"2026-07-30T19:53:04.577816Z","title":"BudgetThinker: Empowering budget-aware LLM reasoning with control tokens.arXiv preprint arXiv:2508.17196,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26828","last_updated":"2026-07-30T03:06:21Z","snapshot_observed_at":"2026-08-05T20:46:38.011084Z","submitted_at":"2026-07-29T12:21:28Z","title":"Budget-Aware LLM Discovery via Cost-Calibrated Frontier Utility","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-30T19:53:04.577816Z"},"links":{"cited_paper":"/paper/2508.17196","citing_paper":"/paper/2607.26828"},"observation_digest":"sha256:17093a645f440a58739ecef3ce6089acaf651e4e253f041096f8e1276186157b","observation_id":"47bbf4c8-1447-44ef-9674-03d321bb2d38","resolution":{"observed_at":"2026-07-30T19:53:04.577816Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.17196","last_updated":"2025-08-29T14:42:16Z","snapshot_observed_at":"2026-08-06T13:40:01.864747Z","submitted_at":"2025-08-24T03:17:50Z","title":"BudgetThinker: Empowering Budget-aware LLM Reasoning with Control Tokens","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.17196","snapshot_observed_at":"2026-08-01T10:47:32.798333Z","title":"BudgetThinker: Empowering budget-aware LLM reasoning with control tokens.arXiv preprint arXiv:2508.17196,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26828","last_updated":"2026-07-30T03:06:21Z","snapshot_observed_at":"2026-08-05T20:46:38.011084Z","submitted_at":"2026-07-29T12:21:28Z","title":"Budget-Aware LLM Discovery via Cost-Calibrated Frontier Utility","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-01T10:47:32.798333Z"},"links":{"cited_paper":"/paper/2508.17196","citing_paper":"/paper/2607.26828"},"observation_digest":"sha256:048e8812ec02bb990eea2373ec17536426ca265da9cad24452f198bf5ec6ef91","observation_id":"9c9fbb6a-3fb7-4064-879d-1b2404766c30","resolution":{"observed_at":"2026-08-01T10:47:32.798333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2508.17196/citation-record","integrity":"/paper/2508.17196/integrity","json":"/paper/2508.17196/citation-record.json","paper":"/paper/2508.17196"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2503.04697","last_updated":"2025-10-03T01:55:58Z","snapshot_observed_at":"2026-08-06T08:53:09.095000Z","submitted_at":"2025-03-06T18:43:29Z","title":"L1: Controlling How Long A Reasoning Model Thinks With Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.04697","snapshot_observed_at":"2026-08-05T17:04:37.855909Z","title":"L1: Controlling how long a reasoning model thinks with reinforcement learning, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.17196","last_updated":"2025-08-29T14:42:16Z","snapshot_observed_at":"2026-08-06T13:40:01.864747Z","submitted_at":"2025-08-24T03:17:50Z","title":"BudgetThinker: Empowering Budget-aware LLM Reasoning with Control Tokens","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-05T17:04:37.855909Z"},"links":{"cited_paper":"/paper/2503.04697","citing_paper":"/paper/2508.17196"},"observation_digest":"sha256:b7ac08775da32504b76373ed0573106f3f891ee36da1d21ce295c439aa375fe8","observation_id":"5b57eae4-b46f-4fee-8a2a-5c537145f60c","resolution":{"observed_at":"2026-08-05T17:04:37.855909Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:04:37.905799Z","title":"Training language models to reason efficiently","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.17196","last_updated":"2025-08-29T14:42:16Z","snapshot_observed_at":"2026-08-06T13:40:01.864747Z","submitted_at":"2025-08-24T03:17:50Z","title":"BudgetThinker: Empowering Budget-aware LLM Reasoning with Control Tokens","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-05T17:04:37.905799Z"},"links":{"citing_paper":"/paper/2508.17196"},"observation_digest":"sha256:4cb95741a0f4486a91bc54d316822bbf78bb07d298c3d00f2067adb5b025d7eb","observation_id":"06ca0e66-f3de-4727-ac4c-e97344c89ba2","resolution":{"observed_at":"2026-08-05T17:04:37.905799Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.14950","last_updated":"2024-09-26T15:45:13Z","snapshot_observed_at":"2026-07-06T17:07:19.721701Z","submitted_at":"2023-12-08T15:57:18Z","title":"TypeFly: Flying Drones with Large Language Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.14950","snapshot_observed_at":"2026-08-05T17:04:37.951222Z","title":"Typefly: Flying drones with large language model","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.17196","last_updated":"2025-08-29T14:42:16Z","snapshot_observed_at":"2026-08-06T13:40:01.864747Z","submitted_at":"2025-08-24T03:17:50Z","title":"BudgetThinker: Empowering Budget-aware LLM Reasoning with Control Tokens","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-05T17:04:37.951222Z"},"links":{"cited_paper":"/paper/2312.14950","citing_paper":"/paper/2508.17196"},"observation_digest":"sha256:7e01e734610003497bb1956d164cb8668e99b5837059bb3e00823e2dfeb8e4e6","observation_id":"c936927b-e53c-4ca5-9c8b-21a96a5dbad7","resolution":{"observed_at":"2026-08-05T17:04:37.951222Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:04:39.521143Z","title":"Timelynet: Adaptive neural architecture for autonomous driving with dynamic deadline","venue":null,"work_id":"d1807f8a-947e-4b1b-a4b5-7e77ae2743c6","year":2025},"citing_paper":{"arxiv_id":"2508.17196","last_updated":"2025-08-29T14:42:16Z","snapshot_observed_at":"2026-08-06T13:40:01.864747Z","submitted_at":"2025-08-24T03:17:50Z","title":"BudgetThinker: Empowering Budget-aware LLM Reasoning with Control Tokens","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-05T17:04:37.993764Z"},"links":{"citing_paper":"/paper/2508.17196"},"observation_digest":"sha256:4da2a98b1c9aa12b807717886c4396db6f3137554453d707da9f8f2947a4b8af","observation_id":"8c05d0d5-c0c3-43b9-a913-077fb9035b39","resolution":{"observed_at":"2026-08-05T17:04:39.523967Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.21187","last_updated":"2025-02-01T07:57:37Z","snapshot_observed_at":"2026-08-01T16:43:44.704797Z","submitted_at":"2024-12-30T18:55:12Z","title":"Do NOT Think That Much for 2+3=? On the Overthinking of o1-Like LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.21187","snapshot_observed_at":"2026-08-05T17:04:38.030801Z","title":"Do not think that much for 2+3=? on the overthinking of o1-like llms, 2025 b","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.17196","last_updated":"2025-08-29T14:42:16Z","snapshot_observed_at":"2026-08-06T13:40:01.864747Z","submitted_at":"2025-08-24T03:17:50Z","title":"BudgetThinker: Empowering Budget-aware LLM Reasoning with Control Tokens","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-05T17:04:38.030801Z"},"links":{"cited_paper":"/paper/2412.21187","citing_paper":"/paper/2508.17196"},"observation_digest":"sha256:09b5c3e41d957df6194f73a89e0b222884b56015dbc8c6637e8aceb05a79e1ef","observation_id":"ed1522b4-5df3-40a6-ab5b-365c16227369","resolution":{"observed_at":"2026-08-05T17:04:38.030801Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01456","last_updated":"2025-09-26T09:25:31Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-03T15:43:48Z","title":"Process Reinforcement through Implicit Rewards","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.01456","snapshot_observed_at":"2026-08-05T17:04:38.081640Z","title":"Process reinforcement through implicit rewards, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.17196","last_updated":"2025-08-29T14:42:16Z","snapshot_observed_at":"2026-08-06T13:40:01.864747Z","submitted_at":"2025-08-24T03:17:50Z","title":"BudgetThinker: Empowering Budget-aware LLM Reasoning with Control Tokens","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-05T17:04:38.081640Z"},"links":{"cited_paper":"/paper/2502.01456","citing_paper":"/paper/2508.17196"},"observation_digest":"sha256:29683e07d5b4943003aa09c05e2b9104a18aee563192a950ec3c96b2bcede62e","observation_id":"aa131fd3-d126-4d82-9f6a-c1ba03f2a8ca","resolution":{"observed_at":"2026-08-05T17:04:38.081640Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.04707","last_updated":"2024-10-07T02:52:30Z","snapshot_observed_at":"2026-07-06T19:28:48.185066Z","submitted_at":"2024-10-07T02:52:30Z","title":"Learning How Hard to Think: Input-Adaptive Allocation of LM Computation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.04707","snapshot_observed_at":"2026-08-05T17:04:38.139893Z","title":"Learning how hard to think: Input-adaptive allocation of lm computation, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.17196","last_updated":"2025-08-29T14:42:16Z","snapshot_observed_at":"2026-08-06T13:40:01.864747Z","submitted_at":"2025-08-24T03:17:50Z","title":"BudgetThinker: Empowering Budget-aware LLM Reasoning with Control Tokens","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-05T17:04:38.139893Z"},"links":{"cited_paper":"/paper/2410.04707","citing_paper":"/paper/2508.17196"},"observation_digest":"sha256:c96422ca34f9aaca6033c463a4b2ef2ac58ad21fc7031e1c389c0ef6b28fd8ad","observation_id":"3cb1a58f-a184-4b77-b97a-e4ffabe2b42f","resolution":{"observed_at":"2026-08-05T17:04:38.139893Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-05T17:04:38.192259Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.17196","last_updated":"2025-08-29T14:42:16Z","snapshot_observed_at":"2026-08-06T13:40:01.864747Z","submitted_at":"2025-08-24T03:17:50Z","title":"BudgetThinker: Empowering Budget-aware LLM Reasoning with Control Tokens","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-05T17:04:38.192259Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2508.17196"},"observation_digest":"sha256:78e4bce9c756c9ab67849f25b19701b501b5e3dddb399ea881ed06a43cbfff1c","observation_id":"ec7288d5-9ab7-4421-9421-1f6dd17d0b07","resolution":{"observed_at":"2026-08-05T17:04:38.192259Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.20993","last_updated":"2025-05-27T16:41:53Z","snapshot_observed_at":"2026-07-06T20:14:40.579474Z","submitted_at":"2024-12-30T14:57:53Z","title":"Efficiently Scaling LLM Reasoning with Certaindex","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.20993","snapshot_observed_at":"2026-08-05T17:04:38.246678Z","title":"Efficiently scaling llm reasoning with certaindex, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.17196","last_updated":"2025-08-29T14:42:16Z","snapshot_observed_at":"2026-08-06T13:40:01.864747Z","submitted_at":"2025-08-24T03:17:50Z","title":"BudgetThinker: Empowering Budget-aware LLM Reasoning with Control Tokens","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-05T17:04:38.246678Z"},"links":{"cited_paper":"/paper/2412.20993","citing_paper":"/paper/2508.17196"},"observation_digest":"sha256:0aab31ed851c594f34bba66b28a136dd839194e1cfd75fadf7825e14335c41e5","observation_id":"74cd2714-fb76-48d6-aa49-5f99cb7f7a74","resolution":{"observed_at":"2026-08-05T17:04:38.246678Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.05171","last_updated":"2025-02-17T17:14:04Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-07T18:55:02Z","title":"Scaling up Test-Time Compute with Latent Reasoning: A Recurrent Depth Approach","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.05171","snapshot_observed_at":"2026-08-05T17:04:38.281800Z","title":"Bartoldson, Bhavya Kailkhura, Abhinav Bhatele, and Tom Goldstein","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.17196","last_updated":"2025-08-29T14:42:16Z","snapshot_observed_at":"2026-08-06T13:40:01.864747Z","submitted_at":"2025-08-24T03:17:50Z","title":"BudgetThinker: Empowering Budget-aware LLM Reasoning with Control Tokens","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-05T17:04:38.281800Z"},"links":{"cited_paper":"/paper/2502.05171","citing_paper":"/paper/2508.17196"},"observation_digest":"sha256:0ed89d179b35792c2488349233d086ebb5241941c4d45c2daa5c1ef2d93f065d","observation_id":"88efb7a1-fe88-4cda-ad73-baab82c06040","resolution":{"observed_at":"2026-08-05T17:04:38.281800Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:04:38.360939Z","title":"Gemini 2.5: Our most intelligent ai model","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.17196","last_updated":"2025-08-29T14:42:16Z","snapshot_observed_at":"2026-08-06T13:40:01.864747Z","submitted_at":"2025-08-24T03:17:50Z","title":"BudgetThinker: Empowering Budget-aware LLM Reasoning with Control Tokens","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-05T17:04:38.360939Z"},"links":{"citing_paper":"/paper/2508.17196"},"observation_digest":"sha256:f6f1dc36de6988175608beacafe5d9add2d53d5cff5a3ceeffca1dc6f587586b","observation_id":"490b8d98-0c7e-464b-838e-19cee20d417a","resolution":{"observed_at":"2026-08-05T17:04:38.360939Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18547","last_updated":"2025-06-02T00:44:09Z","snapshot_observed_at":"2026-08-05T13:27:46.877171Z","submitted_at":"2024-12-24T16:55:45Z","title":"Token-Budget-Aware LLM Reasoning","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.18547","snapshot_observed_at":"2026-08-05T17:04:38.484100Z","title":"Token-budget-aware llm reasoning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.17196","last_updated":"2025-08-29T14:42:16Z","snapshot_observed_at":"2026-08-06T13:40:01.864747Z","submitted_at":"2025-08-24T03:17:50Z","title":"BudgetThinker: Empowering Budget-aware LLM Reasoning with Control Tokens","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-05T17:04:38.484100Z"},"links":{"cited_paper":"/paper/2412.18547","citing_paper":"/paper/2508.17196"},"observation_digest":"sha256:8f3621b60d733073e72bec6e6001d2d9920dc20ba7cd5f695a3dbde9af41668b","observation_id":"5b190463-e31c-4699-bb2f-6f6ce7ad0875","resolution":{"observed_at":"2026-08-05T17:04:38.484100Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:04:38.532025Z","title":"Measuring mathematical problem solving with the math dataset","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.17196","last_updated":"2025-08-29T14:42:16Z","snapshot_observed_at":"2026-08-06T13:40:01.864747Z","submitted_at":"2025-08-24T03:17:50Z","title":"BudgetThinker: Empowering Budget-aware LLM Reasoning with Control Tokens","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-05T17:04:38.532025Z"},"links":{"citing_paper":"/paper/2508.17196"},"observation_digest":"sha256:1eea391ba5bd0f5e6a5ed3d7640f86496bdf006f231e588db07266fc10bfbe52","observation_id":"142f3a88-35b7-4cb9-8f4f-ae3c857bc681","resolution":{"observed_at":"2026-08-05T17:04:38.532025Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.01296","last_updated":"2025-04-02T01:59:26Z","snapshot_observed_at":"2026-07-30T08:40:23.849282Z","submitted_at":"2025-04-02T01:59:26Z","title":"ThinkPrune: Pruning Long Chain-of-Thought of LLMs via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.01296","snapshot_observed_at":"2026-08-05T17:04:38.571915Z","title":"Thinkprune: Pruning long chain-of-thought of llms via reinforcement learning, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.17196","last_updated":"2025-08-29T14:42:16Z","snapshot_observed_at":"2026-08-06T13:40:01.864747Z","submitted_at":"2025-08-24T03:17:50Z","title":"BudgetThinker: Empowering Budget-aware LLM Reasoning with Control Tokens","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-05T17:04:38.571915Z"},"links":{"cited_paper":"/paper/2504.01296","citing_paper":"/paper/2508.17196"},"observation_digest":"sha256:eaaf4ce0a4c32b8f0b22de64e09a306bcdde6de812c67296acd4bd5a9b20a711","observation_id":"8b2dcd08-39c4-46ca-9855-d374981a5a54","resolution":{"observed_at":"2026-08-05T17:04:38.571915Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12186","last_updated":"2024-11-12T13:24:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-18T17:57:57Z","title":"Qwen2.5-Coder Technical Report","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12186","snapshot_observed_at":"2026-08-05T17:04:38.633988Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.17196","last_updated":"2025-08-29T14:42:16Z","snapshot_observed_at":"2026-08-06T13:40:01.864747Z","submitted_at":"2025-08-24T03:17:50Z","title":"BudgetThinker: Empowering Budget-aware LLM Reasoning with Control Tokens","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-05T17:04:38.633988Z"},"links":{"cited_paper":"/paper/2409.12186","citing_paper":"/paper/2508.17196"},"observation_digest":"sha256:8d206901c5f1af8a64cf9c34308ba083239784ee99a53b5b9dda5e3615217d4e","observation_id":"f162caa3-da0e-4f7b-b3de-dfb80bf5f938","resolution":{"observed_at":"2026-08-05T17:04:38.633988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"7993.34832","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:04:39.323790Z","title":"Flexible high-resolution object detection on edge devices with tunable latency","venue":null,"work_id":"105a71fe-3ff7-4eb2-ab4e-965b42b49f69","year":2021},"citing_paper":{"arxiv_id":"2508.17196","last_updated":"2025-08-29T14:42:16Z","snapshot_observed_at":"2026-08-06T13:40:01.864747Z","submitted_at":"2025-08-24T03:17:50Z","title":"BudgetThinker: Empowering Budget-aware LLM Reasoning with Control Tokens","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-05T17:04:38.682766Z"},"links":{"citing_paper":"/paper/2508.17196"},"observation_digest":"sha256:676e9620674f55a27c8b2f9795711af467a5ba11fc3e97ed4321eac2e532fe8c","observation_id":"25887eae-b867-4a79-adab-3629de00185c","resolution":{"observed_at":"2026-08-05T17:04:39.327431Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:04:38.712796Z","title":"Gonzalez, Hao Zhang, and Ion Stoica","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.17196","last_updated":"2025-08-29T14:42:16Z","snapshot_observed_at":"2026-08-06T13:40:01.864747Z","submitted_at":"2025-08-24T03:17:50Z","title":"BudgetThinker: Empowering Budget-aware LLM Reasoning with Control Tokens","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-05T17:04:38.712796Z"},"links":{"citing_paper":"/paper/2508.17196"},"observation_digest":"sha256:6673a5c987c2884accbc1c40ed5d80ab14b53b4a60f40c855ba94c5ddfef61eb","observation_id":"d3ca1e46-f4c4-4435-8326-bf37a47a15aa","resolution":{"observed_at":"2026-08-05T17:04:38.712796Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:04:38.715134Z","title":"Bespoke-stratos: The unreasonable effectiveness of reasoning distillation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.17196","last_updated":"2025-08-29T14:42:16Z","snapshot_observed_at":"2026-08-06T13:40:01.864747Z","submitted_at":"2025-08-24T03:17:50Z","title":"BudgetThinker: Empowering Budget-aware LLM Reasoning with Control Tokens","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-05T17:04:38.715134Z"},"links":{"citing_paper":"/paper/2508.17196"},"observation_digest":"sha256:6674a7ed1360f98f40136c91755e6cfa765bfd9e362ae0148252a51e00838243","observation_id":"1dc51449-cff1-4f81-895d-aad15fa095ec","resolution":{"observed_at":"2026-08-05T17:04:38.715134Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:04:38.717331Z","title":"Numinamath","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.17196","last_updated":"2025-08-29T14:42:16Z","snapshot_observed_at":"2026-08-06T13:40:01.864747Z","submitted_at":"2025-08-24T03:17:50Z","title":"BudgetThinker: Empowering Budget-aware LLM Reasoning with Control Tokens","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-05T17:04:38.717331Z"},"links":{"citing_paper":"/paper/2508.17196"},"observation_digest":"sha256:d4307e74fa4cbb1728fc61983986c9f2cb82e4b4381c61f073dd161f34308007","observation_id":"97ee2066-07b5-41ca-8ac7-f0d32e2a08d8","resolution":{"observed_at":"2026-08-05T17:04:38.717331Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.11274","last_updated":"2026-04-17T08:29:27Z","snapshot_observed_at":"2026-07-06T21:25:03.247284Z","submitted_at":"2025-05-16T14:08:04Z","title":"SelfBudgeter: Adaptive Token Allocation for Efficient LLM Reasoning","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.11274","snapshot_observed_at":"2026-08-05T17:04:38.719466Z","title":"Selfbudgeter: Adaptive token allocation for efficient llm reasoning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.17196","last_updated":"2025-08-29T14:42:16Z","snapshot_observed_at":"2026-08-06T13:40:01.864747Z","submitted_at":"2025-08-24T03:17:50Z","title":"BudgetThinker: Empowering Budget-aware LLM Reasoning with Control Tokens","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-05T17:04:38.719466Z"},"links":{"cited_paper":"/paper/2505.11274","citing_paper":"/paper/2508.17196"},"observation_digest":"sha256:a2b3e789f2edd5d0166756f62c4b3508fc91ecc726cc416fa18261af1b241459","observation_id":"e72ac99b-f4bb-4580-ba65-e7b13df49899","resolution":{"observed_at":"2026-08-05T17:04:38.719466Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.20050","last_updated":"2023-05-31T17:24:00Z","snapshot_observed_at":"2026-08-05T13:11:04.104454Z","submitted_at":"2023-05-31T17:24:00Z","title":"Let's Verify Step by Step","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.20050","snapshot_observed_at":"2026-08-05T17:04:38.721727Z","title":"Let's verify step by step, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.17196","last_updated":"2025-08-29T14:42:16Z","snapshot_observed_at":"2026-08-06T13:40:01.864747Z","submitted_at":"2025-08-24T03:17:50Z","title":"BudgetThinker: Empowering Budget-aware LLM Reasoning with Control Tokens","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-05T17:04:38.721727Z"},"links":{"cited_paper":"/paper/2305.20050","citing_paper":"/paper/2508.17196"},"observation_digest":"sha256:8f562066897ac56f18d2e4015600d08a119b6fe098f1e3d23bf00e7ca2eee9b3","observation_id":"06f997c0-60ce-43cf-b4b7-0a9760b5afc3","resolution":{"observed_at":"2026-08-05T17:04:38.721727Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:04:39.491324Z","title":"The architectural implications of autonomous driving: Constraints and acceleration","venue":null,"work_id":"63e492b6-79da-41e3-b960-1013a06998fb","year":2018},"citing_paper":{"arxiv_id":"2508.17196","last_updated":"2025-08-29T14:42:16Z","snapshot_observed_at":"2026-08-06T13:40:01.864747Z","submitted_at":"2025-08-24T03:17:50Z","title":"BudgetThinker: Empowering Budget-aware LLM Reasoning with Control Tokens","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-05T17:04:38.723989Z"},"links":{"citing_paper":"/paper/2508.17196"},"observation_digest":"sha256:db323b7419970324f1e2ef89f799408c2c2b72fe5fc57d3cdd873bee56cd9297","observation_id":"b35214f4-8f33-47d5-b7b7-9a2d722fc549","resolution":{"observed_at":"2026-08-05T17:04:39.493656Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.19393","last_updated":"2025-03-01T06:07:39Z","snapshot_observed_at":"2026-07-06T20:29:11.710285Z","submitted_at":"2025-01-31T18:48:08Z","title":"s1: Simple test-time scaling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.19393","snapshot_observed_at":"2026-08-05T17:04:38.725923Z","title":"s1: Simple test-time scaling","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.17196","last_updated":"2025-08-29T14:42:16Z","snapshot_observed_at":"2026-08-06T13:40:01.864747Z","submitted_at":"2025-08-24T03:17:50Z","title":"BudgetThinker: Empowering Budget-aware LLM Reasoning with Control Tokens","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-05T17:04:38.725923Z"},"links":{"cited_paper":"/paper/2501.19393","citing_paper":"/paper/2508.17196"},"observation_digest":"sha256:695ce18df051a848976ffa4070266ff7b44bef5d11004e935842e3f43761727b","observation_id":"411fb3da-55d3-4c33-bfae-0177a5435045","resolution":{"observed_at":"2026-08-05T17:04:38.725923Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16720","last_updated":"2026-04-30T02:46:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-21T18:04:31Z","title":"OpenAI o1 System Card","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.16720","snapshot_observed_at":"2026-08-05T17:04:38.728192Z","title":"Openai o1 system card","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.17196","last_updated":"2025-08-29T14:42:16Z","snapshot_observed_at":"2026-08-06T13:40:01.864747Z","submitted_at":"2025-08-24T03:17:50Z","title":"BudgetThinker: Empowering Budget-aware LLM Reasoning with Control Tokens","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-05T17:04:38.728192Z"},"links":{"cited_paper":"/paper/2412.16720","citing_paper":"/paper/2508.17196"},"observation_digest":"sha256:6f0112ab094565c450388b42cfa3d885ee1c9a787f80fae78e2e68b24925c034","observation_id":"6d2059fe-60b5-424b-84b5-429b463f4985","resolution":{"observed_at":"2026-08-05T17:04:38.728192Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:04:39.484478Z","title":"Gpt-5 system card","venue":null,"work_id":"c0adb1c6-180d-47a0-bbf2-20f4233d2293","year":2025},"citing_paper":{"arxiv_id":"2508.17196","last_updated":"2025-08-29T14:42:16Z","snapshot_observed_at":"2026-08-06T13:40:01.864747Z","submitted_at":"2025-08-24T03:17:50Z","title":"BudgetThinker: Empowering Budget-aware LLM Reasoning with Control Tokens","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-05T17:04:38.730425Z"},"links":{"citing_paper":"/paper/2508.17196"},"observation_digest":"sha256:fb002be1f9beb57f57a9d59b4fd46156e57bc110f85fc8cdfe93775f6d8f023d","observation_id":"4f7f5531-785d-4893-af4e-3cb9aa6bb38a","resolution":{"observed_at":"2026-08-05T17:04:39.486979Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.13367","last_updated":"2025-04-17T22:16:30Z","snapshot_observed_at":"2026-08-05T06:40:23.483783Z","submitted_at":"2025-04-17T22:16:30Z","title":"THOUGHTTERMINATOR: Benchmarking, Calibrating, and Mitigating Overthinking in Reasoning Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.13367","snapshot_observed_at":"2026-08-05T17:04:38.732463Z","title":"Thoughtterminator: Benchmarking, calibrating, and mitigating overthinking in reasoning models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.17196","last_updated":"2025-08-29T14:42:16Z","snapshot_observed_at":"2026-08-06T13:40:01.864747Z","submitted_at":"2025-08-24T03:17:50Z","title":"BudgetThinker: Empowering Budget-aware LLM Reasoning with Control Tokens","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-05T17:04:38.732463Z"},"links":{"cited_paper":"/paper/2504.13367","citing_paper":"/paper/2508.17196"},"observation_digest":"sha256:5c07d7cb0bbab1857eeaba3c831cda83d05f5756acdf94e4608f914c286a072e","observation_id":"7efa6940-8689-4eaa-abf6-800d893ff98e","resolution":{"observed_at":"2026-08-05T17:04:38.732463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.07572","last_updated":"2025-03-10T17:40:43Z","snapshot_observed_at":"2026-08-06T13:33:50.894986Z","submitted_at":"2025-03-10T17:40:43Z","title":"Optimizing Test-Time Compute via Meta Reinforcement Fine-Tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.07572","snapshot_observed_at":"2026-08-05T17:04:38.734731Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.17196","last_updated":"2025-08-29T14:42:16Z","snapshot_observed_at":"2026-08-06T13:40:01.864747Z","submitted_at":"2025-08-24T03:17:50Z","title":"BudgetThinker: Empowering Budget-aware LLM Reasoning with Control Tokens","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-05T17:04:38.734731Z"},"links":{"cited_paper":"/paper/2503.07572","citing_paper":"/paper/2508.17196"},"observation_digest":"sha256:c194fd5507bf45001c5eafffb7d88b9e3b8ac4acacf308742f0899aee90423c3","observation_id":"65b7ebd3-8f31-4636-ab99-73c31d9664ff","resolution":{"observed_at":"2026-08-05T17:04:38.734731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-05T17:04:38.737073Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.17196","last_updated":"2025-08-29T14:42:16Z","snapshot_observed_at":"2026-08-06T13:40:01.864747Z","submitted_at":"2025-08-24T03:17:50Z","title":"BudgetThinker: Empowering Budget-aware LLM Reasoning with Control Tokens","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-05T17:04:38.737073Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2508.17196"},"observation_digest":"sha256:0d777640536bcbeb8b52e77f9480d672969f5092cce556b55f71e2a31a23cec7","observation_id":"b58e26e0-1921-47df-b3ea-9bd3f3c0d9cb","resolution":{"observed_at":"2026-08-05T17:04:38.737073Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07615","last_updated":"2025-04-14T15:15:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-10T10:05:15Z","title":"VLM-R1: A Stable and Generalizable R1-style Large Vision-Language Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.07615","snapshot_observed_at":"2026-08-05T17:04:38.739210Z","title":"Vlm-r1: A stable and generalizable r1-style large vision-language model","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.17196","last_updated":"2025-08-29T14:42:16Z","snapshot_observed_at":"2026-08-06T13:40:01.864747Z","submitted_at":"2025-08-24T03:17:50Z","title":"BudgetThinker: Empowering Budget-aware LLM Reasoning with Control Tokens","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-05T17:04:38.739210Z"},"links":{"cited_paper":"/paper/2504.07615","citing_paper":"/paper/2508.17196"},"observation_digest":"sha256:34fe6c0b4fc0a180bfd43c099c5d03b2c73492110777df06d1b2b60ae51f6e09","observation_id":"0e87eb0b-6014-49ed-9520-7068b771d9c2","resolution":{"observed_at":"2026-08-05T17:04:38.739210Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.14350","last_updated":"2025-05-21T09:05:29Z","snapshot_observed_at":"2026-07-06T21:11:58.671097Z","submitted_at":"2025-04-19T16:32:28Z","title":"An Empirical Study of LLM Reasoning Ability Under Strict Output Length Constraint","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.14350","snapshot_observed_at":"2026-08-05T17:04:38.741449Z","title":"An empirical study of llm reasoning ability under strict output length constraint","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.17196","last_updated":"2025-08-29T14:42:16Z","snapshot_observed_at":"2026-08-06T13:40:01.864747Z","submitted_at":"2025-08-24T03:17:50Z","title":"BudgetThinker: Empowering Budget-aware LLM Reasoning with Control Tokens","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-05T17:04:38.741449Z"},"links":{"cited_paper":"/paper/2504.14350","citing_paper":"/paper/2508.17196"},"observation_digest":"sha256:745eebb137497cef118f3bea7bf867835afbc05003b6e7a9640e5269f0985e24","observation_id":"db8c0aa0-73e1-4741-8640-a315ed9b192a","resolution":{"observed_at":"2026-08-05T17:04:38.741449Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:04:38.744028Z","title":"Reason-rft: Reinforcement fine-tuning for visual reasoning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.17196","last_updated":"2025-08-29T14:42:16Z","snapshot_observed_at":"2026-08-06T13:40:01.864747Z","submitted_at":"2025-08-24T03:17:50Z","title":"BudgetThinker: Empowering Budget-aware LLM Reasoning with Control Tokens","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-05T17:04:38.744028Z"},"links":{"citing_paper":"/paper/2508.17196"},"observation_digest":"sha256:187f5b2cb3ebb1d0ec301fffb0c0e0a6ed8336ab9791df5c78f1e01e0c2664c6","observation_id":"f30fbf3b-bf3e-489a-8022-6392071fd94c","resolution":{"observed_at":"2026-08-05T17:04:38.744028Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.20534","last_updated":"2026-02-03T04:57:00Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-28T05:35:43Z","title":"Kimi K2: Open Agentic Intelligence","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.20534","snapshot_observed_at":"2026-08-05T17:04:38.746051Z","title":"Kimi k2: Open agentic intelligence, 2025 a","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.17196","last_updated":"2025-08-29T14:42:16Z","snapshot_observed_at":"2026-08-06T13:40:01.864747Z","submitted_at":"2025-08-24T03:17:50Z","title":"BudgetThinker: Empowering Budget-aware LLM Reasoning with Control Tokens","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-05T17:04:38.746051Z"},"links":{"cited_paper":"/paper/2507.20534","citing_paper":"/paper/2508.17196"},"observation_digest":"sha256:388fbd91efb80de4def6197ffd578d0d62fed2c88a92f2e9ff129e926ac08feb","observation_id":"641ffec1-a207-40c3-8eae-fc6df71fa728","resolution":{"observed_at":"2026-08-05T17:04:38.746051Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12599","last_updated":"2025-06-03T02:14:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T02:48:14Z","title":"Kimi k1.5: Scaling Reinforcement Learning with LLMs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12599","snapshot_observed_at":"2026-08-05T17:04:38.748172Z","title":"Kimi k1.5: Scaling reinforcement learning with llms, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.17196","last_updated":"2025-08-29T14:42:16Z","snapshot_observed_at":"2026-08-06T13:40:01.864747Z","submitted_at":"2025-08-24T03:17:50Z","title":"BudgetThinker: Empowering Budget-aware LLM Reasoning with Control Tokens","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-05T17:04:38.748172Z"},"links":{"cited_paper":"/paper/2501.12599","citing_paper":"/paper/2508.17196"},"observation_digest":"sha256:3a0e1d7b76b0688ae2bbfe1d9a962feed1577e0add58e7a331cf515a418895fc","observation_id":"b36c6317-2cbe-47cb-bb37-f2efb5ec6bce","resolution":{"observed_at":"2026-08-05T17:04:38.748172Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:04:39.477519Z","title":"Sky-t1: Train your own o1 preview model within \\ 450","venue":null,"work_id":"3e39859e-6185-4b2f-8bc5-5ad419a58d49","year":2025},"citing_paper":{"arxiv_id":"2508.17196","last_updated":"2025-08-29T14:42:16Z","snapshot_observed_at":"2026-08-06T13:40:01.864747Z","submitted_at":"2025-08-24T03:17:50Z","title":"BudgetThinker: Empowering Budget-aware LLM Reasoning with Control Tokens","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-05T17:04:38.750609Z"},"links":{"citing_paper":"/paper/2508.17196"},"observation_digest":"sha256:156874be2f5905344fb4aede64b79c18978ff3d3b61e8b01a5b882a5c2292432","observation_id":"8125e605-7a69-4846-8e88-4c7acd54a07a","resolution":{"observed_at":"2026-08-05T17:04:39.480086Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.15335","last_updated":"2025-04-12T02:22:25Z","snapshot_observed_at":"2026-08-04T19:11:25.209799Z","submitted_at":"2025-02-21T09:39:27Z","title":"Stepwise Informativeness Search for Efficient and Effective LLM Reasoning","version":2},"cited_work":{"arxiv_id":"2502.15335","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.15335","snapshot_observed_at":"2026-08-05T17:04:39.162474Z","title":"Stepwise Informativeness Search for Efficient and Effective LLM Reasoning","venue":"cs.CL","work_id":"e9fae354-6943-4bdd-844e-945c62931cfc","year":2025},"citing_paper":{"arxiv_id":"2508.17196","last_updated":"2025-08-29T14:42:16Z","snapshot_observed_at":"2026-08-06T13:40:01.864747Z","submitted_at":"2025-08-24T03:17:50Z","title":"BudgetThinker: Empowering Budget-aware LLM Reasoning with Control Tokens","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-05T17:04:38.752682Z"},"links":{"cited_paper":"/paper/2502.15335","citing_paper":"/paper/2508.17196"},"observation_digest":"sha256:5e47173f42883c450a294e2afdb39db8a38ffc4c71222b72da0844a1b4c2f819","observation_id":"563dd81d-681f-44f1-827f-8fc0628fd5a9","resolution":{"observed_at":"2026-08-05T17:04:39.167050Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.13457","last_updated":"2025-02-12T02:52:25Z","snapshot_observed_at":"2026-08-05T11:12:11.253870Z","submitted_at":"2024-08-24T04:03:35Z","title":"Make Every Penny Count: Difficulty-Adaptive Self-Consistency for Cost-Efficient Reasoning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.13457","snapshot_observed_at":"2026-08-05T17:04:38.754895Z","title":"Make every penny count: Difficulty-adaptive self-consistency for cost-efficient reasoning, 2025 b","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.17196","last_updated":"2025-08-29T14:42:16Z","snapshot_observed_at":"2026-08-06T13:40:01.864747Z","submitted_at":"2025-08-24T03:17:50Z","title":"BudgetThinker: Empowering Budget-aware LLM Reasoning with Control Tokens","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-05T17:04:38.754895Z"},"links":{"cited_paper":"/paper/2408.13457","citing_paper":"/paper/2508.17196"},"observation_digest":"sha256:e19ff4d2efe60decb1848344ec91c03f8cd0e137aaa6da777c83906b0c4b7c5c","observation_id":"56ce4c99-e1bb-4475-8bc7-8910c036d346","resolution":{"observed_at":"2026-08-05T17:04:38.754895Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:04:38.757382Z","title":"Adaptivenet: Post-deployment neural architecture adaptation for diverse edge environments","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.17196","last_updated":"2025-08-29T14:42:16Z","snapshot_observed_at":"2026-08-06T13:40:01.864747Z","submitted_at":"2025-08-24T03:17:50Z","title":"BudgetThinker: Empowering Budget-aware LLM Reasoning with Control Tokens","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-05T17:04:38.757382Z"},"links":{"citing_paper":"/paper/2508.17196"},"observation_digest":"sha256:ffb9f14a7be737c135d0f772a0e97cb65f3a472a6783ee84b1054ee07a834929","observation_id":"a21d9a64-6154-4233-9698-442a7b3291ff","resolution":{"observed_at":"2026-08-05T17:04:38.757382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.15758","last_updated":"2025-08-14T08:13:36Z","snapshot_observed_at":"2026-08-06T15:21:51.510061Z","submitted_at":"2025-07-21T16:14:41Z","title":"LAPO: Internalizing Reasoning Efficiency via Length-Adaptive Policy Optimization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.15758","snapshot_observed_at":"2026-08-05T17:04:38.759385Z","title":"Lapo: Internalizing reasoning efficiency via length-adaptive policy optimization","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.17196","last_updated":"2025-08-29T14:42:16Z","snapshot_observed_at":"2026-08-06T13:40:01.864747Z","submitted_at":"2025-08-24T03:17:50Z","title":"BudgetThinker: Empowering Budget-aware LLM Reasoning with Control Tokens","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-05T17:04:38.759385Z"},"links":{"cited_paper":"/paper/2507.15758","citing_paper":"/paper/2508.17196"},"observation_digest":"sha256:a4d4f39d759de15fecaa9592639a85183042365d18ba4a2e86615aef1b7a77db","observation_id":"2fe9cc27-c640-41c8-b2d0-218cc82279ba","resolution":{"observed_at":"2026-08-05T17:04:38.759385Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:04:38.761729Z","title":"Tokenskip: Controllable chain-of-thought compression in llms, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.17196","last_updated":"2025-08-29T14:42:16Z","snapshot_observed_at":"2026-08-06T13:40:01.864747Z","submitted_at":"2025-08-24T03:17:50Z","title":"BudgetThinker: Empowering Budget-aware LLM Reasoning with Control Tokens","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-05T17:04:38.761729Z"},"links":{"citing_paper":"/paper/2508.17196"},"observation_digest":"sha256:b0e48099cbbea4b393359e84770a4e094cd53e8a53ed845763b948a1c35bb306","observation_id":"bb8a16a1-50f0-459d-a38c-91a0e3c342aa","resolution":{"observed_at":"2026-08-05T17:04:38.761729Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.11284","last_updated":"2025-01-20T05:44:01Z","snapshot_observed_at":"2026-08-06T13:30:45.600197Z","submitted_at":"2025-01-20T05:44:01Z","title":"RedStar: Does Scaling Long-CoT Data Unlock Better Slow-Reasoning Systems?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.11284","snapshot_observed_at":"2026-08-05T17:04:38.763726Z","title":"Redstar: Does scaling long-cot data unlock better slow-reasoning systems?, 2025 a","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.17196","last_updated":"2025-08-29T14:42:16Z","snapshot_observed_at":"2026-08-06T13:40:01.864747Z","submitted_at":"2025-08-24T03:17:50Z","title":"BudgetThinker: Empowering Budget-aware LLM Reasoning with Control Tokens","version":2},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-05T17:04:38.763726Z"},"links":{"cited_paper":"/paper/2501.11284","citing_paper":"/paper/2508.17196"},"observation_digest":"sha256:3ab70a89a62d070f56c515d05e48091480108b29f027f85d1448398780cf3e9d","observation_id":"3032dd93-6f49-4b75-83cc-bdcb605a58fb","resolution":{"observed_at":"2026-08-05T17:04:38.763726Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.18600","last_updated":"2025-03-03T17:08:21Z","snapshot_observed_at":"2026-08-06T08:00:07.411397Z","submitted_at":"2025-02-25T19:36:06Z","title":"Chain of Draft: Thinking Faster by Writing Less","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.18600","snapshot_observed_at":"2026-08-05T17:04:38.765954Z","title":"Chain of draft: Thinking faster by writing less","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.17196","last_updated":"2025-08-29T14:42:16Z","snapshot_observed_at":"2026-08-06T13:40:01.864747Z","submitted_at":"2025-08-24T03:17:50Z","title":"BudgetThinker: Empowering Budget-aware LLM Reasoning with Control Tokens","version":2},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-05T17:04:38.765954Z"},"links":{"cited_paper":"/paper/2502.18600","citing_paper":"/paper/2508.17196"},"observation_digest":"sha256:4c4ed9b97bcf16716de155432235eeccd001ecfe2bfbbc63c8c9effac6816f87","observation_id":"fd6a8083-be1f-4946-a608-33b8278cf207","resolution":{"observed_at":"2026-08-05T17:04:38.765954Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-08-05T17:04:38.768559Z","title":"Qwen3 technical report, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.17196","last_updated":"2025-08-29T14:42:16Z","snapshot_observed_at":"2026-08-06T13:40:01.864747Z","submitted_at":"2025-08-24T03:17:50Z","title":"BudgetThinker: Empowering Budget-aware LLM Reasoning with Control Tokens","version":2},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-05T17:04:38.768559Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2508.17196"},"observation_digest":"sha256:e8bb2a8ef22b95f6a7482b644691bcecdf9306a2f5da15e24b1c61d0164085f8","observation_id":"c2cdb2ce-22c7-4c2e-92d7-30f7ea3c146d","resolution":{"observed_at":"2026-08-05T17:04:38.768559Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03387","last_updated":"2025-07-29T16:23:02Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-05T17:23:45Z","title":"LIMO: Less is More for Reasoning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.03387","snapshot_observed_at":"2026-08-05T17:04:38.770613Z","title":"Limo: Less is more for reasoning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.17196","last_updated":"2025-08-29T14:42:16Z","snapshot_observed_at":"2026-08-06T13:40:01.864747Z","submitted_at":"2025-08-24T03:17:50Z","title":"BudgetThinker: Empowering Budget-aware LLM Reasoning with Control Tokens","version":2},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-05T17:04:38.770613Z"},"links":{"cited_paper":"/paper/2502.03387","citing_paper":"/paper/2508.17196"},"observation_digest":"sha256:4041142e6b3bb3c97b0b7174076dde281e72fdf5412efd83134640a272a68802","observation_id":"b26e41b0-38f5-4b16-9e58-04f17ab8c9f6","resolution":{"observed_at":"2026-08-05T17:04:38.770613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14476","last_updated":"2025-05-20T01:37:34Z","snapshot_observed_at":"2026-08-02T01:40:54.187278Z","submitted_at":"2025-03-18T17:49:06Z","title":"DAPO: An Open-Source LLM Reinforcement Learning System at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.14476","snapshot_observed_at":"2026-08-05T17:04:38.772557Z","title":"Dapo: An open-source llm reinforcement learning system at scale, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.17196","last_updated":"2025-08-29T14:42:16Z","snapshot_observed_at":"2026-08-06T13:40:01.864747Z","submitted_at":"2025-08-24T03:17:50Z","title":"BudgetThinker: Empowering Budget-aware LLM Reasoning with Control Tokens","version":2},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-05T17:04:38.772557Z"},"links":{"cited_paper":"/paper/2503.14476","citing_paper":"/paper/2508.17196"},"observation_digest":"sha256:11e618ca8b6d9c912e05f086b8ff35f39f2ff418710e0c663bc0602566014862","observation_id":"2f809f70-5635-4a15-be5b-fa4eb7bd7296","resolution":{"observed_at":"2026-08-05T17:04:38.772557Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.17974","last_updated":"2025-01-31T16:06:26Z","snapshot_observed_at":"2026-07-06T20:28:09.807683Z","submitted_at":"2025-01-29T20:20:48Z","title":"Think Smarter not Harder: Adaptive Reasoning with Inference Aware Optimization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.17974","snapshot_observed_at":"2026-08-05T17:04:38.774765Z","title":"Think smarter not harder: Adaptive reasoning with inference aware optimization, 2025 b","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.17196","last_updated":"2025-08-29T14:42:16Z","snapshot_observed_at":"2026-08-06T13:40:01.864747Z","submitted_at":"2025-08-24T03:17:50Z","title":"BudgetThinker: Empowering Budget-aware LLM Reasoning with Control Tokens","version":2},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-05T17:04:38.774765Z"},"links":{"cited_paper":"/paper/2501.17974","citing_paper":"/paper/2508.17196"},"observation_digest":"sha256:9939f17225306ed2a1b2930c3b777ba41530a74584b24b5050b60c159f571352","observation_id":"d42c7c33-f588-49d8-be71-c11806c4d052","resolution":{"observed_at":"2026-08-05T17:04:38.774765Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:04:38.777020Z","title":"Pruning the unsurprising: Efficient code reasoning via first-token surprisal, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.17196","last_updated":"2025-08-29T14:42:16Z","snapshot_observed_at":"2026-08-06T13:40:01.864747Z","submitted_at":"2025-08-24T03:17:50Z","title":"BudgetThinker: Empowering Budget-aware LLM Reasoning with Control Tokens","version":2},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-05T17:04:38.777020Z"},"links":{"citing_paper":"/paper/2508.17196"},"observation_digest":"sha256:38ffdac6383bc13ccac0796c48e00303381c237893a60dd8a1a7ddff302bd75f","observation_id":"5f2b47e3-d6a4-4e9f-ba3b-008858b8ebd6","resolution":{"observed_at":"2026-08-05T17:04:38.777020Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.09662","last_updated":"2025-07-13T14:51:59Z","snapshot_observed_at":"2026-07-06T21:56:25.425745Z","submitted_at":"2025-07-13T14:51:59Z","title":"Towards Concise and Adaptive Thinking in Large Reasoning Models: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.09662","snapshot_observed_at":"2026-08-05T17:04:38.779777Z","title":"Towards concise and adaptive thinking in large reasoning models: A survey, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.17196","last_updated":"2025-08-29T14:42:16Z","snapshot_observed_at":"2026-08-06T13:40:01.864747Z","submitted_at":"2025-08-24T03:17:50Z","title":"BudgetThinker: Empowering Budget-aware LLM Reasoning with Control Tokens","version":2},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-05T17:04:38.779777Z"},"links":{"cited_paper":"/paper/2507.09662","citing_paper":"/paper/2508.17196"},"observation_digest":"sha256:f44039a9fd1854368d8f7f3aa814a13c3b203c0d53c9321f7f6f3e8bcd0b12e8","observation_id":"039f2c5e-7771-4517-98aa-e509f67f7d66","resolution":{"observed_at":"2026-08-05T17:04:38.779777Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:04:38.781936Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.17196","last_updated":"2025-08-29T14:42:16Z","snapshot_observed_at":"2026-08-06T13:40:01.864747Z","submitted_at":"2025-08-24T03:17:50Z","title":"BudgetThinker: Empowering Budget-aware LLM Reasoning with Control Tokens","version":2},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-05T17:04:38.781936Z"},"links":{"citing_paper":"/paper/2508.17196"},"observation_digest":"sha256:337708769a6f4ac46bf4d269f91ed6649ecf38dc9934d17067e6259af55b061a","observation_id":"c6129e36-9086-4640-9ecc-e966eddf2dd9","resolution":{"observed_at":"2026-08-05T17:04:38.781936Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:04:38.784543Z","title":"@esa (Ref","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.17196","last_updated":"2025-08-29T14:42:16Z","snapshot_observed_at":"2026-08-06T13:40:01.864747Z","submitted_at":"2025-08-24T03:17:50Z","title":"BudgetThinker: Empowering Budget-aware LLM Reasoning with Control Tokens","version":2},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-05T17:04:38.784543Z"},"links":{"citing_paper":"/paper/2508.17196"},"observation_digest":"sha256:0830a3fd4337565106bf4d9958d52a449c1d926d936927fd37a89172b5b8ab4f","observation_id":"aaf54e79-f677-410b-8440-0ec58dd4a2af","resolution":{"observed_at":"2026-08-05T17:04:38.784543Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:04:38.787037Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.17196","last_updated":"2025-08-29T14:42:16Z","snapshot_observed_at":"2026-08-06T13:40:01.864747Z","submitted_at":"2025-08-24T03:17:50Z","title":"BudgetThinker: Empowering Budget-aware LLM Reasoning with Control Tokens","version":2},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-05T17:04:38.787037Z"},"links":{"citing_paper":"/paper/2508.17196"},"observation_digest":"sha256:c033570f9cc0ace25029cb6f9eb9bb69eb525adda0fb7bd9993c3385ed6763cf","observation_id":"f0227f3e-e182-483e-a789-6282d0c60e33","resolution":{"observed_at":"2026-08-05T17:04:38.787037Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:04:38.789376Z","title":"thinking","venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2508.17196","last_updated":"2025-08-29T14:42:16Z","snapshot_observed_at":"2026-08-06T13:40:01.864747Z","submitted_at":"2025-08-24T03:17:50Z","title":"BudgetThinker: Empowering Budget-aware LLM Reasoning with Control Tokens","version":2},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-05T17:04:38.789376Z"},"links":{"citing_paper":"/paper/2508.17196"},"observation_digest":"sha256:34f9f48609e68e572b69dbb6bf2683ba9f4248de3fa702fe5b7c958b051bb37c","observation_id":"d3934f62-c868-477d-b148-4eb6be7c72d9","resolution":{"observed_at":"2026-08-05T17:04:38.789376Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2508.17196","last_updated":"2025-08-29T14:42:16Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-06T13:40:01.864747Z","submitted_at":"2025-08-24T03:17:50Z","title":"BudgetThinker: Empowering Budget-aware LLM Reasoning with Control Tokens"},"reference_resolution":{"displayed":51,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":45,"verified_exact":1,"verified_fuzzy":4},"total_outbound_references":51},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 51 of 51 outbound references and 8 inbound Pith citation observations for arXiv:2508.17196."}