{"as_of":"2026-08-07T10:35:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:6f8acc22f9a0ee88279b7a2bcfe2aa1bc1c80933c5d595dc347c2158c329a2d3","coverage":[{"denominator":51,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":51,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T21:45:11.904232Z","state":"measured"},{"denominator":56,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":56,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":5,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":5,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T17:53:45.466886Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T10:39:45.836079Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.23840","last_updated":"2025-06-30T13:30:33Z","snapshot_observed_at":"2026-08-07T09:54:31.000434Z","submitted_at":"2025-06-30T13:30:33Z","title":"Do Thinking Tokens Help or Trap? Towards More Efficient Large Reasoning Model","version":1},"cited_work":{"arxiv_id":"2506.23840","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.23840","snapshot_observed_at":"2026-07-04T10:39:45.836079Z","title":"emnlp-main.232/","venue":null,"work_id":"5c46ef72-c90c-4a57-892b-d0d41c19a029","year":2023},"citing_paper":{"arxiv_id":"2503.09567","last_updated":"2025-07-18T15:57:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-12T17:35:03Z","title":"Towards Reasoning Era: A Survey of Long Chain-of-Thought for Reasoning Large Language Models","version":5},"reference_index":156,"source":"pdf_text","source_observed_at":"2026-05-12T08:40:40.910461Z"},"links":{"cited_paper":"/paper/2506.23840","citing_paper":"/paper/2503.09567"},"observation_digest":"sha256:d0ac1d7d99e11d72854bf6a1ddbb8ecf2c30ff87af6541398bd36d575b9224a5","observation_id":"21e56c44-1e3a-4ffd-ac55-aa98adf9a977","resolution":{"observed_at":"2026-05-12T08:40:42.125528Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.23840","last_updated":"2025-06-30T13:30:33Z","snapshot_observed_at":"2026-08-07T09:54:31.000434Z","submitted_at":"2025-06-30T13:30:33Z","title":"Do Thinking Tokens Help or Trap? Towards More Efficient Large Reasoning Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.23840","snapshot_observed_at":"2026-08-06T17:53:45.466886Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.09662","last_updated":"2025-07-13T14:51:59Z","snapshot_observed_at":"2026-08-07T01:15:50.475193Z","submitted_at":"2025-07-13T14:51:59Z","title":"Towards Concise and Adaptive Thinking in Large Reasoning Models: A Survey","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-06T17:53:45.466886Z"},"links":{"cited_paper":"/paper/2506.23840","citing_paper":"/paper/2507.09662"},"observation_digest":"sha256:dfe0e0c2001ff004cb563992e3fee5c967ac02b21da7bea07a1ce481df256950","observation_id":"7f79b699-5894-46b6-a425-456a09a5a222","resolution":{"observed_at":"2026-08-06T17:53:45.466886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.23840","last_updated":"2025-06-30T13:30:33Z","snapshot_observed_at":"2026-08-07T09:54:31.000434Z","submitted_at":"2025-06-30T13:30:33Z","title":"Do Thinking Tokens Help or Trap? Towards More Efficient Large Reasoning Model","version":1},"cited_work":{"arxiv_id":"2506.23840","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.23840","snapshot_observed_at":"2026-07-04T10:39:45.836079Z","title":"emnlp-main.232/","venue":null,"work_id":"5c46ef72-c90c-4a57-892b-d0d41c19a029","year":2023},"citing_paper":{"arxiv_id":"2603.12529","last_updated":"2026-05-14T02:32:10Z","snapshot_observed_at":"2026-07-06T22:48:53.198077Z","submitted_at":"2026-03-13T00:07:18Z","title":"TERMINATOR: Learning Optimal Exit Points for Early Stopping in Chain-of-Thought Reasoning","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-15T11:16:04.614045Z"},"links":{"cited_paper":"/paper/2506.23840","citing_paper":"/paper/2603.12529"},"observation_digest":"sha256:c16557ee90b37c39ad304b8e4ae53eb1a9472eb82ddcbbbb4f72691f3d3075b5","observation_id":"a17936e1-9119-4918-ba97-0e95ef17d1d8","resolution":{"observed_at":"2026-05-15T11:19:58.197620Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.23840","last_updated":"2025-06-30T13:30:33Z","snapshot_observed_at":"2026-08-07T09:54:31.000434Z","submitted_at":"2025-06-30T13:30:33Z","title":"Do Thinking Tokens Help or Trap? Towards More Efficient Large Reasoning Model","version":1},"cited_work":{"arxiv_id":"2506.23840","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.23840","snapshot_observed_at":"2026-07-04T10:39:45.836079Z","title":"emnlp-main.232/","venue":null,"work_id":"5c46ef72-c90c-4a57-892b-d0d41c19a029","year":2023},"citing_paper":{"arxiv_id":"2606.23181","last_updated":"2026-06-22T11:24:59Z","snapshot_observed_at":"2026-08-03T02:26:00.985255Z","submitted_at":"2026-06-22T11:24:59Z","title":"DART: Draft-Agreement Routing for Training-Free Adaptive Thinking Budgets in Hybrid Reasoning Models","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-06-26T08:35:36.580490Z"},"links":{"cited_paper":"/paper/2506.23840","citing_paper":"/paper/2606.23181"},"observation_digest":"sha256:90e290f9f45055fea2976518f14c64bddfbb2778cbe011f8524a634b8cf7cb2e","observation_id":"03e1983f-45d2-498f-a342-ce74e15f612e","resolution":{"observed_at":"2026-07-04T10:39:45.837701Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.23840","last_updated":"2025-06-30T13:30:33Z","snapshot_observed_at":"2026-08-07T09:54:31.000434Z","submitted_at":"2025-06-30T13:30:33Z","title":"Do Thinking Tokens Help or Trap? Towards More Efficient Large Reasoning Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.23840","snapshot_observed_at":"2026-08-02T07:57:24.437765Z","title":"Do thinking tokens help or trap? Towards more efficient large reasoning models.arXiv preprint arXiv:2506.23840, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.20524","last_updated":"2026-07-09T07:04:07Z","snapshot_observed_at":"2026-08-07T09:55:03.217073Z","submitted_at":"2026-07-09T07:04:07Z","title":"Attention Degradation, Function Token Anchoring, and the Limits of Attention-Based Intervention in Large Language Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-02T07:57:24.437765Z"},"links":{"cited_paper":"/paper/2506.23840","citing_paper":"/paper/2607.20524"},"observation_digest":"sha256:eeda825028d3e098aac29f9b7ac809c970985216f1f602993915aedcc5ed396a","observation_id":"67fb104e-45fe-405a-bb69-05330d975857","resolution":{"observed_at":"2026-08-02T07:57:24.437765Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2506.23840/citation-record","integrity":"/paper/2506.23840/integrity","json":"/paper/2506.23840/citation-record.json","paper":"/paper/2506.23840"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:45:06.743591Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.23840","last_updated":"2025-06-30T13:30:33Z","snapshot_observed_at":"2026-08-07T09:54:31.000434Z","submitted_at":"2025-06-30T13:30:33Z","title":"Do Thinking Tokens Help or Trap? Towards More Efficient Large Reasoning Model","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:06.743591Z"},"links":{"citing_paper":"/paper/2506.23840"},"observation_digest":"sha256:f31ac5f15ec77c4b7d8b682e0e0cfece0afaf7d75a58397c4d5d42344cb4b19b","observation_id":"68208e15-b1b8-43ee-b6f1-51357d229694","resolution":{"observed_at":"2026-08-06T21:45:06.743591Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:45:06.852222Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.23840","last_updated":"2025-06-30T13:30:33Z","snapshot_observed_at":"2026-08-07T09:54:31.000434Z","submitted_at":"2025-06-30T13:30:33Z","title":"Do Thinking Tokens Help or Trap? Towards More Efficient Large Reasoning Model","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:06.852222Z"},"links":{"citing_paper":"/paper/2506.23840"},"observation_digest":"sha256:34687642f290716637b6f98c5e19822c7f8ff5ce367480502a664d826e0b529e","observation_id":"421e1458-fb18-4d8f-9a94-de25bac0f89f","resolution":{"observed_at":"2026-08-06T21:45:06.852222Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.04697","last_updated":"2025-10-03T01:55:58Z","snapshot_observed_at":"2026-08-06T08:53:09.095000Z","submitted_at":"2025-03-06T18:43:29Z","title":"L1: Controlling How Long A Reasoning Model Thinks With Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.04697","snapshot_observed_at":"2026-08-06T21:45:06.919394Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23840","last_updated":"2025-06-30T13:30:33Z","snapshot_observed_at":"2026-08-07T09:54:31.000434Z","submitted_at":"2025-06-30T13:30:33Z","title":"Do Thinking Tokens Help or Trap? Towards More Efficient Large Reasoning Model","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:06.919394Z"},"links":{"cited_paper":"/paper/2503.04697","citing_paper":"/paper/2506.23840"},"observation_digest":"sha256:95d8af1cfc739554bc1dfcd1b5f79fb5df74400adf6f1fb94a66e255161789b9","observation_id":"2ceec2c4-6c8e-4bd7-9574-2c20eab7f3f3","resolution":{"observed_at":"2026-08-06T21:45:06.919394Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:45:06.994065Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23840","last_updated":"2025-06-30T13:30:33Z","snapshot_observed_at":"2026-08-07T09:54:31.000434Z","submitted_at":"2025-06-30T13:30:33Z","title":"Do Thinking Tokens Help or Trap? Towards More Efficient Large Reasoning Model","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:06.994065Z"},"links":{"citing_paper":"/paper/2506.23840"},"observation_digest":"sha256:e5b952f9fdfe2e09134fcd50ff4a9ec0c9f4553dccc78133f43a2fbca7dd10bf","observation_id":"894e88e7-e63a-4937-b84f-7455b006b3cc","resolution":{"observed_at":"2026-08-06T21:45:06.994065Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.21187","last_updated":"2025-02-01T07:57:37Z","snapshot_observed_at":"2026-08-01T16:43:44.704797Z","submitted_at":"2024-12-30T18:55:12Z","title":"Do NOT Think That Much for 2+3=? On the Overthinking of o1-Like LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.21187","snapshot_observed_at":"2026-08-06T21:45:07.152919Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23840","last_updated":"2025-06-30T13:30:33Z","snapshot_observed_at":"2026-08-07T09:54:31.000434Z","submitted_at":"2025-06-30T13:30:33Z","title":"Do Thinking Tokens Help or Trap? Towards More Efficient Large Reasoning Model","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:07.152919Z"},"links":{"cited_paper":"/paper/2412.21187","citing_paper":"/paper/2506.23840"},"observation_digest":"sha256:ca1952ea560288cf7a26bfb1cbef34112c750f1d1870c5b903b534c95142891d","observation_id":"2bfbd6ec-86c4-4971-939e-3e10d12b2ef0","resolution":{"observed_at":"2026-08-06T21:45:07.152919Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13260","last_updated":"2025-02-18T20:04:51Z","snapshot_observed_at":"2026-08-04T20:10:01.869851Z","submitted_at":"2025-02-18T20:04:51Z","title":"Stepwise Perplexity-Guided Refinement for Efficient Chain-of-Thought Reasoning in Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13260","snapshot_observed_at":"2026-08-06T21:45:07.266788Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23840","last_updated":"2025-06-30T13:30:33Z","snapshot_observed_at":"2026-08-07T09:54:31.000434Z","submitted_at":"2025-06-30T13:30:33Z","title":"Do Thinking Tokens Help or Trap? Towards More Efficient Large Reasoning Model","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:07.266788Z"},"links":{"cited_paper":"/paper/2502.13260","citing_paper":"/paper/2506.23840"},"observation_digest":"sha256:b92a7d7e4dabdcef07cd848e4744c1124f64a2f0d0e8aae18e05ed134ad4c3d3","observation_id":"6a1d8979-ccc5-46a8-9fa4-e5d23aadb2ba","resolution":{"observed_at":"2026-08-06T21:45:07.266788Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-06T21:45:07.340144Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23840","last_updated":"2025-06-30T13:30:33Z","snapshot_observed_at":"2026-08-07T09:54:31.000434Z","submitted_at":"2025-06-30T13:30:33Z","title":"Do Thinking Tokens Help or Trap? Towards More Efficient Large Reasoning Model","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:07.340144Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2506.23840"},"observation_digest":"sha256:224e7c3e11f8128075163f040923f21d40fe94e2ede4c781bcf86b427427bc04","observation_id":"b582f135-88a0-46b0-8295-7d6e1535d5f9","resolution":{"observed_at":"2026-08-06T21:45:07.340144Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.13379","last_updated":"2025-06-26T14:06:49Z","snapshot_observed_at":"2026-07-06T21:26:25.429980Z","submitted_at":"2025-05-19T17:24:16Z","title":"Thinkless: LLM Learns When to Think","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.13379","snapshot_observed_at":"2026-08-06T21:45:07.494215Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23840","last_updated":"2025-06-30T13:30:33Z","snapshot_observed_at":"2026-08-07T09:54:31.000434Z","submitted_at":"2025-06-30T13:30:33Z","title":"Do Thinking Tokens Help or Trap? Towards More Efficient Large Reasoning Model","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:07.494215Z"},"links":{"cited_paper":"/paper/2505.13379","citing_paper":"/paper/2506.23840"},"observation_digest":"sha256:b287fb34b00e35fb95f2325b1aef133377aa3a330ba129de39888253223cd99c","observation_id":"65dfbec1-48ed-4253-ab04-18b7438fc778","resolution":{"observed_at":"2026-08-06T21:45:07.494215Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:45:07.590372Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23840","last_updated":"2025-06-30T13:30:33Z","snapshot_observed_at":"2026-08-07T09:54:31.000434Z","submitted_at":"2025-06-30T13:30:33Z","title":"Do Thinking Tokens Help or Trap? Towards More Efficient Large Reasoning Model","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:07.590372Z"},"links":{"citing_paper":"/paper/2506.23840"},"observation_digest":"sha256:2a8652f40de5e12d9e11dc6d680ae243c5378f871064d4f7fb648a87d2c94950","observation_id":"62378c28-3e4b-4467-afec-69742671cfb7","resolution":{"observed_at":"2026-08-06T21:45:07.590372Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.20993","last_updated":"2025-05-27T16:41:53Z","snapshot_observed_at":"2026-07-06T20:14:40.579474Z","submitted_at":"2024-12-30T14:57:53Z","title":"Efficiently Scaling LLM Reasoning with Certaindex","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.20993","snapshot_observed_at":"2026-08-06T21:45:07.680145Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23840","last_updated":"2025-06-30T13:30:33Z","snapshot_observed_at":"2026-08-07T09:54:31.000434Z","submitted_at":"2025-06-30T13:30:33Z","title":"Do Thinking Tokens Help or Trap? Towards More Efficient Large Reasoning Model","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:07.680145Z"},"links":{"cited_paper":"/paper/2412.20993","citing_paper":"/paper/2506.23840"},"observation_digest":"sha256:1fe28895e619b2b52fd5fb885dfd6d59ce8379434d7bff17b2a19cda1907c92c","observation_id":"36d735ad-bb62-4f98-aa8a-decd1ec86a3c","resolution":{"observed_at":"2026-08-06T21:45:07.680145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14008","last_updated":"2024-06-06T13:19:44Z","snapshot_observed_at":"2026-08-03T03:39:09.398343Z","submitted_at":"2024-02-21T18:49:26Z","title":"OlympiadBench: A Challenging Benchmark for Promoting AGI with Olympiad-Level Bilingual Multimodal Scientific Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.14008","snapshot_observed_at":"2026-08-06T21:45:07.762813Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23840","last_updated":"2025-06-30T13:30:33Z","snapshot_observed_at":"2026-08-07T09:54:31.000434Z","submitted_at":"2025-06-30T13:30:33Z","title":"Do Thinking Tokens Help or Trap? Towards More Efficient Large Reasoning Model","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:07.762813Z"},"links":{"cited_paper":"/paper/2402.14008","citing_paper":"/paper/2506.23840"},"observation_digest":"sha256:6fa14f94f1518e4af9382a5210022bdfdb2319d5ae4cdc24f53294c5250e51a5","observation_id":"2055cc70-f085-409e-aa56-6873f90f2ede","resolution":{"observed_at":"2026-08-06T21:45:07.762813Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.01296","last_updated":"2025-04-02T01:59:26Z","snapshot_observed_at":"2026-07-30T08:40:23.849282Z","submitted_at":"2025-04-02T01:59:26Z","title":"ThinkPrune: Pruning Long Chain-of-Thought of LLMs via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.01296","snapshot_observed_at":"2026-08-06T21:45:07.852716Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23840","last_updated":"2025-06-30T13:30:33Z","snapshot_observed_at":"2026-08-07T09:54:31.000434Z","submitted_at":"2025-06-30T13:30:33Z","title":"Do Thinking Tokens Help or Trap? Towards More Efficient Large Reasoning Model","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:07.852716Z"},"links":{"cited_paper":"/paper/2504.01296","citing_paper":"/paper/2506.23840"},"observation_digest":"sha256:d78092fa02004c2e39198e53243cafabff0cde922d0d4c27ea0c7091ccc56ea2","observation_id":"79fd9077-b484-4b1b-be1b-0d43ea2e9216","resolution":{"observed_at":"2026-08-06T21:45:07.852716Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:45:13.542398Z","title":null,"venue":null,"work_id":"30e61d78-a451-4c98-beef-d28bb005397b","year":2024},"citing_paper":{"arxiv_id":"2506.23840","last_updated":"2025-06-30T13:30:33Z","snapshot_observed_at":"2026-08-07T09:54:31.000434Z","submitted_at":"2025-06-30T13:30:33Z","title":"Do Thinking Tokens Help or Trap? Towards More Efficient Large Reasoning Model","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:07.938560Z"},"links":{"citing_paper":"/paper/2506.23840"},"observation_digest":"sha256:31c8bdfe987ff604136f78978c7a067e51453e42a80ecfb7910842c9f9572398","observation_id":"0a505b18-50cf-4cfd-9d9f-189b25d2b832","resolution":{"observed_at":"2026-08-06T21:45:13.597244Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:45:08.047039Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23840","last_updated":"2025-06-30T13:30:33Z","snapshot_observed_at":"2026-08-07T09:54:31.000434Z","submitted_at":"2025-06-30T13:30:33Z","title":"Do Thinking Tokens Help or Trap? Towards More Efficient Large Reasoning Model","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:08.047039Z"},"links":{"citing_paper":"/paper/2506.23840"},"observation_digest":"sha256:0361ca29fc911b1807fed23ffa789f8221790494f93f25ee98d93fdc402e369f","observation_id":"8c057826-bba7-4086-adb9-9b7aa3aba305","resolution":{"observed_at":"2026-08-06T21:45:08.047039Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.14858","last_updated":"2022-07-01T02:15:12Z","snapshot_observed_at":"2026-08-05T15:41:22.691461Z","submitted_at":"2022-06-29T18:54:49Z","title":"Solving Quantitative Reasoning Problems with Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.14858","snapshot_observed_at":"2026-08-06T21:45:08.187391Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.23840","last_updated":"2025-06-30T13:30:33Z","snapshot_observed_at":"2026-08-07T09:54:31.000434Z","submitted_at":"2025-06-30T13:30:33Z","title":"Do Thinking Tokens Help or Trap? Towards More Efficient Large Reasoning Model","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:08.187391Z"},"links":{"cited_paper":"/paper/2206.14858","citing_paper":"/paper/2506.23840"},"observation_digest":"sha256:a746085cad21d647a0ba1f23a88b86ef2cfb16ab9d6e002cd69ad4d76799e143","observation_id":"accf01ce-e8e2-4f4e-9c75-2fc42dac7d20","resolution":{"observed_at":"2026-08-06T21:45:08.187391Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:45:08.291449Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23840","last_updated":"2025-06-30T13:30:33Z","snapshot_observed_at":"2026-08-07T09:54:31.000434Z","submitted_at":"2025-06-30T13:30:33Z","title":"Do Thinking Tokens Help or Trap? Towards More Efficient Large Reasoning Model","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:08.291449Z"},"links":{"citing_paper":"/paper/2506.23840"},"observation_digest":"sha256:24d8396b2a768a3c7c99868ace76d37116535218c7760ffd4606bae1e0f21e81","observation_id":"04bdb2ff-b466-4a84-9723-ce3e06415f39","resolution":{"observed_at":"2026-08-06T21:45:08.291449Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:45:13.368683Z","title":null,"venue":null,"work_id":"5ce3f4a4-9574-483d-8987-960288c0cc8f","year":2025},"citing_paper":{"arxiv_id":"2506.23840","last_updated":"2025-06-30T13:30:33Z","snapshot_observed_at":"2026-08-07T09:54:31.000434Z","submitted_at":"2025-06-30T13:30:33Z","title":"Do Thinking Tokens Help or Trap? Towards More Efficient Large Reasoning Model","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:08.397150Z"},"links":{"citing_paper":"/paper/2506.23840"},"observation_digest":"sha256:c72728924ce03fe04b9e523de82735511f2f7e9b2273bab667484cc418927b45","observation_id":"82e1ed63-295b-4791-a5f1-075fb30300a1","resolution":{"observed_at":"2026-08-06T21:45:13.446604Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12570","last_updated":"2025-01-29T03:11:03Z","snapshot_observed_at":"2026-07-06T20:24:12.803909Z","submitted_at":"2025-01-22T01:35:11Z","title":"O1-Pruner: Length-Harmonizing Fine-Tuning for O1-Like Reasoning Pruning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12570","snapshot_observed_at":"2026-08-06T21:45:08.644465Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23840","last_updated":"2025-06-30T13:30:33Z","snapshot_observed_at":"2026-08-07T09:54:31.000434Z","submitted_at":"2025-06-30T13:30:33Z","title":"Do Thinking Tokens Help or Trap? Towards More Efficient Large Reasoning Model","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:08.644465Z"},"links":{"cited_paper":"/paper/2501.12570","citing_paper":"/paper/2506.23840"},"observation_digest":"sha256:72995017593627791c9e6918c97490b75b2235e139483b545025c6eb005044fa","observation_id":"8aa770e4-3ca1-4026-b226-c9449e09faf9","resolution":{"observed_at":"2026-08-06T21:45:08.644465Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.09858","last_updated":"2025-04-14T04:08:16Z","snapshot_observed_at":"2026-07-06T21:08:47.660019Z","submitted_at":"2025-04-14T04:08:16Z","title":"Reasoning Models Can Be Effective Without Thinking","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.09858","snapshot_observed_at":"2026-08-06T21:45:08.793932Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23840","last_updated":"2025-06-30T13:30:33Z","snapshot_observed_at":"2026-08-07T09:54:31.000434Z","submitted_at":"2025-06-30T13:30:33Z","title":"Do Thinking Tokens Help or Trap? Towards More Efficient Large Reasoning Model","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:08.793932Z"},"links":{"cited_paper":"/paper/2504.09858","citing_paper":"/paper/2506.23840"},"observation_digest":"sha256:a9025c6168dd1cc748fa1cfe299f30cf199f05dbc4667c09a70a2ce5ea50b8c8","observation_id":"69ba4bbf-ba5c-4e8f-8187-0bb675177a5a","resolution":{"observed_at":"2026-08-06T21:45:08.793932Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.09601","last_updated":"2025-02-13T18:52:36Z","snapshot_observed_at":"2026-07-06T20:36:12.548343Z","submitted_at":"2025-02-13T18:52:36Z","title":"CoT-Valve: Length-Compressible Chain-of-Thought Tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.09601","snapshot_observed_at":"2026-08-06T21:45:08.905293Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23840","last_updated":"2025-06-30T13:30:33Z","snapshot_observed_at":"2026-08-07T09:54:31.000434Z","submitted_at":"2025-06-30T13:30:33Z","title":"Do Thinking Tokens Help or Trap? Towards More Efficient Large Reasoning Model","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:08.905293Z"},"links":{"cited_paper":"/paper/2502.09601","citing_paper":"/paper/2506.23840"},"observation_digest":"sha256:49167b192359013d947ce571ba117861f6afce7f611f42758694a3148969ee6c","observation_id":"485c7f5b-b443-4fd7-a2e7-27971216ecb2","resolution":{"observed_at":"2026-08-06T21:45:08.905293Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.19393","last_updated":"2025-03-01T06:07:39Z","snapshot_observed_at":"2026-07-06T20:29:11.710285Z","submitted_at":"2025-01-31T18:48:08Z","title":"s1: Simple test-time scaling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.19393","snapshot_observed_at":"2026-08-06T21:45:08.994279Z","title":"Cand \\` e s, and Tatsunori Hashimoto","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23840","last_updated":"2025-06-30T13:30:33Z","snapshot_observed_at":"2026-08-07T09:54:31.000434Z","submitted_at":"2025-06-30T13:30:33Z","title":"Do Thinking Tokens Help or Trap? Towards More Efficient Large Reasoning Model","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:08.994279Z"},"links":{"cited_paper":"/paper/2501.19393","citing_paper":"/paper/2506.23840"},"observation_digest":"sha256:759dea7e00f51135479edecc400672a28e7ddfb2e585d62d09b4cda100255ac0","observation_id":"d2619f22-8a04-4696-a026-252a28c127be","resolution":{"observed_at":"2026-08-06T21:45:08.994279Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.19393","last_updated":"2025-03-01T06:07:39Z","snapshot_observed_at":"2026-07-06T20:29:11.710285Z","submitted_at":"2025-01-31T18:48:08Z","title":"s1: Simple test-time scaling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.19393","snapshot_observed_at":"2026-08-06T21:45:09.112403Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23840","last_updated":"2025-06-30T13:30:33Z","snapshot_observed_at":"2026-08-07T09:54:31.000434Z","submitted_at":"2025-06-30T13:30:33Z","title":"Do Thinking Tokens Help or Trap? Towards More Efficient Large Reasoning Model","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:09.112403Z"},"links":{"cited_paper":"/paper/2501.19393","citing_paper":"/paper/2506.23840"},"observation_digest":"sha256:1b0898a2375fd7d17f2727efa82a34925c4d36e0bf38c6c374ed669608cfb761","observation_id":"1b8741ca-9107-4949-88fa-2f75d135840c","resolution":{"observed_at":"2026-08-06T21:45:09.112403Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.20122","last_updated":"2025-06-10T10:54:28Z","snapshot_observed_at":"2026-08-06T09:58:45.493495Z","submitted_at":"2025-02-27T14:14:50Z","title":"Self-Training Elicits Concise Reasoning in Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.20122","snapshot_observed_at":"2026-08-06T21:45:09.240076Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23840","last_updated":"2025-06-30T13:30:33Z","snapshot_observed_at":"2026-08-07T09:54:31.000434Z","submitted_at":"2025-06-30T13:30:33Z","title":"Do Thinking Tokens Help or Trap? Towards More Efficient Large Reasoning Model","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:09.240076Z"},"links":{"cited_paper":"/paper/2502.20122","citing_paper":"/paper/2506.23840"},"observation_digest":"sha256:69716d0f1a0c4669c58734d2e5c9c82a343c687f73cbe97a98fa4604a4596d2f","observation_id":"7fe5da6d-ddba-4325-8c24-1e8d555b17f9","resolution":{"observed_at":"2026-08-06T21:45:09.240076Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:45:13.206084Z","title":null,"venue":null,"work_id":"4d9f1bf8-27fb-45c4-9122-142be0ca28f4","year":2025},"citing_paper":{"arxiv_id":"2506.23840","last_updated":"2025-06-30T13:30:33Z","snapshot_observed_at":"2026-08-07T09:54:31.000434Z","submitted_at":"2025-06-30T13:30:33Z","title":"Do Thinking Tokens Help or Trap? Towards More Efficient Large Reasoning Model","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:09.333193Z"},"links":{"citing_paper":"/paper/2506.23840"},"observation_digest":"sha256:750a3ae917b0f8a7c66a3a7a35d7ae6fdb89570dab6ae1527d8cdd1f8d4fad61","observation_id":"a31720ba-98b2-4ee1-9e9f-9f6d7e704508","resolution":{"observed_at":"2026-08-06T21:45:13.275219Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:45:13.093104Z","title":null,"venue":null,"work_id":"9dcc6ad7-4e9d-42ab-be52-76455e1a4f86","year":2024},"citing_paper":{"arxiv_id":"2506.23840","last_updated":"2025-06-30T13:30:33Z","snapshot_observed_at":"2026-08-07T09:54:31.000434Z","submitted_at":"2025-06-30T13:30:33Z","title":"Do Thinking Tokens Help or Trap? Towards More Efficient Large Reasoning Model","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:09.438164Z"},"links":{"citing_paper":"/paper/2506.23840"},"observation_digest":"sha256:c8d747f12b7e6c3cca14df355a32c703fd003c0d06efa19f4dc25fc9b2c1a62c","observation_id":"40796972-6a4a-4a69-aa88-5373b11cf590","resolution":{"observed_at":"2026-08-06T21:45:13.139907Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.02867","last_updated":"2025-06-04T15:00:58Z","snapshot_observed_at":"2026-07-31T18:48:48.750117Z","submitted_at":"2025-06-03T13:31:10Z","title":"Demystifying Reasoning Dynamics with Mutual Information: Thinking Tokens are Information Peaks in LLM Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.02867","snapshot_observed_at":"2026-08-06T21:45:09.539739Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23840","last_updated":"2025-06-30T13:30:33Z","snapshot_observed_at":"2026-08-07T09:54:31.000434Z","submitted_at":"2025-06-30T13:30:33Z","title":"Do Thinking Tokens Help or Trap? Towards More Efficient Large Reasoning Model","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:09.539739Z"},"links":{"cited_paper":"/paper/2506.02867","citing_paper":"/paper/2506.23840"},"observation_digest":"sha256:a53c34a6d0f1f86bb39c0c3ac4268d0c11824429fea60e8a436819732632038f","observation_id":"a16f3062-2f13-4cae-ae75-08ac0a661d49","resolution":{"observed_at":"2026-08-06T21:45:09.539739Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.07572","last_updated":"2025-03-10T17:40:43Z","snapshot_observed_at":"2026-08-06T13:33:50.894986Z","submitted_at":"2025-03-10T17:40:43Z","title":"Optimizing Test-Time Compute via Meta Reinforcement Fine-Tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.07572","snapshot_observed_at":"2026-08-06T21:45:09.631754Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23840","last_updated":"2025-06-30T13:30:33Z","snapshot_observed_at":"2026-08-07T09:54:31.000434Z","submitted_at":"2025-06-30T13:30:33Z","title":"Do Thinking Tokens Help or Trap? Towards More Efficient Large Reasoning Model","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:09.631754Z"},"links":{"cited_paper":"/paper/2503.07572","citing_paper":"/paper/2506.23840"},"observation_digest":"sha256:f8b4aa3e02ab3fd8d62dc781c4096993f2dd349dcb168daf6de5147293d0526f","observation_id":"41da26e3-4e5d-4fb3-8c07-362fc3b80f4f","resolution":{"observed_at":"2026-08-06T21:45:09.631754Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:45:12.974566Z","title":null,"venue":null,"work_id":"bb05afea-21e4-4b6c-b827-856446de1af4","year":2025},"citing_paper":{"arxiv_id":"2506.23840","last_updated":"2025-06-30T13:30:33Z","snapshot_observed_at":"2026-08-07T09:54:31.000434Z","submitted_at":"2025-06-30T13:30:33Z","title":"Do Thinking Tokens Help or Trap? Towards More Efficient Large Reasoning Model","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:09.716572Z"},"links":{"citing_paper":"/paper/2506.23840"},"observation_digest":"sha256:b1d5704b449f99f6c52ff3ce73a90b414fbb1659c0b07b4a2fd7b3a3cc08b640","observation_id":"279663a4-a657-401e-9644-25a925020c9d","resolution":{"observed_at":"2026-08-06T21:45:13.035297Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-06T21:45:09.855990Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.23840","last_updated":"2025-06-30T13:30:33Z","snapshot_observed_at":"2026-08-07T09:54:31.000434Z","submitted_at":"2025-06-30T13:30:33Z","title":"Do Thinking Tokens Help or Trap? Towards More Efficient Large Reasoning Model","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:09.855990Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2506.23840"},"observation_digest":"sha256:721d7b895c0c241fbb1c62d5efa416ff8b3d3aff8863c33318b84ebf4a76f2f1","observation_id":"52a889f5-2ceb-4629-8bc0-34390fc13591","resolution":{"observed_at":"2026-08-06T21:45:09.855990Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:45:09.978063Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23840","last_updated":"2025-06-30T13:30:33Z","snapshot_observed_at":"2026-08-07T09:54:31.000434Z","submitted_at":"2025-06-30T13:30:33Z","title":"Do Thinking Tokens Help or Trap? Towards More Efficient Large Reasoning Model","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:09.978063Z"},"links":{"citing_paper":"/paper/2506.23840"},"observation_digest":"sha256:a51cf921a2088a33cfe33806c97f14f560e334e901f504e74fba31b753adfe6b","observation_id":"755fddc9-6bb6-4304-be57-6143548e60bf","resolution":{"observed_at":"2026-08-06T21:45:09.978063Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:45:10.067387Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23840","last_updated":"2025-06-30T13:30:33Z","snapshot_observed_at":"2026-08-07T09:54:31.000434Z","submitted_at":"2025-06-30T13:30:33Z","title":"Do Thinking Tokens Help or Trap? Towards More Efficient Large Reasoning Model","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:10.067387Z"},"links":{"citing_paper":"/paper/2506.23840"},"observation_digest":"sha256:7e555c978b3283e24705a4f1ee3dfdbcbd691fcc6d71a66eb5f2ce53e95aa20b","observation_id":"33f6c803-671d-4006-90bc-9d4e56765e4b","resolution":{"observed_at":"2026-08-06T21:45:10.067387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.19256","last_updated":"2024-10-02T04:01:47Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-28T06:20:03Z","title":"HybridFlow: A Flexible and Efficient RLHF Framework","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.19256","snapshot_observed_at":"2026-08-06T21:45:10.173720Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23840","last_updated":"2025-06-30T13:30:33Z","snapshot_observed_at":"2026-08-07T09:54:31.000434Z","submitted_at":"2025-06-30T13:30:33Z","title":"Do Thinking Tokens Help or Trap? Towards More Efficient Large Reasoning Model","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:10.173720Z"},"links":{"cited_paper":"/paper/2409.19256","citing_paper":"/paper/2506.23840"},"observation_digest":"sha256:567760d7aa87695d836cb762b531350202c2aa18401ecd5c5b886dfd0dfa7b49","observation_id":"c194aa9c-c8f7-43fa-90f4-6bdb33150fc8","resolution":{"observed_at":"2026-08-06T21:45:10.173720Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.18298","last_updated":"2025-05-23T18:44:46Z","snapshot_observed_at":"2026-08-07T02:27:17.115747Z","submitted_at":"2025-05-23T18:44:46Z","title":"Thinking Fast and Right: Balancing Accuracy and Reasoning Length with Adaptive Rewards","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.18298","snapshot_observed_at":"2026-08-06T21:45:10.270039Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23840","last_updated":"2025-06-30T13:30:33Z","snapshot_observed_at":"2026-08-07T09:54:31.000434Z","submitted_at":"2025-06-30T13:30:33Z","title":"Do Thinking Tokens Help or Trap? Towards More Efficient Large Reasoning Model","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:10.270039Z"},"links":{"cited_paper":"/paper/2505.18298","citing_paper":"/paper/2506.23840"},"observation_digest":"sha256:6a41dbc0c35b5d45ec539c86d6341fee245dbc9b7501e5ebf6ada586ad2c3e1a","observation_id":"d52c04d0-32e9-4730-b36a-609bd4a0a2d3","resolution":{"observed_at":"2026-08-06T21:45:10.270039Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.16419","last_updated":"2025-08-21T19:14:40Z","snapshot_observed_at":"2026-08-07T04:27:23.738927Z","submitted_at":"2025-03-20T17:59:38Z","title":"Stop Overthinking: A Survey on Efficient Reasoning for Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.16419","snapshot_observed_at":"2026-08-06T21:45:10.340851Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23840","last_updated":"2025-06-30T13:30:33Z","snapshot_observed_at":"2026-08-07T09:54:31.000434Z","submitted_at":"2025-06-30T13:30:33Z","title":"Do Thinking Tokens Help or Trap? Towards More Efficient Large Reasoning Model","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:10.340851Z"},"links":{"cited_paper":"/paper/2503.16419","citing_paper":"/paper/2506.23840"},"observation_digest":"sha256:7bed41a6515c7b45267f0e735455697760e2cfe96cfcd02ee2b0cd747534bb97","observation_id":"5917b21d-e907-4223-9d63-eeaae4b7948c","resolution":{"observed_at":"2026-08-06T21:45:10.340851Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12599","last_updated":"2025-06-03T02:14:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T02:48:14Z","title":"Kimi k1.5: Scaling Reinforcement Learning with LLMs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12599","snapshot_observed_at":"2026-08-06T21:45:10.436258Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23840","last_updated":"2025-06-30T13:30:33Z","snapshot_observed_at":"2026-08-07T09:54:31.000434Z","submitted_at":"2025-06-30T13:30:33Z","title":"Do Thinking Tokens Help or Trap? Towards More Efficient Large Reasoning Model","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:10.436258Z"},"links":{"cited_paper":"/paper/2501.12599","citing_paper":"/paper/2506.23840"},"observation_digest":"sha256:d5ddf1d62cf12109486bec86fbe6b669d85097b35d90873c29e0b7a94a735bbe","observation_id":"ec8767f2-68f1-4ff4-a6de-5811ea073ebe","resolution":{"observed_at":"2026-08-06T21:45:10.436258Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:45:10.527430Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23840","last_updated":"2025-06-30T13:30:33Z","snapshot_observed_at":"2026-08-07T09:54:31.000434Z","submitted_at":"2025-06-30T13:30:33Z","title":"Do Thinking Tokens Help or Trap? Towards More Efficient Large Reasoning Model","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:10.527430Z"},"links":{"citing_paper":"/paper/2506.23840"},"observation_digest":"sha256:e895817677aff23358c3c1e148d2d3cd5cfcd99f2ce0e64f3cce33a595559f92","observation_id":"79264837-4518-4277-86d1-df1aae92f151","resolution":{"observed_at":"2026-08-06T21:45:10.527430Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.01939","last_updated":"2025-11-13T10:08:29Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-02T17:54:39Z","title":"Beyond the 80/20 Rule: High-Entropy Minority Tokens Drive Effective Reinforcement Learning for LLM Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.01939","snapshot_observed_at":"2026-08-06T21:45:10.621366Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23840","last_updated":"2025-06-30T13:30:33Z","snapshot_observed_at":"2026-08-07T09:54:31.000434Z","submitted_at":"2025-06-30T13:30:33Z","title":"Do Thinking Tokens Help or Trap? Towards More Efficient Large Reasoning Model","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:10.621366Z"},"links":{"cited_paper":"/paper/2506.01939","citing_paper":"/paper/2506.23840"},"observation_digest":"sha256:5f2f9b8b3cd27064460bfe0775d6d94b73f487b769671f515696f5db4b9e89c4","observation_id":"8d1f91d9-4df9-48bc-8cdc-80821d3e9df4","resolution":{"observed_at":"2026-08-06T21:45:10.621366Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.18585","last_updated":"2025-02-18T16:51:53Z","snapshot_observed_at":"2026-07-06T20:28:33.378335Z","submitted_at":"2025-01-30T18:58:18Z","title":"Thoughts Are All Over the Place: On the Underthinking of o1-Like LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.18585","snapshot_observed_at":"2026-08-06T21:45:10.787149Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23840","last_updated":"2025-06-30T13:30:33Z","snapshot_observed_at":"2026-08-07T09:54:31.000434Z","submitted_at":"2025-06-30T13:30:33Z","title":"Do Thinking Tokens Help or Trap? Towards More Efficient Large Reasoning Model","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:10.787149Z"},"links":{"cited_paper":"/paper/2501.18585","citing_paper":"/paper/2506.23840"},"observation_digest":"sha256:389eaa1447d9e099d333fb4be5973a70c8114d4ad340a68b3cbe8e39a74ed347","observation_id":"3dfce824-a629-46ca-9da1-2e4a08c2e132","resolution":{"observed_at":"2026-08-06T21:45:10.787149Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:45:10.859421Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23840","last_updated":"2025-06-30T13:30:33Z","snapshot_observed_at":"2026-08-07T09:54:31.000434Z","submitted_at":"2025-06-30T13:30:33Z","title":"Do Thinking Tokens Help or Trap? Towards More Efficient Large Reasoning Model","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:10.859421Z"},"links":{"citing_paper":"/paper/2506.23840"},"observation_digest":"sha256:ee4b8e37f47e03b284cc7baed8c32c62fa8b2a3cf716fa0ec3c1c37b2a419233","observation_id":"08ce024a-be3d-4c97-b3cd-e3e98a347674","resolution":{"observed_at":"2026-08-06T21:45:10.859421Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.14945","last_updated":"2025-06-22T00:18:09Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-21T08:09:13Z","title":"Learning to Reason under Off-Policy Guidance","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.14945","snapshot_observed_at":"2026-08-06T21:45:10.938994Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23840","last_updated":"2025-06-30T13:30:33Z","snapshot_observed_at":"2026-08-07T09:54:31.000434Z","submitted_at":"2025-06-30T13:30:33Z","title":"Do Thinking Tokens Help or Trap? Towards More Efficient Large Reasoning Model","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:10.938994Z"},"links":{"cited_paper":"/paper/2504.14945","citing_paper":"/paper/2506.23840"},"observation_digest":"sha256:7720080620cfa13ec049537557e600ae6d5f06cb2ff26d665cb8b1bccb72d903","observation_id":"92a74131-c57e-44b9-a971-66f19d43b064","resolution":{"observed_at":"2026-08-06T21:45:10.938994Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-08-06T21:45:11.037966Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23840","last_updated":"2025-06-30T13:30:33Z","snapshot_observed_at":"2026-08-07T09:54:31.000434Z","submitted_at":"2025-06-30T13:30:33Z","title":"Do Thinking Tokens Help or Trap? Towards More Efficient Large Reasoning Model","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:11.037966Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2506.23840"},"observation_digest":"sha256:304e43b66c199cca0d97639e978c50af329d456a275240772a3e3c225418a91c","observation_id":"7f3d562b-0297-4561-bb04-ccc41b59b4ba","resolution":{"observed_at":"2026-08-06T21:45:11.037966Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:45:11.134582Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23840","last_updated":"2025-06-30T13:30:33Z","snapshot_observed_at":"2026-08-07T09:54:31.000434Z","submitted_at":"2025-06-30T13:30:33Z","title":"Do Thinking Tokens Help or Trap? Towards More Efficient Large Reasoning Model","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:11.134582Z"},"links":{"citing_paper":"/paper/2506.23840"},"observation_digest":"sha256:2f06c2f5fea8a3137b7c46ebb162b8ed724f4bea12836a055faf2158f3408076","observation_id":"872e2f79-4196-49bd-a6c9-38c28b369cb5","resolution":{"observed_at":"2026-08-06T21:45:11.134582Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.03234","last_updated":"2025-05-21T15:26:54Z","snapshot_observed_at":"2026-07-06T21:04:11.067292Z","submitted_at":"2025-04-04T07:34:01Z","title":"Think When You Need: Self-Adaptive Chain-of-Thought Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.03234","snapshot_observed_at":"2026-08-06T21:45:11.207138Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23840","last_updated":"2025-06-30T13:30:33Z","snapshot_observed_at":"2026-08-07T09:54:31.000434Z","submitted_at":"2025-06-30T13:30:33Z","title":"Do Thinking Tokens Help or Trap? Towards More Efficient Large Reasoning Model","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:11.207138Z"},"links":{"cited_paper":"/paper/2504.03234","citing_paper":"/paper/2506.23840"},"observation_digest":"sha256:bcb155f1a16835a826c74342a00e182424a3889473f6c885569b1680d09363a0","observation_id":"db3e6b06-037f-4f10-b78a-d18a448964aa","resolution":{"observed_at":"2026-08-06T21:45:11.207138Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.02956","last_updated":"2025-04-03T18:22:20Z","snapshot_observed_at":"2026-07-06T21:03:55.628788Z","submitted_at":"2025-04-03T18:22:20Z","title":"Understanding Aha Moments: from External Observations to Internal Mechanisms","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.02956","snapshot_observed_at":"2026-08-06T21:45:11.280439Z","title":"Wong, and Di Wang","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23840","last_updated":"2025-06-30T13:30:33Z","snapshot_observed_at":"2026-08-07T09:54:31.000434Z","submitted_at":"2025-06-30T13:30:33Z","title":"Do Thinking Tokens Help or Trap? Towards More Efficient Large Reasoning Model","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:11.280439Z"},"links":{"cited_paper":"/paper/2504.02956","citing_paper":"/paper/2506.23840"},"observation_digest":"sha256:75256ae33d3dbfd7d4b8180e6efc22ff4e946aab32cddf201ae5b4c484fc90b5","observation_id":"05ed302e-0bbe-4534-99f0-626a5f61bc42","resolution":{"observed_at":"2026-08-06T21:45:11.280439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03373","last_updated":"2025-02-05T17:13:32Z","snapshot_observed_at":"2026-07-06T20:31:41.231839Z","submitted_at":"2025-02-05T17:13:32Z","title":"Demystifying Long Chain-of-Thought Reasoning in LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.03373","snapshot_observed_at":"2026-08-06T21:45:11.371418Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23840","last_updated":"2025-06-30T13:30:33Z","snapshot_observed_at":"2026-08-07T09:54:31.000434Z","submitted_at":"2025-06-30T13:30:33Z","title":"Do Thinking Tokens Help or Trap? Towards More Efficient Large Reasoning Model","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:11.371418Z"},"links":{"cited_paper":"/paper/2502.03373","citing_paper":"/paper/2506.23840"},"observation_digest":"sha256:cb62b9ee5ad637f3a2f1c628e436aa74d24c72b86ae48a54830c985ce11171e9","observation_id":"77eaa049-0bb4-4db0-b2fb-b5d018206285","resolution":{"observed_at":"2026-08-06T21:45:11.371418Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.06023","last_updated":"2024-07-24T18:40:36Z","snapshot_observed_at":"2026-07-31T10:52:02.949801Z","submitted_at":"2024-07-08T15:17:46Z","title":"Distilling System 2 into System 1","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.06023","snapshot_observed_at":"2026-08-06T21:45:11.449407Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23840","last_updated":"2025-06-30T13:30:33Z","snapshot_observed_at":"2026-08-07T09:54:31.000434Z","submitted_at":"2025-06-30T13:30:33Z","title":"Do Thinking Tokens Help or Trap? Towards More Efficient Large Reasoning Model","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:11.449407Z"},"links":{"cited_paper":"/paper/2407.06023","citing_paper":"/paper/2506.23840"},"observation_digest":"sha256:22d077467afe5989d03ff3f6d2d42b4ef95cda29264bb24e96fb23c67ade6537","observation_id":"e70b2234-1390-42a5-bbde-9a331c05bdb6","resolution":{"observed_at":"2026-08-06T21:45:11.449407Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14476","last_updated":"2025-05-20T01:37:34Z","snapshot_observed_at":"2026-08-02T01:40:54.187278Z","submitted_at":"2025-03-18T17:49:06Z","title":"DAPO: An Open-Source LLM Reinforcement Learning System at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.14476","snapshot_observed_at":"2026-08-06T21:45:11.522799Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23840","last_updated":"2025-06-30T13:30:33Z","snapshot_observed_at":"2026-08-07T09:54:31.000434Z","submitted_at":"2025-06-30T13:30:33Z","title":"Do Thinking Tokens Help or Trap? Towards More Efficient Large Reasoning Model","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:11.522799Z"},"links":{"cited_paper":"/paper/2503.14476","citing_paper":"/paper/2506.23840"},"observation_digest":"sha256:a0bd4fb6196febf8834b1cbdb31566a8a9aaee4c5dbf85a46e4fc121d9ad44f3","observation_id":"4fbc789a-827c-4952-84db-831d9f418d9d","resolution":{"observed_at":"2026-08-06T21:45:11.522799Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.05118","last_updated":"2025-04-11T02:54:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-07T14:21:11Z","title":"VAPO: Efficient and Reliable Reinforcement Learning for Advanced Reasoning Tasks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.05118","snapshot_observed_at":"2026-08-06T21:45:11.615470Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23840","last_updated":"2025-06-30T13:30:33Z","snapshot_observed_at":"2026-08-07T09:54:31.000434Z","submitted_at":"2025-06-30T13:30:33Z","title":"Do Thinking Tokens Help or Trap? Towards More Efficient Large Reasoning Model","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:11.615470Z"},"links":{"cited_paper":"/paper/2504.05118","citing_paper":"/paper/2506.23840"},"observation_digest":"sha256:d362bbfe7d421459c35c0cc1dadfc37655104a610d117c7e227d39b6f7f62f90","observation_id":"70018833-dd4f-4183-901f-6204e44b044d","resolution":{"observed_at":"2026-08-06T21:45:11.615470Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.18892","last_updated":"2025-08-06T08:42:32Z","snapshot_observed_at":"2026-07-06T20:57:57.039376Z","submitted_at":"2025-03-24T17:06:10Z","title":"SimpleRL-Zoo: Investigating and Taming Zero Reinforcement Learning for Open Base Models in the Wild","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.18892","snapshot_observed_at":"2026-08-06T21:45:11.711313Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23840","last_updated":"2025-06-30T13:30:33Z","snapshot_observed_at":"2026-08-07T09:54:31.000434Z","submitted_at":"2025-06-30T13:30:33Z","title":"Do Thinking Tokens Help or Trap? Towards More Efficient Large Reasoning Model","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:11.711313Z"},"links":{"cited_paper":"/paper/2503.18892","citing_paper":"/paper/2506.23840"},"observation_digest":"sha256:0f140b39e93d50919d24b371a6cc2f645a878d677be0fa2af399254004130fce","observation_id":"56978212-369e-432f-9e87-27d9e39d2518","resolution":{"observed_at":"2026-08-06T21:45:11.711313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.13417","last_updated":"2025-05-19T17:50:52Z","snapshot_observed_at":"2026-07-06T21:26:30.087184Z","submitted_at":"2025-05-19T17:50:52Z","title":"AdaptThink: Reasoning Models Can Learn When to Think","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.13417","snapshot_observed_at":"2026-08-06T21:45:11.801215Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23840","last_updated":"2025-06-30T13:30:33Z","snapshot_observed_at":"2026-08-07T09:54:31.000434Z","submitted_at":"2025-06-30T13:30:33Z","title":"Do Thinking Tokens Help or Trap? Towards More Efficient Large Reasoning Model","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:11.801215Z"},"links":{"cited_paper":"/paper/2505.13417","citing_paper":"/paper/2506.23840"},"observation_digest":"sha256:950a2a9212ca386b0b1c5845b5380b7818edff645c6afc759767b35a38333f27","observation_id":"8ae70e2a-a1d2-4824-8f88-39f0a119d810","resolution":{"observed_at":"2026-08-06T21:45:11.801215Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.05132","last_updated":"2025-03-10T01:52:08Z","snapshot_observed_at":"2026-07-06T20:48:18.268075Z","submitted_at":"2025-03-07T04:21:47Z","title":"R1-Zero's \"Aha Moment\" in Visual Reasoning on a 2B Non-SFT Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.05132","snapshot_observed_at":"2026-08-06T21:45:11.904232Z","title":"aha moment","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23840","last_updated":"2025-06-30T13:30:33Z","snapshot_observed_at":"2026-08-07T09:54:31.000434Z","submitted_at":"2025-06-30T13:30:33Z","title":"Do Thinking Tokens Help or Trap? Towards More Efficient Large Reasoning Model","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:11.904232Z"},"links":{"cited_paper":"/paper/2503.05132","citing_paper":"/paper/2506.23840"},"observation_digest":"sha256:8f4610df26ab02cfc823a7a25b9dd789e1553364e14c645f52b30434513c7a92","observation_id":"8fdd2d37-cf37-4fd9-b1ae-8ceaec1e1fce","resolution":{"observed_at":"2026-08-06T21:45:11.904232Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.23840","last_updated":"2025-06-30T13:30:33Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T09:54:31.000434Z","submitted_at":"2025-06-30T13:30:33Z","title":"Do Thinking Tokens Help or Trap? Towards More Efficient Large Reasoning Model"},"reference_resolution":{"displayed":51,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":51,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":51},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 51 of 51 outbound references and 5 inbound Pith citation observations for arXiv:2506.23840."}