{"as_of":"2026-08-08T19:40:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:18a3d2ee73a6857a4e98bf7962ad92689b5b3b517063271da1da9832acbdd1af","coverage":[{"denominator":37,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":37,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T00:57:03.154623Z","state":"measured"},{"denominator":41,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":41,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":4,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":4,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T17:54:17.268192Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-06T05:08:13.018927Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.12353","last_updated":"2025-06-14T05:30:09Z","snapshot_observed_at":"2026-08-07T08:59:45.729814Z","submitted_at":"2025-06-14T05:30:09Z","title":"Efficient Reasoning Through Suppression of Self-Affirmation Reflections in Large Reasoning Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.12353","snapshot_observed_at":"2026-08-06T17:54:17.268192Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.09662","last_updated":"2025-07-13T14:51:59Z","snapshot_observed_at":"2026-08-07T01:15:50.475193Z","submitted_at":"2025-07-13T14:51:59Z","title":"Towards Concise and Adaptive Thinking in Large Reasoning Models: A Survey","version":1},"reference_index":111,"source":"arxiv_source","source_observed_at":"2026-08-06T17:54:17.268192Z"},"links":{"cited_paper":"/paper/2506.12353","citing_paper":"/paper/2507.09662"},"observation_digest":"sha256:51420b06f0758fac9d48e0ae519a09be3d79bb958f46d3ab7920df5098691cae","observation_id":"1f079f2a-4ea7-4138-ba71-ce9121d3e50f","resolution":{"observed_at":"2026-08-06T17:54:17.268192Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.12353","last_updated":"2025-06-14T05:30:09Z","snapshot_observed_at":"2026-08-07T08:59:45.729814Z","submitted_at":"2025-06-14T05:30:09Z","title":"Efficient Reasoning Through Suppression of Self-Affirmation Reflections in Large Reasoning Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.12353","snapshot_observed_at":"2026-08-06T12:26:11.159006Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.21848","last_updated":"2025-07-29T14:23:58Z","snapshot_observed_at":"2026-08-07T09:00:21.482682Z","submitted_at":"2025-07-29T14:23:58Z","title":"EDGE-GRPO: Entropy-Driven GRPO with Guided Error Correction for Advantage Diversity","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T12:26:11.159006Z"},"links":{"cited_paper":"/paper/2506.12353","citing_paper":"/paper/2507.21848"},"observation_digest":"sha256:443a7146319794f8b20150792b5d19b6c2bd555f08575763f4aab15ae369172d","observation_id":"d77ac373-6e99-49ab-a72e-7a0cf74997cd","resolution":{"observed_at":"2026-08-06T12:26:11.159006Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.12353","last_updated":"2025-06-14T05:30:09Z","snapshot_observed_at":"2026-08-07T08:59:45.729814Z","submitted_at":"2025-06-14T05:30:09Z","title":"Efficient Reasoning Through Suppression of Self-Affirmation Reflections in Large Reasoning Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.12353","snapshot_observed_at":"2026-08-06T05:14:37.153107Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.02178","last_updated":"2026-06-29T02:19:28Z","snapshot_observed_at":"2026-08-07T20:42:16.632978Z","submitted_at":"2025-08-04T08:22:14Z","title":"Reconsidering Overthinking: Penalizing Internal and External Redundancy in CoT Reasoning","version":3},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-06T05:14:37.153107Z"},"links":{"cited_paper":"/paper/2506.12353","citing_paper":"/paper/2508.02178"},"observation_digest":"sha256:b5886e07e5112d38bc36ca735f7088c7068fdd2b1dbee392dce6a17b4d5ab798","observation_id":"4541c878-3b5e-4085-b2f0-5ec5b33425ca","resolution":{"observed_at":"2026-08-06T05:14:37.153107Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.12353","last_updated":"2025-06-14T05:30:09Z","snapshot_observed_at":"2026-08-07T08:59:45.729814Z","submitted_at":"2025-06-14T05:30:09Z","title":"Efficient Reasoning Through Suppression of Self-Affirmation Reflections in Large Reasoning Models","version":1},"cited_work":{"arxiv_id":"2506.12353","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.12353","snapshot_observed_at":"2026-08-06T05:08:13.018927Z","title":"Efficient Reasoning Through Suppression of Self-Affirmation Reflections in Large Reasoning Models","venue":"cs.CL","work_id":"fabd6448-6a85-4741-9d54-4f5fa5f6c36b","year":2025},"citing_paper":{"arxiv_id":"2508.02186","last_updated":"2025-08-04T08:31:45Z","snapshot_observed_at":"2026-08-07T08:59:18.880121Z","submitted_at":"2025-08-04T08:31:45Z","title":"Failure Cases Are Better Learned But Boundary Says Sorry: Facilitating Smooth Perception Change for Accuracy-Robustness Trade-Off in Adversarial Training","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T05:08:10.593722Z"},"links":{"cited_paper":"/paper/2506.12353","citing_paper":"/paper/2508.02186"},"observation_digest":"sha256:be09ff02df76031184f36a77dd0d87c16a379d01570f9a6255dbba7654903bf9","observation_id":"a2230aad-aa95-4a74-98f9-df858b7527ff","resolution":{"observed_at":"2026-08-06T05:08:13.098887Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.12353/citation-record","integrity":"/paper/2506.12353/integrity","json":"/paper/2506.12353/citation-record.json","paper":"/paper/2506.12353"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:57:04.242300Z","title":"Wait\" in Other Reflections (Histogram)","venue":null,"work_id":"7b807e96-5ec4-4b8b-9036-9c88eee8fa5c","year":2000},"citing_paper":{"arxiv_id":"2506.12353","last_updated":"2025-06-14T05:30:09Z","snapshot_observed_at":"2026-08-07T08:59:45.729814Z","submitted_at":"2025-06-14T05:30:09Z","title":"Efficient Reasoning Through Suppression of Self-Affirmation Reflections in Large Reasoning Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T00:57:03.154623Z"},"links":{"citing_paper":"/paper/2506.12353"},"observation_digest":"sha256:d4892be67f3a0728e1d5ed520a74f83d6c73238bb3ca9a712feabb35594f618c","observation_id":"efda38cc-9166-42c5-b52f-0f59396ffd0d","resolution":{"observed_at":"2026-08-07T00:57:04.334734Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:57:00.052406Z","title":"Seal: Steer- able reasoning calibration of large language models for free","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12353","last_updated":"2025-06-14T05:30:09Z","snapshot_observed_at":"2026-08-07T08:59:45.729814Z","submitted_at":"2025-06-14T05:30:09Z","title":"Efficient Reasoning Through Suppression of Self-Affirmation Reflections in Large Reasoning Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T00:57:00.052406Z"},"links":{"citing_paper":"/paper/2506.12353"},"observation_digest":"sha256:bbf93ee5b5c1cfc1d46b6ced6a34fe3b8be868527e9faec57684b9b551c63c37","observation_id":"e6b00f0d-f032-41c0-803b-733c20761a23","resolution":{"observed_at":"2026-08-07T00:57:00.052406Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.13171","last_updated":"2024-12-17T18:50:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-17T18:50:33Z","title":"Compressed Chain of Thought: Efficient Reasoning Through Dense Representations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.13171","snapshot_observed_at":"2026-08-07T00:57:00.197987Z","title":"Compressed chain of thought: Efficient reasoning through dense representations","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12353","last_updated":"2025-06-14T05:30:09Z","snapshot_observed_at":"2026-08-07T08:59:45.729814Z","submitted_at":"2025-06-14T05:30:09Z","title":"Efficient Reasoning Through Suppression of Self-Affirmation Reflections in Large Reasoning Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T00:57:00.197987Z"},"links":{"cited_paper":"/paper/2412.13171","citing_paper":"/paper/2506.12353"},"observation_digest":"sha256:7ed8bd6cc63cca106c77bfd6be7ae995e996420bcc48c41f81d6f213927964d0","observation_id":"e36f406b-a0ca-4c4a-b070-6bcdb6009392","resolution":{"observed_at":"2026-08-07T00:57:00.197987Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13284","last_updated":"2025-06-19T22:52:45Z","snapshot_observed_at":"2026-08-07T19:53:57.315695Z","submitted_at":"2024-10-17T07:28:18Z","title":"Learning to Route LLMs with Confidence Tokens","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.13284","snapshot_observed_at":"2026-08-07T00:57:00.438993Z","title":"Learning to route Ilms with confidence tokens","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12353","last_updated":"2025-06-14T05:30:09Z","snapshot_observed_at":"2026-08-07T08:59:45.729814Z","submitted_at":"2025-06-14T05:30:09Z","title":"Efficient Reasoning Through Suppression of Self-Affirmation Reflections in Large Reasoning Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T00:57:00.438993Z"},"links":{"cited_paper":"/paper/2410.13284","citing_paper":"/paper/2506.12353"},"observation_digest":"sha256:61b30ce4e1e247b9454c084039ea53c06da198eedcf751d2dd3cb433a298b3c0","observation_id":"397bcf4d-18c5-4835-93d0-9c2adc0f5c23","resolution":{"observed_at":"2026-08-07T00:57:00.438993Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-07T00:57:00.577386Z","title":"Training verifiers to solve math word problems","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12353","last_updated":"2025-06-14T05:30:09Z","snapshot_observed_at":"2026-08-07T08:59:45.729814Z","submitted_at":"2025-06-14T05:30:09Z","title":"Efficient Reasoning Through Suppression of Self-Affirmation Reflections in Large Reasoning Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T00:57:00.577386Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2506.12353"},"observation_digest":"sha256:508b348365228ffc71e7fd6429ae969fe4e92824c8c5712d2da894b5a50bad32","observation_id":"72a3cc84-c919-4ced-afc7-3208403108cb","resolution":{"observed_at":"2026-08-07T00:57:00.577386Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.17674","last_updated":"2025-04-24T15:45:05Z","snapshot_observed_at":"2026-08-07T15:59:27.686117Z","submitted_at":"2025-04-24T15:45:05Z","title":"Energy Considerations of Large Language Model Inference and Efficiency Optimizations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.17674","snapshot_observed_at":"2026-08-07T00:57:00.675817Z","title":"Energy considerations of large language model inference and efficiency optimizations","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12353","last_updated":"2025-06-14T05:30:09Z","snapshot_observed_at":"2026-08-07T08:59:45.729814Z","submitted_at":"2025-06-14T05:30:09Z","title":"Efficient Reasoning Through Suppression of Self-Affirmation Reflections in Large Reasoning Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T00:57:00.675817Z"},"links":{"cited_paper":"/paper/2504.17674","citing_paper":"/paper/2506.12353"},"observation_digest":"sha256:dbdad1f288a3d73da1711bd524809744e5f153b95db8b0d7c4ac0112ca27cee3","observation_id":"f6ef9b75-2a1c-41b8-abfb-c2d8948ced19","resolution":{"observed_at":"2026-08-07T00:57:00.675817Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-07T00:57:00.793462Z","title":"Deepseek-r1: Incentivizing reasoning capability in Ilms via reinforcement learning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12353","last_updated":"2025-06-14T05:30:09Z","snapshot_observed_at":"2026-08-07T08:59:45.729814Z","submitted_at":"2025-06-14T05:30:09Z","title":"Efficient Reasoning Through Suppression of Self-Affirmation Reflections in Large Reasoning Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T00:57:00.793462Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2506.12353"},"observation_digest":"sha256:21452238f7d2ca5e80466cf506c318d2c21762a5b67c1843379fcf2b271303e9","observation_id":"2868b520-08d4-43e3-9859-6a7696800926","resolution":{"observed_at":"2026-08-07T00:57:00.793462Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06769","last_updated":"2025-11-03T00:53:34Z","snapshot_observed_at":"2026-08-07T06:05:27.895209Z","submitted_at":"2024-12-09T18:55:56Z","title":"Training Large Language Models to Reason in a Continuous Latent Space","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.06769","snapshot_observed_at":"2026-08-07T00:57:00.888079Z","title":"Training large language models to reason in a continuous latent space","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12353","last_updated":"2025-06-14T05:30:09Z","snapshot_observed_at":"2026-08-07T08:59:45.729814Z","submitted_at":"2025-06-14T05:30:09Z","title":"Efficient Reasoning Through Suppression of Self-Affirmation Reflections in Large Reasoning Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T00:57:00.888079Z"},"links":{"cited_paper":"/paper/2412.06769","citing_paper":"/paper/2506.12353"},"observation_digest":"sha256:ac3667c780273f7a28b7f6c13e40e97b8b90a5699e70eb0507e3eb2b1a07a51d","observation_id":"13ac8a10-ecab-42e7-9494-faeda2d61281","resolution":{"observed_at":"2026-08-07T00:57:00.888079Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.03874","last_updated":"2021-11-08T21:30:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-03-05T18:59:39Z","title":"Measuring Mathematical Problem Solving With the MATH Dataset","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.03874","snapshot_observed_at":"2026-08-07T00:57:01.028410Z","title":"Measuring mathematical problem solving with the math dataset","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12353","last_updated":"2025-06-14T05:30:09Z","snapshot_observed_at":"2026-08-07T08:59:45.729814Z","submitted_at":"2025-06-14T05:30:09Z","title":"Efficient Reasoning Through Suppression of Self-Affirmation Reflections in Large Reasoning Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T00:57:01.028410Z"},"links":{"cited_paper":"/paper/2103.03874","citing_paper":"/paper/2506.12353"},"observation_digest":"sha256:87845caef6a05eb4f312f6e6943a559ae5297b3c5bef916febd46889cd7400fc","observation_id":"9b2cb594-fddf-47fe-9803-d5488f6b9f34","resolution":{"observed_at":"2026-08-07T00:57:01.028410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:57:01.196512Z","title":"A sober look at progress in language model reasoning: Pitfalls and paths to reproducibility","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12353","last_updated":"2025-06-14T05:30:09Z","snapshot_observed_at":"2026-08-07T08:59:45.729814Z","submitted_at":"2025-06-14T05:30:09Z","title":"Efficient Reasoning Through Suppression of Self-Affirmation Reflections in Large Reasoning Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T00:57:01.196512Z"},"links":{"citing_paper":"/paper/2506.12353"},"observation_digest":"sha256:49bb3a7d2174f24978351e1c68e70bdd1384f4381d53f43bdc109ad009103b9a","observation_id":"c7ff2f05-6389-4dbb-b7e1-f44596601200","resolution":{"observed_at":"2026-08-07T00:57:01.196512Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16720","last_updated":"2026-04-30T02:46:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-21T18:04:31Z","title":"OpenAI o1 System Card","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.16720","snapshot_observed_at":"2026-08-07T00:57:01.343042Z","title":"Openai ol system card","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12353","last_updated":"2025-06-14T05:30:09Z","snapshot_observed_at":"2026-08-07T08:59:45.729814Z","submitted_at":"2025-06-14T05:30:09Z","title":"Efficient Reasoning Through Suppression of Self-Affirmation Reflections in Large Reasoning Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T00:57:01.343042Z"},"links":{"cited_paper":"/paper/2412.16720","citing_paper":"/paper/2506.12353"},"observation_digest":"sha256:37ce38945c6901319296980146024c3ca1a2db13f2d9ecee704bb1f317d8f7e4","observation_id":"204eef23-37b0-44b8-82ac-39413befa5bf","resolution":{"observed_at":"2026-08-07T00:57:01.343042Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.04697","last_updated":"2025-10-03T01:55:58Z","snapshot_observed_at":"2026-08-06T08:53:09.095000Z","submitted_at":"2025-03-06T18:43:29Z","title":"L1: Controlling How Long A Reasoning Model Thinks With Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.04697","snapshot_observed_at":"2026-08-07T00:56:59.729310Z","title":"L1: Controlling how long a reasoning model thinks with reinforcement learning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12353","last_updated":"2025-06-14T05:30:09Z","snapshot_observed_at":"2026-08-07T08:59:45.729814Z","submitted_at":"2025-06-14T05:30:09Z","title":"Efficient Reasoning Through Suppression of Self-Affirmation Reflections in Large Reasoning Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T00:56:59.729310Z"},"links":{"cited_paper":"/paper/2503.04697","citing_paper":"/paper/2506.12353"},"observation_digest":"sha256:c7d460c04e8f716dddd6e04c782ee69f172ee17cca00b875ff1df9464f0a96d7","observation_id":"327ab32a-9d85-4380-a2d6-a769e79a3bad","resolution":{"observed_at":"2026-08-07T00:56:59.729310Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.19324","last_updated":"2025-06-26T03:14:46Z","snapshot_observed_at":"2026-07-06T20:29:07.258163Z","submitted_at":"2025-01-31T17:19:57Z","title":"Reward-Guided Speculative Decoding for Efficient LLM Reasoning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.19324","snapshot_observed_at":"2026-08-07T00:57:01.524906Z","title":"Reward-guided speculative decoding for efficient Ilm reasoning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12353","last_updated":"2025-06-14T05:30:09Z","snapshot_observed_at":"2026-08-07T08:59:45.729814Z","submitted_at":"2025-06-14T05:30:09Z","title":"Efficient Reasoning Through Suppression of Self-Affirmation Reflections in Large Reasoning Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T00:57:01.524906Z"},"links":{"cited_paper":"/paper/2501.19324","citing_paper":"/paper/2506.12353"},"observation_digest":"sha256:4f0b1842cc0b8d71ca4c21bf4d6040a6ca5c1b5b69f576afc1f070eb0d379b35","observation_id":"35cbcd96-7426-4654-aa51-2ea55b5f6645","resolution":{"observed_at":"2026-08-07T00:57:01.524906Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.20050","last_updated":"2023-05-31T17:24:00Z","snapshot_observed_at":"2026-08-05T13:11:04.104454Z","submitted_at":"2023-05-31T17:24:00Z","title":"Let's Verify Step by Step","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.20050","snapshot_observed_at":"2026-08-07T00:57:01.616179Z","title":"Let’s verify step by step","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12353","last_updated":"2025-06-14T05:30:09Z","snapshot_observed_at":"2026-08-07T08:59:45.729814Z","submitted_at":"2025-06-14T05:30:09Z","title":"Efficient Reasoning Through Suppression of Self-Affirmation Reflections in Large Reasoning Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T00:57:01.616179Z"},"links":{"cited_paper":"/paper/2305.20050","citing_paper":"/paper/2506.12353"},"observation_digest":"sha256:b129e7a521086c3fab687de1f45ec0f94bf1bb2c2ec87c14ddda829d3422ae82","observation_id":"57cd6c8d-000d-43fb-bb29-094a617b1b8a","resolution":{"observed_at":"2026-08-07T00:57:01.616179Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-08-07T00:57:01.731517Z","title":"Deepseek-v3 technical report","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12353","last_updated":"2025-06-14T05:30:09Z","snapshot_observed_at":"2026-08-07T08:59:45.729814Z","submitted_at":"2025-06-14T05:30:09Z","title":"Efficient Reasoning Through Suppression of Self-Affirmation Reflections in Large Reasoning Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T00:57:01.731517Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2506.12353"},"observation_digest":"sha256:fcaad27905d584fa698f355ab9b2d672018949c1d24de083c090474b3a83c478","observation_id":"9b97c33a-6f80-4a36-adb1-820a1be15ce0","resolution":{"observed_at":"2026-08-07T00:57:01.731517Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12570","last_updated":"2025-01-29T03:11:03Z","snapshot_observed_at":"2026-08-08T03:22:47.699927Z","submitted_at":"2025-01-22T01:35:11Z","title":"O1-Pruner: Length-Harmonizing Fine-Tuning for O1-Like Reasoning Pruning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12570","snapshot_observed_at":"2026-08-07T00:57:01.802457Z","title":"Ol-pruner: Length-harmonizing fine-tuning for ol-like reasoning pruning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12353","last_updated":"2025-06-14T05:30:09Z","snapshot_observed_at":"2026-08-07T08:59:45.729814Z","submitted_at":"2025-06-14T05:30:09Z","title":"Efficient Reasoning Through Suppression of Self-Affirmation Reflections in Large Reasoning Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T00:57:01.802457Z"},"links":{"cited_paper":"/paper/2501.12570","citing_paper":"/paper/2506.12353"},"observation_digest":"sha256:5420122e5fe66aec70f8e079f1b98817c5e87c607a3f574176b5f5a908526c28","observation_id":"893a0317-102c-414f-aeef-2b8255072ca4","resolution":{"observed_at":"2026-08-07T00:57:01.802457Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.09601","last_updated":"2025-02-13T18:52:36Z","snapshot_observed_at":"2026-08-08T03:37:50.177168Z","submitted_at":"2025-02-13T18:52:36Z","title":"CoT-Valve: Length-Compressible Chain-of-Thought Tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.09601","snapshot_observed_at":"2026-08-07T00:57:01.899387Z","title":"Cot-valve: Length-compressible chain-of-thought tuning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12353","last_updated":"2025-06-14T05:30:09Z","snapshot_observed_at":"2026-08-07T08:59:45.729814Z","submitted_at":"2025-06-14T05:30:09Z","title":"Efficient Reasoning Through Suppression of Self-Affirmation Reflections in Large Reasoning Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T00:57:01.899387Z"},"links":{"cited_paper":"/paper/2502.09601","citing_paper":"/paper/2506.12353"},"observation_digest":"sha256:b53ba8c25b0339ae72fbfb73405c8aa0dbb0421d77661d1eee07767d715c4042","observation_id":"459f3269-43bb-4e78-b012-2ff194e9a503","resolution":{"observed_at":"2026-08-07T00:57:01.899387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.19393","last_updated":"2025-03-01T06:07:39Z","snapshot_observed_at":"2026-07-06T20:29:11.710285Z","submitted_at":"2025-01-31T18:48:08Z","title":"s1: Simple test-time scaling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.19393","snapshot_observed_at":"2026-08-07T00:57:01.996853Z","title":"sl: Simple test-time scaling","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12353","last_updated":"2025-06-14T05:30:09Z","snapshot_observed_at":"2026-08-07T08:59:45.729814Z","submitted_at":"2025-06-14T05:30:09Z","title":"Efficient Reasoning Through Suppression of Self-Affirmation Reflections in Large Reasoning Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T00:57:01.996853Z"},"links":{"cited_paper":"/paper/2501.19393","citing_paper":"/paper/2506.12353"},"observation_digest":"sha256:21ea4bf6ff1b5c4abbce9d671cdb3357e1881dcf6724f68c1873b75231b9fdd5","observation_id":"298e63dd-70e3-4e09-bf71-442f19579d46","resolution":{"observed_at":"2026-08-07T00:57:01.996853Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.15758","last_updated":"2024-04-24T09:30:00Z","snapshot_observed_at":"2026-08-07T08:29:56.806569Z","submitted_at":"2024-04-24T09:30:00Z","title":"Let's Think Dot by Dot: Hidden Computation in Transformer Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.15758","snapshot_observed_at":"2026-08-07T00:57:02.090047Z","title":"Let’s think dot by dot: Hidden computation in transformer language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12353","last_updated":"2025-06-14T05:30:09Z","snapshot_observed_at":"2026-08-07T08:59:45.729814Z","submitted_at":"2025-06-14T05:30:09Z","title":"Efficient Reasoning Through Suppression of Self-Affirmation Reflections in Large Reasoning Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T00:57:02.090047Z"},"links":{"cited_paper":"/paper/2404.15758","citing_paper":"/paper/2506.12353"},"observation_digest":"sha256:fb7509d12e46bfee190f70874ae7d70fc3008f7038596af1c77e14ec55e7f3c5","observation_id":"20782098-b0fb-492a-abd4-0c5c67f22e62","resolution":{"observed_at":"2026-08-07T00:57:02.090047Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:57:02.179776Z","title":"A survey of efficient reasoning for large reasoning models: Language, multimodality, and beyond","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12353","last_updated":"2025-06-14T05:30:09Z","snapshot_observed_at":"2026-08-07T08:59:45.729814Z","submitted_at":"2025-06-14T05:30:09Z","title":"Efficient Reasoning Through Suppression of Self-Affirmation Reflections in Large Reasoning Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T00:57:02.179776Z"},"links":{"citing_paper":"/paper/2506.12353"},"observation_digest":"sha256:a0816a3aa62a572efeae341ba23395686520f8963e2e7abad191187731678a6c","observation_id":"4f0526b4-fc90-4f29-93d9-d46961c34168","resolution":{"observed_at":"2026-08-07T00:57:02.179776Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.04022","last_updated":"2025-04-05T02:24:07Z","snapshot_observed_at":"2026-08-07T21:53:41.208900Z","submitted_at":"2025-04-05T02:24:07Z","title":"Rethinking Reflection in Pre-Training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.04022","snapshot_observed_at":"2026-08-07T00:57:02.241113Z","title":"Rethinking reflection in pre-training","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12353","last_updated":"2025-06-14T05:30:09Z","snapshot_observed_at":"2026-08-07T08:59:45.729814Z","submitted_at":"2025-06-14T05:30:09Z","title":"Efficient Reasoning Through Suppression of Self-Affirmation Reflections in Large Reasoning Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T00:57:02.241113Z"},"links":{"cited_paper":"/paper/2504.04022","citing_paper":"/paper/2506.12353"},"observation_digest":"sha256:8ff0a31a1ff037a386ab9bbf5d88bc466ded980b7d7bd8dd40ee6a0d3d5d5751","observation_id":"6cd2b2a9-b2be-4646-ae18-378ac9697d09","resolution":{"observed_at":"2026-08-07T00:57:02.241113Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:57:02.329733Z","title":"Dast: Difficulty-adaptive slow-thinking for large reasoning models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12353","last_updated":"2025-06-14T05:30:09Z","snapshot_observed_at":"2026-08-07T08:59:45.729814Z","submitted_at":"2025-06-14T05:30:09Z","title":"Efficient Reasoning Through Suppression of Self-Affirmation Reflections in Large Reasoning Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T00:57:02.329733Z"},"links":{"citing_paper":"/paper/2506.12353"},"observation_digest":"sha256:3adb1c0a63442c2054baff3fd22dc6b903c79ceb9f08246e0094679538578285","observation_id":"a1f409dd-f139-4b48-8b02-dac6572e8131","resolution":{"observed_at":"2026-08-07T00:57:02.329733Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.21074","last_updated":"2025-09-23T08:16:08Z","snapshot_observed_at":"2026-08-07T17:46:47.440455Z","submitted_at":"2025-02-28T14:07:48Z","title":"CODI: Compressing Chain-of-Thought into Continuous Space via Self-Distillation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.21074","snapshot_observed_at":"2026-08-07T00:57:02.392493Z","title":"Codi: Compressing chain-of-thought into continuous space via self-distillation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12353","last_updated":"2025-06-14T05:30:09Z","snapshot_observed_at":"2026-08-07T08:59:45.729814Z","submitted_at":"2025-06-14T05:30:09Z","title":"Efficient Reasoning Through Suppression of Self-Affirmation Reflections in Large Reasoning Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T00:57:02.392493Z"},"links":{"cited_paper":"/paper/2502.21074","citing_paper":"/paper/2506.12353"},"observation_digest":"sha256:6fb33d512668f4d84019b42f623e5ad3b2cb09fb70ccf097953b2a97b1bdda0d","observation_id":"d2758987-83ba-44dd-b603-e8d5964e0937","resolution":{"observed_at":"2026-08-07T00:57:02.392493Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.09261","last_updated":"2022-10-17T17:08:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-10-17T17:08:26Z","title":"Challenging BIG-Bench Tasks and Whether Chain-of-Thought Can Solve Them","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.09261","snapshot_observed_at":"2026-08-07T00:57:02.554880Z","title":"Challenging big-bench tasks and whether chain-of-thought can solve them","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12353","last_updated":"2025-06-14T05:30:09Z","snapshot_observed_at":"2026-08-07T08:59:45.729814Z","submitted_at":"2025-06-14T05:30:09Z","title":"Efficient Reasoning Through Suppression of Self-Affirmation Reflections in Large Reasoning Models","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T00:57:02.554880Z"},"links":{"cited_paper":"/paper/2210.09261","citing_paper":"/paper/2506.12353"},"observation_digest":"sha256:399b4b1d81635ec7d8af1b3e0f19b42ba7b023703eb1b3974d8e184c64b45f31","observation_id":"87300105-0283-41df-9416-eb40690a1c0a","resolution":{"observed_at":"2026-08-07T00:57:02.554880Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.24377","last_updated":"2025-03-31T17:58:07Z","snapshot_observed_at":"2026-08-08T01:06:18.940951Z","submitted_at":"2025-03-31T17:58:07Z","title":"Harnessing the Reasoning Economy: A Survey of Efficient Reasoning for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.24377","snapshot_observed_at":"2026-08-07T00:57:02.706327Z","title":"Harnessing the reasoning economy: A survey of efficient reasoning for large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12353","last_updated":"2025-06-14T05:30:09Z","snapshot_observed_at":"2026-08-07T08:59:45.729814Z","submitted_at":"2025-06-14T05:30:09Z","title":"Efficient Reasoning Through Suppression of Self-Affirmation Reflections in Large Reasoning Models","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T00:57:02.706327Z"},"links":{"cited_paper":"/paper/2503.24377","citing_paper":"/paper/2506.12353"},"observation_digest":"sha256:dddd1786eb895ab4d71394273fece5c0efa988c753f1edd306b407dc1108ba9e","observation_id":"993f89a0-afcc-49bd-8c27-23bd97b7722b","resolution":{"observed_at":"2026-08-07T00:57:02.706327Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.18585","last_updated":"2025-02-18T16:51:53Z","snapshot_observed_at":"2026-08-08T15:09:27.177867Z","submitted_at":"2025-01-30T18:58:18Z","title":"Thoughts Are All Over the Place: On the Underthinking of o1-Like LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.18585","snapshot_observed_at":"2026-08-07T00:57:02.795577Z","title":"Thoughts are all over the place: On the underthinking of ol-like Ilms","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12353","last_updated":"2025-06-14T05:30:09Z","snapshot_observed_at":"2026-08-07T08:59:45.729814Z","submitted_at":"2025-06-14T05:30:09Z","title":"Efficient Reasoning Through Suppression of Self-Affirmation Reflections in Large Reasoning Models","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T00:57:02.795577Z"},"links":{"cited_paper":"/paper/2501.18585","citing_paper":"/paper/2506.12353"},"observation_digest":"sha256:d6c676af31675145db9eb423a6216612f17f17444c66c002096d0ff160af6ec6","observation_id":"db5ace98-dfbb-46c7-bbb7-d387d65e5643","resolution":{"observed_at":"2026-08-07T00:57:02.795577Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-07T00:57:01.260712Z","title":"Gpt-40 system card","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12353","last_updated":"2025-06-14T05:30:09Z","snapshot_observed_at":"2026-08-07T08:59:45.729814Z","submitted_at":"2025-06-14T05:30:09Z","title":"Efficient Reasoning Through Suppression of Self-Affirmation Reflections in Large Reasoning Models","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T00:57:01.260712Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2506.12353"},"observation_digest":"sha256:5d6a2822ce7c33f87a307a9c3545559b7727ec8eba24940aedc353f8ea210d1a","observation_id":"aee5a5d4-149f-4feb-a554-b54d6110e04a","resolution":{"observed_at":"2026-08-07T00:57:01.260712Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:57:02.853369Z","title":"Tokenskip: Controllable chain-of-thought compression in Ilms","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12353","last_updated":"2025-06-14T05:30:09Z","snapshot_observed_at":"2026-08-07T08:59:45.729814Z","submitted_at":"2025-06-14T05:30:09Z","title":"Efficient Reasoning Through Suppression of Self-Affirmation Reflections in Large Reasoning Models","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T00:57:02.853369Z"},"links":{"citing_paper":"/paper/2506.12353"},"observation_digest":"sha256:4742169deb48ca9d344ed2d7dc3e7ceba295c6b5e51d40294ba2c93832b49a0f","observation_id":"d681e2a7-2e87-4ebd-92f2-a1f329307db5","resolution":{"observed_at":"2026-08-07T00:57:02.853369Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.18600","last_updated":"2025-03-03T17:08:21Z","snapshot_observed_at":"2026-08-07T17:49:06.764625Z","submitted_at":"2025-02-25T19:36:06Z","title":"Chain of Draft: Thinking Faster by Writing Less","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.18600","snapshot_observed_at":"2026-08-07T00:57:02.942395Z","title":"Chain of draft: Thinking faster by writing less","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12353","last_updated":"2025-06-14T05:30:09Z","snapshot_observed_at":"2026-08-07T08:59:45.729814Z","submitted_at":"2025-06-14T05:30:09Z","title":"Efficient Reasoning Through Suppression of Self-Affirmation Reflections in Large Reasoning Models","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T00:57:02.942395Z"},"links":{"cited_paper":"/paper/2502.18600","citing_paper":"/paper/2506.12353"},"observation_digest":"sha256:91a940b2711950d18d24ba4440b201e5ba1e1705847c6f05b35103fa1a6e3938","observation_id":"4018b750-52c3-4204-99fc-b70ad89c8a22","resolution":{"observed_at":"2026-08-07T00:57:02.942395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-07T00:57:03.016370Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12353","last_updated":"2025-06-14T05:30:09Z","snapshot_observed_at":"2026-08-07T08:59:45.729814Z","submitted_at":"2025-06-14T05:30:09Z","title":"Efficient Reasoning Through Suppression of Self-Affirmation Reflections in Large Reasoning Models","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T00:57:03.016370Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2506.12353"},"observation_digest":"sha256:9db5f56822545d0f9ff2e45600758fa1781db4a86de682aa41cd12185564d1ec","observation_id":"005af0ef-5636-46c8-83f1-231e846aef3f","resolution":{"observed_at":"2026-08-07T00:57:03.016370Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03373","last_updated":"2025-02-05T17:13:32Z","snapshot_observed_at":"2026-07-06T20:31:41.231839Z","submitted_at":"2025-02-05T17:13:32Z","title":"Demystifying Long Chain-of-Thought Reasoning in LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.03373","snapshot_observed_at":"2026-08-07T00:57:03.086576Z","title":"Demystifying long chain-of-thought reasoning in Ilms","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12353","last_updated":"2025-06-14T05:30:09Z","snapshot_observed_at":"2026-08-07T08:59:45.729814Z","submitted_at":"2025-06-14T05:30:09Z","title":"Efficient Reasoning Through Suppression of Self-Affirmation Reflections in Large Reasoning Models","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T00:57:03.086576Z"},"links":{"cited_paper":"/paper/2502.03373","citing_paper":"/paper/2506.12353"},"observation_digest":"sha256:eea0792ec27667d414142fe06bfd1013647ea5625be70e377e78f987b688561f","observation_id":"4b265649-d87c-49ab-8a54-2c9249ae37d6","resolution":{"observed_at":"2026-08-07T00:57:03.086576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.16419","last_updated":"2025-08-21T19:14:40Z","snapshot_observed_at":"2026-08-07T04:27:23.738927Z","submitted_at":"2025-03-20T17:59:38Z","title":"Stop Overthinking: A Survey on Efficient Reasoning for Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.16419","snapshot_observed_at":"2026-08-07T00:57:02.482809Z","title":"Stop overthinking: A survey on efficient reasoning for large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12353","last_updated":"2025-06-14T05:30:09Z","snapshot_observed_at":"2026-08-07T08:59:45.729814Z","submitted_at":"2025-06-14T05:30:09Z","title":"Efficient Reasoning Through Suppression of Self-Affirmation Reflections in Large Reasoning Models","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T00:57:02.482809Z"},"links":{"cited_paper":"/paper/2503.16419","citing_paper":"/paper/2506.12353"},"observation_digest":"sha256:97106c866ceb010d466d225434fce4a85863d968d967f173e33b2cb60516fe13","observation_id":"48bfcf8c-7c5b-44b0-8460-e640161c230a","resolution":{"observed_at":"2026-08-07T00:57:02.482809Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:56:59.939407Z","title":"Sketch-of-thought: Efficient lm reasoning with adaptive cognitive-inspired sketching","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12353","last_updated":"2025-06-14T05:30:09Z","snapshot_observed_at":"2026-08-07T08:59:45.729814Z","submitted_at":"2025-06-14T05:30:09Z","title":"Efficient Reasoning Through Suppression of Self-Affirmation Reflections in Large Reasoning Models","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-07T00:56:59.939407Z"},"links":{"citing_paper":"/paper/2506.12353"},"observation_digest":"sha256:d69ff5cd1499baddb2e0cd61e22772053b895196d9a52fd7f43b7c71ca7f42cd","observation_id":"87337e2b-fa9b-4e9c-9645-782b05063284","resolution":{"observed_at":"2026-08-07T00:56:59.939407Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12599","last_updated":"2025-06-03T02:14:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T02:48:14Z","title":"Kimi k1.5: Scaling Reinforcement Learning with LLMs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12599","snapshot_observed_at":"2026-08-07T00:57:02.644849Z","title":"Kimi k1.5: Scaling reinforcement learning with Ilms","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12353","last_updated":"2025-06-14T05:30:09Z","snapshot_observed_at":"2026-08-07T08:59:45.729814Z","submitted_at":"2025-06-14T05:30:09Z","title":"Efficient Reasoning Through Suppression of Self-Affirmation Reflections in Large Reasoning Models","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-07T00:57:02.644849Z"},"links":{"cited_paper":"/paper/2501.12599","citing_paper":"/paper/2506.12353"},"observation_digest":"sha256:2d78421b27eb8bbb25248def504400b9b25fd47820f58f92dbd291cbd621fdbe","observation_id":"00c22b61-848d-4d34-bf5f-7032a4c3f332","resolution":{"observed_at":"2026-08-07T00:57:02.644849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01141","last_updated":"2025-04-01T00:41:36Z","snapshot_observed_at":"2026-08-08T04:02:43.828729Z","submitted_at":"2025-03-03T03:48:20Z","title":"How Well do LLMs Compress Their Own Chain-of-Thought? A Token Complexity Approach","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.01141","snapshot_observed_at":"2026-08-07T00:57:01.431811Z","title":"How well do Ilms compress their own chain-of- thought? a token complexity approach","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12353","last_updated":"2025-06-14T05:30:09Z","snapshot_observed_at":"2026-08-07T08:59:45.729814Z","submitted_at":"2025-06-14T05:30:09Z","title":"Efficient Reasoning Through Suppression of Self-Affirmation Reflections in Large Reasoning Models","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-07T00:57:01.431811Z"},"links":{"cited_paper":"/paper/2503.01141","citing_paper":"/paper/2506.12353"},"observation_digest":"sha256:dfef2afff064a3f70d8751fc611ef68f6afea1bf7cdc450c932d9ed7bd410cc4","observation_id":"c508e0f9-1bb8-4906-9b2b-9da57a366953","resolution":{"observed_at":"2026-08-07T00:57:01.431811Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.04428","last_updated":"2025-02-06T18:59:11Z","snapshot_observed_at":"2026-07-06T20:32:28.465641Z","submitted_at":"2025-02-06T18:59:11Z","title":"Confident or Seek Stronger: Exploring Uncertainty-Based On-device LLM Routing From Benchmarking to Generalization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.04428","snapshot_observed_at":"2026-08-07T00:57:00.320706Z","title":"Confident or seek stronger: Exploring uncertainty-based on-device Ilm routing from benchmarking to generalization","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12353","last_updated":"2025-06-14T05:30:09Z","snapshot_observed_at":"2026-08-07T08:59:45.729814Z","submitted_at":"2025-06-14T05:30:09Z","title":"Efficient Reasoning Through Suppression of Self-Affirmation Reflections in Large Reasoning Models","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-07T00:57:00.320706Z"},"links":{"cited_paper":"/paper/2502.04428","citing_paper":"/paper/2506.12353"},"observation_digest":"sha256:f623b23dda43638b1b289afbb3d977736206bbfc41950a047b61d3ff375510f8","observation_id":"c37b93d1-a14e-4fe0-9281-4a6480356d16","resolution":{"observed_at":"2026-08-07T00:57:00.320706Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.07732","last_updated":"2021-08-16T03:57:30Z","snapshot_observed_at":"2026-08-02T19:23:53.535075Z","submitted_at":"2021-08-16T03:57:30Z","title":"Program Synthesis with Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.07732","snapshot_observed_at":"2026-08-07T00:56:59.824558Z","title":"Program synthesis with large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12353","last_updated":"2025-06-14T05:30:09Z","snapshot_observed_at":"2026-08-07T08:59:45.729814Z","submitted_at":"2025-06-14T05:30:09Z","title":"Efficient Reasoning Through Suppression of Self-Affirmation Reflections in Large Reasoning Models","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-07T00:56:59.824558Z"},"links":{"cited_paper":"/paper/2108.07732","citing_paper":"/paper/2506.12353"},"observation_digest":"sha256:58313171e0bc9a1d8c76c7b7f9d3067816abd0d84cea3a8c9532e7ebf857a180","observation_id":"6513cbd3-fbbc-4499-9166-38d364166eb0","resolution":{"observed_at":"2026-08-07T00:56:59.824558Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.12353","last_updated":"2025-06-14T05:30:09Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T08:59:45.729814Z","submitted_at":"2025-06-14T05:30:09Z","title":"Efficient Reasoning Through Suppression of Self-Affirmation Reflections in Large Reasoning Models"},"reference_resolution":{"displayed":37,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":36,"verified_exact":0,"verified_fuzzy":1},"total_outbound_references":37},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 37 of 37 outbound references and 4 inbound Pith citation observations for arXiv:2506.12353."}