{"as_of":"2026-08-16T00:54:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4eb2b8f9c65e090a2af02227480043f83d1d27e744af24c36be7d8dc9855430c","coverage":[{"denominator":31,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":31,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T23:28:41.497380Z","state":"measured"},{"denominator":36,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":36,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":5,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":5,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T08:09:52.972532Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-08T22:25:39.517114Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.18237","last_updated":"2025-06-23T02:06:04Z","snapshot_observed_at":"2026-08-13T13:54:40.411919Z","submitted_at":"2025-06-23T02:06:04Z","title":"AdapThink: Adaptive Thinking Preferences for Reasoning Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.18237","snapshot_observed_at":"2026-08-03T08:09:52.972532Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.18146","last_updated":"2026-07-16T10:27:29Z","snapshot_observed_at":"2026-08-06T14:40:38.756042Z","submitted_at":"2026-01-26T05:09:07Z","title":"Think When Needed: Model-Aware Reasoning Routing for LLM-based Ranking","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-03T08:09:52.972532Z"},"links":{"cited_paper":"/paper/2506.18237","citing_paper":"/paper/2601.18146"},"observation_digest":"sha256:cecb458a874309c17157c40bb80bdac764003a0cc43229492d8de859960fb0de","observation_id":"5cf323ed-ea45-4fa9-a29d-36bcd973a7c4","resolution":{"observed_at":"2026-08-03T08:09:52.972532Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.18237","last_updated":"2025-06-23T02:06:04Z","snapshot_observed_at":"2026-08-13T13:54:40.411919Z","submitted_at":"2025-06-23T02:06:04Z","title":"AdapThink: Adaptive Thinking Preferences for Reasoning Language Model","version":1},"cited_work":{"arxiv_id":"2506.18237","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.18237","snapshot_observed_at":"2026-07-08T22:25:39.517114Z","title":"Adapthink: Adaptive thinking pref- erences for reasoning language model","venue":"cs.LG","work_id":"7604f65a-25dd-4e1b-ab08-765d419b68e1","year":2025},"citing_paper":{"arxiv_id":"2605.10195","last_updated":"2026-05-14T07:42:56Z","snapshot_observed_at":"2026-08-03T09:42:12.047946Z","submitted_at":"2026-05-11T08:45:17Z","title":"Breaking the Reward Barrier: Accelerating Tree-of-Thought Reasoning via Speculative Exploration","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-12T03:51:52.375703Z"},"links":{"cited_paper":"/paper/2506.18237","citing_paper":"/paper/2605.10195"},"observation_digest":"sha256:1ec18aa42507dbc21e08eaf26bedb0ae63e3aa6dd5da97b94c7b42e45b949e08","observation_id":"ccd2a054-c218-41d7-a08c-4b1421badcb5","resolution":{"observed_at":"2026-05-12T06:51:30.150918Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.18237","last_updated":"2025-06-23T02:06:04Z","snapshot_observed_at":"2026-08-13T13:54:40.411919Z","submitted_at":"2025-06-23T02:06:04Z","title":"AdapThink: Adaptive Thinking Preferences for Reasoning Language Model","version":1},"cited_work":{"arxiv_id":"2506.18237","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.18237","snapshot_observed_at":"2026-07-08T22:25:39.517114Z","title":"Adapthink: Adaptive thinking pref- erences for reasoning language model","venue":"cs.LG","work_id":"7604f65a-25dd-4e1b-ab08-765d419b68e1","year":2025},"citing_paper":{"arxiv_id":"2605.10195","last_updated":"2026-05-14T07:42:56Z","snapshot_observed_at":"2026-08-03T09:42:12.047946Z","submitted_at":"2026-05-11T08:45:17Z","title":"Breaking the Reward Barrier: Accelerating Tree-of-Thought Reasoning via Speculative Exploration","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-15T05:11:32.053440Z"},"links":{"cited_paper":"/paper/2506.18237","citing_paper":"/paper/2605.10195"},"observation_digest":"sha256:654e22870c36424ef36c64d1227bbabd23b231871d6b9af70b1d07e1479a07d3","observation_id":"f7cfc255-5ae2-4bea-9a99-5e86b91588df","resolution":{"observed_at":"2026-05-15T05:15:03.277972Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.18237","last_updated":"2025-06-23T02:06:04Z","snapshot_observed_at":"2026-08-13T13:54:40.411919Z","submitted_at":"2025-06-23T02:06:04Z","title":"AdapThink: Adaptive Thinking Preferences for Reasoning Language Model","version":1},"cited_work":{"arxiv_id":"2506.18237","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.18237","snapshot_observed_at":"2026-07-08T22:25:39.517114Z","title":"Adapthink: Adaptive thinking pref- erences for reasoning language model","venue":"cs.LG","work_id":"7604f65a-25dd-4e1b-ab08-765d419b68e1","year":2025},"citing_paper":{"arxiv_id":"2606.18089","last_updated":"2026-07-05T17:40:26Z","snapshot_observed_at":"2026-07-12T13:34:39.011240Z","submitted_at":"2026-06-16T15:55:28Z","title":"From Reasoning Traces to Reusable Modules: Understanding Compositional Generalization in Language Model Reasoning","version":1},"reference_index":119,"source":"arxiv_source","source_observed_at":"2026-06-27T01:13:11.483599Z"},"links":{"cited_paper":"/paper/2506.18237","citing_paper":"/paper/2606.18089"},"observation_digest":"sha256:b328f996393aa7ba0246dfe1a8ef0ce86136a44abd689f4efe3a3f7e85bc6032","observation_id":"24ad31e4-282f-4449-9193-27b8ccbde130","resolution":{"observed_at":"2026-07-03T20:38:55.833122Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.18237","last_updated":"2025-06-23T02:06:04Z","snapshot_observed_at":"2026-08-13T13:54:40.411919Z","submitted_at":"2025-06-23T02:06:04Z","title":"AdapThink: Adaptive Thinking Preferences for Reasoning Language Model","version":1},"cited_work":{"arxiv_id":"2506.18237","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.18237","snapshot_observed_at":"2026-07-08T22:25:39.517114Z","title":"Adapthink: Adaptive thinking pref- erences for reasoning language model","venue":"cs.LG","work_id":"7604f65a-25dd-4e1b-ab08-765d419b68e1","year":2025},"citing_paper":{"arxiv_id":"2607.05861","last_updated":"2026-07-07T05:34:25Z","snapshot_observed_at":"2026-08-03T04:02:27.415732Z","submitted_at":"2026-07-07T05:34:25Z","title":"Mitigating Factual Hallucination in Large Reasoning Models via Mixed-Mode Advantage Regularization","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-08T22:25:35.119625Z"},"links":{"cited_paper":"/paper/2506.18237","citing_paper":"/paper/2607.05861"},"observation_digest":"sha256:750bc35a29e6a6259d5f9ab8664df4dcef582c59de97ec20a154fe0a942b6017","observation_id":"3131f75a-e836-4b65-9e7d-5f7bd9109e76","resolution":{"observed_at":"2026-07-08T22:25:39.518829Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.18237/citation-record","integrity":"/paper/2506.18237/integrity","json":"/paper/2506.18237/citation-record.json","paper":"/paper/2506.18237"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2503.04697","last_updated":"2025-10-03T01:55:58Z","snapshot_observed_at":"2026-08-15T06:09:25.789897Z","submitted_at":"2025-03-06T18:43:29Z","title":"L1: Controlling How Long A Reasoning Model Thinks With Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.04697","snapshot_observed_at":"2026-08-06T23:28:36.724742Z","title":"L1: Controlling how long a reasoning model thinks with reinforcement learning.arXiv preprint arXiv:2503.04697, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.18237","last_updated":"2025-06-23T02:06:04Z","snapshot_observed_at":"2026-08-13T13:54:40.411919Z","submitted_at":"2025-06-23T02:06:04Z","title":"AdapThink: Adaptive Thinking Preferences for Reasoning Language Model","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:36.724742Z"},"links":{"cited_paper":"/paper/2503.04697","citing_paper":"/paper/2506.18237"},"observation_digest":"sha256:8c51e32e354a47865359d10ed846d9a3e3492b44c43bfd0f2cea8f8a7a3e26d7","observation_id":"f17b4c46-bbd7-4971-a1c7-f5b5585aad04","resolution":{"observed_at":"2026-08-06T23:28:36.724742Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.21187","last_updated":"2025-02-01T07:57:37Z","snapshot_observed_at":"2026-08-01T16:43:44.704797Z","submitted_at":"2024-12-30T18:55:12Z","title":"Do NOT Think That Much for 2+3=? On the Overthinking of o1-Like LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.21187","snapshot_observed_at":"2026-08-06T23:28:36.788614Z","title":"Do not think that much for 2+ 3=? on the overthinking of o1-like llms.arXiv preprint arXiv:2412.21187, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.18237","last_updated":"2025-06-23T02:06:04Z","snapshot_observed_at":"2026-08-13T13:54:40.411919Z","submitted_at":"2025-06-23T02:06:04Z","title":"AdapThink: Adaptive Thinking Preferences for Reasoning Language Model","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:36.788614Z"},"links":{"cited_paper":"/paper/2412.21187","citing_paper":"/paper/2506.18237"},"observation_digest":"sha256:99abd1a07a930ce5e65f9c6439fdfb7629c0d8d408581235462f7a89d5901c3a","observation_id":"37d72e08-9e21-471a-b5d0-857ff25dcf3b","resolution":{"observed_at":"2026-08-06T23:28:36.788614Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-08-15T12:33:55.451951Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-06T23:28:36.942227Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning.arXiv preprint arXiv:2501.12948, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.18237","last_updated":"2025-06-23T02:06:04Z","snapshot_observed_at":"2026-08-13T13:54:40.411919Z","submitted_at":"2025-06-23T02:06:04Z","title":"AdapThink: Adaptive Thinking Preferences for Reasoning Language Model","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:36.942227Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2506.18237"},"observation_digest":"sha256:eeea88234218999adfc2f87bacc1c8712bd47d8b67542d76351cb01f2817e2ae","observation_id":"22c5096e-6144-4ae9-be1b-08cab1655567","resolution":{"observed_at":"2026-08-06T23:28:36.942227Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18547","last_updated":"2025-06-02T00:44:09Z","snapshot_observed_at":"2026-08-13T10:37:12.511011Z","submitted_at":"2024-12-24T16:55:45Z","title":"Token-Budget-Aware LLM Reasoning","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.18547","snapshot_observed_at":"2026-08-06T23:28:37.065480Z","title":"Token-budget-aware llm reasoning.arXiv preprint arXiv:2412.18547, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.18237","last_updated":"2025-06-23T02:06:04Z","snapshot_observed_at":"2026-08-13T13:54:40.411919Z","submitted_at":"2025-06-23T02:06:04Z","title":"AdapThink: Adaptive Thinking Preferences for Reasoning Language Model","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:37.065480Z"},"links":{"cited_paper":"/paper/2412.18547","citing_paper":"/paper/2506.18237"},"observation_digest":"sha256:1e713b8115b0433b0f5d1e1ce08ec46f3a7660d99af0f20a3b0db410047bd7b7","observation_id":"3c7f70ea-0ad3-403a-a856-46924bee4374","resolution":{"observed_at":"2026-08-06T23:28:37.065480Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:28:42.994564Z","title":"The impact of reasoning step length on large language models","venue":null,"work_id":"1e744c1d-0035-4df5-9995-edbdd1bfec25","year":2024},"citing_paper":{"arxiv_id":"2506.18237","last_updated":"2025-06-23T02:06:04Z","snapshot_observed_at":"2026-08-13T13:54:40.411919Z","submitted_at":"2025-06-23T02:06:04Z","title":"AdapThink: Adaptive Thinking Preferences for Reasoning Language Model","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:37.186097Z"},"links":{"citing_paper":"/paper/2506.18237"},"observation_digest":"sha256:d59d85e38f9cd0935a54b4e550bc0b2ac527151d5e33cb09891817db1cde8348","observation_id":"f84dbad1-3d81-40f6-ba45-483941eaa666","resolution":{"observed_at":"2026-08-06T23:28:43.105111Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:28:37.304745Z","title":"C3ot: Generating shorter chain-of- thought without compromising effectiveness","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.18237","last_updated":"2025-06-23T02:06:04Z","snapshot_observed_at":"2026-08-13T13:54:40.411919Z","submitted_at":"2025-06-23T02:06:04Z","title":"AdapThink: Adaptive Thinking Preferences for Reasoning Language Model","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:37.304745Z"},"links":{"citing_paper":"/paper/2506.18237"},"observation_digest":"sha256:16661149ce5bb383dbb0e03ae649ca651a71d5479e4bb3de6d20da1e65c959cc","observation_id":"30db8791-896d-425b-9c11-d5497c67957a","resolution":{"observed_at":"2026-08-06T23:28:37.304745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.01679","last_updated":"2025-06-03T20:51:06Z","snapshot_observed_at":"2026-08-14T16:23:58.195255Z","submitted_at":"2024-10-02T15:49:30Z","title":"VinePPO: Refining Credit Assignment in RL Training of LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.01679","snapshot_observed_at":"2026-08-06T23:28:37.524741Z","title":"Vineppo: Unlocking rl potential for llm reasoning through refined credit assignment.arXiv preprint arXiv:2410.01679, 2024","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.18237","last_updated":"2025-06-23T02:06:04Z","snapshot_observed_at":"2026-08-13T13:54:40.411919Z","submitted_at":"2025-06-23T02:06:04Z","title":"AdapThink: Adaptive Thinking Preferences for Reasoning Language Model","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:37.524741Z"},"links":{"cited_paper":"/paper/2410.01679","citing_paper":"/paper/2506.18237"},"observation_digest":"sha256:164e7d4da5c05148a1ace5d059755694b269bb154a01afd2fa1327892277f8ce","observation_id":"7659bb44-44de-4f05-b2e4-a30d560d3f6d","resolution":{"observed_at":"2026-08-06T23:28:37.524741Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.21321","last_updated":"2025-03-24T09:34:38Z","snapshot_observed_at":"2026-08-09T09:18:08.427943Z","submitted_at":"2025-02-28T18:59:54Z","title":"LLM Post-Training: A Deep Dive into Reasoning Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.21321","snapshot_observed_at":"2026-08-06T23:28:37.684822Z","title":"Llm post-training: A deep dive into reasoning large language models.arXiv preprint arXiv:2502.21321, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.18237","last_updated":"2025-06-23T02:06:04Z","snapshot_observed_at":"2026-08-13T13:54:40.411919Z","submitted_at":"2025-06-23T02:06:04Z","title":"AdapThink: Adaptive Thinking Preferences for Reasoning Language Model","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:37.684822Z"},"links":{"cited_paper":"/paper/2502.21321","citing_paper":"/paper/2506.18237"},"observation_digest":"sha256:ea81d975ffbc54c3e85de50fa11beb739eaca5c85e79ebf3f5604537d963a0e5","observation_id":"2a7aabb6-5f76-46eb-9799-f7c11e1203a4","resolution":{"observed_at":"2026-08-06T23:28:37.684822Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13943","last_updated":"2025-05-31T13:35:35Z","snapshot_observed_at":"2026-08-07T18:04:16.547436Z","submitted_at":"2025-02-19T18:35:55Z","title":"AdaptiveStep: Automatically Dividing Reasoning Step through Model Confidence","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13943","snapshot_observed_at":"2026-08-06T23:28:37.815034Z","title":"Adaptivestep: Automatically dividing reasoning step through model confidence.arXiv preprint arXiv:2502.13943, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.18237","last_updated":"2025-06-23T02:06:04Z","snapshot_observed_at":"2026-08-13T13:54:40.411919Z","submitted_at":"2025-06-23T02:06:04Z","title":"AdapThink: Adaptive Thinking Preferences for Reasoning Language Model","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:37.815034Z"},"links":{"cited_paper":"/paper/2502.13943","citing_paper":"/paper/2506.18237"},"observation_digest":"sha256:b293675705f808bf101516bfd750051839c05117092fb17aae445d30801b6475","observation_id":"a453f98f-0bc6-4b5c-b537-0675678ee81e","resolution":{"observed_at":"2026-08-06T23:28:37.815034Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:28:37.939029Z","title":"Tang, Manan Roongta, Colin Cai, Jeffrey Luo, Li Erran Li, Raluca Ada Popa, and Ion Stoica","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.18237","last_updated":"2025-06-23T02:06:04Z","snapshot_observed_at":"2026-08-13T13:54:40.411919Z","submitted_at":"2025-06-23T02:06:04Z","title":"AdapThink: Adaptive Thinking Preferences for Reasoning Language Model","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:37.939029Z"},"links":{"citing_paper":"/paper/2506.18237"},"observation_digest":"sha256:bfc5a299a198de2ba0509650159f51691f145832794efbe9a998d8f0dc73e686","observation_id":"b8df86ba-8f02-41cb-afa5-534b6ed37449","resolution":{"observed_at":"2026-08-06T23:28:37.939029Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.02587","last_updated":"2025-04-04T01:07:06Z","snapshot_observed_at":"2026-08-15T22:16:49.065729Z","submitted_at":"2025-04-03T13:53:28Z","title":"Rethinking RL Scaling for Vision Language Models: A Transparent, From-Scratch Framework and Comprehensive Evaluation Scheme","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.02587","snapshot_observed_at":"2026-08-06T23:28:38.124748Z","title":"Rethinking rl scaling for vision language models: A transparent, from-scratch framework and comprehensive evaluation scheme.arXiv preprint arXiv:2504.02587, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.18237","last_updated":"2025-06-23T02:06:04Z","snapshot_observed_at":"2026-08-13T13:54:40.411919Z","submitted_at":"2025-06-23T02:06:04Z","title":"AdapThink: Adaptive Thinking Preferences for Reasoning Language Model","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:38.124748Z"},"links":{"cited_paper":"/paper/2504.02587","citing_paper":"/paper/2506.18237"},"observation_digest":"sha256:7a3fc34f0de1f6b2db3d4edf427b62e1299f1270290afe78ce9215c4ac9fc980","observation_id":"3751446f-e19e-4344-aded-4380b4983e01","resolution":{"observed_at":"2026-08-06T23:28:38.124748Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:28:38.341898Z","title":"Peft: State-of-the-art parameter-efficient fine-tuning methods","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.18237","last_updated":"2025-06-23T02:06:04Z","snapshot_observed_at":"2026-08-13T13:54:40.411919Z","submitted_at":"2025-06-23T02:06:04Z","title":"AdapThink: Adaptive Thinking Preferences for Reasoning Language Model","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:38.341898Z"},"links":{"citing_paper":"/paper/2506.18237"},"observation_digest":"sha256:5341793f76c892837017342405b6ccefab17aeb4ca50e67b7cfedb72d0331678","observation_id":"edab26c8-8e1a-4930-ad96-a80a54a2a313","resolution":{"observed_at":"2026-08-06T23:28:38.341898Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.00436","last_updated":"2023-10-05T12:59:59Z","snapshot_observed_at":"2026-08-14T21:06:21.407760Z","submitted_at":"2023-08-01T10:31:36Z","title":"SelfCheck: Using LLMs to Zero-Shot Check Their Own Step-by-Step Reasoning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.00436","snapshot_observed_at":"2026-08-06T23:28:38.512970Z","title":"Selfcheck: Using llms to zero-shot check their own step-by-step reasoning.arXiv preprint arXiv:2308.00436, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.18237","last_updated":"2025-06-23T02:06:04Z","snapshot_observed_at":"2026-08-13T13:54:40.411919Z","submitted_at":"2025-06-23T02:06:04Z","title":"AdapThink: Adaptive Thinking Preferences for Reasoning Language Model","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:38.512970Z"},"links":{"cited_paper":"/paper/2308.00436","citing_paper":"/paper/2506.18237"},"observation_digest":"sha256:d465c649bf18c293f7c31cf631646a23e414a1df959c916525924c450e453564","observation_id":"16d0f8f9-75ae-4667-bab6-dc0ebb366f70","resolution":{"observed_at":"2026-08-06T23:28:38.512970Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.19393","last_updated":"2025-03-01T06:07:39Z","snapshot_observed_at":"2026-08-14T11:38:51.383664Z","submitted_at":"2025-01-31T18:48:08Z","title":"s1: Simple test-time scaling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.19393","snapshot_observed_at":"2026-08-06T23:28:38.697944Z","title":"s1: Simple test-time scaling.arXiv preprint arXiv:2501.19393, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.18237","last_updated":"2025-06-23T02:06:04Z","snapshot_observed_at":"2026-08-13T13:54:40.411919Z","submitted_at":"2025-06-23T02:06:04Z","title":"AdapThink: Adaptive Thinking Preferences for Reasoning Language Model","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:38.697944Z"},"links":{"cited_paper":"/paper/2501.19393","citing_paper":"/paper/2506.18237"},"observation_digest":"sha256:ef6ceca2a3b56d2f82395ab23eec718e89e4ad71ef49a8c7cd3bde6478fbe555","observation_id":"5d105e50-c585-4d6b-b683-df77404e5c33","resolution":{"observed_at":"2026-08-06T23:28:38.697944Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.19825","last_updated":"2025-01-23T08:45:52Z","snapshot_observed_at":"2026-08-15T18:58:30.009905Z","submitted_at":"2024-07-29T09:21:52Z","title":"Concise Thoughts: Impact of Output Length on LLM Reasoning and Cost","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.19825","snapshot_observed_at":"2026-08-06T23:28:38.873840Z","title":"Concise thoughts: Impact of output length on llm reasoning and cost.arXiv preprint arXiv:2407.19825, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.18237","last_updated":"2025-06-23T02:06:04Z","snapshot_observed_at":"2026-08-13T13:54:40.411919Z","submitted_at":"2025-06-23T02:06:04Z","title":"AdapThink: Adaptive Thinking Preferences for Reasoning Language Model","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:38.873840Z"},"links":{"cited_paper":"/paper/2407.19825","citing_paper":"/paper/2506.18237"},"observation_digest":"sha256:515ca064650d02b930575665c50d3d7ba75fd6bff73995ca0441a1340f022915","observation_id":"5621987e-1cbb-4c3b-abc2-49183719e93e","resolution":{"observed_at":"2026-08-06T23:28:38.873840Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:28:42.786839Z","title":"Learning to reason with LLMs","venue":null,"work_id":"f6fd4fae-83c5-42e0-afec-7fc1f1f668d1","year":2024},"citing_paper":{"arxiv_id":"2506.18237","last_updated":"2025-06-23T02:06:04Z","snapshot_observed_at":"2026-08-13T13:54:40.411919Z","submitted_at":"2025-06-23T02:06:04Z","title":"AdapThink: Adaptive Thinking Preferences for Reasoning Language Model","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:39.084491Z"},"links":{"citing_paper":"/paper/2506.18237"},"observation_digest":"sha256:1afef2f0b2b7583fd94b34c4653d0374c668e093329b401d276b76223814d583","observation_id":"e0eb64d0-8518-4b30-bd0a-13a64513ced2","resolution":{"observed_at":"2026-08-06T23:28:42.894007Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:28:42.478703Z","title":"The benefits of a concise chain of thought on problem- solving in large language models","venue":null,"work_id":"0dee820f-a51e-4f78-88aa-f7973f0b03bd","year":2024},"citing_paper":{"arxiv_id":"2506.18237","last_updated":"2025-06-23T02:06:04Z","snapshot_observed_at":"2026-08-13T13:54:40.411919Z","submitted_at":"2025-06-23T02:06:04Z","title":"AdapThink: Adaptive Thinking Preferences for Reasoning Language Model","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:39.260339Z"},"links":{"citing_paper":"/paper/2506.18237"},"observation_digest":"sha256:ecec1a5a3cd0eaade518307c22c24ff687255baf17e1b79d505e67ee5295c829","observation_id":"66eae5e8-f01a-4bf3-bffd-b34e62915fab","resolution":{"observed_at":"2026-08-06T23:28:42.608172Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.06682","last_updated":"2024-10-16T23:19:46Z","snapshot_observed_at":"2026-08-13T00:14:28.486590Z","submitted_at":"2024-05-05T18:56:46Z","title":"Self-Reflection in LLM Agents: Effects on Problem-Solving Performance","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.06682","snapshot_observed_at":"2026-08-06T23:28:39.415341Z","title":"Self-reflection in llm agents: Effects on problem-solving performance.arXiv preprint arXiv:2405.06682, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.18237","last_updated":"2025-06-23T02:06:04Z","snapshot_observed_at":"2026-08-13T13:54:40.411919Z","submitted_at":"2025-06-23T02:06:04Z","title":"AdapThink: Adaptive Thinking Preferences for Reasoning Language Model","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:39.415341Z"},"links":{"cited_paper":"/paper/2405.06682","citing_paper":"/paper/2506.18237"},"observation_digest":"sha256:281ad6b2cecc3ccd79f9d03e8a0989315f6d48b2bb2b7183520521066c55dfc2","observation_id":"36ab0612-a4a0-4de0-ab01-62e0d8d342b1","resolution":{"observed_at":"2026-08-06T23:28:39.415341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.05802","last_updated":"2022-06-14T01:16:24Z","snapshot_observed_at":"2026-08-13T17:24:30.719766Z","submitted_at":"2022-06-12T17:40:53Z","title":"Self-critiquing models for assisting human evaluators","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.05802","snapshot_observed_at":"2026-08-06T23:28:39.540270Z","title":"Self-critiquing models for assisting human evaluators.arXiv preprint arXiv:2206.05802, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.18237","last_updated":"2025-06-23T02:06:04Z","snapshot_observed_at":"2026-08-13T13:54:40.411919Z","submitted_at":"2025-06-23T02:06:04Z","title":"AdapThink: Adaptive Thinking Preferences for Reasoning Language Model","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:39.540270Z"},"links":{"cited_paper":"/paper/2206.05802","citing_paper":"/paper/2506.18237"},"observation_digest":"sha256:c0aa5874c6e19ec836f452ddadfbc23418dc23ecfe555c6c9d3929bf28e06b6a","observation_id":"73c2c593-603d-45e2-82f6-8e6c659c86d0","resolution":{"observed_at":"2026-08-06T23:28:39.540270Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.02508","last_updated":"2025-06-16T03:29:47Z","snapshot_observed_at":"2026-08-15T08:49:34.092853Z","submitted_at":"2025-02-04T17:26:58Z","title":"Satori: Reinforcement Learning with Chain-of-Action-Thought Enhances LLM Reasoning via Autoregressive Search","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.02508","snapshot_observed_at":"2026-08-06T23:28:39.674751Z","title":"Satori: Reinforcement learning with chain-of-action-thought enhances llm reasoning via autoregressive search.arXiv preprint arXiv:2502.02508, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.18237","last_updated":"2025-06-23T02:06:04Z","snapshot_observed_at":"2026-08-13T13:54:40.411919Z","submitted_at":"2025-06-23T02:06:04Z","title":"AdapThink: Adaptive Thinking Preferences for Reasoning Language Model","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:39.674751Z"},"links":{"cited_paper":"/paper/2502.02508","citing_paper":"/paper/2506.18237"},"observation_digest":"sha256:5da740989c808519b5b1d835f821454e22e170a62bd4e9a60fe3ae2569b6a592","observation_id":"f604a5e2-42d6-4142-893b-39539c96e298","resolution":{"observed_at":"2026-08-06T23:28:39.674751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:28:39.864875Z","title":"Dast: Difficulty-adaptive slow-thinking for large reasoning models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.18237","last_updated":"2025-06-23T02:06:04Z","snapshot_observed_at":"2026-08-13T13:54:40.411919Z","submitted_at":"2025-06-23T02:06:04Z","title":"AdapThink: Adaptive Thinking Preferences for Reasoning Language Model","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:39.864875Z"},"links":{"citing_paper":"/paper/2506.18237"},"observation_digest":"sha256:2fbf42f4eb4fce643aa3b6ac98529de6ee25c3813b75cc7f23a633721befaa08","observation_id":"d57ebf6f-ff97-4d80-9185-64b7f3245ed0","resolution":{"observed_at":"2026-08-06T23:28:39.864875Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.16419","last_updated":"2025-08-21T19:14:40Z","snapshot_observed_at":"2026-08-11T13:10:23.709172Z","submitted_at":"2025-03-20T17:59:38Z","title":"Stop Overthinking: A Survey on Efficient Reasoning for Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.16419","snapshot_observed_at":"2026-08-06T23:28:39.995135Z","title":"Stop overthinking: A survey on efficient reasoning for large language models.arXiv preprint arXiv:2503.16419, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.18237","last_updated":"2025-06-23T02:06:04Z","snapshot_observed_at":"2026-08-13T13:54:40.411919Z","submitted_at":"2025-06-23T02:06:04Z","title":"AdapThink: Adaptive Thinking Preferences for Reasoning Language Model","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:39.995135Z"},"links":{"cited_paper":"/paper/2503.16419","citing_paper":"/paper/2506.18237"},"observation_digest":"sha256:6a52bbc47aa5597a5a61087fdfc7e83bcbde9f993e74022436989d3bae180779","observation_id":"7497aae9-88a9-4476-810e-5e67929474ad","resolution":{"observed_at":"2026-08-06T23:28:39.995135Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.18585","last_updated":"2025-02-18T16:51:53Z","snapshot_observed_at":"2026-08-15T06:19:06.009960Z","submitted_at":"2025-01-30T18:58:18Z","title":"Thoughts Are All Over the Place: On the Underthinking of o1-Like LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.18585","snapshot_observed_at":"2026-08-06T23:28:40.224745Z","title":"Thoughts are all over the place: On the underthinking of o1-like llms.arXiv preprint arXiv:2501.18585, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.18237","last_updated":"2025-06-23T02:06:04Z","snapshot_observed_at":"2026-08-13T13:54:40.411919Z","submitted_at":"2025-06-23T02:06:04Z","title":"AdapThink: Adaptive Thinking Preferences for Reasoning Language Model","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:40.224745Z"},"links":{"cited_paper":"/paper/2501.18585","citing_paper":"/paper/2506.18237"},"observation_digest":"sha256:673ea9db1dda5fcf52e8f9b18957f6b00b38cb76da5b4f6a881774450d00e4c1","observation_id":"c448b801-d684-4c19-b4ec-2641f31f6878","resolution":{"observed_at":"2026-08-06T23:28:40.224745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:28:40.338404Z","title":"Large language models are better reasoners with self-verification","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.18237","last_updated":"2025-06-23T02:06:04Z","snapshot_observed_at":"2026-08-13T13:54:40.411919Z","submitted_at":"2025-06-23T02:06:04Z","title":"AdapThink: Adaptive Thinking Preferences for Reasoning Language Model","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:40.338404Z"},"links":{"citing_paper":"/paper/2506.18237"},"observation_digest":"sha256:a9e07f1abf3600fdbe507a67804c14d3539f971b10345f3e5ab73da16fb54fb9","observation_id":"c5a2fb81-3969-4bd0-a297-8648cc60aba8","resolution":{"observed_at":"2026-08-06T23:28:40.338404Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14768","last_updated":"2025-02-20T17:49:26Z","snapshot_observed_at":"2026-08-15T06:02:45.207770Z","submitted_at":"2025-02-20T17:49:26Z","title":"Logic-RL: Unleashing LLM Reasoning with Rule-Based Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14768","snapshot_observed_at":"2026-08-06T23:28:40.484741Z","title":"Logic-rl: Unleashing llm reasoning with rule-based reinforcement learning.arXiv preprint arXiv:2502.14768, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.18237","last_updated":"2025-06-23T02:06:04Z","snapshot_observed_at":"2026-08-13T13:54:40.411919Z","submitted_at":"2025-06-23T02:06:04Z","title":"AdapThink: Adaptive Thinking Preferences for Reasoning Language Model","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:40.484741Z"},"links":{"cited_paper":"/paper/2502.14768","citing_paper":"/paper/2506.18237"},"observation_digest":"sha256:04c4442e6eb1c0385b6aba6623da102cc510827cee98c6ab558e3ba7088363d8","observation_id":"2f551bb4-1332-4a89-bec4-7bfc7e896921","resolution":{"observed_at":"2026-08-06T23:28:40.484741Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.11343","last_updated":"2025-06-12T06:03:24Z","snapshot_observed_at":"2026-08-07T16:02:06.428060Z","submitted_at":"2025-04-15T16:15:02Z","title":"A Minimalist Approach to LLM Reasoning: from Rejection Sampling to Reinforce","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.11343","snapshot_observed_at":"2026-08-06T23:28:40.648243Z","title":"A minimalist approach to llm reasoning: from rejection sampling to reinforce.arXiv preprint arXiv:2504.11343, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.18237","last_updated":"2025-06-23T02:06:04Z","snapshot_observed_at":"2026-08-13T13:54:40.411919Z","submitted_at":"2025-06-23T02:06:04Z","title":"AdapThink: Adaptive Thinking Preferences for Reasoning Language Model","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:40.648243Z"},"links":{"cited_paper":"/paper/2504.11343","citing_paper":"/paper/2506.18237"},"observation_digest":"sha256:b7f2280f3b611764059d4e282b292d61b44281e57e609d54c8e22fe14d8567d5","observation_id":"dfe89364-6f1e-4824-b5d1-26b29b027228","resolution":{"observed_at":"2026-08-06T23:28:40.648243Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.18600","last_updated":"2025-03-03T17:08:21Z","snapshot_observed_at":"2026-08-07T17:49:06.764625Z","submitted_at":"2025-02-25T19:36:06Z","title":"Chain of Draft: Thinking Faster by Writing Less","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.18600","snapshot_observed_at":"2026-08-06T23:28:40.811546Z","title":"Chain of draft: Thinking faster by writing less.arXiv preprint arXiv:2502.18600, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.18237","last_updated":"2025-06-23T02:06:04Z","snapshot_observed_at":"2026-08-13T13:54:40.411919Z","submitted_at":"2025-06-23T02:06:04Z","title":"AdapThink: Adaptive Thinking Preferences for Reasoning Language Model","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:40.811546Z"},"links":{"cited_paper":"/paper/2502.18600","citing_paper":"/paper/2506.18237"},"observation_digest":"sha256:faf06dfe3a26e87f61e1d8bb3e7434848c60b8bf66062bce569cf25abe9ec170","observation_id":"ccb6d995-c077-4221-8c79-9337840dddaf","resolution":{"observed_at":"2026-08-06T23:28:40.811546Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03373","last_updated":"2025-02-05T17:13:32Z","snapshot_observed_at":"2026-08-15T20:24:47.341050Z","submitted_at":"2025-02-05T17:13:32Z","title":"Demystifying Long Chain-of-Thought Reasoning in LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.03373","snapshot_observed_at":"2026-08-06T23:28:41.000596Z","title":"Demystifying long chain-of-thought reasoning in llms.arXiv preprint arXiv:2502.03373, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.18237","last_updated":"2025-06-23T02:06:04Z","snapshot_observed_at":"2026-08-13T13:54:40.411919Z","submitted_at":"2025-06-23T02:06:04Z","title":"AdapThink: Adaptive Thinking Preferences for Reasoning Language Model","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:41.000596Z"},"links":{"cited_paper":"/paper/2502.03373","citing_paper":"/paper/2506.18237"},"observation_digest":"sha256:e217f1e0ea8b42e3e8a57b8f8f4c91b5e3d7b8fffaf54b34f3af7253a1c9a045","observation_id":"5e46c1f1-8574-4a23-b441-1c038261c194","resolution":{"observed_at":"2026-08-06T23:28:41.000596Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14476","last_updated":"2025-05-20T01:37:34Z","snapshot_observed_at":"2026-08-02T01:40:54.187278Z","submitted_at":"2025-03-18T17:49:06Z","title":"DAPO: An Open-Source LLM Reinforcement Learning System at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.14476","snapshot_observed_at":"2026-08-06T23:28:41.164788Z","title":"Dapo: An open-source llm reinforcement learning system at scale.arXiv preprint arXiv:2503.14476, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.18237","last_updated":"2025-06-23T02:06:04Z","snapshot_observed_at":"2026-08-13T13:54:40.411919Z","submitted_at":"2025-06-23T02:06:04Z","title":"AdapThink: Adaptive Thinking Preferences for Reasoning Language Model","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:41.164788Z"},"links":{"cited_paper":"/paper/2503.14476","citing_paper":"/paper/2506.18237"},"observation_digest":"sha256:c0cfc6a4164442d7245b5c3251f023b7646b8da18eee20f5b18d2f5883db8c82","observation_id":"52be73b3-2e0c-44c3-a792-35d4179d01d4","resolution":{"observed_at":"2026-08-06T23:28:41.164788Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.14286","last_updated":"2025-04-22T10:07:13Z","snapshot_observed_at":"2026-08-10T23:48:46.098184Z","submitted_at":"2025-04-19T13:06:03Z","title":"SRPO: A Cross-Domain Implementation of Large-Scale Reinforcement Learning on LLM","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.14286","snapshot_observed_at":"2026-08-06T23:28:41.334745Z","title":"Wait”, “check","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.18237","last_updated":"2025-06-23T02:06:04Z","snapshot_observed_at":"2026-08-13T13:54:40.411919Z","submitted_at":"2025-06-23T02:06:04Z","title":"AdapThink: Adaptive Thinking Preferences for Reasoning Language Model","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:41.334745Z"},"links":{"cited_paper":"/paper/2504.14286","citing_paper":"/paper/2506.18237"},"observation_digest":"sha256:234e6af4f358de3501740ab9b59d9182a3baa0b32cbf64e383f1075435ad714d","observation_id":"ef670f0a-6fbe-4d06-9322-eeac51fcc7e5","resolution":{"observed_at":"2026-08-06T23:28:41.334745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:28:42.309275Z","title":"Branch-Extension","venue":null,"work_id":"64e1ab5a-0a81-4ff6-9eed-7b24eb37f179","year":null},"citing_paper":{"arxiv_id":"2506.18237","last_updated":"2025-06-23T02:06:04Z","snapshot_observed_at":"2026-08-13T13:54:40.411919Z","submitted_at":"2025-06-23T02:06:04Z","title":"AdapThink: Adaptive Thinking Preferences for Reasoning Language Model","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T23:28:41.497380Z"},"links":{"citing_paper":"/paper/2506.18237"},"observation_digest":"sha256:b8e192aca21c71f4813df3600cdbb297bc0f1c454f6bea5d98eebc7ae683649c","observation_id":"6c957f00-aa99-46a7-ac0a-dd943db413ce","resolution":{"observed_at":"2026-08-06T23:28:42.388457Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.18237","last_updated":"2025-06-23T02:06:04Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-13T13:54:40.411919Z","submitted_at":"2025-06-23T02:06:04Z","title":"AdapThink: Adaptive Thinking Preferences for Reasoning Language Model"},"reference_resolution":{"displayed":31,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":27,"verified_exact":0,"verified_fuzzy":4},"total_outbound_references":31},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 31 of 31 outbound references and 5 inbound Pith citation observations for arXiv:2506.18237."}