{"as_of":"2026-08-08T07:47:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:af3203d99bc2b77f1a01a10eafdf3d9c76b11e0a8a74884f2bab57264f54c61f","coverage":[{"denominator":33,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":33,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T13:51:53.735735Z","state":"measured"},{"denominator":34,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":34,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-15T10:21:39.892271Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-15T10:25:26.719523Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2509.24560","last_updated":"2026-08-02T06:52:09Z","snapshot_observed_at":"2026-08-07T16:20:24.562487Z","submitted_at":"2025-09-29T10:13:55Z","title":"AdaThink-Med: Optimizing Inference-Time Compute for Medical Reasoning via Uncertainty Quantification","version":2},"cited_work":{"arxiv_id":"2509.24560","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.24560","snapshot_observed_at":"2026-08-04T02:23:30.228809Z","title":"AdaThink-Med: Medical Adaptive Thinking with Uncertainty-Guided Length Calibration.arXiv preprint arXiv:2509.24560.2025","venue":null,"work_id":"13e39898-48dd-4b70-88ce-24f85edad137","year":2025},"citing_paper":{"arxiv_id":"2604.08559","last_updated":"2026-03-17T09:03:09Z","snapshot_observed_at":"2026-08-07T20:04:32.737155Z","submitted_at":"2026-03-17T09:03:09Z","title":"Medical Reasoning with Large Language Models: A Survey and MR-Bench","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-05-15T10:21:39.892271Z"},"links":{"cited_paper":"/paper/2509.24560","citing_paper":"/paper/2604.08559"},"observation_digest":"sha256:43973e9051b07609e7787319ea2af66fbb089bd0670150f10977b99cc1d79541","observation_id":"44a02140-88b8-4300-9753-7e77f7822a19","resolution":{"observed_at":"2026-08-04T02:23:30.228809Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2509.24560/citation-record","integrity":"/paper/2509.24560/integrity","json":"/paper/2509.24560/citation-record.json","paper":"/paper/2509.24560"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2402.16827","last_updated":"2024-08-02T17:59:31Z","snapshot_observed_at":"2026-08-03T03:15:21.035418Z","submitted_at":"2024-02-26T18:54:35Z","title":"A Survey on Data Selection for Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.16827","snapshot_observed_at":"2026-08-04T13:51:50.059178Z","title":"A survey on data selection for language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.24560","last_updated":"2026-08-02T06:52:09Z","snapshot_observed_at":"2026-08-07T16:20:24.562487Z","submitted_at":"2025-09-29T10:13:55Z","title":"AdaThink-Med: Optimizing Inference-Time Compute for Medical Reasoning via Uncertainty Quantification","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-04T13:51:50.059178Z"},"links":{"cited_paper":"/paper/2402.16827","citing_paper":"/paper/2509.24560"},"observation_digest":"sha256:2989b16dcef0d1d1f432cdb702eb7b79c081bd5195e4aed2ed926d438cbc66fe","observation_id":"922ad072-4c67-42f5-8c4a-1512466e6322","resolution":{"observed_at":"2026-08-04T13:51:50.059178Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.14779","last_updated":"2024-04-23T06:36:21Z","snapshot_observed_at":"2026-07-06T18:04:08.777507Z","submitted_at":"2024-04-23T06:36:21Z","title":"Med42 -- Evaluating Fine-Tuning Strategies for Medical LLMs: Full-Parameter vs. Parameter-Efficient Approaches","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.14779","snapshot_observed_at":"2026-08-04T13:51:50.297036Z","title":"Med42–evaluating fine-tuning strategies for medical llms: Full-parameter vs","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.24560","last_updated":"2026-08-02T06:52:09Z","snapshot_observed_at":"2026-08-07T16:20:24.562487Z","submitted_at":"2025-09-29T10:13:55Z","title":"AdaThink-Med: Optimizing Inference-Time Compute for Medical Reasoning via Uncertainty Quantification","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-04T13:51:50.297036Z"},"links":{"cited_paper":"/paper/2404.14779","citing_paper":"/paper/2509.24560"},"observation_digest":"sha256:b9f61bd9a4e53dfe1e5ed6f0d32a86067c068888bdf6eb9409e08223616ef4e4","observation_id":"30d45229-6fff-496e-af92-2b2607f70dcb","resolution":{"observed_at":"2026-08-04T13:51:50.297036Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.22617","last_updated":"2025-05-28T17:38:45Z","snapshot_observed_at":"2026-08-07T08:20:32.332400Z","submitted_at":"2025-05-28T17:38:45Z","title":"The Entropy Mechanism of Reinforcement Learning for Reasoning Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.22617","snapshot_observed_at":"2026-08-04T13:51:50.396802Z","title":"The entropy mechanism of reinforcement learning for reasoning language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.24560","last_updated":"2026-08-02T06:52:09Z","snapshot_observed_at":"2026-08-07T16:20:24.562487Z","submitted_at":"2025-09-29T10:13:55Z","title":"AdaThink-Med: Optimizing Inference-Time Compute for Medical Reasoning via Uncertainty Quantification","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-04T13:51:50.396802Z"},"links":{"cited_paper":"/paper/2505.22617","citing_paper":"/paper/2509.24560"},"observation_digest":"sha256:cb7d32f0aed8cd352a792689216e43de63722d6a8e4be466dd3cae43638593c9","observation_id":"fd743735-2306-447b-b3c1-165f3c32dc0f","resolution":{"observed_at":"2026-08-04T13:51:50.396802Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-04T13:51:50.482050Z","title":"The llama 3 herd of models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.24560","last_updated":"2026-08-02T06:52:09Z","snapshot_observed_at":"2026-08-07T16:20:24.562487Z","submitted_at":"2025-09-29T10:13:55Z","title":"AdaThink-Med: Optimizing Inference-Time Compute for Medical Reasoning via Uncertainty Quantification","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-04T13:51:50.482050Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2509.24560"},"observation_digest":"sha256:f06e16e3a25be5330c67d4990b0ccf78280391abe139788a1278839267c7644e","observation_id":"5266221d-fa61-4e21-82f5-9dee55eb3905","resolution":{"observed_at":"2026-08-04T13:51:50.482050Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.13379","last_updated":"2025-06-26T14:06:49Z","snapshot_observed_at":"2026-08-07T15:43:01.592156Z","submitted_at":"2025-05-19T17:24:16Z","title":"Thinkless: LLM Learns When to Think","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.13379","snapshot_observed_at":"2026-08-04T13:51:50.649862Z","title":"Thinkless: Llm learns when to think.arXiv preprint arXiv:2505.13379,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.24560","last_updated":"2026-08-02T06:52:09Z","snapshot_observed_at":"2026-08-07T16:20:24.562487Z","submitted_at":"2025-09-29T10:13:55Z","title":"AdaThink-Med: Optimizing Inference-Time Compute for Medical Reasoning via Uncertainty Quantification","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-04T13:51:50.649862Z"},"links":{"cited_paper":"/paper/2505.13379","citing_paper":"/paper/2509.24560"},"observation_digest":"sha256:2d17cc8ab40ed221cf5f38f390fade38f9bd43173cc158224c097bef70a34dbe","observation_id":"2e8f611a-3ac5-4afd-8c0b-aa806a81f98f","resolution":{"observed_at":"2026-08-04T13:51:50.649862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.14196","last_updated":"2024-01-26T09:23:11Z","snapshot_observed_at":"2026-08-06T22:40:28.707813Z","submitted_at":"2024-01-25T14:17:53Z","title":"DeepSeek-Coder: When the Large Language Model Meets Programming -- The Rise of Code Intelligence","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.14196","snapshot_observed_at":"2026-08-04T13:51:50.776381Z","title":"Deepseek-coder: When the large language model meets programming–the rise of code intelligence","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.24560","last_updated":"2026-08-02T06:52:09Z","snapshot_observed_at":"2026-08-07T16:20:24.562487Z","submitted_at":"2025-09-29T10:13:55Z","title":"AdaThink-Med: Optimizing Inference-Time Compute for Medical Reasoning via Uncertainty Quantification","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-04T13:51:50.776381Z"},"links":{"cited_paper":"/paper/2401.14196","citing_paper":"/paper/2509.24560"},"observation_digest":"sha256:63129efe0a0e8277ff298567149f468233d2cc0716a686c3ccf25ef1ad727d79","observation_id":"fca865c3-3576-46df-9976-e2105df64380","resolution":{"observed_at":"2026-08-04T13:51:50.776381Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-04T13:51:50.914512Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.24560","last_updated":"2026-08-02T06:52:09Z","snapshot_observed_at":"2026-08-07T16:20:24.562487Z","submitted_at":"2025-09-29T10:13:55Z","title":"AdaThink-Med: Optimizing Inference-Time Compute for Medical Reasoning via Uncertainty Quantification","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-04T13:51:50.914512Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2509.24560"},"observation_digest":"sha256:723aba80956e772e6d1f0b1cd7f32a0e85133c272af211fd84c6444de37154a6","observation_id":"33060816-e11f-426d-9e8f-069aead883ba","resolution":{"observed_at":"2026-08-04T13:51:50.914512Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T13:51:51.018330Z","title":"m1: Unleash the po- tential of test-time scaling for medical reasoning with large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.24560","last_updated":"2026-08-02T06:52:09Z","snapshot_observed_at":"2026-08-07T16:20:24.562487Z","submitted_at":"2025-09-29T10:13:55Z","title":"AdaThink-Med: Optimizing Inference-Time Compute for Medical Reasoning via Uncertainty Quantification","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-04T13:51:51.018330Z"},"links":{"citing_paper":"/paper/2509.24560"},"observation_digest":"sha256:aeb2404a2b90190b86ee9b1edde42c1e77c75bd69621d78c87427526800491fe","observation_id":"a7d53ba7-2286-4434-ad74-83ce11f94fe8","resolution":{"observed_at":"2026-08-04T13:51:51.018330Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14631","last_updated":"2025-05-21T05:17:34Z","snapshot_observed_at":"2026-08-07T15:28:58.246731Z","submitted_at":"2025-05-20T17:23:25Z","title":"Think Only When You Need with Large Hybrid-Reasoning Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.14631","snapshot_observed_at":"2026-08-04T13:51:51.270386Z","title":"Think only when you need with large hybrid-reasoning models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.24560","last_updated":"2026-08-02T06:52:09Z","snapshot_observed_at":"2026-08-07T16:20:24.562487Z","submitted_at":"2025-09-29T10:13:55Z","title":"AdaThink-Med: Optimizing Inference-Time Compute for Medical Reasoning via Uncertainty Quantification","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-04T13:51:51.270386Z"},"links":{"cited_paper":"/paper/2505.14631","citing_paper":"/paper/2509.24560"},"observation_digest":"sha256:0ad9d794a53631738bf9a9ca08cf3c444d1c93a21d914efd1761b111e480b437","observation_id":"8c09e99f-430d-41c8-82e7-a477716cc7bd","resolution":{"observed_at":"2026-08-04T13:51:51.270386Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.09858","last_updated":"2025-04-14T04:08:16Z","snapshot_observed_at":"2026-08-08T01:06:59.135762Z","submitted_at":"2025-04-14T04:08:16Z","title":"Reasoning Models Can Be Effective Without Thinking","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.09858","snapshot_observed_at":"2026-08-04T13:51:51.648270Z","title":"Reasoning models can be effective without thinking","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.24560","last_updated":"2026-08-02T06:52:09Z","snapshot_observed_at":"2026-08-07T16:20:24.562487Z","submitted_at":"2025-09-29T10:13:55Z","title":"AdaThink-Med: Optimizing Inference-Time Compute for Medical Reasoning via Uncertainty Quantification","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-04T13:51:51.648270Z"},"links":{"cited_paper":"/paper/2504.09858","citing_paper":"/paper/2509.24560"},"observation_digest":"sha256:791dd672b4991fb41313a52c095ded916979ff3fc7d4a251e1515418d17d93a8","observation_id":"a4c2c11c-1d38-4049-bf6f-06ab8a2860cd","resolution":{"observed_at":"2026-08-04T13:51:51.648270Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.19213","last_updated":"2025-05-25T16:20:55Z","snapshot_observed_at":"2026-08-07T20:38:23.317910Z","submitted_at":"2025-05-25T16:20:55Z","title":"Improving Medical Reasoning with Curriculum-Aware Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.19213","snapshot_observed_at":"2026-08-04T13:51:51.711834Z","title":"Improving medical reasoning with curriculum-aware reinforcement learning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.24560","last_updated":"2026-08-02T06:52:09Z","snapshot_observed_at":"2026-08-07T16:20:24.562487Z","submitted_at":"2025-09-29T10:13:55Z","title":"AdaThink-Med: Optimizing Inference-Time Compute for Medical Reasoning via Uncertainty Quantification","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-04T13:51:51.711834Z"},"links":{"cited_paper":"/paper/2505.19213","citing_paper":"/paper/2509.24560"},"observation_digest":"sha256:0c503e01ca4ff1da37c55bf853d5782215dd03a79a9d25b73c9fcfb999e4996d","observation_id":"0bd09e0e-b0e5-45bf-b46e-894236e74223","resolution":{"observed_at":"2026-08-04T13:51:51.711834Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.19256","last_updated":"2024-10-02T04:01:47Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-28T06:20:03Z","title":"HybridFlow: A Flexible and Efficient RLHF Framework","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.19256","snapshot_observed_at":"2026-08-04T13:51:51.776607Z","title":"Hybridflow: A flexible and efficient rlhf framework","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.24560","last_updated":"2026-08-02T06:52:09Z","snapshot_observed_at":"2026-08-07T16:20:24.562487Z","submitted_at":"2025-09-29T10:13:55Z","title":"AdaThink-Med: Optimizing Inference-Time Compute for Medical Reasoning via Uncertainty Quantification","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-04T13:51:51.776607Z"},"links":{"cited_paper":"/paper/2409.19256","citing_paper":"/paper/2509.24560"},"observation_digest":"sha256:fd3b89ccb7f164dcf1c7bd3c4504eccf32119c31a0aec882b323794ed069ac27","observation_id":"bcd48595-4c86-4765-b9f2-3cda53c2f0af","resolution":{"observed_at":"2026-08-04T13:51:51.776607Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.00127","last_updated":"2025-04-30T18:48:06Z","snapshot_observed_at":"2026-08-07T17:34:13.816265Z","submitted_at":"2025-04-30T18:48:06Z","title":"Between Underthinking and Overthinking: An Empirical Study of Reasoning Length and correctness in LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.00127","snapshot_observed_at":"2026-08-04T13:51:51.857140Z","title":"Between underthinking and over- thinking: An empirical study of reasoning length and correctness in llms","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.24560","last_updated":"2026-08-02T06:52:09Z","snapshot_observed_at":"2026-08-07T16:20:24.562487Z","submitted_at":"2025-09-29T10:13:55Z","title":"AdaThink-Med: Optimizing Inference-Time Compute for Medical Reasoning via Uncertainty Quantification","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-04T13:51:51.857140Z"},"links":{"cited_paper":"/paper/2505.00127","citing_paper":"/paper/2509.24560"},"observation_digest":"sha256:e05952adbcbb5a301d4d93e088830e675cbf797ce3f87e5eea3154e05de64888","observation_id":"f0f0c9d7-f15a-49cc-9b7f-36650c6952a0","resolution":{"observed_at":"2026-08-04T13:51:51.857140Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.16419","last_updated":"2025-08-21T19:14:40Z","snapshot_observed_at":"2026-08-07T04:27:23.738927Z","submitted_at":"2025-03-20T17:59:38Z","title":"Stop Overthinking: A Survey on Efficient Reasoning for Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.16419","snapshot_observed_at":"2026-08-04T13:51:51.922247Z","title":"Stop overthinking: A survey on efficient reasoning for large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.24560","last_updated":"2026-08-02T06:52:09Z","snapshot_observed_at":"2026-08-07T16:20:24.562487Z","submitted_at":"2025-09-29T10:13:55Z","title":"AdaThink-Med: Optimizing Inference-Time Compute for Medical Reasoning via Uncertainty Quantification","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-04T13:51:51.922247Z"},"links":{"cited_paper":"/paper/2503.16419","citing_paper":"/paper/2509.24560"},"observation_digest":"sha256:8fa4d6190497c7da80a7533cea234c752448e1cee4fb55ba4a50b577aef725b8","observation_id":"783d7d7c-7c2a-461f-8d05-dcfcca2d6359","resolution":{"observed_at":"2026-08-04T13:51:51.922247Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.09261","last_updated":"2022-10-17T17:08:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-10-17T17:08:26Z","title":"Challenging BIG-Bench Tasks and Whether Chain-of-Thought Can Solve Them","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.09261","snapshot_observed_at":"2026-08-04T13:51:52.010093Z","title":"Challenging big-bench tasks and whether chain-of-thought can solve them","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.24560","last_updated":"2026-08-02T06:52:09Z","snapshot_observed_at":"2026-08-07T16:20:24.562487Z","submitted_at":"2025-09-29T10:13:55Z","title":"AdaThink-Med: Optimizing Inference-Time Compute for Medical Reasoning via Uncertainty Quantification","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-04T13:51:52.010093Z"},"links":{"cited_paper":"/paper/2210.09261","citing_paper":"/paper/2509.24560"},"observation_digest":"sha256:b6b60e7910f13d20b612d535e1c742e98d0b5a8dd3698c5f3624daec5d394e55","observation_id":"8cc402e8-7787-4cd6-9349-0bb726f4555f","resolution":{"observed_at":"2026-08-04T13:51:52.010093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-08-04T13:51:52.318666Z","title":"The Register","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.24560","last_updated":"2026-08-02T06:52:09Z","snapshot_observed_at":"2026-08-07T16:20:24.562487Z","submitted_at":"2025-09-29T10:13:55Z","title":"AdaThink-Med: Optimizing Inference-Time Compute for Medical Reasoning via Uncertainty Quantification","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-04T13:51:52.318666Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2509.24560"},"observation_digest":"sha256:74b860d1d00704a538c562e449b80a5addb0e3dcbba13bdadc3d7758c4e4753d","observation_id":"2f8823e5-dc40-4a55-a6c0-9dfdba1744d5","resolution":{"observed_at":"2026-08-04T13:51:52.318666Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T13:51:52.468526Z","title":"Accessed: 2025-08-27","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.24560","last_updated":"2026-08-02T06:52:09Z","snapshot_observed_at":"2026-08-07T16:20:24.562487Z","submitted_at":"2025-09-29T10:13:55Z","title":"AdaThink-Med: Optimizing Inference-Time Compute for Medical Reasoning via Uncertainty Quantification","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-04T13:51:52.468526Z"},"links":{"citing_paper":"/paper/2509.24560"},"observation_digest":"sha256:5da0069fb6cbe16f1db01a1eb38b9af22b814cd000a181c81f2fd2b52d623189","observation_id":"116c1347-5771-4556-b7d3-49133bb87a73","resolution":{"observed_at":"2026-08-04T13:51:52.468526Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.01939","last_updated":"2025-11-13T10:08:29Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-02T17:54:39Z","title":"Beyond the 80/20 Rule: High-Entropy Minority Tokens Drive Effective Reinforcement Learning for LLM Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.01939","snapshot_observed_at":"2026-08-04T13:51:52.645620Z","title":"Beyond the 80/20 rule: High-entropy minority tokens drive effective reinforcement learning for llm reasoning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.24560","last_updated":"2026-08-02T06:52:09Z","snapshot_observed_at":"2026-08-07T16:20:24.562487Z","submitted_at":"2025-09-29T10:13:55Z","title":"AdaThink-Med: Optimizing Inference-Time Compute for Medical Reasoning via Uncertainty Quantification","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-04T13:51:52.645620Z"},"links":{"cited_paper":"/paper/2506.01939","citing_paper":"/paper/2509.24560"},"observation_digest":"sha256:caca4d6d94c4383e9e1a578a2a6514dd6b9a2094e6693704076ea4776d4032a5","observation_id":"f41295f0-6db1-4c41-82cb-06a6dea3396e","resolution":{"observed_at":"2026-08-04T13:51:52.645620Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T13:51:52.821261Z","title":"Fast-slow thinking for large vision-language model reasoning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.24560","last_updated":"2026-08-02T06:52:09Z","snapshot_observed_at":"2026-08-07T16:20:24.562487Z","submitted_at":"2025-09-29T10:13:55Z","title":"AdaThink-Med: Optimizing Inference-Time Compute for Medical Reasoning via Uncertainty Quantification","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-04T13:51:52.821261Z"},"links":{"citing_paper":"/paper/2509.24560"},"observation_digest":"sha256:a03f49f4be51eb7da9b1b67f5353a47f2efc22ded5bd1965ccd06ba33d5008b3","observation_id":"27faa2da-ce88-4f1d-a4a1-8709feb360ab","resolution":{"observed_at":"2026-08-04T13:51:52.821261Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03373","last_updated":"2025-02-05T17:13:32Z","snapshot_observed_at":"2026-07-06T20:31:41.231839Z","submitted_at":"2025-02-05T17:13:32Z","title":"Demystifying Long Chain-of-Thought Reasoning in LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.03373","snapshot_observed_at":"2026-08-04T13:51:52.967619Z","title":"Demystifying long chain- of-thought reasoning in llms","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.24560","last_updated":"2026-08-02T06:52:09Z","snapshot_observed_at":"2026-08-07T16:20:24.562487Z","submitted_at":"2025-09-29T10:13:55Z","title":"AdaThink-Med: Optimizing Inference-Time Compute for Medical Reasoning via Uncertainty Quantification","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-04T13:51:52.967619Z"},"links":{"cited_paper":"/paper/2502.03373","citing_paper":"/paper/2509.24560"},"observation_digest":"sha256:222874e546d3240ed31c16697139b9ce95b0caad0d99d8c95ee4db87ac1159df","observation_id":"75116ecc-157f-444d-b5b5-7e262081b07d","resolution":{"observed_at":"2026-08-04T13:51:52.967619Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T13:51:53.126651Z","title":"Shorterbetter: Guiding reasoning models to find optimal inference length for efficient reasoning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.24560","last_updated":"2026-08-02T06:52:09Z","snapshot_observed_at":"2026-08-07T16:20:24.562487Z","submitted_at":"2025-09-29T10:13:55Z","title":"AdaThink-Med: Optimizing Inference-Time Compute for Medical Reasoning via Uncertainty Quantification","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-04T13:51:53.126651Z"},"links":{"citing_paper":"/paper/2509.24560"},"observation_digest":"sha256:5697b343518ddad59922754aa702bb08b24ab2da3994d72b0ec0f9a234e042d7","observation_id":"5bbc0ded-7347-4b2b-9298-8d347de07266","resolution":{"observed_at":"2026-08-04T13:51:53.126651Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14476","last_updated":"2025-05-20T01:37:34Z","snapshot_observed_at":"2026-08-02T01:40:54.187278Z","submitted_at":"2025-03-18T17:49:06Z","title":"DAPO: An Open-Source LLM Reinforcement Learning System at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.14476","snapshot_observed_at":"2026-08-04T13:51:53.189476Z","title":"Dapo: An open-source llm reinforcement learning system at scale","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.24560","last_updated":"2026-08-02T06:52:09Z","snapshot_observed_at":"2026-08-07T16:20:24.562487Z","submitted_at":"2025-09-29T10:13:55Z","title":"AdaThink-Med: Optimizing Inference-Time Compute for Medical Reasoning via Uncertainty Quantification","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-04T13:51:53.189476Z"},"links":{"cited_paper":"/paper/2503.14476","citing_paper":"/paper/2509.24560"},"observation_digest":"sha256:6b1eeffac5b39e3dc89cc6913575d504932eef0e0926157bdc9ab339ec9fefd9","observation_id":"c2da83b1-c134-43a4-8ab3-d97d194d2423","resolution":{"observed_at":"2026-08-04T13:51:53.189476Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.02822","last_updated":"2025-07-03T17:33:58Z","snapshot_observed_at":"2026-08-07T17:34:45.990556Z","submitted_at":"2025-07-03T17:33:58Z","title":"SynapseRoute: An Auto-Route Switching Framework on Dual-State Large Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.02822","snapshot_observed_at":"2026-08-04T13:51:53.281207Z","title":"Synapseroute: An auto-route switching framework on dual-state large language model","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.24560","last_updated":"2026-08-02T06:52:09Z","snapshot_observed_at":"2026-08-07T16:20:24.562487Z","submitted_at":"2025-09-29T10:13:55Z","title":"AdaThink-Med: Optimizing Inference-Time Compute for Medical Reasoning via Uncertainty Quantification","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-04T13:51:53.281207Z"},"links":{"cited_paper":"/paper/2507.02822","citing_paper":"/paper/2509.24560"},"observation_digest":"sha256:85ed6c2a90081933eec4c76bc0bd1b2e36be717d865f69ab0ecbc83ace1f4d65","observation_id":"d2718a06-1da7-4923-98ca-ca53e307e5ba","resolution":{"observed_at":"2026-08-04T13:51:53.281207Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.10625","last_updated":"2023-04-16T22:08:08Z","snapshot_observed_at":"2026-08-06T09:00:42.886249Z","submitted_at":"2022-05-21T15:34:53Z","title":"Least-to-Most Prompting Enables Complex Reasoning in Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.10625","snapshot_observed_at":"2026-08-04T13:51:53.388873Z","title":"Least-to-most prompting enables complex reasoning in large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.24560","last_updated":"2026-08-02T06:52:09Z","snapshot_observed_at":"2026-08-07T16:20:24.562487Z","submitted_at":"2025-09-29T10:13:55Z","title":"AdaThink-Med: Optimizing Inference-Time Compute for Medical Reasoning via Uncertainty Quantification","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-04T13:51:53.388873Z"},"links":{"cited_paper":"/paper/2205.10625","citing_paper":"/paper/2509.24560"},"observation_digest":"sha256:deec40faa58fc6b72dbb1bdf2925d8d5e878add2d2b3b6a60aee493d2819148f","observation_id":"54401410-eca4-484e-9f6d-0e7565e33f64","resolution":{"observed_at":"2026-08-04T13:51:53.388873Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.18362","last_updated":"2025-06-06T13:00:07Z","snapshot_observed_at":"2026-07-06T20:28:24.203633Z","submitted_at":"2025-01-30T14:07:56Z","title":"MedXpertQA: Benchmarking Expert-Level Medical Reasoning and Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.18362","snapshot_observed_at":"2026-08-04T13:51:53.456752Z","title":"Medxpertqa: Benchmarking expert-level medical reasoning and understanding","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.24560","last_updated":"2026-08-02T06:52:09Z","snapshot_observed_at":"2026-08-07T16:20:24.562487Z","submitted_at":"2025-09-29T10:13:55Z","title":"AdaThink-Med: Optimizing Inference-Time Compute for Medical Reasoning via Uncertainty Quantification","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-04T13:51:53.456752Z"},"links":{"cited_paper":"/paper/2501.18362","citing_paper":"/paper/2509.24560"},"observation_digest":"sha256:b7200af6d111139c207a4eef690794fc93b103cb543f4bbe364f0bda58e6bbcc","observation_id":"00f9f1d0-c640-4be0-9a55-37921d3b8350","resolution":{"observed_at":"2026-08-04T13:51:53.456752Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T13:51:53.533804Z","title":"equation 1, both critic-based reinforcement learning methods (e.g., PPO) and critic-free methods (e.g., GRPO (Guo et al., 2024)) can be applied","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.24560","last_updated":"2026-08-02T06:52:09Z","snapshot_observed_at":"2026-08-07T16:20:24.562487Z","submitted_at":"2025-09-29T10:13:55Z","title":"AdaThink-Med: Optimizing Inference-Time Compute for Medical Reasoning via Uncertainty Quantification","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-04T13:51:53.533804Z"},"links":{"citing_paper":"/paper/2509.24560"},"observation_digest":"sha256:4ed17f86b79db13307353388e8a1f2166f2087261e90383649d4793c6cfca7bc","observation_id":"cbfecd7f-ffe6-450f-83cf-ee5b3699b4d2","resolution":{"observed_at":"2026-08-04T13:51:53.533804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T13:51:53.643148Z","title":"We adopt the Qwen2.5 (Team, 2024)-7B-Instruct model and LLama3.1-Instruct-8B as the backbone models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.24560","last_updated":"2026-08-02T06:52:09Z","snapshot_observed_at":"2026-08-07T16:20:24.562487Z","submitted_at":"2025-09-29T10:13:55Z","title":"AdaThink-Med: Optimizing Inference-Time Compute for Medical Reasoning via Uncertainty Quantification","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-04T13:51:53.643148Z"},"links":{"citing_paper":"/paper/2509.24560"},"observation_digest":"sha256:4eab9c65a6ba362ea9c9bbb04be1620c4bcd0bcbc4a19664005b001910bcf9b4","observation_id":"a3f04f27-be85-4d8c-9fb5-5a78592fc2aa","resolution":{"observed_at":"2026-08-04T13:51:53.643148Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T13:51:53.735735Z","title":"yes,” “no,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.24560","last_updated":"2026-08-02T06:52:09Z","snapshot_observed_at":"2026-08-07T16:20:24.562487Z","submitted_at":"2025-09-29T10:13:55Z","title":"AdaThink-Med: Optimizing Inference-Time Compute for Medical Reasoning via Uncertainty Quantification","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-04T13:51:53.735735Z"},"links":{"citing_paper":"/paper/2509.24560"},"observation_digest":"sha256:2132bfd0e5ce38b979de53e70f36b24309dba1a0fc0afdef41e8bba8f5eb38ae","observation_id":"c073a16e-c6ef-46f2-9ddc-1755248b4ad8","resolution":{"observed_at":"2026-08-04T13:51:53.735735Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.06146","last_updated":"2019-09-13T11:18:20Z","snapshot_observed_at":"2026-07-06T08:21:28.880621Z","submitted_at":"2019-09-13T11:18:20Z","title":"PubMedQA: A Dataset for Biomedical Research Question Answering","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.06146","snapshot_observed_at":"2026-08-04T13:51:51.444910Z","title":"Pubmedqa: A dataset for biomedical research question answering","venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2509.24560","last_updated":"2026-08-02T06:52:09Z","snapshot_observed_at":"2026-08-07T16:20:24.562487Z","submitted_at":"2025-09-29T10:13:55Z","title":"AdaThink-Med: Optimizing Inference-Time Compute for Medical Reasoning via Uncertainty Quantification","version":2},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-04T13:51:51.444910Z"},"links":{"cited_paper":"/paper/1909.06146","citing_paper":"/paper/2509.24560"},"observation_digest":"sha256:72f3f0f7dc9d5c4c48b3b9399069e4628c7deee51685a8cfcea67c449496b8ce","observation_id":"f40bbd7b-2d7a-4870-af83-93f39ed0cb35","resolution":{"observed_at":"2026-08-04T13:51:51.444910Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12599","last_updated":"2025-06-03T02:14:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T02:48:14Z","title":"Kimi k1.5: Scaling Reinforcement Learning with LLMs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12599","snapshot_observed_at":"2026-08-04T13:51:52.132024Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.24560","last_updated":"2026-08-02T06:52:09Z","snapshot_observed_at":"2026-08-07T16:20:24.562487Z","submitted_at":"2025-09-29T10:13:55Z","title":"AdaThink-Med: Optimizing Inference-Time Compute for Medical Reasoning via Uncertainty Quantification","version":2},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-04T13:51:52.132024Z"},"links":{"cited_paper":"/paper/2501.12599","citing_paper":"/paper/2509.24560"},"observation_digest":"sha256:cdec9a69744413d163ccd3e51313cf95ba64542b3521a5dce390ff34937a233f","observation_id":"1edd9de9-3563-4cfd-909c-e5cc69260978","resolution":{"observed_at":"2026-08-04T13:51:52.132024Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.17952","last_updated":"2025-05-23T14:27:37Z","snapshot_observed_at":"2026-08-07T20:38:28.943401Z","submitted_at":"2025-05-23T14:27:37Z","title":"Beyond Distillation: Pushing the Limits of Medical LLM Reasoning with Minimalist Rule-Based RL","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.17952","snapshot_observed_at":"2026-08-04T13:51:51.561726Z","title":"Beyond distillation: Pushing the limits of medical llm reasoning with minimalist rule-based rl","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.24560","last_updated":"2026-08-02T06:52:09Z","snapshot_observed_at":"2026-08-07T16:20:24.562487Z","submitted_at":"2025-09-29T10:13:55Z","title":"AdaThink-Med: Optimizing Inference-Time Compute for Medical Reasoning via Uncertainty Quantification","version":2},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-04T13:51:51.561726Z"},"links":{"cited_paper":"/paper/2505.17952","citing_paper":"/paper/2509.24560"},"observation_digest":"sha256:f7a304d80416f1dd1af545105006140bb58b248f37e9e0095e319e9c2ec40970","observation_id":"cb402813-c124-4aaa-ad62-52804fb69d88","resolution":{"observed_at":"2026-08-04T13:51:51.561726Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.04282","last_updated":"2024-11-21T20:29:09Z","snapshot_observed_at":"2026-07-06T19:46:24.121362Z","submitted_at":"2024-11-06T22:02:30Z","title":"Language Models are Hidden Reasoners: Unlocking Latent Reasoning Capabilities via Self-Rewarding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.04282","snapshot_observed_at":"2026-08-04T13:51:50.125223Z","title":"Language models are hidden reasoners: Unlock- ing latent reasoning capabilities via self-rewarding","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.24560","last_updated":"2026-08-02T06:52:09Z","snapshot_observed_at":"2026-08-07T16:20:24.562487Z","submitted_at":"2025-09-29T10:13:55Z","title":"AdaThink-Med: Optimizing Inference-Time Compute for Medical Reasoning via Uncertainty Quantification","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-04T13:51:50.125223Z"},"links":{"cited_paper":"/paper/2411.04282","citing_paper":"/paper/2509.24560"},"observation_digest":"sha256:4b9a0597aa8c19ea4e714306f3a502651c18313441147e2b2b42fe6d18f0666a","observation_id":"d5bd85dc-7ea3-422f-b2ec-095d848a1e5d","resolution":{"observed_at":"2026-08-04T13:51:50.125223Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.21187","last_updated":"2025-02-01T07:57:37Z","snapshot_observed_at":"2026-08-01T16:43:44.704797Z","submitted_at":"2024-12-30T18:55:12Z","title":"Do NOT Think That Much for 2+3=? On the Overthinking of o1-Like LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.21187","snapshot_observed_at":"2026-08-04T13:51:50.210041Z","title":"Do not think that much for 2+ 3=? on the overthinking of o1-like llms","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.24560","last_updated":"2026-08-02T06:52:09Z","snapshot_observed_at":"2026-08-07T16:20:24.562487Z","submitted_at":"2025-09-29T10:13:55Z","title":"AdaThink-Med: Optimizing Inference-Time Compute for Medical Reasoning via Uncertainty Quantification","version":2},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-04T13:51:50.210041Z"},"links":{"cited_paper":"/paper/2412.21187","citing_paper":"/paper/2509.24560"},"observation_digest":"sha256:ae88e3c13265f20afcc5fea53bd222a390ee6d6401ee7a68b8720c21d9555eec","observation_id":"a1d07536-eda7-4e9c-b93f-4a5bbdd0edfc","resolution":{"observed_at":"2026-08-04T13:51:50.210041Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2509.24560","last_updated":"2026-08-02T06:52:09Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T16:20:24.562487Z","submitted_at":"2025-09-29T10:13:55Z","title":"AdaThink-Med: Optimizing Inference-Time Compute for Medical Reasoning via Uncertainty Quantification"},"reference_resolution":{"displayed":33,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":33,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":33},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 33 of 33 outbound references and 1 inbound Pith citation observation for arXiv:2509.24560."}