{"as_of":"2026-08-09T20:51:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a367461cb668e75456a408c9db86d8250fdd8a490939759b14057ad0dbec83a8","coverage":[{"denominator":50,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":50,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:41:40.334058Z","state":"measured"},{"denominator":60,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":60,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":10,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":10,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T10:44:27.022437Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T09:47:59.448127Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.17952","last_updated":"2025-05-23T14:27:37Z","snapshot_observed_at":"2026-08-07T20:38:28.943401Z","submitted_at":"2025-05-23T14:27:37Z","title":"Beyond Distillation: Pushing the Limits of Medical LLM Reasoning with Minimalist Rule-Based RL","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.17952","snapshot_observed_at":"2026-08-06T10:44:27.022437Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.23541","last_updated":"2026-07-28T08:43:59Z","snapshot_observed_at":"2026-08-09T00:08:15.328289Z","submitted_at":"2025-07-31T13:31:01Z","title":"Med-R$^3$: Enhancing Medical Retrieval-Augmented Reasoning of LLMs via Progressive Reinforcement Learning","version":5},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T10:44:27.022437Z"},"links":{"cited_paper":"/paper/2505.17952","citing_paper":"/paper/2507.23541"},"observation_digest":"sha256:787efdef5fd473be88036f7627e380ae471192794e178670987d04012372da82","observation_id":"cd855766-5f9c-42ba-8f38-91dd09040779","resolution":{"observed_at":"2026-08-06T10:44:27.022437Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.17952","last_updated":"2025-05-23T14:27:37Z","snapshot_observed_at":"2026-08-07T20:38:28.943401Z","submitted_at":"2025-05-23T14:27:37Z","title":"Beyond Distillation: Pushing the Limits of Medical LLM Reasoning with Minimalist Rule-Based RL","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.17952","snapshot_observed_at":"2026-08-05T20:18:43.366828Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.10848","last_updated":"2026-07-20T03:32:44Z","snapshot_observed_at":"2026-08-08T08:03:07.822157Z","submitted_at":"2025-08-14T17:18:35Z","title":"Psyche-R1: Towards Reliable Psychological LLMs through Unified Empathy, Expertise, and Reasoning","version":3},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-05T20:18:43.366828Z"},"links":{"cited_paper":"/paper/2505.17952","citing_paper":"/paper/2508.10848"},"observation_digest":"sha256:70b726e28807202535034dc539ee4d76d7c09d10676c0e5fbb560568e69fde1a","observation_id":"16937fd7-60aa-4f84-b71d-a777a78a7948","resolution":{"observed_at":"2026-08-05T20:18:43.366828Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.17952","last_updated":"2025-05-23T14:27:37Z","snapshot_observed_at":"2026-08-07T20:38:28.943401Z","submitted_at":"2025-05-23T14:27:37Z","title":"Beyond Distillation: Pushing the Limits of Medical LLM Reasoning with Minimalist Rule-Based RL","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.17952","snapshot_observed_at":"2026-08-05T11:50:13.102408Z","title":"Beyond distillation: Pushing the limits of medical LLM reasoning with minimalist rule-based RL","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.02208","last_updated":"2025-09-02T11:23:35Z","snapshot_observed_at":"2026-08-05T11:50:10.014003Z","submitted_at":"2025-09-02T11:23:35Z","title":"Baichuan-M2: Scaling Medical Capability with Large Verifier System","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T11:50:13.102408Z"},"links":{"cited_paper":"/paper/2505.17952","citing_paper":"/paper/2509.02208"},"observation_digest":"sha256:ae537da61a0b0db08cd9fccf5f9edb590ba599521bc8618d859a2f47809f9aea","observation_id":"281d21d1-8ff1-4947-b757-d5b19d5a9f99","resolution":{"observed_at":"2026-08-05T11:50:13.102408Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.17952","last_updated":"2025-05-23T14:27:37Z","snapshot_observed_at":"2026-08-07T20:38:28.943401Z","submitted_at":"2025-05-23T14:27:37Z","title":"Beyond Distillation: Pushing the Limits of Medical LLM Reasoning with Minimalist Rule-Based RL","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.17952","snapshot_observed_at":"2026-08-04T13:51:51.561726Z","title":"Beyond distillation: Pushing the limits of medical llm reasoning with minimalist rule-based rl","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.24560","last_updated":"2026-08-02T06:52:09Z","snapshot_observed_at":"2026-08-08T20:31:19.086455Z","submitted_at":"2025-09-29T10:13:55Z","title":"AdaThink-Med: Optimizing Inference-Time Compute for Medical Reasoning via Uncertainty Quantification","version":2},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-04T13:51:51.561726Z"},"links":{"cited_paper":"/paper/2505.17952","citing_paper":"/paper/2509.24560"},"observation_digest":"sha256:47b61e22428852025cc19f5b5e9ac211d9b21d7c61a27cf0ac9a6b03b5506e16","observation_id":"cb402813-c124-4aaa-ad62-52804fb69d88","resolution":{"observed_at":"2026-08-04T13:51:51.561726Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.17952","last_updated":"2025-05-23T14:27:37Z","snapshot_observed_at":"2026-08-07T20:38:28.943401Z","submitted_at":"2025-05-23T14:27:37Z","title":"Beyond Distillation: Pushing the Limits of Medical LLM Reasoning with Minimalist Rule-Based RL","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.17952","snapshot_observed_at":"2026-08-04T09:22:43.249504Z","title":"Beyond distillation: Pushing the limits of medical llm reasoning with minimalist rule-based rl","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.15859","last_updated":"2026-05-29T10:51:31Z","snapshot_observed_at":"2026-08-08T07:58:01.573052Z","submitted_at":"2025-10-17T17:51:28Z","title":"InfiMed-ORBIT: Aligning LLMs on Open-Ended Complex Tasks via Rubric-Based Incremental Training","version":5},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-04T09:22:43.249504Z"},"links":{"cited_paper":"/paper/2505.17952","citing_paper":"/paper/2510.15859"},"observation_digest":"sha256:f580f9e3d17b690d71dd4973788784b1bd08661ca110614e486c87cf9a419d5d","observation_id":"4744b8c1-bbb1-4855-a935-21941b67f116","resolution":{"observed_at":"2026-08-04T09:22:43.249504Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.17952","last_updated":"2025-05-23T14:27:37Z","snapshot_observed_at":"2026-08-07T20:38:28.943401Z","submitted_at":"2025-05-23T14:27:37Z","title":"Beyond Distillation: Pushing the Limits of Medical LLM Reasoning with Minimalist Rule-Based RL","version":1},"cited_work":{"arxiv_id":"2505.17952","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.17952","snapshot_observed_at":"2026-07-03T09:47:59.448127Z","title":"Beyond distillation: Pushing the limits of medical llm reasoning with minimalist rule-based rl.arXiv preprint arXiv:2505.17952.2025","venue":null,"work_id":"2f6e4f54-eeea-4250-99b6-a54b0862f2e0","year":2025},"citing_paper":{"arxiv_id":"2604.08559","last_updated":"2026-03-17T09:03:09Z","snapshot_observed_at":"2026-08-07T20:04:32.737155Z","submitted_at":"2026-03-17T09:03:09Z","title":"Medical Reasoning with Large Language Models: A Survey and MR-Bench","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-05-15T10:21:39.892271Z"},"links":{"cited_paper":"/paper/2505.17952","citing_paper":"/paper/2604.08559"},"observation_digest":"sha256:e93eafc68ec659c1ab35f89a38b77344b1d3d997638b691c10d6c88b8a6bbdfa","observation_id":"36baa877-01c2-443a-8b05-923db99d484f","resolution":{"observed_at":"2026-05-15T10:25:26.786876Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.17952","last_updated":"2025-05-23T14:27:37Z","snapshot_observed_at":"2026-08-07T20:38:28.943401Z","submitted_at":"2025-05-23T14:27:37Z","title":"Beyond Distillation: Pushing the Limits of Medical LLM Reasoning with Minimalist Rule-Based RL","version":1},"cited_work":{"arxiv_id":"2505.17952","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.17952","snapshot_observed_at":"2026-07-03T09:47:59.448127Z","title":"Beyond distillation: Pushing the limits of medical llm reasoning with minimalist rule-based rl.arXiv preprint arXiv:2505.17952.2025","venue":null,"work_id":"2f6e4f54-eeea-4250-99b6-a54b0862f2e0","year":2025},"citing_paper":{"arxiv_id":"2604.14475","last_updated":"2026-04-15T23:12:02Z","snapshot_observed_at":"2026-07-06T23:02:13.885476Z","submitted_at":"2026-04-15T23:12:02Z","title":"Evo-MedAgent: Beyond One-Shot Diagnosis with Agents That Remember, Reflect, and Improve","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-10T12:35:32.915685Z"},"links":{"cited_paper":"/paper/2505.17952","citing_paper":"/paper/2604.14475"},"observation_digest":"sha256:219e389c413b06443823362fb56df112d35b9ae9fd8c115daa7f64d0cb41facb","observation_id":"5bcc3865-1977-42f6-9ce2-32d32e606e1e","resolution":{"observed_at":"2026-05-11T11:46:34.013256Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.17952","last_updated":"2025-05-23T14:27:37Z","snapshot_observed_at":"2026-08-07T20:38:28.943401Z","submitted_at":"2025-05-23T14:27:37Z","title":"Beyond Distillation: Pushing the Limits of Medical LLM Reasoning with Minimalist Rule-Based RL","version":1},"cited_work":{"arxiv_id":"2505.17952","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.17952","snapshot_observed_at":"2026-07-03T09:47:59.448127Z","title":"Beyond distillation: Pushing the limits of medical llm reasoning with minimalist rule-based rl.arXiv preprint arXiv:2505.17952.2025","venue":null,"work_id":"2f6e4f54-eeea-4250-99b6-a54b0862f2e0","year":2025},"citing_paper":{"arxiv_id":"2605.09584","last_updated":"2026-05-10T14:51:31Z","snapshot_observed_at":"2026-07-06T23:21:39.966502Z","submitted_at":"2026-05-10T14:51:31Z","title":"CLR-voyance: Reinforcing Open-Ended Reasoning for Inpatient Clinical Decision Support with Outcome-Aware Rubrics","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-05-12T04:32:16.930291Z"},"links":{"cited_paper":"/paper/2505.17952","citing_paper":"/paper/2605.09584"},"observation_digest":"sha256:e9fa4493e3b91d3b62d4962bb307471da2fe6156031dbde14dd0fb82f795b812","observation_id":"2cf0a86c-9e05-45f4-8702-dc3b3be5d501","resolution":{"observed_at":"2026-05-12T06:11:23.869943Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.17952","last_updated":"2025-05-23T14:27:37Z","snapshot_observed_at":"2026-08-07T20:38:28.943401Z","submitted_at":"2025-05-23T14:27:37Z","title":"Beyond Distillation: Pushing the Limits of Medical LLM Reasoning with Minimalist Rule-Based RL","version":1},"cited_work":{"arxiv_id":"2505.17952","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.17952","snapshot_observed_at":"2026-07-03T09:47:59.448127Z","title":"Beyond distillation: Pushing the limits of medical llm reasoning with minimalist rule-based rl.arXiv preprint arXiv:2505.17952.2025","venue":null,"work_id":"2f6e4f54-eeea-4250-99b6-a54b0862f2e0","year":2025},"citing_paper":{"arxiv_id":"2606.11740","last_updated":"2026-06-10T07:16:27Z","snapshot_observed_at":"2026-08-02T02:17:16.809620Z","submitted_at":"2026-06-10T07:16:27Z","title":"UniReason-Med: A Shared Grounded Reasoning Interface for 2D-to-3D Transfer in Medical VQA","version":1},"reference_index":186,"source":"arxiv_source","source_observed_at":"2026-06-27T10:21:12.782864Z"},"links":{"cited_paper":"/paper/2505.17952","citing_paper":"/paper/2606.11740"},"observation_digest":"sha256:14aad9009e8c44947b4bbc94e9474bdcf072047596fd9b55a5f08415857486cd","observation_id":"d0d8dc84-b310-48dd-bfd9-68ccac497add","resolution":{"observed_at":"2026-07-03T09:47:59.449550Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.17952","last_updated":"2025-05-23T14:27:37Z","snapshot_observed_at":"2026-08-07T20:38:28.943401Z","submitted_at":"2025-05-23T14:27:37Z","title":"Beyond Distillation: Pushing the Limits of Medical LLM Reasoning with Minimalist Rule-Based RL","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.17952","snapshot_observed_at":"2026-07-30T16:01:42.470884Z","title":"Beyond distillation: Pushing the limits of medical llm reasoning with minimalist rule-based rl","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.26952","last_updated":"2026-07-29T14:20:13Z","snapshot_observed_at":"2026-08-06T11:22:42.288682Z","submitted_at":"2026-07-29T14:20:13Z","title":"Credit Cards, Confusion, Computation, and Consequences: What Can We Uncover About Language Model Reasoning?","version":1},"reference_index":155,"source":"arxiv_source","source_observed_at":"2026-07-30T16:01:42.470884Z"},"links":{"cited_paper":"/paper/2505.17952","citing_paper":"/paper/2607.26952"},"observation_digest":"sha256:389ffa1273437aa71cf3b4a5cac8275f1486992e44cb0edf8959af18583c0c7c","observation_id":"5b87cf8a-7fa2-4afb-9197-dc5a8f416f8b","resolution":{"observed_at":"2026-07-30T16:01:42.470884Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2505.17952/citation-record","integrity":"/paper/2505.17952/integrity","json":"/paper/2505.17952/citation-record.json","paper":"/paper/2505.17952"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2410.18982","last_updated":"2024-10-08T15:13:01Z","snapshot_observed_at":"2026-07-06T19:39:15.025945Z","submitted_at":"2024-10-08T15:13:01Z","title":"O1 Replication Journey: A Strategic Progress Report -- Part 1","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.18982","snapshot_observed_at":"2026-08-07T14:41:35.110924Z","title":"O1 replication journey: A strategic progress report–part 1,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17952","last_updated":"2025-05-23T14:27:37Z","snapshot_observed_at":"2026-08-07T20:38:28.943401Z","submitted_at":"2025-05-23T14:27:37Z","title":"Beyond Distillation: Pushing the Limits of Medical LLM Reasoning with Minimalist Rule-Based RL","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T14:41:35.110924Z"},"links":{"cited_paper":"/paper/2410.18982","citing_paper":"/paper/2505.17952"},"observation_digest":"sha256:cc441d57b427ae21725f2d19cac0a2e1a7fce2cbd2f822a24a412164589c0371","observation_id":"ddff6edb-6561-415f-a0be-7db1e94857ea","resolution":{"observed_at":"2026-08-07T14:41:35.110924Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.14135","last_updated":"2024-12-18T18:24:47Z","snapshot_observed_at":"2026-08-03T23:00:22.560900Z","submitted_at":"2024-12-18T18:24:47Z","title":"Scaling of Search and Learning: A Roadmap to Reproduce o1 from Reinforcement Learning Perspective","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.14135","snapshot_observed_at":"2026-08-07T14:41:35.205646Z","title":"Scaling of search and learning: A roadmap to reproduce o1 from reinforcement learning perspective,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17952","last_updated":"2025-05-23T14:27:37Z","snapshot_observed_at":"2026-08-07T20:38:28.943401Z","submitted_at":"2025-05-23T14:27:37Z","title":"Beyond Distillation: Pushing the Limits of Medical LLM Reasoning with Minimalist Rule-Based RL","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T14:41:35.205646Z"},"links":{"cited_paper":"/paper/2412.14135","citing_paper":"/paper/2505.17952"},"observation_digest":"sha256:5dc38970b44a0d26e36ec181ffd883b50b78e2f98467bfffd4435bfe276a1d57","observation_id":"44390b50-5e53-4f62-a2df-4932ae45cb20","resolution":{"observed_at":"2026-08-07T14:41:35.205646Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.09671","last_updated":"2024-10-12T23:42:16Z","snapshot_observed_at":"2026-08-08T14:45:36.681932Z","submitted_at":"2024-10-12T23:42:16Z","title":"OpenR: An Open Source Framework for Advanced Reasoning with Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.09671","snapshot_observed_at":"2026-08-07T14:41:35.294119Z","title":"Openr: An open source framework for advanced reasoning with large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17952","last_updated":"2025-05-23T14:27:37Z","snapshot_observed_at":"2026-08-07T20:38:28.943401Z","submitted_at":"2025-05-23T14:27:37Z","title":"Beyond Distillation: Pushing the Limits of Medical LLM Reasoning with Minimalist Rule-Based RL","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T14:41:35.294119Z"},"links":{"cited_paper":"/paper/2410.09671","citing_paper":"/paper/2505.17952"},"observation_digest":"sha256:d2dfb037fcf95ee1c39e99c0c1fba81c6b1d3ed9bcbb333064aa06c406d03115","observation_id":"49b20d09-7281-4d9a-ae42-599be00232fb","resolution":{"observed_at":"2026-08-07T14:41:35.294119Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:41:43.367136Z","title":"Deliberative alignment: Reasoning enables safer language models,","venue":null,"work_id":"87b24d51-759c-4877-b470-c1535812af80","year":2024},"citing_paper":{"arxiv_id":"2505.17952","last_updated":"2025-05-23T14:27:37Z","snapshot_observed_at":"2026-08-07T20:38:28.943401Z","submitted_at":"2025-05-23T14:27:37Z","title":"Beyond Distillation: Pushing the Limits of Medical LLM Reasoning with Minimalist Rule-Based RL","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T14:41:35.381361Z"},"links":{"citing_paper":"/paper/2505.17952"},"observation_digest":"sha256:5fb124336b2c7a40308bd8d9f1e84f5a1e60099429ae159a50d129984121e728","observation_id":"fc8a92c0-c574-4791-b7c8-9f36ba96a05b","resolution":{"observed_at":"2026-08-07T14:41:43.430945Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.18416","last_updated":"2024-05-01T17:12:10Z","snapshot_observed_at":"2026-07-06T18:06:49.190172Z","submitted_at":"2024-04-29T04:11:28Z","title":"Capabilities of Gemini Models in Medicine","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.18416","snapshot_observed_at":"2026-08-07T14:41:35.475924Z","title":"Capabilities of gemini models in medicine,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17952","last_updated":"2025-05-23T14:27:37Z","snapshot_observed_at":"2026-08-07T20:38:28.943401Z","submitted_at":"2025-05-23T14:27:37Z","title":"Beyond Distillation: Pushing the Limits of Medical LLM Reasoning with Minimalist Rule-Based RL","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T14:41:35.475924Z"},"links":{"cited_paper":"/paper/2404.18416","citing_paper":"/paper/2505.17952"},"observation_digest":"sha256:0cf0584257198c41c5091de637cd0d0c53381708f3eb3ff3f401248195488954","observation_id":"270b00cb-7f12-4d70-b0c7-ff752bffd7fe","resolution":{"observed_at":"2026-08-07T14:41:35.475924Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.13301","last_updated":"2024-09-15T08:43:17Z","snapshot_observed_at":"2026-07-06T18:48:20.902620Z","submitted_at":"2024-07-18T09:06:27Z","title":"CoD, Towards an Interpretable Medical Agent using Chain of Diagnosis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.13301","snapshot_observed_at":"2026-08-07T14:41:35.566459Z","title":"Cod, towards an interpretable medical agent using chain of diagnosis,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17952","last_updated":"2025-05-23T14:27:37Z","snapshot_observed_at":"2026-08-07T20:38:28.943401Z","submitted_at":"2025-05-23T14:27:37Z","title":"Beyond Distillation: Pushing the Limits of Medical LLM Reasoning with Minimalist Rule-Based RL","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T14:41:35.566459Z"},"links":{"cited_paper":"/paper/2407.13301","citing_paper":"/paper/2505.17952"},"observation_digest":"sha256:a6fe5c376230984073bc7c0d73f1a17ba48272228688bf27ce0e546a48e69a4e","observation_id":"9196e662-694a-46e4-b70f-c0b95d6fbabb","resolution":{"observed_at":"2026-08-07T14:41:35.566459Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:41:43.227904Z","title":"Thinking and reasoning in medicine,","venue":null,"work_id":"8bb4f158-ad05-429b-b534-c2e34b7e16fd","year":2005},"citing_paper":{"arxiv_id":"2505.17952","last_updated":"2025-05-23T14:27:37Z","snapshot_observed_at":"2026-08-07T20:38:28.943401Z","submitted_at":"2025-05-23T14:27:37Z","title":"Beyond Distillation: Pushing the Limits of Medical LLM Reasoning with Minimalist Rule-Based RL","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T14:41:35.658180Z"},"links":{"citing_paper":"/paper/2505.17952"},"observation_digest":"sha256:800d29213b22a8eb08a0e4f7ee8086e6a2f5f5c298cf714e74e7dc78558b0eb4","observation_id":"8f56f633-7dac-414b-9fb7-4dba5eda8c96","resolution":{"observed_at":"2026-08-07T14:41:43.290576Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.14461","last_updated":"2024-11-16T18:19:53Z","snapshot_observed_at":"2026-07-06T19:54:00.822571Z","submitted_at":"2024-11-16T18:19:53Z","title":"Towards Next-Generation Medical Agent: How o1 is Reshaping Decision-Making in Medical Scenarios","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.14461","snapshot_observed_at":"2026-08-07T14:41:35.780810Z","title":"Towards next- generation medical agent: How o1 is reshaping decision-making in medical scenarios,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17952","last_updated":"2025-05-23T14:27:37Z","snapshot_observed_at":"2026-08-07T20:38:28.943401Z","submitted_at":"2025-05-23T14:27:37Z","title":"Beyond Distillation: Pushing the Limits of Medical LLM Reasoning with Minimalist Rule-Based RL","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T14:41:35.780810Z"},"links":{"cited_paper":"/paper/2411.14461","citing_paper":"/paper/2505.17952"},"observation_digest":"sha256:47bb10bad97ade1633d5040eeb8f2624eb7fb5feecddfd8f8d9be28b657e5fd1","observation_id":"dbb93beb-e864-4aac-a750-6ab2d4386646","resolution":{"observed_at":"2026-08-07T14:41:35.780810Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:41:43.068346Z","title":"Openai o1-preview vs. chatgpt in healthcare: A new frontier in medical ai reasoning,","venue":null,"work_id":"41c45e49-a036-452c-afdc-64aca798bc66","year":2024},"citing_paper":{"arxiv_id":"2505.17952","last_updated":"2025-05-23T14:27:37Z","snapshot_observed_at":"2026-08-07T20:38:28.943401Z","submitted_at":"2025-05-23T14:27:37Z","title":"Beyond Distillation: Pushing the Limits of Medical LLM Reasoning with Minimalist Rule-Based RL","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T14:41:35.861039Z"},"links":{"citing_paper":"/paper/2505.17952"},"observation_digest":"sha256:ec745eda546bd4354ebed8410073d94f5f068fba81998e1a9baebb5f17792c29","observation_id":"ccd0b47c-5ec5-4198-b2b7-dfcd303abc82","resolution":{"observed_at":"2026-08-07T14:41:43.134395Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.15277","last_updated":"2024-09-23T17:59:43Z","snapshot_observed_at":"2026-08-07T23:41:53.087365Z","submitted_at":"2024-09-23T17:59:43Z","title":"A Preliminary Study of o1 in Medicine: Are We Closer to an AI Doctor?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.15277","snapshot_observed_at":"2026-08-07T14:41:35.953046Z","title":"A preliminary study of o1 in medicine: Are we closer to an ai doctor?","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17952","last_updated":"2025-05-23T14:27:37Z","snapshot_observed_at":"2026-08-07T20:38:28.943401Z","submitted_at":"2025-05-23T14:27:37Z","title":"Beyond Distillation: Pushing the Limits of Medical LLM Reasoning with Minimalist Rule-Based RL","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T14:41:35.953046Z"},"links":{"cited_paper":"/paper/2409.15277","citing_paper":"/paper/2505.17952"},"observation_digest":"sha256:d8101020723096739df4c9905baf4b34c72553272bc4af7988a413cffbc4e8a0","observation_id":"9fb96894-1c47-4a7a-af57-6915fbf06936","resolution":{"observed_at":"2026-08-07T14:41:35.953046Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.09774","last_updated":"2024-09-15T08:41:01Z","snapshot_observed_at":"2026-07-06T16:48:33.164024Z","submitted_at":"2023-11-16T10:56:24Z","title":"HuatuoGPT-II, One-stage Training for Medical Adaption of LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.09774","snapshot_observed_at":"2026-08-07T14:41:36.033970Z","title":"Huatuogpt- ii, one-stage training for medical adaption of llms,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17952","last_updated":"2025-05-23T14:27:37Z","snapshot_observed_at":"2026-08-07T20:38:28.943401Z","submitted_at":"2025-05-23T14:27:37Z","title":"Beyond Distillation: Pushing the Limits of Medical LLM Reasoning with Minimalist Rule-Based RL","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T14:41:36.033970Z"},"links":{"cited_paper":"/paper/2311.09774","citing_paper":"/paper/2505.17952"},"observation_digest":"sha256:843a68bfc8fc1454efcc9c869ce18b38d5f98274c5860567cbf095e715e82dd4","observation_id":"d1f660c4-a146-46db-9daa-c1e61bf84ea2","resolution":{"observed_at":"2026-08-07T14:41:36.033970Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:41:42.911196Z","title":"Chain- of-thought prompting elicits reasoning in large language models,","venue":null,"work_id":"3c5e72f1-ff3e-4840-bfc1-5b4f2aa3158c","year":2022},"citing_paper":{"arxiv_id":"2505.17952","last_updated":"2025-05-23T14:27:37Z","snapshot_observed_at":"2026-08-07T20:38:28.943401Z","submitted_at":"2025-05-23T14:27:37Z","title":"Beyond Distillation: Pushing the Limits of Medical LLM Reasoning with Minimalist Rule-Based RL","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T14:41:36.140824Z"},"links":{"citing_paper":"/paper/2505.17952"},"observation_digest":"sha256:0ed902d7096ae882607b91c722e58519b8758bd2748a2567576253abbd792550","observation_id":"dfb8cb23-fa89-4910-84ff-5fa8cc3b26fb","resolution":{"observed_at":"2026-08-07T14:41:43.008370Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.11416","last_updated":"2022-12-06T21:39:48Z","snapshot_observed_at":"2026-07-06T14:08:18.855958Z","submitted_at":"2022-10-20T16:58:32Z","title":"Scaling Instruction-Finetuned Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.11416","snapshot_observed_at":"2026-08-07T14:41:36.223757Z","title":"Scaling instruction-finetuned language models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.17952","last_updated":"2025-05-23T14:27:37Z","snapshot_observed_at":"2026-08-07T20:38:28.943401Z","submitted_at":"2025-05-23T14:27:37Z","title":"Beyond Distillation: Pushing the Limits of Medical LLM Reasoning with Minimalist Rule-Based RL","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T14:41:36.223757Z"},"links":{"cited_paper":"/paper/2210.11416","citing_paper":"/paper/2505.17952"},"observation_digest":"sha256:73f3e6ac99d6299bbe82eabe4f9ddf23dddb43d8acf75d9a02131d996af3b52b","observation_id":"e5a910c0-7061-4daf-85c7-5fe14a3228a8","resolution":{"observed_at":"2026-08-07T14:41:36.223757Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:41:42.753994Z","title":"Star: Bootstrapping reasoning with reasoning,","venue":null,"work_id":"269bca7a-c429-41e0-9d4c-ff1395a71614","year":2022},"citing_paper":{"arxiv_id":"2505.17952","last_updated":"2025-05-23T14:27:37Z","snapshot_observed_at":"2026-08-07T20:38:28.943401Z","submitted_at":"2025-05-23T14:27:37Z","title":"Beyond Distillation: Pushing the Limits of Medical LLM Reasoning with Minimalist Rule-Based RL","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T14:41:36.292069Z"},"links":{"citing_paper":"/paper/2505.17952"},"observation_digest":"sha256:a0293a08fc0f258a4df24b410795b7960afa4c693ba52ba81023d601a8ef2043","observation_id":"e7ea9409-fc35-482b-ae14-effe08d21422","resolution":{"observed_at":"2026-08-07T14:41:42.838945Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.17161","last_updated":"2025-05-26T17:16:45Z","snapshot_observed_at":"2026-08-09T18:26:12.869738Z","submitted_at":"2025-01-28T18:59:44Z","title":"SFT Memorizes, RL Generalizes: A Comparative Study of Foundation Model Post-training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.17161","snapshot_observed_at":"2026-08-07T14:41:36.371201Z","title":"Sft memorizes, rl generalizes: A comparative study of foundation model post-training,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17952","last_updated":"2025-05-23T14:27:37Z","snapshot_observed_at":"2026-08-07T20:38:28.943401Z","submitted_at":"2025-05-23T14:27:37Z","title":"Beyond Distillation: Pushing the Limits of Medical LLM Reasoning with Minimalist Rule-Based RL","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T14:41:36.371201Z"},"links":{"cited_paper":"/paper/2501.17161","citing_paper":"/paper/2505.17952"},"observation_digest":"sha256:0d969f212b7c289118f7ca2a5420e2c5f701419fc3804c4c323955aba5f0fd74","observation_id":"d33fe216-0b70-4e32-a9cb-71d7dc42abfc","resolution":{"observed_at":"2026-08-07T14:41:36.371201Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.08837","last_updated":"2025-05-08T06:35:06Z","snapshot_observed_at":"2026-07-06T21:08:05.749656Z","submitted_at":"2025-04-10T17:41:56Z","title":"VL-Rethinker: Incentivizing Self-Reflection of Vision-Language Models with Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.08837","snapshot_observed_at":"2026-08-07T14:41:36.475828Z","title":"Vl-rethinker: Incentivizing self-reflection of vision-language models with reinforcement learning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17952","last_updated":"2025-05-23T14:27:37Z","snapshot_observed_at":"2026-08-07T20:38:28.943401Z","submitted_at":"2025-05-23T14:27:37Z","title":"Beyond Distillation: Pushing the Limits of Medical LLM Reasoning with Minimalist Rule-Based RL","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T14:41:36.475828Z"},"links":{"cited_paper":"/paper/2504.08837","citing_paper":"/paper/2505.17952"},"observation_digest":"sha256:60f8cd4eef57c26481bb626416bcc226691b24350c0a6876ed93cf2ed4b0661a","observation_id":"8d8e1ea7-7979-4aa0-bee8-ec6cc2b88527","resolution":{"observed_at":"2026-08-07T14:41:36.475828Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:41:36.540075Z","title":"Training language models to follow instructions with human feedback,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.17952","last_updated":"2025-05-23T14:27:37Z","snapshot_observed_at":"2026-08-07T20:38:28.943401Z","submitted_at":"2025-05-23T14:27:37Z","title":"Beyond Distillation: Pushing the Limits of Medical LLM Reasoning with Minimalist Rule-Based RL","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T14:41:36.540075Z"},"links":{"citing_paper":"/paper/2505.17952"},"observation_digest":"sha256:4b143fc1594079c0f90471191a0c8bdde21907b8083a8f99f272731644146c20","observation_id":"957b55df-daf8-471d-a8ba-095d21816c1b","resolution":{"observed_at":"2026-08-07T14:41:36.540075Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.00691","last_updated":"2025-07-18T07:40:22Z","snapshot_observed_at":"2026-08-09T18:00:37.513859Z","submitted_at":"2025-02-02T06:32:23Z","title":"To Code or not to Code? Adaptive Tool Integration for Math Language Models via Expectation-Maximization","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.00691","snapshot_observed_at":"2026-08-07T14:41:36.635299Z","title":"Learning autonomous code integration for math language models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17952","last_updated":"2025-05-23T14:27:37Z","snapshot_observed_at":"2026-08-07T20:38:28.943401Z","submitted_at":"2025-05-23T14:27:37Z","title":"Beyond Distillation: Pushing the Limits of Medical LLM Reasoning with Minimalist Rule-Based RL","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T14:41:36.635299Z"},"links":{"cited_paper":"/paper/2502.00691","citing_paper":"/paper/2505.17952"},"observation_digest":"sha256:7d6e06cc43d9ce808bf748966ccee53acd5c03b0ee4229b7249912afce10227e","observation_id":"8a6bfc6b-3108-4773-bdd1-0cbed13750a6","resolution":{"observed_at":"2026-08-07T14:41:36.635299Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:41:42.553793Z","title":"Direct preference opti- mization: Your language model is secretly a reward model,","venue":null,"work_id":"588b84a1-5fd8-4f04-a804-46690cb59c67","year":2023},"citing_paper":{"arxiv_id":"2505.17952","last_updated":"2025-05-23T14:27:37Z","snapshot_observed_at":"2026-08-07T20:38:28.943401Z","submitted_at":"2025-05-23T14:27:37Z","title":"Beyond Distillation: Pushing the Limits of Medical LLM Reasoning with Minimalist Rule-Based RL","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T14:41:36.701546Z"},"links":{"citing_paper":"/paper/2505.17952"},"observation_digest":"sha256:76d3c0dbf9fc14ac5db09bde65ec15da483110957cebdac494c5cab4a41c2cc2","observation_id":"1fbcc017-d600-47fc-b76d-df04a5fa541f","resolution":{"observed_at":"2026-08-07T14:41:42.662548Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:41:42.397447Z","title":"Openbiollm-70b: Advancing open-source biomedical llms with direct preference optimization,","venue":null,"work_id":"5738141a-c9d9-4963-bbae-b36117b9eb06","year":2024},"citing_paper":{"arxiv_id":"2505.17952","last_updated":"2025-05-23T14:27:37Z","snapshot_observed_at":"2026-08-07T20:38:28.943401Z","submitted_at":"2025-05-23T14:27:37Z","title":"Beyond Distillation: Pushing the Limits of Medical LLM Reasoning with Minimalist Rule-Based RL","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T14:41:36.828546Z"},"links":{"citing_paper":"/paper/2505.17952"},"observation_digest":"sha256:709ef0b5641f0afd459d1909aedcb5e232e1ab00aa0427f1bc0249cdbef4db51","observation_id":"e386da9a-1b0f-43f7-94ec-e59668369e62","resolution":{"observed_at":"2026-08-07T14:41:42.481327Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-07T14:41:36.929289Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17952","last_updated":"2025-05-23T14:27:37Z","snapshot_observed_at":"2026-08-07T20:38:28.943401Z","submitted_at":"2025-05-23T14:27:37Z","title":"Beyond Distillation: Pushing the Limits of Medical LLM Reasoning with Minimalist Rule-Based RL","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T14:41:36.929289Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2505.17952"},"observation_digest":"sha256:3e1ec6df63bb7b1fffda99337d1ae76cd1cc115a5d496cb4e2ceb84ad9ecb0c2","observation_id":"1754908f-7f39-47ad-b414-3c26bd069522","resolution":{"observed_at":"2026-08-07T14:41:36.929289Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01718","last_updated":"2025-05-24T04:36:48Z","snapshot_observed_at":"2026-08-09T14:47:36.505441Z","submitted_at":"2025-02-03T18:46:04Z","title":"ACECODER: Acing Coder RL via Automated Test-Case Synthesis","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.01718","snapshot_observed_at":"2026-08-07T14:41:37.015968Z","title":"Acecoder: Acing coder rl via automated test-case synthesis,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17952","last_updated":"2025-05-23T14:27:37Z","snapshot_observed_at":"2026-08-07T20:38:28.943401Z","submitted_at":"2025-05-23T14:27:37Z","title":"Beyond Distillation: Pushing the Limits of Medical LLM Reasoning with Minimalist Rule-Based RL","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T14:41:37.015968Z"},"links":{"cited_paper":"/paper/2502.01718","citing_paper":"/paper/2505.17952"},"observation_digest":"sha256:bfc5d163be7482b5f77b8920c4b5295673843bfa2ded4ae73f087fd91e3c3410","observation_id":"c80f83ec-8b68-4e3d-a607-b2e950a5a54d","resolution":{"observed_at":"2026-08-07T14:41:37.015968Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.19634","last_updated":"2025-03-19T13:55:33Z","snapshot_observed_at":"2026-08-07T20:37:56.716831Z","submitted_at":"2025-02-26T23:57:34Z","title":"MedVLM-R1: Incentivizing Medical Reasoning Capability of Vision-Language Models (VLMs) via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.19634","snapshot_observed_at":"2026-08-07T14:41:37.084607Z","title":"Medvlm-r1: Incentivizing medical reasoning capability of vision-language models (vlms) via reinforcement learning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17952","last_updated":"2025-05-23T14:27:37Z","snapshot_observed_at":"2026-08-07T20:38:28.943401Z","submitted_at":"2025-05-23T14:27:37Z","title":"Beyond Distillation: Pushing the Limits of Medical LLM Reasoning with Minimalist Rule-Based RL","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T14:41:37.084607Z"},"links":{"cited_paper":"/paper/2502.19634","citing_paper":"/paper/2505.17952"},"observation_digest":"sha256:cb4fcbcdec12911543ba1cc4a1e5d7618ee95f4573775cbe4539f5835bd08a86","observation_id":"f99ccc4a-99b6-43ff-8516-31e3ba326ad1","resolution":{"observed_at":"2026-08-07T14:41:37.084607Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15075","last_updated":"2023-05-24T11:56:01Z","snapshot_observed_at":"2026-08-07T23:04:52.692705Z","submitted_at":"2023-05-24T11:56:01Z","title":"HuatuoGPT, towards Taming Language Model to Be a Doctor","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.15075","snapshot_observed_at":"2026-08-07T14:41:37.171031Z","title":"Huatuogpt, towards taming language model to be a doctor,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17952","last_updated":"2025-05-23T14:27:37Z","snapshot_observed_at":"2026-08-07T20:38:28.943401Z","submitted_at":"2025-05-23T14:27:37Z","title":"Beyond Distillation: Pushing the Limits of Medical LLM Reasoning with Minimalist Rule-Based RL","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T14:41:37.171031Z"},"links":{"cited_paper":"/paper/2305.15075","citing_paper":"/paper/2505.17952"},"observation_digest":"sha256:96677d3c08074fb1b16297069ae86ad1ec31d99da4ef449272da020d05dc5f6d","observation_id":"29a452ce-3036-4ade-a2c8-bbd105af3e82","resolution":{"observed_at":"2026-08-07T14:41:37.171031Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.10373","last_updated":"2024-07-17T09:34:00Z","snapshot_observed_at":"2026-08-02T05:31:09.782791Z","submitted_at":"2024-02-15T23:39:04Z","title":"BioMistral: A Collection of Open-Source Pretrained Large Language Models for Medical Domains","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.10373","snapshot_observed_at":"2026-08-07T14:41:37.248353Z","title":"Biomistral: A collection of open-source pretrained large language models for medical domains,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17952","last_updated":"2025-05-23T14:27:37Z","snapshot_observed_at":"2026-08-07T20:38:28.943401Z","submitted_at":"2025-05-23T14:27:37Z","title":"Beyond Distillation: Pushing the Limits of Medical LLM Reasoning with Minimalist Rule-Based RL","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T14:41:37.248353Z"},"links":{"cited_paper":"/paper/2402.10373","citing_paper":"/paper/2505.17952"},"observation_digest":"sha256:58b864b15493272d77e43a9ad8c9f6ae557d1c22dc34bed8639195daf63073ea","observation_id":"e8570afb-a017-4443-a685-cdaceee4c015","resolution":{"observed_at":"2026-08-07T14:41:37.248353Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.03241","last_updated":"2023-04-12T10:36:44Z","snapshot_observed_at":"2026-08-05T03:04:44.382109Z","submitted_at":"2023-02-07T03:57:55Z","title":"Continual Pre-training of Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.03241","snapshot_observed_at":"2026-08-07T14:41:37.342138Z","title":"Continual pre-training of language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17952","last_updated":"2025-05-23T14:27:37Z","snapshot_observed_at":"2026-08-07T20:38:28.943401Z","submitted_at":"2025-05-23T14:27:37Z","title":"Beyond Distillation: Pushing the Limits of Medical LLM Reasoning with Minimalist Rule-Based RL","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T14:41:37.342138Z"},"links":{"cited_paper":"/paper/2302.03241","citing_paper":"/paper/2505.17952"},"observation_digest":"sha256:a0e06293dc523e7f9d22024268433747f90bcce2b03b0aa2fc912a62b4b95126","observation_id":"73ddad87-78bb-4a09-a9e0-731211447055","resolution":{"observed_at":"2026-08-07T14:41:37.342138Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:41:37.431561Z","title":"Ultramedical: Building specialized generalists in biomedicine,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17952","last_updated":"2025-05-23T14:27:37Z","snapshot_observed_at":"2026-08-07T20:38:28.943401Z","submitted_at":"2025-05-23T14:27:37Z","title":"Beyond Distillation: Pushing the Limits of Medical LLM Reasoning with Minimalist Rule-Based RL","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T14:41:37.431561Z"},"links":{"citing_paper":"/paper/2505.17952"},"observation_digest":"sha256:d642538d8039cafea6a85e77854f58ebe913326a3ae5fc473166141804b03964","observation_id":"1473c761-1476-43af-8f1e-91f3ff449fd6","resolution":{"observed_at":"2026-08-07T14:41:37.431561Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:41:37.649916Z","title":"m1: Unleash the potential of test-time scaling for medical reasoning with large language models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17952","last_updated":"2025-05-23T14:27:37Z","snapshot_observed_at":"2026-08-07T20:38:28.943401Z","submitted_at":"2025-05-23T14:27:37Z","title":"Beyond Distillation: Pushing the Limits of Medical LLM Reasoning with Minimalist Rule-Based RL","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T14:41:37.649916Z"},"links":{"citing_paper":"/paper/2505.17952"},"observation_digest":"sha256:2c8523625414616eb43b7b30db34a0ca56ce01ef163d0da7f65f3659161bb89f","observation_id":"4d5da96f-8c4b-4684-96e5-9e805d0d8759","resolution":{"observed_at":"2026-08-07T14:41:37.649916Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-07T14:41:37.741316Z","title":"Proximal policy optimization algo- rithms,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.17952","last_updated":"2025-05-23T14:27:37Z","snapshot_observed_at":"2026-08-07T20:38:28.943401Z","submitted_at":"2025-05-23T14:27:37Z","title":"Beyond Distillation: Pushing the Limits of Medical LLM Reasoning with Minimalist Rule-Based RL","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T14:41:37.741316Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2505.17952"},"observation_digest":"sha256:7ca59a1318ff8f81fb621d0b640cf7e312aae054cf195e9ddad73f730eb9c88a","observation_id":"d6ac4e88-471d-4433-beca-d35c9dca5d08","resolution":{"observed_at":"2026-08-07T14:41:37.741316Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.19256","last_updated":"2024-10-02T04:01:47Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-28T06:20:03Z","title":"HybridFlow: A Flexible and Efficient RLHF Framework","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.19256","snapshot_observed_at":"2026-08-07T14:41:37.853487Z","title":"Hybridflow: A flexible and efficient rlhf framework,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17952","last_updated":"2025-05-23T14:27:37Z","snapshot_observed_at":"2026-08-07T20:38:28.943401Z","submitted_at":"2025-05-23T14:27:37Z","title":"Beyond Distillation: Pushing the Limits of Medical LLM Reasoning with Minimalist Rule-Based RL","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T14:41:37.853487Z"},"links":{"cited_paper":"/paper/2409.19256","citing_paper":"/paper/2505.17952"},"observation_digest":"sha256:7b74ae3b889cc44dd8e30d46ce582fa71b472a7a2c6033e95fe8a53bf549a835","observation_id":"b651a1eb-6835-48f3-8950-f88774b3528c","resolution":{"observed_at":"2026-08-07T14:41:37.853487Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:41:42.216524Z","title":"Medmcqa: A large-scale multi-subject multi-choice dataset for medical domain question answering,","venue":null,"work_id":"8b340294-29fe-41b6-8c7e-89e389be82b9","year":2022},"citing_paper":{"arxiv_id":"2505.17952","last_updated":"2025-05-23T14:27:37Z","snapshot_observed_at":"2026-08-07T20:38:28.943401Z","submitted_at":"2025-05-23T14:27:37Z","title":"Beyond Distillation: Pushing the Limits of Medical LLM Reasoning with Minimalist Rule-Based RL","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T14:41:38.014800Z"},"links":{"citing_paper":"/paper/2505.17952"},"observation_digest":"sha256:b9748b237b6bac2ef9b689e8b5219a9b33aecdefc564b8cee16dc927e79203a4","observation_id":"954f89b7-6c7e-4fb7-885e-eca57af0df40","resolution":{"observed_at":"2026-08-07T14:41:42.307188Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1909.06146","last_updated":"2019-09-13T11:18:20Z","snapshot_observed_at":"2026-07-06T08:21:28.880621Z","submitted_at":"2019-09-13T11:18:20Z","title":"PubMedQA: A Dataset for Biomedical Research Question Answering","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.06146","snapshot_observed_at":"2026-08-07T14:41:38.111618Z","title":"Pubmedqa: A dataset for biomedical research question answering,","venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2505.17952","last_updated":"2025-05-23T14:27:37Z","snapshot_observed_at":"2026-08-07T20:38:28.943401Z","submitted_at":"2025-05-23T14:27:37Z","title":"Beyond Distillation: Pushing the Limits of Medical LLM Reasoning with Minimalist Rule-Based RL","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T14:41:38.111618Z"},"links":{"cited_paper":"/paper/1909.06146","citing_paper":"/paper/2505.17952"},"observation_digest":"sha256:2e25f1b1d028519f7c036d225e13384ed636c735f9ec825edde3d9fc7fc3f0cc","observation_id":"ea87c37c-55e7-4a5b-a18e-4fc1419b4629","resolution":{"observed_at":"2026-08-07T14:41:38.111618Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:41:42.017736Z","title":"Mmlu- pro: A more robust and challenging multi-task language understanding benchmark,","venue":null,"work_id":"ef9abb09-c011-4aed-856a-63552678867d","year":2024},"citing_paper":{"arxiv_id":"2505.17952","last_updated":"2025-05-23T14:27:37Z","snapshot_observed_at":"2026-08-07T20:38:28.943401Z","submitted_at":"2025-05-23T14:27:37Z","title":"Beyond Distillation: Pushing the Limits of Medical LLM Reasoning with Minimalist Rule-Based RL","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T14:41:38.215005Z"},"links":{"citing_paper":"/paper/2505.17952"},"observation_digest":"sha256:b4aaae123aa23fb574a7d3bdc826bec0194c044d0eaf7a6e5b2a732a481343e2","observation_id":"33dbd54b-e09c-4eb2-8c58-cbe4bddab2b2","resolution":{"observed_at":"2026-08-07T14:41:42.105838Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:41:38.322847Z","title":"Gpqa: A graduate-level google-proof q&a benchmark,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17952","last_updated":"2025-05-23T14:27:37Z","snapshot_observed_at":"2026-08-07T20:38:28.943401Z","submitted_at":"2025-05-23T14:27:37Z","title":"Beyond Distillation: Pushing the Limits of Medical LLM Reasoning with Minimalist Rule-Based RL","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T14:41:38.322847Z"},"links":{"citing_paper":"/paper/2505.17952"},"observation_digest":"sha256:3921681a9948f50b3eae5440827c990ed8dbb493ffcc4369699da1439c2a56a5","observation_id":"df4ce292-511b-4cf3-b664-3bdd37b2a5fa","resolution":{"observed_at":"2026-08-07T14:41:38.322847Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.18362","last_updated":"2025-06-06T13:00:07Z","snapshot_observed_at":"2026-08-09T12:11:54.956626Z","submitted_at":"2025-01-30T14:07:56Z","title":"MedXpertQA: Benchmarking Expert-Level Medical Reasoning and Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.18362","snapshot_observed_at":"2026-08-07T14:41:38.423359Z","title":"Medxpertqa: Bench- marking expert-level medical reasoning and understanding,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17952","last_updated":"2025-05-23T14:27:37Z","snapshot_observed_at":"2026-08-07T20:38:28.943401Z","submitted_at":"2025-05-23T14:27:37Z","title":"Beyond Distillation: Pushing the Limits of Medical LLM Reasoning with Minimalist Rule-Based RL","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T14:41:38.423359Z"},"links":{"cited_paper":"/paper/2501.18362","citing_paper":"/paper/2505.17952"},"observation_digest":"sha256:d8c72ace8a227c894c96dfb86c64655183ff90ccda766c54c5fbcf7d4187067c","observation_id":"f4b35547-716f-4666-acfb-e821b41c857e","resolution":{"observed_at":"2026-08-07T14:41:38.423359Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.07459","last_updated":"2026-06-16T17:07:03Z","snapshot_observed_at":"2026-08-08T19:42:41.144056Z","submitted_at":"2025-03-10T15:38:44Z","title":"MedicalAgentsBench for Complex Medical Reasoning: Comparing Internalized Reasoning Models versus Externalized Agent-based Frameworks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.07459","snapshot_observed_at":"2026-08-07T14:41:38.579027Z","title":"Medagents- bench: Benchmarking thinking models and agent frameworks for complex medical reasoning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17952","last_updated":"2025-05-23T14:27:37Z","snapshot_observed_at":"2026-08-07T20:38:28.943401Z","submitted_at":"2025-05-23T14:27:37Z","title":"Beyond Distillation: Pushing the Limits of Medical LLM Reasoning with Minimalist Rule-Based RL","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T14:41:38.579027Z"},"links":{"cited_paper":"/paper/2503.07459","citing_paper":"/paper/2505.17952"},"observation_digest":"sha256:b202e134ef9ef08d6f5d0082170d0573da5a99c9bbbe0305a7079708440861c5","observation_id":"2fc5f574-142a-4694-b38a-c57e3ae2a1fa","resolution":{"observed_at":"2026-08-07T14:41:38.579027Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.01574","last_updated":"2024-11-06T02:54:00Z","snapshot_observed_at":"2026-08-06T00:29:17.674418Z","submitted_at":"2024-06-03T17:53:00Z","title":"MMLU-Pro: A More Robust and Challenging Multi-Task Language Understanding Benchmark","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.01574","snapshot_observed_at":"2026-08-07T14:41:38.693288Z","title":"Mmlu- pro: A more robust and challenging multi-task language understanding benchmark,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17952","last_updated":"2025-05-23T14:27:37Z","snapshot_observed_at":"2026-08-07T20:38:28.943401Z","submitted_at":"2025-05-23T14:27:37Z","title":"Beyond Distillation: Pushing the Limits of Medical LLM Reasoning with Minimalist Rule-Based RL","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T14:41:38.693288Z"},"links":{"cited_paper":"/paper/2406.01574","citing_paper":"/paper/2505.17952"},"observation_digest":"sha256:12097fa8a0a6f5534de8ad5ce2db38a06d6badd2a173752769276db23c9cfc1e","observation_id":"d514a37b-32bc-4cfd-adef-3c560f2ef65c","resolution":{"observed_at":"2026-08-07T14:41:38.693288Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:41:41.813541Z","title":"Openbiollms: Advancing open-source large language models for healthcare and life sciences,","venue":null,"work_id":"94a088dc-ffd5-4b7f-b61e-de3d97a26a45","year":2024},"citing_paper":{"arxiv_id":"2505.17952","last_updated":"2025-05-23T14:27:37Z","snapshot_observed_at":"2026-08-07T20:38:28.943401Z","submitted_at":"2025-05-23T14:27:37Z","title":"Beyond Distillation: Pushing the Limits of Medical LLM Reasoning with Minimalist Rule-Based RL","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T14:41:38.796996Z"},"links":{"citing_paper":"/paper/2505.17952"},"observation_digest":"sha256:d00559d1ea99f4d9d82cebe602fc544e90e8887aab0602fbd953577bf67eae2a","observation_id":"497ac864-91eb-43b3-bf04-b1d08468b539","resolution":{"observed_at":"2026-08-07T14:41:41.905072Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:41:41.615804Z","title":"Towards building multilin- gual language model for medicine,","venue":null,"work_id":"84d49300-d7c9-4d9c-89f2-94572c9af651","year":2024},"citing_paper":{"arxiv_id":"2505.17952","last_updated":"2025-05-23T14:27:37Z","snapshot_observed_at":"2026-08-07T20:38:28.943401Z","submitted_at":"2025-05-23T14:27:37Z","title":"Beyond Distillation: Pushing the Limits of Medical LLM Reasoning with Minimalist Rule-Based RL","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T14:41:38.908872Z"},"links":{"citing_paper":"/paper/2505.17952"},"observation_digest":"sha256:a371b9d5b37932c4fa915f6039dc253e9e57a87426de898c6884d3178b3c5be9","observation_id":"a95fa484-fc52-4f60-b28f-9f93522260ab","resolution":{"observed_at":"2026-08-07T14:41:41.710949Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.14779","last_updated":"2024-04-23T06:36:21Z","snapshot_observed_at":"2026-08-09T07:41:35.460122Z","submitted_at":"2024-04-23T06:36:21Z","title":"Med42 -- Evaluating Fine-Tuning Strategies for Medical LLMs: Full-Parameter vs. Parameter-Efficient Approaches","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.14779","snapshot_observed_at":"2026-08-07T14:41:39.026377Z","title":"Med42–evaluating fine-tuning strategies for medical llms: Full-parameter vs. parameter-efficient approaches,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17952","last_updated":"2025-05-23T14:27:37Z","snapshot_observed_at":"2026-08-07T20:38:28.943401Z","submitted_at":"2025-05-23T14:27:37Z","title":"Beyond Distillation: Pushing the Limits of Medical LLM Reasoning with Minimalist Rule-Based RL","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T14:41:39.026377Z"},"links":{"cited_paper":"/paper/2404.14779","citing_paper":"/paper/2505.17952"},"observation_digest":"sha256:c9db1ea598816846577d5af367c0780cfdac078016d7638e6e6cd79b16456d51","observation_id":"fee30329-026f-44a0-8b51-306c9d1155a5","resolution":{"observed_at":"2026-08-07T14:41:39.026377Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:41:39.162856Z","title":"What disease does this patient have? a large-scale open domain question answering dataset from medical exams,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.17952","last_updated":"2025-05-23T14:27:37Z","snapshot_observed_at":"2026-08-07T20:38:28.943401Z","submitted_at":"2025-05-23T14:27:37Z","title":"Beyond Distillation: Pushing the Limits of Medical LLM Reasoning with Minimalist Rule-Based RL","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T14:41:39.162856Z"},"links":{"citing_paper":"/paper/2505.17952"},"observation_digest":"sha256:2f1c763c13565fe84557e6023de5326305da84d4ea9a886c217278a090437726","observation_id":"b77641c6-aac8-485d-908b-4405227b7c09","resolution":{"observed_at":"2026-08-07T14:41:39.162856Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:41:41.438462Z","title":"Medmcqa: A large-scale multi-subject multi-choice dataset for medical domain question answering,","venue":null,"work_id":"0a8a1f21-1350-4edc-be57-6058dfa235cf","year":2022},"citing_paper":{"arxiv_id":"2505.17952","last_updated":"2025-05-23T14:27:37Z","snapshot_observed_at":"2026-08-07T20:38:28.943401Z","submitted_at":"2025-05-23T14:27:37Z","title":"Beyond Distillation: Pushing the Limits of Medical LLM Reasoning with Minimalist Rule-Based RL","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T14:41:39.278178Z"},"links":{"citing_paper":"/paper/2505.17952"},"observation_digest":"sha256:c22a4fc15ac35b940a0fbd01de07500d00ca816f66074cb531188b11e0b52c0d","observation_id":"d4c9f1c4-fb21-43f8-a5c9-812ee0279875","resolution":{"observed_at":"2026-08-07T14:41:41.514776Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-07T14:41:39.409211Z","title":"The llama 3 herd of models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17952","last_updated":"2025-05-23T14:27:37Z","snapshot_observed_at":"2026-08-07T20:38:28.943401Z","submitted_at":"2025-05-23T14:27:37Z","title":"Beyond Distillation: Pushing the Limits of Medical LLM Reasoning with Minimalist Rule-Based RL","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T14:41:39.409211Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2505.17952"},"observation_digest":"sha256:48e7048004d6f56869f374a49d9246e541fde9986a7ccbc3b856e6fd891968e4","observation_id":"e1c5258e-34e5-48bf-8a75-e9254d4a3c30","resolution":{"observed_at":"2026-08-07T14:41:39.409211Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18925","last_updated":"2024-12-25T15:12:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-25T15:12:34Z","title":"HuatuoGPT-o1, Towards Medical Complex Reasoning with LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.18925","snapshot_observed_at":"2026-08-07T14:41:39.559067Z","title":"Huatuogpt-o1, towards medical complex reasoning with llms,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17952","last_updated":"2025-05-23T14:27:37Z","snapshot_observed_at":"2026-08-07T20:38:28.943401Z","submitted_at":"2025-05-23T14:27:37Z","title":"Beyond Distillation: Pushing the Limits of Medical LLM Reasoning with Minimalist Rule-Based RL","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T14:41:39.559067Z"},"links":{"cited_paper":"/paper/2412.18925","citing_paper":"/paper/2505.17952"},"observation_digest":"sha256:b7a723cc4e900fb2c0b5b9275c6df66b91deb59010398a50821b34db4bd0b98d","observation_id":"a0c4a48a-0fd9-4268-b15c-a59d446e6bc3","resolution":{"observed_at":"2026-08-07T14:41:39.559067Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-07T14:41:39.677799Z","title":"Gpt-4o system card,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17952","last_updated":"2025-05-23T14:27:37Z","snapshot_observed_at":"2026-08-07T20:38:28.943401Z","submitted_at":"2025-05-23T14:27:37Z","title":"Beyond Distillation: Pushing the Limits of Medical LLM Reasoning with Minimalist Rule-Based RL","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T14:41:39.677799Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2505.17952"},"observation_digest":"sha256:599f8041ccc952c83e9bb50bfb27f0b6af8306f8085aaff235aa160e6c0f36f9","observation_id":"c9a988c5-1a8d-48cb-b5e2-854e6aa9078f","resolution":{"observed_at":"2026-08-07T14:41:39.677799Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:41:41.261763Z","title":"Qwq: Reflect deeply on the boundaries of the unknown,","venue":null,"work_id":"19a13b81-86a1-44fb-b6ca-3373eccbc2bc","year":2024},"citing_paper":{"arxiv_id":"2505.17952","last_updated":"2025-05-23T14:27:37Z","snapshot_observed_at":"2026-08-07T20:38:28.943401Z","submitted_at":"2025-05-23T14:27:37Z","title":"Beyond Distillation: Pushing the Limits of Medical LLM Reasoning with Minimalist Rule-Based RL","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T14:41:39.815897Z"},"links":{"citing_paper":"/paper/2505.17952"},"observation_digest":"sha256:341ae38359e88ce75beb39958e881863a6caf4ae452c60320f5dd27f62025888","observation_id":"9c02b31f-638b-4072-b27f-f4f295cdc9f6","resolution":{"observed_at":"2026-08-07T14:41:41.352436Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:41:41.064743Z","title":"The claude 3 model family: Opus, sonnet, haiku,","venue":null,"work_id":"12ba7738-bead-467e-930c-3cc4013de6e2","year":2024},"citing_paper":{"arxiv_id":"2505.17952","last_updated":"2025-05-23T14:27:37Z","snapshot_observed_at":"2026-08-07T20:38:28.943401Z","submitted_at":"2025-05-23T14:27:37Z","title":"Beyond Distillation: Pushing the Limits of Medical LLM Reasoning with Minimalist Rule-Based RL","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T14:41:39.930681Z"},"links":{"citing_paper":"/paper/2505.17952"},"observation_digest":"sha256:289e4869564d525ead0da1987eb0429339c9dce7cae726f7beb3f0fb6f2d4361","observation_id":"4906fd2b-fb4d-478b-a2fc-d306805a407f","resolution":{"observed_at":"2026-08-07T14:41:41.155809Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-08-07T14:41:40.068205Z","title":"Deepseek- v3 technical report,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17952","last_updated":"2025-05-23T14:27:37Z","snapshot_observed_at":"2026-08-07T20:38:28.943401Z","submitted_at":"2025-05-23T14:27:37Z","title":"Beyond Distillation: Pushing the Limits of Medical LLM Reasoning with Minimalist Rule-Based RL","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T14:41:40.068205Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2505.17952"},"observation_digest":"sha256:84dac77a41d41ed69610336b1ce6c4e1d3c8f417ace7915f05c284a34b4d4886","observation_id":"85eec960-6abc-4426-84d3-6e39bbd053cb","resolution":{"observed_at":"2026-08-07T14:41:40.068205Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12022","last_updated":"2023-11-20T18:57:34Z","snapshot_observed_at":"2026-08-04T22:55:15.345443Z","submitted_at":"2023-11-20T18:57:34Z","title":"GPQA: A Graduate-Level Google-Proof Q&A Benchmark","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.12022","snapshot_observed_at":"2026-08-07T14:41:40.218826Z","title":"Gpqa: A graduate-level google-proof q&a benchmark,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17952","last_updated":"2025-05-23T14:27:37Z","snapshot_observed_at":"2026-08-07T20:38:28.943401Z","submitted_at":"2025-05-23T14:27:37Z","title":"Beyond Distillation: Pushing the Limits of Medical LLM Reasoning with Minimalist Rule-Based RL","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T14:41:40.218826Z"},"links":{"cited_paper":"/paper/2311.12022","citing_paper":"/paper/2505.17952"},"observation_digest":"sha256:622cca6e1e0dde977f3b3eac5e718986b2c04ab9892acc622ac7837c699c5ade","observation_id":"f0042886-c4f9-4cf6-a277-04c03afbcfbe","resolution":{"observed_at":"2026-08-07T14:41:40.218826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:41:40.871579Z","title":"Qwen2.5: A party of foundation models,","venue":null,"work_id":"11ab930b-27bb-4800-bf3c-e5846f2da555","year":2024},"citing_paper":{"arxiv_id":"2505.17952","last_updated":"2025-05-23T14:27:37Z","snapshot_observed_at":"2026-08-07T20:38:28.943401Z","submitted_at":"2025-05-23T14:27:37Z","title":"Beyond Distillation: Pushing the Limits of Medical LLM Reasoning with Minimalist Rule-Based RL","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T14:41:40.334058Z"},"links":{"citing_paper":"/paper/2505.17952"},"observation_digest":"sha256:6452eab4adfc2496972b5ac62eff29ad988ac6a3926c908e9ab9bb820469c85d","observation_id":"08e58909-ad10-49a8-9531-4114269efcd3","resolution":{"observed_at":"2026-08-07T14:41:40.962287Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.17952","last_updated":"2025-05-23T14:27:37Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T20:38:28.943401Z","submitted_at":"2025-05-23T14:27:37Z","title":"Beyond Distillation: Pushing the Limits of Medical LLM Reasoning with Minimalist Rule-Based RL"},"reference_resolution":{"displayed":50,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":35,"verified_exact":0,"verified_fuzzy":15},"total_outbound_references":50},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 50 of 50 outbound references and 10 inbound Pith citation observations for arXiv:2505.17952."}