{"as_of":"2026-08-07T22:16:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:80aa22c39cb62b1671fbb14bfb4845ec2f2dae2aae32d4451a019fbe9bdd1e1d","coverage":[{"denominator":81,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":81,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:40:16.167357Z","state":"measured"},{"denominator":84,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":84,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T16:42:34.643403Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-07T20:32:59.705021Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.24105","snapshot_observed_at":"2026-08-06T16:42:34.643403Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.12774","last_updated":"2025-07-17T04:31:55Z","snapshot_observed_at":"2026-08-07T20:34:11.711273Z","submitted_at":"2025-07-17T04:31:55Z","title":"A Comprehensive Survey of Electronic Health Record Modeling: From Deep Learning Approaches to Large Language Models","version":1},"reference_index":170,"source":"pdf_text","source_observed_at":"2026-08-06T16:42:34.643403Z"},"links":{"cited_paper":"/paper/2505.24105","citing_paper":"/paper/2507.12774"},"observation_digest":"sha256:0cc2de5626049cfdc6d42a84b074ee2a0f9d567cd47d7957ad29db5274604479","observation_id":"7e1fa655-5f32-4f99-853b-347455265ae0","resolution":{"observed_at":"2026-08-06T16:42:34.643403Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-07T20:32:59.705021Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2505.24105","doi":"10.48550/arxiv.2505.24105","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.24105","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Rein- forcement Learning","venue":"ArXiv.org","work_id":"c05f77c9-9852-4855-913c-00bd25ede69c","year":2025},"citing_paper":{"arxiv_id":"2512.19691","last_updated":"2026-04-13T08:00:46Z","snapshot_observed_at":"2026-07-31T18:31:36.321575Z","submitted_at":"2025-12-22T18:59:34Z","title":"Scalable Stewardship of an LLM-Assisted Clinical Benchmark with Physician Oversight","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-16T20:21:40.867354Z"},"links":{"cited_paper":"/paper/2505.24105","citing_paper":"/paper/2512.19691"},"observation_digest":"sha256:85b7e01aeffd5b42d5dd5eac8df8d1e646fd7ef557756372f48925b625d0062c","observation_id":"415c1475-4b7f-4c82-8317-a9fc9300d54b","resolution":{"observed_at":"2026-05-16T20:23:23.350397Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-07T20:32:59.705021Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2505.24105","doi":"10.48550/arxiv.2505.24105","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.24105","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Rein- forcement Learning","venue":"ArXiv.org","work_id":"c05f77c9-9852-4855-913c-00bd25ede69c","year":2025},"citing_paper":{"arxiv_id":"2603.23964","last_updated":"2026-04-13T08:15:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-03-25T05:56:54Z","title":"From Pixels to Digital Agents: An Empirical Study on the Taxonomy and Technological Trends of Reinforcement Learning Environments","version":2},"reference_index":183,"source":"pdf_text","source_observed_at":"2026-05-15T01:20:03.181903Z"},"links":{"cited_paper":"/paper/2505.24105","citing_paper":"/paper/2603.23964"},"observation_digest":"sha256:31ecb9a9fadd6f96ee850dac2cea79709ca8a374d642c9c3a140b6c940a09f0d","observation_id":"336f4c34-8c09-48f6-abde-99a5db98e613","resolution":{"observed_at":"2026-05-15T01:23:27.263072Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.24105/citation-record","integrity":"/paper/2505.24105/integrity","json":"/paper/2505.24105/citation-record.json","paper":"/paper/2505.24105"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-07T12:40:05.748193Z","title":"Gpt-4 technical report.arXiv preprint arXiv:2303.08774, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-07T20:32:59.705021Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:05.748193Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:576e7ba037ac0fb27aa6cb380506f5204f2d594c3cba299687ffa8aebc917330","observation_id":"88cd335b-b05b-4e69-9ea7-8938a1be17fd","resolution":{"observed_at":"2026-08-07T12:40:05.748193Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:40:05.836155Z","title":"Claude 3 haiku: our fastest model yet, March 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-07T20:32:59.705021Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:05.836155Z"},"links":{"citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:fa61d186ec2f37fd57d1c5e4f59ce4a4eabebde3f73e425d207218328af6b65b","observation_id":"d031cc18-80a3-4363-b2aa-beb9f1a67af2","resolution":{"observed_at":"2026-08-07T12:40:05.836155Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:40:24.422437Z","title":"Claude 3.5 sonnet, June 2024","venue":null,"work_id":"cd0ddfcb-3bde-49ca-be3f-df90bcaf0abe","year":2024},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-07T20:32:59.705021Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:05.989525Z"},"links":{"citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:1092f7d49b9fe3c82abf347a4cf4299f4ce6aae371e8d95a322337073a898436","observation_id":"ccb64938-c2e3-4146-adf7-1470961a05ba","resolution":{"observed_at":"2026-08-07T12:40:24.573185Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:40:06.100300Z","title":"Training a helpful and harmless assistant with reinforcement learning from human feedback, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-07T20:32:59.705021Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:06.100300Z"},"links":{"citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:8c709f35a621f1a94d5f4ce7ff9f8af36266a7b45a7c9384150859873ec0bdbc","observation_id":"25a76a8d-bac8-4dba-8c89-500edc05a857","resolution":{"observed_at":"2026-08-07T12:40:06.100300Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:40:06.195545Z","title":"Rm-r1: Reward modeling as reasoning.arXiv preprint arXiv:2505.02387, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-07T20:32:59.705021Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:06.195545Z"},"links":{"citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:ab895ff3e7c361e7fe42fdd52e34d16d95cffc74474d5303313ee1bfc9dbc390","observation_id":"ccf6234e-e6e1-4535-84c1-6581ca90850e","resolution":{"observed_at":"2026-08-07T12:40:06.195545Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.04176","last_updated":"2025-03-06T07:44:17Z","snapshot_observed_at":"2026-08-07T17:25:37.281002Z","submitted_at":"2025-03-06T07:44:17Z","title":"TIMER: Temporal Instruction Modeling and Evaluation for Longitudinal Clinical Records","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.04176","snapshot_observed_at":"2026-08-07T12:40:06.323564Z","title":"Timer: Temporal instruction modeling and evaluation for longitudinal clinical records.arXiv preprint arXiv:2503.04176, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-07T20:32:59.705021Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:06.323564Z"},"links":{"cited_paper":"/paper/2503.04176","citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:a89499cee8278deb41aa3a9bf25efb76e16f4131160e368ac7a3d0370356cdc1","observation_id":"650e90de-3aa1-40ab-93d0-bd5cfd21236a","resolution":{"observed_at":"2026-08-07T12:40:06.323564Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:40:24.056406Z","title":"A new paradigm for accelerating clinical data science at stanford medicine, 2020","venue":null,"work_id":"b327c7fd-67b6-4ee6-9e7a-7b99cfce30a7","year":2020},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-07T20:32:59.705021Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:06.481447Z"},"links":{"citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:20a270bcf6906ed64f07e21328aed550fbd6e6da61255443cf126fd44ce9f011","observation_id":"6e6a513b-0f05-4bc0-8d0e-4c93033ec4d1","resolution":{"observed_at":"2026-08-07T12:40:24.207489Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:40:06.646162Z","title":"Electronic health records: then, now, and in the future.Yearbook of medical informatics, 25(S 01):S48–S61, 2016","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-07T20:32:59.705021Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:06.646162Z"},"links":{"citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:28f1bafabf62719112216e55aaf1c6488589128d975070fad4438337a9271544","observation_id":"326ae02a-724f-4313-8763-1e01c822d791","resolution":{"observed_at":"2026-08-07T12:40:06.646162Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:40:23.777990Z","title":"Fleming, Alejandro Lozano, William J","venue":null,"work_id":"eb9af2a6-8b03-4019-9704-e21efc69cb0b","year":2023},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-07T20:32:59.705021Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:06.758263Z"},"links":{"citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:188d2102fab795a5dd93cdb3e3b7622284ccdff9c9241138a366089ad2f1673e","observation_id":"20d7d28e-5b28-48fa-a794-14c19f6efdd7","resolution":{"observed_at":"2026-08-07T12:40:23.908708Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:40:23.499029Z","title":"Metrics for multi-class classification: An overview.stat, 1050:13, 2020","venue":null,"work_id":"e7dfcabb-fa5c-4c1d-9ac9-1f3b8f28ddf7","year":2020},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-07T20:32:59.705021Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:06.880668Z"},"links":{"citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:0f466a5a924082d94812765099cbcabd6680b846c45c3d31ee968b2f57fc5749","observation_id":"c33a26b2-608e-4b8e-b165-9dbfb4c71594","resolution":{"observed_at":"2026-08-07T12:40:23.653417Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-07T12:40:07.001760Z","title":"The llama 3 herd of models.arXiv preprint arXiv:2407.21783, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-07T20:32:59.705021Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:07.001760Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:ed8196c3d427253360f7940542a66b5e9ff20212fc0e4172b0afef496e9c274c","observation_id":"f6f7d809-fa99-4a90-8eff-08d7f966d1db","resolution":{"observed_at":"2026-08-07T12:40:07.001760Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-07T12:40:07.140634Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning.arXiv preprint arXiv:2501.12948, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-07T20:32:59.705021Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:07.140634Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:7e19d1ce7a99ada929f0011d299d8fd097e559eeea81622c1aa3e41a94c8fb70","observation_id":"8e34339c-d7bc-46cd-a13f-f39629154c2d","resolution":{"observed_at":"2026-08-07T12:40:07.140634Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:40:23.315844Z","title":"Kale, Greg Ver Steeg, and Aram Galstyan","venue":null,"work_id":"5fe1c2c3-6fe4-4d35-b8ee-5318be5f744e","year":2019},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-07T20:32:59.705021Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:07.316228Z"},"links":{"citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:2ec46a2cc91a7a798bc1bd3c3eb85b33d081f0f8ab5f565ead687ec3dc3a2624","observation_id":"0c5e5c1d-46c5-4dd2-8e9d-b21bbf86b506","resolution":{"observed_at":"2026-08-07T12:40:23.408150Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.19898","last_updated":"2025-04-28T15:30:58Z","snapshot_observed_at":"2026-08-07T15:58:33.955467Z","submitted_at":"2025-04-28T15:30:58Z","title":"GenCLS++: Pushing the Boundaries of Generative Classification in LLMs Through Comprehensive SFT and RL Studies Across Diverse Datasets","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.19898","snapshot_observed_at":"2026-08-07T12:40:07.437399Z","title":"Gencls++: Pushing the boundaries of generative classification in llms through comprehensive sft and rl studies across diverse datasets.arXiv preprint arXiv:2504.19898, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-07T20:32:59.705021Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:07.437399Z"},"links":{"cited_paper":"/paper/2504.19898","citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:665e182411d6561287d014191dd08cafbf55680d1a964a9ea49d37d702c8cac5","observation_id":"f99164e9-49d7-417a-800b-205e0852b455","resolution":{"observed_at":"2026-08-07T12:40:07.437399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:40:23.155428Z","title":"Measuring massive multitask language understanding, 2021","venue":null,"work_id":"4d03edce-2a36-42f6-80f6-0628a6df0be2","year":2021},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-07T20:32:59.705021Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:07.577410Z"},"links":{"citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:ef575ed3b0230fa5d651d5a1ff5c7d405c860c259cb10c91129fc58afc644b52","observation_id":"856cf426-b842-4c7a-9ba6-3811d2568764","resolution":{"observed_at":"2026-08-07T12:40:23.231577Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.00223","last_updated":"2025-04-12T03:17:26Z","snapshot_observed_at":"2026-08-07T17:38:11.374070Z","submitted_at":"2025-02-28T22:16:42Z","title":"DeepRetrieval: Hacking Real Search Engines and Retrievers with Large Language Models via Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.00223","snapshot_observed_at":"2026-08-07T12:40:07.713578Z","title":"Deepretrieval: Hacking real search engines and retrievers with large language models via reinforcement learning.arXiv preprint arXiv:2503.00223, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-07T20:32:59.705021Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:07.713578Z"},"links":{"cited_paper":"/paper/2503.00223","citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:e7f486f36ddcf4f9352271e365b95e9ef8750043c185c4b53072e445a9af5777","observation_id":"1ad0381e-b8c5-4f9d-a42d-14fa07e5d01c","resolution":{"observed_at":"2026-08-07T12:40:07.713578Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.04585","last_updated":"2025-04-20T05:49:38Z","snapshot_observed_at":"2026-07-06T19:28:43.743447Z","submitted_at":"2024-10-06T18:46:28Z","title":"Reasoning-Enhanced Healthcare Predictions with Knowledge Graph Community Retrieval","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.04585","snapshot_observed_at":"2026-08-07T12:40:07.860220Z","title":"Reasoning-enhanced healthcare predictions with knowledge graph community retrieval.arXiv preprint arXiv:2410.04585, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-07T20:32:59.705021Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:07.860220Z"},"links":{"cited_paper":"/paper/2410.04585","citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:8f3a1dc7e1ff5ecc67f05ea595d898f46bca088cd4248843286250e7735891c7","observation_id":"daf9734b-6cb2-4714-a051-00d83dff8885","resolution":{"observed_at":"2026-08-07T12:40:07.860220Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09516","last_updated":"2025-08-05T19:08:38Z","snapshot_observed_at":"2026-07-06T20:51:28.022519Z","submitted_at":"2025-03-12T16:26:39Z","title":"Search-R1: Training LLMs to Reason and Leverage Search Engines with Reinforcement Learning","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.09516","snapshot_observed_at":"2026-08-07T12:40:07.992856Z","title":"Search-r1: Training llms to reason and leverage search engines with reinforcement learning.arXiv preprint arXiv:2503.09516, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-07T20:32:59.705021Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:07.992856Z"},"links":{"cited_paper":"/paper/2503.09516","citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:f568e4c0104d9ba3a19b557c4736d13115880e939f9ad5d4255c5f6aaccb81db","observation_id":"25ccaad0-916f-4dae-bbdd-6ece313ae861","resolution":{"observed_at":"2026-08-07T12:40:07.992856Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.13081","last_updated":"2020-09-28T05:07:51Z","snapshot_observed_at":"2026-08-06T03:17:52.286711Z","submitted_at":"2020-09-28T05:07:51Z","title":"What Disease does this Patient Have? A Large-scale Open Domain Question Answering Dataset from Medical Exams","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.13081","snapshot_observed_at":"2026-08-07T12:40:08.110832Z","title":"What disease does this patient have? a large-scale open domain question answering dataset from medical exams.arXiv preprint arXiv:2009.13081, 2020","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-07T20:32:59.705021Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:08.110832Z"},"links":{"cited_paper":"/paper/2009.13081","citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:1f0e9ee4b60311a3d7233471842fad0511f92aa510dfe48403c81da07bda2362","observation_id":"7181a258-ea6a-4c20-bbf8-aacec9d18513","resolution":{"observed_at":"2026-08-07T12:40:08.110832Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:40:08.270915Z","title":"Medcalc-bench: Evaluating large language models for medical calculations.Advances in Neural Information Processing Systems, 37:84730–84745, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-07T20:32:59.705021Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:08.270915Z"},"links":{"citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:7523ff29806b4dd67aa9b74705cc08334e39f141328a34f3871b90d2b7de186e","observation_id":"81e95fa0-d63a-404d-b55a-74dc0d2175e0","resolution":{"observed_at":"2026-08-07T12:40:08.270915Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.02722","last_updated":"2026-07-20T05:28:15Z","snapshot_observed_at":"2026-08-07T15:56:20.183169Z","submitted_at":"2025-05-05T15:23:47Z","title":"Enhancing LLMs' Clinical Reasoning with Real-World Data from a Nationwide Sepsis Registry","version":2},"cited_work":{"arxiv_id":"2505.02722","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.02722","snapshot_observed_at":"2026-08-07T12:40:16.696367Z","title":"Enhancing LLMs' Clinical Reasoning with Real-World Data from a Nationwide Sepsis Registry","venue":"cs.AI","work_id":"9cb1ae78-e027-4186-a3e3-e533daa06849","year":2025},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-07T20:32:59.705021Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:08.444451Z"},"links":{"cited_paper":"/paper/2505.02722","citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:a89181e395a79cb6d4dc04cf17e84ac8db57dc5a0f788789c79781d3967bf09a","observation_id":"601f646c-4f78-4781-8a0d-ba13c52e6856","resolution":{"observed_at":"2026-08-07T12:40:16.829938Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:40:08.591865Z","title":"Med-r1: Reinforce- ment learning for generalizable medical reasoning in vision-language models.arXiv preprint arXiv:2503.13939, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-07T20:32:59.705021Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:08.591865Z"},"links":{"citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:c67d886ca65ebdfb94a3d0326251bc17156846282966321bdd5e9466e5294172","observation_id":"6afc9b05-c40c-40cf-896b-767efb14c6d5","resolution":{"observed_at":"2026-08-07T12:40:08.591865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.09421","last_updated":"2025-04-15T07:52:40Z","snapshot_observed_at":"2026-08-07T16:06:13.556152Z","submitted_at":"2025-04-13T04:00:40Z","title":"ClinicalGPT-R1: Pushing reasoning capability of generalist disease diagnosis with large language model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.09421","snapshot_observed_at":"2026-08-07T12:40:08.713290Z","title":"Clinicalgpt-r1: Pushing reasoning capability of generalist disease diagnosis with large language model.arXiv preprint arXiv:2504.09421, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-07T20:32:59.705021Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:08.713290Z"},"links":{"cited_paper":"/paper/2504.09421","citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:a2820928201f2c55c1f63322775b39b20f0066014f59029ee2e261cd7f576bb8","observation_id":"4e93ba54-3132-4bc9-b709-d718fdab05db","resolution":{"observed_at":"2026-08-07T12:40:08.713290Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:40:08.886612Z","title":"Rlaif vs","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-07T20:32:59.705021Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:08.886612Z"},"links":{"citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:e465d992c780d590f114367a281059bd42955b6ab484a7dff7d084c82fe012ba","observation_id":"2fa7090f-a704-4064-b023-1af0552eff29","resolution":{"observed_at":"2026-08-07T12:40:08.886612Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.03066","last_updated":"2024-05-22T16:57:56Z","snapshot_observed_at":"2026-08-07T20:30:35.208804Z","submitted_at":"2024-05-05T22:21:15Z","title":"A scoping review of using Large Language Models (LLMs) to investigate Electronic Health Records (EHRs)","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.03066","snapshot_observed_at":"2026-08-07T12:40:09.003800Z","title":"A scoping review of using large language models (llms) to investigate electronic health records (ehrs).arXiv preprint arXiv:2405.03066, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-07T20:32:59.705021Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:09.003800Z"},"links":{"cited_paper":"/paper/2405.03066","citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:24110f51a57c8394f455610e23d5e8bd4f2882aa77b404c117f9fb8cd22f3d42","observation_id":"2975b656-7471-4252-88d4-89164de1da41","resolution":{"observed_at":"2026-08-07T12:40:09.003800Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:40:09.163179Z","title":"Cls-rl: Image classifica- tion with rule-based reinforcement learning.arXiv preprint arXiv:2503.16188, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-07T20:32:59.705021Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:09.163179Z"},"links":{"citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:2677ea980221bd3d23dcaf6f47bf16ecf3a9b5c40fed7ee15c19761add1ab9d3","observation_id":"94c35891-3a53-4a1c-a2bf-6535222ead76","resolution":{"observed_at":"2026-08-07T12:40:09.163179Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:40:09.294209Z","title":"Rec-r1: Bridging generative large language mod- els and user-centric recommendation systems via reinforcement learning.arXiv preprint arXiv:2503.24289, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-07T20:32:59.705021Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:09.294209Z"},"links":{"citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:52477501701dc1598dfac321607dbca655c8580e1d4f76454d1c7be60b557ab4","observation_id":"441e5fc8-9d7d-4e00-a28d-9e403f6397ce","resolution":{"observed_at":"2026-08-07T12:40:09.294209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:40:22.858733Z","title":"Panacea: A foundation model for clinical trial search, summarization, design, and recruitment.medRxiv, pages 2024–06, 2024","venue":null,"work_id":"df97d655-1ef9-4638-96fd-abc74b037fd4","year":2024},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-07T20:32:59.705021Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:09.445067Z"},"links":{"citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:d68d58b390de9e18f82031b99a0eb42dbf3ea7a6f4fd42c245c37d0db5333993","observation_id":"df6f4c4f-8547-405f-9a7c-128c6944d21e","resolution":{"observed_at":"2026-08-07T12:40:23.004693Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:40:22.622106Z","title":"Pisces: A cross-modal contrastive learning approach to synergistic drug combination prediction","venue":null,"work_id":"950938e3-1bd5-4a54-b771-0fe79441d7cb","year":2023},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-07T20:32:59.705021Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:09.593187Z"},"links":{"citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:9c048087102d6f8eeb27c690f73adfa51157c40852e33d2d47c88ad7a3e38d73","observation_id":"bf925afc-28e4-41b7-8cb3-7827c2d4e9dc","resolution":{"observed_at":"2026-08-07T12:40:22.734561Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.08967","last_updated":"2024-12-13T04:44:11Z","snapshot_observed_at":"2026-08-05T08:09:01.340423Z","submitted_at":"2024-01-17T04:43:21Z","title":"ReFT: Reasoning with Reinforced Fine-Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.08967","snapshot_observed_at":"2026-08-07T12:40:09.774303Z","title":"Reft: Reasoning with reinforced fine-tuning.arXiv preprint arXiv:2401.08967, 3, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-07T20:32:59.705021Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:09.774303Z"},"links":{"cited_paper":"/paper/2401.08967","citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:b19064213cae4757260ad6aba930df1a624bfe3f0ecc16f8bdd524fce0a110fc","observation_id":"77f82f1d-90bb-424d-ad69-2b7662b4c4cf","resolution":{"observed_at":"2026-08-07T12:40:09.774303Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06781","last_updated":"2025-02-10T18:57:29Z","snapshot_observed_at":"2026-07-06T20:34:11.407726Z","submitted_at":"2025-02-10T18:57:29Z","title":"Exploring the Limit of Outcome Reward for Learning Mathematical Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.06781","snapshot_observed_at":"2026-08-07T12:40:09.933663Z","title":"Exploring the limit of outcome reward for learning mathematical reasoning.arXiv preprint arXiv:2502.06781, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-07T20:32:59.705021Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:09.933663Z"},"links":{"cited_paper":"/paper/2502.06781","citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:9fdfeed32b6361e36a1bc6291d7e89506d933d325291a14c97d905bd9367baed","observation_id":"747e0839-1ec3-49c4-b4f8-1e95d895c7b6","resolution":{"observed_at":"2026-08-07T12:40:09.933663Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.07365","last_updated":"2025-04-15T14:22:45Z","snapshot_observed_at":"2026-07-06T20:49:56.018809Z","submitted_at":"2025-03-10T14:23:12Z","title":"MM-Eureka: Exploring the Frontiers of Multimodal Reasoning with Rule-based Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.07365","snapshot_observed_at":"2026-08-07T12:40:10.057892Z","title":"Mm-eureka: Exploring the frontiers of multimodal reasoning with rule-based reinforcement learning.arXiv preprint arXiv:2503.07365, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-07T20:32:59.705021Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:10.057892Z"},"links":{"cited_paper":"/paper/2503.07365","citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:8dff00cd9256220e1e653a973a04274f8e89ceba1cef3daec81682a024eb0470","observation_id":"05492bca-953b-45f2-ba62-608ce5783f72","resolution":{"observed_at":"2026-08-07T12:40:10.057892Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:40:22.450037Z","title":"Can generalist foundation models outcompete special-purpose tuning? case study in medicine.Medicine, 84(88.3):77–3, 2023","venue":null,"work_id":"77aeeece-2dda-4317-a5ed-879c0d899c62","year":2023},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-07T20:32:59.705021Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:10.157196Z"},"links":{"citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:ba06ec44974488e5b1b6f67e1682ef3271cff00575597c102dd2032f831b3466","observation_id":"15441b47-519d-44f8-b74b-2f1a43c0cf99","resolution":{"observed_at":"2026-08-07T12:40:22.511312Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:40:22.319652Z","title":"Openai o3-mini","venue":null,"work_id":"ab6a020e-5af1-467f-92de-73f8f9ae087b","year":2025},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-07T20:32:59.705021Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:10.270598Z"},"links":{"citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:e478e268f7e2bd30f2f9afd877d511213f22f4ad649d99f22fb77dc37b4fde5b","observation_id":"d30ad90a-484b-4757-8c9b-68502463b61d","resolution":{"observed_at":"2026-08-07T12:40:22.359460Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:40:10.395468Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-07T20:32:59.705021Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:10.395468Z"},"links":{"citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:7e35412f8d36f4231beea1434fc4c8ca9d9d159670c9b0ca1daa9a181dfc6ed5","observation_id":"4cb3e704-503c-471f-aa35-5a853328c76e","resolution":{"observed_at":"2026-08-07T12:40:10.395468Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:40:10.512776Z","title":"Training language models to follow instructions with human feedback.Advances in neural information processing systems, 35:27730–27744, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-07T20:32:59.705021Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:10.512776Z"},"links":{"citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:50a4aacecc19fde65b8d776d9ce175cbb5c9241c86d50dc1242a1b6f69956374","observation_id":"f1baf4f4-88fa-417e-9e9b-0245d92c04ff","resolution":{"observed_at":"2026-08-07T12:40:10.512776Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:40:10.620491Z","title":"Medmcqa: A large-scale multi-subject multi-choice dataset for medical domain question answering","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-07T20:32:59.705021Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:10.620491Z"},"links":{"citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:af741e3f428d59f32aebe746269349d0a906f35c173d40193f6cbafa87359956","observation_id":"e539073f-d59f-4e20-8372-62e44b4d1d5b","resolution":{"observed_at":"2026-08-07T12:40:10.620491Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.19634","last_updated":"2025-03-19T13:55:33Z","snapshot_observed_at":"2026-08-07T20:37:56.716831Z","submitted_at":"2025-02-26T23:57:34Z","title":"MedVLM-R1: Incentivizing Medical Reasoning Capability of Vision-Language Models (VLMs) via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.19634","snapshot_observed_at":"2026-08-07T12:40:10.729078Z","title":"Medvlm-r1: Incentivizing medical reasoning capability of vision-language models (vlms) via reinforcement learning.arXiv preprint arXiv:2502.19634, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-07T20:32:59.705021Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:10.729078Z"},"links":{"cited_paper":"/paper/2502.19634","citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:16deb14502da47ce185cbfa874848ac1ff1c03f20e73ab612f84071b339aa917","observation_id":"ea8fe538-4e8d-4330-8df7-7642bab30f10","resolution":{"observed_at":"2026-08-07T12:40:10.729078Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.07536","last_updated":"2025-03-11T03:32:59Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-10T17:04:14Z","title":"LMM-R1: Empowering 3B LMMs with Strong Reasoning Abilities Through Two-Stage Rule-Based RL","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.07536","snapshot_observed_at":"2026-08-07T12:40:10.817997Z","title":"Lmm-r1: Empowering 3b lmms with strong reasoning abilities through two-stage rule-based rl.arXiv preprint arXiv:2503.07536, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-07T20:32:59.705021Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:10.817997Z"},"links":{"cited_paper":"/paper/2503.07536","citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:40ddef29608518dd58d14051918d155b2063d94a1c91239a121b882350e2e6f6","observation_id":"a5658105-bbc9-4f79-9842-5336daec8d31","resolution":{"observed_at":"2026-08-07T12:40:10.817997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.13950","last_updated":"2025-04-16T09:16:12Z","snapshot_observed_at":"2026-08-07T16:01:53.177099Z","submitted_at":"2025-04-16T09:16:12Z","title":"Open-Medical-R1: How to Choose Data for RLVR Training at Medicine Domain","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.13950","snapshot_observed_at":"2026-08-07T12:40:10.939828Z","title":"Open-medical-r1: How to choose data for rlvr training at medicine domain.arXiv preprint arXiv:2504.13950, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-07T20:32:59.705021Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:10.939828Z"},"links":{"cited_paper":"/paper/2504.13950","citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:06b9af3fcce5a743c314a23682014f838c95f7010d7140e06c60438ac77d5364","observation_id":"a6d1740c-1ff0-4826-a24e-ffe0f51b25dc","resolution":{"observed_at":"2026-08-07T12:40:10.939828Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:40:11.066282Z","title":"Manning, and Chelsea Finn","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-07T20:32:59.705021Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:11.066282Z"},"links":{"citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:3db08cb7380a3b8cb72f33c95afc1aa9902d37b71f587cb7272ee9ff43b460f5","observation_id":"89a6aaa2-52c3-446e-bdf2-aba93ce4177a","resolution":{"observed_at":"2026-08-07T12:40:11.066282Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:40:22.208127Z","title":"Overview of the trec 2021 clinical trials track","venue":null,"work_id":"af813e62-a9b8-4aef-85ca-3885ba275581","year":2021},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-07T20:32:59.705021Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:11.129702Z"},"links":{"citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:6ebf491ef4220523b36e46b681b48f43e16038af1a454a560cf90d7f573a1eaf","observation_id":"41a07926-025e-42f1-ac89-d8f46f86f932","resolution":{"observed_at":"2026-08-07T12:40:22.244817Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-07T12:40:11.264725Z","title":"Proximal policy optimization algorithms.arXiv preprint arXiv:1707.06347, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-07T20:32:59.705021Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:11.264725Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:151460a6d73e9bb836faf2b49555538b45c6c178c50d25fc6adae30b3a0bcd22","observation_id":"ef5a72be-b684-48ee-bdcb-77fea2b15e24","resolution":{"observed_at":"2026-08-07T12:40:11.264725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-07T12:40:11.414091Z","title":"Deepseekmath: Pushing the limits of mathematical reasoning in open language models.arXiv preprint arXiv:2402.03300, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-07T20:32:59.705021Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:11.414091Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:a14b85f22ed048e472db928044378c8848063d7e7f267f0ee73f6b06a87d29e0","observation_id":"696f8fb7-b375-40b8-9f4d-88b6a322a84b","resolution":{"observed_at":"2026-08-07T12:40:11.414091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.19256","last_updated":"2024-10-02T04:01:47Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-28T06:20:03Z","title":"HybridFlow: A Flexible and Efficient RLHF Framework","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.19256","snapshot_observed_at":"2026-08-07T12:40:11.531409Z","title":"Hybridflow: A flexible and efficient rlhf framework.arXiv preprint arXiv: 2409.19256, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-07T20:32:59.705021Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:11.531409Z"},"links":{"cited_paper":"/paper/2409.19256","citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:f8c0dbcd9e3bc7879304ec607af61834ec620933178196eadf7e6fb88458e94d","observation_id":"cdcc5a0b-5908-41c5-bf23-98b54e24d8f8","resolution":{"observed_at":"2026-08-07T12:40:11.531409Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:40:11.665979Z","title":"Large language models encode clinical knowledge.Nature, 620(7972):172–180, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-07T20:32:59.705021Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:11.665979Z"},"links":{"citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:8344494633562a6149f24c56f23924793f0200dcd34bb8260813b7030cae58ec","observation_id":"54a5c2ea-eec3-4fa9-9a1d-cce29d0c827d","resolution":{"observed_at":"2026-08-07T12:40:11.665979Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:40:22.063540Z","title":"Toward expert-level medical question answering with large language models.Nature Medicine, pages 1–8, 2025","venue":null,"work_id":"cbbd7dcc-829a-42c6-b340-d4d223d9f853","year":2025},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-07T20:32:59.705021Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:11.804203Z"},"links":{"citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:31a6a4e4abcec32b63679d1368f4f5965fd3a7d0debfe9a1e6f0c2ed27aa235a","observation_id":"7a7dded0-d419-47c2-9967-0ad3bdb0274f","resolution":{"observed_at":"2026-08-07T12:40:22.139607Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.05592","last_updated":"2025-03-18T08:32:24Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-07T17:14:44Z","title":"R1-Searcher: Incentivizing the Search Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.05592","snapshot_observed_at":"2026-08-07T12:40:11.914141Z","title":"R1-searcher: Incentivizing the search capability in llms via reinforcement learning.arXiv preprint arXiv:2503.05592, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-07T20:32:59.705021Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:11.914141Z"},"links":{"cited_paper":"/paper/2503.05592","citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:ef88b78fa7ee3e07867bd98f9a4a266a56c74a1f1089d101adf6ef72efa222e9","observation_id":"8e4dc3a9-b1cb-43b2-bfe1-a9e3461b421e","resolution":{"observed_at":"2026-08-07T12:40:11.914141Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.01886","last_updated":"2025-04-02T16:43:16Z","snapshot_observed_at":"2026-08-07T16:14:08.516831Z","submitted_at":"2025-04-02T16:43:16Z","title":"GMAI-VL-R1: Harnessing Reinforcement Learning for Multimodal Medical Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.01886","snapshot_observed_at":"2026-08-07T12:40:12.027646Z","title":"Gmai-vl-r1: Harnessing reinforcement learning for multimodal medical reasoning.arXiv preprint arXiv:2504.01886, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-07T20:32:59.705021Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:12.027646Z"},"links":{"cited_paper":"/paper/2504.01886","citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:94402c7ad8c9b42ad49c2bc6c4843d06c9b4cf60611b606c701dae869435ce90","observation_id":"cd557f50-9eff-4477-9534-8923451c3e2e","resolution":{"observed_at":"2026-08-07T12:40:12.027646Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.23829","last_updated":"2025-04-01T14:48:02Z","snapshot_observed_at":"2026-08-07T21:53:39.516862Z","submitted_at":"2025-03-31T08:22:49Z","title":"Crossing the Reward Bridge: Expanding RL with Verifiable Rewards Across Diverse Domains","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.23829","snapshot_observed_at":"2026-08-07T12:40:12.121976Z","title":"Expanding rl with verifiable rewards across diverse domains.arXiv preprint arXiv:2503.23829, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-07T20:32:59.705021Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:12.121976Z"},"links":{"cited_paper":"/paper/2503.23829","citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:2626cd79ba527352cb6701a179a6c78ebeb58d18304c3c6683cce3cd1244dbe7","observation_id":"645593a1-35a9-47e3-9965-95a705d71bbf","resolution":{"observed_at":"2026-08-07T12:40:12.121976Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12599","last_updated":"2025-06-03T02:14:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T02:48:14Z","title":"Kimi k1.5: Scaling Reinforcement Learning with LLMs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12599","snapshot_observed_at":"2026-08-07T12:40:12.244157Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-07T20:32:59.705021Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:12.244157Z"},"links":{"cited_paper":"/paper/2501.12599","citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:de17714d54f9b0854f91258844bdce44acbaf61fe6791b451374a6fa5cb4591d","observation_id":"72ca7834-9d41-4ad0-9926-1b3fb3afe746","resolution":{"observed_at":"2026-08-07T12:40:12.244157Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:40:21.767608Z","title":"Yet another ICU benchmark: A flexible multi-center framework for clinical ML","venue":null,"work_id":"9c1b288f-5bee-4227-a9fb-3fe16253ae3a","year":2024},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-07T20:32:59.705021Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:12.354142Z"},"links":{"citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:2d59ec63468a5b8291616cf6f197f7af857c141dc40f48f816d1c64d5b5a5223","observation_id":"13ca0bb1-7e27-4cd9-a282-2bb9402481cf","resolution":{"observed_at":"2026-08-07T12:40:21.914155Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:40:21.549793Z","title":"Drg-llama: tuning llama model to predict diagnosis-related group for hospitalized patients.npj Digital Medicine, 7(1):16, 2024","venue":null,"work_id":"17ce7f6a-f223-4841-be0e-a7abe6edc24b","year":2024},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-07T20:32:59.705021Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:12.471664Z"},"links":{"citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:d06600d427ed8e3817b6acd21c4f06cc57fd9a73321aa24f9e579ff65da24300","observation_id":"c12f8d70-63dd-4ca7-adbe-2b50f4f32d0b","resolution":{"observed_at":"2026-08-07T12:40:21.641415Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.20571","last_updated":"2025-10-24T10:02:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-29T09:24:30Z","title":"Reinforcement Learning for Reasoning in Large Language Models with One Training Example","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.20571","snapshot_observed_at":"2026-08-07T12:40:12.554505Z","title":"Reinforcement learning for reasoning in large language models with one training example.arXiv preprint arXiv:2504.20571, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-07T20:32:59.705021Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:12.554505Z"},"links":{"cited_paper":"/paper/2504.20571","citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:e6816f22c487f4ad2683dfab8facd3aaf0ca0f6e6d434c03df70345d35cfe156","observation_id":"9a51b7fa-1c5c-49d7-92f2-0c1a3ea56ff4","resolution":{"observed_at":"2026-08-07T12:40:12.554505Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:40:12.648627Z","title":"Ehrshot: An ehr benchmark for few-shot evaluation of foundation models.Advances in Neural Information Processing Systems, 36:67125–67137, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-07T20:32:59.705021Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:12.648627Z"},"links":{"citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:60d94a9dbac98b97cbbe11cccd9e793092c829ddcd803f752f9ef3368ab82994","observation_id":"c1ddffc4-6a31-42d1-9fad-801d8cd29507","resolution":{"observed_at":"2026-08-07T12:40:12.648627Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.12961","last_updated":"2023-03-24T21:50:03Z","snapshot_observed_at":"2026-07-06T15:06:56.845060Z","submitted_at":"2023-03-22T23:54:14Z","title":"The Shaky Foundations of Clinical Foundation Models: A Survey of Large Language Models and Foundation Models for EMRs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.12961","snapshot_observed_at":"2026-08-07T12:40:12.766149Z","title":"The shaky foundations of clinical foundation models: A survey of large language models and foundation models for emrs.arXiv preprint arXiv:2303.12961, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-07T20:32:59.705021Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:12.766149Z"},"links":{"cited_paper":"/paper/2303.12961","citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:68772960050b02b97708bcf4af1b282bc87f36dfed0f8cb3bb6a2f298be2c5d1","observation_id":"a76b5e70-0439-4c0a-aa4e-d73a821e1bfa","resolution":{"observed_at":"2026-08-07T12:40:12.766149Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.09258","last_updated":"2025-04-18T07:21:19Z","snapshot_observed_at":"2026-08-07T16:06:17.294598Z","submitted_at":"2025-04-12T15:32:16Z","title":"PathVLM-R1: A Reinforcement Learning-Driven Reasoning Model for Pathology Visual-Language Tasks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.09258","snapshot_observed_at":"2026-08-07T12:40:12.932030Z","title":"Pathvlm-r1: A reinforcement learning-driven reasoning model for pathology visual-language tasks.arXiv preprint arXiv:2504.09258, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-07T20:32:59.705021Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:12.932030Z"},"links":{"cited_paper":"/paper/2504.09258","citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:9e3d9af24f81efb465acb8d07d6493c6d142ae15f09844f29379142fe103c549","observation_id":"15631cde-5f52-4257-aac4-7dd590444ca3","resolution":{"observed_at":"2026-08-07T12:40:12.932030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.02686","last_updated":"2025-06-12T16:39:09Z","snapshot_observed_at":"2026-08-07T15:56:21.414821Z","submitted_at":"2025-05-05T14:33:49Z","title":"Sailing by the Stars: A Survey on Reward Models and Learning Strategies for Learning from Rewards","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.02686","snapshot_observed_at":"2026-08-07T12:40:13.070016Z","title":"Sailing ai by the stars: A survey of learning from rewards in post-training and test-time scaling of large language models.arXiv preprint arXiv:2505.02686, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-07T20:32:59.705021Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:13.070016Z"},"links":{"cited_paper":"/paper/2505.02686","citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:c202a9d3453739999abd92d8d4020ebdbb92aef88aebe5d11d9dc52997f1dad3","observation_id":"b08205ac-ba61-43a9-a7d5-dbcb2efed3b2","resolution":{"observed_at":"2026-08-07T12:40:13.070016Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:40:21.380157Z","title":"Instruction tuning large language models to understand electronic health records","venue":null,"work_id":"049a92de-a6c7-40c7-bf5c-e97877571caf","year":2024},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-07T20:32:59.705021Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:13.220372Z"},"links":{"citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:29b28c05e2f06c9d5a5137c2eec639d2f1b20bb2e85c86b4f2b67f9a2c1a5447","observation_id":"e5edff52-49fb-4c3a-87aa-6758030fa9da","resolution":{"observed_at":"2026-08-07T12:40:21.445973Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14768","last_updated":"2025-02-20T17:49:26Z","snapshot_observed_at":"2026-08-04T12:32:53.090165Z","submitted_at":"2025-02-20T17:49:26Z","title":"Logic-RL: Unleashing LLM Reasoning with Rule-Based Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14768","snapshot_observed_at":"2026-08-07T12:40:13.347732Z","title":"Logic-rl: Unleashing llm reasoning with rule-based reinforcement learning.arXiv preprint arXiv:2502.14768, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-07T20:32:59.705021Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:13.347732Z"},"links":{"cited_paper":"/paper/2502.14768","citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:dca683d865a61c17c149168f9fdd19c86ed99acf0b1ef20ac8c7f9f8d9748c4b","observation_id":"0f342469-489a-4218-8dc4-7051792f570d","resolution":{"observed_at":"2026-08-07T12:40:13.347732Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:40:21.204244Z","title":"Qwen3 technical report, 2025","venue":null,"work_id":"4f6cab8e-ac6d-4754-9c10-ccf5610d1de8","year":2025},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-07T20:32:59.705021Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:13.455171Z"},"links":{"citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:59c7190ec7330697781655610a0f7f3875fe2d64e68e35d9f7d6383167602e45","observation_id":"84b1490f-7a21-4bb0-a6b9-faf8d27154c5","resolution":{"observed_at":"2026-08-07T12:40:21.277106Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14476","last_updated":"2025-05-20T01:37:34Z","snapshot_observed_at":"2026-08-02T01:40:54.187278Z","submitted_at":"2025-03-18T17:49:06Z","title":"DAPO: An Open-Source LLM Reinforcement Learning System at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.14476","snapshot_observed_at":"2026-08-07T12:40:13.610491Z","title":"Dapo: An open-source llm reinforcement learning system at scale.arXiv preprint arXiv:2503.14476, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-07T20:32:59.705021Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:13.610491Z"},"links":{"cited_paper":"/paper/2503.14476","citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:a7c18a03357d52ed5350f5329fb976b4634f42e06844d5da67c97e90024daab5","observation_id":"9c2a96cf-38b2-41b9-9ea6-59fc39a26ca3","resolution":{"observed_at":"2026-08-07T12:40:13.610491Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.19655","last_updated":"2025-02-27T00:54:38Z","snapshot_observed_at":"2026-08-07T21:58:54.817701Z","submitted_at":"2025-02-27T00:54:38Z","title":"Med-RLVR: Emerging Medical Reasoning from a 3B base model via reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.19655","snapshot_observed_at":"2026-08-07T12:40:13.760606Z","title":"Med-rlvr: Emerging medical reasoning from a 3b base model via reinforcement learning.arXiv preprint arXiv:2502.19655, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-07T20:32:59.705021Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:13.760606Z"},"links":{"cited_paper":"/paper/2502.19655","citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:8ac0631850771811827aefba49a245574ea427db54d31be779028739027b5f55","observation_id":"c42987b4-5995-4040-8344-5dd7c2152bac","resolution":{"observed_at":"2026-08-07T12:40:13.760606Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.06034","last_updated":"2025-03-08T03:14:26Z","snapshot_observed_at":"2026-08-07T17:20:46.152437Z","submitted_at":"2025-03-08T03:14:26Z","title":"Rank-R1: Enhancing Reasoning in LLM-based Document Rerankers via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.06034","snapshot_observed_at":"2026-08-07T12:40:13.873620Z","title":"Rank- r1: Enhancing reasoning in llm-based document rerankers via reinforcement learning.arXiv preprint arXiv:2503.06034, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-07T20:32:59.705021Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:13.873620Z"},"links":{"cited_paper":"/paper/2503.06034","citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:8047423908b428b91aa03d2979cf11c9000d19063865a4df4a1eac06fec36fe1","observation_id":"2f092779-c71c-4252-97c3-7069f5184840","resolution":{"observed_at":"2026-08-07T12:40:13.873620Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:40:21.070733Z","title":"Details are provided in Section F","venue":null,"work_id":"fda59595-e8bf-48ad-a06e-70dfcea3a188","year":null},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-07T20:32:59.705021Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:14.010225Z"},"links":{"citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:7f16612e683ddaff51c1d85f9e84146a5bdadc2cf059358ab2a2e04633866d57","observation_id":"2c36a95e-4922-4f60-ac37-678ff6b83b2e","resolution":{"observed_at":"2026-08-07T12:40:21.135687Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:40:20.904693Z","title":null,"venue":null,"work_id":"7d72183e-2d32-4693-80f2-8604c80e7491","year":null},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-07T20:32:59.705021Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:14.133635Z"},"links":{"citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:011ecd033b2a4a8fc8bf7e133c431deee6402889742b3807fcf682707b4a775d","observation_id":"b3e4d5c4-aeb4-4a14-ae2a-36027c04532f","resolution":{"observed_at":"2026-08-07T12:40:21.008685Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:40:20.671608Z","title":"See Section F.3.4","venue":null,"work_id":"e3b22f3b-592d-473d-9c37-95781c2f7839","year":null},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-07T20:32:59.705021Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:14.231461Z"},"links":{"citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:2e9b054621702db9d284614e7df795fda01cf36901ed60731838d959459a0ee9","observation_id":"89263a09-dd93-48a7-9451-70723d27474b","resolution":{"observed_at":"2026-08-07T12:40:20.770263Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:40:20.480008Z","title":"Given a dose of Drug A, what is the equivalent dose of Drug B?","venue":null,"work_id":"0cbaf3c8-3aa1-4da5-bd60-b83c299aa9e6","year":2021},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-07T20:32:59.705021Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:14.373677Z"},"links":{"citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:472d92718671a8b5d485a072015f264e43e57e9ec1ac52ee06a699794b14ceec","observation_id":"7f6da25b-063a-4bec-bcc1-748d665d2a26","resolution":{"observed_at":"2026-08-07T12:40:20.562596Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:40:20.236664Z","title":null,"venue":null,"work_id":"f9ef69b0-af2e-423d-9ab8-ceb83e2656f0","year":null},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-07T20:32:59.705021Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:14.559299Z"},"links":{"citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:c831dcea098991e24f3a06e918727530ac3e2b8b459eb649c79344f3bfc4616a","observation_id":"3f082de1-aab8-42ea-9684-4b33f0fe3537","resolution":{"observed_at":"2026-08-07T12:40:20.376274Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:40:19.931009Z","title":null,"venue":null,"work_id":"9a0f816b-0181-4cb7-9fbd-955131fbe0a4","year":null},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-07T20:32:59.705021Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:14.725894Z"},"links":{"citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:86baf210d8de6c4553dd9b71e9a43e5497863392d4964bf8934008da0f62e4a6","observation_id":"4180e1d6-005e-4cd2-8e52-377b263abc24","resolution":{"observed_at":"2026-08-07T12:40:20.075209Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:40:19.719980Z","title":"Key Considerations: - Carefully **evaluate each inclusion and exclusion criterion individually**","venue":null,"work_id":"acba23a4-93e7-4ee1-b824-6966eb3f91dd","year":null},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-07T20:32:59.705021Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:14.845286Z"},"links":{"citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:c6f58e78e798b6ae54b20c8bc618f63d45bd1e1216f0e5ba10342dcecc449680","observation_id":"1538b0e0-2b9b-47d7-9e2e-13491bcfa142","resolution":{"observed_at":"2026-08-07T12:40:19.826437Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:40:19.467167Z","title":null,"venue":null,"work_id":"9d3aa069-0dd0-499d-a5bd-9b9a5a803cd4","year":null},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-07T20:32:59.705021Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:14.988132Z"},"links":{"citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:cf28ddd7944b0abaafd9fc666715b3a19a9d1e48f7b6cae71fba09390a73d685","observation_id":"78876dcd-e8c1-425c-9b11-9bb14550e8ad","resolution":{"observed_at":"2026-08-07T12:40:19.596276Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:40:18.938884Z","title":"The reasoning should be comprehensive, medically sound, and clearly explain how the patient’s information leads to the predicted outcome","venue":null,"work_id":"fc169a50-40e1-4293-adab-0b275ae61bd8","year":null},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-07T20:32:59.705021Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:15.327917Z"},"links":{"citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:cff0c008fa23793b30111460614488e65fcf67a395f847980abb6b6b5b7be4b4","observation_id":"1f7bfa90-eef2-488c-b6be-8211fe1cac03","resolution":{"observed_at":"2026-08-07T12:40:19.047445Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:40:18.667730Z","title":null,"venue":null,"work_id":"2501e712-95be-4a5e-8bf3-df669c7312a1","year":null},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-07T20:32:59.705021Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:15.442336Z"},"links":{"citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:1b06d184aa9b8a54b22aa841b143ddf31ffa632faae7ab82d970139ba7665ad1","observation_id":"387b5318-5e61-4ea8-83b0-442d1ce234c6","resolution":{"observed_at":"2026-08-07T12:40:18.784235Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:40:18.172319Z","title":"Very Confident","venue":null,"work_id":"1845a6f9-41eb-479b-b4b6-261d184bfbf2","year":2020},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-07T20:32:59.705021Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:15.652511Z"},"links":{"citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:b6c087ae924bce2752978989d3627d06dc2e19be50c9e8f34c8f192ad481bd30","observation_id":"5e44305c-dc9b-472a-a6dd-159556210ead","resolution":{"observed_at":"2026-08-07T12:40:18.288998Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:40:17.909632Z","title":null,"venue":null,"work_id":"eaff7c3d-d637-45d6-9054-a94f911cc367","year":null},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-07T20:32:59.705021Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:15.731643Z"},"links":{"citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:e173e1260a3b4021f3d7119aacab59b86aaf8d767cc6b4fb2a8e766f0e748a73","observation_id":"92b791e6-2377-437c-a8b9-e4c34729e477","resolution":{"observed_at":"2026-08-07T12:40:18.047633Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:40:19.185773Z","title":null,"venue":null,"work_id":"2dd7cea5-f548-4f30-a47b-6b719df02307","year":null},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-07T20:32:59.705021Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:15.782070Z"},"links":{"citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:db233af687e45900171e853308d8901f455e298a5395aa5a2fc7983b0917f131","observation_id":"7b2ca135-5919-404b-be3d-7db4b0520553","resolution":{"observed_at":"2026-08-07T12:40:19.322411Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:40:17.670039Z","title":"The reasoning should be comprehensive, medically sound, and clearly explain how the patient’s information leads to the predicted outcome","venue":null,"work_id":"522b5c1c-2946-466a-9f6f-08ae642f735d","year":null},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-07T20:32:59.705021Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:15.870417Z"},"links":{"citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:bba42984d16c394a7e1d0dd8dc9dd63befaa8746e926499fa5f2cb366bcca15f","observation_id":"194b7b38-6e3b-4078-b552-77fe310ea1e4","resolution":{"observed_at":"2026-08-07T12:40:17.796523Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:40:17.386300Z","title":null,"venue":null,"work_id":"09c49eb0-aad1-4982-99e1-4ba3f804eae3","year":null},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-07T20:32:59.705021Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:15.940088Z"},"links":{"citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:24332f11b4ababa3aed33c026a83a9e817f986793f582b8289c76838e4a385ce","observation_id":"6e146c0a-7796-4a19-8648-cd5cd0d43b6b","resolution":{"observed_at":"2026-08-07T12:40:17.503210Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:40:18.414065Z","title":null,"venue":null,"work_id":"6b1d3dc7-ea27-430c-9c25-a9a42735e5f3","year":null},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-07T20:32:59.705021Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:16.057297Z"},"links":{"citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:f8b0786b3cf076c8e083629da0708b7ae5278cc04c3817561e354c498733da22","observation_id":"0b633e40-d006-4f11-9604-1435024ec891","resolution":{"observed_at":"2026-08-07T12:40:18.546105Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:40:17.119372Z","title":"Very Confident","venue":null,"work_id":"33eeb4c1-26d7-4349-ba05-c58feb3c37b9","year":null},"citing_paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","snapshot_observed_at":"2026-08-07T20:32:59.705021Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:16.167357Z"},"links":{"citing_paper":"/paper/2505.24105"},"observation_digest":"sha256:c539a15cc64e2542312aa092837af01ac7b6706e4246fb73ef243494a07b032c","observation_id":"72c93ba4-f781-4338-a665-c3c17665769b","resolution":{"observed_at":"2026-08-07T12:40:17.248724Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.24105","last_updated":"2025-05-30T01:13:22Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T20:32:59.705021Z","submitted_at":"2025-05-30T01:13:22Z","title":"Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning"},"reference_resolution":{"displayed":81,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":56,"verified_exact":1,"verified_fuzzy":24},"total_outbound_references":81},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 81 of 81 outbound references and 3 inbound Pith citation observations for arXiv:2505.24105."}