{"as_of":"2026-08-07T05:39:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:56ff0636d8404dab3408e7436adc936873ee1785c64b62e434a25febcc75eb9a","coverage":[{"denominator":281,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T15:08:54.087214Z","state":"measured"},{"denominator":101,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":101,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-10T16:22:25.648004Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-11T09:00:58.380446Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-05T15:08:43.283542Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"cited_work":{"arxiv_id":"2508.21101","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.21101","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Xiaoye Qu, Yafu Li, Zhaochen Su, Weigao Sun, Jianhao Yan, Dongrui Liu, Ganqu Cui, Daizong Liu, Shuxian Liang, Junxian He, and 1 others","venue":null,"work_id":"77960c16-7b2d-4d6a-860d-eadc61d234f7","year":2025},"citing_paper":{"arxiv_id":"2604.10918","last_updated":"2026-04-13T02:34:30Z","snapshot_observed_at":"2026-07-06T22:59:27.499664Z","submitted_at":"2026-04-13T02:34:30Z","title":"CSPO: Alleviating Reward Ambiguity for Structured Table-to-LaTeX Generation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-10T16:22:25.648004Z"},"links":{"cited_paper":"/paper/2508.21101","citing_paper":"/paper/2604.10918"},"observation_digest":"sha256:241034f6741d44c1e2b6ef9ad745d93e99c256885e75bc73a4d8d06c7af2bbe9","observation_id":"e64ed3d2-4775-4f5e-b875-b75b61a14243","resolution":{"observed_at":"2026-05-11T09:00:58.382781Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2508.21101/citation-record","integrity":"/paper/2508.21101/integrity","json":"/paper/2508.21101/citation-record.json","paper":"/paper/2508.21101"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:45.530518Z","title":"Apprenticeshiplearningviainverserein- forcement learning, in: Proceedings of the twenty-first international conference on Machine learning, p","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-05T15:08:43.283542Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:45.530518Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:18e513ac5968182f05bda40c4c28bd337cc47b796d6e6b4703234dd99c4b9a8e","observation_id":"e20443c0-a6f6-448b-8e71-f493803dd5ba","resolution":{"observed_at":"2026-08-05T15:08:45.530518Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2022.16393","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:56.747437Z","title":"A prehospital triage system to detect traumatic intracranial hemorrhage using machine learning algorithms","venue":null,"work_id":"d6490a88-bf78-4e54-9919-076e0ad4ef38","year":2022},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-05T15:08:43.283542Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:45.636977Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:ed7b2f628dba77b0d6fe1c9a8c8c05215cd48e5bc16617a2ff4d6984b79b6d5f","observation_id":"7ea9e247-3d4d-4891-a5b8-a995c06a0590","resolution":{"observed_at":"2026-08-05T15:08:56.753280Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:45.769343Z","title":"Machine learning in clinical decision making","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-05T15:08:43.283542Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:45.769343Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:feedeabe3bea0a8db89b9302263600240767a0924f440c02ea8e044fdf7c80bc","observation_id":"a8365f3d-cf53-4644-8ccc-8cacfa86120f","resolution":{"observed_at":"2026-08-05T15:08:45.769343Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:45.935638Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-05T15:08:43.283542Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:45.935638Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:f9d47be642b67490d6785f662376cbfaa845b0a708b384d46286ffe10e30832e","observation_id":"8fa8520c-8ed6-4681-a6c3-7f84c03be345","resolution":{"observed_at":"2026-08-05T15:08:45.935638Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:46.043391Z","title":"Optimized blockchain-basedhealthcareframeworkempoweredbymixedmulti- agent reinforcement learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-05T15:08:43.283542Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:46.043391Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:632b5ee057d3a17b36f56fa61d74cf06d8fc1422faf9556dd023573fd57a26ef","observation_id":"8dfb0261-d3e2-4757-8f8d-e4e4eacfc651","resolution":{"observed_at":"2026-08-05T15:08:46.043391Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:46.207662Z","title":"A systematic review of trustworthy and explain- able artificial intelligence in healthcare: Assessment of qual- ity, bias risk, and data fusion","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-05T15:08:43.283542Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:46.207662Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:e923c3f523df50ce9e5f392afd5201194aacb31669575928ddb9f2801653b727","observation_id":"7aaa4125-4d1e-4371-8aca-b3c2bdaf507d","resolution":{"observed_at":"2026-08-05T15:08:46.207662Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1807.08217","last_updated":"2018-07-22T01:07:43Z","snapshot_observed_at":"2026-07-06T06:51:35.633345Z","submitted_at":"2018-07-22T01:07:43Z","title":"Asynchronous Advantage Actor-Critic Agent for Starcraft II","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1807.08217","snapshot_observed_at":"2026-08-05T15:08:46.539904Z","title":"Asynchronousadvantageactor-criticagentfor starcraft ii","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-05T15:08:43.283542Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:46.539904Z"},"links":{"cited_paper":"/paper/1807.08217","citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:214a0ef4c2645122e1727e9cd0a68e650fd2be369d9233ddc833c7292df5b2a9","observation_id":"9e4751f1-560d-4a10-a843-aa4a3e926282","resolution":{"observed_at":"2026-08-05T15:08:46.539904Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:46.706161Z","title":"Reinforcement learning in healthcare: optimizing treatmentstrategies,dynamicresourceallocation,andadaptiveclin- ical decision-making","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-05T15:08:43.283542Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:46.706161Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:ea56960837bb59b32af0b2bad64ccc66a8ce795ceca4ef87923689aa333bb15f","observation_id":"133d13ac-a0f0-4e9f-8906-6e7e20fd7048","resolution":{"observed_at":"2026-08-05T15:08:46.706161Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:46.829657Z","title":"Explainabilityforartificialintelligenceinhealthcare: a multidisciplinary perspective","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-05T15:08:43.283542Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:46.829657Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:ec7fcf604fde94ed7ef86ee2a16e8da0adb320f1c3a52ae096f14a6cfe244d24","observation_id":"a4169ad2-3cae-4363-a969-776202c75269","resolution":{"observed_at":"2026-08-05T15:08:46.829657Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:46.925741Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-05T15:08:43.283542Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:46.925741Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:11dc24a3bda697b3d3e1aed825b0674ff94b0f79f6109a04d68c38f85cd1d60e","observation_id":"c610baf5-ce9f-40c9-9e7a-188383100ecb","resolution":{"observed_at":"2026-08-05T15:08:46.925741Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:47.036255Z","title":"A comprehensive review on machine learning in healthcare industry: classification, restrictions, opportunities and challenges","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-05T15:08:43.283542Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:47.036255Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:75c0223a3f23b18dd36944c5b06ec162a708c5c4193fa56c921f699236f3ae78","observation_id":"4b88890c-bb42-4578-8eb1-aa60ecc1c6d0","resolution":{"observed_at":"2026-08-05T15:08:47.036255Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:47.153146Z","title":"On the challenges of using reinforcement learning in precision drug dosing:Delayandprolongednessofactioneffects,in:Proceedingsof the AAAI Conference on Artificial Intelligence, pp","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-05T15:08:43.283542Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:47.153146Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:f05df3564c12648eb307e8027d1225b14d2e1879bf0f7517608ff5ea2e2f4c97","observation_id":"aac97f51-7bd4-4918-8927-ee99299ad8d1","resolution":{"observed_at":"2026-08-05T15:08:47.153146Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"4567.12345","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:56.650912Z","title":"Optimizing substance use treatment selection using reinforcement learning","venue":null,"work_id":"3a45c5e8-f6bc-4c3e-9ce3-aa0bebd9fb04","year":2023},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-05T15:08:43.283542Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:47.293276Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:8de7134aba04500887ee8829f32a6f4ee6598e047fc527d8457fe9e9567e3012","observation_id":"e22aeca8-1d8b-4f78-b0e1-d98989a7c2f6","resolution":{"observed_at":"2026-08-05T15:08:56.655360Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:47.460205Z","title":"Using artificial intelligence to learn optimal regimen plan for alzheimer’s disease","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-05T15:08:43.283542Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:47.460205Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:b9bb2e75a2aaf1281ccad83c819994c5bba06fb19d39590ad95f6f9d1d04d4ca","observation_id":"0c6af5c0-b2a5-4251-844c-9efb9cfe827d","resolution":{"observed_at":"2026-08-05T15:08:47.460205Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:47.619876Z","title":"Reinvent 2.0: an ai tool for de novo drug design","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-05T15:08:43.283542Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:47.619876Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:c187a5c28356d40d475e6cf8f94009e7415aa85cedddfc04409b56fba20be66d","observation_id":"6091a871-c6fa-44c3-bae7-b51c3228b28a","resolution":{"observed_at":"2026-08-05T15:08:47.619876Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:47.776802Z","title":"Trans- forming health care with artificial intelligence: redefining medical documentation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-05T15:08:43.283542Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:47.776802Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:5346a6fea81c7d8ded1b4a18c22fbc068568b131f374147005d2cbc0b6bbc32f","observation_id":"bb124c55-b6be-4359-961e-97d9a7e995b5","resolution":{"observed_at":"2026-08-05T15:08:47.776802Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15217","last_updated":"2023-09-11T17:25:24Z","snapshot_observed_at":"2026-08-03T19:11:09.671782Z","submitted_at":"2023-07-27T22:29:25Z","title":"Open Problems and Fundamental Limitations of Reinforcement Learning from Human Feedback","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.15217","snapshot_observed_at":"2026-08-05T15:08:47.910667Z","title":"Open problems and fundamental limitations of reinforcement learning from human feedback","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-05T15:08:43.283542Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:47.910667Z"},"links":{"cited_paper":"/paper/2307.15217","citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:c2740683fc0f035b97f1218e56877ed5b51670f5f9468b6331eb8a77e1ace6f3","observation_id":"05948fb1-cc9e-4c62-833a-44cbbf013ac9","resolution":{"observed_at":"2026-08-05T15:08:47.910667Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:48.074904Z","title":"Implementing machine learninginhealthcare—addressingethicalchallenges.NewEngland Journal of Medicine 378, 981–983","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-05T15:08:43.283542Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:48.074904Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:1a0049524532e2a11adfc7a6423f99eaf4b91d794eef1b2f3686c1958bc1babd","observation_id":"35edb42d-83a8-4ab1-80b4-a818869af8dc","resolution":{"observed_at":"2026-08-05T15:08:48.074904Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.08555","last_updated":"2024-04-16T00:22:16Z","snapshot_observed_at":"2026-08-01T22:10:49.555742Z","submitted_at":"2024-04-12T15:54:15Z","title":"RLHF Deciphered: A Critical Analysis of Reinforcement Learning from Human Feedback for LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.08555","snapshot_observed_at":"2026-08-05T15:08:48.201481Z","title":"Rlhf de- ciphered: A critical analysis of reinforcement learning from human feedback for llms","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-05T15:08:43.283542Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:48.201481Z"},"links":{"cited_paper":"/paper/2404.08555","citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:12b95190a1f06a76443631e672c5c680f1a28e593f8d55a5c8bedb8e349e6b34","observation_id":"fb30ccd4-5103-4e0e-9e52-32b2ea97598a","resolution":{"observed_at":"2026-08-05T15:08:48.201481Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:48.352812Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-05T15:08:43.283542Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:48.352812Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:eead324eb386524606993a8158a720a8c7d0318ad6582f33aa4e24826fe2e58b","observation_id":"d2f31642-00c0-4266-9f7e-5edb5d970070","resolution":{"observed_at":"2026-08-05T15:08:48.352812Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:48.521405Z","title":"Event-triggered drug dosage control strategy of immune systems via safe integral reinforcement learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-05T15:08:43.283542Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:48.521405Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:b667da0da23fb9f5da34caf1c34473ca271e40c3626967b9c66adb92765a009f","observation_id":"3666ef78-a8b8-44f4-a567-a7c2043cb72c","resolution":{"observed_at":"2026-08-05T15:08:48.521405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2022.31804","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:56.548948Z","title":"Reinforcement learning based diagnosis and prediction for covid-19 by optimizing a mixed cost function from ct images","venue":null,"work_id":"9b8b22bd-dfaa-4868-86d7-3cda7dec77c7","year":2022},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-05T15:08:43.283542Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:48.740315Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:87c0ec3c5b17b3d6e80e847aaf0347242c9f76fb62974245e11a681c155fa821","observation_id":"bac48f58-0f57-46ed-866d-a93d425e7dc3","resolution":{"observed_at":"2026-08-05T15:08:56.553558Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:48.906071Z","title":"A model-based hybrid soft actor-critic deep reinforcement learning algorithm for optimal ventilator settings","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-05T15:08:43.283542Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:48.906071Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:b8785f36cdf367b24028723781a5923260766d2847a59166416b46e09f0f82fa","observation_id":"e5bac7b2-e9b6-4598-9917-bdb9067be55d","resolution":{"observed_at":"2026-08-05T15:08:48.906071Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2024.10280","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:56.476626Z","title":"Teleconsultation dynamic scheduling with a deep reinforcement learning approach","venue":null,"work_id":"bea7d973-2bb7-44e6-adcc-3f0843900b76","year":2024},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-05T15:08:43.283542Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:49.074214Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:6dc9efe4916c97ffe2d0359452c8fd547227bd88ed8797bb5fc4d77db74d901e","observation_id":"25ad33e0-be33-4dd9-aaec-03991d127bff","resolution":{"observed_at":"2026-08-05T15:08:56.480704Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:49.240722Z","title":"An online trajectory guidance framework via imitation learning and interactive feedback in robot-assisted surgery","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-05T15:08:43.283542Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:49.240722Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:4b333a59ae1b47085b2aebc91aa9f99a8a802106a2513433c2806cd62a4d57f6","observation_id":"3e58feb5-2882-45c2-b14c-e83605e239b6","resolution":{"observed_at":"2026-08-05T15:08:49.240722Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06869","last_updated":"2025-02-08T05:30:31Z","snapshot_observed_at":"2026-08-01T21:42:22.545583Z","submitted_at":"2025-02-08T05:30:31Z","title":"A Survey on Explainable Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.06869","snapshot_observed_at":"2026-08-05T15:08:49.409444Z","title":"A survey on explainable deep reinforcement learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-05T15:08:43.283542Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:49.409444Z"},"links":{"cited_paper":"/paper/2502.06869","citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:fe7962e0678caf117e7adc9fd671bed763f75dc37c088e72bcfd95ce61f0f8e9","observation_id":"f13abb6d-7170-4bb9-be00-4edc0e906c68","resolution":{"observed_at":"2026-08-05T15:08:49.409444Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:49.535441Z","title":"Deep reinforcement learning extracts the optimal sepsis treatment policy from treatment records","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-05T15:08:43.283542Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:49.535441Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:05c0d6f8d0563d34dcdb1136932c9bd4974eda9a5495dc5e03505072ee82f990","observation_id":"b43e4a4b-7ab9-46f9-a0ed-9f8dda7df9c9","resolution":{"observed_at":"2026-08-05T15:08:49.535441Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1805.11973","last_updated":"2022-09-27T10:04:29Z","snapshot_observed_at":"2026-07-06T06:42:03.459695Z","submitted_at":"2018-05-30T13:56:06Z","title":"MolGAN: An implicit generative model for small molecular graphs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1805.11973","snapshot_observed_at":"2026-08-05T15:08:49.648115Z","title":"Molgan: An implicit generative model for small molecular graphs","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-05T15:08:43.283542Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:49.648115Z"},"links":{"cited_paper":"/paper/1805.11973","citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:e1ee9da16771b4e98384479ce9ccb3f5be340c9eead99f9ce6f37acff5267c93","observation_id":"742a106e-41de-4d76-8247-40348bffd9fc","resolution":{"observed_at":"2026-08-05T15:08:49.648115Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:49.748376Z","title":"Advances and applications in inverse reinforcement learning: a comprehensive review","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-05T15:08:43.283542Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:49.748376Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:7c00c12d2ec89c310800b0a0e6197333df583fdee09a3e67516bc9251cd90425","observation_id":"5cc1dbc4-185f-4992-9d27-27eab8889441","resolution":{"observed_at":"2026-08-05T15:08:49.748376Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:49.913400Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-05T15:08:43.283542Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:49.913400Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:c58bfc93c26144eaf46d03b48b992246f14b9838376da6c597feefbafdffc7b8","observation_id":"2fa4e6af-a59e-4a62-af2c-7d3eefdffcf9","resolution":{"observed_at":"2026-08-05T15:08:49.913400Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:50.230054Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-05T15:08:43.283542Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:50.230054Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:5c17d2ccb2b6f27a6aed367baba3392036ceee91b7114fb5de1dfe0326c0400c","observation_id":"4a3735ff-e04f-4bec-943d-8ff28b55dec3","resolution":{"observed_at":"2026-08-05T15:08:50.230054Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:50.341927Z","title":"Situation-dependentcausalinfluence-basedcooperativemulti-agent reinforcementlearning,in:ProceedingsoftheAAAIConferenceon Artificial Intelligence, pp","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-05T15:08:43.283542Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:50.341927Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:0ae8d825e9f19d2ef3a4f1e4d190c8984ee622bf3e3067400954ec825a9eaa28","observation_id":"5486b722-25a7-4122-86c9-b969329d3eec","resolution":{"observed_at":"2026-08-05T15:08:50.341927Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:50.495504Z","title":"Patient-specific sedation management via deep reinforcement learning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-05T15:08:43.283542Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:50.495504Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:e83e22ac775563e47caed06cd63c0d28c72b8e5276d5db0cecec574749ddc500","observation_id":"b83e3b9d-9db4-456d-a0e3-f8468e16e8b2","resolution":{"observed_at":"2026-08-05T15:08:50.495504Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:50.520252Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-05T15:08:43.283542Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:50.520252Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:51b6e25482850b7c0389b8be7c2e62ad7b64b7e86585a89f9137bf1876accbe6","observation_id":"db12d268-7851-4cc8-ad65-c6f449352355","resolution":{"observed_at":"2026-08-05T15:08:50.520252Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2024.33517","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:56.402519Z","title":"Learn from safe experience: Safe reinforcement learning for task automation of surgical robots","venue":null,"work_id":"a6b601a1-4d90-4ad4-ac6f-74ad990add62","year":2024},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-05T15:08:43.283542Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:50.523040Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:1c4a8baf7c20e7c8b0dc10f947cd02182f8c559bb0a98331d373239970de62a4","observation_id":"ef07fff5-0892-4478-9c95-5d74c023d9ac","resolution":{"observed_at":"2026-08-05T15:08:56.407196Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2023.32548","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:56.340745Z","title":"Sim-to-real surgical robot learningandautonomousplanningforinternaltissuepointsmanipu- lationusingreinforcementlearning","venue":null,"work_id":"31482e36-06ed-4902-896e-1ac40e6c90b0","year":2023},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-05T15:08:43.283542Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:50.526338Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:549605433ecb6228346efe0916fe78e996fcc2f43c4e3f4320f61965d22cf675","observation_id":"46885983-7b1c-4932-a253-4200e1858491","resolution":{"observed_at":"2026-08-05T15:08:56.345168Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.08123","last_updated":"2025-02-12T05:05:40Z","snapshot_observed_at":"2026-07-06T20:35:11.864261Z","submitted_at":"2025-02-12T05:05:40Z","title":"Provably Robust Federated Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.08123","snapshot_observed_at":"2026-08-05T15:08:50.598526Z","title":"Provably robust federated reinforcement learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-05T15:08:43.283542Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:50.598526Z"},"links":{"cited_paper":"/paper/2502.08123","citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:af6fd4c559ea972d0b78b5a3582c018f1b1d9be36f9c03f5158f647103fe2b2a","observation_id":"1562e15c-6ee6-4560-83b0-290f3d01cf64","resolution":{"observed_at":"2026-08-05T15:08:50.598526Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:50.764408Z","title":"Towards trustworthy automatic diagnosis systems by emulating doctors’ reasoning with deep reinforcement learning, in:AdvancesinNeuralInformationProcessingSystems,pp.24502– 24515","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-05T15:08:43.283542Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:50.764408Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:5da508ce327938ee1a92ec67894f86193339cb3a4a77fc23a0c602b060d925a1","observation_id":"fe9a056c-9103-4bed-90ac-bb5732e07b49","resolution":{"observed_at":"2026-08-05T15:08:50.764408Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:50.928847Z","title":"More robust doubly robust off-policy evaluation, in: International Conference on Machine Learning, PMLR","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-05T15:08:43.283542Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:50.928847Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:81c7e6d5dfb4c7fb4306369eb3df565e2d97e0b502dcc10340ab9dc5922e2b8e","observation_id":"73f2a626-8e68-4b1e-9254-4467c3615fa8","resolution":{"observed_at":"2026-08-05T15:08:50.928847Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:51.053088Z","title":"Semi-markov offline reinforce- ment learning for healthcare, in: Conference on Health, Inference, and Learning, PMLR","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-05T15:08:43.283542Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:51.053088Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:f5bfed9c58993549f2df274de744cc15543b4c4adb08bdebc49d1cd38e8d3dc1","observation_id":"cd7a958b-7eda-4cd4-bc8a-3ce2e193ebdb","resolution":{"observed_at":"2026-08-05T15:08:51.053088Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.04408","last_updated":"2025-02-06T09:51:28Z","snapshot_observed_at":"2026-07-06T20:32:28.465641Z","submitted_at":"2025-02-06T09:51:28Z","title":"Transforming Multimodal Models into Action Models for Radiotherapy","version":1},"cited_work":{"arxiv_id":"2502.04408","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.04408","snapshot_observed_at":"2026-08-05T15:08:56.257305Z","title":"Transforming Multimodal Models into Action Models for Radiotherapy","venue":"cs.LG","work_id":"3aa86110-3e30-4f14-9a8d-74d4cb0fd2d5","year":2025},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-05T15:08:43.283542Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:51.209296Z"},"links":{"cited_paper":"/paper/2502.04408","citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:772188e11ade25f8a0f18d5c035085cacb1f80b81f7491513ce298a921dccbfd","observation_id":"769466d0-e276-4370-8ff5-85c410129cff","resolution":{"observed_at":"2026-08-05T15:08:56.260496Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:51.372021Z","title":"Off-policy deep rein- forcementlearningwithoutexploration,in:Internationalconference on machine learning, PMLR","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-05T15:08:43.283542Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:51.372021Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:36eb1f6ad4f2dbbf9205b70e9f880b8898efa5a7fc5d75c6acdb019c3a5c18f1","observation_id":"3e5e4067-a4cd-483a-b3c6-03cbccb71ba7","resolution":{"observed_at":"2026-08-05T15:08:51.372021Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2001.04032","last_updated":"2020-03-31T15:57:08Z","snapshot_observed_at":"2026-07-06T08:50:01.519038Z","submitted_at":"2020-01-13T01:55:50Z","title":"POPCORN: Partially Observed Prediction COnstrained ReiNforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2001.04032","snapshot_observed_at":"2026-08-05T15:08:51.538487Z","title":"Popcorn:Partially observed prediction constrained reinforcement learning","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-05T15:08:43.283542Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:51.538487Z"},"links":{"cited_paper":"/paper/2001.04032","citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:fcf47e154f74bf1cb3957ff4931415bafc7423301340b3b748b5a2729b6ffcc8","observation_id":"e988a8da-a1ac-4053-912b-c0ccce6c390f","resolution":{"observed_at":"2026-08-05T15:08:51.538487Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:51.704602Z","title":"Learningtotreatsepsiswithmulti-outputgaus- sian process deep recurrent q-networks","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-05T15:08:43.283542Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:51.704602Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:43cf7e3b96a29afa2d2b52566ce71ac2850ad3b3631f1b2b24f86e55225c2b9c","observation_id":"ff631272-9b71-4e06-ba4d-c8386e7bcf86","resolution":{"observed_at":"2026-08-05T15:08:51.704602Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:51.870300Z","title":"Ai-assisted warfarin dose optimisation with curate","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-05T15:08:43.283542Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:51.870300Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:f8e8bd4979621a2a845c504dc64b7508f038c9b08fed885acb30ebef5403f394","observation_id":"7dfdf40c-04ee-4847-a57e-6cd5bc0f639d","resolution":{"observed_at":"2026-08-05T15:08:51.870300Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:52.025563Z","title":"Causal inference from cross-sectional earth system data with geographical convergent cross mapping","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-05T15:08:43.283542Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:52.025563Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:fad283cc529b378b686005439ac93f64cfb3cd342b15b75098efab4626a48417","observation_id":"0a6dd22b-d0ab-45cd-aac3-dfbe64f20f43","resolution":{"observed_at":"2026-08-05T15:08:52.025563Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:52.143243Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-05T15:08:43.283542Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:52.143243Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:7aae2ea3ab51ab2bd50ff7423f2169fa87eb7f5c25ef39b3cfdcd2ae3d1b7282","observation_id":"506b35ad-7dfc-4eb2-8927-80258b6483a4","resolution":{"observed_at":"2026-08-05T15:08:52.143243Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.07123","last_updated":"2023-10-14T16:38:00Z","snapshot_observed_at":"2026-07-06T16:30:55.043821Z","submitted_at":"2023-10-11T01:52:42Z","title":"Off-Policy Evaluation for Human Feedback","version":2},"cited_work":{"arxiv_id":"2310.07123","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.07123","snapshot_observed_at":"2026-08-05T15:08:56.237798Z","title":"Off-Policy Evaluation for Human Feedback","venue":"cs.LG","work_id":"7de60153-2f13-446d-9b75-364b3a29d28b","year":2023},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-05T15:08:43.283542Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:52.429349Z"},"links":{"cited_paper":"/paper/2310.07123","citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:dc3b7a5979a0468937616dcdb39d36af10250dd8bc36495396dd08aede7959a3","observation_id":"f4c763a9-2e22-4258-8798-ff30fdb9a862","resolution":{"observed_at":"2026-08-05T15:08:56.240949Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1038/s41746-025-00789-4","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:54.700742Z","title":"Personalized decision making for coronary artery disease treatmentusingofflinereinforcementlearning","venue":null,"work_id":"59c8bb38-5a8c-417a-a722-8a88f6c87b7f","year":null},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-05T15:08:43.283542Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:52.593805Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:8e25e1b1e98889a41fb3ff5061ffd644c2e6fbef92ad977617a2cb4fd442102e","observation_id":"69fdbe3d-a7ed-445d-a750-2e244cb37e78","resolution":{"observed_at":"2026-08-05T15:08:54.703375Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:52.808475Z","title":"Personalizeddecisionmakingforcoronaryarterydisease treatmentusingofflinereinforcementlearning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-05T15:08:43.283542Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:52.808475Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:7171141592fe0f9cd1584f2680a2c6816d9f56b5e52dc6dc800ed7089bd8ca20","observation_id":"e802e6ad-0902-43d9-947e-af509c318701","resolution":{"observed_at":"2026-08-05T15:08:52.808475Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:52.974903Z","title":"The false hope of current approaches to explainable artificial intelligence in health care","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-05T15:08:43.283542Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:52.974903Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:aa0bc74c5afc26c584a0353a93f20fa19316129876a39b855c4894a33d5663b4","observation_id":"3085a92c-5619-42d8-8ad7-f85e1d7e9b8b","resolution":{"observed_at":"2026-08-05T15:08:52.974903Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:53.093621Z","title":"Medications for analgesia and sedation in the intensive care unit: an overview","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-05T15:08:43.283542Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:53.093621Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:d198367664cc9ed0c503395ef72509072ab71565ecc874a54c886b601b4a84df","observation_id":"f4e51424-3561-4f69-8fc9-57d92c60f73b","resolution":{"observed_at":"2026-08-05T15:08:53.093621Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:53.253680Z","title":"Guidelines for reinforcement learning in healthcare","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-05T15:08:43.283542Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:53.253680Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:8901709a5a7f3adc5e6c5a290b6267da96b4fc626fbccfc7b3d1fca29780f5de","observation_id":"8d8ff5ac-a924-4a3a-b9ef-038097fdded7","resolution":{"observed_at":"2026-08-05T15:08:53.253680Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:53.449950Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-05T15:08:43.283542Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:53.449950Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:aed51700b567194a25bb6787a7bd58e1010d41e447cee8edd7601bca31185877","observation_id":"217d091d-76b3-4582-8906-5ae280ed2d21","resolution":{"observed_at":"2026-08-05T15:08:53.449950Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:53.576781Z","title":"Machine learning with optimization to create medicine intake schedules for parkin- son’s disease patients","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-05T15:08:43.283542Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:53.576781Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:67db55fe2d07c06c2d9e82afdd5142ed42413afbe939b37c799d13c6be84999c","observation_id":"70d69ac7-097b-4d8c-876e-802fdb11a4f6","resolution":{"observed_at":"2026-08-05T15:08:53.576781Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:53.703069Z","title":"Extubation after breathing trials with automatictubecompensation,t-tube,orpressuresupportventilation","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-05T15:08:43.283542Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:53.703069Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:50fcec18cd024ab8c63a5e63fd62c122165fab8b0f6a3f658324a19a9be6ef76","observation_id":"3669b792-dfa2-4529-9881-a9ca02156779","resolution":{"observed_at":"2026-08-05T15:08:53.703069Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:53.798275Z","title":"Sim2real rope cutting with a surgical robot using vision-based reinforcement learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-05T15:08:43.283542Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:53.798275Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:33357f3a723806ecb887ce29c08e7698c33eb3c624c614e6c702cdd823c86e22","observation_id":"8c4033f0-4c20-4f9f-8b70-085979bc71f8","resolution":{"observed_at":"2026-08-05T15:08:53.798275Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:53.966709Z","title":"Evaluating the diagnostic performance of symptom checkers: Clinical vignette study","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-05T15:08:43.283542Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:53.966709Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:5b0324871cac7b1ef2a92a506d5aefdaae5f6e082906170490184b5a9e87c9d2","observation_id":"b51c75ed-f0d2-4bc6-989a-a31d77381147","resolution":{"observed_at":"2026-08-05T15:08:53.966709Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:53.976377Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-05T15:08:43.283542Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:53.976377Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:625f347731f1f4d4215e1d80e310cea256a0f731794e57ebe0e5bbc581feef92","observation_id":"7edfe91b-04b0-46df-af36-0943cb0a3635","resolution":{"observed_at":"2026-08-05T15:08:53.976377Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:53.979230Z","title":"Longi- tudinalchangesindiagnosticaccuracyofadifferentialdiagnosislist developed by an ai-based symptom checker: retrospective observa- tional study","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-05T15:08:43.283542Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:53.979230Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:522565318fec3bdee4bb9d2bf6b409c4de95c9496ec6ac1a1fc1b4a5b1da6574","observation_id":"9a5496cb-2bef-42c8-a8db-13f8888227f6","resolution":{"observed_at":"2026-08-05T15:08:53.979230Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:53.981906Z","title":"Investigatingthe potential of reinforcement learning and deep learning in improving alzheimer’s disease classification","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-05T15:08:43.283542Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:53.981906Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:6afc475beb74ba8aed8848982caf5bd4b2dd8313c91d9d08ba88b385e382eb10","observation_id":"c58fb827-8b84-4716-8840-7fbf995271e4","resolution":{"observed_at":"2026-08-05T15:08:53.981906Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:53.984249Z","title":"Deep recurrent q-learning for partially observable mdps., in: AAAI fall symposia, p","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-05T15:08:43.283542Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:53.984249Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:9d691ed2155f032aa247fda9f1922e5efc5e93712e34b126b342a193dbce3bde","observation_id":"21d8895a-592e-4074-908e-0d23f3403fe4","resolution":{"observed_at":"2026-08-05T15:08:53.984249Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1109/mwc.001.2000345","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:54.692418Z","title":"IEEE Wireless Communications 28, 6–11","venue":null,"work_id":"84b1d9bd-b494-4780-b688-a00aa35e526c","year":2021},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-05T15:08:43.283542Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:53.986690Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:9f12809575b05e98810138772f0b1f5dfb14d827b23a8a408a3dd7e92b52bbf8","observation_id":"852e8429-f5c3-48c2-8ba2-33dcee4453d3","resolution":{"observed_at":"2026-08-05T15:08:54.695502Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:53.989409Z","title":"Understanding the patient perspective of epilepsy treatment through text mining of online patient support groups","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-05T15:08:43.283542Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:53.989409Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:456056f4e40e9d8378d704da52d271fb2ecb3f7cb751e63c0027991cfa561c93","observation_id":"9d591e9d-f25a-43f1-b704-cb5731291dcb","resolution":{"observed_at":"2026-08-05T15:08:53.989409Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:53.991765Z","title":"A survey of large language models for healthcare: fromdata,technology,andapplicationstoaccountabilityandethics","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-05T15:08:43.283542Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:53.991765Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:c15c45040b36bfe280abe6d48e582fb1407f12fef4048b995b3d446e92b64582","observation_id":"4b39b70d-7f8b-4394-95d3-44059f428e1e","resolution":{"observed_at":"2026-08-05T15:08:53.991765Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:53.994388Z","title":"A blockchain-based scheme for secure data offloading in healthcare with deep reinforcement learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-05T15:08:43.283542Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:53.994388Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:2e998a866f6f744bf7392433056e40eef02b05d9d6dcb045660761a3a95749b3","observation_id":"f3ecea35-f958-4503-8589-439cd2475a0b","resolution":{"observed_at":"2026-08-05T15:08:53.994388Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.10000","last_updated":"2023-04-19T22:37:12Z","snapshot_observed_at":"2026-08-03T19:14:06.942475Z","submitted_at":"2023-04-19T22:37:12Z","title":"Model Based Reinforcement Learning for Personalized Heparin Dosing","version":1},"cited_work":{"arxiv_id":"2304.10000","doi":null,"metadata_source":"pith","pith_arxiv_id":"2304.10000","snapshot_observed_at":"2026-08-05T15:08:56.226115Z","title":"Model Based Reinforcement Learning for Personalized Heparin Dosing","venue":"math.OC","work_id":"1e7f34ed-bbbe-48de-89be-c2dd37c81e7c","year":2023},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-05T15:08:43.283542Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:53.997414Z"},"links":{"cited_paper":"/paper/2304.10000","citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:e3a4cef2ce6a6f5084142409420e8556ffaa751f6c64fb9744cfc0cd29f5cb05","observation_id":"824d38b9-8200-4ef6-bc6c-c523197c01ff","resolution":{"observed_at":"2026-08-05T15:08:56.229502Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:54.000288Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-05T15:08:43.283542Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:54.000288Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:5639b20f34e74d755bd26fcc4dec76f5cad6b38dd8706c3cf4a456ca6a142788","observation_id":"8b459f2e-cdd7-43ea-9fa8-57e3d2f96b1c","resolution":{"observed_at":"2026-08-05T15:08:54.000288Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:54.006238Z","title":"Long short-term memory","venue":null,"work_id":null,"year":1997},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-05T15:08:43.283542Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:54.006238Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:e712442e6f9829e2cd1550116ee85b1754cd3201c37689c4b8b6d2e44a571ab5","observation_id":"de23203d-b3ef-404d-8444-29244d374dde","resolution":{"observed_at":"2026-08-05T15:08:54.006238Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:54.008732Z","title":"Vime: Variational information maximizing ex- ploration","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-05T15:08:43.283542Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:54.008732Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:132fb65afcb3ffaf77ff7f8b247600310866bbe743cd08d37283058f8335a571","observation_id":"9ec8c2f9-7553-4dc7-92a6-22fe3bf8c75c","resolution":{"observed_at":"2026-08-05T15:08:54.008732Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:54.011303Z","title":"Dynamic programming and markov processes","venue":null,"work_id":null,"year":1960},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-05T15:08:43.283542Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:54.011303Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:a83611f98a4c23261d6608f2426a20f30e06b1553c38efe1162262c80eed0826","observation_id":"9cdb71e4-69ba-435c-a973-23b926d2da8e","resolution":{"observed_at":"2026-08-05T15:08:54.011303Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:54.013931Z","title":"Reinforcement learning for sepsis treatment: A continuous action space solution","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-05T15:08:43.283542Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:54.013931Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:0f98a8810d44e9a5cb7457b50a72e39b5ffefc7f12fed60a3ec06246da19059d","observation_id":"06330450-0716-46e7-a308-0da67d5660f2","resolution":{"observed_at":"2026-08-05T15:08:54.013931Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:54.016430Z","title":"Deep variational reinforcement learning for pomdps, in: International conference on machine learning, PMLR","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-05T15:08:43.283542Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:54.016430Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:656c6c8c6fe0d8c196dbc568275f33ba21bbf2c0c7e179d6b720fddf5e94267a","observation_id":"a3d1bdd2-c4f5-41fc-84b6-58703c74f244","resolution":{"observed_at":"2026-08-05T15:08:54.016430Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:54.019264Z","title":"Personal- ized insulin dosing using reinforcement learning for high-fat meals and aerobic exercises in type 1 diabetes: a proof-of-concept trial","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-05T15:08:43.283542Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:54.019264Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:f2f85a005e9bd3f3f121ec0e9602b82a35224dce97f034a57b507a266b5e7ff1","observation_id":"712ed2eb-bccf-4f04-9632-7373db863552","resolution":{"observed_at":"2026-08-05T15:08:54.019264Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:54.021562Z","title":"Irl for restless multi-armed bandits with applications in maternal and child health, in: PRICAI 2024: Trends in Artificial Intelligence, pp","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-05T15:08:43.283542Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:54.021562Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:7d585b8a00473a5660cf867646c2649471ff5c93be52dc64ae9e7831ab738c39","observation_id":"6ac6a665-dc2a-47db-9555-1fdb109692b5","resolution":{"observed_at":"2026-08-05T15:08:54.021562Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:54.023899Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-05T15:08:43.283542Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:54.023899Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:c00d5850c8e00ee92839ec27fc235f6c858bfae533385648b85507718b041871","observation_id":"f4be8083-322c-442b-a950-f45d701752cf","resolution":{"observed_at":"2026-08-05T15:08:54.023899Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:54.026439Z","title":"Basal-bolus advisor for type 1 diabetes (t1d) patients using multi-agent reinforcement learning (rl) methodology","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-05T15:08:43.283542Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:54.026439Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:6431a7f999e221bd999f5a4aa72a4f3d5256947411b665caaef31991b23b3bb5","observation_id":"55a5964d-9f84-4c36-b53d-ef2a386cebb0","resolution":{"observed_at":"2026-08-05T15:08:54.026439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:54.029482Z","title":"A primer on reinforcement learning in medicine for clinicians","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-05T15:08:43.283542Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:54.029482Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:71e230f840d6ea582f00930e4c385020fb19ae98214d86b2f31e0fdc36d65cd2","observation_id":"093ec56e-2839-4175-b3ec-ba54ac892f7e","resolution":{"observed_at":"2026-08-05T15:08:54.029482Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.15513","last_updated":"2025-06-14T16:04:31Z","snapshot_observed_at":"2026-08-03T06:34:42.243765Z","submitted_at":"2024-06-20T18:37:36Z","title":"PKU-SafeRLHF: Towards Multi-Level Safety Alignment for LLMs with Human Preference","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.15513","snapshot_observed_at":"2026-08-05T15:08:54.032086Z","title":"Pku-saferlhf: Towards multi-level safety alignment for llms with human preference","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-05T15:08:43.283542Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:54.032086Z"},"links":{"cited_paper":"/paper/2406.15513","citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:d360df36a52f1b123e320fe658aededb225af9cdc29f416c5e55e7278c2a7c6d","observation_id":"c95821df-2fb0-4028-9f2c-4fb40de35681","resolution":{"observed_at":"2026-08-05T15:08:54.032086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:54.035230Z","title":"Safe reinforcement learningforsepsistreatment,in:2020IEEEInternationalconference on healthcare informatics (ICHI), IEEE","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-05T15:08:43.283542Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:54.035230Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:610b91fff2ba5f8b8f7ef8a69670c41d1c6f7ede06f3ab1854b6584f64a80525","observation_id":"ef362d3e-c085-4daa-bf04-94c6db3a5996","resolution":{"observed_at":"2026-08-05T15:08:54.035230Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:54.037864Z","title":"Doubly robust off-policy value evaluation for reinforcement learning, in: International conference on machine learning, PMLR","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-05T15:08:43.283542Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:54.037864Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:f55ddbd6965589268beba099d2fbdd2bc8f1875494951abe6ef99f68f526610e","observation_id":"d9108e7c-05c5-44e0-864a-a7b8b69b4d18","resolution":{"observed_at":"2026-08-05T15:08:54.037864Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:54.040899Z","title":"Opti- maltreatmentstrategiesforcriticalpatientswithdeepreinforcement learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-05T15:08:43.283542Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:54.040899Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:57d674f0ef7c0bdb8e5fcfa876511875009fa3b3275a64ec0cdd874c2a201478","observation_id":"e761e101-baed-46dc-a56f-3dc605eac58d","resolution":{"observed_at":"2026-08-05T15:08:54.040899Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:54.043409Z","title":"The malmoplatformforartificialintelligenceexperimentation.,in:Ijcai, pp","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-05T15:08:43.283542Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:54.043409Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:628208d5807e417e16e3dc9c072132c9524a78dfada857f965664a53d6e9ce1f","observation_id":"0e845017-4203-4b96-b0f8-8cb8c4f320be","resolution":{"observed_at":"2026-08-05T15:08:54.043409Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:54.046328Z","title":"Reinforcement learn- ing: A survey","venue":null,"work_id":null,"year":1996},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-05T15:08:43.283542Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:54.046328Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:de8d909d1438e3db929224b5cd6a2c4312437cd65b3fd5b00643a0da54729ea5","observation_id":"683b236b-9637-4ab3-af63-06ed314cd503","resolution":{"observed_at":"2026-08-05T15:08:54.046328Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1609/aaai.v32i1.11902","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:54.683366Z","title":"Context-aware symp- tomcheckingfordiseasediagnosisusinghierarchicalreinforcement learning","venue":null,"work_id":"2c833d22-79ea-44ad-a99f-f1bf847c626e","year":2018},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-05T15:08:43.283542Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:54.049323Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:ccc5864d7cb435bbef5fbef41b171ad68eb5b5b74582f7d7d5c9b6cbbdbe167e","observation_id":"e237829f-6243-42f4-9cc1-0734607f13b2","resolution":{"observed_at":"2026-08-05T15:08:54.686460Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:54.051882Z","title":"Elrl-md: a deep learning approach for myocarditis diagnosis using cardiac magnetic resonance images with ensemble and reinforcement learning inte- gration","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-05T15:08:43.283542Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:54.051882Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:87324a43d9c66b52598367b009e937540db664874d6141009538e3394bbefdc4","observation_id":"23ad0529-b2b4-4db9-84cc-11ed9c1ab69e","resolution":{"observed_at":"2026-08-05T15:08:54.051882Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:54.054418Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-05T15:08:43.283542Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:54.054418Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:c9ce485bf71a9f25ac627bf272c6d1a95cf0399fe760c4373428681b156260b6","observation_id":"df4d1ce9-4b95-43ca-8658-4d048e645232","resolution":{"observed_at":"2026-08-05T15:08:54.054418Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:54.056693Z","title":"Reinforcement learning for clinical applica- tions","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-05T15:08:43.283542Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:54.056693Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:102cc289d49e167a4b9d0b7ef447528c202d88c1b86811d1d2d9dd9fdf480610","observation_id":"6666043a-e222-4905-b5c8-2acad0c60a8e","resolution":{"observed_at":"2026-08-05T15:08:54.056693Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.11235","last_updated":"2020-11-23T06:37:08Z","snapshot_observed_at":"2026-07-06T10:16:51.040229Z","submitted_at":"2020-11-23T06:37:08Z","title":"An Empirical Study of Representation Learning for Reinforcement Learning in Healthcare","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.11235","snapshot_observed_at":"2026-08-05T15:08:54.059609Z","title":"An empirical study of representation learning for rein- forcement learning in healthcare","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-05T15:08:43.283542Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:54.059609Z"},"links":{"cited_paper":"/paper/2011.11235","citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:f3a449c04c68040d46fba43ec520881f554387c4b9948995e362be6489327060","observation_id":"ae999c9d-b19a-47b4-b869-409ebd24dffd","resolution":{"observed_at":"2026-08-05T15:08:54.059609Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:54.062323Z","title":"Physiological Measurement 42, 025006","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-05T15:08:43.283542Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:54.062323Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:162cfc81814d57a39056b291bbcb07e383bba720b0a6021066d81cb1e14453c6","observation_id":"d77e2c6d-8fc8-4689-a30e-8a1993a88c9f","resolution":{"observed_at":"2026-08-05T15:08:54.062323Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:54.065072Z","title":"Building a personalized messaging system for health intervention inunderprivilegedregionsusingreinforcementlearning.,in:IJCAI, pp","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-05T15:08:43.283542Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:54.065072Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:c2f04f90f651829f39a771ed80460bdabfb1fe5826766b315bacd5775a0ae64c","observation_id":"e7c08f9a-b067-46ac-b208-998784b5b0ab","resolution":{"observed_at":"2026-08-05T15:08:54.065072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:54.067425Z","title":"The artificial intelligence clinician learns optimal treatment strategies for sepsis in intensive care","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-05T15:08:43.283542Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:54.067425Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:86b1ef73f3248c956688fa812cdefa38dbcaf4f997fcda2fcc1b93a12af3fb15","observation_id":"57bba718-eecc-4af9-ac1a-cff4bc737e2a","resolution":{"observed_at":"2026-08-05T15:08:54.067425Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:54.069892Z","title":"Towards safe mechanical ventilation treatment using deep offline reinforcement learning, in: Proceedings of the AAAI Conference on Artificial Intelligence, pp","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-05T15:08:43.283542Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:54.069892Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:d6dff29a583090b229dd11e397f52376d94a951c30ffdc24d4c7ab5e1508e859","observation_id":"6790d2ef-8325-4f2f-abc1-19595e0f4c2d","resolution":{"observed_at":"2026-08-05T15:08:54.069892Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:54.072593Z","title":"Designanefficientvarmalstmgru model for identification of deep-fake images via dynamic window- based spatio-temporal analysis","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-05T15:08:43.283542Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:54.072593Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:9762a3e002b7bc597c465fd8555d0f4b3c3bec3be457a8d5c6cc152e3d7f1aed","observation_id":"cb5e42dd-628c-4de8-97c9-5f4cc4c435a7","resolution":{"observed_at":"2026-08-05T15:08:54.072593Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:54.075126Z","title":"Hierarchical deep reinforcement learning: Integrating temporal ab- straction and intrinsic motivation","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-05T15:08:43.283542Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:54.075126Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:1fadc95c998ef68dd8f4ea02f6cfb79034ee0ab41961481c471a49d4e65b6d41","observation_id":"98cc2015-24a9-4be6-85f8-5fa01a6d0d5b","resolution":{"observed_at":"2026-08-05T15:08:54.075126Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:54.077569Z","title":"Conservative q-learning for offline reinforcement learning","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-05T15:08:43.283542Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:54.077569Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:fa7f6cf75c363cc40dd1f02d4092d460a7d611fa2613ab90fbb21527c9fbf9c8","observation_id":"5983922a-f426-4bc6-a0c5-7e22642a05fe","resolution":{"observed_at":"2026-08-05T15:08:54.077569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:54.080066Z","title":"Artificial intel- ligence in disease diagnosis: a systematic literature review, synthe- sizing framework and future research agenda","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-05T15:08:43.283542Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:54.080066Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:d28cee44ce59f97b88b2c43f9c6021503acdcbd68f467f5baad141b4ff187018","observation_id":"b5b774aa-4bd5-45b3-983b-9d538bdeb4b8","resolution":{"observed_at":"2026-08-05T15:08:54.080066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:54.082549Z","title":"Mobile-fog-cloud assisted deep reinforcement learning and blockchain-enable iomt system for healthcare workflows","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-05T15:08:43.283542Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:54.082549Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:cc405dd93d602f13a227a3809a35c72eba96edaab0a895e3330724a44039c8d7","observation_id":"b4376bf6-a559-48cd-90b5-c0e0a71f90a5","resolution":{"observed_at":"2026-08-05T15:08:54.082549Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:54.084801Z","title":"Fiber-optics iot healthcare system based on deep reinforcement learning combi- natorial constraint scheduling for hybrid telemedicine applications","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-05T15:08:43.283542Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:54.084801Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:d6500e620210f2d4953092e8f9e93ee9c741e25485f219ecb55f6b405eb2dcfd","observation_id":"52ceb5f8-27ac-4562-9401-fb68f0a62944","resolution":{"observed_at":"2026-08-05T15:08:54.084801Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:08:54.087214Z","title":"Data-drivenhospitalsstaffandresourcesalloca- tion using agent-based simulation and deep reinforcement learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-05T15:08:43.283542Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:54.087214Z"},"links":{"citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:7ef227938f8e2a780fcee7bb915f4b42cb3d954cf064db7f27f1a011494cb0e5","observation_id":"9c2f2111-ba65-41e9-9b30-c2096e9b08b8","resolution":{"observed_at":"2026-08-05T15:08:54.087214Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-05T15:08:43.283542Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":1,"metadata_mismatch":6,"parse_uncertain":0,"unresolved":87,"verified_exact":6,"verified_fuzzy":0},"total_outbound_references":281},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 100 of 281 outbound references and 1 inbound Pith citation observation for arXiv:2508.21101."}