{"as_of":"2026-08-11T06:14:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:6d2a7a4e097d42f7087d721f0ebfbcea038ea25b982070d3bc3d8e658db3b620","coverage":[{"denominator":45,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":45,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-28T17:58:59.805574Z","state":"measured"},{"denominator":45,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":45,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2606.01051/citation-record","integrity":"/paper/2606.01051/integrity","json":"/paper/2606.01051/citation-record.json","paper":"/paper/2606.01051"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T17:58:59.805574Z","title":"Constrained policy optimization","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2606.01051","last_updated":"2026-05-31T06:46:26Z","snapshot_observed_at":"2026-08-02T00:24:45.749093Z","submitted_at":"2026-05-31T06:46:26Z","title":"Interaction-Limited Safe Continuous-Time RL for Dynamical Medical Treatment","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-28T17:58:59.805574Z"},"links":{"citing_paper":"/paper/2606.01051"},"observation_digest":"sha256:3f53c088f42368559cd47c9adb8f6124a1a194067cdc3f75ca93b50d08d3bdea","observation_id":"62522aea-e052-4c82-bade-f225beeecc21","resolution":{"observed_at":"2026-06-28T17:58:59.805574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T17:58:59.805574Z","title":"Routledge, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.01051","last_updated":"2026-05-31T06:46:26Z","snapshot_observed_at":"2026-08-02T00:24:45.749093Z","submitted_at":"2026-05-31T06:46:26Z","title":"Interaction-Limited Safe Continuous-Time RL for Dynamical Medical Treatment","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-28T17:58:59.805574Z"},"links":{"citing_paper":"/paper/2606.01051"},"observation_digest":"sha256:4aeecbfbfcfd5f9ca0b6bf0041012dcea4c5af5afd2e52f9508ead270eeec3de","observation_id":"3968f31b-e69f-44d8-a9d1-73a52ebb8d5b","resolution":{"observed_at":"2026-06-28T17:58:59.805574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T17:58:59.805574Z","title":"The option-critic architecture","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2606.01051","last_updated":"2026-05-31T06:46:26Z","snapshot_observed_at":"2026-08-02T00:24:45.749093Z","submitted_at":"2026-05-31T06:46:26Z","title":"Interaction-Limited Safe Continuous-Time RL for Dynamical Medical Treatment","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-28T17:58:59.805574Z"},"links":{"citing_paper":"/paper/2606.01051"},"observation_digest":"sha256:f642b08ec9d5e49c074d415872ff82a819356b21dfd8e977bc3cc0c76db8cf31","observation_id":"4997861d-d093-4f42-ad25-8aa61237e2bf","resolution":{"observed_at":"2026-06-28T17:58:59.805574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T17:58:59.805574Z","title":"Kellum, and Claudio Ronco","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2606.01051","last_updated":"2026-05-31T06:46:26Z","snapshot_observed_at":"2026-08-02T00:24:45.749093Z","submitted_at":"2026-05-31T06:46:26Z","title":"Interaction-Limited Safe Continuous-Time RL for Dynamical Medical Treatment","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-28T17:58:59.805574Z"},"links":{"citing_paper":"/paper/2606.01051"},"observation_digest":"sha256:c5373ed1477c166ac0cf2d2d51db4636cf3af3d63f39f111faba4f2ea3b05d07","observation_id":"9db079e9-524a-42d8-a7b6-e71c600e704a","resolution":{"observed_at":"2026-06-28T17:58:59.805574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T17:58:59.805574Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.01051","last_updated":"2026-05-31T06:46:26Z","snapshot_observed_at":"2026-08-02T00:24:45.749093Z","submitted_at":"2026-05-31T06:46:26Z","title":"Interaction-Limited Safe Continuous-Time RL for Dynamical Medical Treatment","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-28T17:58:59.805574Z"},"links":{"citing_paper":"/paper/2606.01051"},"observation_digest":"sha256:5e8e96e90dda7674d9ef3e64f0c7d378a41b5ebd0e7f2e62936428d5025eac88","observation_id":"6235a3e9-ffee-41fd-a1d7-159a4167c85a","resolution":{"observed_at":"2026-06-28T17:58:59.805574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T17:58:59.805574Z","title":"A lyapunov-based approach to safe reinforcement learning.Advances in neural information processing systems, 31, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2606.01051","last_updated":"2026-05-31T06:46:26Z","snapshot_observed_at":"2026-08-02T00:24:45.749093Z","submitted_at":"2026-05-31T06:46:26Z","title":"Interaction-Limited Safe Continuous-Time RL for Dynamical Medical Treatment","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-28T17:58:59.805574Z"},"links":{"citing_paper":"/paper/2606.01051"},"observation_digest":"sha256:6e27dcdeebe9769538f68f3c064b181a2fc5999bd64ff97a3cd5cd4c91008c7e","observation_id":"1475c816-4a4c-41e4-bb5b-33f062ed8886","resolution":{"observed_at":"2026-06-28T17:58:59.805574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T17:58:59.805574Z","title":"Serum lactate is associated with mortality in severe sepsis independent of organ failure and shock.Critical Care Medicine, 37(5):1670–1677, 2009","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2606.01051","last_updated":"2026-05-31T06:46:26Z","snapshot_observed_at":"2026-08-02T00:24:45.749093Z","submitted_at":"2026-05-31T06:46:26Z","title":"Interaction-Limited Safe Continuous-Time RL for Dynamical Medical Treatment","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-28T17:58:59.805574Z"},"links":{"citing_paper":"/paper/2606.01051"},"observation_digest":"sha256:e5e7181748d8a0059a4b423d8dc89e02b9456a80a03f77e017cd5d3cf18a291b","observation_id":"a3e719c0-fd36-4bb5-b4e5-ed58a08b72d3","resolution":{"observed_at":"2026-06-28T17:58:59.805574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T17:58:59.805574Z","title":"Bonferroni inequalities.The Annals of Probability, 5(4):577–581, 1977","venue":null,"work_id":null,"year":1977},"citing_paper":{"arxiv_id":"2606.01051","last_updated":"2026-05-31T06:46:26Z","snapshot_observed_at":"2026-08-02T00:24:45.749093Z","submitted_at":"2026-05-31T06:46:26Z","title":"Interaction-Limited Safe Continuous-Time RL for Dynamical Medical Treatment","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-28T17:58:59.805574Z"},"links":{"citing_paper":"/paper/2606.01051"},"observation_digest":"sha256:696d83bb6cdd4547de8534f8d548fa9864406d070108397ed324701210c65e1f","observation_id":"027b0b36-e50f-4075-bd9b-6c715741b97c","resolution":{"observed_at":"2026-06-28T17:58:59.805574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T17:58:59.805574Z","title":"Ghossein, B","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.01051","last_updated":"2026-05-31T06:46:26Z","snapshot_observed_at":"2026-08-02T00:24:45.749093Z","submitted_at":"2026-05-31T06:46:26Z","title":"Interaction-Limited Safe Continuous-Time RL for Dynamical Medical Treatment","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-28T17:58:59.805574Z"},"links":{"citing_paper":"/paper/2606.01051"},"observation_digest":"sha256:87385c62876b6566bb6cd68e0e15892c565d91beb37dd8de338abac0c2174b84","observation_id":"8b90dc57-baed-41fa-b79e-6c75c4b79683","resolution":{"observed_at":"2026-06-28T17:58:59.805574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T17:58:59.805574Z","title":"Guidelines for reinforcement learning in healthcare.Nature medicine, 25(1):16–18, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2606.01051","last_updated":"2026-05-31T06:46:26Z","snapshot_observed_at":"2026-08-02T00:24:45.749093Z","submitted_at":"2026-05-31T06:46:26Z","title":"Interaction-Limited Safe Continuous-Time RL for Dynamical Medical Treatment","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-28T17:58:59.805574Z"},"links":{"citing_paper":"/paper/2606.01051"},"observation_digest":"sha256:883462ffe51d2f923f5db9082df1008436e9382eebde99cfbe15482820a627e3","observation_id":"6245c4ad-73aa-451c-97bb-56fe5b8fe56d","resolution":{"observed_at":"2026-06-28T17:58:59.805574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T17:58:59.805574Z","title":"Grönwall","venue":null,"work_id":null,"year":1919},"citing_paper":{"arxiv_id":"2606.01051","last_updated":"2026-05-31T06:46:26Z","snapshot_observed_at":"2026-08-02T00:24:45.749093Z","submitted_at":"2026-05-31T06:46:26Z","title":"Interaction-Limited Safe Continuous-Time RL for Dynamical Medical Treatment","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-28T17:58:59.805574Z"},"links":{"citing_paper":"/paper/2606.01051"},"observation_digest":"sha256:03030db85b04574856aa16753c20bbbbe695d1b18fdbdbed5c91ec1466d412c8","observation_id":"321ba8cc-458f-4b71-a439-f6a3d6d0f87d","resolution":{"observed_at":"2026-06-28T17:58:59.805574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T17:58:59.805574Z","title":"Soft actor-critic: Off-policy maximum entropy deep reinforcement learning with a stochastic actor","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2606.01051","last_updated":"2026-05-31T06:46:26Z","snapshot_observed_at":"2026-08-02T00:24:45.749093Z","submitted_at":"2026-05-31T06:46:26Z","title":"Interaction-Limited Safe Continuous-Time RL for Dynamical Medical Treatment","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-28T17:58:59.805574Z"},"links":{"citing_paper":"/paper/2606.01051"},"observation_digest":"sha256:23f99d3417cdbcec64ed9f20a6d488815f3835f5bb213792020067d0b9adb710","observation_id":"10ee26be-1ced-4332-a02e-9d2bcf11b2c0","resolution":{"observed_at":"2026-06-28T17:58:59.805574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T17:58:59.805574Z","title":"Epicare: A reinforcement learning benchmark for dynamic treatment regimes","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.01051","last_updated":"2026-05-31T06:46:26Z","snapshot_observed_at":"2026-08-02T00:24:45.749093Z","submitted_at":"2026-05-31T06:46:26Z","title":"Interaction-Limited Safe Continuous-Time RL for Dynamical Medical Treatment","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-28T17:58:59.805574Z"},"links":{"citing_paper":"/paper/2606.01051"},"observation_digest":"sha256:5133893f4b66f0a29d733c673d4a9d2ce2a63b0250cec4f697ca9c09063674bb","observation_id":"aed5e5f2-4348-46dd-8b56-e75aa39cffc5","resolution":{"observed_at":"2026-06-28T17:58:59.805574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T17:58:59.805574Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.01051","last_updated":"2026-05-31T06:46:26Z","snapshot_observed_at":"2026-08-02T00:24:45.749093Z","submitted_at":"2026-05-31T06:46:26Z","title":"Interaction-Limited Safe Continuous-Time RL for Dynamical Medical Treatment","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-28T17:58:59.805574Z"},"links":{"citing_paper":"/paper/2606.01051"},"observation_digest":"sha256:4c0e6df997b511a53f8efdd61de9e38473df8db57bd1b3e7e9f7066e22549e41","observation_id":"51d9cd68-b8a7-4946-86ee-0da3c9d164b0","resolution":{"observed_at":"2026-06-28T17:58:59.805574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T17:58:59.805574Z","title":"Reinforcement learning for sepsis treatment: A continuous action space solution","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.01051","last_updated":"2026-05-31T06:46:26Z","snapshot_observed_at":"2026-08-02T00:24:45.749093Z","submitted_at":"2026-05-31T06:46:26Z","title":"Interaction-Limited Safe Continuous-Time RL for Dynamical Medical Treatment","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-28T17:58:59.805574Z"},"links":{"citing_paper":"/paper/2606.01051"},"observation_digest":"sha256:0e1ff1abf30e397ccdf9b3c3a37c27943e139b0fb7bf3193b296169b499b494a","observation_id":"beb3b07c-0e31-48f9-88e1-9c707d29e963","resolution":{"observed_at":"2026-06-28T17:58:59.805574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T17:58:59.805574Z","title":"Hyndman, D","venue":null,"work_id":null,"year":1996},"citing_paper":{"arxiv_id":"2606.01051","last_updated":"2026-05-31T06:46:26Z","snapshot_observed_at":"2026-08-02T00:24:45.749093Z","submitted_at":"2026-05-31T06:46:26Z","title":"Interaction-Limited Safe Continuous-Time RL for Dynamical Medical Treatment","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-28T17:58:59.805574Z"},"links":{"citing_paper":"/paper/2606.01051"},"observation_digest":"sha256:ab3f5d3440336c456620f1e57bcc51ffe6e5bf34d61f4f5d852dc3e9000f53aa","observation_id":"efc7faa4-51e0-4bd1-a7a3-5eb4e1318f01","resolution":{"observed_at":"2026-06-28T17:58:59.805574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T17:58:59.805574Z","title":"Optimal treatment strategies for critical patients with deep reinforcement learning.ACM Transactions on Intelligent Systems and Technology, 15(2):1–22, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.01051","last_updated":"2026-05-31T06:46:26Z","snapshot_observed_at":"2026-08-02T00:24:45.749093Z","submitted_at":"2026-05-31T06:46:26Z","title":"Interaction-Limited Safe Continuous-Time RL for Dynamical Medical Treatment","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-28T17:58:59.805574Z"},"links":{"citing_paper":"/paper/2606.01051"},"observation_digest":"sha256:dc9a69beaa26039033f625b67bf537ab54b2755e707da012a8026aec103f4305","observation_id":"e71b774c-812c-4032-a3f8-3d59267f147b","resolution":{"observed_at":"2026-06-28T17:58:59.805574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1038/sdata.2016.35","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"MIMIC-III, a freely accessible critical care database","venue":"Scientific Data","work_id":"673c213a-7352-4186-9d68-0046d5e2ec44","year":2016},"citing_paper":{"arxiv_id":"2606.01051","last_updated":"2026-05-31T06:46:26Z","snapshot_observed_at":"2026-08-02T00:24:45.749093Z","submitted_at":"2026-05-31T06:46:26Z","title":"Interaction-Limited Safe Continuous-Time RL for Dynamical Medical Treatment","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-28T17:58:59.805574Z"},"links":{"citing_paper":"/paper/2606.01051"},"observation_digest":"sha256:d63dc88ed65e726047d0de9c649e77070bf12924e90163fb21cfdbfe2ab24ca7","observation_id":"0bcd403a-7b98-4e3b-83b7-5ec90a8d9d35","resolution":{"observed_at":"2026-06-28T18:02:26.499765Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-08T07:08:16.744854+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-08T07:08:16.744854+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T17:58:59.805574Z","title":"Komorowski, L.A","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2606.01051","last_updated":"2026-05-31T06:46:26Z","snapshot_observed_at":"2026-08-02T00:24:45.749093Z","submitted_at":"2026-05-31T06:46:26Z","title":"Interaction-Limited Safe Continuous-Time RL for Dynamical Medical Treatment","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-28T17:58:59.805574Z"},"links":{"citing_paper":"/paper/2606.01051"},"observation_digest":"sha256:ed44ff3341a6317d63387563eaf810955f17e554fbb72b884b3fb50fadcc6965","observation_id":"9ad598ed-65d7-467a-b099-0f8ad67036c9","resolution":{"observed_at":"2026-06-28T17:58:59.805574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T17:58:59.805574Z","title":"Jedlicki, David Ouyang, Anthony Philippakis, David Sontag, and Ahmed M","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.01051","last_updated":"2026-05-31T06:46:26Z","snapshot_observed_at":"2026-08-02T00:24:45.749093Z","submitted_at":"2026-05-31T06:46:26Z","title":"Interaction-Limited Safe Continuous-Time RL for Dynamical Medical Treatment","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-28T17:58:59.805574Z"},"links":{"citing_paper":"/paper/2606.01051"},"observation_digest":"sha256:86175f065f3e8cc79f0c140d180240d1e382bca7586f43b9afa6a7b375ba1514","observation_id":"d1899cd2-5586-447e-878c-5158cc4eb872","resolution":{"observed_at":"2026-06-28T17:58:59.805574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T17:58:59.805574Z","title":"Lingsch, Dana Grund, Siddhartha Mishra, and Georgios Kissas","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.01051","last_updated":"2026-05-31T06:46:26Z","snapshot_observed_at":"2026-08-02T00:24:45.749093Z","submitted_at":"2026-05-31T06:46:26Z","title":"Interaction-Limited Safe Continuous-Time RL for Dynamical Medical Treatment","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-28T17:58:59.805574Z"},"links":{"citing_paper":"/paper/2606.01051"},"observation_digest":"sha256:7e80edb3b9f12f67406cb41aec10e7e20a7b28dde7607825e8c05a39681d45fc","observation_id":"661366ba-d158-459c-8675-3ba967af9937","resolution":{"observed_at":"2026-06-28T17:58:59.805574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T17:58:59.805574Z","title":"Time-regularized interrupting options (trio)","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2606.01051","last_updated":"2026-05-31T06:46:26Z","snapshot_observed_at":"2026-08-02T00:24:45.749093Z","submitted_at":"2026-05-31T06:46:26Z","title":"Interaction-Limited Safe Continuous-Time RL for Dynamical Medical Treatment","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-28T17:58:59.805574Z"},"links":{"citing_paper":"/paper/2606.01051"},"observation_digest":"sha256:76cce02be36c4369369a53171eebf2215b2db081f9726b8ec3ce1ec0520137f3","observation_id":"e37be4a4-9e1c-480a-9406-f775564286cd","resolution":{"observed_at":"2026-06-28T17:58:59.805574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T17:58:59.805574Z","title":"Nambiar, S","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.01051","last_updated":"2026-05-31T06:46:26Z","snapshot_observed_at":"2026-08-02T00:24:45.749093Z","submitted_at":"2026-05-31T06:46:26Z","title":"Interaction-Limited Safe Continuous-Time RL for Dynamical Medical Treatment","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-28T17:58:59.805574Z"},"links":{"citing_paper":"/paper/2606.01051"},"observation_digest":"sha256:3a9da4fb472e97b66f08827c80befa50cebe991caeb991e6eb8de42388e79918","observation_id":"276009fb-8cf7-47a3-9b36-2523a2099e4d","resolution":{"observed_at":"2026-06-28T17:58:59.805574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T17:58:59.805574Z","title":"Prescott, Massimo Antonelli, Waleed Alhazzani, Morten Hylander Møller, Fayez Alshamsi, Luciano C","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.01051","last_updated":"2026-05-31T06:46:26Z","snapshot_observed_at":"2026-08-02T00:24:45.749093Z","submitted_at":"2026-05-31T06:46:26Z","title":"Interaction-Limited Safe Continuous-Time RL for Dynamical Medical Treatment","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-28T17:58:59.805574Z"},"links":{"citing_paper":"/paper/2606.01051"},"observation_digest":"sha256:ff24d506509f7c0b37af1b84be8ff9ba290fd53317a2b76475abfb5a38340c33","observation_id":"013523da-e610-40b2-a685-f61bc84dbe27","resolution":{"observed_at":"2026-06-28T17:58:59.805574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1016/j.jcp.2018.10.045","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T10:17:00.970707Z","title":"Raissi, P","venue":"Journal of Computational Physics","work_id":"16a1de8a-4145-44c7-a263-8f01bfe9ca2e","year":2019},"citing_paper":{"arxiv_id":"2606.01051","last_updated":"2026-05-31T06:46:26Z","snapshot_observed_at":"2026-08-02T00:24:45.749093Z","submitted_at":"2026-05-31T06:46:26Z","title":"Interaction-Limited Safe Continuous-Time RL for Dynamical Medical Treatment","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-28T17:58:59.805574Z"},"links":{"citing_paper":"/paper/2606.01051"},"observation_digest":"sha256:503ff8fe709602fa56656b0eeb9ab88606e2a98cafb0bee0e0db76ba25b52630","observation_id":"a14bce2b-aaf3-4691-beac-d6c96c33d759","resolution":{"observed_at":"2026-06-28T18:02:26.502025Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T18:38:13.615655+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T18:38:13.615655+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-10T18:38:13.615655+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.16789","doi":"10.48550/arxiv.2603.16789","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Conservative continuous-time treatment optimization.arXiv preprint, 2026","venue":"arXiv (Cornell University)","work_id":"b46698ec-f24d-4187-b85e-f718085e8c75","year":2026},"citing_paper":{"arxiv_id":"2606.01051","last_updated":"2026-05-31T06:46:26Z","snapshot_observed_at":"2026-08-02T00:24:45.749093Z","submitted_at":"2026-05-31T06:46:26Z","title":"Interaction-Limited Safe Continuous-Time RL for Dynamical Medical Treatment","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-28T17:58:59.805574Z"},"links":{"citing_paper":"/paper/2606.01051"},"observation_digest":"sha256:424aed2d9ce7675ebf5e13eedca7cabc44281d469c886aab97a3a75674b79b9e","observation_id":"0d7047f1-b93e-4b0a-94e5-f9f010424728","resolution":{"observed_at":"2026-06-28T18:02:26.497930Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T17:58:59.805574Z","title":"Trust region policy optimization","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2606.01051","last_updated":"2026-05-31T06:46:26Z","snapshot_observed_at":"2026-08-02T00:24:45.749093Z","submitted_at":"2026-05-31T06:46:26Z","title":"Interaction-Limited Safe Continuous-Time RL for Dynamical Medical Treatment","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-28T17:58:59.805574Z"},"links":{"citing_paper":"/paper/2606.01051"},"observation_digest":"sha256:832adab0cb92e43ff44807c56228c8243c5b2a5a6f6d74772596ba23ba843288","observation_id":"a696f331-301b-4c17-894b-f25cca2373a6","resolution":{"observed_at":"2026-06-28T17:58:59.805574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T17:58:59.805574Z","title":"Probabilistic reachable sets of stochastic nonlinear systems with contextual uncertainties.Automatica, 176: 112237, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.01051","last_updated":"2026-05-31T06:46:26Z","snapshot_observed_at":"2026-08-02T00:24:45.749093Z","submitted_at":"2026-05-31T06:46:26Z","title":"Interaction-Limited Safe Continuous-Time RL for Dynamical Medical Treatment","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-28T17:58:59.805574Z"},"links":{"citing_paper":"/paper/2606.01051"},"observation_digest":"sha256:c63a3bff95af457d6c6432a71a9b4b55f590a4f1de21d24aee05357cc81a81c5","observation_id":"f5ce8d26-739d-4627-8cf4-4e2c3d7bb0bc","resolution":{"observed_at":"2026-06-28T17:58:59.805574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T17:58:59.805574Z","title":"Deutschman, Christopher W","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2606.01051","last_updated":"2026-05-31T06:46:26Z","snapshot_observed_at":"2026-08-02T00:24:45.749093Z","submitted_at":"2026-05-31T06:46:26Z","title":"Interaction-Limited Safe Continuous-Time RL for Dynamical Medical Treatment","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-06-28T17:58:59.805574Z"},"links":{"citing_paper":"/paper/2606.01051"},"observation_digest":"sha256:e05ca2d5f5a860937389c1d377dbf80db55431426afd3dc7c2dd20058603648c","observation_id":"b0c90e31-59ab-4d41-9f4b-048e83401b5b","resolution":{"observed_at":"2026-06-28T17:58:59.805574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T17:58:59.805574Z","title":"The spectrum of sepsis-associated encephalopathy: a clinical perspective.Critical Care, 27(1):386, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.01051","last_updated":"2026-05-31T06:46:26Z","snapshot_observed_at":"2026-08-02T00:24:45.749093Z","submitted_at":"2026-05-31T06:46:26Z","title":"Interaction-Limited Safe Continuous-Time RL for Dynamical Medical Treatment","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-28T17:58:59.805574Z"},"links":{"citing_paper":"/paper/2606.01051"},"observation_digest":"sha256:155e752e56e2ca5a060cdd8a56f7be48fd2ba76bd176348ca9524392c21b3c93","observation_id":"3b6d4064-b0fb-4e63-8e72-75a7370f1eef","resolution":{"observed_at":"2026-06-28T17:58:59.805574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T17:58:59.805574Z","title":"Between mdps and semi-mdps: A framework for temporal abstraction in reinforcement learning.Artificial intelligence, 112(1-2): 181–211, 1999","venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2606.01051","last_updated":"2026-05-31T06:46:26Z","snapshot_observed_at":"2026-08-02T00:24:45.749093Z","submitted_at":"2026-05-31T06:46:26Z","title":"Interaction-Limited Safe Continuous-Time RL for Dynamical Medical Treatment","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-06-28T17:58:59.805574Z"},"links":{"citing_paper":"/paper/2606.01051"},"observation_digest":"sha256:d30a1651bd28fa424cc2b8f3f21ec0cfe287df4caab568ef3ef9f6115ba95bcc","observation_id":"29a7c0ac-1610-4585-a216-93421af2b0e9","resolution":{"observed_at":"2026-06-28T17:58:59.805574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T17:58:59.805574Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2606.01051","last_updated":"2026-05-31T06:46:26Z","snapshot_observed_at":"2026-08-02T00:24:45.749093Z","submitted_at":"2026-05-31T06:46:26Z","title":"Interaction-Limited Safe Continuous-Time RL for Dynamical Medical Treatment","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-06-28T17:58:59.805574Z"},"links":{"citing_paper":"/paper/2606.01051"},"observation_digest":"sha256:6f05d5149e889ab105ade682023d7efd953a29d2e079f3df77a06eb5383b6b45","observation_id":"58f9cc0d-efe0-4e50-9789-e38078ec8755","resolution":{"observed_at":"2026-06-28T17:58:59.805574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T17:58:59.805574Z","title":"Efficient exploration in continuous-time model-based reinforcement learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.01051","last_updated":"2026-05-31T06:46:26Z","snapshot_observed_at":"2026-08-02T00:24:45.749093Z","submitted_at":"2026-05-31T06:46:26Z","title":"Interaction-Limited Safe Continuous-Time RL for Dynamical Medical Treatment","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-06-28T17:58:59.805574Z"},"links":{"citing_paper":"/paper/2606.01051"},"observation_digest":"sha256:a041ce74b3de93a40409c397a35c2eb0fb20aa4c4155f8212f6743a2db4dbf40","observation_id":"edca147f-9735-48e3-bdfe-b199ec3ae31e","resolution":{"observed_at":"2026-06-28T17:58:59.805574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T17:58:59.805574Z","title":"When to sense and control? a time-adaptive approach for continuous-time reinforcement learning","venue":null,"work_id":null,"year":2033},"citing_paper":{"arxiv_id":"2606.01051","last_updated":"2026-05-31T06:46:26Z","snapshot_observed_at":"2026-08-02T00:24:45.749093Z","submitted_at":"2026-05-31T06:46:26Z","title":"Interaction-Limited Safe Continuous-Time RL for Dynamical Medical Treatment","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-06-28T17:58:59.805574Z"},"links":{"citing_paper":"/paper/2606.01051"},"observation_digest":"sha256:6fb4ef3004099e9e201b3a7ce0f1d1e6124744c7df4d355c140474585032dfdd","observation_id":"ad8a95ce-7a84-40ae-aa98-3afc6f6a9706","resolution":{"observed_at":"2026-06-28T17:58:59.805574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T17:58:59.805574Z","title":"Guardian-regularized safe offline reinforcement learning for smart weaning of mechanical circulatory devices","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.01051","last_updated":"2026-05-31T06:46:26Z","snapshot_observed_at":"2026-08-02T00:24:45.749093Z","submitted_at":"2026-05-31T06:46:26Z","title":"Interaction-Limited Safe Continuous-Time RL for Dynamical Medical Treatment","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-06-28T17:58:59.805574Z"},"links":{"citing_paper":"/paper/2606.01051"},"observation_digest":"sha256:18b1f838597735422ad319460527171f1757cb6c35f832dcde1c069337d11741","observation_id":"1073a43e-35da-4032-9591-64fd867ab2e7","resolution":{"observed_at":"2026-06-28T17:58:59.805574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T17:58:59.805574Z","title":"Cambridge University Press, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2606.01051","last_updated":"2026-05-31T06:46:26Z","snapshot_observed_at":"2026-08-02T00:24:45.749093Z","submitted_at":"2026-05-31T06:46:26Z","title":"Interaction-Limited Safe Continuous-Time RL for Dynamical Medical Treatment","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-06-28T17:58:59.805574Z"},"links":{"citing_paper":"/paper/2606.01051"},"observation_digest":"sha256:f143eef2677b813b16250c998623b7e430056b17c8982e01e090ffedc8780dca","observation_id":"cb97ef10-b076-4626-b6ec-d4093962d106","resolution":{"observed_at":"2026-06-28T17:58:59.805574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T17:58:59.805574Z","title":"West and Andrew M","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.01051","last_updated":"2026-05-31T06:46:26Z","snapshot_observed_at":"2026-08-02T00:24:45.749093Z","submitted_at":"2026-05-31T06:46:26Z","title":"Interaction-Limited Safe Continuous-Time RL for Dynamical Medical Treatment","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-06-28T17:58:59.805574Z"},"links":{"citing_paper":"/paper/2606.01051"},"observation_digest":"sha256:07717365272917aaaad944343eb7c1ec5529c854e80377374689e5430474626d","observation_id":"65871e73-f3db-4d0f-8a58-d19b56f72499","resolution":{"observed_at":"2026-06-28T17:58:59.805574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T17:58:59.805574Z","title":"Offline guarded safe reinforcement learning for medical treatment optimization strategies.Proceedings of the 39th Advances in Neural Information Processing Systems, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.01051","last_updated":"2026-05-31T06:46:26Z","snapshot_observed_at":"2026-08-02T00:24:45.749093Z","submitted_at":"2026-05-31T06:46:26Z","title":"Interaction-Limited Safe Continuous-Time RL for Dynamical Medical Treatment","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-06-28T17:58:59.805574Z"},"links":{"citing_paper":"/paper/2606.01051"},"observation_digest":"sha256:799fa8d3f0a6f4072754c0dd8d628ef6d39af62183e1c053b69fcba1d9516b3d","observation_id":"dbdc22b2-ff4d-490e-aa05-7ceddf39d224","resolution":{"observed_at":"2026-06-28T17:58:59.805574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T17:58:59.805574Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.01051","last_updated":"2026-05-31T06:46:26Z","snapshot_observed_at":"2026-08-02T00:24:45.749093Z","submitted_at":"2026-05-31T06:46:26Z","title":"Interaction-Limited Safe Continuous-Time RL for Dynamical Medical Treatment","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-06-28T17:58:59.805574Z"},"links":{"citing_paper":"/paper/2606.01051"},"observation_digest":"sha256:ff27f13590b207c56994b5eb6b63c47c023ae315255367ad1daf457739401f94","observation_id":"32f1564b-9c41-4f01-8acd-f98029ac3c3a","resolution":{"observed_at":"2026-06-28T17:58:59.805574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T17:58:59.805574Z","title":"Yildiz, M","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.01051","last_updated":"2026-05-31T06:46:26Z","snapshot_observed_at":"2026-08-02T00:24:45.749093Z","submitted_at":"2026-05-31T06:46:26Z","title":"Interaction-Limited Safe Continuous-Time RL for Dynamical Medical Treatment","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-06-28T17:58:59.805574Z"},"links":{"citing_paper":"/paper/2606.01051"},"observation_digest":"sha256:21982b68cc5432a792baa3e1adb3b7eda4bf42112ff178f91e302f5f87968cba","observation_id":"ee52e7a1-b06b-47cb-b513-09f9ff8120e3","resolution":{"observed_at":"2026-06-28T17:58:59.805574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T17:58:59.805574Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.01051","last_updated":"2026-05-31T06:46:26Z","snapshot_observed_at":"2026-08-02T00:24:45.749093Z","submitted_at":"2026-05-31T06:46:26Z","title":"Interaction-Limited Safe Continuous-Time RL for Dynamical Medical Treatment","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-06-28T17:58:59.805574Z"},"links":{"citing_paper":"/paper/2606.01051"},"observation_digest":"sha256:50fb5392f9108de666a280949d5ce001d4494afad2f31a0f492295bbfb331ceb","observation_id":"5930826d-312e-4c51-8f3a-284f257e7ac4","resolution":{"observed_at":"2026-06-28T17:58:59.805574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T17:58:59.805574Z","title":"Continuous-time decision transformer for healthcare applications","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.01051","last_updated":"2026-05-31T06:46:26Z","snapshot_observed_at":"2026-08-02T00:24:45.749093Z","submitted_at":"2026-05-31T06:46:26Z","title":"Interaction-Limited Safe Continuous-Time RL for Dynamical Medical Treatment","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-06-28T17:58:59.805574Z"},"links":{"citing_paper":"/paper/2606.01051"},"observation_digest":"sha256:23a342a7b7be808207a25e6341d5894a07e94d60624881305ef82f0259af6aa9","observation_id":"5a7b38ea-b164-4fb6-8e2a-f9fe85a593d2","resolution":{"observed_at":"2026-06-28T17:58:59.805574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"1459.2021","doi":"10.1080/01621459.2021.1874961","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Graphical Models for Processing Missing Data","venue":"Journal of the American Statistical Association","work_id":"cedbb8cd-4355-4661-9d7a-1d12a91d0dd9","year":2021},"citing_paper":{"arxiv_id":"2606.01051","last_updated":"2026-05-31T06:46:26Z","snapshot_observed_at":"2026-08-02T00:24:45.749093Z","submitted_at":"2026-05-31T06:46:26Z","title":"Interaction-Limited Safe Continuous-Time RL for Dynamical Medical Treatment","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-06-28T17:58:59.805574Z"},"links":{"citing_paper":"/paper/2606.01051"},"observation_digest":"sha256:d3f610ae994fdc10e161d088def724daf2469854fbeda5f4fb4a0a3a550b968d","observation_id":"3f3d526e-9116-4654-870e-731c5c5e04f1","resolution":{"observed_at":"2026-06-28T18:02:26.906913Z","resolver_source":"arxiv_id","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T17:58:59.805574Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.01051","last_updated":"2026-05-31T06:46:26Z","snapshot_observed_at":"2026-08-02T00:24:45.749093Z","submitted_at":"2026-05-31T06:46:26Z","title":"Interaction-Limited Safe Continuous-Time RL for Dynamical Medical Treatment","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-06-28T17:58:59.805574Z"},"links":{"citing_paper":"/paper/2606.01051"},"observation_digest":"sha256:207e2c60f9ed77dab845b73b8246da9a0d8a83fc5ed4a05588e9f4f1b1768533","observation_id":"b4ec18c2-1d11-4684-8aa1-814d0b6fc387","resolution":{"observed_at":"2026-06-28T17:58:59.805574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T17:58:59.805574Z","title":"35 Proof.SinceF(· |x, δt)is continuous and strictly increasing, the equation F(d s |x, δt) = 1−¯ϵ h has a unique solution","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.01051","last_updated":"2026-05-31T06:46:26Z","snapshot_observed_at":"2026-08-02T00:24:45.749093Z","submitted_at":"2026-05-31T06:46:26Z","title":"Interaction-Limited Safe Continuous-Time RL for Dynamical Medical Treatment","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-06-28T17:58:59.805574Z"},"links":{"citing_paper":"/paper/2606.01051"},"observation_digest":"sha256:af8928508714da4cc860a1cc8c3cfef01c87c6fedb63668aef467020beebf95b","observation_id":"6d4bdb7a-fe85-4dd8-a45a-1906c33f9c3b","resolution":{"observed_at":"2026-06-28T17:58:59.805574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2606.01051","last_updated":"2026-05-31T06:46:26Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-02T00:24:45.749093Z","submitted_at":"2026-05-31T06:46:26Z","title":"Interaction-Limited Safe Continuous-Time RL for Dynamical Medical Treatment"},"reference_resolution":{"displayed":45,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":41,"verified_exact":3,"verified_fuzzy":0},"total_outbound_references":45},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 45 of 45 outbound references and 0 inbound Pith citation observations for arXiv:2606.01051."}