{"as_of":"2026-08-08T17:55:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:60a1eca070cf6320e3ee3795af1962832eccf27b24ef349338ce8b0be160bf17","coverage":[{"denominator":17,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":17,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T16:13:32.534554Z","state":"measured"},{"denominator":17,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":17,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.03606/citation-record","integrity":"/paper/2608.03606/integrity","json":"/paper/2608.03606/citation-record.json","paper":"/paper/2608.03606"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:13:34.517023Z","title":"When does return-conditioned supervised learning work for offline reinforcement learning? In Advances in Neural Information Processing Systems (NeurIPS), 2022","venue":null,"work_id":"59222ebc-bd66-4c19-a6b5-824e1acc14d8","year":2022},"citing_paper":{"arxiv_id":"2608.03606","last_updated":"2026-08-04T12:58:17Z","snapshot_observed_at":"2026-08-08T09:01:40.979192Z","submitted_at":"2026-08-04T12:58:17Z","title":"Learning Clinical-Trial Strategy: Offline Policy Training for Decision Agents","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-05T16:13:30.916113Z"},"links":{"citing_paper":"/paper/2608.03606"},"observation_digest":"sha256:9ab07f9ae0630ca6a3f5805ad1a76d44ea60285563cbb06cefbd4f2a09acdf85","observation_id":"afc4603b-355a-40c4-8a58-d983a7be7eac","resolution":{"observed_at":"2026-08-05T16:13:34.586091Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:13:34.343301Z","title":"Trialbench: Multi-modal ai-ready datasets for clinical trial prediction","venue":null,"work_id":"fc5c59aa-4db1-4e12-8079-590bc21a4fe5","year":2025},"citing_paper":{"arxiv_id":"2608.03606","last_updated":"2026-08-04T12:58:17Z","snapshot_observed_at":"2026-08-08T09:01:40.979192Z","submitted_at":"2026-08-04T12:58:17Z","title":"Learning Clinical-Trial Strategy: Offline Policy Training for Decision Agents","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-05T16:13:30.980647Z"},"links":{"citing_paper":"/paper/2608.03606"},"observation_digest":"sha256:4e721ce948ae4603289ad7693d01aa1c54db26f3fb6dd6f7d3554c2dba9b39f4","observation_id":"38f39604-1bfa-4b84-aa82-291ad7815dc3","resolution":{"observed_at":"2026-08-05T16:13:34.430927Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:13:34.162530Z","title":"Decision transformer: Reinforcement learning via sequence modeling","venue":null,"work_id":"a1e2e435-7d67-4cfe-b76d-cb711d922965","year":2021},"citing_paper":{"arxiv_id":"2608.03606","last_updated":"2026-08-04T12:58:17Z","snapshot_observed_at":"2026-08-08T09:01:40.979192Z","submitted_at":"2026-08-04T12:58:17Z","title":"Learning Clinical-Trial Strategy: Offline Policy Training for Decision Agents","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-05T16:13:31.080200Z"},"links":{"citing_paper":"/paper/2608.03606"},"observation_digest":"sha256:498698ff8a044d5cab26ca900d0b78a5eb608698460dc55fa580b9f4ee4d6e84","observation_id":"5da2eff5-4b16-4c94-b88a-ef16e1155ff8","resolution":{"observed_at":"2026-08-05T16:13:34.246840Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:13:34.015205Z","title":"RvS : What is essential for offline RL via supervised learning? In International Conference on Learning Representations (ICLR), 2022","venue":null,"work_id":"31dd869d-fd50-4162-a378-c25f6c77abb4","year":2022},"citing_paper":{"arxiv_id":"2608.03606","last_updated":"2026-08-04T12:58:17Z","snapshot_observed_at":"2026-08-08T09:01:40.979192Z","submitted_at":"2026-08-04T12:58:17Z","title":"Learning Clinical-Trial Strategy: Offline Policy Training for Decision Agents","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-05T16:13:31.190307Z"},"links":{"citing_paper":"/paper/2608.03606"},"observation_digest":"sha256:66a929bf3d9b2284203efedb2bcfafe9ad3931b2ed0ec222df251eef321d7feb","observation_id":"1622e00c-6655-4a91-84e2-7a510dd0df6a","resolution":{"observed_at":"2026-08-05T16:13:34.084594Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:13:33.841398Z","title":"M., and Sun, J","venue":null,"work_id":"500858ff-7ff8-46ca-aeef-2f471b33adf7","year":2022},"citing_paper":{"arxiv_id":"2608.03606","last_updated":"2026-08-04T12:58:17Z","snapshot_observed_at":"2026-08-08T09:01:40.979192Z","submitted_at":"2026-08-04T12:58:17Z","title":"Learning Clinical-Trial Strategy: Offline Policy Training for Decision Agents","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-05T16:13:31.328397Z"},"links":{"citing_paper":"/paper/2608.03606"},"observation_digest":"sha256:c3af27f801ab7e4dd184024b5b95307f0f7efffd5782646006b8b90f5cc5119f","observation_id":"579859c7-4d9c-472b-9f29-69d511b9bfc7","resolution":{"observed_at":"2026-08-05T16:13:33.920918Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:13:33.693419Z","title":"Biomni: A general-purpose biomedical ai agent","venue":null,"work_id":"2d3e1107-bead-437e-b08c-6666b6fbcf80","year":2025},"citing_paper":{"arxiv_id":"2608.03606","last_updated":"2026-08-04T12:58:17Z","snapshot_observed_at":"2026-08-08T09:01:40.979192Z","submitted_at":"2026-08-04T12:58:17Z","title":"Learning Clinical-Trial Strategy: Offline Policy Training for Decision Agents","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-05T16:13:31.425518Z"},"links":{"citing_paper":"/paper/2608.03606"},"observation_digest":"sha256:8af91117a9268f532d7db121451644f5e06c1c75de2316f2f9785ae6ad6af471","observation_id":"f59a5af0-eaa2-41da-8b69-569bb770be4a","resolution":{"observed_at":"2026-08-05T16:13:33.765955Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:13:33.512401Z","title":"Offline reinforcement learning as one big sequence modeling problem","venue":null,"work_id":"360479b8-3787-4de4-a7f3-bd8691c54618","year":2021},"citing_paper":{"arxiv_id":"2608.03606","last_updated":"2026-08-04T12:58:17Z","snapshot_observed_at":"2026-08-08T09:01:40.979192Z","submitted_at":"2026-08-04T12:58:17Z","title":"Learning Clinical-Trial Strategy: Offline Policy Training for Decision Agents","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-05T16:13:31.523538Z"},"links":{"citing_paper":"/paper/2608.03606"},"observation_digest":"sha256:47332cee72d14ccb820b34ca22fe396e2aea30986e704dfecc9402f2dceaf658","observation_id":"ca1d33fd-607d-4ac2-afec-17cb1960ada6","resolution":{"observed_at":"2026-08-05T16:13:33.601148Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:13:33.357732Z","title":"S., Chen, F., Gong, C., Bracken-Clarke, D., Xue, E., Yang, Y., Sun, J., and Lu, Z","venue":null,"work_id":"146c86d7-6fa6-4a62-848f-ed6c3557c36a","year":2024},"citing_paper":{"arxiv_id":"2608.03606","last_updated":"2026-08-04T12:58:17Z","snapshot_observed_at":"2026-08-08T09:01:40.979192Z","submitted_at":"2026-08-04T12:58:17Z","title":"Learning Clinical-Trial Strategy: Offline Policy Training for Decision Agents","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-05T16:13:31.673635Z"},"links":{"citing_paper":"/paper/2608.03606"},"observation_digest":"sha256:679f1d004033765339e33711ceb70c90a003be3382e2013cab292ab5d312ae07","observation_id":"b003f1de-35c9-4997-9668-436c8bb5d323","resolution":{"observed_at":"2026-08-05T16:13:33.416324Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.06169","last_updated":"2021-10-12T17:05:05Z","snapshot_observed_at":"2026-08-06T15:42:21.967989Z","submitted_at":"2021-10-12T17:05:05Z","title":"Offline Reinforcement Learning with Implicit Q-Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.06169","snapshot_observed_at":"2026-08-05T16:13:31.791314Z","title":"Offline reinforcement learning with implicit q-learning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.03606","last_updated":"2026-08-04T12:58:17Z","snapshot_observed_at":"2026-08-08T09:01:40.979192Z","submitted_at":"2026-08-04T12:58:17Z","title":"Learning Clinical-Trial Strategy: Offline Policy Training for Decision Agents","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-05T16:13:31.791314Z"},"links":{"cited_paper":"/paper/2110.06169","citing_paper":"/paper/2608.03606"},"observation_digest":"sha256:7c51e221412a7b564bb67e1751762b33e80951f955f1421a54be1d350456c32d","observation_id":"6c72ebba-9545-4f59-9141-343fe579b2ea","resolution":{"observed_at":"2026-08-05T16:13:31.791314Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.05618","last_updated":"2022-04-12T08:25:34Z","snapshot_observed_at":"2026-07-06T12:59:27.558579Z","submitted_at":"2022-04-12T08:25:34Z","title":"When Should We Prefer Offline Reinforcement Learning Over Behavioral Cloning?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.05618","snapshot_observed_at":"2026-08-05T16:13:31.897892Z","title":"When should we prefer offline reinforcement learning over behavioral cloning? In International Conference on Learning Representations (ICLR), 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.03606","last_updated":"2026-08-04T12:58:17Z","snapshot_observed_at":"2026-08-08T09:01:40.979192Z","submitted_at":"2026-08-04T12:58:17Z","title":"Learning Clinical-Trial Strategy: Offline Policy Training for Decision Agents","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-05T16:13:31.897892Z"},"links":{"cited_paper":"/paper/2204.05618","citing_paper":"/paper/2608.03606"},"observation_digest":"sha256:49698048fb72d01b78b9594a7193915110c3dba5b22f150389533eecebcc1a3a","observation_id":"944f50eb-2561-49dc-a84b-812052f33c30","resolution":{"observed_at":"2026-08-05T16:13:31.897892Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2005.01643","last_updated":"2020-11-01T23:50:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-05-04T17:00:15Z","title":"Offline Reinforcement Learning: Tutorial, Review, and Perspectives on Open Problems","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.01643","snapshot_observed_at":"2026-08-05T16:13:31.993261Z","title":"Offline reinforcement learning: Tutorial, review, and perspectives on open problems","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2608.03606","last_updated":"2026-08-04T12:58:17Z","snapshot_observed_at":"2026-08-08T09:01:40.979192Z","submitted_at":"2026-08-04T12:58:17Z","title":"Learning Clinical-Trial Strategy: Offline Policy Training for Decision Agents","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-05T16:13:31.993261Z"},"links":{"cited_paper":"/paper/2005.01643","citing_paper":"/paper/2608.03606"},"observation_digest":"sha256:16aaa6950992d0851d28324a2531da19f003c6ee56d59609bfe1d948c8545f88","observation_id":"31346935-d93e-4eef-a9ee-0716b4e983db","resolution":{"observed_at":"2026-08-05T16:13:31.993261Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.09359","last_updated":"2021-04-24T22:39:30Z","snapshot_observed_at":"2026-07-06T09:29:45.475911Z","submitted_at":"2020-06-16T17:54:41Z","title":"AWAC: Accelerating Online Reinforcement Learning with Offline Datasets","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.09359","snapshot_observed_at":"2026-08-05T16:13:32.092136Z","title":"Awac: Accelerating online reinforcement learning with offline datasets","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2608.03606","last_updated":"2026-08-04T12:58:17Z","snapshot_observed_at":"2026-08-08T09:01:40.979192Z","submitted_at":"2026-08-04T12:58:17Z","title":"Learning Clinical-Trial Strategy: Offline Policy Training for Decision Agents","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-05T16:13:32.092136Z"},"links":{"cited_paper":"/paper/2006.09359","citing_paper":"/paper/2608.03606"},"observation_digest":"sha256:444281c6b1363c57f5d28fd9a61f6139d4b5f18366ef66981d9275db5433d6e4","observation_id":"2c652392-baf9-4b45-99d8-a23efea3cc03","resolution":{"observed_at":"2026-08-05T16:13:32.092136Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.00177","last_updated":"2019-10-07T20:23:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2019-10-01T02:23:38Z","title":"Advantage-Weighted Regression: Simple and Scalable Off-Policy Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.00177","snapshot_observed_at":"2026-08-05T16:13:32.177880Z","title":"B., Kumar, A., Zhang, G., and Levine, S","venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2608.03606","last_updated":"2026-08-04T12:58:17Z","snapshot_observed_at":"2026-08-08T09:01:40.979192Z","submitted_at":"2026-08-04T12:58:17Z","title":"Learning Clinical-Trial Strategy: Offline Policy Training for Decision Agents","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-05T16:13:32.177880Z"},"links":{"cited_paper":"/paper/1910.00177","citing_paper":"/paper/2608.03606"},"observation_digest":"sha256:8e13f478c972e3d94bed1e03286cc2b915c7121f4a35e6f577927bab188f6078","observation_id":"29627c24-ad87-4a42-975e-dc0a530d7dd2","resolution":{"observed_at":"2026-08-05T16:13:32.177880Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:13:33.171185Z","title":"F., Maximo, M","venue":null,"work_id":"a90ded2f-5187-488e-ba4b-990fde809764","year":2023},"citing_paper":{"arxiv_id":"2608.03606","last_updated":"2026-08-04T12:58:17Z","snapshot_observed_at":"2026-08-08T09:01:40.979192Z","submitted_at":"2026-08-04T12:58:17Z","title":"Learning Clinical-Trial Strategy: Offline Policy Training for Decision Agents","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-05T16:13:32.262350Z"},"links":{"citing_paper":"/paper/2608.03606"},"observation_digest":"sha256:22b9a9ffc4114a8f9341d823985e421204d7cfa1b3e4be2f31d116c6c31ceea4","observation_id":"a7a2ef60-d035-4892-8844-b40f0b341648","resolution":{"observed_at":"2026-08-05T16:13:33.263990Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.07960","last_updated":"2025-05-25T02:19:37Z","snapshot_observed_at":"2026-07-30T08:34:47.046912Z","submitted_at":"2024-05-13T17:38:53Z","title":"AgentClinic: a multimodal agent benchmark to evaluate AI in simulated clinical environments","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.07960","snapshot_observed_at":"2026-08-05T16:13:32.341671Z","title":"Agentclinic: a multimodal agent benchmark to evaluate ai in simulated clinical environments","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.03606","last_updated":"2026-08-04T12:58:17Z","snapshot_observed_at":"2026-08-08T09:01:40.979192Z","submitted_at":"2026-08-04T12:58:17Z","title":"Learning Clinical-Trial Strategy: Offline Policy Training for Decision Agents","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-05T16:13:32.341671Z"},"links":{"cited_paper":"/paper/2405.07960","citing_paper":"/paper/2608.03606"},"observation_digest":"sha256:25ed9f21af2399e4a318a2c69304065e922d9182053a08d03f2f02897ea02728","observation_id":"4dd17814-fe04-48aa-955f-5411bc480670","resolution":{"observed_at":"2026-08-05T16:13:32.341671Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:13:32.983360Z","title":"and Kim, Y","venue":null,"work_id":"23f4f946-569f-4e0d-b7db-f8ab54138a88","year":2023},"citing_paper":{"arxiv_id":"2608.03606","last_updated":"2026-08-04T12:58:17Z","snapshot_observed_at":"2026-08-08T09:01:40.979192Z","submitted_at":"2026-08-04T12:58:17Z","title":"Learning Clinical-Trial Strategy: Offline Policy Training for Decision Agents","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-05T16:13:32.446109Z"},"links":{"citing_paper":"/paper/2608.03606"},"observation_digest":"sha256:f7abe0ff031c3db444e5fd8d8b05e6cacc1ae7dcd65373abacf6bf6a1402713b","observation_id":"04eae1dd-7bdd-4e88-8e1d-141492700fc3","resolution":{"observed_at":"2026-08-05T16:13:33.067634Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:13:32.789869Z","title":"T., Reed, S., Shahriari, B., Siegel, N., Merel, J., Gulcehre, C., Heess, N., and de Freitas, N","venue":null,"work_id":"fe38bf9f-0d3a-432f-b3b3-e54f611b90ce","year":2020},"citing_paper":{"arxiv_id":"2608.03606","last_updated":"2026-08-04T12:58:17Z","snapshot_observed_at":"2026-08-08T09:01:40.979192Z","submitted_at":"2026-08-04T12:58:17Z","title":"Learning Clinical-Trial Strategy: Offline Policy Training for Decision Agents","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-05T16:13:32.534554Z"},"links":{"citing_paper":"/paper/2608.03606"},"observation_digest":"sha256:02d3b826790292a117029ff5f6af331150329d323658f9034dbc664478683f14","observation_id":"6b935df0-b80e-450c-81b0-cf1d5b38c049","resolution":{"observed_at":"2026-08-05T16:13:32.848904Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.03606","last_updated":"2026-08-04T12:58:17Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-08T09:01:40.979192Z","submitted_at":"2026-08-04T12:58:17Z","title":"Learning Clinical-Trial Strategy: Offline Policy Training for Decision Agents"},"reference_resolution":{"displayed":17,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":6,"verified_exact":0,"verified_fuzzy":11},"total_outbound_references":17},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 17 of 17 outbound references and 0 inbound Pith citation observations for arXiv:2608.03606."}