{"as_of":"2026-08-09T17:51:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:fd918133dc1114feed151d48eb3dd2cc7344af31165df65bdc1ebef6546172bf","coverage":[{"denominator":14,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":14,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T15:04:38.869043Z","state":"measured"},{"denominator":14,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":14,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.17056/citation-record","integrity":"/paper/2507.17056/integrity","json":"/paper/2507.17056/citation-record.json","paper":"/paper/2507.17056"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:04:38.958613Z","title":"Following (Matsson et al., 2024a), we restricted the analysis to classes of DMARDs rather than individ- ual drugs","venue":null,"work_id":"f2b2c88a-9ce3-4c4c-a9a7-720c693f8320","year":2018},"citing_paper":{"arxiv_id":"2507.17056","last_updated":"2025-07-22T22:34:35Z","snapshot_observed_at":"2026-08-09T05:16:12.996238Z","submitted_at":"2025-07-22T22:34:35Z","title":"Pragmatic Policy Development via Interpretable Behavior Cloning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T15:04:38.863588Z"},"links":{"citing_paper":"/paper/2507.17056"},"observation_digest":"sha256:b665053bef1ac1af49f1e16eb43860029f2bcc717999c85ff46afc2a6a3e89aa","observation_id":"b0ab8493-e16b-49a2-ba25-e39cd2af6e56","resolution":{"observed_at":"2026-08-06T15:04:38.961367Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1711.08037","last_updated":"2017-11-24T07:02:24Z","snapshot_observed_at":"2026-07-06T06:10:39.125648Z","submitted_at":"2017-11-20T04:19:49Z","title":"The Doctor Just Won't Accept That!","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.08037","snapshot_observed_at":"2026-08-06T15:04:38.842866Z","title":"The doctor just won’t accept that! arXiv preprint arXiv:1711.08037 ,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.17056","last_updated":"2025-07-22T22:34:35Z","snapshot_observed_at":"2026-08-09T05:16:12.996238Z","submitted_at":"2025-07-22T22:34:35Z","title":"Pragmatic Policy Development via Interpretable Behavior Cloning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T15:04:38.842866Z"},"links":{"cited_paper":"/paper/1711.08037","citing_paper":"/paper/2507.17056"},"observation_digest":"sha256:84138165efefd545c64e97f5442a3f5c06ea674addce2886dbbf188e1ea88fd5","observation_id":"1d254811-2815-4910-899a-99d12207bd4b","resolution":{"observed_at":"2026-08-06T15:04:38.842866Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:04:38.950312Z","title":null,"venue":null,"work_id":"80fddb3d-ff31-4339-841b-debd6b4e19d8","year":2015},"citing_paper":{"arxiv_id":"2507.17056","last_updated":"2025-07-22T22:34:35Z","snapshot_observed_at":"2026-08-09T05:16:12.996238Z","submitted_at":"2025-07-22T22:34:35Z","title":"Pragmatic Policy Development via Interpretable Behavior Cloning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T15:04:38.866370Z"},"links":{"citing_paper":"/paper/2507.17056"},"observation_digest":"sha256:7fa7f864cca94d2deba1b9b1c448b7c65fea92552e73a8cb864749eab297c5fa","observation_id":"a7884742-40dd-4060-ab59-e0556f900d3f","resolution":{"observed_at":"2026-08-06T15:04:38.953006Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:04:38.940315Z","title":"For the other methods—DQN, BCQ, and CQL— we used the implementation provided by Luo et al","venue":null,"work_id":"1a212341-ef43-4510-b149-7cdc61cb96f7","year":2024},"citing_paper":{"arxiv_id":"2507.17056","last_updated":"2025-07-22T22:34:35Z","snapshot_observed_at":"2026-08-09T05:16:12.996238Z","submitted_at":"2025-07-22T22:34:35Z","title":"Pragmatic Policy Development via Interpretable Behavior Cloning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T15:04:38.869043Z"},"links":{"citing_paper":"/paper/2507.17056"},"observation_digest":"sha256:f48443aa373cf7a0e480c6a960f90866efeba6dced31ac634f2b76467aeff5d8","observation_id":"80477ffe-2319-429d-afda-65fcc8901c8c","resolution":{"observed_at":"2026-08-06T15:04:38.944333Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:04:38.984014Z","title":"Behavioural cloning for driving robots over rough terrain","venue":null,"work_id":"ecf42c91-bdef-47f0-8ffd-629fae0b8326","year":2011},"citing_paper":{"arxiv_id":"2507.17056","last_updated":"2025-07-22T22:34:35Z","snapshot_observed_at":"2026-08-09T05:16:12.996238Z","submitted_at":"2025-07-22T22:34:35Z","title":"Pragmatic Policy Development via Interpretable Behavior Cloning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T15:04:38.855301Z"},"links":{"citing_paper":"/paper/2507.17056"},"observation_digest":"sha256:0880e3d71a7bdd066f3ec1552f7d6d24af60952931728b502611030cf87a0dce","observation_id":"d409f753-1c02-4ca4-ab51-45312fdba3bd","resolution":{"observed_at":"2026-08-06T15:04:38.986896Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1907.01180","last_updated":"2019-07-02T05:51:04Z","snapshot_observed_at":"2026-08-05T03:40:23.581115Z","submitted_at":"2019-07-02T05:51:04Z","title":"Conservative Q-Improvement: Reinforcement Learning for an Interpretable Decision-Tree Policy","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.01180","snapshot_observed_at":"2026-08-06T15:04:38.852237Z","title":"Conservative Q- improvement: Reinforcement learning for an interpretable decision-tree policy","venue":null,"work_id":null,"year":1907},"citing_paper":{"arxiv_id":"2507.17056","last_updated":"2025-07-22T22:34:35Z","snapshot_observed_at":"2026-08-09T05:16:12.996238Z","submitted_at":"2025-07-22T22:34:35Z","title":"Pragmatic Policy Development via Interpretable Behavior Cloning","version":1},"reference_index":1983,"source":"pdf_text","source_observed_at":"2026-08-06T15:04:38.852237Z"},"links":{"cited_paper":"/paper/1907.01180","citing_paper":"/paper/2507.17056"},"observation_digest":"sha256:10a137c52832206d877a3104561e546926fccd98b288bd593afada8dbfdf0d1b","observation_id":"d4132ec1-52da-45e4-ba46-67765db35e5c","resolution":{"observed_at":"2026-08-06T15:04:38.852237Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.09602","last_updated":"2017-11-27T09:49:57Z","snapshot_observed_at":"2026-07-06T06:11:17.645784Z","submitted_at":"2017-11-27T09:49:57Z","title":"Deep Reinforcement Learning for Sepsis Treatment","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.09602","snapshot_observed_at":"2026-08-06T15:04:38.849175Z","title":"Deep reinforcement learning for sepsis treatment","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.17056","last_updated":"2025-07-22T22:34:35Z","snapshot_observed_at":"2026-08-09T05:16:12.996238Z","submitted_at":"2025-07-22T22:34:35Z","title":"Pragmatic Policy Development via Interpretable Behavior Cloning","version":1},"reference_index":2000,"source":"pdf_text","source_observed_at":"2026-08-06T15:04:38.849175Z"},"links":{"cited_paper":"/paper/1711.09602","citing_paper":"/paper/2507.17056"},"observation_digest":"sha256:32782f51c270ea7622aa059ebdd7a6847e43772ac5f1b880dc0d71810498bd3e","observation_id":"056f7f80-8196-40e6-867b-e795428858a7","resolution":{"observed_at":"2026-08-06T15:04:38.849175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:04:39.000798Z","title":"Distilling deep rein- forcement learning policies in soft decision trees","venue":null,"work_id":"2918ef65-6c8e-449c-a907-66aba997df62","year":2019},"citing_paper":{"arxiv_id":"2507.17056","last_updated":"2025-07-22T22:34:35Z","snapshot_observed_at":"2026-08-09T05:16:12.996238Z","submitted_at":"2025-07-22T22:34:35Z","title":"Pragmatic Policy Development via Interpretable Behavior Cloning","version":1},"reference_index":2014,"source":"pdf_text","source_observed_at":"2026-08-06T15:04:38.829990Z"},"links":{"citing_paper":"/paper/2507.17056"},"observation_digest":"sha256:a7a40aed5d8d1c245a31ce0e794c280dace6170811cdc74020bc17f4e4622f5b","observation_id":"4641c43b-3c3a-47de-86f6-3ade251ed508","resolution":{"observed_at":"2026-08-06T15:04:39.003648Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:04:38.975345Z","title":"Smolen, Robert B.M","venue":null,"work_id":"c394ae9b-41e8-4411-960b-09157ce92844","year":2022},"citing_paper":{"arxiv_id":"2507.17056","last_updated":"2025-07-22T22:34:35Z","snapshot_observed_at":"2026-08-09T05:16:12.996238Z","submitted_at":"2025-07-22T22:34:35Z","title":"Pragmatic Policy Development via Interpretable Behavior Cloning","version":1},"reference_index":2016,"source":"pdf_text","source_observed_at":"2026-08-06T15:04:38.858179Z"},"links":{"citing_paper":"/paper/2507.17056"},"observation_digest":"sha256:063ebd89c6814ffd340ae0fbdccff32a44384717b0a7cc486688baf447086beb","observation_id":"af3dd4ac-89ef-411e-840f-26d72d465e11","resolution":{"observed_at":"2026-08-06T15:04:38.977980Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:04:38.992391Z","title":"Off-policy deep reinforcement learning without ex- ploration","venue":null,"work_id":"17d27cc5-6af5-44d7-8260-f46b75bfaed5","year":null},"citing_paper":{"arxiv_id":"2507.17056","last_updated":"2025-07-22T22:34:35Z","snapshot_observed_at":"2026-08-09T05:16:12.996238Z","submitted_at":"2025-07-22T22:34:35Z","title":"Pragmatic Policy Development via Interpretable Behavior Cloning","version":1},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-06T15:04:38.833477Z"},"links":{"citing_paper":"/paper/2507.17056"},"observation_digest":"sha256:512cc924b4ef62bbbbb99a7178d2a9465eacfd44358271713a32318d0ae7b55e","observation_id":"27778344-32cf-4392-a7e1-e54db046e05b","resolution":{"observed_at":"2026-08-06T15:04:38.995325Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2005.01643","last_updated":"2020-11-01T23:50:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-05-04T17:00:15Z","title":"Offline Reinforcement Learning: Tutorial, Review, and Perspectives on Open Problems","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.01643","snapshot_observed_at":"2026-08-06T15:04:38.839728Z","title":"Offline reinforcement learning: Tutorial, review, and perspectives on open problems","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2507.17056","last_updated":"2025-07-22T22:34:35Z","snapshot_observed_at":"2026-08-09T05:16:12.996238Z","submitted_at":"2025-07-22T22:34:35Z","title":"Pragmatic Policy Development via Interpretable Behavior Cloning","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-06T15:04:38.839728Z"},"links":{"cited_paper":"/paper/2005.01643","citing_paper":"/paper/2507.17056"},"observation_digest":"sha256:171ca7cb60a86982aedc95b7ee433b479f714848c8b79d928b170f10c230494e","observation_id":"467fabfc-7175-4e64-8fb1-6d1efb5a2c63","resolution":{"observed_at":"2026-08-06T15:04:38.839728Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1904.01685","last_updated":"2020-08-07T18:34:21Z","snapshot_observed_at":"2026-08-04T20:23:20.720077Z","submitted_at":"2019-04-02T22:10:44Z","title":"Measuring Calibration in Deep Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.01685","snapshot_observed_at":"2026-08-06T15:04:38.845945Z","title":"Measuring calibration in deep learning","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"2507.17056","last_updated":"2025-07-22T22:34:35Z","snapshot_observed_at":"2026-08-09T05:16:12.996238Z","submitted_at":"2025-07-22T22:34:35Z","title":"Pragmatic Policy Development via Interpretable Behavior Cloning","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-06T15:04:38.845945Z"},"links":{"cited_paper":"/paper/1904.01685","citing_paper":"/paper/2507.17056"},"observation_digest":"sha256:267a5b299e67867ef4a08503ea0de4e64cc5d907e5a2229a9f2626b1ddc62d7f","observation_id":"b01d28c9-5d7b-4357-9db7-b5ef5a5cc74c","resolution":{"observed_at":"2026-08-06T15:04:38.845945Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:04:38.966637Z","title":"Datasets Our experimental evaluation was based on two dis- tinct datasets related to the management of rheuma- toid arthritis (RA) and sepsis","venue":null,"work_id":"b0cedc65-b210-4dfe-8dc2-96b5f36d504c","year":2023},"citing_paper":{"arxiv_id":"2507.17056","last_updated":"2025-07-22T22:34:35Z","snapshot_observed_at":"2026-08-09T05:16:12.996238Z","submitted_at":"2025-07-22T22:34:35Z","title":"Pragmatic Policy Development via Interpretable Behavior Cloning","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-06T15:04:38.861017Z"},"links":{"citing_paper":"/paper/2507.17056"},"observation_digest":"sha256:2b54cbfa14b2b3319a0cd3060d312de264fb26d5ab2847b55a07084ccafc26ef","observation_id":"8677122e-7a88-4289-ba20-b9c7e9dcdc09","resolution":{"observed_at":"2026-08-06T15:04:38.970031Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1805.12298","last_updated":"2018-05-31T02:56:26Z","snapshot_observed_at":"2026-07-06T06:42:10.448624Z","submitted_at":"2018-05-31T02:56:26Z","title":"Evaluating Reinforcement Learning Algorithms in Observational Health Settings","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1805.12298","snapshot_observed_at":"2026-08-06T15:04:38.836400Z","title":"Evaluating reinforcement learning al- gorithms in observational health settings","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.17056","last_updated":"2025-07-22T22:34:35Z","snapshot_observed_at":"2026-08-09T05:16:12.996238Z","submitted_at":"2025-07-22T22:34:35Z","title":"Pragmatic Policy Development via Interpretable Behavior Cloning","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-06T15:04:38.836400Z"},"links":{"cited_paper":"/paper/1805.12298","citing_paper":"/paper/2507.17056"},"observation_digest":"sha256:ae4f8b849fdefd0945a5436487b56c8c9e0a796944af9e710bca99c00ec1e8b3","observation_id":"22e4a638-523a-46ca-bf1f-f1a50b3792db","resolution":{"observed_at":"2026-08-06T15:04:38.836400Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.17056","last_updated":"2025-07-22T22:34:35Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-09T05:16:12.996238Z","submitted_at":"2025-07-22T22:34:35Z","title":"Pragmatic Policy Development via Interpretable Behavior Cloning"},"reference_resolution":{"displayed":14,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":7,"verified_exact":0,"verified_fuzzy":6},"total_outbound_references":14},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 14 of 14 outbound references and 0 inbound Pith citation observations for arXiv:2507.17056."}