Typed states for the displayed outbound observations.
Source: paper_references, paper_reference_links, observed 2026-08-14T11:46:30.168252Z
Paper Citation Record · LEDGER
As of 17 August 2026, this Paper Citation Record lists 71 of 71 outbound references and 0 inbound Pith citation observations for arXiv:1908.08526.
A citation records a reference. It does not transfer a finding from one paper to another.
Typed states for the displayed outbound observations.
Source: paper_references, paper_reference_links, observed 2026-08-14T11:46:30.168252Z
One-hop event checks from named stored sources.
Source: scholarly_work_events, retraction_status_cache, observed 2026-08-16T06:30:59.297886+00:00
Pith citing papers itemized under the disclosed page cap.
Source: paper_references, paper_reference_links
A source-named dated measurement, never combined with another source.
Source: cited_works
71 of 71 outbound references displayed
External citation measurements
No source-named external measurement is stored.
Observation 2f7b9a31-3e26-4e61-97aa-6095eeb23fe4 · outbound
Double Reinforcement Learning for Efficient Off-Policy Evaluation in Markov Decision Processes Ai and X
Reference 1
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.
Observation 6a09b9d4-0a22-46dc-b54f-f4599ea5e1dc · outbound
Double Reinforcement Learning for Efficient Off-Policy Evaluation in Markov Decision Processes Ai and X
Reference 2
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.
Observation 9fa8affe-7a93-470e-9298-b2c917d49aa1 · outbound
Double Reinforcement Learning for Efficient Off-Policy Evaluation in Markov Decision Processes Antos, C
Reference 3
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.
Observation d818f678-21e1-4dc0-b942-8fb649b593cd · outbound
Double Reinforcement Learning for Efficient Off-Policy Evaluation in Markov Decision Processes Unresolved cited work
Reference 4
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.
Observation d6edfed1-f4db-4313-b3e2-5fcfc0cbef8f · outbound
Double Reinforcement Learning for Efficient Off-Policy Evaluation in Markov Decision Processes Benkeser and M
Reference 5
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.
Observation 09e5b3f6-384d-40a6-96fc-8ccab2344dc3 · outbound
Double Reinforcement Learning for Efficient Off-Policy Evaluation in Markov Decision Processes Unresolved cited work
Reference 6
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.
Observation de1af119-467d-4b1a-a29c-254f140b8e54 · outbound
Double Reinforcement Learning for Efficient Off-Policy Evaluation in Markov Decision Processes Bibaut, I
Reference 8
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.
Observation 1e23951c-9ce7-4762-8e03-a682dda75c17 · outbound
Double Reinforcement Learning for Efficient Off-Policy Evaluation in Markov Decision Processes Fast rates for empirical risk minimization over c\`adl\`ag functions with bounded sectional variation norm
Reference 9
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation a43cee4a-eafd-4766-9a3c-8e4461c1c3c6 · outbound
Double Reinforcement Learning for Efficient Off-Policy Evaluation in Markov Decision Processes Unresolved cited work
Reference 10
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 4dceaf47-f150-4468-b2bd-37098574e674 · outbound
Double Reinforcement Learning for Efficient Off-Policy Evaluation in Markov Decision Processes Unresolved cited work
Reference 11
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.
Observation 4e9e4388-96a0-43dd-98b3-2b0404f82f21 · outbound
Double Reinforcement Learning for Efficient Off-Policy Evaluation in Markov Decision Processes OpenAI Gym
Reference 12
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 6c60ff96-8cce-4aa1-b15f-e891c1d266fa · outbound
Double Reinforcement Learning for Efficient Off-Policy Evaluation in Markov Decision Processes Chakraborty and E
Reference 13
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.
Observation 9a64125f-fc43-4087-a8be-7c5722234d21 · outbound
Double Reinforcement Learning for Efficient Off-Policy Evaluation in Markov Decision Processes Chamberlain
Reference 14
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.
Observation 9fab8462-5abe-4776-979a-edd1d53d53cb · outbound
Double Reinforcement Learning for Efficient Off-Policy Evaluation in Markov Decision Processes Unresolved cited work
Reference 15
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.
Observation dc187219-a481-4ab6-8918-8d4fe65e1d18 · outbound
Double Reinforcement Learning for Efficient Off-Policy Evaluation in Markov Decision Processes Chernozhukov, D
Reference 16
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.
Observation f1477ac4-7b3e-43c7-9e51-78000f8b228f · outbound
Double Reinforcement Learning for Efficient Off-Policy Evaluation in Markov Decision Processes Unresolved cited work
Reference 17
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.
Observation f048094e-e66a-4e83-9a46-670416b3cf26 · outbound
Double Reinforcement Learning for Efficient Off-Policy Evaluation in Markov Decision Processes Dudik, D
Reference 18
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.
Observation d4341ded-05a6-40df-9260-59191525b859 · outbound
Double Reinforcement Learning for Efficient Off-Policy Evaluation in Markov Decision Processes Ertefaie and R
Reference 19
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.
Observation e8741784-62bd-4a8e-ab96-26a3abe57435 · outbound
Double Reinforcement Learning for Efficient Off-Policy Evaluation in Markov Decision Processes Farajtabar, Y
Reference 20
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.
Observation 187b1056-ac8d-418a-8ffe-06d61e441410 · outbound
Double Reinforcement Learning for Efficient Off-Policy Evaluation in Markov Decision Processes Gottesman, F
Reference 21
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.
Observation 7188bc26-2d3a-4d1c-aee4-7ba21dd13e0c · outbound
Double Reinforcement Learning for Efficient Off-Policy Evaluation in Markov Decision Processes Gy \"o rfi, M
Reference 22
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.
Observation 27e3deb6-450b-44d1-be84-81f952661e85 · outbound
Double Reinforcement Learning for Efficient Off-Policy Evaluation in Markov Decision Processes Unresolved cited work
Reference 23
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.
Observation 96fac50b-3a5c-45d8-83ac-e8a784e66047 · outbound
Double Reinforcement Learning for Efficient Off-Policy Evaluation in Markov Decision Processes Unresolved cited work
Reference 24
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.
Observation bc4b7f22-3f27-4757-b432-6e2ae0f6a4f5 · outbound
Double Reinforcement Learning for Efficient Off-Policy Evaluation in Markov Decision Processes Unresolved cited work
Reference 25
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.
Observation 40afc250-0db6-4f50-8d13-411bf036bc69 · outbound
Double Reinforcement Learning for Efficient Off-Policy Evaluation in Markov Decision Processes Unresolved cited work
Reference 26
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.
Observation daa26224-7df5-44e2-a5a5-a44414a2197e · outbound
Double Reinforcement Learning for Efficient Off-Policy Evaluation in Markov Decision Processes Hernan and J
Reference 27
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.
Observation 582a21ef-731e-4fcd-855a-f837ff193c4e · outbound
Double Reinforcement Learning for Efficient Off-Policy Evaluation in Markov Decision Processes Hirano, G
Reference 28
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.
Observation e5cfc05c-9586-4051-ba4f-7268017bb553 · outbound
Double Reinforcement Learning for Efficient Off-Policy Evaluation in Markov Decision Processes Deep Neural Networks Learn Non-Smooth Functions Effectively
Reference 29
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.
Observation e833b080-1600-4f94-a90c-6b76babb06d3 · outbound
Double Reinforcement Learning for Efficient Off-Policy Evaluation in Markov Decision Processes Jiang and L
Reference 30
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.
Observation 4130b4d5-b87b-4fce-a4c4-8a8211510a98 · outbound
Double Reinforcement Learning for Efficient Off-Policy Evaluation in Markov Decision Processes Kallus and M
Reference 31
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.
Observation 2784b18d-a65b-4730-9624-81580d3ef43e · outbound
Double Reinforcement Learning for Efficient Off-Policy Evaluation in Markov Decision Processes Non-Parametric Inference Adaptive to Intrinsic Dimension
Reference 32
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.
Observation d974909d-c01f-419c-a4c3-b1691fdb1f99 · outbound
Double Reinforcement Learning for Efficient Off-Policy Evaluation in Markov Decision Processes Unresolved cited work
Reference 33
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.
Observation 7a009ad2-ec69-4248-8704-ab35dee85572 · outbound
Double Reinforcement Learning for Efficient Off-Policy Evaluation in Markov Decision Processes Unresolved cited work
Reference 34
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.
Observation d225f321-f385-411e-a58b-87a7943f1e5c · outbound
Double Reinforcement Learning for Efficient Off-Policy Evaluation in Markov Decision Processes Lagoudakis and R
Reference 35
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.
Observation dd1a6b8b-b1df-4d79-9ef3-40a075870779 · outbound
Double Reinforcement Learning for Efficient Off-Policy Evaluation in Markov Decision Processes Unresolved cited work
Reference 36
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.
Observation c809529c-5f0f-4cc5-9162-a5d15a9a7ab7 · outbound
Double Reinforcement Learning for Efficient Off-Policy Evaluation in Markov Decision Processes Unresolved cited work
Reference 37
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.
Observation 2b630a9a-167b-4935-acd9-17134ff9891c · outbound
Double Reinforcement Learning for Efficient Off-Policy Evaluation in Markov Decision Processes Li and J
Reference 38
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.
Observation bfb89cd7-e8a2-4360-bac8-2c7669c1f636 · outbound
Double Reinforcement Learning for Efficient Off-Policy Evaluation in Markov Decision Processes Unresolved cited work
Reference 39
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.
Observation 6d863ec6-1291-4917-a0a0-a21422839f2b · outbound
Double Reinforcement Learning for Efficient Off-Policy Evaluation in Markov Decision Processes Unresolved cited work
Reference 40
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.
Observation f89ec68f-efb6-4d90-a9ee-d020a1f21e7e · outbound
Double Reinforcement Learning for Efficient Off-Policy Evaluation in Markov Decision Processes Unresolved cited work
Reference 41
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.
Observation a33cf5bf-3eee-4da9-adc9-09fc9f8b6d5a · outbound
Double Reinforcement Learning for Efficient Off-Policy Evaluation in Markov Decision Processes Mandel, Y
Reference 42
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.
Observation e2f2b559-f3fc-4543-b051-9461d4f8e323 · outbound
Double Reinforcement Learning for Efficient Off-Policy Evaluation in Markov Decision Processes Mannor, D
Reference 43
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.
Observation d8b0a424-78a6-47d9-91d7-319aa22a519c · outbound
Double Reinforcement Learning for Efficient Off-Policy Evaluation in Markov Decision Processes Munos, T
Reference 44
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.
Observation 822b46da-14c6-4ba8-bfef-6d0673854268 · outbound
Double Reinforcement Learning for Efficient Off-Policy Evaluation in Markov Decision Processes Unresolved cited work
Reference 45
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.
Observation 3c527b1f-0f8d-4bc6-9832-a66756345532 · outbound
Double Reinforcement Learning for Efficient Off-Policy Evaluation in Markov Decision Processes Unresolved cited work
Reference 46
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.
Observation 20279ca8-88b9-4e63-b109-6c0971aecc98 · outbound
Double Reinforcement Learning for Efficient Off-Policy Evaluation in Markov Decision Processes Unresolved cited work
Reference 47
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.
Observation 51abad15-06c2-498f-9d52-25c699b96e12 · outbound
Double Reinforcement Learning for Efficient Off-Policy Evaluation in Markov Decision Processes Precup, R
Reference 48
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.
Observation 4d4a39b5-8936-4af7-8593-97bd6094a46c · outbound
Double Reinforcement Learning for Efficient Off-Policy Evaluation in Markov Decision Processes Rahimi and B
Reference 49
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.
Observation a29adcc7-471b-4a9a-bd40-02b089af0ab7 · outbound
Double Reinforcement Learning for Efficient Off-Policy Evaluation in Markov Decision Processes Unresolved cited work
Reference 50
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation c5474ff6-ed48-4ff7-9f19-a2047e5088a0 · outbound
Double Reinforcement Learning for Efficient Off-Policy Evaluation in Markov Decision Processes Unresolved cited work
Reference 51
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.
Observation 3891080d-8386-47e1-9ee7-9440383b4ffa · outbound
Double Reinforcement Learning for Efficient Off-Policy Evaluation in Markov Decision Processes Unresolved cited work
Reference 52
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.
Observation f35b1f7a-ee20-4320-a4bf-ebfc7c5a3e12 · outbound
Double Reinforcement Learning for Efficient Off-Policy Evaluation in Markov Decision Processes Rotnitzky and S
Reference 53
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.
Observation 93237f4b-a33a-4e24-a832-e67a5bd7ced2 · outbound
Double Reinforcement Learning for Efficient Off-Policy Evaluation in Markov Decision Processes Identification, Doubly Robust Estimation, and Semiparametric Efficiency Theory of Nonignorable Missing Data With a Shadow Variable
Reference 54
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 57dc18f1-35d7-4f56-992e-64068604e7f5 · outbound
Double Reinforcement Learning for Efficient Off-Policy Evaluation in Markov Decision Processes Scharfstein, A
Reference 55
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.
Observation c5646464-6853-4f32-929c-2a9e204ae2e7 · outbound
Double Reinforcement Learning for Efficient Off-Policy Evaluation in Markov Decision Processes Unresolved cited work
Reference 56
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.
Observation fdf71f61-1d43-4320-ba9b-e839a7b4f1d0 · outbound
Double Reinforcement Learning for Efficient Off-Policy Evaluation in Markov Decision Processes Unresolved cited work
Reference 57
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.
Observation f07166fe-6c58-4096-a7d9-e03af9c18acb · outbound
Double Reinforcement Learning for Efficient Off-Policy Evaluation in Markov Decision Processes Unresolved cited work
Reference 58
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.
Observation a851e44f-fed0-4bbb-8988-eee8049152d0 · outbound
Double Reinforcement Learning for Efficient Off-Policy Evaluation in Markov Decision Processes Swaminathan and T
Reference 59
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.
Observation 1abeb396-058d-45fe-abe3-bc2e6bc0f24f · outbound
Double Reinforcement Learning for Efficient Off-Policy Evaluation in Markov Decision Processes Thomas and E
Reference 60
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.
Observation ea5317c0-baf0-426e-9596-c2fd244d828a · outbound
Double Reinforcement Learning for Efficient Off-Policy Evaluation in Markov Decision Processes Tripathi
Reference 61
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.
Observation b58a750b-1315-4ed8-b028-2bef40a88917 · outbound
Double Reinforcement Learning for Efficient Off-Policy Evaluation in Markov Decision Processes Unresolved cited work
Reference 62
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.
Observation 50296aed-8de8-4c85-976e-022a1cdb4864 · outbound
Double Reinforcement Learning for Efficient Off-Policy Evaluation in Markov Decision Processes Unresolved cited work
Reference 63
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.
Observation c7eb9fa1-801b-49f8-9920-8861b86df38e · outbound
Double Reinforcement Learning for Efficient Off-Policy Evaluation in Markov Decision Processes Unresolved cited work
Reference 64
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.
Observation f816fdf0-9662-48fd-9c08-fb500a359bec · outbound
Double Reinforcement Learning for Efficient Off-Policy Evaluation in Markov Decision Processes Unresolved cited work
Reference 65
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.
Observation 8a76e8bd-8928-4624-add7-95d5f7079e89 · outbound
Double Reinforcement Learning for Efficient Off-Policy Evaluation in Markov Decision Processes Unresolved cited work
Reference 66
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.
Observation 686ae564-f31c-4a78-85a4-c6b9f51b6a91 · outbound
Double Reinforcement Learning for Efficient Off-Policy Evaluation in Markov Decision Processes Vermeulen
Reference 67
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.
Observation 1cbdc28f-9c5a-49e4-8aa7-5769a7bb7978 · outbound
Double Reinforcement Learning for Efficient Off-Policy Evaluation in Markov Decision Processes Adaptive Concentration of Regression Trees, with Application to Random Forests
Reference 68
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 9341a610-d4e4-4f3a-8465-1a1099db1c87 · outbound
Double Reinforcement Learning for Efficient Off-Policy Evaluation in Markov Decision Processes Unresolved cited work
Reference 69
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.
Observation ff344948-ef2b-4eac-a8dd-2c89ebf7e840 · outbound
Double Reinforcement Learning for Efficient Off-Policy Evaluation in Markov Decision Processes Yin and Y.-X
Reference 70
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.
Observation a34c62ce-fd75-4651-bb54-fd8f7ef4f919 · outbound
Double Reinforcement Learning for Efficient Off-Policy Evaluation in Markov Decision Processes Zhang, A
Reference 71
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.
Observation 36e41956-8ef9-4a85-84a7-a6e2bdd2c41c · outbound
Double Reinforcement Learning for Efficient Off-Policy Evaluation in Markov Decision Processes Zheng and M
Reference 72
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.
No inbound Pith citation observations are available.