Typed states for the displayed outbound observations.
Source: paper_references, paper_reference_links, observed 2026-08-11T20:26:49.464366Z
Paper Citation Record · LEDGER
As of 13 August 2026, this Paper Citation Record lists 100 of 106 outbound references and 1 inbound Pith citation observation for arXiv:2412.05783.
A citation records a reference. It does not transfer a finding from one paper to another.
Typed states for the displayed outbound observations.
Source: paper_references, paper_reference_links, observed 2026-08-11T20:26:49.464366Z
One-hop event checks from named stored sources.
Source: scholarly_work_events, retraction_status_cache, observed 2026-08-12T06:34:41.77262+00:00
Pith citing papers itemized under the disclosed page cap.
Source: paper_references, paper_reference_links, observed 2026-08-01T08:36:27.422590Z
A source-named dated measurement, never combined with another source.
Source: pith, observed 2026-08-05T02:28:24.338817Z
100 of 106 outbound references displayed
External citation measurements
0
pith, observed 2026-08-05T02:28:24.338817Z
Observation 5cf9ca6b-303e-49b7-860a-b97f038ec39c · outbound
Two-way Deconfounder for Off-policy Evaluation in Causal Reinforcement Learning Formulation and estimation of dynamic models using panel data
Reference 1
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 81eab347-b38c-4953-a397-f6fa7bbcb21d · outbound
Two-way Deconfounder for Off-policy Evaluation in Causal Reinforcement Learning Doubly robust identification for causal panel data models
Reference 2
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation d392ba94-52de-418b-9353-b0106c23bf1f · outbound
Two-way Deconfounder for Off-policy Evaluation in Causal Reinforcement Learning Design-based analysis in difference-in-differences settings with staggered adoption
Reference 3
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation a13dec1d-9588-44aa-bf28-610180a1d069 · outbound
Two-way Deconfounder for Off-policy Evaluation in Causal Reinforcement Learning Econometric analysis of panel data, volume 4
Reference 4
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 856b2df3-9142-4198-a91c-0af226994e1d · outbound
Two-way Deconfounder for Off-policy Evaluation in Causal Reinforcement Learning Genetic risk profiles for cancer susceptibility and therapy response
Reference 5
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation b4fc580b-0d56-486a-9196-350a637475a3 · outbound
Two-way Deconfounder for Off-policy Evaluation in Causal Reinforcement Learning Proximal reinforcement learning: Efficient off-policy evaluation in partially observed markov decision processes
Reference 6
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 2d2851fd-f9da-422f-a698-a9b11f3f2593 · outbound
Two-way Deconfounder for Off-policy Evaluation in Causal Reinforcement Learning Off-policy Evaluation in Doubly Inhomogeneous Environments
Reference 7
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.
Observation e6aa3b11-ad83-48f3-aa5e-d6c55cdf5ca9 · outbound
Two-way Deconfounder for Off-policy Evaluation in Causal Reinforcement Learning Time series deconfounder: Estimating treatment effects over time in the presence of hidden confounders
Reference 8
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation f3703407-ced8-4883-8a64-918f469106e4 · outbound
Two-way Deconfounder for Off-policy Evaluation in Causal Reinforcement Learning Robust fitted-q-evaluation and iteration under sequentially exogenous unobserved confounders
Reference 9
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 2f731838-1fa3-45b9-bd8d-fc1dcab8f1d9 · outbound
Two-way Deconfounder for Off-policy Evaluation in Causal Reinforcement Learning Treatment effects in interactive fixed effects models with a small number of time periods
Reference 10
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 64d47dda-039d-4779-9afd-7c65d9605d74 · outbound
Two-way Deconfounder for Off-policy Evaluation in Causal Reinforcement Learning Statistical inference
Reference 11
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 674bde1d-3223-409c-babe-49b6fe6a5f80 · outbound
Two-way Deconfounder for Off-policy Evaluation in Causal Reinforcement Learning Universal off-policy evaluation
Reference 12
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation ea0ba1f1-cf76-4fa8-ad75-515556cd94b5 · outbound
Two-way Deconfounder for Off-policy Evaluation in Causal Reinforcement Learning Testing for the markov property in time series
Reference 13
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 61ddd041-b55b-4d1e-932d-44105215db94 · outbound
Two-way Deconfounder for Off-policy Evaluation in Causal Reinforcement Learning Information-Theoretic Considerations in Batch Reinforcement Learning
Reference 14
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.
Observation 61dbe7c9-4d78-4c87-b6a3-b8ea0c5428b2 · outbound
Two-way Deconfounder for Off-policy Evaluation in Causal Reinforcement Learning On well-posedness and minimax optimal rates of nonparametric q-function estimation in off-policy evaluation
Reference 15
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 79a87a3e-8b07-4c7e-9a83-f545bcf34291 · outbound
Two-way Deconfounder for Off-policy Evaluation in Causal Reinforcement Learning On instrumental variable regression for deep offline policy evaluation
Reference 16
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation cca7315a-4c7e-47dc-9384-2d46fd4f03d5 · outbound
Two-way Deconfounder for Off-policy Evaluation in Causal Reinforcement Learning Double/debiased machine learning for treatment and structural parameters
Reference 17
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 54065e70-f661-480c-b050-cb993b19469e · outbound
Two-way Deconfounder for Off-policy Evaluation in Causal Reinforcement Learning A crash course in good and bad controls
Reference 18
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation b3647527-68eb-42b6-ad3c-2c247dc2fb07 · outbound
Two-way Deconfounder for Off-policy Evaluation in Causal Reinforcement Learning Coindice: Off-policy confidence interval estimation
Reference 19
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation ad05cb02-d180-4a4a-9508-f57b7f20b71e · outbound
Two-way Deconfounder for Off-policy Evaluation in Causal Reinforcement Learning Comment: Reflections on the deconfounder, 2019
Reference 20
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 68dde355-1d55-49a3-b452-15c5bef507d5 · outbound
Two-way Deconfounder for Off-policy Evaluation in Causal Reinforcement Learning Two-way fixed effects estimators with heterogeneous treatment effects
Reference 21
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 9ea2261c-b5ee-4ba1-aa62-e36811700efe · outbound
Two-way Deconfounder for Off-policy Evaluation in Causal Reinforcement Learning Counterfactual inference in sequential experiments
Reference 22
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.
Observation 722ea65d-52ee-42d8-9ce1-5a3902d93c9f · outbound
Two-way Deconfounder for Off-policy Evaluation in Causal Reinforcement Learning A theoretical analysis of deep q-learning
Reference 23
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 6dc54f2f-3ac3-4e0a-ba59-30af9c519f98 · outbound
Two-way Deconfounder for Off-policy Evaluation in Causal Reinforcement Learning More robust doubly robust off-policy evaluation
Reference 24
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 1aa730a7-d898-46c9-9e90-bd224f8486c2 · outbound
Two-way Deconfounder for Off-policy Evaluation in Causal Reinforcement Learning Deep neural networks for estimation and inference
Reference 25
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation d241ef39-edf2-4287-b0e8-deb304ea1fc6 · outbound
Two-way Deconfounder for Off-policy Evaluation in Causal Reinforcement Learning Non-parametric panel data models with interactive fixed effects
Reference 26
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 4e1aa98c-71ab-44ca-8711-72bbcd9c208f · outbound
Two-way Deconfounder for Off-policy Evaluation in Causal Reinforcement Learning Offline Reinforcement Learning with Instrumental Variables in Confounded Markov Decision Processes
Reference 27
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.
Observation 71f7fafc-e76d-4c41-856e-74588a2a464e · outbound
Two-way Deconfounder for Off-policy Evaluation in Causal Reinforcement Learning Prediction of treatment response for combined chemo-and radiation therapy for non-small cell lung cancer patients using a bio-mathematical model
Reference 28
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation af85bcdc-9ff7-4a0b-bd0c-dc89ad0653d8 · outbound
Two-way Deconfounder for Off-policy Evaluation in Causal Reinforcement Learning Issues in assessing the contribution of research and development to productivity growth
Reference 29
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 4ca90b1d-0ee0-404d-a32e-8736af8529a9 · outbound
Two-way Deconfounder for Off-policy Evaluation in Causal Reinforcement Learning Richard Guo, Anton Rask Lundborg, and Qingyuan Zhao
Reference 30
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 52c89603-207b-4f0a-b66d-ed48e4f6765f · outbound
Two-way Deconfounder for Off-policy Evaluation in Causal Reinforcement Learning Dream to Control: Learning Behaviors by Latent Imagination
Reference 31
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 3bfd73e2-7b4c-4d1b-a9ba-66f424d966f0 · outbound
Two-way Deconfounder for Off-policy Evaluation in Causal Reinforcement Learning Learning latent dynamics for planning from pixels
Reference 32
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation fa09841b-afa9-4af0-8f09-c107a472fb7d · outbound
Two-way Deconfounder for Off-policy Evaluation in Causal Reinforcement Learning Bootstrapping fitted q-evaluation for off-policy inference
Reference 33
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 52f1e374-03d7-4990-9a8d-02939d46e023 · outbound
Two-way Deconfounder for Off-policy Evaluation in Causal Reinforcement Learning Sequential Deconfounding for Causal Inference with Unobserved Confounders
Reference 34
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.
Observation 7fe94afa-707d-4d74-8f53-c5f8b8746612 · outbound
Two-way Deconfounder for Off-policy Evaluation in Causal Reinforcement Learning Neural collaborative filtering
Reference 35
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 1b616d7c-1356-4f6b-8bf4-a49d8e0f5007 · outbound
Two-way Deconfounder for Off-policy Evaluation in Causal Reinforcement Learning A Policy Gradient Method for Confounded POMDPs
Reference 36
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation e4cadad5-e646-4614-a495-325ffc3a13c8 · outbound
Two-way Deconfounder for Off-policy Evaluation in Causal Reinforcement Learning Collaborative filtering for implicit feedback datasets
Reference 37
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation f18883af-ed44-4dd2-9508-340088c4bad5 · outbound
Two-way Deconfounder for Off-policy Evaluation in Causal Reinforcement Learning On the use of two-way fixed effects regression models for causal inference with panel data
Reference 38
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 32386744-8488-4fe7-9487-63338c368b07 · outbound
Two-way Deconfounder for Off-policy Evaluation in Causal Reinforcement Learning Off-policy evaluation via off-policy classification
Reference 39
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.
Observation a127d31e-b7f1-4795-8641-129d4520de1b · outbound
Two-way Deconfounder for Off-policy Evaluation in Causal Reinforcement Learning When to trust your model: Model-based policy optimization
Reference 40
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 71aaaba8-9046-4a8e-94b2-8f8cf63173aa · outbound
Two-way Deconfounder for Off-policy Evaluation in Causal Reinforcement Learning A survey on knowledge graphs: Representation, acquisition, and applications
Reference 41
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 0b532d18-1e37-4f82-a1f3-29eeea0c962c · outbound
Two-way Deconfounder for Off-policy Evaluation in Causal Reinforcement Learning A Note on Loss Functions and Error Compounding in Model-based Reinforcement Learning
Reference 42
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation a49847dc-e071-44ab-8e47-3da895f4dd04 · outbound
Two-way Deconfounder for Off-policy Evaluation in Causal Reinforcement Learning Doubly robust off-policy value evaluation for reinforcement learning
Reference 43
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.
Observation af55c0cd-0b26-43a5-a67a-2265db6863e3 · outbound
Two-way Deconfounder for Off-policy Evaluation in Causal Reinforcement Learning Mimic-iii, a freely accessible critical care database
Reference 44
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 64ee11ac-76dd-476a-87f0-6ae58685e7f9 · outbound
Two-way Deconfounder for Off-policy Evaluation in Causal Reinforcement Learning Efficiently breaking the curse of horizon in off-policy evaluation with double reinforcement learning
Reference 45
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 0e964bf1-c5cb-41ef-a054-15e682554714 · outbound
Two-way Deconfounder for Off-policy Evaluation in Causal Reinforcement Learning Confounding-robust policy evaluation in infinite-horizon reinforcement learning
Reference 46
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.
Observation 94a0e4f1-6eb6-483d-a136-302449c5190e · outbound
Two-way Deconfounder for Off-policy Evaluation in Causal Reinforcement Learning Offline Policy Evaluation and Optimization under Confounding
Reference 47
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.
Observation 3b6da3e7-58ef-4f93-be19-d93779cdf21d · outbound
Two-way Deconfounder for Off-policy Evaluation in Causal Reinforcement Learning Learning mixtures of markov chains and mdps
Reference 48
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.
Observation 0e270572-5815-4174-bd97-59858a67f107 · outbound
Two-way Deconfounder for Off-policy Evaluation in Causal Reinforcement Learning Asymptotic Theory for IV-Based Reinforcement Learning with Potential Endogeneity
Reference 49
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation ff919683-2e4f-47ab-94b7-05a99ee2375c · outbound
Two-way Deconfounder for Off-policy Evaluation in Causal Reinforcement Learning Instrumental Variable Value Iteration for Causal Offline Reinforcement Learning
Reference 50
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation d548c79c-5569-492f-bacf-4f08e31279a2 · outbound
Two-way Deconfounder for Off-policy Evaluation in Causal Reinforcement Learning Off-policy estimation of long-term average outcomes with applications to mobile health
Reference 51
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.
Observation b53a4e2a-c74e-4d51-9b97-02e1eeb4febb · outbound
Two-way Deconfounder for Off-policy Evaluation in Causal Reinforcement Learning Batch policy learning in average reward markov decision processes
Reference 52
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.
Observation 4e5d4ad9-54f4-44a1-ac39-e5d5a85ef690 · outbound
Two-way Deconfounder for Off-policy Evaluation in Causal Reinforcement Learning Forecasting treatment responses over time using recurrent marginal structural networks
Reference 53
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 65385c22-c2a2-4eff-b63e-d9162e098533 · outbound
Two-way Deconfounder for Off-policy Evaluation in Causal Reinforcement Learning Breaking the curse of horizon: Infinite-horizon off-policy estimation
Reference 54
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 0cc27e4d-b8ac-4b9f-bd0f-8969dd803f30 · outbound
Two-way Deconfounder for Off-policy Evaluation in Causal Reinforcement Learning Provably good batch off-policy reinforcement learning without great exploration
Reference 55
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.
Observation 6020fd7c-11f3-408c-8ef3-d621c217b820 · outbound
Two-way Deconfounder for Off-policy Evaluation in Causal Reinforcement Learning Causal effect inference with deep latent-variable models
Reference 56
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 011c4092-9749-427a-9ef8-26338579198c · outbound
Two-way Deconfounder for Off-policy Evaluation in Causal Reinforcement Learning Deconfounding Reinforcement Learning in Observational Settings
Reference 57
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation fd481239-bf69-4c47-9a24-db357de512c5 · outbound
Two-way Deconfounder for Off-policy Evaluation in Causal Reinforcement Learning Pessimism in the face of confounders: Provably efficient offline reinforcement learning in partially observable markov decision processes
Reference 58
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.
Observation 4a51b86d-dc62-426d-afdc-9fa3765d7c6b · outbound
Two-way Deconfounder for Off-policy Evaluation in Causal Reinforcement Learning Estimating causal peer influence in homophilous social networks by inferring latent locations
Reference 59
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.
Observation 32153b46-476a-4467-aeae-7b83e851470e · outbound
Two-way Deconfounder for Off-policy Evaluation in Causal Reinforcement Learning Off-policy evaluation for episodic partially observable markov decision processes under non-parametric models
Reference 60
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.
Observation fc41d0e5-9d07-4f21-8904-5012e55c1384 · outbound
Two-way Deconfounder for Off-policy Evaluation in Causal Reinforcement Learning Empirical production function free of management bias
Reference 61
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.
Observation 56e8f4d9-725a-4e58-8577-1a4e69e10266 · outbound
Two-way Deconfounder for Off-policy Evaluation in Causal Reinforcement Learning A Spectral Approach to Off-Policy Evaluation for POMDPs
Reference 62
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 37f99efe-7629-4a6a-9394-86ee51e38913 · outbound
Two-way Deconfounder for Off-policy Evaluation in Causal Reinforcement Learning Off-policy policy evaluation for sequential decisions under unobserved confounding
Reference 63
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.
Observation 54907508-141e-4877-a4e4-f4268c6c760a · outbound
Two-way Deconfounder for Off-policy Evaluation in Causal Reinforcement Learning A Novel Embedding Model for Knowledge Base Completion Based on Convolutional Neural Network
Reference 64
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation d57eeb98-a197-4cfd-92f9-518be18c6ab6 · outbound
Two-way Deconfounder for Off-policy Evaluation in Causal Reinforcement Learning A review of relational machine learning for knowledge graphs
Reference 65
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.
Observation eca033d3-c3ed-4dac-b4a0-4093929bb8f9 · outbound
Two-way Deconfounder for Off-policy Evaluation in Causal Reinforcement Learning Automated cars meet human drivers: responsible human-robot coordination and the ethics of mixed traffic
Reference 66
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.
Observation 0502d09e-fd3a-4c68-99bd-16bd2ce1a339 · outbound
Two-way Deconfounder for Off-policy Evaluation in Causal Reinforcement Learning blessings of multiple causes
Reference 67
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation cd511ddc-54a8-4ae9-8bf4-841a0c66b884 · outbound
Two-way Deconfounder for Off-policy Evaluation in Causal Reinforcement Learning Counterexamples to "The Blessings of Multiple Causes" by Wang and Blei
Reference 68
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation f03a237d-00ca-423b-81c7-15fef16315ff · outbound
Two-way Deconfounder for Off-policy Evaluation in Causal Reinforcement Learning A critical look at the consistency of causal estimation with deep latent variable models
Reference 69
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.
Observation 0df06961-fb28-404c-9c24-a728d438e613 · outbound
Two-way Deconfounder for Off-policy Evaluation in Causal Reinforcement Learning Doubly robust difference-in-differences estimators
Reference 70
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.
Observation a4e00b95-682b-4952-895e-f771f7975623 · outbound
Two-way Deconfounder for Off-policy Evaluation in Causal Reinforcement Learning Importance resampling for off-policy prediction
Reference 71
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.
Observation 76918f35-ec26-4eb2-a005-7527cb92a1ce · outbound
Two-way Deconfounder for Off-policy Evaluation in Causal Reinforcement Learning Nonparametric regression using deep neural networks with relu activation function
Reference 72
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation c94b25b5-0eb0-49ce-b030-b6d9692cd316 · outbound
Two-way Deconfounder for Off-policy Evaluation in Causal Reinforcement Learning On counterfactual inference with unobserved confounding
Reference 73
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.
Observation 067ac510-944f-4d18-b6cb-84dc2de34cb7 · outbound
Two-way Deconfounder for Off-policy Evaluation in Causal Reinforcement Learning Does the markov decision process fit the data: Testing for the markov property in sequential decision making
Reference 74
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.
Observation dba602c9-a56e-4e02-af6c-fd7fbd4fcb16 · outbound
Two-way Deconfounder for Off-policy Evaluation in Causal Reinforcement Learning Deeply-debiased off-policy interval estimation
Reference 75
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.
Observation 01a0abe7-28ec-40c9-b6fa-76afeb142d23 · outbound
Two-way Deconfounder for Off-policy Evaluation in Causal Reinforcement Learning A minimax learning approach to off-policy evaluation in confounded partially observable markov decision processes
Reference 76
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.
Observation 9397cc0a-09a2-462f-8e3e-0ea8651c291e · outbound
Two-way Deconfounder for Off-policy Evaluation in Causal Reinforcement Learning Statistical inference of the value function for reinforcement learning in infinite-horizon settings
Reference 77
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.
Observation f75aea1e-95db-497e-83dd-6c2ecff17798 · outbound
Two-way Deconfounder for Off-policy Evaluation in Causal Reinforcement Learning Off-policy confidence interval estimation with confounded markov decision process
Reference 78
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.
Observation 611f730e-97af-4690-94ad-937ecc2f2c3f · outbound
Two-way Deconfounder for Off-policy Evaluation in Causal Reinforcement Learning Mediation pathway selection with unmeasured mediator-outcome confounding
Reference 79
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.
Observation 5a207d18-b0e6-48f3-9c1d-8d6dfc330435 · outbound
Two-way Deconfounder for Off-policy Evaluation in Causal Reinforcement Learning Reasoning with neural tensor networks for knowledge base completion
Reference 80
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 8bf13f72-5146-4824-b96b-f6c32cf73b4b · outbound
Two-way Deconfounder for Off-policy Evaluation in Causal Reinforcement Learning Reinforcement learning: An introduction
Reference 81
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation e254b7c3-ddd9-4d3c-a61e-477b512f9f93 · outbound
Two-way Deconfounder for Off-policy Evaluation in Causal Reinforcement Learning Doubly Robust Bias Reduction in Infinite Horizon Off-Policy Estimation
Reference 82
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation ff5acfdd-eea0-4bea-915a-509ac1b12643 · outbound
Two-way Deconfounder for Off-policy Evaluation in Causal Reinforcement Learning An Introduction to Proximal Causal Learning
Reference 83
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation f53839b7-c0a4-4ed0-a2b4-dde6c539d20f · outbound
Two-way Deconfounder for Off-policy Evaluation in Causal Reinforcement Learning Off-policy evaluation in partially observable environments
Reference 84
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.
Observation 2b35f4a5-8d54-4921-9d90-dacbeb46223a · outbound
Two-way Deconfounder for Off-policy Evaluation in Causal Reinforcement Learning Data-efficient off-policy policy evaluation for reinforcement learning
Reference 85
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.
Observation 3538c71c-a3a8-4ff6-975c-c9a846b1b822 · outbound
Two-way Deconfounder for Off-policy Evaluation in Causal Reinforcement Learning High-confidence off-policy evaluation
Reference 86
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.
Observation aa3f4e79-c057-494b-94b1-6dd011a90948 · outbound
Two-way Deconfounder for Off-policy Evaluation in Causal Reinforcement Learning Implicit Causal Models for Genome-wide Association Studies
Reference 87
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 8e91b53c-552f-45e5-ad6e-80d394d79687 · outbound
Two-way Deconfounder for Off-policy Evaluation in Causal Reinforcement Learning Pessimistic Model-based Offline Reinforcement Learning under Partial Coverage
Reference 88
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation b6b9adc8-d1cd-4b59-b49e-c42fafb9b975 · outbound
Two-way Deconfounder for Off-policy Evaluation in Causal Reinforcement Learning Minimax weight and q-function learning for off-policy evaluation
Reference 89
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation f501c8cd-c13f-4e91-ab43-6980c84cd4be · outbound
Two-way Deconfounder for Off-policy Evaluation in Causal Reinforcement Learning Using embeddings to correct for unobserved confounding in networks
Reference 90
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.
Observation da6374d8-9829-4a5f-b237-bcc3689aef74 · outbound
Two-way Deconfounder for Off-policy Evaluation in Causal Reinforcement Learning Adapting text embeddings for causal inference
Reference 91
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 3b16c69a-bd9d-4fc2-a840-e839d600de9d · outbound
Two-way Deconfounder for Off-policy Evaluation in Causal Reinforcement Learning Relational deep learning: A deep latent variable model for link prediction
Reference 92
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.
Observation 1f3480fa-a383-465c-8444-211ed4b6ea20 · outbound
Two-way Deconfounder for Off-policy Evaluation in Causal Reinforcement Learning Blessing from Human-AI Interaction: Super Reinforcement Learning in Confounded Environments
Reference 93
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 4b0b5083-cc16-4f7f-bcf0-a517aa9b41f3 · outbound
Two-way Deconfounder for Off-policy Evaluation in Causal Reinforcement Learning Provably efficient causal reinforcement learning with confounded observational data
Reference 94
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.
Observation bdf0cca4-42c4-44f5-a381-04d74a0cc6f8 · outbound
Two-way Deconfounder for Off-policy Evaluation in Causal Reinforcement Learning The blessings of multiple causes
Reference 95
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.
Observation 62992a5b-55ea-4fb3-a59e-7beabeab7809 · outbound
Two-way Deconfounder for Off-policy Evaluation in Causal Reinforcement Learning The Deconfounded Recommender: A Causal Inference Approach to Recommendation
Reference 96
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 358dc732-754a-4111-847a-086c856d366f · outbound
Two-way Deconfounder for Off-policy Evaluation in Causal Reinforcement Learning Semiparametrically efficient off-policy evaluation in linear markov decision processes
Reference 97
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.
Observation 3c3c5a1d-a062-4258-96ee-c74991263fb6 · outbound
Two-way Deconfounder for Off-policy Evaluation in Causal Reinforcement Learning Towards optimal off-policy evaluation for reinforcement learning with marginalized importance sampling
Reference 98
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.
Observation eb66cdb4-473c-43a7-a7f0-558b3da967f7 · outbound
Two-way Deconfounder for Off-policy Evaluation in Causal Reinforcement Learning An instrumental variable approach to confounded off-policy evaluation
Reference 99
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.
Observation 7f363e52-78a9-4d07-b6c1-8d1bd082a64d · outbound
Two-way Deconfounder for Off-policy Evaluation in Causal Reinforcement Learning Strategic Decision-Making in the Presence of Information Asymmetry: Provably Efficient RL with Algorithmic Instruments
Reference 100
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 76ef2f32-1274-4e25-b5f0-bf677d993731 · inbound
Training Large Language Models for Self-Explanation Faithfulness Two-way Deconfounder for Off-policy Evaluation in Causal Reinforcement Learning
Reference 104
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.