Typed states for the displayed outbound observations.
Source: paper_references, paper_reference_links, observed 2026-05-15T07:55:15.678348Z
Paper Citation Record · LEDGER
As of 11 August 2026, this Paper Citation Record lists 29 of 29 outbound references and 83 inbound Pith citation observations for arXiv:2208.06193.
A citation records a reference. It does not transfer a finding from one paper to another.
Typed states for the displayed outbound observations.
Source: paper_references, paper_reference_links, observed 2026-05-15T07:55:15.678348Z
One-hop event checks from named stored sources.
Source: scholarly_work_events, retraction_status_cache, observed 2026-08-10T06:31:04.303077+00:00
Pith citing papers itemized under the disclosed page cap.
Source: paper_references, paper_reference_links, observed 2026-08-10T20:43:10.843823Z
A source-named dated measurement, never combined with another source.
Source: pith, observed 2026-07-04T06:49:37.744619Z
29 of 29 outbound references displayed
External citation measurements
No source-named external measurement is stored.
Observation eec0bf49-870f-4c19-9509-febcfe95ff3a · outbound
Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning Is Conditional Generative Modeling all you need for Decision-Making?
Reference 1
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.
Observation 056b3df7-809a-4f66-9d87-30044f2e8677 · outbound
Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning D4RL: Datasets for Deep Data-Driven Reinforcement Learning
Reference 2
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.
Observation 09bfa496-0d19-4c70-b90d-196d3cace0d6 · outbound
Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning Off-policy deep reinforcement learning without exploration
Reference 3
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.
Observation bdef00ee-3763-4b84-87e8-7416d08c579d · outbound
Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning Know Your Boundaries: The Necessity of Explicit Behavioral Cloning in Offline RL
Reference 4
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.
Observation cbd67746-5e7a-4a00-bc36-45eba698131b · outbound
Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning Planning with Diffusion for Flexible Behavior Synthesis
Reference 5
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.
Observation 15a2ef3a-8960-4322-b194-f505d72b1254 · outbound
Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning Adam: A Method for Stochastic Optimization
Reference 6
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.
Observation 2b680175-38fd-4be1-b83c-e58cf3e1ab98 · outbound
Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning Offline Reinforcement Learning with Implicit Q-Learning
Reference 7
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.
Observation 1176ba35-2a80-4c29-bd9c-e9916b6c243d · outbound
Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning Continuous control with deep reinforcement learning
Reference 8
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.
Observation e45bf9a9-d0eb-439f-a1f0-a4d5da48ae6a · outbound
Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning DPM-Solver: A Fast ODE Solver for Diffusion Probabilistic Model Sampling in Around 10 Steps
Reference 9
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.
Observation b0c20bb4-f22b-4b12-ae36-fcdfd60e549b · outbound
Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning Mildly Conservative Q-Learning for Offline Reinforcement Learning
Reference 10
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.
Observation d78308f1-b0aa-4040-94c8-a851a7274406 · outbound
Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning AWAC: Accelerating Online Reinforcement Learning with Offline Datasets
Reference 11
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.
Observation 7d877569-8fa1-4044-8954-9e689c3e98b9 · outbound
Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning Imitating Human Behaviour with Diffusion Models
Reference 12
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.
Observation 7799ebfd-dddb-4a76-b042-45125ebc1b32 · outbound
Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning Advantage-Weighted Regression: Simple and Scalable Off-Policy Reinforcement Learning
Reference 13
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.
Observation faa0a6e7-1e72-4713-bff9-ae3ebe15d68e · outbound
Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning Progressive Distillation for Fast Sampling of Diffusion Models
Reference 14
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.
Observation f31be01c-a54f-47c6-b36d-7199552fcd00 · outbound
Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning Behavior Transformers: Cloning $k$ modes with one stone
Reference 15
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.
Observation 5bfd00f3-66bf-4be0-ab96-8305917d02a9 · outbound
Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning Deep Unsupervised Learning using Nonequilibrium Thermodynamics
Reference 16
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.
Observation 646bd8c7-3c4e-48c1-b818-bac504da60b7 · outbound
Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning Denoising Diffusion Implicit Models
Reference 17
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.
Observation 4597c9cd-12bf-4d7e-abd9-a6bef932c18a · outbound
Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning 11 Published as a conference paper at ICLR 2023 Richard S Sutton and Andrew G Barto
Reference 18
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.
Observation dc3e612c-74ac-4adb-ac94-ea72f0493613 · outbound
Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning Diffusion-GAN: Training GANs with Diffusion
Reference 19
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.
Observation b5d510ac-e9e6-4f65-9da6-a99fdb5cef21 · outbound
Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning Behavior Regularized Offline Reinforcement Learning
Reference 20
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.
Observation 0f516002-3b44-48c1-9288-7a306d8a37cb · outbound
Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning Tackling the Generative Learning Trilemma with Denoising Diffusion GANs
Reference 21
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.
Observation 910a542d-217a-40b8-9616-a742d395493e · outbound
Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning Truncated Diffusion Probabilistic Models and Diffusion-based Adversarial Auto-Encoders
Reference 22
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.
Observation 126a36ee-4124-4a85-960c-9631dbc26c36 · outbound
Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning Actions are again in a real-valued 2D space, a ∈ [−1, 1]2
Reference 23
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.
Observation 9da335d2-6e26-488f-804a-88b6e6399be4 · outbound
Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning For behavior-cloning experiments, we observe that only our diffusion model could recover the orig- inal data distribution while the prior regularization methods fail in some way
Reference 24
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.
Observation 6a7801aa-0b8f-42c0-8072-4de1ee3d2fcc · outbound
Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning C E XPERIMENTAL DETAILS We train our algorithm with 2000 epochs for Gym tasks and 1000 epochs for the other tasks, where each epoch consists of 1000 gradient steps
Reference 25
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.
Observation 9398589f-2a9e-43e8-b906-22f24c86974a · outbound
Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning Unresolved cited work
Reference 26
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.
Observation 6f5da7f8-fb38-4ba8-baee-5e58384533ed · outbound
Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning Unresolved cited work
Reference 27
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.
Observation 395d7135-2397-49e4-ab6b-1f201ea0ddd7 · outbound
Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning We have shown this results in learning better policies in offlineRL
Reference 28
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.
Observation 9dd233b3-618a-4edb-81c0-2a3e8c99fe04 · outbound
Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning Unresolved cited work
Reference 29
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.
Observation 7ac80405-8840-4ba6-8fe1-ebe993b28280 · inbound
Diffusion Policy: Visuomotor Policy Learning via Action Diffusion Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning
Reference 10
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.
Observation 994dbbe3-6b30-411a-8993-cfe8ece56105 · inbound
IDQL: Implicit Q-Learning as an Actor-Critic Method with Diffusion Policies Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning
Reference 45
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.
Observation d8de71e7-39be-44c8-8808-06dfd1f62b5a · inbound
Training Diffusion Models with Reinforcement Learning Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning
Reference 29
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.
Observation 41b930f7-2c85-4dd0-b1c8-df9ad8499b81 · inbound
3D Diffuser Actor: Policy Diffusion with 3D Scene Representations Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning
Reference 39
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.
Observation f6229189-5202-48aa-b716-dfd78823ce01 · inbound
Diffusion Policy Policy Optimization Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning
Reference 100
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.
Observation 4b3c8da6-746f-438d-8299-8c600536bc31 · inbound
From Screens to Scenes: A Survey of Embodied AI in Healthcare Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning
Reference 241
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 8852ed3d-2aa6-46b2-95fd-a88ea53872a5 · inbound
Generative AI-driven Cross-layer Covert Communication: Fundamentals, Framework and Case Study Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning
Reference 7
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation aad60dac-a116-4642-b486-1529543fe211 · inbound
Offline Diffusion Policy for Multi-User Delay-Constrained Scheduling Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning
Reference 83
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation a0ab7c18-6c95-4044-adfb-205e60997282 · inbound
Efficient Online Reinforcement Learning for Diffusion Policy Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning
Reference 47
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 51d2b1ae-4cd8-4110-8204-3e02e3f2ea1e · inbound
HybridVLA: Collaborative Diffusion and Autoregression in a Unified Vision-Language-Action Model Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning
Reference 51
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.
Observation fe1bf706-dab6-4486-b4e9-02a2ad4fac05 · inbound
BalancedDPO: Adaptive Multi-Metric Alignment Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning
Reference 14
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.
Observation b847c2d6-688b-413d-807f-163f9a42b7f3 · inbound
VIPO: Value Function Inconsistency Penalized Offline Reinforcement Learning Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning
Reference 9
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.
Observation a72f762f-edd0-4573-b06c-85b28c7a4840 · inbound
FlowQ: Energy-Guided Flow Policies for Offline Reinforcement Learning Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning
Reference 19
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 25dc2dab-b486-4eed-bb29-3dabaa895e39 · inbound
Cascaded Diffusion Models for Neural Motion Planning Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning
Reference 10
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 7a33a587-91c8-495d-a991-4a2389b37c28 · inbound
Learning to Trust Bellman Updates: Selective State-Adaptive Regularization for Offline RL Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning
Reference 17
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation d52a9e49-a01c-4f4b-9059-477a16ecc566 · inbound
Decision Flow Policy Optimization Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning
Reference 84
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 77a45f2d-adb8-4921-b993-68bdfb79c047 · inbound
BiTrajDiff: Bidirectional Trajectory Generation with Diffusion Models for Offline Reinforcement Learning Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning
Reference 44
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.
Observation 02e0fc2b-835e-4cf9-bd43-666c636f48ee · inbound
Real-Time Execution of Action Chunking Flow Policies Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning
Reference 64
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.
Observation fa19f191-2ee8-4b19-baf1-31e256d4836f · inbound
Semi-gradient DICE for Offline Constrained Reinforcement Learning Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning
Reference 42
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 39ef6507-02fa-43d7-8977-73111800c368 · inbound
ClutterDexGrasp: A Sim-to-Real System for General Dexterous Grasping in Cluttered Scenes Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning
Reference 50
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation dcccf895-d921-48ad-a92c-e13efc3933ca · inbound
Steering Your Diffusion Policy with Latent Space Reinforcement Learning Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning
Reference 46
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.
Observation 95dc4f19-86d8-4674-8e21-89a853191561 · inbound
Offline Reinforcement Learning with Penalized Action Noise Injection Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning
Reference 34
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 302007d0-04f9-4809-a204-cca0d10cb5ed · inbound
Spatial-Temporal Aware Visuomotor Diffusion Policy Learning Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning
Reference 38
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation c4b99743-a20b-49c0-b964-25ec4014ab0e · inbound
EAT: QoS-Aware Edge-Collaborative AIGC Task Scheduling via Attention-Guided Diffusion Reinforcement Learning Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning
Reference 35
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 7fdd4f8b-a471-4d08-9208-c889534d5e14 · inbound
Censored Sampling for Topology Design: Guiding Diffusion with Human Preferences Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning
Reference 163
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 0fed7347-ea3c-470b-8eb9-868e3a04b80d · inbound
Large Model Empowered Embodied AI: A Survey on Decision-Making and Embodied Learning Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning
Reference 199
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation cfacb3a9-9f64-4285-b382-e1bf72ae8d2b · inbound
Diffusion-RL Based Air Traffic Conflict Detection and Resolution Method Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning
Reference 38
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 5dbc7881-a16a-4492-b969-3e1883d7af6d · inbound
Diffusion-Guided Multi-Arm Motion Planning Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning
Reference 30
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 6999ea11-2336-4272-bae1-a3bee618d4aa · inbound
Wavelet Fourier Diffuser: Frequency-Aware Diffusion Model for Reinforcement Learning Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning
Reference 29
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation de8e4e58-1c07-4bf5-a5c2-783642e85750 · inbound
Reinforcement Learning with Discrete Diffusion Policies for Combinatorial Action Spaces Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning
Reference 62
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.
Observation 73429f7f-7804-4655-a7d5-d0c0fede7592 · inbound
Diffusion Bridge or Flow Matching? A Unifying Framework and Comparative Analysis Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning
Reference 29
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation ffa0ba8b-3210-460c-b85b-28cacd99a5f9 · inbound
Value Flows Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning
Reference 82
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation d99e9b3b-e9cc-4c78-b051-75d5b6866443 · inbound
FM-IRL: Flow-Matching for Reward Modeling and Policy Regularization in Reinforcement Learning Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning
Reference 23
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 1c09ee03-1f21-430b-91b2-305a777b62d2 · inbound
Self-Imitated Diffusion Policy for Efficient and Robust Visual Navigation Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning
Reference 10
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 77cd936f-939d-43e5-997f-1270f5770f7f · inbound
How Does the Lagrangian Guide Safe Reinforcement Learning through Diffusion Models? Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning
Reference 21
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.
Observation 859563cd-2542-42ff-8b0b-273bafced1da · inbound
GeMPO: Generalized Measure Matching for Online Diffusion Reinforcement Learning Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning
Reference 57
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 5e08b9d1-fae2-483e-9b0d-7efd2bf17d95 · inbound
Nonreciprocal current induced by dissipation in time-reversal symmetric systems Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning
Reference 21
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 1bc11e9b-b40a-4ab6-9298-7ce8b98e8fbe · inbound
Receding-Horizon Control via Drifting Models Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning
Reference 21
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.
Observation bb587849-e519-40dd-a030-5b7a873e31e6 · inbound
Efficient Hierarchical Implicit Flow Q-learning for Offline Goal-conditioned Reinforcement Learning Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning
Reference 13
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.
Observation e270f2cb-8855-4743-b19d-fead74681d6b · inbound
Fisher Decorator: Refining Flow Policy via a Local Transport Map Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning
Reference 13
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.
Observation 11044c6c-895c-406f-9c18-cdd5bf0488d9 · inbound
Accelerating trajectory optimization with Sobolev-trained diffusion policies Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning
Reference 38
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.
Observation 5047ad81-58a9-4fd8-9e0a-9009460d4c1d · inbound
FASTER: Value-Guided Sampling for Fast RL Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning
Reference 9
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.
Observation 3e25564b-0eb6-4af3-8621-c2d36ed2b7ec · inbound
AdamO: A Collapse-Suppressed Optimizer for Offline RL Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning
Reference 60
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.
Observation 59bea60f-96b3-445c-abce-b49fa4767182 · inbound
Refining Compositional Diffusion for Reliable Long-Horizon Planning Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning
Reference 75
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.
Observation 8f1a1ee9-8cd1-431d-af09-e21b364578dd · inbound
Beyond Penalization: Diffusion-based Out-of-Distribution Detection and Selective Regularization in Offline Reinforcement Learning Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning
Reference 8
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.
Observation dcd47bc1-4b30-4ad2-af28-666395e741c6 · inbound
Path-Coupled Bellman Flows for Distributional Reinforcement Learning Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning
Reference 22
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.
Observation 9a21c44e-d57a-44f2-833e-9bcb96dd0bf6 · inbound
Insider Attacks in Multi-Agent LLM Consensus Systems Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning
Reference 95
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.
Observation 885def38-d9cc-494f-8a51-1aed58f8b554 · inbound
Muninn: Your Trajectory Diffusion Model But Faster Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning
Reference 62
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.
Observation 70149c94-010d-4d69-92d4-e50b0a1c2d02 · inbound
Revisiting Policy Gradients for Restricted Policy Classes: Escaping Myopic Local Optima with $k$-step Policy Gradients Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning
Reference 49
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.
Observation 07f84e69-f09e-4bb6-beb1-948d76993f72 · inbound
Block-R1: Rethinking the Role of Block Size in Multi-domain Reinforcement Learning for Diffusion Large Language Models Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning
Reference 64
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.
Observation 9ac5a5b9-5dca-4786-8015-9a89c3cd5137 · inbound
Block-R1: Rethinking the Role of Block Size in Multi-domain Reinforcement Learning for Diffusion Large Language Models Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning
Reference 64
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.
Observation e1513347-6a38-43d6-a94f-40200bedea25 · inbound
Aligning Flow Map Policies with Optimal Q-Guidance Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning
Reference 43
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.
Observation 6b9ba123-3d86-4eb9-9832-7fe3b741f56e · inbound
Driving Intents Amplify Planning-Oriented Reinforcement Learning Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning
Reference 20
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.
Observation 63508570-6442-4507-a77e-63052d1cf11d · inbound
Driving Intents Amplify Planning-Oriented Reinforcement Learning Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning
Reference 21
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.
Observation 05e5801a-de5e-48db-bab0-60ccbc6a55e7 · inbound
JEDI: Joint Embedding Diffusion World Model for Online Model-Based Reinforcement Learning Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning
Reference 25
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.
Observation 293975ad-1b8a-429d-b0ab-a73b8e79fe76 · inbound
Ada-Diffuser: Latent-Aware Adaptive Diffusion for Decision-Making Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning
Reference 24
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.
Observation aa53d60e-5d78-4539-89b7-1db658aea058 · inbound
Global Convergence of Sampling-Based Nonconvex Optimization through Diffusion-Style Smoothing Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning
Reference 211
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.
Observation 84d67496-976e-4353-b5ff-c0138c0423d0 · inbound
D$^3$-Subsidy: Online and Sequential Driver Subsidy Decision-Making for Large-Scale Ride-Hailing Market Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning
Reference 21
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.
Observation 009132cc-b9d1-4aa3-a6f9-141e6376e6db · inbound
D$^3$-Subsidy: Online and Sequential Driver Subsidy Decision-Making for Large-Scale Ride-Hailing Market Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning
Reference 21
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.
Observation 6aa08e93-4571-4600-823f-17b3360c0a25 · inbound
D$^3$-Subsidy: Online and Sequential Driver Subsidy Decision-Making for Large-Scale Ride-Hailing Market Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning
Reference 21
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.
Observation 924b9bc7-efb3-4933-a760-634ac1414df6 · inbound
D$^3$-Subsidy: Online and Sequential Driver Subsidy Decision-Making for Large-Scale Ride-Hailing Market Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning
Reference 21
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.
Observation 122435b3-554b-42c1-bb11-8cc966680c11 · inbound
HITL-D: Human In The Loop Diffusion Assisted Shared Control Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning
Reference 16
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.
Observation a7380df4-2c16-4cf9-8f26-57ae3abc5f89 · inbound
Cross-Domain Energy-Guided Diffusion Generation for Off-Dynamics Reinforcement Learning Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning
Reference 34
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.
Observation 2bf5a61c-7a71-4832-9024-17d25bcc25d7 · inbound
From Denoising to Decision Making: A Survey on Diffusion Model-Enabled Deep Reinforcement Learning for Wireless Networks Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning
Reference 41
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.
Observation 4bfeff70-e09a-4198-909b-9f77015bd300 · inbound
Adversarial Dual On-Policy Distillation from Expressive Teacher Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning
Reference 21
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.
Observation b015ed9f-d634-4d83-82fd-2e117255cb30 · inbound
SPAR: Support-Preserving Action Rectification Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning
Reference 15
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.
Observation 84ca06a8-0ab3-425f-ba8a-52730bbd4995 · inbound
GDSD: Reinforcement Learning as Guided Denoiser Self-Distillation for Diffusion Language Models Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning
Reference 55
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.
Observation 539834d2-a9e0-4467-8101-85ee296ee714 · inbound
Lagrangian Perturbation Diffusion Steering: Latent Reinforcement Learning for Generative Policies Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning
Reference 28
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.
Observation 4fb2eb9f-ba9c-4159-8f73-6a8efce2a0be · inbound
Training-Free Imitation Learning with Closed-Form Diffusion Policies Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning
Reference 10
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.
Observation a357415b-276f-4873-8deb-ec925f3ec93c · inbound
Counterfactual Transport Flows for Offline Conservative Trajectory Refinement Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning
Reference 80
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.
Observation b69f719c-2681-4cba-b14f-b0a96caa8187 · inbound
Fast and Highly Expressive Policy Learning for Offline Reinforcement Learning via Bootstrapped Flow Q-Learning Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning
Reference 23
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.
Observation 06216ae3-c849-4049-811c-d242e4cb7db7 · inbound
MODIP: Efficient Model-Based Optimization for Diffusion Policies Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning
Reference 22
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.
Observation a93d95b9-b1af-49c1-8b5c-4358081e92c1 · inbound
Test-Time Gradient Guidance of Flow Policies in Reinforcement Learning Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning
Reference 63
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.
Observation bffd78e1-b49c-4867-a2fc-b576d1c736b3 · inbound
Energy-based Compositional Diffusion Planning Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning
Reference 25
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.
Observation 076ee41d-ae43-40d9-b6af-c9cecbb6361b · inbound
RS-Diffuser: Risk-Sensitive Diffusion Planning with Distributional Value Guidance Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning
Reference 28
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.
Observation 7bc40a06-f596-4293-abb5-ed9fa45284d0 · inbound
Guided Action Flow: Q-Guided Inference for Flow-Matching Vision-Language-Action Policies Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning
Reference 23
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.
Observation d7d23c51-e4e5-4295-8d10-f1a6f1327b57 · inbound
Guided Action Flow: Q-Guided Inference for Flow-Matching Vision-Language-Action Policies Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning
Reference 23
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 81ce14fc-6107-400f-9081-925c4e3fc569 · inbound
A Single Diffusion-Policy Controller for Multi-Task Block Pushing with Zero-Shot Sim-to-Real Transfer Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning
Reference 8
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 6f34c692-fc82-4357-aaa5-fc1f2bec7ba4 · inbound
Reinforcement Learning: From Algorithms To Foundation Models Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning
Reference 146
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation c2aa95f3-ad94-40d2-b9c8-9cf54e7e21ad · inbound
Good Rankers, Bad Objectives: Bilinear Contrastive Critics under Expressive Policy Search Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning
Reference 33
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 65176c4b-f0e2-447f-8ebf-363b34b5ffdf · inbound
Deep Reinforcement Learning: From First Principles to Reasoning Models Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning
Reference 2023
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 758f9309-a314-4a46-80c2-a2c53f2a5bbb · inbound
ReBRAC-v2: The Return of the King Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning
Reference 76
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation e1af34ed-08b7-4250-b4f4-ba4dc3411141 · inbound
Weights or Skills? A Survey of Robot-Learning Techniques: from Action-Predicting Weights to Robots that Write their Own Skills Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning
Reference 265
Source-reported events for the cited work
Unavailable: canonical work link unavailable.