Pith. sign in

Paper Citation Record · LEDGER

Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning

As of 11 August 2026, this Paper Citation Record lists 29 of 29 outbound references and 83 inbound Pith citation observations for arXiv:2208.06193.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2208.06193 v3

Coverage vector

measured 29 of 29 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-05-15T07:55:15.678348Z

measured 112 of 112 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-10T06:31:04.303077+00:00

measured 83 of 83 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-10T20:43:10.843823Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: pith, observed 2026-07-04T06:49:37.744619Z

Reference resolution

29 of 29 outbound references displayed

  • verified exact17
  • verified fuzzy6
  • unresolved2
  • parse uncertain0
  • malformed identifier1
  • metadata mismatch3

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation eec0bf49-870f-4c19-9509-febcfe95ff3a · outbound

This paper cites Is Conditional Generative Modeling all you need for Decision-Making?.

Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning Is Conditional Generative Modeling all you need for Decision-Making?

Reference 1

Resolution
verified exact
arxiv_id, observed 2026-05-15T15:35:11.667805Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-05-15T07:55:15.678348Z digest=sha256:59ef3649192b3730916526cada09cf93193f9bc95db1a1d234d986a1bcc918b6

Observation 056b3df7-809a-4f66-9d87-30044f2e8677 · outbound

This paper cites D4RL: Datasets for Deep Data-Driven Reinforcement Learning.

Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning D4RL: Datasets for Deep Data-Driven Reinforcement Learning

Reference 2

Resolution
verified exact
local_arxiv, observed 2026-05-15T07:55:15.719096Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-05-15T07:55:15.678348Z digest=sha256:c67bc83a49e431bc20d5d0494a2c779f66be70219589d634560223b71d759a90

Observation 09bfa496-0d19-4c70-b90d-196d3cace0d6 · outbound

This paper cites Off-policy deep reinforcement learning without exploration.

Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning Off-policy deep reinforcement learning without exploration

Reference 3

Resolution
verified fuzzy
raw_fallback, observed 2026-05-15T07:55:15.866945Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-05-15T07:55:15.678348Z digest=sha256:74dda656d1b725a8d2db7ba36014dc2c50faceec8485e112e03dca7620508026

Observation bdef00ee-3763-4b84-87e8-7416d08c579d · outbound

This paper cites Know Your Boundaries: The Necessity of Explicit Behavioral Cloning in Offline RL.

Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning Know Your Boundaries: The Necessity of Explicit Behavioral Cloning in Offline RL

Reference 4

Resolution
metadata mismatch
arxiv_id, observed 2026-05-15T07:55:15.799302Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-05-15T07:55:15.678348Z digest=sha256:d1f67fb17938dce70986f7db9b0f4154cebba5b35bad3016f37dd9823b7913ce

Observation cbd67746-5e7a-4a00-bc36-45eba698131b · outbound

This paper cites Planning with Diffusion for Flexible Behavior Synthesis.

Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning Planning with Diffusion for Flexible Behavior Synthesis

Reference 5

Resolution
verified exact
local_arxiv, observed 2026-05-15T07:55:15.806639Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-05-15T07:55:15.678348Z digest=sha256:df22aa19b9771cb3ecfefab3e5569c3e2a99b6d6d5af3b611869ff226d5e3c63

Observation 15a2ef3a-8960-4322-b194-f505d72b1254 · outbound

This paper cites Adam: A Method for Stochastic Optimization.

Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning Adam: A Method for Stochastic Optimization

Reference 6

Resolution
verified exact
local_arxiv, observed 2026-05-15T07:55:15.813188Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-05-15T07:55:15.678348Z digest=sha256:8755987e07365e5bb24131ada09ae3df794f564f7158cc57718f763ad4e1add0

Observation 2b680175-38fd-4be1-b83c-e58cf3e1ab98 · outbound

This paper cites Offline Reinforcement Learning with Implicit Q-Learning.

Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning Offline Reinforcement Learning with Implicit Q-Learning

Reference 7

Resolution
verified exact
local_arxiv, observed 2026-05-15T07:55:15.820040Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-05-15T07:55:15.678348Z digest=sha256:2a92dc8d75d75ca6ec9efa80e679de7e159f074c6bf93791d3d878c93928a75a

Observation 1176ba35-2a80-4c29-bd9c-e9916b6c243d · outbound

This paper cites Continuous control with deep reinforcement learning.

Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning Continuous control with deep reinforcement learning

Reference 8

Resolution
verified exact
local_arxiv, observed 2026-05-15T07:55:15.827422Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-05-15T07:55:15.678348Z digest=sha256:59f504ab5d5956ddd4c4dd4ea2f48e9e2a5de39cf20de804f80a1fa5f030d8dc

Observation e45bf9a9-d0eb-439f-a1f0-a4d5da48ae6a · outbound

This paper cites DPM-Solver: A Fast ODE Solver for Diffusion Probabilistic Model Sampling in Around 10 Steps.

Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning DPM-Solver: A Fast ODE Solver for Diffusion Probabilistic Model Sampling in Around 10 Steps

Reference 9

Resolution
verified exact
arxiv_id, observed 2026-05-15T07:55:15.834614Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-05-15T07:55:15.678348Z digest=sha256:3d74e9ff5ed1063c75b27f4519ff05fc857cf7bb337a69e7ca2e5397577ffce4

Observation b0c20bb4-f22b-4b12-ae36-fcdfd60e549b · outbound

This paper cites Mildly Conservative Q-Learning for Offline Reinforcement Learning.

Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning Mildly Conservative Q-Learning for Offline Reinforcement Learning

Reference 10

Resolution
verified exact
arxiv_id, observed 2026-05-15T07:55:15.841431Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-05-15T07:55:15.678348Z digest=sha256:ba057bce61eda387f1657ccf085add9a1ec3d1344d7832805a8802dfaba3e848

Observation d78308f1-b0aa-4040-94c8-a851a7274406 · outbound

This paper cites AWAC: Accelerating Online Reinforcement Learning with Offline Datasets.

Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning AWAC: Accelerating Online Reinforcement Learning with Offline Datasets

Reference 11

Resolution
verified exact
local_arxiv, observed 2026-05-15T07:55:15.851450Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-05-15T07:55:15.678348Z digest=sha256:9dbea56446af0ccaa02220e614110c433b14e19bc8d757b302a4be0dea3cadc6

Observation 7d877569-8fa1-4044-8954-9e689c3e98b9 · outbound

This paper cites Imitating Human Behaviour with Diffusion Models.

Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning Imitating Human Behaviour with Diffusion Models

Reference 12

Resolution
verified exact
arxiv_id, observed 2026-05-15T07:55:15.862233Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-05-15T07:55:15.678348Z digest=sha256:783a778bc5c89f15d7893a793fdcab89cd548a4af6c8f4f7bdc6078e35aec658

Observation 7799ebfd-dddb-4a76-b042-45125ebc1b32 · outbound

This paper cites Advantage-Weighted Regression: Simple and Scalable Off-Policy Reinforcement Learning.

Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning Advantage-Weighted Regression: Simple and Scalable Off-Policy Reinforcement Learning

Reference 13

Resolution
verified exact
local_arxiv, observed 2026-05-15T07:55:15.725977Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-05-15T07:55:15.678348Z digest=sha256:cccb2eb35f53ec1498977304c086a21fa48d7beed750783fbe2e7e7dec0ca7db

Observation faa0a6e7-1e72-4713-bff9-ae3ebe15d68e · outbound

This paper cites Progressive Distillation for Fast Sampling of Diffusion Models.

Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning Progressive Distillation for Fast Sampling of Diffusion Models

Reference 14

Resolution
verified exact
local_arxiv, observed 2026-05-15T07:55:15.733570Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-05-15T07:55:15.678348Z digest=sha256:a43dd7e27ee0f89e20080a75d54ec19f668177b27731d17961f5ebfde3e7c65c

Observation f31be01c-a54f-47c6-b36d-7199552fcd00 · outbound

This paper cites Behavior Transformers: Cloning $k$ modes with one stone.

Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning Behavior Transformers: Cloning $k$ modes with one stone

Reference 15

Resolution
verified exact
arxiv_id, observed 2026-05-15T07:55:15.742785Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-05-15T07:55:15.678348Z digest=sha256:1d7bf07e66bc4c9eec9bd8b147b4122f878f90d02be023e65d5894fb19180346

Observation 5bfd00f3-66bf-4be0-ab96-8305917d02a9 · outbound

This paper cites Deep Unsupervised Learning using Nonequilibrium Thermodynamics.

Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning Deep Unsupervised Learning using Nonequilibrium Thermodynamics

Reference 16

Resolution
metadata mismatch
local_arxiv, observed 2026-05-15T07:55:15.750609Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-05-15T07:55:15.678348Z digest=sha256:46cb9d944f3b3a5a22705694713af7f730eea925d73b0c8e9a7b2a8ea5cb7091

Observation 646bd8c7-3c4e-48c1-b818-bac504da60b7 · outbound

This paper cites Denoising Diffusion Implicit Models.

Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning Denoising Diffusion Implicit Models

Reference 17

Resolution
verified exact
local_arxiv, observed 2026-05-15T07:55:15.757468Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-05-15T07:55:15.678348Z digest=sha256:5e064c4bb19eddadf117d0289413688fbb4eb0419fbb1d6a3877aee37826d5a7

Observation 4597c9cd-12bf-4d7e-abd9-a6bef932c18a · outbound

This paper cites 11 Published as a conference paper at ICLR 2023 Richard S Sutton and Andrew G Barto.

Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning 11 Published as a conference paper at ICLR 2023 Richard S Sutton and Andrew G Barto

Reference 18

Resolution
verified fuzzy
raw_fallback, observed 2026-05-15T07:55:15.897816Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-05-15T07:55:15.678348Z digest=sha256:45f0b0dd57d3e9d92dbe5563464d97304a9d5a276e1a202606f4bc9b0ec8ae92

Observation dc3e612c-74ac-4adb-ac94-ea72f0493613 · outbound

This paper cites Diffusion-GAN: Training GANs with Diffusion.

Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning Diffusion-GAN: Training GANs with Diffusion

Reference 19

Resolution
verified exact
arxiv_id, observed 2026-05-15T07:55:15.766018Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-05-15T07:55:15.678348Z digest=sha256:bda2f8fb070a968c2a2b9d2a95e3d95e9820f232f211ca30341f9ad3b30dfc7c

Observation b5d510ac-e9e6-4f65-9da6-a99fdb5cef21 · outbound

This paper cites Behavior Regularized Offline Reinforcement Learning.

Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning Behavior Regularized Offline Reinforcement Learning

Reference 20

Resolution
verified exact
local_arxiv, observed 2026-05-15T07:55:15.772701Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-05-15T07:55:15.678348Z digest=sha256:349f3d6c4f8fef7d18dc3e2244ee6469d1196faba83bad95f4cf77273ef0b69d

Observation 0f516002-3b44-48c1-9288-7a306d8a37cb · outbound

This paper cites Tackling the Generative Learning Trilemma with Denoising Diffusion GANs.

Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning Tackling the Generative Learning Trilemma with Denoising Diffusion GANs

Reference 21

Resolution
verified exact
arxiv_id, observed 2026-05-15T07:55:15.782473Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-05-15T07:55:15.678348Z digest=sha256:132798cadae48abdd62614fbd0b45ceed0a40a30f31db7664b8e30f5f4463a3d

Observation 910a542d-217a-40b8-9616-a742d395493e · outbound

This paper cites Truncated Diffusion Probabilistic Models and Diffusion-based Adversarial Auto-Encoders.

Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning Truncated Diffusion Probabilistic Models and Diffusion-based Adversarial Auto-Encoders

Reference 22

Resolution
metadata mismatch
arxiv_id, observed 2026-05-15T07:55:15.790173Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-05-15T07:55:15.678348Z digest=sha256:23e1e6ca9407f29bcaabe3b8fc982dbbc561d6f878fd80aa9bfcecd50d42b264

Observation 126a36ee-4124-4a85-960c-9631dbc26c36 · outbound

This paper cites Actions are again in a real-valued 2D space, a ∈ [−1, 1]2.

Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning Actions are again in a real-valued 2D space, a ∈ [−1, 1]2

Reference 23

Resolution
verified fuzzy
raw_fallback, observed 2026-05-15T07:55:15.884405Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-05-15T07:55:15.678348Z digest=sha256:2cce468fe43a4d9a5b0c678b68a0a8d72ea0cab5ad38e979c012c38a4138f9bb

Observation 9da335d2-6e26-488f-804a-88b6e6399be4 · outbound

This paper cites For behavior-cloning experiments, we observe that only our diffusion model could recover the orig- inal data distribution while the prior regularization methods fail in some way.

Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning For behavior-cloning experiments, we observe that only our diffusion model could recover the orig- inal data distribution while the prior regularization methods fail in some way

Reference 24

Resolution
verified fuzzy
raw_fallback, observed 2026-05-15T07:55:15.888579Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-05-15T07:55:15.678348Z digest=sha256:030de0f349af1329e9b8dabeb227ce532de436f2a9502396f03039acc643af42

Observation 6a7801aa-0b8f-42c0-8072-4de1ee3d2fcc · outbound

This paper cites C E XPERIMENTAL DETAILS We train our algorithm with 2000 epochs for Gym tasks and 1000 epochs for the other tasks, where each epoch consists of 1000 gradient steps.

Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning C E XPERIMENTAL DETAILS We train our algorithm with 2000 epochs for Gym tasks and 1000 epochs for the other tasks, where each epoch consists of 1000 gradient steps

Reference 25

Resolution
verified fuzzy
raw_fallback, observed 2026-05-15T07:55:15.893643Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-05-15T07:55:15.678348Z digest=sha256:015a53a9ab7147df09a5503cf92cbca367831295def70ac525cf4a3584c99198

Observation 9398589f-2a9e-43e8-b906-22f24c86974a · outbound

This paper cites an unresolved cited work.

Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning Unresolved cited work

Reference 26

Resolution
unresolved
raw_fallback, observed 2026-05-15T07:55:15.901707Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-05-15T07:55:15.678348Z digest=sha256:cecb7f42eed4efc4246bbf6d2c76aefbb444a34a9f9f050a5f66e526e4c45412

Observation 6f5da7f8-fb38-4ba8-baee-5e58384533ed · outbound

This paper cites an unresolved cited work.

Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning Unresolved cited work

Reference 27

Resolution
unresolved
raw_fallback, observed 2026-05-15T07:55:15.870971Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-05-15T07:55:15.678348Z digest=sha256:dc39d22745f0eb9a79f330993981979e1651196e24373bfbad43dbd92a69c49e

Observation 395d7135-2397-49e4-ab6b-1f201ea0ddd7 · outbound

This paper cites We have shown this results in learning better policies in offlineRL.

Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning We have shown this results in learning better policies in offlineRL

Reference 28

Resolution
verified fuzzy
raw_fallback, observed 2026-05-15T07:55:15.875344Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-05-15T07:55:15.678348Z digest=sha256:c1171851a93a57b9a6199926bb24c4e6e20b3a862fc8c0c2cc4213d9728f8464

Observation 9dd233b3-618a-4edb-81c0-2a3e8c99fe04 · outbound

This paper cites an unresolved cited work.

Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning Unresolved cited work

Reference 29

Resolution
malformed identifier
raw_fallback, observed 2026-05-15T07:55:15.879187Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-05-15T07:55:15.678348Z digest=sha256:75099d16803214f4dbb61c64d519c2cdac76402d59135032970a05e31ef07d61

Pith citing papers

Observation 7ac80405-8840-4ba6-8fe1-ebe993b28280 · inbound

Diffusion Policy: Visuomotor Policy Learning via Action Diffusion cites this paper.

Diffusion Policy: Visuomotor Policy Learning via Action Diffusion Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning

Reference 10

Resolution
metadata mismatch
arxiv_id, observed 2026-05-15T07:55:15.903200Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-05-13T00:20:30.936392Z digest=sha256:9b3e96c2396918c08792e963454ecaf207cb0fe2749a9de13b0e631e0721ab4b

Observation 994dbbe3-6b30-411a-8993-cfe8ece56105 · inbound

IDQL: Implicit Q-Learning as an Actor-Critic Method with Diffusion Policies cites this paper.

IDQL: Implicit Q-Learning as an Actor-Critic Method with Diffusion Policies Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning

Reference 45

Resolution
verified exact
arxiv_id, observed 2026-05-15T07:55:15.903200Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-05-13T13:48:36.369334Z digest=sha256:07d1a98d852729bfcbbf7434f395a6d01aa883d464bc732598e2c263868c0f75

Observation d8de71e7-39be-44c8-8808-06dfd1f62b5a · inbound

Training Diffusion Models with Reinforcement Learning cites this paper.

Training Diffusion Models with Reinforcement Learning Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning

Reference 29

Resolution
verified exact
arxiv_id, observed 2026-05-15T07:55:15.903200Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-05-11T20:16:30.840184Z digest=sha256:c3c376f263b063397458bfd85ccba24c7376e80addf4d11beb47d876cd55533f

Observation 41b930f7-2c85-4dd0-b1c8-df9ad8499b81 · inbound

3D Diffuser Actor: Policy Diffusion with 3D Scene Representations cites this paper.

3D Diffuser Actor: Policy Diffusion with 3D Scene Representations Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning

Reference 39

Resolution
verified exact
local_arxiv, observed 2026-05-17T22:00:04.947744Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-05-17T22:00:04.812281Z digest=sha256:968dea2a84b0939d06b8e414fb76db32f76b8a1d4a088f61d1594bc58a05582e

Observation f6229189-5202-48aa-b716-dfd78823ce01 · inbound

Diffusion Policy Policy Optimization cites this paper.

Diffusion Policy Policy Optimization Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning

Reference 100

Resolution
verified exact
local_arxiv, observed 2026-05-16T08:48:15.032219Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-05-16T08:48:14.776754Z digest=sha256:45427e2462de1c57cedc4fa199b84cc482b8320b1795803081b0e68784583594

Observation 4b3c8da6-746f-438d-8299-8c600536bc31 · inbound

From Screens to Scenes: A Survey of Embodied AI in Healthcare cites this paper.

From Screens to Scenes: A Survey of Embodied AI in Healthcare Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning

Reference 241

Resolution
unresolved
no resolver link, observed 2026-08-10T20:43:10.843823Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-10T20:43:10.843823Z digest=sha256:32b905a3f31e6ddf74d1fb144e73c061395c6fdf535c51ca316fa69de229bee5

Observation 8852ed3d-2aa6-46b2-95fd-a88ea53872a5 · inbound

Generative AI-driven Cross-layer Covert Communication: Fundamentals, Framework and Case Study cites this paper.

Generative AI-driven Cross-layer Covert Communication: Fundamentals, Framework and Case Study Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning

Reference 7

Resolution
unresolved
no resolver link, observed 2026-08-10T18:45:44.828109Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-10T18:45:44.828109Z digest=sha256:b4161c6dce7f75bf1291134b8fce19afcdcde01ebd6f23486a6b4440d82d32df

Observation aad60dac-a116-4642-b486-1529543fe211 · inbound

Offline Diffusion Policy for Multi-User Delay-Constrained Scheduling cites this paper.

Offline Diffusion Policy for Multi-User Delay-Constrained Scheduling Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning

Reference 83

Resolution
unresolved
no resolver link, observed 2026-08-10T16:40:59.046141Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-10T16:40:59.046141Z digest=sha256:d92497b2d9bdf4415aacddabc112ef3b0da205b8b6f52a921fe5163e1f51b2a6

Observation a0ab7c18-6c95-4044-adfb-205e60997282 · inbound

Efficient Online Reinforcement Learning for Diffusion Policy cites this paper.

Efficient Online Reinforcement Learning for Diffusion Policy Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning

Reference 47

Resolution
unresolved
no resolver link, observed 2026-08-09T19:28:42.485934Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T19:28:42.485934Z digest=sha256:0bbc130d1d0d273986b8fafd98db3d4d3c5592bfd347c7dc9c170f4ae2af8465

Observation 51d2b1ae-4cd8-4110-8204-3e02e3f2ea1e · inbound

HybridVLA: Collaborative Diffusion and Autoregression in a Unified Vision-Language-Action Model cites this paper.

HybridVLA: Collaborative Diffusion and Autoregression in a Unified Vision-Language-Action Model Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning

Reference 51

Resolution
verified exact
local_arxiv, observed 2026-05-15T22:00:49.026210Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-05-15T22:00:48.667428Z digest=sha256:924c2cd338350d50a5c86550db09df7f190418a1ef76922e8f6d6bd2a4bbfa07

Observation fe1bf706-dab6-4486-b4e9-02a2ad4fac05 · inbound

BalancedDPO: Adaptive Multi-Metric Alignment cites this paper.

BalancedDPO: Adaptive Multi-Metric Alignment Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning

Reference 14

Resolution
verified exact
local_arxiv, observed 2026-05-22T23:42:16.576021Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-05-22T23:37:55.154902Z digest=sha256:570292368670ff4ba861ad7931c38c8964f58fe856265c05230b897f33ee8047

Observation b847c2d6-688b-413d-807f-163f9a42b7f3 · inbound

VIPO: Value Function Inconsistency Penalized Offline Reinforcement Learning cites this paper.

VIPO: Value Function Inconsistency Penalized Offline Reinforcement Learning Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning

Reference 9

Resolution
verified exact
local_arxiv, observed 2026-05-22T19:35:03.967979Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-05-22T19:34:33.263674Z digest=sha256:97792f1a5fe29980669fe96227f7527de3de5dc718e1d3d0553763a85bd9eeb5

Observation a72f762f-edd0-4573-b06c-85b28c7a4840 · inbound

FlowQ: Energy-Guided Flow Policies for Offline Reinforcement Learning cites this paper.

FlowQ: Energy-Guided Flow Policies for Offline Reinforcement Learning Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning

Reference 19

Resolution
unresolved
no resolver link, observed 2026-08-07T15:42:50.747484Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T15:42:50.747484Z digest=sha256:8705ce3ae6e8eaf7accc77435a79b017571f2f935752eae610c369b6f19d5443

Observation 25dc2dab-b486-4eed-bb29-3dabaa895e39 · inbound

Cascaded Diffusion Models for Neural Motion Planning cites this paper.

Cascaded Diffusion Models for Neural Motion Planning Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning

Reference 10

Resolution
unresolved
no resolver link, observed 2026-08-07T15:26:15.208611Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T15:26:15.208611Z digest=sha256:40e2420adcc6897f0e5270ac951524c5161068a980c540c384989b09582fbd60

Observation 7a33a587-91c8-495d-a991-4a2389b37c28 · inbound

Learning to Trust Bellman Updates: Selective State-Adaptive Regularization for Offline RL cites this paper.

Learning to Trust Bellman Updates: Selective State-Adaptive Regularization for Offline RL Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning

Reference 17

Resolution
unresolved
no resolver link, observed 2026-08-07T14:14:46.345569Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:14:46.345569Z digest=sha256:0f08914481526430f7ef09de62246158e886dbf0865f01d6e1307ba6caae260a

Observation d52a9e49-a01c-4f4b-9059-477a16ecc566 · inbound

Decision Flow Policy Optimization cites this paper.

Decision Flow Policy Optimization Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning

Reference 84

Resolution
unresolved
no resolver link, observed 2026-08-07T14:20:41.247019Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:20:41.247019Z digest=sha256:135866ea0bd6f14ed0ee9bebf1dcbc7ced2049d1a87fd8ddff0d69d0b6d95707

Observation 77a45f2d-adb8-4921-b993-68bdfb79c047 · inbound

BiTrajDiff: Bidirectional Trajectory Generation with Diffusion Models for Offline Reinforcement Learning cites this paper.

BiTrajDiff: Bidirectional Trajectory Generation with Diffusion Models for Offline Reinforcement Learning Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning

Reference 44

Resolution
verified exact
local_arxiv, observed 2026-05-19T10:52:15.290962Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-05-19T10:48:28.980868Z digest=sha256:77a319a39439f02668163b2151a1045439c666cc2c3c39754a1c090bc37067c4

Observation 02e0fc2b-835e-4cf9-bd43-666c636f48ee · inbound

Real-Time Execution of Action Chunking Flow Policies cites this paper.

Real-Time Execution of Action Chunking Flow Policies Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning

Reference 64

Resolution
verified exact
local_arxiv, observed 2026-05-15T14:18:51.711991Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-05-15T14:18:51.613045Z digest=sha256:302cb77bb1acda368c483ab190c73d32ad48e1fa0df4aad02b6e0bdc14d7ed8c

Observation fa19f191-2ee8-4b19-baf1-31e256d4836f · inbound

Semi-gradient DICE for Offline Constrained Reinforcement Learning cites this paper.

Semi-gradient DICE for Offline Constrained Reinforcement Learning Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning

Reference 42

Resolution
unresolved
no resolver link, observed 2026-08-07T05:15:33.492822Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T05:15:33.492822Z digest=sha256:72c77aab6f3ae25f90901a54fb5b3639318f81d2f51b6eb208241c8187cfb976

Observation 39ef6507-02fa-43d7-8977-73111800c368 · inbound

ClutterDexGrasp: A Sim-to-Real System for General Dexterous Grasping in Cluttered Scenes cites this paper.

ClutterDexGrasp: A Sim-to-Real System for General Dexterous Grasping in Cluttered Scenes Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning

Reference 50

Resolution
unresolved
no resolver link, observed 2026-08-07T00:23:18.829157Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T00:23:18.829157Z digest=sha256:21b07ba36b9e4e71d38aedc43c03d8e6526341a0071efe318f6b48f32328480c

Observation dcccf895-d921-48ad-a92c-e13efc3933ca · inbound

Steering Your Diffusion Policy with Latent Space Reinforcement Learning cites this paper.

Steering Your Diffusion Policy with Latent Space Reinforcement Learning Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning

Reference 46

Resolution
verified exact
local_arxiv, observed 2026-05-17T21:55:46.434493Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-05-17T21:55:46.183007Z digest=sha256:5e4c1425bb1acaca1de886e75a5c494385173a7737fb6172a7381f46b8d601e0

Observation 95dc4f19-86d8-4674-8e21-89a853191561 · inbound

Offline Reinforcement Learning with Penalized Action Noise Injection cites this paper.

Offline Reinforcement Learning with Penalized Action Noise Injection Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning

Reference 34

Resolution
unresolved
no resolver link, observed 2026-08-06T20:38:35.366704Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T20:38:35.366704Z digest=sha256:ca723806dece6447633676e2f85d757f09633759c18db33a040dcb46eba34566

Observation 302007d0-04f9-4809-a204-cca0d10cb5ed · inbound

Spatial-Temporal Aware Visuomotor Diffusion Policy Learning cites this paper.

Spatial-Temporal Aware Visuomotor Diffusion Policy Learning Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning

Reference 38

Resolution
unresolved
no resolver link, observed 2026-08-06T19:05:23.018513Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T19:05:23.018513Z digest=sha256:700acd40332a882895a97e79905c21eb6cd7793a88cadeeb9321afa691d4dc3b

Observation c4b99743-a20b-49c0-b964-25ec4014ab0e · inbound

EAT: QoS-Aware Edge-Collaborative AIGC Task Scheduling via Attention-Guided Diffusion Reinforcement Learning cites this paper.

EAT: QoS-Aware Edge-Collaborative AIGC Task Scheduling via Attention-Guided Diffusion Reinforcement Learning Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning

Reference 35

Resolution
unresolved
no resolver link, observed 2026-08-06T17:47:42.030565Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T17:47:42.030565Z digest=sha256:da1ac37f17ad04b042228a514a8d8337b974b13ff314d33ebde8ca2f5c7a04c6

Observation 7fdd4f8b-a471-4d08-9208-c889534d5e14 · inbound

Censored Sampling for Topology Design: Guiding Diffusion with Human Preferences cites this paper.

Censored Sampling for Topology Design: Guiding Diffusion with Human Preferences Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning

Reference 163

Resolution
unresolved
no resolver link, observed 2026-08-06T05:35:39.646624Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T05:35:39.646624Z digest=sha256:98197119b5e8138c7dfc05f2c2364af41dd076ebe2422a06efd308c7b7d13cf4

Observation 0fed7347-ea3c-470b-8eb9-868e3a04b80d · inbound

Large Model Empowered Embodied AI: A Survey on Decision-Making and Embodied Learning cites this paper.

Large Model Empowered Embodied AI: A Survey on Decision-Making and Embodied Learning Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning

Reference 199

Resolution
unresolved
no resolver link, observed 2026-08-05T20:31:54.022841Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-05T20:31:54.022841Z digest=sha256:a863aa6223e060bb7675326aa2e613a3d8ae408bca357d307602a0dbc6bab5d2

Observation cfacb3a9-9f64-4285-b382-e1bf72ae8d2b · inbound

Diffusion-RL Based Air Traffic Conflict Detection and Resolution Method cites this paper.

Diffusion-RL Based Air Traffic Conflict Detection and Resolution Method Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning

Reference 38

Resolution
unresolved
no resolver link, observed 2026-08-05T11:23:27.342828Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-05T11:23:27.342828Z digest=sha256:5b7ab13ec39c470c27b1421f8022d2dfc334f87d55b8be778e967251a5a33dc1

Observation 5dbc7881-a16a-4492-b969-3e1883d7af6d · inbound

Diffusion-Guided Multi-Arm Motion Planning cites this paper.

Diffusion-Guided Multi-Arm Motion Planning Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning

Reference 30

Resolution
unresolved
no resolver link, observed 2026-08-04T21:12:46.063817Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T21:12:46.063817Z digest=sha256:c6ed3719dff367166518dd58b6389f57c5d08f31c67548ee1e634fd3a8ccc0e2

Observation 6999ea11-2336-4272-bae1-a3bee618d4aa · inbound

Wavelet Fourier Diffuser: Frequency-Aware Diffusion Model for Reinforcement Learning cites this paper.

Wavelet Fourier Diffuser: Frequency-Aware Diffusion Model for Reinforcement Learning Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning

Reference 29

Resolution
unresolved
no resolver link, observed 2026-08-05T10:30:59.227479Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-05T10:30:59.227479Z digest=sha256:8f21e4e5231ba2761a5760defa42ef8d315dfbd870496414a7fdfe42b7d5b72d

Observation de8e4e58-1c07-4bf5-a5c2-783642e85750 · inbound

Reinforcement Learning with Discrete Diffusion Policies for Combinatorial Action Spaces cites this paper.

Reinforcement Learning with Discrete Diffusion Policies for Combinatorial Action Spaces Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning

Reference 62

Resolution
verified exact
local_arxiv, observed 2026-05-21T21:15:38.694878Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=arxiv_source observed=2026-05-21T21:14:54.053177Z digest=sha256:9b8d99f75fc54ef835079926fed3bccf652896f7b5c236e773d6b75362c827e3

Observation 73429f7f-7804-4655-a7d5-d0c0fede7592 · inbound

Diffusion Bridge or Flow Matching? A Unifying Framework and Comparative Analysis cites this paper.

Diffusion Bridge or Flow Matching? A Unifying Framework and Comparative Analysis Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning

Reference 29

Resolution
unresolved
no resolver link, observed 2026-08-04T13:52:11.964736Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T13:52:11.964736Z digest=sha256:822a309dcc00e9594efc1d1b2e643715d382b79f07501ff49e387178e0f87b45

Observation ffa0ba8b-3210-460c-b85b-28cacd99a5f9 · inbound

Value Flows cites this paper.

Value Flows Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning

Reference 82

Resolution
unresolved
no resolver link, observed 2026-08-04T11:01:34.844971Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-04T11:01:34.844971Z digest=sha256:8ff38d763b4ba6eccf26a862419df4972cf1b5f7b7fec6ac21153eaea46a154e

Observation d99e9b3b-e9cc-4c78-b051-75d5b6866443 · inbound

FM-IRL: Flow-Matching for Reward Modeling and Policy Regularization in Reinforcement Learning cites this paper.

FM-IRL: Flow-Matching for Reward Modeling and Policy Regularization in Reinforcement Learning Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning

Reference 23

Resolution
unresolved
no resolver link, observed 2026-08-04T10:44:10.802074Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T10:44:10.802074Z digest=sha256:a4bec2cf05fb595ccbbba0fc16629f7e98f414b93aec7d1147c363240c2d55a0

Observation 1c09ee03-1f21-430b-91b2-305a777b62d2 · inbound

Self-Imitated Diffusion Policy for Efficient and Robust Visual Navigation cites this paper.

Self-Imitated Diffusion Policy for Efficient and Robust Visual Navigation Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning

Reference 10

Resolution
unresolved
no resolver link, observed 2026-08-03T06:23:16.060327Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T06:23:16.060327Z digest=sha256:6434a1219c6fcd08ca82807867298f12727477fc028de2b8841fca5e859844ef

Observation 77cd936f-939d-43e5-997f-1270f5770f7f · inbound

How Does the Lagrangian Guide Safe Reinforcement Learning through Diffusion Models? cites this paper.

How Does the Lagrangian Guide Safe Reinforcement Learning through Diffusion Models? Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning

Reference 21

Resolution
verified exact
local_arxiv, observed 2026-05-16T07:57:33.085981Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-05-16T07:55:31.706717Z digest=sha256:92847dab92e40c52ca607edd04e15a8f32c1de216e6b0fc05fb5ac73494daff9

Observation 859563cd-2542-42ff-8b0b-273bafced1da · inbound

GeMPO: Generalized Measure Matching for Online Diffusion Reinforcement Learning cites this paper.

GeMPO: Generalized Measure Matching for Online Diffusion Reinforcement Learning Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning

Reference 57

Resolution
unresolved
no resolver link, observed 2026-07-14T23:47:45.866615Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-14T23:47:45.866615Z digest=sha256:25f249ba5398fdc82d50218b45338f22b6ad362e5746436f0f0bb96e0cfc4a47

Observation 5e08b9d1-fae2-483e-9b0d-7efd2bf17d95 · inbound

Nonreciprocal current induced by dissipation in time-reversal symmetric systems cites this paper.

Nonreciprocal current induced by dissipation in time-reversal symmetric systems Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning

Reference 21

Resolution
unresolved
no resolver link, observed 2026-07-13T09:47:32.460955Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-13T09:47:32.460955Z digest=sha256:d139d2715d6e5e0c88e5efd7ab37d38e2943d1e7004d5c0fe7a358579f92ea2c

Observation 1bc11e9b-b40a-4ab6-9298-7ce8b98e8fbe · inbound

Receding-Horizon Control via Drifting Models cites this paper.

Receding-Horizon Control via Drifting Models Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning

Reference 21

Resolution
verified exact
arxiv_id, observed 2026-05-15T07:55:15.903200Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-05-10T19:41:20.941243Z digest=sha256:67a7492110f0262fdf8a8db1537991f9c5786ab9b8f723348edc30a34c6535c0

Observation bb587849-e519-40dd-a030-5b7a873e31e6 · inbound

Efficient Hierarchical Implicit Flow Q-learning for Offline Goal-conditioned Reinforcement Learning cites this paper.

Efficient Hierarchical Implicit Flow Q-learning for Offline Goal-conditioned Reinforcement Learning Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning

Reference 13

Resolution
verified exact
arxiv_id, observed 2026-05-15T07:55:15.903200Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-05-10T18:12:32.839681Z digest=sha256:0d5c31075476d7982cd2a6bb38e4d994c594866e21b91ff546cd0ee99f3e66fa

Observation e270f2cb-8855-4743-b19d-fead74681d6b · inbound

Fisher Decorator: Refining Flow Policy via a Local Transport Map cites this paper.

Fisher Decorator: Refining Flow Policy via a Local Transport Map Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning

Reference 13

Resolution
verified exact
arxiv_id, observed 2026-05-15T07:55:15.903200Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-05-10T05:28:12.298066Z digest=sha256:cc194d2399eac0d9185f05872053bb895d88020c3116334f24af778ab7e98e66

Observation 11044c6c-895c-406f-9c18-cdd5bf0488d9 · inbound

Accelerating trajectory optimization with Sobolev-trained diffusion policies cites this paper.

Accelerating trajectory optimization with Sobolev-trained diffusion policies Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning

Reference 38

Resolution
metadata mismatch
arxiv_id, observed 2026-05-15T07:55:15.903200Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-05-10T02:41:06.947124Z digest=sha256:58c5bd1da6886448477f09f317ad955444455a1d7f37943b32106bafd92b817c

Observation 5047ad81-58a9-4fd8-9e0a-9009460d4c1d · inbound

FASTER: Value-Guided Sampling for Fast RL cites this paper.

FASTER: Value-Guided Sampling for Fast RL Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning

Reference 9

Resolution
malformed identifier
arxiv_id, observed 2026-05-15T07:55:15.903200Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-05-10T02:47:36.475845Z digest=sha256:dcc594caf25519b8cbb3af1ff80f81418ea527b14e50fdc6620cb3f4e35a8a21

Observation 3e25564b-0eb6-4af3-8621-c2d36ed2b7ec · inbound

AdamO: A Collapse-Suppressed Optimizer for Offline RL cites this paper.

AdamO: A Collapse-Suppressed Optimizer for Offline RL Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning

Reference 60

Resolution
metadata mismatch
arxiv_id, observed 2026-05-15T07:55:15.903200Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=arxiv_source observed=2026-05-10T14:48:05.166453Z digest=sha256:a8ceb0548362bd52c276adcd20918dcf801634cf3b9b3411deab0b49af20e721

Observation 59bea60f-96b3-445c-abce-b49fa4767182 · inbound

Refining Compositional Diffusion for Reliable Long-Horizon Planning cites this paper.

Refining Compositional Diffusion for Reliable Long-Horizon Planning Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning

Reference 75

Resolution
verified exact
arxiv_id, observed 2026-05-15T07:55:15.903200Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-05-08T17:47:58.141126Z digest=sha256:20d21d58ef919f0b6da24c0346379b9b4012b655e9c7f3357b12fa0e6fcbdf8e

Observation 8f1a1ee9-8cd1-431d-af09-e21b364578dd · inbound

Beyond Penalization: Diffusion-based Out-of-Distribution Detection and Selective Regularization in Offline Reinforcement Learning cites this paper.

Beyond Penalization: Diffusion-based Out-of-Distribution Detection and Selective Regularization in Offline Reinforcement Learning Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning

Reference 8

Resolution
metadata mismatch
arxiv_id, observed 2026-05-15T07:55:15.903200Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=arxiv_source observed=2026-05-12T02:17:25.783688Z digest=sha256:2c41c7dff8fe359dee9755f9295a455c1ccbb723b72c2fdbfbf016c06a614d9a

Observation dcd47bc1-4b30-4ad2-af28-666395e741c6 · inbound

Path-Coupled Bellman Flows for Distributional Reinforcement Learning cites this paper.

Path-Coupled Bellman Flows for Distributional Reinforcement Learning Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning

Reference 22

Resolution
metadata mismatch
arxiv_id, observed 2026-05-15T07:55:15.903200Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=arxiv_source observed=2026-05-12T02:12:58.528130Z digest=sha256:5e74a2488db4a1c25037bd99c86a011f5d37a9335902b41568bf6da8dcc058d0

Observation 9a21c44e-d57a-44f2-833e-9bcb96dd0bf6 · inbound

Insider Attacks in Multi-Agent LLM Consensus Systems cites this paper.

Insider Attacks in Multi-Agent LLM Consensus Systems Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning

Reference 95

Resolution
metadata mismatch
arxiv_id, observed 2026-05-15T07:55:15.903200Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=arxiv_source observed=2026-05-12T00:52:23.019201Z digest=sha256:72dfd57732235dba6a065cf43bab7a2f750d34e4696ff0b286db47f53b417fa9

Observation 885def38-d9cc-494f-8a51-1aed58f8b554 · inbound

Muninn: Your Trajectory Diffusion Model But Faster cites this paper.

Muninn: Your Trajectory Diffusion Model But Faster Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning

Reference 62

Resolution
metadata mismatch
arxiv_id, observed 2026-05-15T07:55:15.903200Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-05-12T03:49:48.492957Z digest=sha256:f5839bca1a17f822e27fcfee19a82a023608d4a597b5f16cdf42123d2c070bc1

Observation 70149c94-010d-4d69-92d4-e50b0a1c2d02 · inbound

Revisiting Policy Gradients for Restricted Policy Classes: Escaping Myopic Local Optima with $k$-step Policy Gradients cites this paper.

Revisiting Policy Gradients for Restricted Policy Classes: Escaping Myopic Local Optima with $k$-step Policy Gradients Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning

Reference 49

Resolution
verified exact
arxiv_id, observed 2026-05-15T07:55:15.903200Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-05-12T04:02:04.342363Z digest=sha256:f8303b8c42f2b418ec200c8dd7377cefa43de43faa56659e524a3f3cef47f542

Observation 07f84e69-f09e-4bb6-beb1-948d76993f72 · inbound

Block-R1: Rethinking the Role of Block Size in Multi-domain Reinforcement Learning for Diffusion Large Language Models cites this paper.

Block-R1: Rethinking the Role of Block Size in Multi-domain Reinforcement Learning for Diffusion Large Language Models Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning

Reference 64

Resolution
verified exact
arxiv_id, observed 2026-05-15T07:55:15.903200Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-05-13T07:03:00.503644Z digest=sha256:dc928aaa0d7a61c9aab2753320277af7c8da4a5c40691696485bc8b56a32126f

Observation 9ac5a5b9-5dca-4786-8015-9a89c3cd5137 · inbound

Block-R1: Rethinking the Role of Block Size in Multi-domain Reinforcement Learning for Diffusion Large Language Models cites this paper.

Block-R1: Rethinking the Role of Block Size in Multi-domain Reinforcement Learning for Diffusion Large Language Models Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning

Reference 64

Resolution
verified exact
arxiv_id, observed 2026-05-15T07:55:15.903200Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-05-14T21:06:01.667173Z digest=sha256:f839bf5760d4ddb74601d429b4533f5b176f06e4047be1bff035005f04b3de39

Observation e1513347-6a38-43d6-a94f-40200bedea25 · inbound

Aligning Flow Map Policies with Optimal Q-Guidance cites this paper.

Aligning Flow Map Policies with Optimal Q-Guidance Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning

Reference 43

Resolution
verified exact
arxiv_id, observed 2026-05-15T07:55:15.903200Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-05-13T05:04:22.603786Z digest=sha256:d7a899255d0856a036add343f536e63636f9aba7135b52624b66bd56add307a1

Observation 6b9ba123-3d86-4eb9-9832-7fe3b741f56e · inbound

Driving Intents Amplify Planning-Oriented Reinforcement Learning cites this paper.

Driving Intents Amplify Planning-Oriented Reinforcement Learning Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning

Reference 20

Resolution
verified exact
arxiv_id, observed 2026-05-15T07:55:15.903200Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-05-14T20:50:14.602822Z digest=sha256:48ee99411952affc1a16bd7ce78d29320d500e1d6343c5ecfb7f4d7bda1b57a8

Observation 63508570-6442-4507-a77e-63052d1cf11d · inbound

Driving Intents Amplify Planning-Oriented Reinforcement Learning cites this paper.

Driving Intents Amplify Planning-Oriented Reinforcement Learning Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning

Reference 21

Resolution
verified exact
arxiv_id, observed 2026-05-15T07:55:15.903200Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-05-15T04:58:07.943615Z digest=sha256:51748b066f99304e51e69ef68b640fa7a6df5dd63be1cbea34cf42484f9ef8d6

Observation 05e5801a-de5e-48db-bab0-60ccbc6a55e7 · inbound

JEDI: Joint Embedding Diffusion World Model for Online Model-Based Reinforcement Learning cites this paper.

JEDI: Joint Embedding Diffusion World Model for Online Model-Based Reinforcement Learning Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning

Reference 25

Resolution
verified exact
arxiv_id, observed 2026-05-15T07:55:15.903200Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-05-14T19:37:19.404335Z digest=sha256:ca9fba14a7e247d498ba0ce6909388df6b2fa11a42fcca75eab1193338577816

Observation 293975ad-1b8a-429d-b0ab-a73b8e79fe76 · inbound

Ada-Diffuser: Latent-Aware Adaptive Diffusion for Decision-Making cites this paper.

Ada-Diffuser: Latent-Aware Adaptive Diffusion for Decision-Making Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning

Reference 24

Resolution
metadata mismatch
local_arxiv, observed 2026-05-20T20:59:01.955010Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=arxiv_source observed=2026-05-20T20:54:31.025488Z digest=sha256:941dd7e0cf5d4845c4b757d58d0c11b0f5312387fb5038aa09d59f1ceb658706

Observation aa53d60e-5d78-4539-89b7-1db658aea058 · inbound

Global Convergence of Sampling-Based Nonconvex Optimization through Diffusion-Style Smoothing cites this paper.

Global Convergence of Sampling-Based Nonconvex Optimization through Diffusion-Style Smoothing Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning

Reference 211

Resolution
metadata mismatch
local_arxiv, observed 2026-05-20T20:18:59.888321Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=arxiv_source observed=2026-05-20T20:15:44.030714Z digest=sha256:4b71dddd697d7c4b944f1c403d6e9185dcd9dc2529fceab05419910c49855113

Observation 84d67496-976e-4353-b5ff-c0138c0423d0 · inbound

D$^3$-Subsidy: Online and Sequential Driver Subsidy Decision-Making for Large-Scale Ride-Hailing Market cites this paper.

D$^3$-Subsidy: Online and Sequential Driver Subsidy Decision-Making for Large-Scale Ride-Hailing Market Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning

Reference 21

Resolution
verified exact
local_arxiv, observed 2026-05-20T06:53:05.959925Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-05-20T06:49:53.603604Z digest=sha256:4969391744d9d77dfa42f7d1e5df7ac77d54a86fd643e1d265a357a66459019f

Observation 009132cc-b9d1-4aa3-a6f9-141e6376e6db · inbound

D$^3$-Subsidy: Online and Sequential Driver Subsidy Decision-Making for Large-Scale Ride-Hailing Market cites this paper.

D$^3$-Subsidy: Online and Sequential Driver Subsidy Decision-Making for Large-Scale Ride-Hailing Market Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning

Reference 21

Resolution
verified exact
local_arxiv, observed 2026-05-21T07:29:48.459245Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-05-21T07:25:05.617335Z digest=sha256:e70b99086e03e15ac893ffa940efe99ab99dafdc56ab90c54c155127fb93f13d

Observation 6aa08e93-4571-4600-823f-17b3360c0a25 · inbound

D$^3$-Subsidy: Online and Sequential Driver Subsidy Decision-Making for Large-Scale Ride-Hailing Market cites this paper.

D$^3$-Subsidy: Online and Sequential Driver Subsidy Decision-Making for Large-Scale Ride-Hailing Market Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning

Reference 21

Resolution
verified exact
local_arxiv, observed 2026-05-22T09:24:46.740380Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-05-22T09:17:01.418385Z digest=sha256:9090d71c4138b51783bace0ff2fe61cd5599983867bd17ff0b1af5a711383169

Observation 924b9bc7-efb3-4933-a760-634ac1414df6 · inbound

D$^3$-Subsidy: Online and Sequential Driver Subsidy Decision-Making for Large-Scale Ride-Hailing Market cites this paper.

D$^3$-Subsidy: Online and Sequential Driver Subsidy Decision-Making for Large-Scale Ride-Hailing Market Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning

Reference 21

Resolution
verified exact
local_arxiv, observed 2026-07-01T15:05:47.275755Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-06-30T18:21:12.783683Z digest=sha256:07bf7975fc9c3274cb5bd8a6504d9b94ec8408b7cbba9afc6505e59150dbcf55

Observation 122435b3-554b-42c1-bb11-8cc966680c11 · inbound

HITL-D: Human In The Loop Diffusion Assisted Shared Control cites this paper.

HITL-D: Human In The Loop Diffusion Assisted Shared Control Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning

Reference 16

Resolution
verified exact
local_arxiv, observed 2026-05-21T03:23:55.704702Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-05-21T03:23:11.911870Z digest=sha256:6d4004fd0cec8f5bbf333f528e8cd24e6f9646546f09a5826ef20efb1f0d87a4

Observation a7380df4-2c16-4cf9-8f26-57ae3abc5f89 · inbound

Cross-Domain Energy-Guided Diffusion Generation for Off-Dynamics Reinforcement Learning cites this paper.

Cross-Domain Energy-Guided Diffusion Generation for Off-Dynamics Reinforcement Learning Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning

Reference 34

Resolution
verified exact
local_arxiv, observed 2026-06-30T11:44:37.882131Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=arxiv_source observed=2026-06-30T11:43:41.884049Z digest=sha256:c892c1b90b22d9862985ab725eb899280b4acd90c036c3e483b10de284d365cb

Observation 2bf5a61c-7a71-4832-9024-17d25bcc25d7 · inbound

From Denoising to Decision Making: A Survey on Diffusion Model-Enabled Deep Reinforcement Learning for Wireless Networks cites this paper.

From Denoising to Decision Making: A Survey on Diffusion Model-Enabled Deep Reinforcement Learning for Wireless Networks Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning

Reference 41

Resolution
verified exact
local_arxiv, observed 2026-06-29T20:53:58.363799Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-06-29T20:49:07.030872Z digest=sha256:009a80c5cb0276af49835f8c1d1a5da252a2986d9cbe0751670aa652882deb98

Observation 4bfeff70-e09a-4198-909b-9f77015bd300 · inbound

Adversarial Dual On-Policy Distillation from Expressive Teacher cites this paper.

Adversarial Dual On-Policy Distillation from Expressive Teacher Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning

Reference 21

Resolution
metadata mismatch
local_arxiv, observed 2026-06-29T19:03:51.521000Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-06-29T18:55:23.777484Z digest=sha256:6922c0eda14658d961ac316dc723a98c0911f2d04e12f83db3fe73bd3cf7ee18

Observation b015ed9f-d634-4d83-82fd-2e117255cb30 · inbound

SPAR: Support-Preserving Action Rectification cites this paper.

SPAR: Support-Preserving Action Rectification Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning

Reference 15

Resolution
verified exact
local_arxiv, observed 2026-06-29T14:43:30.987653Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-06-29T14:34:39.094753Z digest=sha256:062569b87526193f5c5eae97229c7d128e876af75615d24f1e37ee4f47014b3e

Observation 84ca06a8-0ab3-425f-ba8a-52730bbd4995 · inbound

GDSD: Reinforcement Learning as Guided Denoiser Self-Distillation for Diffusion Language Models cites this paper.

GDSD: Reinforcement Learning as Guided Denoiser Self-Distillation for Diffusion Language Models Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning

Reference 55

Resolution
verified exact
local_arxiv, observed 2026-06-29T08:53:16.322817Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-06-29T08:44:53.969301Z digest=sha256:be04aa34b11e4e46225c9097ac072995cb1170b63e742ccbf7c5a78f6b73ebc4

Observation 539834d2-a9e0-4467-8101-85ee296ee714 · inbound

Lagrangian Perturbation Diffusion Steering: Latent Reinforcement Learning for Generative Policies cites this paper.

Lagrangian Perturbation Diffusion Steering: Latent Reinforcement Learning for Generative Policies Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning

Reference 28

Resolution
metadata mismatch
local_arxiv, observed 2026-06-28T17:22:24.656018Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-06-28T17:19:36.722892Z digest=sha256:6ebaa42d846c21eb0b2ed9ae4a76eeb43fd41a910e9c544ba14af4a3be91133e

Observation 4fb2eb9f-ba9c-4159-8f73-6a8efce2a0be · inbound

Training-Free Imitation Learning with Closed-Form Diffusion Policies cites this paper.

Training-Free Imitation Learning with Closed-Form Diffusion Policies Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning

Reference 10

Resolution
verified exact
local_arxiv, observed 2026-06-28T17:12:24.890387Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-06-28T17:07:46.856210Z digest=sha256:f36c67f2ad40c73fab07e664114c398236b7078cd61b6fa11d40c5e8d1593488

Observation a357415b-276f-4873-8deb-ec925f3ec93c · inbound

Counterfactual Transport Flows for Offline Conservative Trajectory Refinement cites this paper.

Counterfactual Transport Flows for Offline Conservative Trajectory Refinement Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning

Reference 80

Resolution
metadata mismatch
local_arxiv, observed 2026-07-02T23:57:29.179837Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=arxiv_source observed=2026-06-27T17:33:35.857240Z digest=sha256:1a5170c6126ef289805e9d99cdd7b001b9504110355eb10cff9efaff757d198c

Observation b69f719c-2681-4cba-b14f-b0a96caa8187 · inbound

Fast and Highly Expressive Policy Learning for Offline Reinforcement Learning via Bootstrapped Flow Q-Learning cites this paper.

Fast and Highly Expressive Policy Learning for Offline Reinforcement Learning via Bootstrapped Flow Q-Learning Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning

Reference 23

Resolution
verified exact
local_arxiv, observed 2026-07-03T04:27:36.359425Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-06-27T13:57:31.180928Z digest=sha256:894760ef449d68bd6136c2511b6f2640dd3d3c64afe768dc1427babe5322c7a5

Observation 06216ae3-c849-4049-811c-d242e4cb7db7 · inbound

MODIP: Efficient Model-Based Optimization for Diffusion Policies cites this paper.

MODIP: Efficient Model-Based Optimization for Diffusion Policies Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning

Reference 22

Resolution
metadata mismatch
local_arxiv, observed 2026-07-03T04:37:37.563763Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=arxiv_source observed=2026-06-27T13:44:19.708550Z digest=sha256:daa1a023a5a3d223081755cac37be7fd8eb45b5f2258b0f6a99c86ec83fcf900

Observation a93d95b9-b1af-49c1-8b5c-4358081e92c1 · inbound

Test-Time Gradient Guidance of Flow Policies in Reinforcement Learning cites this paper.

Test-Time Gradient Guidance of Flow Policies in Reinforcement Learning Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning

Reference 63

Resolution
verified exact
local_arxiv, observed 2026-07-03T04:17:36.916636Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-06-27T14:05:01.073951Z digest=sha256:5826d0fe956f521bea2e54280ef78e0750245cd76bed5f1afb6ac5b0b1c28a6e

Observation bffd78e1-b49c-4867-a2fc-b576d1c736b3 · inbound

Energy-based Compositional Diffusion Planning cites this paper.

Energy-based Compositional Diffusion Planning Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning

Reference 25

Resolution
verified exact
local_arxiv, observed 2026-07-04T06:49:37.746641Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-06-26T14:12:33.307261Z digest=sha256:cea3b480cfcd216278efa571c6b88fc6c19c14989d60fc59dc1ae5f4f7913891

Observation 076ee41d-ae43-40d9-b6af-c9cecbb6361b · inbound

RS-Diffuser: Risk-Sensitive Diffusion Planning with Distributional Value Guidance cites this paper.

RS-Diffuser: Risk-Sensitive Diffusion Planning with Distributional Value Guidance Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning

Reference 28

Resolution
metadata mismatch
local_arxiv, observed 2026-06-29T18:23:51.477914Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-06-29T05:05:39.828659Z digest=sha256:8054a0fb18c5c4f9d580ce617f9d9a66474b3e097e09d82b0aa444b76c218100

Observation 7bc40a06-f596-4293-abb5-ed9fa45284d0 · inbound

Guided Action Flow: Q-Guided Inference for Flow-Matching Vision-Language-Action Policies cites this paper.

Guided Action Flow: Q-Guided Inference for Flow-Matching Vision-Language-Action Policies Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning

Reference 23

Resolution
verified exact
local_arxiv, observed 2026-07-03T11:58:05.723569Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-07-03T11:50:49.215046Z digest=sha256:a4c68300a16e7d153ec65592566fc7e106352ab6d5584540ae8cf8a876fb4384

Observation d7d23c51-e4e5-4295-8d10-f1a6f1327b57 · inbound

Guided Action Flow: Q-Guided Inference for Flow-Matching Vision-Language-Action Policies cites this paper.

Guided Action Flow: Q-Guided Inference for Flow-Matching Vision-Language-Action Policies Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning

Reference 23

Resolution
unresolved
no resolver link, observed 2026-07-12T08:26:59.428524Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-12T08:26:59.428524Z digest=sha256:40b56e0440bf68e935a0e79ed6b15cd42ccfdf71ebba9605acd70486a5a9292b

Observation 81ce14fc-6107-400f-9081-925c4e3fc569 · inbound

A Single Diffusion-Policy Controller for Multi-Task Block Pushing with Zero-Shot Sim-to-Real Transfer cites this paper.

A Single Diffusion-Policy Controller for Multi-Task Block Pushing with Zero-Shot Sim-to-Real Transfer Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning

Reference 8

Resolution
unresolved
no resolver link, observed 2026-07-14T08:30:10.584105Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-14T08:30:10.584105Z digest=sha256:e84dd4b320603d1a7c4dcee859bdb51c1ec078e6fa1f52dc4db270f4ff434f9b

Observation 6f34c692-fc82-4357-aaa5-fc1f2bec7ba4 · inbound

Reinforcement Learning: From Algorithms To Foundation Models cites this paper.

Reinforcement Learning: From Algorithms To Foundation Models Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning

Reference 146

Resolution
unresolved
no resolver link, observed 2026-08-01T17:45:11.182095Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-01T17:45:11.182095Z digest=sha256:59e0751b4eade3cce3e387a87db84d76bdee421a6827ccfb8d9a45c6c4b1d972

Observation c2aa95f3-ad94-40d2-b9c8-9cf54e7e21ad · inbound

Good Rankers, Bad Objectives: Bilinear Contrastive Critics under Expressive Policy Search cites this paper.

Good Rankers, Bad Objectives: Bilinear Contrastive Critics under Expressive Policy Search Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning

Reference 33

Resolution
unresolved
no resolver link, observed 2026-07-31T01:24:21.575169Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-31T01:24:21.575169Z digest=sha256:448b93bf31c691d032d577ca81a3785908a9af140ee6e522b02f71a1661156fe

Observation 65176c4b-f0e2-447f-8ebf-363b34b5ffdf · inbound

Deep Reinforcement Learning: From First Principles to Reasoning Models cites this paper.

Deep Reinforcement Learning: From First Principles to Reasoning Models Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning

Reference 2023

Resolution
unresolved
no resolver link, observed 2026-08-04T01:16:04.653728Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T01:16:04.653728Z digest=sha256:289b278610e4091a2c28ef2220569b16fc816d364e6d9ca8d54f7cd7a580209c

Observation 758f9309-a314-4a46-80c2-a2c53f2a5bbb · inbound

ReBRAC-v2: The Return of the King cites this paper.

ReBRAC-v2: The Return of the King Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning

Reference 76

Resolution
unresolved
no resolver link, observed 2026-08-06T00:32:46.484739Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T00:32:46.484739Z digest=sha256:189664654c09cf7e864ed494ce25ee20e325b18cb5b473acc11810308b9aa719

Observation e1af34ed-08b7-4250-b4f4-ba4dc3411141 · inbound

Weights or Skills? A Survey of Robot-Learning Techniques: from Action-Predicting Weights to Robots that Write their Own Skills cites this paper.

Weights or Skills? A Survey of Robot-Learning Techniques: from Action-Predicting Weights to Robots that Write their Own Skills Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning

Reference 265

Resolution
unresolved
no resolver link, observed 2026-08-04T19:45:35.322822Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T19:45:35.322822Z digest=sha256:0869fb401c3928cbcccc6fcabcc3a50f6bed99e925d8727c389141bce7ecf7c1