Pith. sign in

Paper Citation Record · LEDGER

ADG: Ambient Diffusion-Guided Dataset Recovery for Corruption-Robust Offline Reinforcement Learning

As of 8 August 2026, this Paper Citation Record lists 43 of 43 outbound references and 1 inbound Pith citation observation for arXiv:2505.23871.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2505.23871 v2

Coverage vector

measured 43 of 43 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-07T12:55:54.416203Z

measured 44 of 44 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-08T06:32:00.761636+00:00

measured 1 of 1 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-07T05:01:15.443445Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: pith, observed 2026-08-07T05:01:17.482077Z

Reference resolution

43 of 43 outbound references displayed

  • verified exact1
  • verified fuzzy22
  • unresolved19
  • parse uncertain0
  • malformed identifier1
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation f07df930-7dab-4be3-9ff6-a941c0221bf2 · outbound

This paper cites Ambient Diffusion Posterior Sampling: Solving Inverse Problems with Diffusion Models Trained on Corrupted Data.

ADG: Ambient Diffusion-Guided Dataset Recovery for Corruption-Robust Offline Reinforcement Learning Ambient Diffusion Posterior Sampling: Solving Inverse Problems with Diffusion Models Trained on Corrupted Data

Reference 1

Resolution
unresolved
no resolver link, observed 2026-08-07T12:55:49.402174Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T12:55:49.402174Z digest=sha256:a159283f2ea80a5ff76e188546a6ca657ee3f0f59fd8a7ce3118b14d215bf189

Observation 6806c56b-80d0-4f93-bbda-f07b6239954e · outbound

This paper cites Offline Reinforcement Learning from Datasets with Structured Non-Stationarity.

ADG: Ambient Diffusion-Guided Dataset Recovery for Corruption-Robust Offline Reinforcement Learning Offline Reinforcement Learning from Datasets with Structured Non-Stationarity

Reference 2

Resolution
verified exact
local_arxiv, observed 2026-08-07T12:55:54.927932Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T12:55:49.514880Z digest=sha256:5766c5b3a4a1850b5fe3fa06605282c5f2f52b3c1fd2d429032d2b230f78f3ad

Observation ae3d6006-5349-4ead-8aad-7106da10dd1f · outbound

This paper cites Is conditional generative modeling all you need for decision making? In The Eleventh International Conference on Learning Representations, 2023.

ADG: Ambient Diffusion-Guided Dataset Recovery for Corruption-Robust Offline Reinforcement Learning Is conditional generative modeling all you need for decision making? In The Eleventh International Conference on Learning Representations, 2023

Reference 3

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T12:55:58.447137Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T12:55:49.626930Z digest=sha256:7404541f26a54fa70c17817daa98678be8e1a64bbdae4ecdb348973bea65eb28

Observation 4193ddd7-63bf-4de2-b501-5cff4344046b · outbound

This paper cites Uncertainty-based offline reinforcement learning with diversified q-ensemble.

ADG: Ambient Diffusion-Guided Dataset Recovery for Corruption-Robust Offline Reinforcement Learning Uncertainty-based offline reinforcement learning with diversified q-ensemble

Reference 4

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T12:55:58.320673Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T12:55:49.772302Z digest=sha256:71b9b38aed9eff74bcd7b8ccb90dc2094a794a8c1613e3f74b44630d7db99160

Observation 8fc1e53c-519f-4b0e-996e-c04cbfd6fe86 · outbound

This paper cites Pessimistic Bootstrapping for Uncertainty-Driven Offline Reinforcement Learning.

ADG: Ambient Diffusion-Guided Dataset Recovery for Corruption-Robust Offline Reinforcement Learning Pessimistic Bootstrapping for Uncertainty-Driven Offline Reinforcement Learning

Reference 5

Resolution
unresolved
no resolver link, observed 2026-08-07T12:55:49.886568Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T12:55:49.886568Z digest=sha256:e8ec28fce6d519b32eb5ae2c4b7c8a9c05b10daf1c4587306d55c2ee52e7e1f9

Observation 0419cc4f-e479-4089-883d-e7c0c1657164 · outbound

This paper cites Decision transformer: Reinforcement learning via sequence modeling.

ADG: Ambient Diffusion-Guided Dataset Recovery for Corruption-Robust Offline Reinforcement Learning Decision transformer: Reinforcement learning via sequence modeling

Reference 6

Resolution
unresolved
no resolver link, observed 2026-08-07T12:55:50.011227Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T12:55:50.011227Z digest=sha256:58c51956cd07e376b3b81aa6f0671c6a970bf80c5871673b1218b604b06f7b73

Observation 8b641ced-b476-4710-bf8c-e9cf78a61c58 · outbound

This paper cites Exact policy recovery in offline rl with both heavy-tailed rewards and data corruption.

ADG: Ambient Diffusion-Guided Dataset Recovery for Corruption-Robust Offline Reinforcement Learning Exact policy recovery in offline rl with both heavy-tailed rewards and data corruption

Reference 7

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T12:55:58.188635Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T12:55:50.170867Z digest=sha256:79b09bb9f9d570c9c0b2c647f121d3274fa0899ce3f7ab5732a5749a60ea6a82

Observation 901b35f6-a897-4991-b54a-fedcaa433656 · outbound

This paper cites Consistent diffusion meets tweedie: Training exact ambient diffusion models with noisy data.

ADG: Ambient Diffusion-Guided Dataset Recovery for Corruption-Robust Offline Reinforcement Learning Consistent diffusion meets tweedie: Training exact ambient diffusion models with noisy data

Reference 8

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T12:55:58.059697Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T12:55:50.323136Z digest=sha256:83c010ed52308c5ecc7d944f49043dbd390a04f9039c09d9c50bd421dbab81de

Observation bf4502ff-5025-487b-8de7-5dd4ed9c70ca · outbound

This paper cites D4RL: Datasets for Deep Data-Driven Reinforcement Learning.

ADG: Ambient Diffusion-Guided Dataset Recovery for Corruption-Robust Offline Reinforcement Learning D4RL: Datasets for Deep Data-Driven Reinforcement Learning

Reference 9

Resolution
unresolved
no resolver link, observed 2026-08-07T12:55:50.472027Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T12:55:50.472027Z digest=sha256:a9974829df04fca294cbb995f9986c1e854ccb917173adfcf4057a3b77588d15

Observation c858ef78-624f-42f4-acee-de67074b791c · outbound

This paper cites A minimalist approach to offline reinforcement learn- ing.

ADG: Ambient Diffusion-Guided Dataset Recovery for Corruption-Robust Offline Reinforcement Learning A minimalist approach to offline reinforcement learn- ing

Reference 10

Resolution
unresolved
no resolver link, observed 2026-08-07T12:55:50.601518Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T12:55:50.601518Z digest=sha256:e43fa15b03639256a18341927d133f17e7447749803ac7faba0205d75f24ef9d

Observation 70525bd3-df61-4f38-8570-38c8e52a4f78 · outbound

This paper cites Off-policy deep reinforcement learning with- out exploration.

ADG: Ambient Diffusion-Guided Dataset Recovery for Corruption-Robust Offline Reinforcement Learning Off-policy deep reinforcement learning with- out exploration

Reference 11

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T12:55:57.948906Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T12:55:50.751884Z digest=sha256:29764b6625bc6aed47c48b8da63c343405ef2ca1aed9ec99beae82e2651599db

Observation ce47875b-e531-4665-b6ec-30fae9c7a8db · outbound

This paper cites Why so pessimistic? estimating uncertainties for offline rl through ensembles, and why their independence matters.

ADG: Ambient Diffusion-Guided Dataset Recovery for Corruption-Robust Offline Reinforcement Learning Why so pessimistic? estimating uncertainties for offline rl through ensembles, and why their independence matters

Reference 12

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T12:55:57.837287Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T12:55:50.996427Z digest=sha256:c379f29eaefafc5ea41e4f223796f8ac50c6c305b2e17f4bce751e074b84dc67

Observation 7bb711e0-81f2-4b51-8742-16ae564a9b2c · outbound

This paper cites IDQL: Implicit Q-Learning as an Actor-Critic Method with Diffusion Policies.

ADG: Ambient Diffusion-Guided Dataset Recovery for Corruption-Robust Offline Reinforcement Learning IDQL: Implicit Q-Learning as an Actor-Critic Method with Diffusion Policies

Reference 13

Resolution
unresolved
no resolver link, observed 2026-08-07T12:55:51.086548Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T12:55:51.086548Z digest=sha256:42fd164a760c9f82a3b4e5dec94e350194b13239abf100014052bfe3b1833d92

Observation 044294f5-e2f2-4677-a284-ce6e4a52f95d · outbound

This paper cites Denoising diffusion probabilistic models.

ADG: Ambient Diffusion-Guided Dataset Recovery for Corruption-Robust Offline Reinforcement Learning Denoising diffusion probabilistic models

Reference 14

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T12:55:57.670545Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T12:55:51.167694Z digest=sha256:dbc6de3d0f1f814acda2d7de35218d3df2c510e5815e996a41365c5831bc0dd7

Observation 71b1811b-c4c7-46d2-ad04-06838da71daf · outbound

This paper cites Planning with diffusion for flexible behavior synthesis.

ADG: Ambient Diffusion-Guided Dataset Recovery for Corruption-Robust Offline Reinforcement Learning Planning with diffusion for flexible behavior synthesis

Reference 15

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T12:55:57.509450Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T12:55:51.268766Z digest=sha256:5e13585f532435b0d4489c40a36b5fbc673bc772e6fb1ba420bc2f19f963e025

Observation 9dedea89-7914-4726-8c53-7e240630a2fd · outbound

This paper cites Offline reinforcement learning as one big sequence modeling problem.

ADG: Ambient Diffusion-Guided Dataset Recovery for Corruption-Robust Offline Reinforcement Learning Offline reinforcement learning as one big sequence modeling problem

Reference 16

Resolution
unresolved
no resolver link, observed 2026-08-07T12:55:51.378863Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T12:55:51.378863Z digest=sha256:b0d2f9632e6a6d3c3a4c8eb7a80f66229f7f8c6f411d6476ae1dcc46ef7e425c

Observation e84a4cd2-cafa-47e9-bfc4-3cb71585a727 · outbound

This paper cites Neural stochastic differential equations for uncertainty-aware offline rl.

ADG: Ambient Diffusion-Guided Dataset Recovery for Corruption-Robust Offline Reinforcement Learning Neural stochastic differential equations for uncertainty-aware offline rl

Reference 17

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T12:55:57.302674Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T12:55:51.479404Z digest=sha256:f9a512da80c05f74adbe7016fcee1a8a1e51757ad7920af7c43151c35390ca9c

Observation c4d21d72-cb97-4cb4-8a73-bdef2ef490e0 · outbound

This paper cites Offline Reinforcement Learning with Implicit Q-Learning.

ADG: Ambient Diffusion-Guided Dataset Recovery for Corruption-Robust Offline Reinforcement Learning Offline Reinforcement Learning with Implicit Q-Learning

Reference 18

Resolution
unresolved
no resolver link, observed 2026-08-07T12:55:51.589000Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T12:55:51.589000Z digest=sha256:b2e1da332d47b2a6ae49275aeb256d18cc9d30fd15ec8b0d00fe1e99e262ca5a

Observation 51bdfcb9-5299-48f8-92cf-56ca80169906 · outbound

This paper cites Conservative q-learning for offline reinforcement learning.

ADG: Ambient Diffusion-Guided Dataset Recovery for Corruption-Robust Offline Reinforcement Learning Conservative q-learning for offline reinforcement learning

Reference 19

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T12:55:57.162259Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T12:55:51.696488Z digest=sha256:ae10b0e3ef162162f48295b6779239e9455238091e7f7351d2f4d5199d34cda2

Observation 506ed5af-a7b9-447f-ab85-59acdc70cfa7 · outbound

This paper cites Offline reinforcement learning: Tutorial, review, and perspectives on open problems, 2020.

ADG: Ambient Diffusion-Guided Dataset Recovery for Corruption-Robust Offline Reinforcement Learning Offline reinforcement learning: Tutorial, review, and perspectives on open problems, 2020

Reference 20

Resolution
unresolved
no resolver link, observed 2026-08-07T12:55:51.841469Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T12:55:51.841469Z digest=sha256:cc0b0d25f77c0b3463719312ffaf7c186b6237a25e62038ce78f1e9163391de5

Observation 20eb3195-e3be-45c8-8419-0ff7be9c8d52 · outbound

This paper cites Survival instinct in offline reinforcement learning.

ADG: Ambient Diffusion-Guided Dataset Recovery for Corruption-Robust Offline Reinforcement Learning Survival instinct in offline reinforcement learning

Reference 21

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T12:55:57.021913Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T12:55:51.953347Z digest=sha256:b6d3754a967016600a9d70308d7a82b3fd5fd5b220c77d554e2f1f0ddc625b35

Observation e1eb5478-0d2b-4072-9b61-e5f6d10d193a · outbound

This paper cites ROPO: Robust Preference Optimization for Large Language Models.

ADG: Ambient Diffusion-Guided Dataset Recovery for Corruption-Robust Offline Reinforcement Learning ROPO: Robust Preference Optimization for Large Language Models

Reference 22

Resolution
unresolved
no resolver link, observed 2026-08-07T12:55:52.060026Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T12:55:52.060026Z digest=sha256:2d13dfb303a8df98ba7d2ecc1ecd0ba337768c4956e48275252cc37760cc9607

Observation 0d4f3c54-dde8-45f3-bd3a-d8f6fc392673 · outbound

This paper cites Adapt- diffuser: Diffusion models as adaptive self-evolving planners.

ADG: Ambient Diffusion-Guided Dataset Recovery for Corruption-Robust Offline Reinforcement Learning Adapt- diffuser: Diffusion models as adaptive self-evolving planners

Reference 23

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T12:55:56.910769Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T12:55:52.171683Z digest=sha256:ec23cbf15b364933b577967868d0f75490330c51a6095fe2b193c250f5054a31

Observation 81d71945-2dc4-486e-8ea6-8491f145900c · outbound

This paper cites Adaptive Advantage-Guided Policy Regularization for Offline Reinforcement Learning.

ADG: Ambient Diffusion-Guided Dataset Recovery for Corruption-Robust Offline Reinforcement Learning Adaptive Advantage-Guided Policy Regularization for Offline Reinforcement Learning

Reference 24

Resolution
unresolved
no resolver link, observed 2026-08-07T12:55:52.250621Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T12:55:52.250621Z digest=sha256:1ba304221c2a522a134dce0ae75f4ffbc635664a1253feed4e9607943b10aeb1

Observation f2c5b186-0fa7-42c0-9625-32b4df67b044 · outbound

This paper cites Towards Deep Learning Models Resistant to Adversarial Attacks.

ADG: Ambient Diffusion-Guided Dataset Recovery for Corruption-Robust Offline Reinforcement Learning Towards Deep Learning Models Resistant to Adversarial Attacks

Reference 25

Resolution
unresolved
no resolver link, observed 2026-08-07T12:55:52.349876Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T12:55:52.349876Z digest=sha256:7ec8997fb9a49281b543d5ee966c6b3ddb847ae8010b0074c1ff4fa5ba20ce02

Observation edc02cc5-db76-450b-8169-b5808703197b · outbound

This paper cites Robust re- inforcement learning using offline data.

ADG: Ambient Diffusion-Guided Dataset Recovery for Corruption-Robust Offline Reinforcement Learning Robust re- inforcement learning using offline data

Reference 26

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T12:55:56.832793Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T12:55:52.492092Z digest=sha256:e91ba374c95e7695c4b7c577303c679e14960897151ee86e7fa364f234688bda

Observation a4fc0fb9-2b0a-4640-86f5-4b5c9827f731 · outbound

This paper cites High-resolution image synthesis with latent diffusion models.

ADG: Ambient Diffusion-Guided Dataset Recovery for Corruption-Robust Offline Reinforcement Learning High-resolution image synthesis with latent diffusion models

Reference 27

Resolution
unresolved
no resolver link, observed 2026-08-07T12:55:52.603920Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T12:55:52.603920Z digest=sha256:5d7be6788c18c1df8d970628268f4b1704f60567dfae1667c9336fa6583a4756

Observation 1d7ba50d-9111-434f-bda0-5b5d009993a2 · outbound

This paper cites Distributionally robust model-based offline reinforcement learning with near-optimal sample complexity.

ADG: Ambient Diffusion-Guided Dataset Recovery for Corruption-Robust Offline Reinforcement Learning Distributionally robust model-based offline reinforcement learning with near-optimal sample complexity

Reference 28

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T12:55:56.620400Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T12:55:52.715087Z digest=sha256:0af9382105000e0c5a5e77aed1c97fcabeecc181a05528513adbff8783001fdd

Observation fa6ae2c6-7739-44b5-a371-55c774d36064 · outbound

This paper cites Unleashing the Power of Pre-trained Language Models for Offline Reinforcement Learning.

ADG: Ambient Diffusion-Guided Dataset Recovery for Corruption-Robust Offline Reinforcement Learning Unleashing the Power of Pre-trained Language Models for Offline Reinforcement Learning

Reference 29

Resolution
unresolved
no resolver link, observed 2026-08-07T12:55:52.772925Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T12:55:52.772925Z digest=sha256:264aec4dc84975a55b9a0bcdc801a9c7da0db9fe22a9db269e595ab660400492

Observation 03cb4af2-56f5-4eba-9fd3-1e8bf8881c8c · outbound

This paper cites Deep un- supervised learning using nonequilibrium thermodynamics.

ADG: Ambient Diffusion-Guided Dataset Recovery for Corruption-Robust Offline Reinforcement Learning Deep un- supervised learning using nonequilibrium thermodynamics

Reference 30

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T12:55:56.475138Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T12:55:52.882565Z digest=sha256:981a715808f4347fa257a21643b15608775dd1e918dcd39f2b42df81b5c01c05

Observation d95c7342-e74a-4a3f-9126-2545d5b18d35 · outbound

This paper cites Score-based generative modeling through stochastic differential equations.

ADG: Ambient Diffusion-Guided Dataset Recovery for Corruption-Robust Offline Reinforcement Learning Score-based generative modeling through stochastic differential equations

Reference 31

Resolution
unresolved
no resolver link, observed 2026-08-07T12:55:53.023971Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T12:55:53.023971Z digest=sha256:0ddb5784a4972fed0a24f4b017699cd6fa01a3fac114b2f9276ff87625ce07d8

Observation e72e98e9-8ea3-4648-9020-99c453556ca2 · outbound

This paper cites Diffusion policies as an expressive policy class for offline reinforcement learning.

ADG: Ambient Diffusion-Guided Dataset Recovery for Corruption-Robust Offline Reinforcement Learning Diffusion policies as an expressive policy class for offline reinforcement learning

Reference 32

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T12:55:56.382385Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T12:55:53.157210Z digest=sha256:863b48379c29f9bfbb534b41aea52c2610f4daba14135fa5013b072c51d9be55

Observation 397d09de-2df4-4cfc-b15f-04cefe7ba833 · outbound

This paper cites COPA: Certifying Robust Policies for Offline Reinforcement Learning against Poisoning Attacks.

ADG: Ambient Diffusion-Guided Dataset Recovery for Corruption-Robust Offline Reinforcement Learning COPA: Certifying Robust Policies for Offline Reinforcement Learning against Poisoning Attacks

Reference 33

Resolution
unresolved
no resolver link, observed 2026-08-07T12:55:53.257474Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T12:55:53.257474Z digest=sha256:5df2874897928db77db4a4cbfa4b383970327ccd7bfa6199f0b3a88bb972ef20

Observation ae603eeb-7d7a-43b2-86bc-6f252b7d7d6a · outbound

This paper cites Tackling data corruption in offline reinforcement learning via sequence modeling.

ADG: Ambient Diffusion-Guided Dataset Recovery for Corruption-Robust Offline Reinforcement Learning Tackling data corruption in offline reinforcement learning via sequence modeling

Reference 34

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T12:55:56.317012Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T12:55:53.375177Z digest=sha256:0eb997d1007872eb13a30e340d1604d7bcbd62b93d28f13e2b1986e7c76ec96f

Observation bec7e5bc-db01-4841-ab8d-ae899f31e0dc · outbound

This paper cites Rorl: Robust offline reinforcement learning via conservative smoothing.

ADG: Ambient Diffusion-Guided Dataset Recovery for Corruption-Robust Offline Reinforcement Learning Rorl: Robust offline reinforcement learning via conservative smoothing

Reference 35

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T12:55:56.126296Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T12:55:53.461873Z digest=sha256:91e476c139f6fba19e4287b059849300621164eee5a6f0c8a449d9a9243e95bb

Observation c2be624d-9675-487d-92de-65d134ad6429 · outbound

This paper cites Regularizing Hidden States Enables Learning Generalizable Reward Model for LLMs.

ADG: Ambient Diffusion-Guided Dataset Recovery for Corruption-Robust Offline Reinforcement Learning Regularizing Hidden States Enables Learning Generalizable Reward Model for LLMs

Reference 36

Resolution
unresolved
no resolver link, observed 2026-08-07T12:55:53.556785Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T12:55:53.556785Z digest=sha256:b3a788f29ce6a16a6f8a8af5a4f374a2840a577285b4097cc8488d1cbce6c1dc

Observation dc6e40a4-8c22-499d-916f-38b0606a70ab · outbound

This paper cites Towards robust offline reinforcement learning under diverse data corruption.

ADG: Ambient Diffusion-Guided Dataset Recovery for Corruption-Robust Offline Reinforcement Learning Towards robust offline reinforcement learning under diverse data corruption

Reference 37

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T12:55:55.958959Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T12:55:53.638459Z digest=sha256:937f375c5a32609d05d253183bc8e59b111edb1a5c50bdf4e3a0821775848d43

Observation c23335ab-2839-49a6-ba43-d10898ab60cb · outbound

This paper cites Dmbp: Diffusion model-based predictor for robust offline rein- forcement learning against state observation perturbations.

ADG: Ambient Diffusion-Guided Dataset Recovery for Corruption-Robust Offline Reinforcement Learning Dmbp: Diffusion model-based predictor for robust offline rein- forcement learning against state observation perturbations

Reference 38

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T12:55:55.796509Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T12:55:53.766842Z digest=sha256:392bb12bc36a7b864a63528ec2de04a53d1aa53bfe59d6a41f08b51f7490eb66

Observation 942f13a5-48d8-4637-8b4e-3dcb9e0b5a7a · outbound

This paper cites Towards Robust Model-Based Reinforcement Learning Against Adversarial Corruption.

ADG: Ambient Diffusion-Guided Dataset Recovery for Corruption-Robust Offline Reinforcement Learning Towards Robust Model-Based Reinforcement Learning Against Adversarial Corruption

Reference 39

Resolution
unresolved
no resolver link, observed 2026-08-07T12:55:53.920438Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T12:55:53.920438Z digest=sha256:c07f0f1310e4991a52a87a0f554dc268250363cf490dd0c4ecddf9320661bccd

Observation 02a95ecd-77eb-4bc1-9265-743cc4e120cc · outbound

This paper cites Corruption-robust offline reinforcement learning with general function approximation.

ADG: Ambient Diffusion-Guided Dataset Recovery for Corruption-Robust Offline Reinforcement Learning Corruption-robust offline reinforcement learning with general function approximation

Reference 40

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T12:55:55.607965Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T12:55:54.057000Z digest=sha256:9fc055ebbee0e6f71c20b6b776c4eab94a0e4064614b13800ea908e5695fb136

Observation b9ecdb87-ee50-4795-8257-fb15e3942fd9 · outbound

This paper cites Robust Reinforcement Learning on State Observations with Learned Optimal Adversary.

ADG: Ambient Diffusion-Guided Dataset Recovery for Corruption-Robust Offline Reinforcement Learning Robust Reinforcement Learning on State Observations with Learned Optimal Adversary

Reference 41

Resolution
unresolved
no resolver link, observed 2026-08-07T12:55:54.213230Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T12:55:54.213230Z digest=sha256:d80a51974d9d106370cc7b6390c2ee561a16d2209ae5a638b455638be94caea9

Observation 5871579f-6a8d-4d36-901e-99fe7a7e3c0c · outbound

This paper cites Robust deep reinforcement learning against adversarial perturbations on state observa- tions.

ADG: Ambient Diffusion-Guided Dataset Recovery for Corruption-Robust Offline Reinforcement Learning Robust deep reinforcement learning against adversarial perturbations on state observa- tions

Reference 42

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T12:55:55.473965Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T12:55:54.309588Z digest=sha256:9c6c56beef05b5bd83e87436e4378c8e93d9704f7da945337f9f5c7d4c88ea12

Observation 3eac0b00-c5a7-4c4f-bb3a-438918897dbf · outbound

This paper cites medium-replay- v2.

ADG: Ambient Diffusion-Guided Dataset Recovery for Corruption-Robust Offline Reinforcement Learning medium-replay- v2

Reference 43

Resolution
malformed identifier
raw_fallback, observed 2026-08-07T12:55:55.236937Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T12:55:54.416203Z digest=sha256:9bed400f0d8868047318aa4905913f79ca42b51359b6803c187a58afd3e05020

Pith citing papers

Observation a4d3b03d-0631-4e30-a768-51c4b3a89431 · inbound

Ambient Diffusion Omni: Training Good Models with Bad Data cites this paper.

Ambient Diffusion Omni: Training Good Models with Bad Data ADG: Ambient Diffusion-Guided Dataset Recovery for Corruption-Robust Offline Reinforcement Learning

Reference 45

Resolution
verified exact
local_arxiv, observed 2026-08-07T05:01:17.604728Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T05:01:15.443445Z digest=sha256:d067ff5318048a094487f26e527259894ba423f5534ce854ffb5d6451da39fca