Pith. sign in

Paper Citation Record · LEDGER

Stable Continual Reinforcement Learning via Diffusion-based Trajectory Replay

As of 15 August 2026, this Paper Citation Record lists 18 of 18 outbound references and 4 inbound Pith citation observations for arXiv:2411.10809.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2411.10809 v1

Coverage vector

measured 18 of 18 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-12T19:21:15.806376Z

measured 22 of 22 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-15T06:32:42.880941+00:00

measured 4 of 4 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-07T00:16:40.984294Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: arxiv_reference, observed 2026-07-04T19:30:07.936806Z

Reference resolution

18 of 18 outbound references displayed

  • verified exact2
  • verified fuzzy4
  • unresolved12
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation 18771d1f-dd46-4b76-8a2a-7d135188cd84 · outbound

This paper cites On Tiny Episodic Memories in Continual Learning.

Stable Continual Reinforcement Learning via Diffusion-based Trajectory Replay On Tiny Episodic Memories in Continual Learning

Reference 2

Resolution
unresolved
no resolver link, observed 2026-08-12T19:21:15.659121Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T19:21:15.659121Z digest=sha256:287456e0ccb7d7545e6b666315c07a6aaa08eac3bea9773fc0c920622d665583

Observation 702aa86b-6677-4309-84d7-b8cbd8fc11c2 · outbound

This paper cites AdaptDiffuser: Diffusion Models as Adaptive Self-evolving Planners.

Stable Continual Reinforcement Learning via Diffusion-based Trajectory Replay AdaptDiffuser: Diffusion Models as Adaptive Self-evolving Planners

Reference 5

Resolution
unresolved
no resolver link, observed 2026-08-12T19:21:15.682942Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T19:21:15.682942Z digest=sha256:3177164a25d24931f701fb912e6389d4fa0e236167f7879972289a3e6ed65d35

Observation 33c22658-9e03-40cb-b97e-683e4cce3246 · outbound

This paper cites A Survey on Model-based Reinforcement Learning.

Stable Continual Reinforcement Learning via Diffusion-based Trajectory Replay A Survey on Model-based Reinforcement Learning

Reference 7

Resolution
unresolved
no resolver link, observed 2026-08-12T19:21:15.710465Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T19:21:15.710465Z digest=sha256:bbbcb42747d05b538743b961d53935ec2fabebf2ade6dd6a5206fef9f2b86840

Observation 0b2bf39d-4119-440f-82b5-849cd9f835ad · outbound

This paper cites Im- itating human behaviour with diffusion models.

Stable Continual Reinforcement Learning via Diffusion-based Trajectory Replay Im- itating human behaviour with diffusion models

Reference 10

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T19:21:16.314335Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-08-12T19:21:15.745030Z digest=sha256:f0aa9d1bdfdfb2747159d846ff92f9e64e5e8c9f197c564dd7e9fb1de48911b1

Observation bbdfb1e9-97a0-4d3d-a326-611990d53c41 · outbound

This paper cites High- resolution image synthesis with latent diffusion models.

Stable Continual Reinforcement Learning via Diffusion-based Trajectory Replay High- resolution image synthesis with latent diffusion models

Reference 12

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T19:21:16.290765Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-08-12T19:21:15.766013Z digest=sha256:21177972b621637c5728fe7dddc5cf7f97192873cdde7e402e3f4ad052687acb

Observation 7241d327-b860-4fff-8a75-961bb5d85189 · outbound

This paper cites SafeDiffuser: Safe Planning with Diffusion Probabilistic Models.

Stable Continual Reinforcement Learning via Diffusion-based Trajectory Replay SafeDiffuser: Safe Planning with Diffusion Probabilistic Models

Reference 15

Resolution
unresolved
no resolver link, observed 2026-08-12T19:21:15.785796Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T19:21:15.785796Z digest=sha256:bffa7b67f76203671ac2134b86758dbba01054515621a1e4bf5adab6490255e8

Observation 3a9e65a6-e1d7-4257-97b0-457b4d21bdb9 · outbound

This paper cites t-DGR: A trajectory-based deep generative replay method for continual learning in decision making.

Stable Continual Reinforcement Learning via Diffusion-based Trajectory Replay t-DGR: A trajectory-based deep generative replay method for continual learning in decision making

Reference 16

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T19:21:16.266129Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-08-12T19:21:15.792245Z digest=sha256:d5415b314f621d7b0eb549d7c1d7f9a3867a285c63d2bfeeea7d11b8d63d9914

Observation 87da433e-bfc3-4b91-818b-a1d0a4b684aa · outbound

This paper cites Exploring Continual Learning of Diffusion Models.

Stable Continual Reinforcement Learning via Diffusion-based Trajectory Replay Exploring Continual Learning of Diffusion Models

Reference 17

Resolution
unresolved
no resolver link, observed 2026-08-12T19:21:15.798243Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T19:21:15.798243Z digest=sha256:2672689ca417170905f80c2642cdcdb9abffb94ee21e7d5068a630fb330a43b0

Observation 0459a2d7-3642-4c55-aa6d-b3b126e9935f · outbound

This paper cites MADiff: Offline Multi-agent Learning with Diffusion Models.

Stable Continual Reinforcement Learning via Diffusion-based Trajectory Replay MADiff: Offline Multi-agent Learning with Diffusion Models

Reference 18

Resolution
unresolved
no resolver link, observed 2026-08-12T19:21:15.806376Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T19:21:15.806376Z digest=sha256:1f69e8cf42913aacf0688aed9cb76bfb393512c91e5de3fadf1c554118e44250

Observation 9a3bc1da-b79f-4e0d-a6b9-277d2c7e0ea5 · outbound

This paper cites UMAP: Uniform Manifold Approximation and Projection for Dimension Reduction.

Stable Continual Reinforcement Learning via Diffusion-based Trajectory Replay UMAP: Uniform Manifold Approximation and Projection for Dimension Reduction

Reference 1989

Resolution
unresolved
no resolver link, observed 2026-08-12T19:21:15.721771Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T19:21:15.721771Z digest=sha256:1f5ce621ab08bc79fdfca72256c3205d16f4e2b96f3daf7d194040206cbe1790

Observation 5e665aec-e7d6-43d0-96f4-b16094ff9426 · outbound

This paper cites Goal-Conditioned Imitation Learning using Score-based Diffusion Policies.

Stable Continual Reinforcement Learning via Diffusion-based Trajectory Replay Goal-Conditioned Imitation Learning using Score-based Diffusion Policies

Reference 2017

Resolution
unresolved
no resolver link, observed 2026-08-12T19:21:15.755795Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T19:21:15.755795Z digest=sha256:f6b5d5cc5d06eb67e260feac3f23a0ed3d9e64c44a5a9288b0109c5084df311f

Observation 972618b6-b6b1-43fd-8775-3091be6a1e11 · outbound

This paper cites Diffusion Model is an Effective Planner and Data Synthesizer for Multi-Task Reinforcement Learning.

Stable Continual Reinforcement Learning via Diffusion-based Trajectory Replay Diffusion Model is an Effective Planner and Data Synthesizer for Multi-Task Reinforcement Learning

Reference 2018

Resolution
verified exact
local_arxiv, observed 2026-08-12T19:21:16.200814Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-08-12T19:21:15.668449Z digest=sha256:3e1e78da6208552dc3a22a034529b52ead19966b1653029fc22ba2acfe1dcf31

Observation f0de0998-1ab6-4feb-b11c-0aca837bbcb8 · outbound

This paper cites Continual Learning in Neural Networks.

Stable Continual Reinforcement Learning via Diffusion-based Trajectory Replay Continual Learning in Neural Networks

Reference 2019

Resolution
unresolved
no resolver link, observed 2026-08-12T19:21:15.650251Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T19:21:15.650251Z digest=sha256:3ff13fd5a9dfcb223d47e726dd3e638fd4c90cefaeb404d8b29313981ee0ce31

Observation b3017ada-96bc-49f8-8f42-93bf4b1ee0ba · outbound

This paper cites A Comprehensive Survey of Continual Learning: Theory, Method and Application.

Stable Continual Reinforcement Learning via Diffusion-based Trajectory Replay A Comprehensive Survey of Continual Learning: Theory, Method and Application

Reference 2020

Resolution
unresolved
no resolver link, observed 2026-08-12T19:21:15.778771Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T19:21:15.778771Z digest=sha256:7f22bb6691fc837b1150abd943dd3442ab6a4e87ea26de18b65e63470cabfb73

Observation f125ad51-7f30-425e-b3ec-2f2b87ea1692 · outbound

This paper cites Progressive Neural Networks.

Stable Continual Reinforcement Learning via Diffusion-based Trajectory Replay Progressive Neural Networks

Reference 2021

Resolution
unresolved
no resolver link, observed 2026-08-12T19:21:15.771993Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T19:21:15.771993Z digest=sha256:da50f597eaeac94848ff9b254bc20f92393790c154b82ec1bc4881bf84b0407e

Observation c191ff02-d232-4e97-b5bb-d0560040d291 · outbound

This paper cites Auto-Encoding Variational Bayes.

Stable Continual Reinforcement Learning via Diffusion-based Trajectory Replay Auto-Encoding Variational Bayes

Reference 2022

Resolution
unresolved
no resolver link, observed 2026-08-12T19:21:15.676100Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T19:21:15.676100Z digest=sha256:a6c49840f1880cb21a263d2efa359fc8f3ae14ac6fedbbfcb49bc48a0b595ca3

Observation aa9a42dc-91ac-4c79-b69d-c89d7b92268c · outbound

This paper cites MetaDiffuser: Diffusion Model as Conditional Planner for Offline Meta-RL.

Stable Continual Reinforcement Learning via Diffusion-based Trajectory Replay MetaDiffuser: Diffusion Model as Conditional Planner for Offline Meta-RL

Reference 2023

Resolution
verified exact
local_arxiv, observed 2026-08-12T19:21:16.065123Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-08-12T19:21:15.734406Z digest=sha256:34fe3fe813043bab4fc842144f3e58f026506c48f4775d951955d52a23122f5e

Observation 2d187eee-ef9b-49f5-9310-d62e74dda94d · outbound

This paper cites Synthetic experience replay.

Stable Continual Reinforcement Learning via Diffusion-based Trajectory Replay Synthetic experience replay

Reference 2024

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T19:21:16.335144Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-08-12T19:21:15.692731Z digest=sha256:d28db830faab29f0d94331f54ec821085d18edf6e08c3d9fb6597bc898c9fc54

Pith citing papers

Observation 49674be9-0832-491e-846f-1da97c8da846 · inbound

MEAL: A Benchmark for Continual Multi-Agent Reinforcement Learning cites this paper.

MEAL: A Benchmark for Continual Multi-Agent Reinforcement Learning Stable Continual Reinforcement Learning via Diffusion-based Trajectory Replay

Reference 9

Resolution
unresolved
no resolver link, observed 2026-08-07T00:16:40.984294Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T00:16:40.984294Z digest=sha256:a27e7ce841f19cd3531688fe750067b2775d03bcb82c2fceda5f4b49e1c68901

Observation 32d0c95c-ff66-4c11-bfc3-314a4444684e · inbound

Continual Quadruped Robots Coordination via Semantic Skill Discovery cites this paper.

Continual Quadruped Robots Coordination via Semantic Skill Discovery Stable Continual Reinforcement Learning via Diffusion-based Trajectory Replay

Reference 15

Resolution
verified exact
arxiv_id, observed 2026-07-02T21:37:25.171324Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-06-27T19:37:53.168569Z digest=sha256:3d99115fcf9ae3d24206cbcec78d67ceadbc14c007fa5f7946b2e560e5e35cae

Observation ad1cc0a0-5926-448c-9f01-f62965cf8296 · inbound

Offline Multi-agent Continual Cooperation via Skill Partition and Reuse cites this paper.

Offline Multi-agent Continual Cooperation via Skill Partition and Reuse Stable Continual Reinforcement Learning via Diffusion-based Trajectory Replay

Reference 36

Resolution
verified exact
arxiv_id, observed 2026-07-04T19:30:07.938269Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=arxiv_source observed=2026-06-25T21:14:31.778575Z digest=sha256:24f501564388614f3601009575698d734527ce2bfb1b6670274008d638d033b2

Observation 9ae066cd-8993-4889-b00c-3638a169dfe7 · inbound

HyperDCM: Dynamic Cluster Memory Replay in Hyperbolic Space for Continual Robotic Navigation Across Scenes cites this paper.

HyperDCM: Dynamic Cluster Memory Replay in Hyperbolic Space for Continual Robotic Navigation Across Scenes Stable Continual Reinforcement Learning via Diffusion-based Trajectory Replay

Reference 33

Resolution
unresolved
no resolver link, observed 2026-08-02T08:53:46.797845Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T08:53:46.797845Z digest=sha256:b868c2fdfa414292f82bd0a94099b7db49930a8daadb8047f8354d1feda21042