Pith. sign in

Paper Citation Record · LEDGER

Revisiting Generative Policies: A Simpler Reinforcement Learning Algorithmic Perspective

As of 16 August 2026, this Paper Citation Record lists 13 of 13 outbound references and 1 inbound Pith citation observation for arXiv:2412.01245.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2412.01245 v1

Coverage vector

measured 13 of 13 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-12T04:36:35.855257Z

measured 14 of 14 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-16T06:30:59.297886+00:00

measured 1 of 1 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-16T04:14:13.202400Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: pith, observed 2026-08-16T04:14:13.247801Z

Reference resolution

13 of 13 outbound references displayed

  • verified exact0
  • verified fuzzy4
  • unresolved7
  • parse uncertain0
  • malformed identifier2
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation b12e8a8b-acd6-4d41-9ae1-6338fb840cb9 · outbound

This paper cites IDQL: Implicit Q-Learning as an Actor-Critic Method with Diffusion Policies.

Revisiting Generative Policies: A Simpler Reinforcement Learning Algorithmic Perspective IDQL: Implicit Q-Learning as an Actor-Critic Method with Diffusion Policies

Reference 4

Resolution
unresolved
no resolver link, observed 2026-08-12T04:36:35.825515Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T04:36:35.825515Z digest=sha256:f90d4377f31d64e196608720b22054010f30a67d3f31cbed11bfb89632cdfd95

Observation e56b479e-575a-47ca-aaf8-ae4c203ccd1e · outbound

This paper cites Symbolic Music Generation with Diffusion Models.

Revisiting Generative Policies: A Simpler Reinforcement Learning Algorithmic Perspective Symbolic Music Generation with Diffusion Models

Reference 8

Resolution
unresolved
no resolver link, observed 2026-08-12T04:36:35.838981Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T04:36:35.838981Z digest=sha256:eef53711318b0dad5b9abd21b7c884986b256d5d77cba84d5f32ea2c39684b85

Observation e43c0168-fe48-4c42-a3e7-8e4a8736173e · outbound

This paper cites Diffusion Policy Policy Optimization.

Revisiting Generative Policies: A Simpler Reinforcement Learning Algorithmic Perspective Diffusion Policy Policy Optimization

Reference 10

Resolution
unresolved
no resolver link, observed 2026-08-12T04:36:35.845781Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T04:36:35.845781Z digest=sha256:ab6c536b244958d1de8876fa830bb56eaa46afe2cc7f4f90a9daa751fc5ee869

Observation db0e2b4e-4762-4f08-b666-61172bda24b7 · outbound

This paper cites Guided Flows for Generative Modeling and Decision Making.

Revisiting Generative Policies: A Simpler Reinforcement Learning Algorithmic Perspective Guided Flows for Generative Modeling and Decision Making

Reference 13

Resolution
malformed identifier
no resolver link, observed 2026-08-12T04:36:35.855257Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T04:36:35.855257Z digest=sha256:6dc23f2c3d9560c46c6b649004f8a7904e30429e8cfc9e679b771aff816e0edc

Observation 5ffc3fbd-44c2-40bf-a860-8545b51d93da · outbound

This paper cites Yang Song, Conor Durkan, Iain Murray, and Stefano Ermon.

Revisiting Generative Policies: A Simpler Reinforcement Learning Algorithmic Perspective Yang Song, Conor Durkan, Iain Murray, and Stefano Ermon

Reference 2015

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T04:36:35.945642Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.

source=pdf_text observed=2026-08-12T04:36:35.849233Z digest=sha256:94d93ee84401fadd50f97d8ca3596e3a5147c8a89b8dff8c3d9c993f3c08e51e

Observation 3856558f-98c3-4118-b960-30b983955c58 · outbound

This paper cites IDQL: Implicit Q-Learning as an Actor-Critic Method with Diffusion Policies.

Revisiting Generative Policies: A Simpler Reinforcement Learning Algorithmic Perspective IDQL: Implicit Q-Learning as an Actor-Critic Method with Diffusion Policies

Reference 2018

Resolution
unresolved
no resolver link, observed 2026-08-12T04:36:35.821985Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T04:36:35.821985Z digest=sha256:577fcada0a33eba02cb8e0609a63ec47f243eee41e136c6fbe18ecd40c584025

Observation 8f6b6d5a-c9da-42c2-a179-d37edfdb5c36 · outbound

This paper cites Eric Liang, Richard Liaw, Robert Nishihara, Philipp Moritz, Roy Fox, Ken Goldberg, Joseph E.

Revisiting Generative Policies: A Simpler Reinforcement Learning Algorithmic Perspective Eric Liang, Richard Liaw, Robert Nishihara, Philipp Moritz, Roy Fox, Ken Goldberg, Joseph E

Reference 2019

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T04:36:35.963036Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.

source=pdf_text observed=2026-08-12T04:36:35.835862Z digest=sha256:abda0b0ffc923607c2b815c33cd5f4d650aabe5ddce784a7d25a303d20d3f19e

Observation 4de7edc4-d186-4ee4-96aa-5fdece7f790e · outbound

This paper cites Jonathan Ho, Tim Salimans, Alexey Gritsenko, William Chan, Mohammad Norouzi, and David J Fleet.

Revisiting Generative Policies: A Simpler Reinforcement Learning Algorithmic Perspective Jonathan Ho, Tim Salimans, Alexey Gritsenko, William Chan, Mohammad Norouzi, and David J Fleet

Reference 2020

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T04:36:35.971723Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.

source=pdf_text observed=2026-08-12T04:36:35.828826Z digest=sha256:c9c081d17009ca9ec1f81679231f8e0af556d313a46941c116aa944e35114867

Observation 10bce5cd-5b4a-43de-a27b-1ac77cf10cca · outbound

This paper cites Acme: A Research Framework for Distributed Reinforcement Learning.

Revisiting Generative Policies: A Simpler Reinforcement Learning Algorithmic Perspective Acme: A Research Framework for Distributed Reinforcement Learning

Reference 2022

Resolution
unresolved
no resolver link, observed 2026-08-12T04:36:35.832000Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T04:36:35.832000Z digest=sha256:22b7fd903af3b3127cba43f0d201b90ecd2c7b98dd945768ef229e2a6987288a

Observation 1e68aa15-5bc4-4228-9aad-9ea9ed8bc523 · outbound

This paper cites CleanDiffuser: An Easy-to-use Modularized Library for Diffusion Models in Decision Making.

Revisiting Generative Policies: A Simpler Reinforcement Learning Algorithmic Perspective CleanDiffuser: An Easy-to-use Modularized Library for Diffusion Models in Decision Making

Reference 2023

Resolution
unresolved
no resolver link, observed 2026-08-12T04:36:35.818408Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T04:36:35.818408Z digest=sha256:7f931d12d6747bf9e68d6b49e17387b7c065962dec0913b19ac2da29678de770

Observation 6e5dd0af-f8e4-4ab4-bfaa-5323b78cfdaa · outbound

This paper cites Diffusion Policy: Visuomotor Policy Learning via Action Diffusion.

Revisiting Generative Policies: A Simpler Reinforcement Learning Algorithmic Perspective Diffusion Policy: Visuomotor Policy Learning via Action Diffusion

Reference 2024

Resolution
unresolved
no resolver link, observed 2026-08-12T04:36:35.814125Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T04:36:35.814125Z digest=sha256:28ded4051dd46cd0f9634d1af1720c1eeced55b540bfebe4fc34eefdb6f4d4f2

Observation 9ee1adeb-a4f4-4ba5-b334-c5e04e09add7 · outbound

This paper cites Michael Poli, Stefano Massaroli, Atsushi Yamashita, Hajime Asama, Jinkyoo Park, and Stefano Ermon.

Revisiting Generative Policies: A Simpler Reinforcement Learning Algorithmic Perspective Michael Poli, Stefano Massaroli, Atsushi Yamashita, Hajime Asama, Jinkyoo Park, and Stefano Ermon

Reference 7727

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T04:36:35.954350Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.

source=pdf_text observed=2026-08-12T04:36:35.842491Z digest=sha256:770d560e939a2beadddf445e6057913c2e46809cb873cecc2a8c4e825e6428c0

Observation c0c40b0d-8d4d-407a-bf9b-dde0d83c672c · outbound

This paper cites Expert Certification.

Revisiting Generative Policies: A Simpler Reinforcement Learning Algorithmic Perspective Expert Certification

Reference 8856

Resolution
malformed identifier
no resolver link, observed 2026-08-12T04:36:35.851991Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T04:36:35.851991Z digest=sha256:562ae63d01ada4aa4597e259c4b4031f55f4c9ef57d09754c706ac1a92ed58bc

Pith citing papers

Observation ed647e00-263c-4e9f-8456-c82226888419 · inbound

Analytic Energy-Guided Policy Optimization for Offline Reinforcement Learning cites this paper.

Analytic Energy-Guided Policy Optimization for Offline Reinforcement Learning Revisiting Generative Policies: A Simpler Reinforcement Learning Algorithmic Perspective

Reference 38

Resolution
verified exact
local_arxiv, observed 2026-08-16T04:14:13.255020Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.

source=pdf_text observed=2026-08-16T04:14:13.202400Z digest=sha256:99383b3d0d065cc23b47e99eacb68ebbb610aab46eea49f2a60ad0e09383777c