Pith. sign in

Paper Citation Record · LEDGER

LLM-Driven Policy Diffusion: Enhancing Generalization in Offline Reinforcement Learning

As of 10 August 2026, this Paper Citation Record lists 15 of 15 outbound references and 0 inbound Pith citation observations for arXiv:2509.00347.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2509.00347 v1

Coverage vector

measured 15 of 15 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-05T13:46:03.231288Z

measured 15 of 15 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-10T06:31:04.303077+00:00

measured 0 of 0 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: cited_works

Reference resolution

15 of 15 outbound references displayed

  • verified exact3
  • verified fuzzy3
  • unresolved9
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation cddb5748-84c8-4599-8a79-66bcf1635332 · outbound

This paper cites Is Conditional Generative Modeling all you need for Decision-Making?.

LLM-Driven Policy Diffusion: Enhancing Generalization in Offline Reinforcement Learning Is Conditional Generative Modeling all you need for Decision-Making?

Reference 1

Resolution
unresolved
no resolver link, observed 2026-08-05T13:46:02.217620Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-05T13:46:02.217620Z digest=sha256:7109216c4ab0b1a19c51749b6af779d8f23c2927bf4587d37a830e3ae01b7427

Observation fd1ace3d-5848-43db-8f71-c981711f80bb · outbound

This paper cites Planning with Diffusion for Flexible Behavior Synthesis.

LLM-Driven Policy Diffusion: Enhancing Generalization in Offline Reinforcement Learning Planning with Diffusion for Flexible Behavior Synthesis

Reference 5

Resolution
unresolved
no resolver link, observed 2026-08-05T13:46:02.350406Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-05T13:46:02.350406Z digest=sha256:0fe102a1936e042aeca8b19eb20316106fa312e2ad1a918f83a9bd69ea55d954

Observation 4a5fffbe-172a-45b3-8c98-208015532ea9 · outbound

This paper cites Ad4rl: Autonomous driving benchmarks for of- fline reinforcement learning with value-based dataset.

LLM-Driven Policy Diffusion: Enhancing Generalization in Offline Reinforcement Learning Ad4rl: Autonomous driving benchmarks for of- fline reinforcement learning with value-based dataset

Reference 6

Resolution
verified fuzzy
raw_fallback, observed 2026-08-05T13:46:03.957230Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-08-05T13:46:02.387100Z digest=sha256:d5d49de8f793428317b226c486b5f01e7a3e8e616b03e6101c9f072c097adc02

Observation 01f8c809-2436-4020-b774-450034bef383 · outbound

This paper cites Exploiting Generalization in Offline Reinforcement Learning via Unseen State Augmentations.

LLM-Driven Policy Diffusion: Enhancing Generalization in Offline Reinforcement Learning Exploiting Generalization in Offline Reinforcement Learning via Unseen State Augmentations

Reference 7

Resolution
verified exact
local_arxiv, observed 2026-08-05T13:46:03.559746Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-08-05T13:46:02.477661Z digest=sha256:ae41708282b9aa98bd075e4f9a686c777a238f8f783388c54da2b84c03305078

Observation 819b1949-d086-48b9-8cad-bc5faae2c2ba · outbound

This paper cites Soft adversarial offline reinforcement learning via reducing the attack strength for generalization.

LLM-Driven Policy Diffusion: Enhancing Generalization in Offline Reinforcement Learning Soft adversarial offline reinforcement learning via reducing the attack strength for generalization

Reference 8

Resolution
verified fuzzy
raw_fallback, observed 2026-08-05T13:46:03.832525Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-08-05T13:46:02.545337Z digest=sha256:433dfc86b0876af36bf0578b2e89c4205ce7926ec65d34ddca0d42e3cc7c4579

Observation a3c743bb-61f6-4e56-9bbe-68086e6d8572 · outbound

This paper cites Large Language Models Meet NLP: A Survey.

LLM-Driven Policy Diffusion: Enhancing Generalization in Offline Reinforcement Learning Large Language Models Meet NLP: A Survey

Reference 9

Resolution
unresolved
no resolver link, observed 2026-08-05T13:46:02.642782Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-05T13:46:02.642782Z digest=sha256:3d26ffe1e9050da4d35711c3d3a7215361034957c445bbad0a842d5f402b7fcc

Observation 69d9f2f7-0787-43bb-9a0a-8e948284061b · outbound

This paper cites Mujoco: A physics engine for model-based control.

LLM-Driven Policy Diffusion: Enhancing Generalization in Offline Reinforcement Learning Mujoco: A physics engine for model-based control

Reference 11

Resolution
verified fuzzy
raw_fallback, observed 2026-08-05T13:46:03.699111Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-08-05T13:46:02.910684Z digest=sha256:30356d0bc5d1b6c538ecd562f20064b6ee093167622205301e6bea4823bddad6

Observation 08620d10-b74b-4347-b5fd-b48fc279c181 · outbound

This paper cites A Survey on Knowledge Distillation of Large Language Models.

LLM-Driven Policy Diffusion: Enhancing Generalization in Offline Reinforcement Learning A Survey on Knowledge Distillation of Large Language Models

Reference 13

Resolution
unresolved
no resolver link, observed 2026-08-05T13:46:03.161222Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-05T13:46:03.161222Z digest=sha256:dbd91998b47c9afb73d06995b43d517025d549948e9918c22d5f89a8eabc91bc

Observation ea991915-d6c7-4e22-a76d-27ddd1176e20 · outbound

This paper cites Generalization of Reinforcement Learning with Policy-Aware Adversarial Data Augmentation.

LLM-Driven Policy Diffusion: Enhancing Generalization in Offline Reinforcement Learning Generalization of Reinforcement Learning with Policy-Aware Adversarial Data Augmentation

Reference 14

Resolution
verified exact
local_arxiv, observed 2026-08-05T13:46:03.459519Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-08-05T13:46:03.192637Z digest=sha256:91eb050079ac155107aaa644b7351fefbfb3a6e163849c3e4041f1628c04955e

Observation 4b80b5fd-0993-424f-8b9e-54b8c6fec6b1 · outbound

This paper cites Paired Open-Ended Trailblazer (POET): Endlessly Generating Increasingly Complex and Diverse Learning Environments and Their Solutions.

LLM-Driven Policy Diffusion: Enhancing Generalization in Offline Reinforcement Learning Paired Open-Ended Trailblazer (POET): Endlessly Generating Increasingly Complex and Diverse Learning Environments and Their Solutions

Reference 2017

Resolution
unresolved
no resolver link, observed 2026-08-05T13:46:03.033891Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-05T13:46:03.033891Z digest=sha256:7e17ef70590a83ecd6921a3326ad429884c5feeaab966ac3b7d87da0d59e9170

Observation 076455a5-efce-4483-a759-dc9dd8131d7f · outbound

This paper cites OLMo: Accelerating the Science of Language Models.

LLM-Driven Policy Diffusion: Enhancing Generalization in Offline Reinforcement Learning OLMo: Accelerating the Science of Language Models

Reference 2020

Resolution
unresolved
no resolver link, observed 2026-08-05T13:46:02.328405Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-05T13:46:02.328405Z digest=sha256:4804ccfe196dd747c60cde6d3342354125645a224deab5c3a57589c81b86f7e1

Observation 2ebc30eb-88bc-4c90-a44a-bd7abe79f9f3 · outbound

This paper cites Offline Trajectory Optimization for Offline Reinforcement Learning.

LLM-Driven Policy Diffusion: Enhancing Generalization in Offline Reinforcement Learning Offline Trajectory Optimization for Offline Reinforcement Learning

Reference 2021

Resolution
verified exact
local_arxiv, observed 2026-08-05T13:46:03.367828Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-08-05T13:46:03.231288Z digest=sha256:04e95e7083cd63c613a52952f6cf7e0d7f72090d42744fe5bc8d01788ef858f6

Observation fabc8d4a-808d-47a5-a9f6-17af5f205a5f · outbound

This paper cites LLM-based Multi-Agent Reinforcement Learning: Current and Future Directions.

LLM-Driven Policy Diffusion: Enhancing Generalization in Offline Reinforcement Learning LLM-based Multi-Agent Reinforcement Learning: Current and Future Directions

Reference 2022

Resolution
unresolved
no resolver link, observed 2026-08-05T13:46:02.788254Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-05T13:46:02.788254Z digest=sha256:8cd83cd98efc53d610e0f0d0bdb82f9e75c44ce4d36d3e83d7412728ba070ed5

Observation d4fabd4e-6e44-4eda-aa65-79ad9c01bfdd · outbound

This paper cites The Llama 3 Herd of Models.

LLM-Driven Policy Diffusion: Enhancing Generalization in Offline Reinforcement Learning The Llama 3 Herd of Models

Reference 2023

Resolution
unresolved
no resolver link, observed 2026-08-05T13:46:02.269056Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-05T13:46:02.269056Z digest=sha256:85bbf1057d2c37ef23247fa92092aae694c25f62b3449f5e79d00d1622369e2f

Observation 4d68f3ad-e4fc-40e6-be86-ce3a31ed6f15 · outbound

This paper cites D4RL: Datasets for Deep Data-Driven Reinforcement Learning.

LLM-Driven Policy Diffusion: Enhancing Generalization in Offline Reinforcement Learning D4RL: Datasets for Deep Data-Driven Reinforcement Learning

Reference 2024

Resolution
unresolved
no resolver link, observed 2026-08-05T13:46:02.304215Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-05T13:46:02.304215Z digest=sha256:51015830731a0426dadb44f21c6d6403f2a9fd98b40134af708d4e4125131248

Pith citing papers

No inbound Pith citation observations are available.