Pith. sign in

Paper Citation Record · LEDGER

Revolutionizing Reinforcement Learning Framework for Diffusion Large Language Models

As of 3 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 31 inbound Pith citation observations for arXiv:2509.06949.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2509.06949 v1

Coverage vector

measured 0 of 0 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links

measured 31 of 31 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-03T06:30:56.289259+00:00

measured 31 of 31 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-03T10:09:23.651861Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: arxiv_reference, observed 2026-07-04T06:09:37.869529Z

Reference resolution

0 of 0 outbound references displayed

  • verified exact0
  • verified fuzzy0
  • unresolved0
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

No outbound reference observations are available for this paper version.

Pith citing papers

Observation bf21409b-dd4a-47fa-8e82-8af6c646eade · inbound

T$^\star$: Progressive Block Scaling for Masked Diffusion Language Models Through Trajectory Aware Reinforcement Learning cites this paper.

T$^\star$: Progressive Block Scaling for Masked Diffusion Language Models Through Trajectory Aware Reinforcement Learning Revolutionizing Reinforcement Learning Framework for Diffusion Large Language Models

Reference 19

Resolution
unresolved
no resolver link, observed 2026-08-03T10:09:23.651861Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-03T10:09:23.651861Z digest=sha256:3b6c4cec1cd334118f48e24bf05b7ed1a25f5eb799e7e20bd12e3c7921c37fed

Observation aac8d34a-7ed5-4678-9637-f856fbdece51 · inbound

The Flexibility Trap: Rethinking the Value of Arbitrary Order in Diffusion Language Models cites this paper.

The Flexibility Trap: Rethinking the Value of Arbitrary Order in Diffusion Language Models Revolutionizing Reinforcement Learning Framework for Diffusion Large Language Models

Reference 35

Resolution
unresolved
no resolver link, observed 2026-08-03T09:03:21.032525Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-03T09:03:21.032525Z digest=sha256:97f57dafebdc1859e4f1c2183ca61dababf9c9d604379580bd64d88f634f5c3c

Observation f38b6adf-8604-426a-9c2a-df30ef681b13 · inbound

FlashBlock: Attention Caching for Efficient Long-Context Block Diffusion cites this paper.

FlashBlock: Attention Caching for Efficient Long-Context Block Diffusion Revolutionizing Reinforcement Learning Framework for Diffusion Large Language Models

Reference 7

Resolution
unresolved
no resolver link, observed 2026-08-03T04:24:06.167099Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T04:24:06.167099Z digest=sha256:356a5ce25c67c92cad78bb6c15662db3b1a906ba434c47b30f6da3338a8b93bf

Observation f63daa97-6757-4967-94a6-cb94ef78eec6 · inbound

DICE: Diffusion Large Language Models Excel at Generating CUDA Kernels cites this paper.

DICE: Diffusion Large Language Models Excel at Generating CUDA Kernels Revolutionizing Reinforcement Learning Framework for Diffusion Large Language Models

Reference 22

Resolution
unresolved
no resolver link, observed 2026-08-03T00:05:27.122639Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T00:05:27.122639Z digest=sha256:1a67aa8e7cbe0d3856660063c110bfe435de051aa97b3f3d57a3ab78ab4db641

Observation d1841513-5677-477d-bdea-07091b1cae5d · inbound

Improving Sampling for Masked Diffusion Models via Information Gain cites this paper.

Improving Sampling for Masked Diffusion Models via Information Gain Revolutionizing Reinforcement Learning Framework for Diffusion Large Language Models

Reference 14

Resolution
verified exact
arxiv_id, observed 2026-05-25T07:35:29.593174Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.

source=pdf_text observed=2026-05-25T07:30:59.831550Z digest=sha256:dff9e878283d3c6d478ddeb2306d55a973a5b644aa090584346056d763b4b166

Observation 8ab909dd-c28a-4395-b2ce-ff9ad4979467 · inbound

MemDLM: Memory-Enhanced DLM Training cites this paper.

MemDLM: Memory-Enhanced DLM Training Revolutionizing Reinforcement Learning Framework for Diffusion Large Language Models

Reference 11

Resolution
metadata mismatch
arxiv_id, observed 2026-05-15T00:43:24.479970Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.

source=pdf_text observed=2026-05-15T00:42:22.989588Z digest=sha256:53458e966c3c3b0b355807f9681cfdf962cfeb59a37906d3db2c849225bd4fc7

Observation 3562d992-73ec-4496-a18f-477cfc4c09da · inbound

TAD: Temporal-Aware Trajectory Self-Distillation for Fast and Accurate Diffusion LLM cites this paper.

TAD: Temporal-Aware Trajectory Self-Distillation for Fast and Accurate Diffusion LLM Revolutionizing Reinforcement Learning Framework for Diffusion Large Language Models

Reference 38

Resolution
metadata mismatch
arxiv_id, observed 2026-05-12T05:46:26.356955Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.

source=pdf_text observed=2026-05-12T05:01:03.570848Z digest=sha256:bc44905f7e1e51826abb5c2d23d674b9451037aa09fbdc138e314d4acfd3bfb3

Observation d9e9c51b-a69c-4215-9b40-43c49577bfe8 · inbound

Relative Score Policy Optimization for Diffusion Language Models cites this paper.

Relative Score Policy Optimization for Diffusion Language Models Revolutionizing Reinforcement Learning Framework for Diffusion Large Language Models

Reference 95

Resolution
metadata mismatch
arxiv_id, observed 2026-05-12T06:56:29.492965Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.

source=arxiv_source observed=2026-05-12T03:47:42.196931Z digest=sha256:a5263120972ac60f1b5a296a4587935ff5e659984a2cd57808a550b0a6016391

Observation dfda3f9e-43ee-47d2-9768-3826aefcf14a · inbound

Beyond Mode-Seeking RL: Trajectory-Balance Post-Training for Diffusion Language Models cites this paper.

Beyond Mode-Seeking RL: Trajectory-Balance Post-Training for Diffusion Language Models Revolutionizing Reinforcement Learning Framework for Diffusion Large Language Models

Reference 21

Resolution
metadata mismatch
arxiv_id, observed 2026-05-15T04:59:45.335288Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.

source=pdf_text observed=2026-05-15T04:59:10.377262Z digest=sha256:7582f38cca85978d73a3c54c78c11cde8efc778e2dc40a4b0f264cfc46dfb8d8

Observation 9f028af6-4e13-4f28-b5e5-57169d77a00d · inbound

Sketch Then Paint: Hierarchical Reinforcement Learning for Diffusion Multi-Modal Large Language Models cites this paper.

Sketch Then Paint: Hierarchical Reinforcement Learning for Diffusion Multi-Modal Large Language Models Revolutionizing Reinforcement Learning Framework for Diffusion Large Language Models

Reference 22

Resolution
metadata mismatch
arxiv_id, observed 2026-05-19T21:22:48.527344Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.

source=pdf_text observed=2026-05-19T21:18:03.005508Z digest=sha256:8159261e7f07677cce8b63dcc23618eb2b861ca23ca1c12edc00e65d432f93ae

Observation 4931ca3e-ecc6-4b60-965e-d6d12050ac79 · inbound

Beyond Execution: Static-Analysis Rewards and Hint-Conditioned Diffusion RL for Code Generation cites this paper.

Beyond Execution: Static-Analysis Rewards and Hint-Conditioned Diffusion RL for Code Generation Revolutionizing Reinforcement Learning Framework for Diffusion Large Language Models

Reference 21

Resolution
metadata mismatch
arxiv_id, observed 2026-05-20T14:08:21.253476Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.

source=pdf_text observed=2026-05-20T14:03:45.869373Z digest=sha256:b571086ef3fa3d557a88f36d5f15fed8a936eeaa27d29a1dd918d2fd6b87ea83

Observation 1980fc2b-a08b-45dd-8dd2-795e2127eb22 · inbound

Fast-dDrive: Efficient Block-Diffusion VLM for Autonomous Driving cites this paper.

Fast-dDrive: Efficient Block-Diffusion VLM for Autonomous Driving Revolutionizing Reinforcement Learning Framework for Diffusion Large Language Models

Reference 16

Resolution
metadata mismatch
arxiv_id, observed 2026-05-25T05:06:38.500005Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.

source=pdf_text observed=2026-05-25T05:00:58.024124Z digest=sha256:2a39e5d98b77f67190a52f0f921c26abdca21ba804f281235cf8ae2b642685b9

Observation cddd6195-278a-4aed-a8f2-e4f8e212b7d3 · inbound

Fast-dDrive: Efficient Block-Diffusion VLM for Autonomous Driving cites this paper.

Fast-dDrive: Efficient Block-Diffusion VLM for Autonomous Driving Revolutionizing Reinforcement Learning Framework for Diffusion Large Language Models

Reference 16

Resolution
metadata mismatch
arxiv_id, observed 2026-06-30T16:35:12.302334Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.

source=pdf_text observed=2026-06-30T16:34:21.422620Z digest=sha256:71ac3cf2c2055e6e2bf7b52d2b67e40e99786f43b422905141fe2959aca52ac1

Observation 880e18e9-98e7-4abb-989f-c41f6c372eb3 · inbound

GDSD: Reinforcement Learning as Guided Denoiser Self-Distillation for Diffusion Language Models cites this paper.

GDSD: Reinforcement Learning as Guided Denoiser Self-Distillation for Diffusion Language Models Revolutionizing Reinforcement Learning Framework for Diffusion Large Language Models

Reference 54

Resolution
metadata mismatch
arxiv_id, observed 2026-06-29T08:53:16.365834Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.

source=pdf_text observed=2026-06-29T08:44:53.969301Z digest=sha256:077bcc7f02672fd34312e14ed21f47a5da4c119a0de3d2903f2424fb0ef7bf02

Observation 811ec5d0-7205-45ae-890d-c281b6f09ed5 · inbound

Dynamic Infilling Anchors for Format-Constrained Generation in Diffusion Large Language Models cites this paper.

Dynamic Infilling Anchors for Format-Constrained Generation in Diffusion Large Language Models Revolutionizing Reinforcement Learning Framework for Diffusion Large Language Models

Reference 74

Resolution
verified exact
arxiv_id, observed 2026-07-02T08:06:48.439338Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.

source=arxiv_source observed=2026-06-28T06:20:27.041099Z digest=sha256:cfea4e257eb1dbde4142f6b8305df1de441ba3f1a75c5254298fdb1af19f16ac

Observation 3ad659e2-0aa5-4651-ac0b-b97de6064121 · inbound

Data-Efficient Autoregressive-to-Diffusion Language Models via On-Policy Distillation cites this paper.

Data-Efficient Autoregressive-to-Diffusion Language Models via On-Policy Distillation Revolutionizing Reinforcement Learning Framework for Diffusion Large Language Models

Reference 51

Resolution
metadata mismatch
arxiv_id, observed 2026-07-02T13:26:58.870004Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.

source=pdf_text observed=2026-06-28T01:21:52.821813Z digest=sha256:faf602859b94aa24e2dc80c6b62c703908bbbde3074df776ceb4a52f4ac58ade

Observation 971d982d-f78e-4362-af0e-ad8f44d0ae51 · inbound

Back on Track: Aligning Rewards and States for Reasoning in Diffusion Large Language Models cites this paper.

Back on Track: Aligning Rewards and States for Reasoning in Diffusion Large Language Models Revolutionizing Reinforcement Learning Framework for Diffusion Large Language Models

Reference 20

Resolution
metadata mismatch
arxiv_id, observed 2026-07-02T22:57:26.565951Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.

source=arxiv_source observed=2026-06-27T18:31:21.493677Z digest=sha256:1785d7858554861fcef23015abafdab348bb8941c156425cff516828ccea29d5

Observation fdc14c71-1bd0-4457-993a-67d7a2af8218 · inbound

Unified Energy for Invariant and Independent Decoding in Diffusion Language Models cites this paper.

Unified Energy for Invariant and Independent Decoding in Diffusion Language Models Revolutionizing Reinforcement Learning Framework for Diffusion Large Language Models

Reference 39

Resolution
metadata mismatch
arxiv_id, observed 2026-07-03T01:07:29.846196Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.

source=pdf_text observed=2026-06-27T16:51:04.460958Z digest=sha256:ab3a77f9a899f880c97ebe20e4bcc5a202997422130c1197c8aec4de8e8a0fac

Observation 3cd60031-8723-4cb0-affd-42cf8408f7dd · inbound

Beyond Fully Random Masking: Attention-Guided Denoising and Optimization for Diffusion Language Models cites this paper.

Beyond Fully Random Masking: Attention-Guided Denoising and Optimization for Diffusion Language Models Revolutionizing Reinforcement Learning Framework for Diffusion Large Language Models

Reference 41

Resolution
metadata mismatch
arxiv_id, observed 2026-07-03T11:28:04.415986Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.

source=arxiv_source observed=2026-06-27T09:34:02.484344Z digest=sha256:ea5e69fabfa09e7b280136a7f9b32b966c65350dfa2cc8c2dbe94ee24f32f3f0

Observation b9a99040-ad11-47d1-892a-994b3be35b0b · inbound

VoidPadding: Let [VOID] Handle Padding in Masked Diffusion Language Models so that [EOS] Can Focus on Semantic Termination cites this paper.

VoidPadding: Let [VOID] Handle Padding in Masked Diffusion Language Models so that [EOS] Can Focus on Semantic Termination Revolutionizing Reinforcement Learning Framework for Diffusion Large Language Models

Reference 34

Resolution
metadata mismatch
arxiv_id, observed 2026-07-03T21:18:59.434749Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.

source=arxiv_source observed=2026-06-27T00:42:43.220998Z digest=sha256:e0a4124c67370b60eae615cceeaf23ed28e85ec2e03f9baaab3d1d8dd5dfb842

Observation 62592c28-83d3-4cf7-9bac-dcbd43f62984 · inbound

Learning from the Self-future: On-policy Self-distillation for dLLMs cites this paper.

Learning from the Self-future: On-policy Self-distillation for dLLMs Revolutionizing Reinforcement Learning Framework for Diffusion Large Language Models

Reference 19

Resolution
metadata mismatch
arxiv_id, observed 2026-07-03T20:28:55.657585Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.

source=pdf_text observed=2026-06-27T01:20:14.919054Z digest=sha256:e64fda2c957211de129bbda179b8ad0d1253e0457b9fddb9295aa847ccb038f2

Observation 6de3e9a3-28d4-46cf-8bc3-e0ac677103c8 · inbound

HERALD: High-Throughput Block Diffusion LLM Serving via CPU-GPU Cooperative KV Cache Retrieval cites this paper.

HERALD: High-Throughput Block Diffusion LLM Serving via CPU-GPU Cooperative KV Cache Retrieval Revolutionizing Reinforcement Learning Framework for Diffusion Large Language Models

Reference 42

Resolution
verified exact
arxiv_id, observed 2026-07-04T06:09:37.871132Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.

source=pdf_text observed=2026-06-26T14:44:11.281545Z digest=sha256:c52aebc8e93a583aa6d20d80f9e9ee2f44b9dbfe4e39cae3b6b6fad4aee55949

Observation 0bb9e1f9-9190-4dc1-8486-a5d7db9ce489 · inbound

Diffusion-GR2: Diffusion Generative Reasoning Re-ranker cites this paper.

Diffusion-GR2: Diffusion Generative Reasoning Re-ranker Revolutionizing Reinforcement Learning Framework for Diffusion Large Language Models

Reference 17

Resolution
metadata mismatch
arxiv_id, observed 2026-07-02T06:26:43.627379Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.

source=pdf_text observed=2026-07-02T06:25:02.503822Z digest=sha256:0681c3ab50dd1cdd1dff4fc91b33cee85ff3a18e9c7ab42ab9d2a97dc7e031f1

Observation 75236aba-2ff5-4c7b-a001-513c1cb908a1 · inbound

Diffusion-GR2: Diffusion Generative Reasoning Re-ranker cites this paper.

Diffusion-GR2: Diffusion Generative Reasoning Re-ranker Revolutionizing Reinforcement Learning Framework for Diffusion Large Language Models

Reference 17

Resolution
unresolved
no resolver link, observed 2026-07-12T08:57:54.859566Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-12T08:57:54.859566Z digest=sha256:0ca03cb50d6fba5cec9db01fa7eb2be059fb64492ac91c012aa25f2ee485a39e

Observation 2de102df-3f46-41d4-b9f5-ed8e3a9f5c7b · inbound

Diffusion-GR2: Diffusion Generative Reasoning Re-ranker cites this paper.

Diffusion-GR2: Diffusion Generative Reasoning Re-ranker Revolutionizing Reinforcement Learning Framework for Diffusion Large Language Models

Reference 17

Resolution
unresolved
no resolver link, observed 2026-07-14T16:47:20.534676Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-14T16:47:20.534676Z digest=sha256:2eb8de12feae243462d326eaa76591eb7683cf9ae2bf75fc5565c05e32d4e9e8

Observation 3a5f90f7-0a02-4f5b-87fb-ee8d3ad77b09 · inbound

Spec-AUF: Accept-Until-Fail Training under Train-Inference Misalignment for Masked Block Drafters cites this paper.

Spec-AUF: Accept-Until-Fail Training under Train-Inference Misalignment for Masked Block Drafters Revolutionizing Reinforcement Learning Framework for Diffusion Large Language Models

Reference 15

Resolution
metadata mismatch
arxiv_id, observed 2026-07-03T14:18:22.462915Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.

source=arxiv_source observed=2026-07-03T14:15:49.996586Z digest=sha256:fd85e3a0250cbca8b929318d24e762790fb0c59569935b242606f41efe91e500

Observation 32c74cee-776c-4044-b59d-3d4ef58b3e0f · inbound

Layer-Parallel Inference Reduces Encrypted Nonlinear Depth in Transformers cites this paper.

Layer-Parallel Inference Reduces Encrypted Nonlinear Depth in Transformers Revolutionizing Reinforcement Learning Framework for Diffusion Large Language Models

Reference 30

Resolution
unresolved
no resolver link, observed 2026-07-11T13:03:39.236118Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-11T13:03:39.236118Z digest=sha256:4929bd3e52f4ab679b2ad320b7166f9849a8690a94e747723a03fd8b42a88683

Observation 0dbfbf5d-d8ae-4709-b6ff-7c4c11ad38b7 · inbound

Layer-Parallel Inference Reduces Encrypted Nonlinear Depth in Transformers cites this paper.

Layer-Parallel Inference Reduces Encrypted Nonlinear Depth in Transformers Revolutionizing Reinforcement Learning Framework for Diffusion Large Language Models

Reference 30

Resolution
unresolved
no resolver link, observed 2026-07-14T16:21:05.570023Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-14T16:21:05.570023Z digest=sha256:58ca6173be1000aca289a18b02035bc14fbdbeaf47711b55dbd495c1cb4f48b3

Observation d7c9d9ec-48c9-4d3a-a49b-485c2a6f1130 · inbound

Trace-Based On-Policy Distillation for Masked Diffusion Language Models cites this paper.

Trace-Based On-Policy Distillation for Masked Diffusion Language Models Revolutionizing Reinforcement Learning Framework for Diffusion Large Language Models

Reference 11

Resolution
unresolved
no resolver link, observed 2026-08-01T19:45:10.696984Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-01T19:45:10.696984Z digest=sha256:35139d8a91b434abc28acde4d65c7c86bd7263abd76df774397c7a189eeb8cda

Observation add924f4-5a95-4b2d-a03c-b65f6aa1c66d · inbound

AdaFlash: Adaptive Speculative Decoding via On-Policy Distilled Diffusion Drafters cites this paper.

AdaFlash: Adaptive Speculative Decoding via On-Policy Distilled Diffusion Drafters Revolutionizing Reinforcement Learning Framework for Diffusion Large Language Models

Reference 16

Resolution
unresolved
no resolver link, observed 2026-08-01T13:10:37.517405Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-01T13:10:37.517405Z digest=sha256:9e750b7c623b4ae09eda04b15312abde861deb192e4ced281789c9ba48992198

Observation 2acfa3f7-fa86-4d7b-a71f-e7ace4c56226 · inbound

From Interface to Inference: Eliciting Any-Order Inference from Any-Order Models cites this paper.

From Interface to Inference: Eliciting Any-Order Inference from Any-Order Models Revolutionizing Reinforcement Learning Framework for Diffusion Large Language Models

Reference 38

Resolution
unresolved
no resolver link, observed 2026-08-01T14:25:39.622262Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-01T14:25:39.622262Z digest=sha256:5e0982295c4db7e52478d45a4e634ac66172931e56ed0c61df0642871bec4ee6