{"as_of":"2026-08-03T20:08:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:aecba4409bb562aa4a445e1de31ef1cf8c2ddb7cb121ba2490ad6c5e840d1dd9","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":31,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":31,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-03T06:30:56.289259+00:00","state":"measured"},{"denominator":31,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":31,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T10:09:23.651861Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T06:09:37.869529Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2509.06949","last_updated":"2025-09-08T17:58:06Z","snapshot_observed_at":"2026-07-31T14:27:38.629662Z","submitted_at":"2025-09-08T17:58:06Z","title":"Revolutionizing Reinforcement Learning Framework for Diffusion Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.06949","snapshot_observed_at":"2026-08-03T10:09:23.651861Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.11214","last_updated":"2026-06-03T10:02:48Z","snapshot_observed_at":"2026-08-03T10:09:18.776895Z","submitted_at":"2026-01-16T11:44:12Z","title":"T$^\\star$: Progressive Block Scaling for Masked Diffusion Language Models Through Trajectory Aware Reinforcement Learning","version":5},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-03T10:09:23.651861Z"},"links":{"cited_paper":"/paper/2509.06949","citing_paper":"/paper/2601.11214"},"observation_digest":"sha256:3b6c4cec1cd334118f48e24bf05b7ed1a25f5eb799e7e20bd12e3c7921c37fed","observation_id":"bf21409b-dd4a-47fa-8e82-8af6c646eade","resolution":{"observed_at":"2026-08-03T10:09:23.651861Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.06949","last_updated":"2025-09-08T17:58:06Z","snapshot_observed_at":"2026-07-31T14:27:38.629662Z","submitted_at":"2025-09-08T17:58:06Z","title":"Revolutionizing Reinforcement Learning Framework for Diffusion Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.06949","snapshot_observed_at":"2026-08-03T09:03:21.032525Z","title":"Revolutionizing reinforcement learning framework for diffusion large language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.15165","last_updated":"2026-06-08T15:43:52Z","snapshot_observed_at":"2026-08-03T11:44:38.056149Z","submitted_at":"2026-01-21T16:41:58Z","title":"The Flexibility Trap: Rethinking the Value of Arbitrary Order in Diffusion Language Models","version":4},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-03T09:03:21.032525Z"},"links":{"cited_paper":"/paper/2509.06949","citing_paper":"/paper/2601.15165"},"observation_digest":"sha256:97f57dafebdc1859e4f1c2183ca61dababf9c9d604379580bd64d88f634f5c3c","observation_id":"aac8d34a-7ed5-4678-9637-f856fbdece51","resolution":{"observed_at":"2026-08-03T09:03:21.032525Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.06949","last_updated":"2025-09-08T17:58:06Z","snapshot_observed_at":"2026-07-31T14:27:38.629662Z","submitted_at":"2025-09-08T17:58:06Z","title":"Revolutionizing Reinforcement Learning Framework for Diffusion Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.06949","snapshot_observed_at":"2026-08-03T04:24:06.167099Z","title":"Revolutionizing reinforcement learning framework for diffusion large language models.arXiv preprint arXiv:2509.06949, 2025a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.05305","last_updated":"2026-07-03T13:47:53Z","snapshot_observed_at":"2026-08-03T04:23:59.358369Z","submitted_at":"2026-02-05T04:57:21Z","title":"FlashBlock: Attention Caching for Efficient Long-Context Block Diffusion","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-03T04:24:06.167099Z"},"links":{"cited_paper":"/paper/2509.06949","citing_paper":"/paper/2602.05305"},"observation_digest":"sha256:356a5ce25c67c92cad78bb6c15662db3b1a906ba434c47b30f6da3338a8b93bf","observation_id":"f38b6adf-8604-426a-9c2a-df30ef681b13","resolution":{"observed_at":"2026-08-03T04:24:06.167099Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.06949","last_updated":"2025-09-08T17:58:06Z","snapshot_observed_at":"2026-07-31T14:27:38.629662Z","submitted_at":"2025-09-08T17:58:06Z","title":"Revolutionizing Reinforcement Learning Framework for Diffusion Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.06949","snapshot_observed_at":"2026-08-03T00:05:27.122639Z","title":"Revolutionizing reinforcement learning framework for diffusion large language models.arXiv preprint arXiv:2509.06949,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.11715","last_updated":"2026-06-16T06:09:33Z","snapshot_observed_at":"2026-08-03T14:08:36.735635Z","submitted_at":"2026-02-12T08:45:13Z","title":"DICE: Diffusion Large Language Models Excel at Generating CUDA Kernels","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-03T00:05:27.122639Z"},"links":{"cited_paper":"/paper/2509.06949","citing_paper":"/paper/2602.11715"},"observation_digest":"sha256:1a67aa8e7cbe0d3856660063c110bfe435de051aa97b3f3d57a3ab78ab4db641","observation_id":"f63daa97-6757-4967-94a6-cb94ef78eec6","resolution":{"observed_at":"2026-08-03T00:05:27.122639Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.06949","last_updated":"2025-09-08T17:58:06Z","snapshot_observed_at":"2026-07-31T14:27:38.629662Z","submitted_at":"2025-09-08T17:58:06Z","title":"Revolutionizing Reinforcement Learning Framework for Diffusion Large Language Models","version":1},"cited_work":{"arxiv_id":"2509.06949","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.06949","snapshot_observed_at":"2026-07-04T06:09:37.869529Z","title":"Wu, C., Zhang, H., Xue, S., Diao, S., Fu, Y ., Liu, Z., Molchanov, P., Luo, P., Han, S., and Xie, E","venue":null,"work_id":"78175ece-3ca1-44f9-9ce1-abb99d42868e","year":2025},"citing_paper":{"arxiv_id":"2602.18176","last_updated":"2026-05-22T13:29:19Z","snapshot_observed_at":"2026-07-06T22:46:30.684694Z","submitted_at":"2026-02-20T12:26:03Z","title":"Improving Sampling for Masked Diffusion Models via Information Gain","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-25T07:30:59.831550Z"},"links":{"cited_paper":"/paper/2509.06949","citing_paper":"/paper/2602.18176"},"observation_digest":"sha256:dff9e878283d3c6d478ddeb2306d55a973a5b644aa090584346056d763b4b166","observation_id":"d1841513-5677-477d-bdea-07091b1cae5d","resolution":{"observed_at":"2026-05-25T07:35:29.593174Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.06949","last_updated":"2025-09-08T17:58:06Z","snapshot_observed_at":"2026-07-31T14:27:38.629662Z","submitted_at":"2025-09-08T17:58:06Z","title":"Revolutionizing Reinforcement Learning Framework for Diffusion Large Language Models","version":1},"cited_work":{"arxiv_id":"2509.06949","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.06949","snapshot_observed_at":"2026-07-04T06:09:37.869529Z","title":"Wu, C., Zhang, H., Xue, S., Diao, S., Fu, Y ., Liu, Z., Molchanov, P., Luo, P., Han, S., and Xie, E","venue":null,"work_id":"78175ece-3ca1-44f9-9ce1-abb99d42868e","year":2025},"citing_paper":{"arxiv_id":"2603.22241","last_updated":"2026-04-13T08:19:37Z","snapshot_observed_at":"2026-08-03T01:01:53.602471Z","submitted_at":"2026-03-23T17:39:56Z","title":"MemDLM: Memory-Enhanced DLM Training","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-15T00:42:22.989588Z"},"links":{"cited_paper":"/paper/2509.06949","citing_paper":"/paper/2603.22241"},"observation_digest":"sha256:53458e966c3c3b0b355807f9681cfdf962cfeb59a37906d3db2c849225bd4fc7","observation_id":"8ab909dd-c28a-4395-b2ce-ff9ad4979467","resolution":{"observed_at":"2026-05-15T00:43:24.479970Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.06949","last_updated":"2025-09-08T17:58:06Z","snapshot_observed_at":"2026-07-31T14:27:38.629662Z","submitted_at":"2025-09-08T17:58:06Z","title":"Revolutionizing Reinforcement Learning Framework for Diffusion Large Language Models","version":1},"cited_work":{"arxiv_id":"2509.06949","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.06949","snapshot_observed_at":"2026-07-04T06:09:37.869529Z","title":"Wu, C., Zhang, H., Xue, S., Diao, S., Fu, Y ., Liu, Z., Molchanov, P., Luo, P., Han, S., and Xie, E","venue":null,"work_id":"78175ece-3ca1-44f9-9ce1-abb99d42868e","year":2025},"citing_paper":{"arxiv_id":"2605.09536","last_updated":"2026-05-10T13:38:53Z","snapshot_observed_at":"2026-07-06T23:21:35.327066Z","submitted_at":"2026-05-10T13:38:53Z","title":"TAD: Temporal-Aware Trajectory Self-Distillation for Fast and Accurate Diffusion LLM","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-12T05:01:03.570848Z"},"links":{"cited_paper":"/paper/2509.06949","citing_paper":"/paper/2605.09536"},"observation_digest":"sha256:bc44905f7e1e51826abb5c2d23d674b9451037aa09fbdc138e314d4acfd3bfb3","observation_id":"3562d992-73ec-4496-a18f-477cfc4c09da","resolution":{"observed_at":"2026-05-12T05:46:26.356955Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.06949","last_updated":"2025-09-08T17:58:06Z","snapshot_observed_at":"2026-07-31T14:27:38.629662Z","submitted_at":"2025-09-08T17:58:06Z","title":"Revolutionizing Reinforcement Learning Framework for Diffusion Large Language Models","version":1},"cited_work":{"arxiv_id":"2509.06949","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.06949","snapshot_observed_at":"2026-07-04T06:09:37.869529Z","title":"Wu, C., Zhang, H., Xue, S., Diao, S., Fu, Y ., Liu, Z., Molchanov, P., Luo, P., Han, S., and Xie, E","venue":null,"work_id":"78175ece-3ca1-44f9-9ce1-abb99d42868e","year":2025},"citing_paper":{"arxiv_id":"2605.10218","last_updated":"2026-05-11T08:58:40Z","snapshot_observed_at":"2026-07-06T23:22:13.774652Z","submitted_at":"2026-05-11T08:58:40Z","title":"Relative Score Policy Optimization for Diffusion Language Models","version":1},"reference_index":95,"source":"arxiv_source","source_observed_at":"2026-05-12T03:47:42.196931Z"},"links":{"cited_paper":"/paper/2509.06949","citing_paper":"/paper/2605.10218"},"observation_digest":"sha256:a5263120972ac60f1b5a296a4587935ff5e659984a2cd57808a550b0a6016391","observation_id":"d9e9c51b-a69c-4215-9b40-43c49577bfe8","resolution":{"observed_at":"2026-05-12T06:56:29.492965Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.06949","last_updated":"2025-09-08T17:58:06Z","snapshot_observed_at":"2026-07-31T14:27:38.629662Z","submitted_at":"2025-09-08T17:58:06Z","title":"Revolutionizing Reinforcement Learning Framework for Diffusion Large Language Models","version":1},"cited_work":{"arxiv_id":"2509.06949","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.06949","snapshot_observed_at":"2026-07-04T06:09:37.869529Z","title":"Wu, C., Zhang, H., Xue, S., Diao, S., Fu, Y ., Liu, Z., Molchanov, P., Luo, P., Han, S., and Xie, E","venue":null,"work_id":"78175ece-3ca1-44f9-9ce1-abb99d42868e","year":2025},"citing_paper":{"arxiv_id":"2605.13935","last_updated":"2026-05-13T16:14:46Z","snapshot_observed_at":"2026-07-06T23:25:25.361350Z","submitted_at":"2026-05-13T16:14:46Z","title":"Beyond Mode-Seeking RL: Trajectory-Balance Post-Training for Diffusion Language Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-15T04:59:10.377262Z"},"links":{"cited_paper":"/paper/2509.06949","citing_paper":"/paper/2605.13935"},"observation_digest":"sha256:7582f38cca85978d73a3c54c78c11cde8efc778e2dc40a4b0f264cfc46dfb8d8","observation_id":"dfda3f9e-43ee-47d2-9768-3826aefcf14a","resolution":{"observed_at":"2026-05-15T04:59:45.335288Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.06949","last_updated":"2025-09-08T17:58:06Z","snapshot_observed_at":"2026-07-31T14:27:38.629662Z","submitted_at":"2025-09-08T17:58:06Z","title":"Revolutionizing Reinforcement Learning Framework for Diffusion Large Language Models","version":1},"cited_work":{"arxiv_id":"2509.06949","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.06949","snapshot_observed_at":"2026-07-04T06:09:37.869529Z","title":"Wu, C., Zhang, H., Xue, S., Diao, S., Fu, Y ., Liu, Z., Molchanov, P., Luo, P., Han, S., and Xie, E","venue":null,"work_id":"78175ece-3ca1-44f9-9ce1-abb99d42868e","year":2025},"citing_paper":{"arxiv_id":"2605.16842","last_updated":"2026-05-16T06:59:54Z","snapshot_observed_at":"2026-07-06T23:27:57.805018Z","submitted_at":"2026-05-16T06:59:54Z","title":"Sketch Then Paint: Hierarchical Reinforcement Learning for Diffusion Multi-Modal Large Language Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-19T21:18:03.005508Z"},"links":{"cited_paper":"/paper/2509.06949","citing_paper":"/paper/2605.16842"},"observation_digest":"sha256:8159261e7f07677cce8b63dcc23618eb2b861ca23ca1c12edc00e65d432f93ae","observation_id":"9f028af6-4e13-4f28-b5e5-57169d77a00d","resolution":{"observed_at":"2026-05-19T21:22:48.527344Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.06949","last_updated":"2025-09-08T17:58:06Z","snapshot_observed_at":"2026-07-31T14:27:38.629662Z","submitted_at":"2025-09-08T17:58:06Z","title":"Revolutionizing Reinforcement Learning Framework for Diffusion Large Language Models","version":1},"cited_work":{"arxiv_id":"2509.06949","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.06949","snapshot_observed_at":"2026-07-04T06:09:37.869529Z","title":"Wu, C., Zhang, H., Xue, S., Diao, S., Fu, Y ., Liu, Z., Molchanov, P., Luo, P., Han, S., and Xie, E","venue":null,"work_id":"78175ece-3ca1-44f9-9ce1-abb99d42868e","year":2025},"citing_paper":{"arxiv_id":"2605.17174","last_updated":"2026-05-16T22:18:04Z","snapshot_observed_at":"2026-08-02T13:33:29.826456Z","submitted_at":"2026-05-16T22:18:04Z","title":"Beyond Execution: Static-Analysis Rewards and Hint-Conditioned Diffusion RL for Code Generation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-20T14:03:45.869373Z"},"links":{"cited_paper":"/paper/2509.06949","citing_paper":"/paper/2605.17174"},"observation_digest":"sha256:b571086ef3fa3d557a88f36d5f15fed8a936eeaa27d29a1dd918d2fd6b87ea83","observation_id":"4931ca3e-ecc6-4b60-965e-d6d12050ac79","resolution":{"observed_at":"2026-05-20T14:08:21.253476Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.06949","last_updated":"2025-09-08T17:58:06Z","snapshot_observed_at":"2026-07-31T14:27:38.629662Z","submitted_at":"2025-09-08T17:58:06Z","title":"Revolutionizing Reinforcement Learning Framework for Diffusion Large Language Models","version":1},"cited_work":{"arxiv_id":"2509.06949","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.06949","snapshot_observed_at":"2026-07-04T06:09:37.869529Z","title":"Wu, C., Zhang, H., Xue, S., Diao, S., Fu, Y ., Liu, Z., Molchanov, P., Luo, P., Han, S., and Xie, E","venue":null,"work_id":"78175ece-3ca1-44f9-9ce1-abb99d42868e","year":2025},"citing_paper":{"arxiv_id":"2605.23163","last_updated":"2026-05-25T07:32:46Z","snapshot_observed_at":"2026-08-02T21:34:47.188518Z","submitted_at":"2026-05-22T02:31:32Z","title":"Fast-dDrive: Efficient Block-Diffusion VLM for Autonomous Driving","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-25T05:00:58.024124Z"},"links":{"cited_paper":"/paper/2509.06949","citing_paper":"/paper/2605.23163"},"observation_digest":"sha256:2a39e5d98b77f67190a52f0f921c26abdca21ba804f281235cf8ae2b642685b9","observation_id":"1980fc2b-a08b-45dd-8dd2-795e2127eb22","resolution":{"observed_at":"2026-05-25T05:06:38.500005Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.06949","last_updated":"2025-09-08T17:58:06Z","snapshot_observed_at":"2026-07-31T14:27:38.629662Z","submitted_at":"2025-09-08T17:58:06Z","title":"Revolutionizing Reinforcement Learning Framework for Diffusion Large Language Models","version":1},"cited_work":{"arxiv_id":"2509.06949","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.06949","snapshot_observed_at":"2026-07-04T06:09:37.869529Z","title":"Wu, C., Zhang, H., Xue, S., Diao, S., Fu, Y ., Liu, Z., Molchanov, P., Luo, P., Han, S., and Xie, E","venue":null,"work_id":"78175ece-3ca1-44f9-9ce1-abb99d42868e","year":2025},"citing_paper":{"arxiv_id":"2605.23163","last_updated":"2026-05-25T07:32:46Z","snapshot_observed_at":"2026-08-02T21:34:47.188518Z","submitted_at":"2026-05-22T02:31:32Z","title":"Fast-dDrive: Efficient Block-Diffusion VLM for Autonomous Driving","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-30T16:34:21.422620Z"},"links":{"cited_paper":"/paper/2509.06949","citing_paper":"/paper/2605.23163"},"observation_digest":"sha256:71ac3cf2c2055e6e2bf7b52d2b67e40e99786f43b422905141fe2959aca52ac1","observation_id":"cddd6195-278a-4aed-a8f2-e4f8e212b7d3","resolution":{"observed_at":"2026-06-30T16:35:12.302334Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.06949","last_updated":"2025-09-08T17:58:06Z","snapshot_observed_at":"2026-07-31T14:27:38.629662Z","submitted_at":"2025-09-08T17:58:06Z","title":"Revolutionizing Reinforcement Learning Framework for Diffusion Large Language Models","version":1},"cited_work":{"arxiv_id":"2509.06949","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.06949","snapshot_observed_at":"2026-07-04T06:09:37.869529Z","title":"Wu, C., Zhang, H., Xue, S., Diao, S., Fu, Y ., Liu, Z., Molchanov, P., Luo, P., Han, S., and Xie, E","venue":null,"work_id":"78175ece-3ca1-44f9-9ce1-abb99d42868e","year":2025},"citing_paper":{"arxiv_id":"2605.29398","last_updated":"2026-05-28T05:47:40Z","snapshot_observed_at":"2026-07-06T23:38:51.349968Z","submitted_at":"2026-05-28T05:47:40Z","title":"GDSD: Reinforcement Learning as Guided Denoiser Self-Distillation for Diffusion Language Models","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-06-29T08:44:53.969301Z"},"links":{"cited_paper":"/paper/2509.06949","citing_paper":"/paper/2605.29398"},"observation_digest":"sha256:077bcc7f02672fd34312e14ed21f47a5da4c119a0de3d2903f2424fb0ef7bf02","observation_id":"880e18e9-98e7-4abb-989f-c41f6c372eb3","resolution":{"observed_at":"2026-06-29T08:53:16.365834Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.06949","last_updated":"2025-09-08T17:58:06Z","snapshot_observed_at":"2026-07-31T14:27:38.629662Z","submitted_at":"2025-09-08T17:58:06Z","title":"Revolutionizing Reinforcement Learning Framework for Diffusion Large Language Models","version":1},"cited_work":{"arxiv_id":"2509.06949","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.06949","snapshot_observed_at":"2026-07-04T06:09:37.869529Z","title":"Wu, C., Zhang, H., Xue, S., Diao, S., Fu, Y ., Liu, Z., Molchanov, P., Luo, P., Han, S., and Xie, E","venue":null,"work_id":"78175ece-3ca1-44f9-9ce1-abb99d42868e","year":2025},"citing_paper":{"arxiv_id":"2606.04535","last_updated":"2026-06-03T07:18:23Z","snapshot_observed_at":"2026-07-06T23:44:37.797802Z","submitted_at":"2026-06-03T07:18:23Z","title":"Dynamic Infilling Anchors for Format-Constrained Generation in Diffusion Large Language Models","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-06-28T06:20:27.041099Z"},"links":{"cited_paper":"/paper/2509.06949","citing_paper":"/paper/2606.04535"},"observation_digest":"sha256:cfea4e257eb1dbde4142f6b8305df1de441ba3f1a75c5254298fdb1af19f16ac","observation_id":"811ec5d0-7205-45ae-890d-c281b6f09ed5","resolution":{"observed_at":"2026-07-02T08:06:48.439338Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.06949","last_updated":"2025-09-08T17:58:06Z","snapshot_observed_at":"2026-07-31T14:27:38.629662Z","submitted_at":"2025-09-08T17:58:06Z","title":"Revolutionizing Reinforcement Learning Framework for Diffusion Large Language Models","version":1},"cited_work":{"arxiv_id":"2509.06949","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.06949","snapshot_observed_at":"2026-07-04T06:09:37.869529Z","title":"Wu, C., Zhang, H., Xue, S., Diao, S., Fu, Y ., Liu, Z., Molchanov, P., Luo, P., Han, S., and Xie, E","venue":null,"work_id":"78175ece-3ca1-44f9-9ce1-abb99d42868e","year":2025},"citing_paper":{"arxiv_id":"2606.06712","last_updated":"2026-06-04T20:58:08Z","snapshot_observed_at":"2026-07-06T23:46:28.942186Z","submitted_at":"2026-06-04T20:58:08Z","title":"Data-Efficient Autoregressive-to-Diffusion Language Models via On-Policy Distillation","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-06-28T01:21:52.821813Z"},"links":{"cited_paper":"/paper/2509.06949","citing_paper":"/paper/2606.06712"},"observation_digest":"sha256:faf602859b94aa24e2dc80c6b62c703908bbbde3074df776ceb4a52f4ac58ade","observation_id":"3ad659e2-0aa5-4651-ac0b-b97de6064121","resolution":{"observed_at":"2026-07-02T13:26:58.870004Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.06949","last_updated":"2025-09-08T17:58:06Z","snapshot_observed_at":"2026-07-31T14:27:38.629662Z","submitted_at":"2025-09-08T17:58:06Z","title":"Revolutionizing Reinforcement Learning Framework for Diffusion Large Language Models","version":1},"cited_work":{"arxiv_id":"2509.06949","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.06949","snapshot_observed_at":"2026-07-04T06:09:37.869529Z","title":"Wu, C., Zhang, H., Xue, S., Diao, S., Fu, Y ., Liu, Z., Molchanov, P., Luo, P., Han, S., and Xie, E","venue":null,"work_id":"78175ece-3ca1-44f9-9ce1-abb99d42868e","year":2025},"citing_paper":{"arxiv_id":"2606.08501","last_updated":"2026-06-07T07:59:55Z","snapshot_observed_at":"2026-07-06T23:47:57.376596Z","submitted_at":"2026-06-07T07:59:55Z","title":"Back on Track: Aligning Rewards and States for Reasoning in Diffusion Large Language Models","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-06-27T18:31:21.493677Z"},"links":{"cited_paper":"/paper/2509.06949","citing_paper":"/paper/2606.08501"},"observation_digest":"sha256:1785d7858554861fcef23015abafdab348bb8941c156425cff516828ccea29d5","observation_id":"971d982d-f78e-4362-af0e-ad8f44d0ae51","resolution":{"observed_at":"2026-07-02T22:57:26.565951Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.06949","last_updated":"2025-09-08T17:58:06Z","snapshot_observed_at":"2026-07-31T14:27:38.629662Z","submitted_at":"2025-09-08T17:58:06Z","title":"Revolutionizing Reinforcement Learning Framework for Diffusion Large Language Models","version":1},"cited_work":{"arxiv_id":"2509.06949","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.06949","snapshot_observed_at":"2026-07-04T06:09:37.869529Z","title":"Wu, C., Zhang, H., Xue, S., Diao, S., Fu, Y ., Liu, Z., Molchanov, P., Luo, P., Han, S., and Xie, E","venue":null,"work_id":"78175ece-3ca1-44f9-9ce1-abb99d42868e","year":2025},"citing_paper":{"arxiv_id":"2606.09159","last_updated":"2026-06-08T07:50:12Z","snapshot_observed_at":"2026-07-06T23:48:35.190418Z","submitted_at":"2026-06-08T07:50:12Z","title":"Unified Energy for Invariant and Independent Decoding in Diffusion Language Models","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-06-27T16:51:04.460958Z"},"links":{"cited_paper":"/paper/2509.06949","citing_paper":"/paper/2606.09159"},"observation_digest":"sha256:ab3a77f9a899f880c97ebe20e4bcc5a202997422130c1197c8aec4de8e8a0fac","observation_id":"fdc14c71-1bd0-4457-993a-67d7a2af8218","resolution":{"observed_at":"2026-07-03T01:07:29.846196Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.06949","last_updated":"2025-09-08T17:58:06Z","snapshot_observed_at":"2026-07-31T14:27:38.629662Z","submitted_at":"2025-09-08T17:58:06Z","title":"Revolutionizing Reinforcement Learning Framework for Diffusion Large Language Models","version":1},"cited_work":{"arxiv_id":"2509.06949","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.06949","snapshot_observed_at":"2026-07-04T06:09:37.869529Z","title":"Wu, C., Zhang, H., Xue, S., Diao, S., Fu, Y ., Liu, Z., Molchanov, P., Luo, P., Han, S., and Xie, E","venue":null,"work_id":"78175ece-3ca1-44f9-9ce1-abb99d42868e","year":2025},"citing_paper":{"arxiv_id":"2606.12273","last_updated":"2026-06-10T16:14:23Z","snapshot_observed_at":"2026-07-06T23:51:13.191639Z","submitted_at":"2026-06-10T16:14:23Z","title":"Beyond Fully Random Masking: Attention-Guided Denoising and Optimization for Diffusion Language Models","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-06-27T09:34:02.484344Z"},"links":{"cited_paper":"/paper/2509.06949","citing_paper":"/paper/2606.12273"},"observation_digest":"sha256:ea5e69fabfa09e7b280136a7f9b32b966c65350dfa2cc8c2dbe94ee24f32f3f0","observation_id":"3cd60031-8723-4cb0-affd-42cf8408f7dd","resolution":{"observed_at":"2026-07-03T11:28:04.415986Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.06949","last_updated":"2025-09-08T17:58:06Z","snapshot_observed_at":"2026-07-31T14:27:38.629662Z","submitted_at":"2025-09-08T17:58:06Z","title":"Revolutionizing Reinforcement Learning Framework for Diffusion Large Language Models","version":1},"cited_work":{"arxiv_id":"2509.06949","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.06949","snapshot_observed_at":"2026-07-04T06:09:37.869529Z","title":"Wu, C., Zhang, H., Xue, S., Diao, S., Fu, Y ., Liu, Z., Molchanov, P., Luo, P., Han, S., and Xie, E","venue":null,"work_id":"78175ece-3ca1-44f9-9ce1-abb99d42868e","year":2025},"citing_paper":{"arxiv_id":"2606.17999","last_updated":"2026-06-22T14:15:54Z","snapshot_observed_at":"2026-07-06T23:53:30.953084Z","submitted_at":"2026-06-16T14:46:53Z","title":"VoidPadding: Let [VOID] Handle Padding in Masked Diffusion Language Models so that [EOS] Can Focus on Semantic Termination","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-06-27T00:42:43.220998Z"},"links":{"cited_paper":"/paper/2509.06949","citing_paper":"/paper/2606.17999"},"observation_digest":"sha256:e0a4124c67370b60eae615cceeaf23ed28e85ec2e03f9baaab3d1d8dd5dfb842","observation_id":"b9a99040-ad11-47d1-892a-994b3be35b0b","resolution":{"observed_at":"2026-07-03T21:18:59.434749Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.06949","last_updated":"2025-09-08T17:58:06Z","snapshot_observed_at":"2026-07-31T14:27:38.629662Z","submitted_at":"2025-09-08T17:58:06Z","title":"Revolutionizing Reinforcement Learning Framework for Diffusion Large Language Models","version":1},"cited_work":{"arxiv_id":"2509.06949","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.06949","snapshot_observed_at":"2026-07-04T06:09:37.869529Z","title":"Wu, C., Zhang, H., Xue, S., Diao, S., Fu, Y ., Liu, Z., Molchanov, P., Luo, P., Han, S., and Xie, E","venue":null,"work_id":"78175ece-3ca1-44f9-9ce1-abb99d42868e","year":2025},"citing_paper":{"arxiv_id":"2606.18195","last_updated":"2026-06-25T16:08:43Z","snapshot_observed_at":"2026-07-06T23:53:40.698123Z","submitted_at":"2026-06-16T17:24:57Z","title":"Learning from the Self-future: On-policy Self-distillation for dLLMs","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-27T01:20:14.919054Z"},"links":{"cited_paper":"/paper/2509.06949","citing_paper":"/paper/2606.18195"},"observation_digest":"sha256:e64fda2c957211de129bbda179b8ad0d1253e0457b9fddb9295aa847ccb038f2","observation_id":"62592c28-83d3-4cf7-9bac-dcbd43f62984","resolution":{"observed_at":"2026-07-03T20:28:55.657585Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.06949","last_updated":"2025-09-08T17:58:06Z","snapshot_observed_at":"2026-07-31T14:27:38.629662Z","submitted_at":"2025-09-08T17:58:06Z","title":"Revolutionizing Reinforcement Learning Framework for Diffusion Large Language Models","version":1},"cited_work":{"arxiv_id":"2509.06949","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.06949","snapshot_observed_at":"2026-07-04T06:09:37.869529Z","title":"Wu, C., Zhang, H., Xue, S., Diao, S., Fu, Y ., Liu, Z., Molchanov, P., Luo, P., Han, S., and Xie, E","venue":null,"work_id":"78175ece-3ca1-44f9-9ce1-abb99d42868e","year":2025},"citing_paper":{"arxiv_id":"2606.21633","last_updated":"2026-06-19T17:36:51Z","snapshot_observed_at":"2026-08-02T15:49:31.773129Z","submitted_at":"2026-06-19T17:36:51Z","title":"HERALD: High-Throughput Block Diffusion LLM Serving via CPU-GPU Cooperative KV Cache Retrieval","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-06-26T14:44:11.281545Z"},"links":{"cited_paper":"/paper/2509.06949","citing_paper":"/paper/2606.21633"},"observation_digest":"sha256:c52aebc8e93a583aa6d20d80f9e9ee2f44b9dbfe4e39cae3b6b6fad4aee55949","observation_id":"6de3e9a3-28d4-46cf-8bc3-e0ac677103c8","resolution":{"observed_at":"2026-07-04T06:09:37.871132Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.06949","last_updated":"2025-09-08T17:58:06Z","snapshot_observed_at":"2026-07-31T14:27:38.629662Z","submitted_at":"2025-09-08T17:58:06Z","title":"Revolutionizing Reinforcement Learning Framework for Diffusion Large Language Models","version":1},"cited_work":{"arxiv_id":"2509.06949","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.06949","snapshot_observed_at":"2026-07-04T06:09:37.869529Z","title":"Wu, C., Zhang, H., Xue, S., Diao, S., Fu, Y ., Liu, Z., Molchanov, P., Luo, P., Han, S., and Xie, E","venue":null,"work_id":"78175ece-3ca1-44f9-9ce1-abb99d42868e","year":2025},"citing_paper":{"arxiv_id":"2607.01170","last_updated":"2026-07-12T23:41:53Z","snapshot_observed_at":"2026-07-16T23:18:46.944047Z","submitted_at":"2026-07-01T17:02:20Z","title":"Diffusion-GR2: Diffusion Generative Reasoning Re-ranker","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-02T06:25:02.503822Z"},"links":{"cited_paper":"/paper/2509.06949","citing_paper":"/paper/2607.01170"},"observation_digest":"sha256:0681c3ab50dd1cdd1dff4fc91b33cee85ff3a18e9c7ab42ab9d2a97dc7e031f1","observation_id":"0bb9e1f9-9190-4dc1-8486-a5d7db9ce489","resolution":{"observed_at":"2026-07-02T06:26:43.627379Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.06949","last_updated":"2025-09-08T17:58:06Z","snapshot_observed_at":"2026-07-31T14:27:38.629662Z","submitted_at":"2025-09-08T17:58:06Z","title":"Revolutionizing Reinforcement Learning Framework for Diffusion Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.06949","snapshot_observed_at":"2026-07-12T08:57:54.859566Z","title":"Revolutionizing reinforcement learning framework for diffusion large language models.arXiv preprint arXiv:2509.06949,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.01170","last_updated":"2026-07-12T23:41:53Z","snapshot_observed_at":"2026-07-16T23:18:46.944047Z","submitted_at":"2026-07-01T17:02:20Z","title":"Diffusion-GR2: Diffusion Generative Reasoning Re-ranker","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-12T08:57:54.859566Z"},"links":{"cited_paper":"/paper/2509.06949","citing_paper":"/paper/2607.01170"},"observation_digest":"sha256:0ca03cb50d6fba5cec9db01fa7eb2be059fb64492ac91c012aa25f2ee485a39e","observation_id":"75236aba-2ff5-4c7b-a001-513c1cb908a1","resolution":{"observed_at":"2026-07-12T08:57:54.859566Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.06949","last_updated":"2025-09-08T17:58:06Z","snapshot_observed_at":"2026-07-31T14:27:38.629662Z","submitted_at":"2025-09-08T17:58:06Z","title":"Revolutionizing Reinforcement Learning Framework for Diffusion Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.06949","snapshot_observed_at":"2026-07-14T16:47:20.534676Z","title":"Revolutionizing reinforcement learning framework for diffusion large language models.arXiv preprint arXiv:2509.06949,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.01170","last_updated":"2026-07-12T23:41:53Z","snapshot_observed_at":"2026-07-16T23:18:46.944047Z","submitted_at":"2026-07-01T17:02:20Z","title":"Diffusion-GR2: Diffusion Generative Reasoning Re-ranker","version":4},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-14T16:47:20.534676Z"},"links":{"cited_paper":"/paper/2509.06949","citing_paper":"/paper/2607.01170"},"observation_digest":"sha256:2eb8de12feae243462d326eaa76591eb7683cf9ae2bf75fc5565c05e32d4e9e8","observation_id":"2de102df-3f46-41d4-b9f5-ed8e3a9f5c7b","resolution":{"observed_at":"2026-07-14T16:47:20.534676Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.06949","last_updated":"2025-09-08T17:58:06Z","snapshot_observed_at":"2026-07-31T14:27:38.629662Z","submitted_at":"2025-09-08T17:58:06Z","title":"Revolutionizing Reinforcement Learning Framework for Diffusion Large Language Models","version":1},"cited_work":{"arxiv_id":"2509.06949","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.06949","snapshot_observed_at":"2026-07-04T06:09:37.869529Z","title":"Wu, C., Zhang, H., Xue, S., Diao, S., Fu, Y ., Liu, Z., Molchanov, P., Luo, P., Han, S., and Xie, E","venue":null,"work_id":"78175ece-3ca1-44f9-9ce1-abb99d42868e","year":2025},"citing_paper":{"arxiv_id":"2607.01893","last_updated":"2026-07-02T08:44:04Z","snapshot_observed_at":"2026-07-07T00:07:23.664493Z","submitted_at":"2026-07-02T08:44:04Z","title":"Spec-AUF: Accept-Until-Fail Training under Train-Inference Misalignment for Masked Block Drafters","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-07-03T14:15:49.996586Z"},"links":{"cited_paper":"/paper/2509.06949","citing_paper":"/paper/2607.01893"},"observation_digest":"sha256:fd85e3a0250cbca8b929318d24e762790fb0c59569935b242606f41efe91e500","observation_id":"3a5f90f7-0a02-4f5b-87fb-ee8d3ad77b09","resolution":{"observed_at":"2026-07-03T14:18:22.462915Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.06949","last_updated":"2025-09-08T17:58:06Z","snapshot_observed_at":"2026-07-31T14:27:38.629662Z","submitted_at":"2025-09-08T17:58:06Z","title":"Revolutionizing Reinforcement Learning Framework for Diffusion Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.06949","snapshot_observed_at":"2026-07-11T13:03:39.236118Z","title":"arXiv preprint arXiv:2509.06949 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04819","last_updated":"2026-07-13T09:12:14Z","snapshot_observed_at":"2026-07-16T23:19:39.775078Z","submitted_at":"2026-07-06T08:51:22Z","title":"Layer-Parallel Inference Reduces Encrypted Nonlinear Depth in Transformers","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-07-11T13:03:39.236118Z"},"links":{"cited_paper":"/paper/2509.06949","citing_paper":"/paper/2607.04819"},"observation_digest":"sha256:4929bd3e52f4ab679b2ad320b7166f9849a8690a94e747723a03fd8b42a88683","observation_id":"32c74cee-776c-4044-b59d-3d4ef58b3e0f","resolution":{"observed_at":"2026-07-11T13:03:39.236118Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.06949","last_updated":"2025-09-08T17:58:06Z","snapshot_observed_at":"2026-07-31T14:27:38.629662Z","submitted_at":"2025-09-08T17:58:06Z","title":"Revolutionizing Reinforcement Learning Framework for Diffusion Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.06949","snapshot_observed_at":"2026-07-14T16:21:05.570023Z","title":"arXiv preprint arXiv:2509.06949 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04819","last_updated":"2026-07-13T09:12:14Z","snapshot_observed_at":"2026-07-16T23:19:39.775078Z","submitted_at":"2026-07-06T08:51:22Z","title":"Layer-Parallel Inference Reduces Encrypted Nonlinear Depth in Transformers","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-07-14T16:21:05.570023Z"},"links":{"cited_paper":"/paper/2509.06949","citing_paper":"/paper/2607.04819"},"observation_digest":"sha256:58ca6173be1000aca289a18b02035bc14fbdbeaf47711b55dbd495c1cb4f48b3","observation_id":"0dbfbf5d-d8ae-4709-b6ff-7c4c11ad38b7","resolution":{"observed_at":"2026-07-14T16:21:05.570023Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.06949","last_updated":"2025-09-08T17:58:06Z","snapshot_observed_at":"2026-07-31T14:27:38.629662Z","submitted_at":"2025-09-08T17:58:06Z","title":"Revolutionizing Reinforcement Learning Framework for Diffusion Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.06949","snapshot_observed_at":"2026-08-01T19:45:10.696984Z","title":"arXiv preprint arXiv:2509.06949 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16872","last_updated":"2026-07-18T16:25:17Z","snapshot_observed_at":"2026-08-03T19:25:46.633433Z","submitted_at":"2026-07-18T16:25:17Z","title":"Trace-Based On-Policy Distillation for Masked Diffusion Language Models","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-01T19:45:10.696984Z"},"links":{"cited_paper":"/paper/2509.06949","citing_paper":"/paper/2607.16872"},"observation_digest":"sha256:6ee7cc218902c089afcfbcd1e6de79af06c8e3323e9c457fb0b836bbddd40eb0","observation_id":"d7c9d9ec-48c9-4d3a-a49b-485c2a6f1130","resolution":{"observed_at":"2026-08-01T19:45:10.696984Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.06949","last_updated":"2025-09-08T17:58:06Z","snapshot_observed_at":"2026-07-31T14:27:38.629662Z","submitted_at":"2025-09-08T17:58:06Z","title":"Revolutionizing Reinforcement Learning Framework for Diffusion Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.06949","snapshot_observed_at":"2026-08-01T13:10:37.517405Z","title":"Revolutionizing reinforce- ment learning framework for diffusion large language models.ArXiv preprint, arXiv:2509.06949,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19223","last_updated":"2026-07-21T15:52:50Z","snapshot_observed_at":"2026-08-01T13:10:35.664738Z","submitted_at":"2026-07-21T15:52:50Z","title":"AdaFlash: Adaptive Speculative Decoding via On-Policy Distilled Diffusion Drafters","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-01T13:10:37.517405Z"},"links":{"cited_paper":"/paper/2509.06949","citing_paper":"/paper/2607.19223"},"observation_digest":"sha256:9e750b7c623b4ae09eda04b15312abde861deb192e4ced281789c9ba48992198","observation_id":"add924f4-5a95-4b2d-a03c-b65f6aa1c66d","resolution":{"observed_at":"2026-08-01T13:10:37.517405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.06949","last_updated":"2025-09-08T17:58:06Z","snapshot_observed_at":"2026-07-31T14:27:38.629662Z","submitted_at":"2025-09-08T17:58:06Z","title":"Revolutionizing Reinforcement Learning Framework for Diffusion Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.06949","snapshot_observed_at":"2026-08-01T14:25:39.622262Z","title":"arXiv preprint arXiv:2509.06949 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26504","last_updated":"2026-07-29T06:09:12Z","snapshot_observed_at":"2026-08-01T23:25:48.326706Z","submitted_at":"2026-07-29T06:09:12Z","title":"From Interface to Inference: Eliciting Any-Order Inference from Any-Order Models","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-01T14:25:39.622262Z"},"links":{"cited_paper":"/paper/2509.06949","citing_paper":"/paper/2607.26504"},"observation_digest":"sha256:5e0982295c4db7e52478d45a4e634ac66172931e56ed0c61df0642871bec4ee6","observation_id":"2acfa3f7-fa86-4d7b-a71f-e7ace4c56226","resolution":{"observed_at":"2026-08-01T14:25:39.622262Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2509.06949/citation-record","integrity":"/paper/2509.06949/integrity","json":"/paper/2509.06949/citation-record.json","paper":"/paper/2509.06949"},"outbound":[],"paper":{"arxiv_id":"2509.06949","last_updated":"2025-09-08T17:58:06Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-07-31T14:27:38.629662Z","submitted_at":"2025-09-08T17:58:06Z","title":"Revolutionizing Reinforcement Learning Framework for Diffusion Large Language Models"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"thesis":"As of 3 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 31 inbound Pith citation observations for arXiv:2509.06949."}