{"as_of":"2026-08-05T11:01:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:8c6946c9675295611e49a0b4d997f20ea98d4eadaf208825942d234f4ffa2fad","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":50,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":50,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-05T06:32:48.257954+00:00","state":"measured"},{"denominator":50,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":50,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T10:24:24.060171Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"pith","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"pith"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.15781","last_updated":"2025-05-21T17:32:10Z","snapshot_observed_at":"2026-08-01T20:24:14.008213Z","submitted_at":"2025-05-21T17:32:10Z","title":"dKV-Cache: The Cache for Diffusion Language Models","version":1},"cited_work":{"arxiv_id":"2505.15781","doi":"10.48550/arxiv.2505.15781","metadata_source":"pith","pith_arxiv_id":"2505.15781","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"dkv-cache: The cache for diffusion language models","venue":"cs.CL","work_id":"8bba2afd-bafd-4ccb-af6d-58855e9f3967","year":2025},"citing_paper":{"arxiv_id":"2505.23606","last_updated":"2026-04-13T07:14:16Z","snapshot_observed_at":"2026-07-06T21:33:02.686798Z","submitted_at":"2025-05-29T16:15:48Z","title":"Muddit: Liberating Generation Beyond Text-to-Image with a Unified Discrete Diffusion Model","version":4},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-19T12:59:31.454155Z"},"links":{"cited_paper":"/paper/2505.15781","citing_paper":"/paper/2505.23606"},"observation_digest":"sha256:530efe1a91bcb866d2188b9679c3356cd7ee0484cfa759cf8a413e1f19ac2dc2","observation_id":"7d907a1e-04fc-48a9-8eb6-d0aa13ecf1c9","resolution":{"observed_at":"2026-05-19T13:02:18.398850Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.15781","last_updated":"2025-05-21T17:32:10Z","snapshot_observed_at":"2026-08-01T20:24:14.008213Z","submitted_at":"2025-05-21T17:32:10Z","title":"dKV-Cache: The Cache for Diffusion Language Models","version":1},"cited_work":{"arxiv_id":"2505.15781","doi":"10.48550/arxiv.2505.15781","metadata_source":"pith","pith_arxiv_id":"2505.15781","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"dkv-cache: The cache for diffusion language models","venue":"cs.CL","work_id":"8bba2afd-bafd-4ccb-af6d-58855e9f3967","year":2025},"citing_paper":{"arxiv_id":"2508.19982","last_updated":"2026-04-09T08:29:43Z","snapshot_observed_at":"2026-08-02T21:00:22.153828Z","submitted_at":"2025-08-27T15:40:25Z","title":"Diffusion Language Models Know the Answer Before Decoding","version":5},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-18T20:30:58.012632Z"},"links":{"cited_paper":"/paper/2505.15781","citing_paper":"/paper/2508.19982"},"observation_digest":"sha256:f62c0179b4624c6315305536928d84196714c3a91dc333c1959300c27dd47e5e","observation_id":"f8941ab3-2b1b-4ce5-a71c-4434fa74b735","resolution":{"observed_at":"2026-05-18T20:31:50.415030Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.15781","last_updated":"2025-05-21T17:32:10Z","snapshot_observed_at":"2026-08-01T20:24:14.008213Z","submitted_at":"2025-05-21T17:32:10Z","title":"dKV-Cache: The Cache for Diffusion Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.15781","snapshot_observed_at":"2026-08-05T10:24:24.060171Z","title":"dkv-cache: The cache for diffusion language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.04185","last_updated":"2025-09-04T13:02:39Z","snapshot_observed_at":"2026-08-05T10:24:22.676474Z","submitted_at":"2025-09-04T13:02:39Z","title":"Set Block Decoding is a Language Model Inference Accelerator","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-05T10:24:24.060171Z"},"links":{"cited_paper":"/paper/2505.15781","citing_paper":"/paper/2509.04185"},"observation_digest":"sha256:e5470662e0d8150ac48817fcc096d68930f692cb94858478b3eb4a4c5e41c9a3","observation_id":"cfd3a2b9-906e-428f-bfa2-e351a926b3e9","resolution":{"observed_at":"2026-08-05T10:24:24.060171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.15781","last_updated":"2025-05-21T17:32:10Z","snapshot_observed_at":"2026-08-01T20:24:14.008213Z","submitted_at":"2025-05-21T17:32:10Z","title":"dKV-Cache: The Cache for Diffusion Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.15781","snapshot_observed_at":"2026-08-04T22:56:05.212046Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.06949","last_updated":"2025-09-08T17:58:06Z","snapshot_observed_at":"2026-08-04T22:56:04.053052Z","submitted_at":"2025-09-08T17:58:06Z","title":"Revolutionizing Reinforcement Learning Framework for Diffusion Large Language Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-04T22:56:05.212046Z"},"links":{"cited_paper":"/paper/2505.15781","citing_paper":"/paper/2509.06949"},"observation_digest":"sha256:5bf402ce764a7e34d8cf98415e9d6b063e688c02dc362981f90f532b8411d813","observation_id":"713aadc2-9b0a-4e00-9321-87bea02c3a44","resolution":{"observed_at":"2026-08-04T22:56:05.212046Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.15781","last_updated":"2025-05-21T17:32:10Z","snapshot_observed_at":"2026-08-01T20:24:14.008213Z","submitted_at":"2025-05-21T17:32:10Z","title":"dKV-Cache: The Cache for Diffusion Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.15781","snapshot_observed_at":"2026-08-04T17:57:47.001151Z","title":"dkv-cache: The cache for diffusion language models, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.10396","last_updated":"2025-09-12T16:44:31Z","snapshot_observed_at":"2026-08-04T17:57:38.684690Z","submitted_at":"2025-09-12T16:44:31Z","title":"Inpainting-Guided Policy Optimization for Diffusion Large Language Models","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-04T17:57:47.001151Z"},"links":{"cited_paper":"/paper/2505.15781","citing_paper":"/paper/2509.10396"},"observation_digest":"sha256:c55bc7c684a3d11768ee51ed1ec9513b8ef5c0eb42d94df3bd755cd9f4586526","observation_id":"5164ca18-0a62-4bca-95d6-e41445003700","resolution":{"observed_at":"2026-08-04T17:57:47.001151Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.15781","last_updated":"2025-05-21T17:32:10Z","snapshot_observed_at":"2026-08-01T20:24:14.008213Z","submitted_at":"2025-05-21T17:32:10Z","title":"dKV-Cache: The Cache for Diffusion Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.15781","snapshot_observed_at":"2026-08-04T16:07:02.053450Z","title":"dkv-cache: The cache for diffusion language models.arXiv preprint arXiv:2505.15781,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.16518","last_updated":"2026-06-04T19:42:40Z","snapshot_observed_at":"2026-08-04T16:06:57.570070Z","submitted_at":"2025-09-20T03:48:32Z","title":"FG-Attn: Leveraging Fine-Grained Sparse Attention in Video Diffusion Models","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-04T16:07:02.053450Z"},"links":{"cited_paper":"/paper/2505.15781","citing_paper":"/paper/2509.16518"},"observation_digest":"sha256:277ba4f9c48106cd93acf0a8df3079072e341e6da65a28688c5f4366cf45f913","observation_id":"ada3d51b-d88f-4f0c-9efb-4ee388a51dee","resolution":{"observed_at":"2026-08-04T16:07:02.053450Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.15781","last_updated":"2025-05-21T17:32:10Z","snapshot_observed_at":"2026-08-01T20:24:14.008213Z","submitted_at":"2025-05-21T17:32:10Z","title":"dKV-Cache: The Cache for Diffusion Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.15781","snapshot_observed_at":"2026-08-04T15:58:14.912908Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.18085","last_updated":"2026-06-11T00:26:51Z","snapshot_observed_at":"2026-08-04T15:57:57.655593Z","submitted_at":"2025-09-22T17:58:21Z","title":"Structuring The Future: Diffusion LLM Speculative Decoding via Calibrated Draft Graphs","version":4},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-04T15:58:14.912908Z"},"links":{"cited_paper":"/paper/2505.15781","citing_paper":"/paper/2509.18085"},"observation_digest":"sha256:0c2d3802a5965fa26cfb97525a255d271196f8fcb80b769d9c3b245248f9cad9","observation_id":"3c195442-0851-4953-9a58-2faf33441f1d","resolution":{"observed_at":"2026-08-04T15:58:14.912908Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.15781","last_updated":"2025-05-21T17:32:10Z","snapshot_observed_at":"2026-08-01T20:24:14.008213Z","submitted_at":"2025-05-21T17:32:10Z","title":"dKV-Cache: The Cache for Diffusion Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.15781","snapshot_observed_at":"2026-08-04T11:38:52.560659Z","title":"dkv-cache: The cache for diffusion language models, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.04019","last_updated":"2026-07-23T05:31:21Z","snapshot_observed_at":"2026-08-04T11:38:49.212104Z","submitted_at":"2025-10-05T03:53:16Z","title":"Simple Policy Gradients for Reasoning with Diffusion Language Models","version":3},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-04T11:38:52.560659Z"},"links":{"cited_paper":"/paper/2505.15781","citing_paper":"/paper/2510.04019"},"observation_digest":"sha256:464b0007b4c597bc02411f4133789b4fcfa35451230110aca4fbd4e61b4c4828","observation_id":"20102168-ea77-4daf-aa1d-3256cd232747","resolution":{"observed_at":"2026-08-04T11:38:52.560659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.15781","last_updated":"2025-05-21T17:32:10Z","snapshot_observed_at":"2026-08-01T20:24:14.008213Z","submitted_at":"2025-05-21T17:32:10Z","title":"dKV-Cache: The Cache for Diffusion Language Models","version":1},"cited_work":{"arxiv_id":"2505.15781","doi":"10.48550/arxiv.2505.15781","metadata_source":"pith","pith_arxiv_id":"2505.15781","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"dkv-cache: The cache for diffusion language models","venue":"cs.CL","work_id":"8bba2afd-bafd-4ccb-af6d-58855e9f3967","year":2025},"citing_paper":{"arxiv_id":"2510.04525","last_updated":"2025-10-31T05:31:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-10-06T06:30:22Z","title":"Demystifying MaskGIT Sampler and Beyond: Adaptive Order Selection in Masked Diffusion","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-18T10:06:40.530902Z"},"links":{"cited_paper":"/paper/2505.15781","citing_paper":"/paper/2510.04525"},"observation_digest":"sha256:38c0fd1a66d623ab328af760d0cc9d9ac951df5c623034754aced10d92013eee","observation_id":"331f9718-0159-4aa8-862a-5a2cbbbdd361","resolution":{"observed_at":"2026-05-18T10:11:14.611613Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.15781","last_updated":"2025-05-21T17:32:10Z","snapshot_observed_at":"2026-08-01T20:24:14.008213Z","submitted_at":"2025-05-21T17:32:10Z","title":"dKV-Cache: The Cache for Diffusion Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.15781","snapshot_observed_at":"2026-08-03T21:31:34.904750Z","title":"dkv-cache: The cache for diffusion language models.arXiv preprint arXiv:2505.15781, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2511.15098","last_updated":"2026-06-21T15:38:16Z","snapshot_observed_at":"2026-08-03T21:31:33.690337Z","submitted_at":"2025-11-19T04:13:36Z","title":"A Comprehensive Study on Visual Token Redundancy for Discrete Diffusion-based Multimodal Large Language Models","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-03T21:31:34.904750Z"},"links":{"cited_paper":"/paper/2505.15781","citing_paper":"/paper/2511.15098"},"observation_digest":"sha256:4dd570308b5174e264b4f1fbb14d6c51558d7ae1f3637177172b3b728db59821","observation_id":"299cd264-8b51-4e98-bfba-b468464c6992","resolution":{"observed_at":"2026-08-03T21:31:34.904750Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.15781","last_updated":"2025-05-21T17:32:10Z","snapshot_observed_at":"2026-08-01T20:24:14.008213Z","submitted_at":"2025-05-21T17:32:10Z","title":"dKV-Cache: The Cache for Diffusion Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.15781","snapshot_observed_at":"2026-08-03T21:20:35.469650Z","title":"dkv-cache: The cache for diffusion language models.arXiv preprint arXiv:2505.15781,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2511.15927","last_updated":"2026-07-17T11:40:17Z","snapshot_observed_at":"2026-08-03T21:20:33.021179Z","submitted_at":"2025-11-19T23:23:49Z","title":"DiffuMamba: High-Throughput Diffusion LMs with Mamba Backbone","version":4},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-03T21:20:35.469650Z"},"links":{"cited_paper":"/paper/2505.15781","citing_paper":"/paper/2511.15927"},"observation_digest":"sha256:694441ee28414f55b672fcd12b4c41fa4fe1ddae7d59149b92859149396b8b9f","observation_id":"9493dd07-a51c-4254-85f7-ecb47e6eecdb","resolution":{"observed_at":"2026-08-03T21:20:35.469650Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.15781","last_updated":"2025-05-21T17:32:10Z","snapshot_observed_at":"2026-08-01T20:24:14.008213Z","submitted_at":"2025-05-21T17:32:10Z","title":"dKV-Cache: The Cache for Diffusion Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.15781","snapshot_observed_at":"2026-08-03T16:21:35.294723Z","title":"dkv-cache: The cache for diffusion language models.arXiv preprint arXiv:2505.15781, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.14008","last_updated":"2026-07-15T22:52:21Z","snapshot_observed_at":"2026-08-04T04:44:58.323566Z","submitted_at":"2025-12-16T02:06:06Z","title":"Sparse-LaViDa: Sparse Multimodal Discrete Diffusion Language Models","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-03T16:21:35.294723Z"},"links":{"cited_paper":"/paper/2505.15781","citing_paper":"/paper/2512.14008"},"observation_digest":"sha256:730b6703bf299511b6ffceefc5de44259436064cf2262b41f04aa73edd57ace9","observation_id":"c1cad497-ab5f-4dac-90b2-9ee8ba46a4b2","resolution":{"observed_at":"2026-08-03T16:21:35.294723Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.15781","last_updated":"2025-05-21T17:32:10Z","snapshot_observed_at":"2026-08-01T20:24:14.008213Z","submitted_at":"2025-05-21T17:32:10Z","title":"dKV-Cache: The Cache for Diffusion Language Models","version":1},"cited_work":{"arxiv_id":"2505.15781","doi":"10.48550/arxiv.2505.15781","metadata_source":"pith","pith_arxiv_id":"2505.15781","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"dkv-cache: The cache for diffusion language models","venue":"cs.CL","work_id":"8bba2afd-bafd-4ccb-af6d-58855e9f3967","year":2025},"citing_paper":{"arxiv_id":"2512.14067","last_updated":"2026-04-29T20:52:08Z","snapshot_observed_at":"2026-07-06T22:39:08.850289Z","submitted_at":"2025-12-16T04:12:17Z","title":"Efficient-DLM: From Autoregressive to Diffusion Language Models, and Beyond in Speed","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-16T22:29:08.669964Z"},"links":{"cited_paper":"/paper/2505.15781","citing_paper":"/paper/2512.14067"},"observation_digest":"sha256:be527e3044db3aa5687a359cf288ecd70c0ce64c924b6ac1040eb311613d85cc","observation_id":"6c029df7-316a-4645-b054-41d5d7ef96b2","resolution":{"observed_at":"2026-05-16T22:31:19.277458Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.15781","last_updated":"2025-05-21T17:32:10Z","snapshot_observed_at":"2026-08-01T20:24:14.008213Z","submitted_at":"2025-05-21T17:32:10Z","title":"dKV-Cache: The Cache for Diffusion Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.15781","snapshot_observed_at":"2026-08-03T04:24:05.894101Z","title":"dkv-cache: The cache for diffusion language models.arXiv preprint arXiv:2505.15781,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.05305","last_updated":"2026-07-03T13:47:53Z","snapshot_observed_at":"2026-08-03T20:15:43.778141Z","submitted_at":"2026-02-05T04:57:21Z","title":"FlashBlock: Attention Caching for Efficient Long-Context Block Diffusion","version":3},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-03T04:24:05.894101Z"},"links":{"cited_paper":"/paper/2505.15781","citing_paper":"/paper/2602.05305"},"observation_digest":"sha256:acbcc540a85b641e83b9ff8a7fed5a722b52753a69d4acad862d634a9a8b4aec","observation_id":"adf646da-4de1-4373-8851-da2335f752ce","resolution":{"observed_at":"2026-08-03T04:24:05.894101Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.15781","last_updated":"2025-05-21T17:32:10Z","snapshot_observed_at":"2026-08-01T20:24:14.008213Z","submitted_at":"2025-05-21T17:32:10Z","title":"dKV-Cache: The Cache for Diffusion Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.15781","snapshot_observed_at":"2026-08-03T04:07:43.895110Z","title":"dkv-cache: The cache for diffusion language models.arXiv preprint arXiv:2505.15781,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.05992","last_updated":"2026-06-17T04:52:05Z","snapshot_observed_at":"2026-08-03T04:07:41.584536Z","submitted_at":"2026-02-05T18:41:38Z","title":"DSB: Dynamic Sliding Block Scheduling for Diffusion LLMs","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-03T04:07:43.895110Z"},"links":{"cited_paper":"/paper/2505.15781","citing_paper":"/paper/2602.05992"},"observation_digest":"sha256:6bff4fd12e196ce0d24a32d3a417e095ad76868bbdd5ad2147fbb6f7bdedb5bc","observation_id":"d1b1075d-ff89-45f9-bf6b-4045f15d8ba6","resolution":{"observed_at":"2026-08-03T04:07:43.895110Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.15781","last_updated":"2025-05-21T17:32:10Z","snapshot_observed_at":"2026-08-01T20:24:14.008213Z","submitted_at":"2025-05-21T17:32:10Z","title":"dKV-Cache: The Cache for Diffusion Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.15781","snapshot_observed_at":"2026-08-04T06:06:06.779366Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.11133","last_updated":"2026-08-02T20:20:48Z","snapshot_observed_at":"2026-08-05T10:21:59.429413Z","submitted_at":"2026-02-11T18:44:04Z","title":"Just on Time: Token-Level Early Stopping for Diffusion Language Models","version":2},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-04T06:06:06.779366Z"},"links":{"cited_paper":"/paper/2505.15781","citing_paper":"/paper/2602.11133"},"observation_digest":"sha256:2b36f45bd7a75551ded3f0eaffea8676dd29c9a68e01efed803d07c7ec3bfa34","observation_id":"2b6eb4e3-9429-4b5a-8254-4ccc8ad584db","resolution":{"observed_at":"2026-08-04T06:06:06.779366Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.15781","last_updated":"2025-05-21T17:32:10Z","snapshot_observed_at":"2026-08-01T20:24:14.008213Z","submitted_at":"2025-05-21T17:32:10Z","title":"dKV-Cache: The Cache for Diffusion Language Models","version":1},"cited_work":{"arxiv_id":"2505.15781","doi":"10.48550/arxiv.2505.15781","metadata_source":"pith","pith_arxiv_id":"2505.15781","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"dkv-cache: The cache for diffusion language models","venue":"cs.CL","work_id":"8bba2afd-bafd-4ccb-af6d-58855e9f3967","year":2025},"citing_paper":{"arxiv_id":"2603.07475","last_updated":"2026-08-02T20:40:52Z","snapshot_observed_at":"2026-08-05T10:22:04.718440Z","submitted_at":"2026-03-08T05:31:52Z","title":"A Comparative analysis of Layer-wise Representational Capacity in AR and Diffusion LLMs","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-15T15:03:23.792608Z"},"links":{"cited_paper":"/paper/2505.15781","citing_paper":"/paper/2603.07475"},"observation_digest":"sha256:d534e9e3d7e53d32e21f9cae0c31008182952636be8843b9175ada393e46228d","observation_id":"4808324c-c034-445b-8ebd-7de1a882e5dc","resolution":{"observed_at":"2026-05-15T15:06:10.088470Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.15781","last_updated":"2025-05-21T17:32:10Z","snapshot_observed_at":"2026-08-01T20:24:14.008213Z","submitted_at":"2025-05-21T17:32:10Z","title":"dKV-Cache: The Cache for Diffusion Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.15781","snapshot_observed_at":"2026-08-04T05:57:08.013699Z","title":"dkv-cache: The cache for diffusion language models.arXiv preprint arXiv:2505.15781,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.07475","last_updated":"2026-08-02T20:40:52Z","snapshot_observed_at":"2026-08-05T10:22:04.718440Z","submitted_at":"2026-03-08T05:31:52Z","title":"A Comparative analysis of Layer-wise Representational Capacity in AR and Diffusion LLMs","version":4},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-04T05:57:08.013699Z"},"links":{"cited_paper":"/paper/2505.15781","citing_paper":"/paper/2603.07475"},"observation_digest":"sha256:4dc2797fa429fab6f24489fdbc64a98a1e1c9a9c27ce8222570170b21f22d0a4","observation_id":"16271fa4-81d2-439a-817a-b48eb8f553ca","resolution":{"observed_at":"2026-08-04T05:57:08.013699Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.15781","last_updated":"2025-05-21T17:32:10Z","snapshot_observed_at":"2026-08-01T20:24:14.008213Z","submitted_at":"2025-05-21T17:32:10Z","title":"dKV-Cache: The Cache for Diffusion Language Models","version":1},"cited_work":{"arxiv_id":"2505.15781","doi":"10.48550/arxiv.2505.15781","metadata_source":"pith","pith_arxiv_id":"2505.15781","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"dkv-cache: The cache for diffusion language models","venue":"cs.CL","work_id":"8bba2afd-bafd-4ccb-af6d-58855e9f3967","year":2025},"citing_paper":{"arxiv_id":"2604.05250","last_updated":"2026-04-06T23:23:57Z","snapshot_observed_at":"2026-07-06T22:54:00.211106Z","submitted_at":"2026-04-06T23:23:57Z","title":"DualDiffusion: A Speculative Decoding Strategy for Masked Diffusion Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-10T18:46:57.123262Z"},"links":{"cited_paper":"/paper/2505.15781","citing_paper":"/paper/2604.05250"},"observation_digest":"sha256:c9ca88ccd957126562f9bfb2374c95e1ba841754233e5aec144a3abf5e19ecd9","observation_id":"e2ef35a8-8413-4c99-8683-5048a3db85e0","resolution":{"observed_at":"2026-05-10T23:55:52.485178Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.15781","last_updated":"2025-05-21T17:32:10Z","snapshot_observed_at":"2026-08-01T20:24:14.008213Z","submitted_at":"2025-05-21T17:32:10Z","title":"dKV-Cache: The Cache for Diffusion Language Models","version":1},"cited_work":{"arxiv_id":"2505.15781","doi":"10.48550/arxiv.2505.15781","metadata_source":"pith","pith_arxiv_id":"2505.15781","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"dkv-cache: The cache for diffusion language models","venue":"cs.CL","work_id":"8bba2afd-bafd-4ccb-af6d-58855e9f3967","year":2025},"citing_paper":{"arxiv_id":"2604.08302","last_updated":"2026-05-15T04:19:14Z","snapshot_observed_at":"2026-07-06T22:57:26.678728Z","submitted_at":"2026-04-09T14:35:42Z","title":"DMax: Aggressive Parallel Decoding for dLLMs","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-10T17:58:17.880199Z"},"links":{"cited_paper":"/paper/2505.15781","citing_paper":"/paper/2604.08302"},"observation_digest":"sha256:1072271fa2f335971815e8302ae7e2b6bf33931751a5988041dc05c91b4db180","observation_id":"6d7e55cf-f729-4d97-a729-1088a0042f10","resolution":{"observed_at":"2026-05-11T05:45:55.915284Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.15781","last_updated":"2025-05-21T17:32:10Z","snapshot_observed_at":"2026-08-01T20:24:14.008213Z","submitted_at":"2025-05-21T17:32:10Z","title":"dKV-Cache: The Cache for Diffusion Language Models","version":1},"cited_work":{"arxiv_id":"2505.15781","doi":"10.48550/arxiv.2505.15781","metadata_source":"pith","pith_arxiv_id":"2505.15781","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"dkv-cache: The cache for diffusion language models","venue":"cs.CL","work_id":"8bba2afd-bafd-4ccb-af6d-58855e9f3967","year":2025},"citing_paper":{"arxiv_id":"2604.08302","last_updated":"2026-05-15T04:19:14Z","snapshot_observed_at":"2026-07-06T22:57:26.678728Z","submitted_at":"2026-04-09T14:35:42Z","title":"DMax: Aggressive Parallel Decoding for dLLMs","version":3},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-19T16:46:56.743268Z"},"links":{"cited_paper":"/paper/2505.15781","citing_paper":"/paper/2604.08302"},"observation_digest":"sha256:f712593d42a98270c6ba438b5b7baf0cd8fb2aac7c443e1c7432eb8eaaeff66a","observation_id":"5d555c91-64eb-4ac2-bef7-a9d3b48b7942","resolution":{"observed_at":"2026-05-19T16:47:40.235722Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.15781","last_updated":"2025-05-21T17:32:10Z","snapshot_observed_at":"2026-08-01T20:24:14.008213Z","submitted_at":"2025-05-21T17:32:10Z","title":"dKV-Cache: The Cache for Diffusion Language Models","version":1},"cited_work":{"arxiv_id":"2505.15781","doi":"10.48550/arxiv.2505.15781","metadata_source":"pith","pith_arxiv_id":"2505.15781","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"dkv-cache: The cache for diffusion language models","venue":"cs.CL","work_id":"8bba2afd-bafd-4ccb-af6d-58855e9f3967","year":2025},"citing_paper":{"arxiv_id":"2604.17068","last_updated":"2026-04-18T17:04:10Z","snapshot_observed_at":"2026-07-06T23:04:14.688737Z","submitted_at":"2026-04-18T17:04:10Z","title":"Stability-Weighted Decoding for Diffusion Language Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-10T06:12:37.804816Z"},"links":{"cited_paper":"/paper/2505.15781","citing_paper":"/paper/2604.17068"},"observation_digest":"sha256:46af6b26ea18e148f2700e027d11e04717aef89ec5505c27c441eee5f45693f4","observation_id":"78e334c2-02dc-4f4a-ba76-71c3bdfa198c","resolution":{"observed_at":"2026-05-10T06:31:31.324664Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.15781","last_updated":"2025-05-21T17:32:10Z","snapshot_observed_at":"2026-08-01T20:24:14.008213Z","submitted_at":"2025-05-21T17:32:10Z","title":"dKV-Cache: The Cache for Diffusion Language Models","version":1},"cited_work":{"arxiv_id":"2505.15781","doi":"10.48550/arxiv.2505.15781","metadata_source":"pith","pith_arxiv_id":"2505.15781","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"dkv-cache: The cache for diffusion language models","venue":"cs.CL","work_id":"8bba2afd-bafd-4ccb-af6d-58855e9f3967","year":2025},"citing_paper":{"arxiv_id":"2604.18995","last_updated":"2026-06-02T03:22:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-21T02:26:08Z","title":"$R^2$-dLLM: Accelerating Diffusion Large Language Models via Spatio-Temporal Redundancy Reduction","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-10T02:56:32.367404Z"},"links":{"cited_paper":"/paper/2505.15781","citing_paper":"/paper/2604.18995"},"observation_digest":"sha256:fbc9978c6374079c00851c7bd097549dc6573d78b027fbb174352815e8ddaaa6","observation_id":"310c6f96-9478-4eb9-a715-a3d081ab485d","resolution":{"observed_at":"2026-05-11T12:46:25.680494Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.15781","last_updated":"2025-05-21T17:32:10Z","snapshot_observed_at":"2026-08-01T20:24:14.008213Z","submitted_at":"2025-05-21T17:32:10Z","title":"dKV-Cache: The Cache for Diffusion Language Models","version":1},"cited_work":{"arxiv_id":"2505.15781","doi":"10.48550/arxiv.2505.15781","metadata_source":"pith","pith_arxiv_id":"2505.15781","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"dkv-cache: The cache for diffusion language models","venue":"cs.CL","work_id":"8bba2afd-bafd-4ccb-af6d-58855e9f3967","year":2025},"citing_paper":{"arxiv_id":"2605.00161","last_updated":"2026-05-30T05:41:01Z","snapshot_observed_at":"2026-08-03T08:25:31.473650Z","submitted_at":"2026-04-30T19:31:02Z","title":"Consistent Diffusion Language Models","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-05-09T20:59:46.082251Z"},"links":{"cited_paper":"/paper/2505.15781","citing_paper":"/paper/2605.00161"},"observation_digest":"sha256:7849219d1ee93478eea81850f16aee41da2c573ba07e5707d5770e86dd4b5705","observation_id":"0ade42e0-49f4-40b7-8f9e-b5c8cbadd279","resolution":{"observed_at":"2026-05-11T14:51:04.836536Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.15781","last_updated":"2025-05-21T17:32:10Z","snapshot_observed_at":"2026-08-01T20:24:14.008213Z","submitted_at":"2025-05-21T17:32:10Z","title":"dKV-Cache: The Cache for Diffusion Language Models","version":1},"cited_work":{"arxiv_id":"2505.15781","doi":"10.48550/arxiv.2505.15781","metadata_source":"pith","pith_arxiv_id":"2505.15781","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"dkv-cache: The cache for diffusion language models","venue":"cs.CL","work_id":"8bba2afd-bafd-4ccb-af6d-58855e9f3967","year":2025},"citing_paper":{"arxiv_id":"2605.08134","last_updated":"2026-05-01T19:15:45Z","snapshot_observed_at":"2026-07-31T08:32:09.868528Z","submitted_at":"2026-05-01T19:15:45Z","title":"DARE: Diffusion Language Model Activation Reuse for Efficient Inference","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-05-12T03:24:00.494716Z"},"links":{"cited_paper":"/paper/2505.15781","citing_paper":"/paper/2605.08134"},"observation_digest":"sha256:a1c4bb367fa3f0413eeb0ad9194e68728429e043363b782e038bc7b95ee64a66","observation_id":"5af9c771-90fd-4ed2-bac0-16cae20bfb1a","resolution":{"observed_at":"2026-05-12T03:26:19.682913Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.15781","last_updated":"2025-05-21T17:32:10Z","snapshot_observed_at":"2026-08-01T20:24:14.008213Z","submitted_at":"2025-05-21T17:32:10Z","title":"dKV-Cache: The Cache for Diffusion Language Models","version":1},"cited_work":{"arxiv_id":"2505.15781","doi":"10.48550/arxiv.2505.15781","metadata_source":"pith","pith_arxiv_id":"2505.15781","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"dkv-cache: The cache for diffusion language models","venue":"cs.CL","work_id":"8bba2afd-bafd-4ccb-af6d-58855e9f3967","year":2025},"citing_paper":{"arxiv_id":"2605.09536","last_updated":"2026-05-10T13:38:53Z","snapshot_observed_at":"2026-07-06T23:21:35.327066Z","submitted_at":"2026-05-10T13:38:53Z","title":"TAD: Temporal-Aware Trajectory Self-Distillation for Fast and Accurate Diffusion LLM","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-12T05:01:03.570848Z"},"links":{"cited_paper":"/paper/2505.15781","citing_paper":"/paper/2605.09536"},"observation_digest":"sha256:253489e1ade9ccbf9d224438c8db412f23ee71fec827624e12e0519ebbb06706","observation_id":"eb660baa-c8eb-4e48-aa34-f8b1c3d458db","resolution":{"observed_at":"2026-05-12T05:46:26.034064Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.15781","last_updated":"2025-05-21T17:32:10Z","snapshot_observed_at":"2026-08-01T20:24:14.008213Z","submitted_at":"2025-05-21T17:32:10Z","title":"dKV-Cache: The Cache for Diffusion Language Models","version":1},"cited_work":{"arxiv_id":"2505.15781","doi":"10.48550/arxiv.2505.15781","metadata_source":"pith","pith_arxiv_id":"2505.15781","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"dkv-cache: The cache for diffusion language models","venue":"cs.CL","work_id":"8bba2afd-bafd-4ccb-af6d-58855e9f3967","year":2025},"citing_paper":{"arxiv_id":"2605.09999","last_updated":"2026-05-11T05:21:52Z","snapshot_observed_at":"2026-07-06T23:21:59.096464Z","submitted_at":"2026-05-11T05:21:52Z","title":"Muninn: Your Trajectory Diffusion Model But Faster","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-12T03:49:48.492957Z"},"links":{"cited_paper":"/paper/2505.15781","citing_paper":"/paper/2605.09999"},"observation_digest":"sha256:54801e593f9a939f70638f5cf169aafc0024961ee17e7e36c2a0f2e90ebec601","observation_id":"7d11f95d-593e-439c-ac6e-7a3270ccf72c","resolution":{"observed_at":"2026-05-12T06:56:27.588353Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.15781","last_updated":"2025-05-21T17:32:10Z","snapshot_observed_at":"2026-08-01T20:24:14.008213Z","submitted_at":"2025-05-21T17:32:10Z","title":"dKV-Cache: The Cache for Diffusion Language Models","version":1},"cited_work":{"arxiv_id":"2505.15781","doi":"10.48550/arxiv.2505.15781","metadata_source":"pith","pith_arxiv_id":"2505.15781","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"dkv-cache: The cache for diffusion language models","venue":"cs.CL","work_id":"8bba2afd-bafd-4ccb-af6d-58855e9f3967","year":2025},"citing_paper":{"arxiv_id":"2605.12825","last_updated":"2026-05-17T06:15:57Z","snapshot_observed_at":"2026-08-02T22:38:42.397013Z","submitted_at":"2026-05-12T23:47:35Z","title":"Orthrus: Memory-Efficient Parallel Token Generation via Dual-View Diffusion","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-14T19:49:16.478833Z"},"links":{"cited_paper":"/paper/2505.15781","citing_paper":"/paper/2605.12825"},"observation_digest":"sha256:e3eb3fa083f3738f5c6a11b4d81d6ac49797c3f18325d3073e2cda65e04f4523","observation_id":"92bd7f62-ca1c-48fa-ab44-1f56159ff89d","resolution":{"observed_at":"2026-05-14T19:49:24.893227Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.15781","last_updated":"2025-05-21T17:32:10Z","snapshot_observed_at":"2026-08-01T20:24:14.008213Z","submitted_at":"2025-05-21T17:32:10Z","title":"dKV-Cache: The Cache for Diffusion Language Models","version":1},"cited_work":{"arxiv_id":"2505.15781","doi":"10.48550/arxiv.2505.15781","metadata_source":"pith","pith_arxiv_id":"2505.15781","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"dkv-cache: The cache for diffusion language models","venue":"cs.CL","work_id":"8bba2afd-bafd-4ccb-af6d-58855e9f3967","year":2025},"citing_paper":{"arxiv_id":"2605.12825","last_updated":"2026-05-17T06:15:57Z","snapshot_observed_at":"2026-08-02T22:38:42.397013Z","submitted_at":"2026-05-12T23:47:35Z","title":"Orthrus: Memory-Efficient Parallel Token Generation via Dual-View Diffusion","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-20T21:37:58.464075Z"},"links":{"cited_paper":"/paper/2505.15781","citing_paper":"/paper/2605.12825"},"observation_digest":"sha256:0e075faa9aa304681a8bae9f69ec59cb017c80c1b50eeea2fabdb45f9e8783c5","observation_id":"d90ca113-b18f-48ef-a912-73b75de7a72f","resolution":{"observed_at":"2026-05-20T21:39:03.370154Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.15781","last_updated":"2025-05-21T17:32:10Z","snapshot_observed_at":"2026-08-01T20:24:14.008213Z","submitted_at":"2025-05-21T17:32:10Z","title":"dKV-Cache: The Cache for Diffusion Language Models","version":1},"cited_work":{"arxiv_id":"2505.15781","doi":"10.48550/arxiv.2505.15781","metadata_source":"pith","pith_arxiv_id":"2505.15781","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"dkv-cache: The cache for diffusion language models","venue":"cs.CL","work_id":"8bba2afd-bafd-4ccb-af6d-58855e9f3967","year":2025},"citing_paper":{"arxiv_id":"2605.18165","last_updated":"2026-05-18T10:09:10Z","snapshot_observed_at":"2026-07-06T23:29:04.241654Z","submitted_at":"2026-05-18T10:09:10Z","title":"Elastic-dLLM: Position Preserving Context Compression and Augmentation of Diffusion LLMs","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-20T13:13:05.695349Z"},"links":{"cited_paper":"/paper/2505.15781","citing_paper":"/paper/2605.18165"},"observation_digest":"sha256:f060e21406d076ad4ad34542885c88195598e24ad77e85acb4d6e4745c08bfaf","observation_id":"7d8be878-a96a-45e4-8166-14c00b6596cb","resolution":{"observed_at":"2026-05-20T13:13:17.907799Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.15781","last_updated":"2025-05-21T17:32:10Z","snapshot_observed_at":"2026-08-01T20:24:14.008213Z","submitted_at":"2025-05-21T17:32:10Z","title":"dKV-Cache: The Cache for Diffusion Language Models","version":1},"cited_work":{"arxiv_id":"2505.15781","doi":"10.48550/arxiv.2505.15781","metadata_source":"pith","pith_arxiv_id":"2505.15781","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"dkv-cache: The cache for diffusion language models","venue":"cs.CL","work_id":"8bba2afd-bafd-4ccb-af6d-58855e9f3967","year":2025},"citing_paper":{"arxiv_id":"2605.19470","last_updated":"2026-05-19T07:22:17Z","snapshot_observed_at":"2026-08-02T15:57:38.826961Z","submitted_at":"2026-05-19T07:22:17Z","title":"Drifting Objectives for Refining Discrete Diffusion Language Models","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-20T06:18:06.115984Z"},"links":{"cited_paper":"/paper/2505.15781","citing_paper":"/paper/2605.19470"},"observation_digest":"sha256:1d6281f34b12a64506bc8cdfb158a6cb73665731e636e91b1fa730826e89373e","observation_id":"055c3160-77b4-43e7-80d1-af16600d9bf7","resolution":{"observed_at":"2026-05-20T06:23:05.629856Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.15781","last_updated":"2025-05-21T17:32:10Z","snapshot_observed_at":"2026-08-01T20:24:14.008213Z","submitted_at":"2025-05-21T17:32:10Z","title":"dKV-Cache: The Cache for Diffusion Language Models","version":1},"cited_work":{"arxiv_id":"2505.15781","doi":"10.48550/arxiv.2505.15781","metadata_source":"pith","pith_arxiv_id":"2505.15781","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"dkv-cache: The cache for diffusion language models","venue":"cs.CL","work_id":"8bba2afd-bafd-4ccb-af6d-58855e9f3967","year":2025},"citing_paper":{"arxiv_id":"2605.20179","last_updated":"2026-05-19T17:59:08Z","snapshot_observed_at":"2026-08-02T06:21:17.194998Z","submitted_at":"2026-05-19T17:59:08Z","title":"TIDE: Efficient and Lossless MoE Diffusion LLM Inference with I/O-aware Expert Offload","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-20T05:08:07.318040Z"},"links":{"cited_paper":"/paper/2505.15781","citing_paper":"/paper/2605.20179"},"observation_digest":"sha256:ac4b487fa53717c55fc6b21e5b958127dfda30a1140e6fb048a4fe9566adc31d","observation_id":"6bb5c8fc-a2bc-4180-8bb0-5ba106576c76","resolution":{"observed_at":"2026-05-20T05:13:03.704690Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.15781","last_updated":"2025-05-21T17:32:10Z","snapshot_observed_at":"2026-08-01T20:24:14.008213Z","submitted_at":"2025-05-21T17:32:10Z","title":"dKV-Cache: The Cache for Diffusion Language Models","version":1},"cited_work":{"arxiv_id":"2505.15781","doi":"10.48550/arxiv.2505.15781","metadata_source":"pith","pith_arxiv_id":"2505.15781","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"dkv-cache: The cache for diffusion language models","venue":"cs.CL","work_id":"8bba2afd-bafd-4ccb-af6d-58855e9f3967","year":2025},"citing_paper":{"arxiv_id":"2605.20813","last_updated":"2026-05-20T07:06:54Z","snapshot_observed_at":"2026-08-02T08:54:20.689265Z","submitted_at":"2026-05-20T07:06:54Z","title":"PulseCol: Periodically Refreshed Column-Sparse Attention for Accelerating Diffusion Language Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-21T05:05:55.767705Z"},"links":{"cited_paper":"/paper/2505.15781","citing_paper":"/paper/2605.20813"},"observation_digest":"sha256:407c66a53bad10450bd0bb0d2c3bfb749287faf05b11c440131af40789bbdc0c","observation_id":"3ae9365c-3c58-440a-aa3d-d960936d841a","resolution":{"observed_at":"2026-05-21T05:09:38.702899Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.15781","last_updated":"2025-05-21T17:32:10Z","snapshot_observed_at":"2026-08-01T20:24:14.008213Z","submitted_at":"2025-05-21T17:32:10Z","title":"dKV-Cache: The Cache for Diffusion Language Models","version":1},"cited_work":{"arxiv_id":"2505.15781","doi":"10.48550/arxiv.2505.15781","metadata_source":"pith","pith_arxiv_id":"2505.15781","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"dkv-cache: The cache for diffusion language models","venue":"cs.CL","work_id":"8bba2afd-bafd-4ccb-af6d-58855e9f3967","year":2025},"citing_paper":{"arxiv_id":"2606.00724","last_updated":"2026-05-30T13:32:26Z","snapshot_observed_at":"2026-08-01T20:21:29.201173Z","submitted_at":"2026-05-30T13:32:26Z","title":"WaveFilter: Enhancing the Long-Context Capability of Diffusion LLMs via Wavelet-Guided KV Cache Filtering","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-06-28T18:57:54.491506Z"},"links":{"cited_paper":"/paper/2505.15781","citing_paper":"/paper/2606.00724"},"observation_digest":"sha256:8fc52e2a9ab0155af67693e318d9c1c1f1d9050c8536d653ea3b5fdd6d1cc495","observation_id":"80f1760e-6b83-4097-9fd4-aaf2514d27a0","resolution":{"observed_at":"2026-06-28T19:02:33.539893Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.15781","last_updated":"2025-05-21T17:32:10Z","snapshot_observed_at":"2026-08-01T20:24:14.008213Z","submitted_at":"2025-05-21T17:32:10Z","title":"dKV-Cache: The Cache for Diffusion Language Models","version":1},"cited_work":{"arxiv_id":"2505.15781","doi":"10.48550/arxiv.2505.15781","metadata_source":"pith","pith_arxiv_id":"2505.15781","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"dkv-cache: The cache for diffusion language models","venue":"cs.CL","work_id":"8bba2afd-bafd-4ccb-af6d-58855e9f3967","year":2025},"citing_paper":{"arxiv_id":"2606.02544","last_updated":"2026-06-01T17:46:46Z","snapshot_observed_at":"2026-07-06T23:42:53.514946Z","submitted_at":"2026-06-01T17:46:46Z","title":"SimSD: Simple Speculative Decoding in Diffusion Language Models","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-06-28T14:58:00.723105Z"},"links":{"cited_paper":"/paper/2505.15781","citing_paper":"/paper/2606.02544"},"observation_digest":"sha256:543b61f84f061dbb0ded191d7c277257edd75639bc24d6970a1c32d7d29b6eb5","observation_id":"dded29b5-222b-4259-b60b-1eea4953b0cc","resolution":{"observed_at":"2026-07-01T22:56:19.572445Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.15781","last_updated":"2025-05-21T17:32:10Z","snapshot_observed_at":"2026-08-01T20:24:14.008213Z","submitted_at":"2025-05-21T17:32:10Z","title":"dKV-Cache: The Cache for Diffusion Language Models","version":1},"cited_work":{"arxiv_id":"2505.15781","doi":"10.48550/arxiv.2505.15781","metadata_source":"pith","pith_arxiv_id":"2505.15781","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"dkv-cache: The cache for diffusion language models","venue":"cs.CL","work_id":"8bba2afd-bafd-4ccb-af6d-58855e9f3967","year":2025},"citing_paper":{"arxiv_id":"2606.08411","last_updated":"2026-06-07T02:24:11Z","snapshot_observed_at":"2026-08-02T02:11:38.348268Z","submitted_at":"2026-06-07T02:24:11Z","title":"AsyncLane: Decoupling Refinement from Advancement in Diffusion Language Model Decoding","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-27T18:55:09.942488Z"},"links":{"cited_paper":"/paper/2505.15781","citing_paper":"/paper/2606.08411"},"observation_digest":"sha256:863e054dbb1cd9201359f0b321552db756efccd58fa2c5fcf8c900d16834bbd2","observation_id":"2d70d8ab-8310-4dee-80c9-bc82ec4e273b","resolution":{"observed_at":"2026-07-02T22:27:25.768144Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.15781","last_updated":"2025-05-21T17:32:10Z","snapshot_observed_at":"2026-08-01T20:24:14.008213Z","submitted_at":"2025-05-21T17:32:10Z","title":"dKV-Cache: The Cache for Diffusion Language Models","version":1},"cited_work":{"arxiv_id":"2505.15781","doi":"10.48550/arxiv.2505.15781","metadata_source":"pith","pith_arxiv_id":"2505.15781","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"dkv-cache: The cache for diffusion language models","venue":"cs.CL","work_id":"8bba2afd-bafd-4ccb-af6d-58855e9f3967","year":2025},"citing_paper":{"arxiv_id":"2606.25331","last_updated":"2026-06-24T02:51:36Z","snapshot_observed_at":"2026-07-06T23:59:47.542695Z","submitted_at":"2026-06-24T02:51:36Z","title":"Improved Large Language Diffusion Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-25T21:34:45.620481Z"},"links":{"cited_paper":"/paper/2505.15781","citing_paper":"/paper/2606.25331"},"observation_digest":"sha256:084c7959e62b96232c50e35e33b8bac6d80a1c840b7c74db0bd683041ce12f91","observation_id":"e6d94c8c-7f0f-43ff-b91d-d76c320357e3","resolution":{"observed_at":"2026-07-04T19:20:05.600761Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.15781","last_updated":"2025-05-21T17:32:10Z","snapshot_observed_at":"2026-08-01T20:24:14.008213Z","submitted_at":"2025-05-21T17:32:10Z","title":"dKV-Cache: The Cache for Diffusion Language Models","version":1},"cited_work":{"arxiv_id":"2505.15781","doi":"10.48550/arxiv.2505.15781","metadata_source":"pith","pith_arxiv_id":"2505.15781","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"dkv-cache: The cache for diffusion language models","venue":"cs.CL","work_id":"8bba2afd-bafd-4ccb-af6d-58855e9f3967","year":2025},"citing_paper":{"arxiv_id":"2606.26120","last_updated":"2026-05-27T02:47:50Z","snapshot_observed_at":"2026-07-07T00:00:31.981360Z","submitted_at":"2026-05-27T02:47:50Z","title":"Dynamic-dLLM: Dynamic Cache-Budget and Adaptive Parallel Decoding for Training-Free Acceleration of Diffusion LLM","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-29T13:27:45.796650Z"},"links":{"cited_paper":"/paper/2505.15781","citing_paper":"/paper/2606.26120"},"observation_digest":"sha256:fb775a3dfdfe68e9ec6477f92ac6ac592266171c3e10ba89c810b83c687e2f8f","observation_id":"29e0803d-f212-4e95-8759-6331721d0d88","resolution":{"observed_at":"2026-06-29T13:33:28.295423Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.15781","last_updated":"2025-05-21T17:32:10Z","snapshot_observed_at":"2026-08-01T20:24:14.008213Z","submitted_at":"2025-05-21T17:32:10Z","title":"dKV-Cache: The Cache for Diffusion Language Models","version":1},"cited_work":{"arxiv_id":"2505.15781","doi":"10.48550/arxiv.2505.15781","metadata_source":"pith","pith_arxiv_id":"2505.15781","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"dkv-cache: The cache for diffusion language models","venue":"cs.CL","work_id":"8bba2afd-bafd-4ccb-af6d-58855e9f3967","year":2025},"citing_paper":{"arxiv_id":"2606.29814","last_updated":"2026-07-15T22:31:14Z","snapshot_observed_at":"2026-08-02T09:39:29.759731Z","submitted_at":"2026-06-29T05:48:41Z","title":"Nemotron-Labs-Diffusion-Image: Advancing Masked Discrete Diffusion for High-Resolution Image Synthesis","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-30T06:07:55.600338Z"},"links":{"cited_paper":"/paper/2505.15781","citing_paper":"/paper/2606.29814"},"observation_digest":"sha256:59cc3c8e340be47b72c3c17565550942d0eda2f19e86b2d48e11ec8f49e85cb4","observation_id":"01addc37-21fe-42fb-bc40-435440b1cf1d","resolution":{"observed_at":"2026-06-30T08:14:26.594399Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.15781","last_updated":"2025-05-21T17:32:10Z","snapshot_observed_at":"2026-08-01T20:24:14.008213Z","submitted_at":"2025-05-21T17:32:10Z","title":"dKV-Cache: The Cache for Diffusion Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.15781","snapshot_observed_at":"2026-08-02T09:39:33.236358Z","title":"dkv-cache: The cache for diffusion language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.29814","last_updated":"2026-07-15T22:31:14Z","snapshot_observed_at":"2026-08-02T09:39:29.759731Z","submitted_at":"2026-06-29T05:48:41Z","title":"Nemotron-Labs-Diffusion-Image: Advancing Masked Discrete Diffusion for High-Resolution Image Synthesis","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-02T09:39:33.236358Z"},"links":{"cited_paper":"/paper/2505.15781","citing_paper":"/paper/2606.29814"},"observation_digest":"sha256:57d3e91611c7ffd278e7d6a5d1af929fb168287a9d7f494fbebd42696c1a69a8","observation_id":"56d813eb-b96a-48c9-8663-7998a002160d","resolution":{"observed_at":"2026-08-02T09:39:33.236358Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.15781","last_updated":"2025-05-21T17:32:10Z","snapshot_observed_at":"2026-08-01T20:24:14.008213Z","submitted_at":"2025-05-21T17:32:10Z","title":"dKV-Cache: The Cache for Diffusion Language Models","version":1},"cited_work":{"arxiv_id":"2505.15781","doi":"10.48550/arxiv.2505.15781","metadata_source":"pith","pith_arxiv_id":"2505.15781","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"dkv-cache: The cache for diffusion language models","venue":"cs.CL","work_id":"8bba2afd-bafd-4ccb-af6d-58855e9f3967","year":2025},"citing_paper":{"arxiv_id":"2607.01775","last_updated":"2026-07-02T06:45:43Z","snapshot_observed_at":"2026-08-05T08:13:48.395073Z","submitted_at":"2026-07-02T06:45:43Z","title":"Set Diffusion: Interpolating Token Orderings Between Autoregression and Diffusion for Fast and Flexible Decoding","version":1},"reference_index":139,"source":"arxiv_source","source_observed_at":"2026-07-03T17:30:39.458521Z"},"links":{"cited_paper":"/paper/2505.15781","citing_paper":"/paper/2607.01775"},"observation_digest":"sha256:b6518d2088b0bbe7e455ca0fc6a834284fc6dcd7de5a3346aedafe5f5dcdc195","observation_id":"424817c7-15e2-425a-baa3-08ed58b79c58","resolution":{"observed_at":"2026-07-03T17:38:43.633789Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.15781","last_updated":"2025-05-21T17:32:10Z","snapshot_observed_at":"2026-08-01T20:24:14.008213Z","submitted_at":"2025-05-21T17:32:10Z","title":"dKV-Cache: The Cache for Diffusion Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.15781","snapshot_observed_at":"2026-07-12T06:56:40.273325Z","title":"arXiv preprint arXiv:2505.15781 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.02805","last_updated":"2026-07-02T22:37:43Z","snapshot_observed_at":"2026-08-03T16:59:52.805255Z","submitted_at":"2026-07-02T22:37:43Z","title":"Training Hybrid Block Diffusion Language Models with Partial Bidirectionality","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-07-12T06:56:40.273325Z"},"links":{"cited_paper":"/paper/2505.15781","citing_paper":"/paper/2607.02805"},"observation_digest":"sha256:f922adb5aab778a1d0bdcd7557cfdb8621d950653d9be7b7ca37f9b139217ab6","observation_id":"8a3d6f89-a2fe-45f7-8af4-b0154b74d73a","resolution":{"observed_at":"2026-07-12T06:56:40.273325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.15781","last_updated":"2025-05-21T17:32:10Z","snapshot_observed_at":"2026-08-01T20:24:14.008213Z","submitted_at":"2025-05-21T17:32:10Z","title":"dKV-Cache: The Cache for Diffusion Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.15781","snapshot_observed_at":"2026-07-11T13:03:39.236118Z","title":"arXiv preprint arXiv:2505.15781 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04819","last_updated":"2026-07-13T09:12:14Z","snapshot_observed_at":"2026-08-04T15:17:53.147491Z","submitted_at":"2026-07-06T08:51:22Z","title":"Layer-Parallel Inference Reduces Encrypted Nonlinear Depth in Transformers","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-07-11T13:03:39.236118Z"},"links":{"cited_paper":"/paper/2505.15781","citing_paper":"/paper/2607.04819"},"observation_digest":"sha256:21d84adac3b2f4698919a2b632da49151c06f83576c39570ac41bb925a143f7a","observation_id":"f67277e8-3340-4071-9266-a28eb77da737","resolution":{"observed_at":"2026-07-11T13:03:39.236118Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.15781","last_updated":"2025-05-21T17:32:10Z","snapshot_observed_at":"2026-08-01T20:24:14.008213Z","submitted_at":"2025-05-21T17:32:10Z","title":"dKV-Cache: The Cache for Diffusion Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.15781","snapshot_observed_at":"2026-07-14T16:21:05.570023Z","title":"arXiv preprint arXiv:2505.15781 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04819","last_updated":"2026-07-13T09:12:14Z","snapshot_observed_at":"2026-08-04T15:17:53.147491Z","submitted_at":"2026-07-06T08:51:22Z","title":"Layer-Parallel Inference Reduces Encrypted Nonlinear Depth in Transformers","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-07-14T16:21:05.570023Z"},"links":{"cited_paper":"/paper/2505.15781","citing_paper":"/paper/2607.04819"},"observation_digest":"sha256:82b7818827b89a41363015e076ff014770d6ab66f07a0afe8318d101670882e7","observation_id":"eef39733-e605-43c6-869d-308e4a8ef461","resolution":{"observed_at":"2026-07-14T16:21:05.570023Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.15781","last_updated":"2025-05-21T17:32:10Z","snapshot_observed_at":"2026-08-01T20:24:14.008213Z","submitted_at":"2025-05-21T17:32:10Z","title":"dKV-Cache: The Cache for Diffusion Language Models","version":1},"cited_work":{"arxiv_id":"2505.15781","doi":"10.48550/arxiv.2505.15781","metadata_source":"pith","pith_arxiv_id":"2505.15781","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"dkv-cache: The cache for diffusion language models","venue":"cs.CL","work_id":"8bba2afd-bafd-4ccb-af6d-58855e9f3967","year":2025},"citing_paper":{"arxiv_id":"2607.05722","last_updated":"2026-07-07T01:09:54Z","snapshot_observed_at":"2026-07-11T03:04:09.555872Z","submitted_at":"2026-07-07T01:09:54Z","title":"Nemotron-Labs-Diffusion: A Tri-Mode Language Model Unifying Autoregressive, Diffusion, and Self-Speculation Decoding","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-07-11T03:04:12.500342Z"},"links":{"cited_paper":"/paper/2505.15781","citing_paper":"/paper/2607.05722"},"observation_digest":"sha256:e6c12479bbda8d784b012fcc87e987333cd6d9414f7f0451c7c710c81bfef381","observation_id":"a6be4ad2-c798-4782-842c-e59f1aae65fb","resolution":{"observed_at":"2026-07-11T03:07:52.108528Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.15781","last_updated":"2025-05-21T17:32:10Z","snapshot_observed_at":"2026-08-01T20:24:14.008213Z","submitted_at":"2025-05-21T17:32:10Z","title":"dKV-Cache: The Cache for Diffusion Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.15781","snapshot_observed_at":"2026-08-02T14:46:39.626083Z","title":"dkv-cache: The cache for diffusion language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.14107","last_updated":"2026-05-07T18:05:39Z","snapshot_observed_at":"2026-08-04T17:50:10.370976Z","submitted_at":"2026-05-07T18:05:39Z","title":"Polestar: Drift-Aware Cache Calibration and Token Commitment for Efficient Inference of Diffusion LLMs","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-02T14:46:39.626083Z"},"links":{"cited_paper":"/paper/2505.15781","citing_paper":"/paper/2607.14107"},"observation_digest":"sha256:741e53dd5599bdb10e4e148b8301db49f4aefbf12aef08287737fbf493e5e1c5","observation_id":"d6ef4718-def9-4b1a-9c79-306795d83737","resolution":{"observed_at":"2026-08-02T14:46:39.626083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.15781","last_updated":"2025-05-21T17:32:10Z","snapshot_observed_at":"2026-08-01T20:24:14.008213Z","submitted_at":"2025-05-21T17:32:10Z","title":"dKV-Cache: The Cache for Diffusion Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.15781","snapshot_observed_at":"2026-08-02T01:48:53.941991Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.14557","last_updated":"2026-07-16T04:37:02Z","snapshot_observed_at":"2026-08-03T19:01:15.705968Z","submitted_at":"2026-07-16T04:37:02Z","title":"Seeing the End at Step Zero: Accelerating Diffusion MLLMs via MLP Sparsity-Aware Truncation","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-02T01:48:53.941991Z"},"links":{"cited_paper":"/paper/2505.15781","citing_paper":"/paper/2607.14557"},"observation_digest":"sha256:f5a4346bfb6f2535494457ba4f46244181f1fe6d6e7d85fc63e99b464e6aa2ba","observation_id":"e6c2e671-5f8e-45e7-9a47-c16eba3394e6","resolution":{"observed_at":"2026-08-02T01:48:53.941991Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.15781","last_updated":"2025-05-21T17:32:10Z","snapshot_observed_at":"2026-08-01T20:24:14.008213Z","submitted_at":"2025-05-21T17:32:10Z","title":"dKV-Cache: The Cache for Diffusion Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.15781","snapshot_observed_at":"2026-08-01T23:55:56.796892Z","title":"dkv-cache: The cache for diffusion language models.arXiv preprint arXiv:2505.15781,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.15200","last_updated":"2026-07-16T16:57:34Z","snapshot_observed_at":"2026-08-03T21:14:30.561247Z","submitted_at":"2026-07-16T16:57:34Z","title":"Mask-Aware Policy Gradients for Diffusion Language Models","version":1},"reference_index":1959,"source":"pdf_text","source_observed_at":"2026-08-01T23:55:56.796892Z"},"links":{"cited_paper":"/paper/2505.15781","citing_paper":"/paper/2607.15200"},"observation_digest":"sha256:71c1818fb1500f0472b4b15b0d563b7fbe5b00276295f3d72b683a9de0bd576f","observation_id":"af10b56e-ac39-4055-9166-e4182e424d5e","resolution":{"observed_at":"2026-08-01T23:55:56.796892Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.15781","last_updated":"2025-05-21T17:32:10Z","snapshot_observed_at":"2026-08-01T20:24:14.008213Z","submitted_at":"2025-05-21T17:32:10Z","title":"dKV-Cache: The Cache for Diffusion Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.15781","snapshot_observed_at":"2026-08-01T17:28:55.370896Z","title":"InProceedings of the 41st International Conference on Ma- chine Learning, ICML’24","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17652","last_updated":"2026-07-20T08:05:03Z","snapshot_observed_at":"2026-08-03T19:05:40.976043Z","submitted_at":"2026-07-20T08:05:03Z","title":"FlowBlock: Wavefront-Parallel Decoding for Self-Correcting Diffusion Language Models","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-01T17:28:55.370896Z"},"links":{"cited_paper":"/paper/2505.15781","citing_paper":"/paper/2607.17652"},"observation_digest":"sha256:aa75ac526db4b0eeb0ffacbc6e7cc4367e6b9eb7e31981a465cc4b7d7a7e4a11","observation_id":"a4da808d-e1b9-405c-a5dd-9b39decee86b","resolution":{"observed_at":"2026-08-01T17:28:55.370896Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.15781","last_updated":"2025-05-21T17:32:10Z","snapshot_observed_at":"2026-08-01T20:24:14.008213Z","submitted_at":"2025-05-21T17:32:10Z","title":"dKV-Cache: The Cache for Diffusion Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.15781","snapshot_observed_at":"2026-08-04T22:20:08.739938Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.01717","last_updated":"2026-08-03T05:28:37Z","snapshot_observed_at":"2026-08-05T10:24:19.697490Z","submitted_at":"2026-08-03T05:28:37Z","title":"Beyond On-Policy Exploration: Integrating External Policy Rollouts for Reinforcement Learning in Diffusion Language Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-04T22:20:08.739938Z"},"links":{"cited_paper":"/paper/2505.15781","citing_paper":"/paper/2608.01717"},"observation_digest":"sha256:e1eeafb8da788f40272773e1f123b31dbd0220ba4a3eae48b4386dfe5c072eca","observation_id":"6d711fa9-e3f3-4e83-a04e-2a99c6136159","resolution":{"observed_at":"2026-08-04T22:20:08.739938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2505.15781/citation-record","integrity":"/paper/2505.15781/integrity","json":"/paper/2505.15781/citation-record.json","paper":"/paper/2505.15781"},"outbound":[],"paper":{"arxiv_id":"2505.15781","last_updated":"2025-05-21T17:32:10Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-01T20:24:14.008213Z","submitted_at":"2025-05-21T17:32:10Z","title":"dKV-Cache: The Cache for Diffusion Language Models"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"thesis":"As of 5 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 50 inbound Pith citation observations for arXiv:2505.15781."}