{"as_of":"2026-08-13T13:46:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9e39049b4e04dcf08c493242b23c62d3b8f01734b76d6c41369b81dc0c2e9e05","coverage":[{"denominator":32,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":32,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-13T18:04:43.103159Z","state":"measured"},{"denominator":33,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":33,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-02T19:05:59.651008Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-02T19:07:17.196322Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2603.25702","last_updated":"2026-06-17T19:47:34Z","snapshot_observed_at":"2026-08-03T00:06:56.242578Z","submitted_at":"2026-03-26T17:48:50Z","title":"S2D2: Fast Decoding for Diffusion LLMs via Training-Free Self-Speculation","version":2},"cited_work":{"arxiv_id":"2603.25702","doi":null,"metadata_source":"pith","pith_arxiv_id":"2603.25702","snapshot_observed_at":"2026-07-02T19:07:17.196322Z","title":"S2D2: Fast Decoding for Diffusion LLMs via Training-Free Self-Speculation","venue":"cs.CL","work_id":"8cfc1e4c-cc83-4ed2-bf75-0a19b076f71b","year":2026},"citing_paper":{"arxiv_id":"2607.00208","last_updated":"2026-06-30T21:38:46Z","snapshot_observed_at":"2026-07-07T00:05:54.401681Z","submitted_at":"2026-06-30T21:38:46Z","title":"SLIM-RL: Risk-Budgeted Random-Masking RL for Diffusion LLMs Without Trajectory Slicing","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-02T19:05:59.651008Z"},"links":{"cited_paper":"/paper/2603.25702","citing_paper":"/paper/2607.00208"},"observation_digest":"sha256:c11abc326701fc48262222ff950d4a6a34f0196dd690319441b65925e3dcf2c6","observation_id":"443aa055-7659-442c-847a-134bbc50d529","resolution":{"observed_at":"2026-07-02T19:07:17.197492Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2603.25702/citation-record","integrity":"/paper/2603.25702/integrity","json":"/paper/2603.25702/citation-record.json","paper":"/paper/2603.25702"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2503.09573","last_updated":"2025-05-17T21:15:02Z","snapshot_observed_at":"2026-08-03T23:49:05.512328Z","submitted_at":"2025-03-12T17:43:40Z","title":"Block Diffusion: Interpolating Between Autoregressive and Diffusion Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.09573","snapshot_observed_at":"2026-07-13T18:04:43.103159Z","title":"Block diffusion: Interpolating between autoregressive and diffusion language models.arXiv preprint arXiv:2503.09573,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.25702","last_updated":"2026-06-17T19:47:34Z","snapshot_observed_at":"2026-08-03T00:06:56.242578Z","submitted_at":"2026-03-26T17:48:50Z","title":"S2D2: Fast Decoding for Diffusion LLMs via Training-Free Self-Speculation","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-13T18:04:43.103159Z"},"links":{"cited_paper":"/paper/2503.09573","citing_paper":"/paper/2603.25702"},"observation_digest":"sha256:589d097670b68281a22c60db2597b10dbaec110d1629e6cc05b4f269ee3b176c","observation_id":"4829eb2a-6f8a-4f22-aa28-c6993fa45988","resolution":{"observed_at":"2026-07-13T18:04:43.103159Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.07732","last_updated":"2021-08-16T03:57:30Z","snapshot_observed_at":"2026-08-02T19:23:53.535075Z","submitted_at":"2021-08-16T03:57:30Z","title":"Program Synthesis with Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.07732","snapshot_observed_at":"2026-07-13T18:04:43.103159Z","title":"Structured denoising diffusion models in discrete state-spaces.Advances in neural informa- tion processing systems, 34:17981–17993, 2021a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.25702","last_updated":"2026-06-17T19:47:34Z","snapshot_observed_at":"2026-08-03T00:06:56.242578Z","submitted_at":"2026-03-26T17:48:50Z","title":"S2D2: Fast Decoding for Diffusion LLMs via Training-Free Self-Speculation","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-13T18:04:43.103159Z"},"links":{"cited_paper":"/paper/2108.07732","citing_paper":"/paper/2603.25702"},"observation_digest":"sha256:be419f7ac2eea278d98c913ac93dcb6e32588b90b1f749f9294579d93ac0d574","observation_id":"f5500d6a-2e2c-4da7-a14e-173a816aacc1","resolution":{"observed_at":"2026-07-13T18:04:43.103159Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T18:04:43.103159Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.25702","last_updated":"2026-06-17T19:47:34Z","snapshot_observed_at":"2026-08-03T00:06:56.242578Z","submitted_at":"2026-03-26T17:48:50Z","title":"S2D2: Fast Decoding for Diffusion LLMs via Training-Free Self-Speculation","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-13T18:04:43.103159Z"},"links":{"citing_paper":"/paper/2603.25702"},"observation_digest":"sha256:c4e83198f37cc4bea339c6ae5e7da063612f6ead91d4dba70f6f7ee56c274ed6","observation_id":"a4ea8734-dcde-41b0-9b76-3f33d12db70f","resolution":{"observed_at":"2026-07-13T18:04:43.103159Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T18:04:43.103159Z","title":"Language models are few-shot learners.Advances in neural information processing systems, 33:1877–1901,","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2603.25702","last_updated":"2026-06-17T19:47:34Z","snapshot_observed_at":"2026-08-03T00:06:56.242578Z","submitted_at":"2026-03-26T17:48:50Z","title":"S2D2: Fast Decoding for Diffusion LLMs via Training-Free Self-Speculation","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-13T18:04:43.103159Z"},"links":{"citing_paper":"/paper/2603.25702"},"observation_digest":"sha256:31611f7c3366239f5bd24c8bb563b8eccad61c1b7c68da9b6f39bdc6b096f3b1","observation_id":"364f4169-c0e8-42c0-9ec1-7464df6e989c","resolution":{"observed_at":"2026-07-13T18:04:43.103159Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.01318","last_updated":"2023-02-02T18:44:11Z","snapshot_observed_at":"2026-08-10T21:52:49.568983Z","submitted_at":"2023-02-02T18:44:11Z","title":"Accelerating Large Language Model Decoding with Speculative Sampling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.01318","snapshot_observed_at":"2026-07-13T18:04:43.103159Z","title":"Accelerating large language model decoding with speculative sampling","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.25702","last_updated":"2026-06-17T19:47:34Z","snapshot_observed_at":"2026-08-03T00:06:56.242578Z","submitted_at":"2026-03-26T17:48:50Z","title":"S2D2: Fast Decoding for Diffusion LLMs via Training-Free Self-Speculation","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-13T18:04:43.103159Z"},"links":{"cited_paper":"/paper/2302.01318","citing_paper":"/paper/2603.25702"},"observation_digest":"sha256:0d51e60b997826ceaff01c82f5f19a39e18ad9f5539d059ff6f6b024afc9db48","observation_id":"df6062e7-bdd6-4361-8ae5-94b9e0c96894","resolution":{"observed_at":"2026-07-13T18:04:43.103159Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-08-08T11:58:24.516369Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-07-13T18:04:43.103159Z","title":"Evaluating large language models trained on code.arXiv preprint arXiv:2107.03374,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.25702","last_updated":"2026-06-17T19:47:34Z","snapshot_observed_at":"2026-08-03T00:06:56.242578Z","submitted_at":"2026-03-26T17:48:50Z","title":"S2D2: Fast Decoding for Diffusion LLMs via Training-Free Self-Speculation","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-13T18:04:43.103159Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2603.25702"},"observation_digest":"sha256:6b2238230ebd4162e2cf2b944deb3205b9ab4bab99bb09e2313942ddfee8f75b","observation_id":"d56dc2c3-b0e3-44de-ba24-0bf397b3141e","resolution":{"observed_at":"2026-07-13T18:04:43.103159Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T18:04:43.103159Z","title":"Sdar: A synergistic diffusion- autoregression paradigm for scalable sequence generation.arXiv preprint arXiv:2510.06303,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.25702","last_updated":"2026-06-17T19:47:34Z","snapshot_observed_at":"2026-08-03T00:06:56.242578Z","submitted_at":"2026-03-26T17:48:50Z","title":"S2D2: Fast Decoding for Diffusion LLMs via Training-Free Self-Speculation","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-13T18:04:43.103159Z"},"links":{"citing_paper":"/paper/2603.25702"},"observation_digest":"sha256:fe4b106fb3814fa5fd3bb10c500bb677d9ce19d51be70d29627a96ecbc792cc2","observation_id":"b5e646e0-0031-41cb-9145-a9e7f3057500","resolution":{"observed_at":"2026-07-13T18:04:43.103159Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.14687","last_updated":"2024-05-20T04:23:45Z","snapshot_observed_at":"2026-08-03T03:59:22.374270Z","submitted_at":"2022-09-29T11:12:27Z","title":"Diffusion Posterior Sampling for General Noisy Inverse Problems","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.14687","snapshot_observed_at":"2026-07-13T18:04:43.103159Z","title":"Diffusion posterior sampling for general noisy inverse problems.arXiv preprint arXiv:2209.14687,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.25702","last_updated":"2026-06-17T19:47:34Z","snapshot_observed_at":"2026-08-03T00:06:56.242578Z","submitted_at":"2026-03-26T17:48:50Z","title":"S2D2: Fast Decoding for Diffusion LLMs via Training-Free Self-Speculation","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-13T18:04:43.103159Z"},"links":{"cited_paper":"/paper/2209.14687","citing_paper":"/paper/2603.25702"},"observation_digest":"sha256:d9a291f827c05d36164e7dfb2062142def99d76d34347f40f5c2309601f1b9a7","observation_id":"e536e719-58ca-449e-982e-4787a9209db3","resolution":{"observed_at":"2026-07-13T18:04:43.103159Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-07-13T18:04:43.103159Z","title":"Training verifiers to solve math word problems.arXiv preprint arXiv:2110.14168,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.25702","last_updated":"2026-06-17T19:47:34Z","snapshot_observed_at":"2026-08-03T00:06:56.242578Z","submitted_at":"2026-03-26T17:48:50Z","title":"S2D2: Fast Decoding for Diffusion LLMs via Training-Free Self-Speculation","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-13T18:04:43.103159Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2603.25702"},"observation_digest":"sha256:9a0b9bd535dc2b62bc02befb9541b6b756ae885a86111d02b3d45a011aa24aa0","observation_id":"aaaac26e-cad6-4668-8187-0d302c3366e6","resolution":{"observed_at":"2026-07-13T18:04:43.103159Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T18:04:43.103159Z","title":"10 Preprint","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.25702","last_updated":"2026-06-17T19:47:34Z","snapshot_observed_at":"2026-08-03T00:06:56.242578Z","submitted_at":"2026-03-26T17:48:50Z","title":"S2D2: Fast Decoding for Diffusion LLMs via Training-Free Self-Speculation","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-13T18:04:43.103159Z"},"links":{"citing_paper":"/paper/2603.25702"},"observation_digest":"sha256:54a56f85ace934f6abdfb28d1166e0f0f13e6463d2bdeec7aa59578aabe07c87","observation_id":"95b798df-7ff5-48ab-bde6-0dba62eae9d7","resolution":{"observed_at":"2026-07-13T18:04:43.103159Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.17891","last_updated":"2025-05-31T07:01:57Z","snapshot_observed_at":"2026-08-12T13:46:51.848016Z","submitted_at":"2024-10-23T14:04:22Z","title":"Scaling Diffusion Language Models via Adaptation from Autoregressive Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.17891","snapshot_observed_at":"2026-07-13T18:04:43.103159Z","title":"Scaling diffusion language models via adapta- tion from autoregressive models.arXiv preprint arXiv:2410.17891,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.25702","last_updated":"2026-06-17T19:47:34Z","snapshot_observed_at":"2026-08-03T00:06:56.242578Z","submitted_at":"2026-03-26T17:48:50Z","title":"S2D2: Fast Decoding for Diffusion LLMs via Training-Free Self-Speculation","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-13T18:04:43.103159Z"},"links":{"cited_paper":"/paper/2410.17891","citing_paper":"/paper/2603.25702"},"observation_digest":"sha256:2d492166a0f2483e49887db39ee29809c7989d5ac18ce858b7df4ab127a7f8b6","observation_id":"bc13c5b0-a12a-4e8d-9ce4-3f45114246d9","resolution":{"observed_at":"2026-07-13T18:04:43.103159Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.20639","last_updated":"2025-06-26T15:46:40Z","snapshot_observed_at":"2026-08-06T22:41:34.301841Z","submitted_at":"2025-06-25T17:35:47Z","title":"DiffuCoder: Understanding and Improving Masked Diffusion Models for Code Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.20639","snapshot_observed_at":"2026-07-13T18:04:43.103159Z","title":"Diffucoder: Understanding and improving masked diffusion models for code generation.arXiv preprint arXiv:2506.20639,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.25702","last_updated":"2026-06-17T19:47:34Z","snapshot_observed_at":"2026-08-03T00:06:56.242578Z","submitted_at":"2026-03-26T17:48:50Z","title":"S2D2: Fast Decoding for Diffusion LLMs via Training-Free Self-Speculation","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-13T18:04:43.103159Z"},"links":{"cited_paper":"/paper/2506.20639","citing_paper":"/paper/2603.25702"},"observation_digest":"sha256:5a7d98b4ebde83e90928f797f3842de81014bb95e9344d5fac1f75b7ebdf4a1c","observation_id":"d51c7a66-1170-4051-a65d-19dcee1f0a86","resolution":{"observed_at":"2026-07-13T18:04:43.103159Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-08-13T09:12:54.999095Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-07-13T18:04:43.103159Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning.arXiv preprint arXiv:2501.12948,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.25702","last_updated":"2026-06-17T19:47:34Z","snapshot_observed_at":"2026-08-03T00:06:56.242578Z","submitted_at":"2026-03-26T17:48:50Z","title":"S2D2: Fast Decoding for Diffusion LLMs via Training-Free Self-Speculation","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-13T18:04:43.103159Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2603.25702"},"observation_digest":"sha256:ff1bba2cfa33c49c1790ece49a32e490bae20fa82fc32d4c701cf1e96dda4e04","observation_id":"708100e4-986f-4eac-b85b-692a3a7e03bc","resolution":{"observed_at":"2026-07-13T18:04:43.103159Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.20456","last_updated":"2025-04-29T06:33:13Z","snapshot_observed_at":"2026-08-09T03:21:35.266149Z","submitted_at":"2025-04-29T06:33:13Z","title":"Reviving Any-Subset Autoregressive Models with Principled Parallel Sampling and Speculative Decoding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.20456","snapshot_observed_at":"2026-07-13T18:04:43.103159Z","title":"Reviving any-subset autoregressive models with principled parallel sampling and speculative decoding.arXiv preprint arXiv:2504.20456,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.25702","last_updated":"2026-06-17T19:47:34Z","snapshot_observed_at":"2026-08-03T00:06:56.242578Z","submitted_at":"2026-03-26T17:48:50Z","title":"S2D2: Fast Decoding for Diffusion LLMs via Training-Free Self-Speculation","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-13T18:04:43.103159Z"},"links":{"cited_paper":"/paper/2504.20456","citing_paper":"/paper/2603.25702"},"observation_digest":"sha256:3b69a9dc5d431fd10f8414f0f18f4395da03e7d46a3843bcf1bf84ca2e9c699b","observation_id":"a4277ab7-b59f-445f-bd19-47f69a5d823e","resolution":{"observed_at":"2026-07-13T18:04:43.103159Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.02037","last_updated":"2022-02-01T21:32:15Z","snapshot_observed_at":"2026-08-10T08:25:20.862768Z","submitted_at":"2021-10-05T13:36:55Z","title":"Autoregressive Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.02037","snapshot_observed_at":"2026-07-13T18:04:43.103159Z","title":"Autoregressive diffusion models.arXiv preprint arXiv:2110.02037,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.25702","last_updated":"2026-06-17T19:47:34Z","snapshot_observed_at":"2026-08-03T00:06:56.242578Z","submitted_at":"2026-03-26T17:48:50Z","title":"S2D2: Fast Decoding for Diffusion LLMs via Training-Free Self-Speculation","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-13T18:04:43.103159Z"},"links":{"cited_paper":"/paper/2110.02037","citing_paper":"/paper/2603.25702"},"observation_digest":"sha256:9eca0d9e6120fdbd54370d5eac996e9646e975f8ba514f912b1bd1f091a750db","observation_id":"fd36c94d-0c3c-44b0-aec0-791d2332b0e7","resolution":{"observed_at":"2026-07-13T18:04:43.103159Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16720","last_updated":"2026-04-30T02:46:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-21T18:04:31Z","title":"OpenAI o1 System Card","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.16720","snapshot_observed_at":"2026-07-13T18:04:43.103159Z","title":"Openai o1 system card","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.25702","last_updated":"2026-06-17T19:47:34Z","snapshot_observed_at":"2026-08-03T00:06:56.242578Z","submitted_at":"2026-03-26T17:48:50Z","title":"S2D2: Fast Decoding for Diffusion LLMs via Training-Free Self-Speculation","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-13T18:04:43.103159Z"},"links":{"cited_paper":"/paper/2412.16720","citing_paper":"/paper/2603.25702"},"observation_digest":"sha256:70d4de8020cf7fdf78f7615639a9f5091d9fd486fb624155b78dfcafc122fdca","observation_id":"5758b39c-06d0-435f-a73f-c67fa53df06c","resolution":{"observed_at":"2026-07-13T18:04:43.103159Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.17298","last_updated":"2025-06-17T17:06:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-17T17:06:18Z","title":"Mercury: Ultra-Fast Language Models Based on Diffusion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.17298","snapshot_observed_at":"2026-07-13T18:04:43.103159Z","title":"Mercury: Ultra-fast language models based on diffusion.arXiv preprint arXiv:2506.17298,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.25702","last_updated":"2026-06-17T19:47:34Z","snapshot_observed_at":"2026-08-03T00:06:56.242578Z","submitted_at":"2026-03-26T17:48:50Z","title":"S2D2: Fast Decoding for Diffusion LLMs via Training-Free Self-Speculation","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-13T18:04:43.103159Z"},"links":{"cited_paper":"/paper/2506.17298","citing_paper":"/paper/2603.25702"},"observation_digest":"sha256:1a667d367811b2dc4e2fcb5e8852eacf3d2ab8a2303b63c589c8bffd559791f7","observation_id":"3780ceec-99a9-47ae-a38c-1b9d165e823a","resolution":{"observed_at":"2026-07-13T18:04:43.103159Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T18:04:43.103159Z","title":"Refusion: A diffusion large language model with parallel autoregressive decoding.arXiv preprint arXiv:2512.13586,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.25702","last_updated":"2026-06-17T19:47:34Z","snapshot_observed_at":"2026-08-03T00:06:56.242578Z","submitted_at":"2026-03-26T17:48:50Z","title":"S2D2: Fast Decoding for Diffusion LLMs via Training-Free Self-Speculation","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-13T18:04:43.103159Z"},"links":{"citing_paper":"/paper/2603.25702"},"observation_digest":"sha256:368d75b158d0836fe43f6dfa355a66bacdcadbb6bdb4285a0e860d2e06420e08","observation_id":"70ce1caa-b2da-41a2-9a9f-fdf2b0eb0851","resolution":{"observed_at":"2026-07-13T18:04:43.103159Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.16834","last_updated":"2024-06-06T21:06:44Z","snapshot_observed_at":"2026-07-06T16:38:29.188225Z","submitted_at":"2023-10-25T17:59:12Z","title":"Discrete Diffusion Modeling by Estimating the Ratios of the Data Distribution","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.16834","snapshot_observed_at":"2026-07-13T18:04:43.103159Z","title":"Discrete diffusion modeling by estimating the ratios of the data distribution.arXiv preprint arXiv:2310.16834,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.25702","last_updated":"2026-06-17T19:47:34Z","snapshot_observed_at":"2026-08-03T00:06:56.242578Z","submitted_at":"2026-03-26T17:48:50Z","title":"S2D2: Fast Decoding for Diffusion LLMs via Training-Free Self-Speculation","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-13T18:04:43.103159Z"},"links":{"cited_paper":"/paper/2310.16834","citing_paper":"/paper/2603.25702"},"observation_digest":"sha256:935f5fc397ed37572372eaa5c2f2686b538745b858d6338b9eefecdf2308126b","observation_id":"b8a44d21-51ad-424a-90e4-5ee8e942077b","resolution":{"observed_at":"2026-07-13T18:04:43.103159Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.09992","last_updated":"2025-10-18T15:35:05Z","snapshot_observed_at":"2026-08-04T04:34:22.998376Z","submitted_at":"2025-02-14T08:23:51Z","title":"Large Language Diffusion Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.09992","snapshot_observed_at":"2026-07-13T18:04:43.103159Z","title":"Large language diffusion models.arXiv preprint arXiv:2502.09992,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.25702","last_updated":"2026-06-17T19:47:34Z","snapshot_observed_at":"2026-08-03T00:06:56.242578Z","submitted_at":"2026-03-26T17:48:50Z","title":"S2D2: Fast Decoding for Diffusion LLMs via Training-Free Self-Speculation","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-13T18:04:43.103159Z"},"links":{"cited_paper":"/paper/2502.09992","citing_paper":"/paper/2603.25702"},"observation_digest":"sha256:05014d898db7007011003def67113031f497a2eaeb8cbcb6e7032b4c61187cce","observation_id":"9aa6d7d5-d265-404d-87ce-be380ec7dd4f","resolution":{"observed_at":"2026-07-13T18:04:43.103159Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.01928","last_updated":"2026-08-05T00:02:32Z","snapshot_observed_at":"2026-08-08T23:08:57.113826Z","submitted_at":"2025-06-02T17:47:27Z","title":"Esoteric Language Models: A Family of Any-Order Diffusion LLMs","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.01928","snapshot_observed_at":"2026-07-13T18:04:43.103159Z","title":"Yair Schiff, Subham Sekhar Sahoo, Hao Phung, Guanghan Wang, Sam Boshar, Hugo Dalla- torre, Bernardo P de Almeida, Alexander M Rush, Thomas PIERROT, and Volodymyr Kuleshov","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.25702","last_updated":"2026-06-17T19:47:34Z","snapshot_observed_at":"2026-08-03T00:06:56.242578Z","submitted_at":"2026-03-26T17:48:50Z","title":"S2D2: Fast Decoding for Diffusion LLMs via Training-Free Self-Speculation","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-13T18:04:43.103159Z"},"links":{"cited_paper":"/paper/2506.01928","citing_paper":"/paper/2603.25702"},"observation_digest":"sha256:8ca149dd34e77612429eb9c6dd6680fa56d3126abf08636259cb3d67e72b6c25","observation_id":"eb1cb518-da32-434c-9f71-3c5839a46b04","resolution":{"observed_at":"2026-07-13T18:04:43.103159Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-07-13T18:04:43.103159Z","title":"Llama: Open and efficient foundation language models.arXiv preprint arXiv:2302.13971,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.25702","last_updated":"2026-06-17T19:47:34Z","snapshot_observed_at":"2026-08-03T00:06:56.242578Z","submitted_at":"2026-03-26T17:48:50Z","title":"S2D2: Fast Decoding for Diffusion LLMs via Training-Free Self-Speculation","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-13T18:04:43.103159Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2603.25702"},"observation_digest":"sha256:398e60949b373cb70f010bf9ce87dca4d260741d0fe1909dade658a667226fa1","observation_id":"09ead617-5a96-4fc0-a609-2e4d0c547aed","resolution":{"observed_at":"2026-07-13T18:04:43.103159Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.09192","last_updated":"2025-08-08T04:51:37Z","snapshot_observed_at":"2026-08-13T05:22:59.274069Z","submitted_at":"2025-08-08T04:51:37Z","title":"Diffusion LLMs Can Do Faster-Than-AR Inference via Discrete Diffusion Forcing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.09192","snapshot_observed_at":"2026-07-13T18:04:43.103159Z","title":"Diffusion llms can do faster-than-ar inference via discrete diffusion forcing.arXiv preprint arXiv:2508.09192,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.25702","last_updated":"2026-06-17T19:47:34Z","snapshot_observed_at":"2026-08-03T00:06:56.242578Z","submitted_at":"2026-03-26T17:48:50Z","title":"S2D2: Fast Decoding for Diffusion LLMs via Training-Free Self-Speculation","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-13T18:04:43.103159Z"},"links":{"cited_paper":"/paper/2508.09192","citing_paper":"/paper/2603.25702"},"observation_digest":"sha256:6857bc4002dd97bfc50780cde653bd3e763864b0818fa00a20ac82164b71beec","observation_id":"47a1290f-5742-4fe3-bd48-d83febc5e97a","resolution":{"observed_at":"2026-07-13T18:04:43.103159Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.22618","last_updated":"2025-07-03T04:51:05Z","snapshot_observed_at":"2026-07-06T21:32:23.537939Z","submitted_at":"2025-05-28T17:39:15Z","title":"Fast-dLLM: Training-free Acceleration of Diffusion LLM by Enabling KV Cache and Parallel Decoding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.22618","snapshot_observed_at":"2026-07-13T18:04:43.103159Z","title":"Minkai Xu, Tomas Geffner, Karsten Kreis, Weili Nie, Yilun Xu, Jure Leskovec, Stefano Ermon, and Arash Vahdat","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.25702","last_updated":"2026-06-17T19:47:34Z","snapshot_observed_at":"2026-08-03T00:06:56.242578Z","submitted_at":"2026-03-26T17:48:50Z","title":"S2D2: Fast Decoding for Diffusion LLMs via Training-Free Self-Speculation","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-13T18:04:43.103159Z"},"links":{"cited_paper":"/paper/2505.22618","citing_paper":"/paper/2603.25702"},"observation_digest":"sha256:5f456dec28d6e2861fcc4b0e6244d3027095ecc31e794320a36a843c982f5b6d","observation_id":"f090f280-44ea-414e-8f89-19a32685d396","resolution":{"observed_at":"2026-07-13T18:04:43.103159Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.15487","last_updated":"2025-08-21T12:09:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-08-21T12:09:58Z","title":"Dream 7B: Diffusion Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.15487","snapshot_observed_at":"2026-07-13T18:04:43.103159Z","title":"Dream 7b: Diffusion large language models.arXiv preprint arXiv:2508.15487,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.25702","last_updated":"2026-06-17T19:47:34Z","snapshot_observed_at":"2026-08-03T00:06:56.242578Z","submitted_at":"2026-03-26T17:48:50Z","title":"S2D2: Fast Decoding for Diffusion LLMs via Training-Free Self-Speculation","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-07-13T18:04:43.103159Z"},"links":{"cited_paper":"/paper/2508.15487","citing_paper":"/paper/2603.25702"},"observation_digest":"sha256:5cbd5b883cc7f9a85c44d8f0515b407eea90034479b3d37c528ecb5f0dcbd8af","observation_id":"823489ff-9d51-4cb4-b503-729c188bfe32","resolution":{"observed_at":"2026-07-13T18:04:43.103159Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T18:04:43.103159Z","title":"Redi: Rectified discrete flow.arXiv preprint arXiv:2507.15897,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.25702","last_updated":"2026-06-17T19:47:34Z","snapshot_observed_at":"2026-08-03T00:06:56.242578Z","submitted_at":"2026-03-26T17:48:50Z","title":"S2D2: Fast Decoding for Diffusion LLMs via Training-Free Self-Speculation","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-07-13T18:04:43.103159Z"},"links":{"citing_paper":"/paper/2603.25702"},"observation_digest":"sha256:11351121020a9cf2d82f10f77bca3100041343a0945f656777454939cd4e3fbf","observation_id":"4a5838c8-507e-43b3-a947-d79ac92f4a06","resolution":{"observed_at":"2026-07-13T18:04:43.103159Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T18:04:43.103159Z","title":"T3d: Few-step diffusion language models via trajectory self-distillation with direct discriminative optimization","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.25702","last_updated":"2026-06-17T19:47:34Z","snapshot_observed_at":"2026-08-03T00:06:56.242578Z","submitted_at":"2026-03-26T17:48:50Z","title":"S2D2: Fast Decoding for Diffusion LLMs via Training-Free Self-Speculation","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-07-13T18:04:43.103159Z"},"links":{"citing_paper":"/paper/2603.25702"},"observation_digest":"sha256:923ac9453deb0b280a8b4466514caf22cc7c62204e6f11c331e48d6ed9458221","observation_id":"b08e058c-6a18-40fd-ac36-ef4215294e58","resolution":{"observed_at":"2026-07-13T18:04:43.103159Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T18:04:43.103159Z","title":"Variational masked diffusion models.arXiv preprint arXiv:2510.23606,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.25702","last_updated":"2026-06-17T19:47:34Z","snapshot_observed_at":"2026-08-03T00:06:56.242578Z","submitted_at":"2026-03-26T17:48:50Z","title":"S2D2: Fast Decoding for Diffusion LLMs via Training-Free Self-Speculation","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-07-13T18:04:43.103159Z"},"links":{"citing_paper":"/paper/2603.25702"},"observation_digest":"sha256:011bb315893dd942f91d310f8abbae7c88c26ffe496042b050a8c3894cec1ae2","observation_id":"4eae701c-c172-4617-9ca3-4db8af900d0f","resolution":{"observed_at":"2026-07-13T18:04:43.103159Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01103","last_updated":"2025-06-21T15:54:27Z","snapshot_observed_at":"2026-08-09T10:35:33.740382Z","submitted_at":"2025-03-03T02:06:22Z","title":"Direct Discriminative Optimization: Your Likelihood-Based Visual Generative Model is Secretly a GAN Discriminator","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.01103","snapshot_observed_at":"2026-07-13T18:04:43.103159Z","title":"Direct discriminative optimization: Your likelihood-based visual generative model is secretly a gan discriminator.arXiv preprint arXiv:2503.01103,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.25702","last_updated":"2026-06-17T19:47:34Z","snapshot_observed_at":"2026-08-03T00:06:56.242578Z","submitted_at":"2026-03-26T17:48:50Z","title":"S2D2: Fast Decoding for Diffusion LLMs via Training-Free Self-Speculation","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-07-13T18:04:43.103159Z"},"links":{"cited_paper":"/paper/2503.01103","citing_paper":"/paper/2603.25702"},"observation_digest":"sha256:81d0cc44a879658f3321b1c6b83269dae14657087382967b5fad40357ca7d084","observation_id":"593c4f96-9124-42ac-8815-f9b576ada248","resolution":{"observed_at":"2026-07-13T18:04:43.103159Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.07911","last_updated":"2023-11-14T05:13:55Z","snapshot_observed_at":"2026-07-06T16:47:08.877195Z","submitted_at":"2023-11-14T05:13:55Z","title":"Instruction-Following Evaluation for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.07911","snapshot_observed_at":"2026-07-13T18:04:43.103159Z","title":"Instruction-following evaluation for large language models.arXiv preprint arXiv:2311.07911,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.25702","last_updated":"2026-06-17T19:47:34Z","snapshot_observed_at":"2026-08-03T00:06:56.242578Z","submitted_at":"2026-03-26T17:48:50Z","title":"S2D2: Fast Decoding for Diffusion LLMs via Training-Free Self-Speculation","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-07-13T18:04:43.103159Z"},"links":{"cited_paper":"/paper/2311.07911","citing_paper":"/paper/2603.25702"},"observation_digest":"sha256:e990e944f57d0a0209dc542f9be68c14cd5425e77c1e52f98b20a1f57a5f7b70","observation_id":"d02f3d94-db22-4a46-bb10-cec9f9184889","resolution":{"observed_at":"2026-07-13T18:04:43.103159Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T18:04:43.103159Z","title":"Instead, after a draft forward pass, it selects which positions to unmask using token confidence, either according to a fixed schedule or a dynamic threshold","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2603.25702","last_updated":"2026-06-17T19:47:34Z","snapshot_observed_at":"2026-08-03T00:06:56.242578Z","submitted_at":"2026-03-26T17:48:50Z","title":"S2D2: Fast Decoding for Diffusion LLMs via Training-Free Self-Speculation","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-07-13T18:04:43.103159Z"},"links":{"citing_paper":"/paper/2603.25702"},"observation_digest":"sha256:896e35928e72397034d2b86ef7fe01612682b13f3b965c61d64d59b79829f2ab","observation_id":"59953967-e650-42af-b8a0-8b1cd7263fcc","resolution":{"observed_at":"2026-07-13T18:04:43.103159Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T18:04:43.103159Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.25702","last_updated":"2026-06-17T19:47:34Z","snapshot_observed_at":"2026-08-03T00:06:56.242578Z","submitted_at":"2026-03-26T17:48:50Z","title":"S2D2: Fast Decoding for Diffusion LLMs via Training-Free Self-Speculation","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-07-13T18:04:43.103159Z"},"links":{"citing_paper":"/paper/2603.25702"},"observation_digest":"sha256:668ebfe19429227b470448b57533b0ca1c769a54d2064b5cd7a5df1a98fa2dfb","observation_id":"848e11d9-6f69-4ac9-93ab-37d2ee01aa66","resolution":{"observed_at":"2026-07-13T18:04:43.103159Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2603.25702","last_updated":"2026-06-17T19:47:34Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-03T00:06:56.242578Z","submitted_at":"2026-03-26T17:48:50Z","title":"S2D2: Fast Decoding for Diffusion LLMs via Training-Free Self-Speculation"},"reference_resolution":{"displayed":32,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":32,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":32},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 32 of 32 outbound references and 1 inbound Pith citation observation for arXiv:2603.25702."}