{"as_of":"2026-08-12T20:44:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:1e5131493926b92b7622d41c47866d20649fb8a5cbaa6d338f725f18ea603953","coverage":[{"denominator":18,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":18,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T17:41:04.567291Z","state":"measured"},{"denominator":18,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":18,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.09424/citation-record","integrity":"/paper/2608.09424/integrity","json":"/paper/2608.09424/citation-record.json","paper":"/paper/2608.09424"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2512.15745","last_updated":"2025-12-24T03:46:46Z","snapshot_observed_at":"2026-08-10T07:50:38.265616Z","submitted_at":"2025-12-10T09:26:18Z","title":"LLaDA2.0: Scaling Up Diffusion Language Models to 100B","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2512.15745","snapshot_observed_at":"2026-08-11T17:41:04.518726Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09424","last_updated":"2026-08-10T10:52:20Z","snapshot_observed_at":"2026-08-12T20:19:31.307522Z","submitted_at":"2026-08-10T10:52:20Z","title":"Reducing Pretraining-Generation Mismatch in Diffusion Language Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-11T17:41:04.518726Z"},"links":{"cited_paper":"/paper/2512.15745","citing_paper":"/paper/2608.09424"},"observation_digest":"sha256:517d24fcb5d018a4f3c90ce94c14afe01cb7f9912e6538bd783bb01a0b900011","observation_id":"ebc3caff-58f0-4648-885f-3daa5839a23d","resolution":{"observed_at":"2026-08-11T17:41:04.518726Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.03677","last_updated":"2026-04-04T10:26:36Z","snapshot_observed_at":"2026-08-11T16:38:55.822985Z","submitted_at":"2026-04-04T10:26:36Z","title":"Unlocking Prompt Infilling Capability for Diffusion Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.03677","snapshot_observed_at":"2026-08-11T17:41:04.533398Z","title":"Marjan Ghazvininejad, Omer Levy, Yinhan Liu, and Luke Zettlemoyer","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.09424","last_updated":"2026-08-10T10:52:20Z","snapshot_observed_at":"2026-08-12T20:19:31.307522Z","submitted_at":"2026-08-10T10:52:20Z","title":"Reducing Pretraining-Generation Mismatch in Diffusion Language Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-11T17:41:04.533398Z"},"links":{"cited_paper":"/paper/2604.03677","citing_paper":"/paper/2608.09424"},"observation_digest":"sha256:ca2c7542f704ce103234cf63d28824932386724a09d833ef3704bc4911433954","observation_id":"20e6ed0d-672f-402d-acb7-e400a9931cad","resolution":{"observed_at":"2026-08-11T17:41:04.533398Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:41:04.536748Z","title":"URL https: //aclanthology.org/D19-1633/","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09424","last_updated":"2026-08-10T10:52:20Z","snapshot_observed_at":"2026-08-12T20:19:31.307522Z","submitted_at":"2026-08-10T10:52:20Z","title":"Reducing Pretraining-Generation Mismatch in Diffusion Language Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T17:41:04.536748Z"},"links":{"citing_paper":"/paper/2608.09424"},"observation_digest":"sha256:633421a495be033c7d90d132a5e51aba9f68ca7a9a866f82b1299f665f814b44","observation_id":"25a4c3d8-0484-4bd9-a90c-94635d128599","resolution":{"observed_at":"2026-08-11T17:41:04.536748Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:41:04.781532Z","title":"Emiel Hoogeboom, Didrik Nielsen, Priyank Jaini, Patrick Forré, and Max Welling","venue":null,"work_id":"60c30891-9adb-43a0-bb72-5395bd1769c0","year":2020},"citing_paper":{"arxiv_id":"2608.09424","last_updated":"2026-08-10T10:52:20Z","snapshot_observed_at":"2026-08-12T20:19:31.307522Z","submitted_at":"2026-08-10T10:52:20Z","title":"Reducing Pretraining-Generation Mismatch in Diffusion Language Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-11T17:41:04.539495Z"},"links":{"citing_paper":"/paper/2608.09424"},"observation_digest":"sha256:6ef9aa04889446bf5cea72244411fa6eb58517eaec08a04a82f655d17936262c","observation_id":"26dbd88c-3f47-45c5-83dc-f056f75d7420","resolution":{"observed_at":"2026-08-11T17:41:04.784411Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:41:04.773417Z","title":"Jason Lee, Elman Mansimov, and Kyunghyun Cho","venue":null,"work_id":"2bf6f726-7a93-40e4-9e88-b380eb0ae22e","year":2021},"citing_paper":{"arxiv_id":"2608.09424","last_updated":"2026-08-10T10:52:20Z","snapshot_observed_at":"2026-08-12T20:19:31.307522Z","submitted_at":"2026-08-10T10:52:20Z","title":"Reducing Pretraining-Generation Mismatch in Diffusion Language Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-11T17:41:04.542286Z"},"links":{"citing_paper":"/paper/2608.09424"},"observation_digest":"sha256:f0938bcaa769a0b007b772ae18a553b576cb283d714fd36144a2170de3800a19","observation_id":"a5198e69-4e23-4b37-b164-ebed22f860c0","resolution":{"observed_at":"2026-08-11T17:41:04.776460Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:41:04.765187Z","title":"Aaron Lou, Chenlin Meng, and Stefano Ermon","venue":null,"work_id":"8e836ecd-b9ff-4723-ac8f-8734f0668ca5","year":2022},"citing_paper":{"arxiv_id":"2608.09424","last_updated":"2026-08-10T10:52:20Z","snapshot_observed_at":"2026-08-12T20:19:31.307522Z","submitted_at":"2026-08-10T10:52:20Z","title":"Reducing Pretraining-Generation Mismatch in Diffusion Language Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T17:41:04.547623Z"},"links":{"citing_paper":"/paper/2608.09424"},"observation_digest":"sha256:914ebabb8d888b4732ef4782e919bc2f11f966690c64ce1e0cb051aeb9830c4c","observation_id":"a99c3cd9-a568-461a-abc5-3625d020d4b3","resolution":{"observed_at":"2026-08-11T17:41:04.768449Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.09992","last_updated":"2025-10-18T15:35:05Z","snapshot_observed_at":"2026-08-04T04:34:22.998376Z","submitted_at":"2025-02-14T08:23:51Z","title":"Large Language Diffusion Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.09992","snapshot_observed_at":"2026-08-11T17:41:04.553125Z","title":"Colin Raffel, Noam Shazeer, Adam Roberts, Katherine Lee, Sharan Narang, Michael Matena, Yanqi Zhou, Wei Li, and Peter J","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09424","last_updated":"2026-08-10T10:52:20Z","snapshot_observed_at":"2026-08-12T20:19:31.307522Z","submitted_at":"2026-08-10T10:52:20Z","title":"Reducing Pretraining-Generation Mismatch in Diffusion Language Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T17:41:04.553125Z"},"links":{"cited_paper":"/paper/2502.09992","citing_paper":"/paper/2608.09424"},"observation_digest":"sha256:c1910273a25d2f415a86c5536857b3eca107e9c4b4c2bf82ee94aa2103cf09c5","observation_id":"e88c29d0-dbcb-44db-ad17-3feb73dc2caa","resolution":{"observed_at":"2026-08-11T17:41:04.553125Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.07524","last_updated":"2024-11-10T20:34:34Z","snapshot_observed_at":"2026-08-10T20:57:25.396291Z","submitted_at":"2024-06-11T17:51:40Z","title":"Simple and Effective Masked Diffusion Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.07524","snapshot_observed_at":"2026-08-11T17:41:04.555962Z","title":"Jascha Sohl-Dickstein, Eric Weiss, Niru Maheswaranathan, and Surya Ganguli","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09424","last_updated":"2026-08-10T10:52:20Z","snapshot_observed_at":"2026-08-12T20:19:31.307522Z","submitted_at":"2026-08-10T10:52:20Z","title":"Reducing Pretraining-Generation Mismatch in Diffusion Language Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-11T17:41:04.555962Z"},"links":{"cited_paper":"/paper/2406.07524","citing_paper":"/paper/2608.09424"},"observation_digest":"sha256:6020dac7e0fe4300161cd1d8683bc9d2ba35baa4150388ede08efaa608ea4fe7","observation_id":"eecadad7-0abf-4605-a565-67329b38c3db","resolution":{"observed_at":"2026-08-11T17:41:04.555962Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.15487","last_updated":"2025-08-21T12:09:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-08-21T12:09:58Z","title":"Dream 7B: Diffusion Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.15487","snapshot_observed_at":"2026-08-11T17:41:04.564813Z","title":"Fengqi Zhu, Xinyue Wen, and Yankai Lin","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09424","last_updated":"2026-08-10T10:52:20Z","snapshot_observed_at":"2026-08-12T20:19:31.307522Z","submitted_at":"2026-08-10T10:52:20Z","title":"Reducing Pretraining-Generation Mismatch in Diffusion Language Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-11T17:41:04.564813Z"},"links":{"cited_paper":"/paper/2508.15487","citing_paper":"/paper/2608.09424"},"observation_digest":"sha256:f022b8dc87c145d620c31badcacf6d4b8cc33a21ac8c0e44734718c5e2fcc801","observation_id":"946dfb82-1895-4654-8765-f3287f501806","resolution":{"observed_at":"2026-08-11T17:41:04.564813Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:41:04.567291Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09424","last_updated":"2026-08-10T10:52:20Z","snapshot_observed_at":"2026-08-12T20:19:31.307522Z","submitted_at":"2026-08-10T10:52:20Z","title":"Reducing Pretraining-Generation Mismatch in Diffusion Language Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T17:41:04.567291Z"},"links":{"citing_paper":"/paper/2608.09424"},"observation_digest":"sha256:d7b1bc8cda2a6c0a0b39fd88e5493ef8235ba5d0f98a82b32fb8efc7edf60cd7","observation_id":"5dbfdacd-0202-4b06-be7b-f50a07571d21","resolution":{"observed_at":"2026-08-11T17:41:04.567291Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:41:04.755375Z","title":"Kaiyue Wen, Zhiyuan Li, Jason Wang, David Hall, Percy Liang, and Tengyu Ma","venue":null,"work_id":"defb45f0-ada1-430e-8c2f-8db8f3e5d03c","year":2017},"citing_paper":{"arxiv_id":"2608.09424","last_updated":"2026-08-10T10:52:20Z","snapshot_observed_at":"2026-08-12T20:19:31.307522Z","submitted_at":"2026-08-10T10:52:20Z","title":"Reducing Pretraining-Generation Mismatch in Diffusion Language Models","version":1},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-11T17:41:04.558804Z"},"links":{"citing_paper":"/paper/2608.09424"},"observation_digest":"sha256:bbb7ad9befdd6d88d1f214897fa619008bed69cd32962099586f5d02c641fb14","observation_id":"5fc0aa85-2b94-4be3-8aaa-a2af1df9e0ee","resolution":{"observed_at":"2026-08-11T17:41:04.759904Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:41:04.544858Z","title":"URLhttps://aclanthology.org/D18-1149/","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09424","last_updated":"2026-08-10T10:52:20Z","snapshot_observed_at":"2026-08-12T20:19:31.307522Z","submitted_at":"2026-08-10T10:52:20Z","title":"Reducing Pretraining-Generation Mismatch in Diffusion Language Models","version":1},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-11T17:41:04.544858Z"},"links":{"citing_paper":"/paper/2608.09424"},"observation_digest":"sha256:2a4f7495368989859b38a5d7b1179a216d4b10144bf80f711f9db3f0668ab728","observation_id":"87bb9d1d-c3c7-4a36-af39-677024d58bfb","resolution":{"observed_at":"2026-08-11T17:41:04.544858Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:41:04.527540Z","title":"URL https://aclanthology.org/N19-1423/","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09424","last_updated":"2026-08-10T10:52:20Z","snapshot_observed_at":"2026-08-12T20:19:31.307522Z","submitted_at":"2026-08-10T10:52:20Z","title":"Reducing Pretraining-Generation Mismatch in Diffusion Language Models","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-11T17:41:04.527540Z"},"links":{"citing_paper":"/paper/2608.09424"},"observation_digest":"sha256:b3f848407937734a13c56d48b9c50a46bf6c1f5ab7ac74ea17e35ac9786d198c","observation_id":"0460cba3-6433-4246-bf1c-7cfa03dcd2db","resolution":{"observed_at":"2026-08-11T17:41:04.527540Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:41:04.805252Z","title":"Huiwen Chang, Han Zhang, Lu Jiang, Ce Liu, and William T","venue":null,"work_id":"61eb9d30-fd56-4b40-b396-0648757f1a3a","year":2020},"citing_paper":{"arxiv_id":"2608.09424","last_updated":"2026-08-10T10:52:20Z","snapshot_observed_at":"2026-08-12T20:19:31.307522Z","submitted_at":"2026-08-10T10:52:20Z","title":"Reducing Pretraining-Generation Mismatch in Diffusion Language Models","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-11T17:41:04.521483Z"},"links":{"citing_paper":"/paper/2608.09424"},"observation_digest":"sha256:4fc9d1699f9a169e10d884e03dd6233241203a54d11f096aca58ccbbdcc0865a","observation_id":"582ea11d-268b-4172-aa85-f39ee6c8f7d3","resolution":{"observed_at":"2026-08-11T17:41:04.808068Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:41:04.797180Z","title":"Jacob Devlin, Ming-Wei Chang, Kenton Lee, and Kristina Toutanova","venue":null,"work_id":"ea1535b9-1565-418f-adb6-b0010ac7ed23","year":2019},"citing_paper":{"arxiv_id":"2608.09424","last_updated":"2026-08-10T10:52:20Z","snapshot_observed_at":"2026-08-12T20:19:31.307522Z","submitted_at":"2026-08-10T10:52:20Z","title":"Reducing Pretraining-Generation Mismatch in Diffusion Language Models","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-11T17:41:04.524500Z"},"links":{"citing_paper":"/paper/2608.09424"},"observation_digest":"sha256:26b396d77712bbc2b89f9996074154150558eedfd50cd356c2a9ec33bdde8ade","observation_id":"8daa65e5-8c0e-4748-a832-d6285a9a20d1","resolution":{"observed_at":"2026-08-11T17:41:04.800281Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.16834","last_updated":"2024-06-06T21:06:44Z","snapshot_observed_at":"2026-07-06T16:38:29.188225Z","submitted_at":"2023-10-25T17:59:12Z","title":"Discrete Diffusion Modeling by Estimating the Ratios of the Data Distribution","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.16834","snapshot_observed_at":"2026-08-11T17:41:04.550161Z","title":"Shen Nie, Fengqi Zhu, Zebin You, Xiaolu Zhang, Jingyang Ou, Jun Hu, Jun Zhou, Yankai Lin, Ji-Rong Wen, and Chongxuan Li","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09424","last_updated":"2026-08-10T10:52:20Z","snapshot_observed_at":"2026-08-12T20:19:31.307522Z","submitted_at":"2026-08-10T10:52:20Z","title":"Reducing Pretraining-Generation Mismatch in Diffusion Language Models","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-11T17:41:04.550161Z"},"links":{"cited_paper":"/paper/2310.16834","citing_paper":"/paper/2608.09424"},"observation_digest":"sha256:00b6413d7a17d3a2a3c5d0b4bf9dd1f04937b169051ddd56e90573198d0ab149","observation_id":"4c9b5066-887e-4306-817b-1dd1b9772f70","resolution":{"observed_at":"2026-08-11T17:41:04.550161Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09573","last_updated":"2025-05-17T21:15:02Z","snapshot_observed_at":"2026-08-03T23:49:05.512328Z","submitted_at":"2025-03-12T17:43:40Z","title":"Block Diffusion: Interpolating Between Autoregressive and Diffusion Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.09573","snapshot_observed_at":"2026-08-11T17:41:04.511402Z","title":"Jacob Austin, Daniel D","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09424","last_updated":"2026-08-10T10:52:20Z","snapshot_observed_at":"2026-08-12T20:19:31.307522Z","submitted_at":"2026-08-10T10:52:20Z","title":"Reducing Pretraining-Generation Mismatch in Diffusion Language Models","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-11T17:41:04.511402Z"},"links":{"cited_paper":"/paper/2503.09573","citing_paper":"/paper/2608.09424"},"observation_digest":"sha256:2d94eeab644d18a450ee7c4536136eb953c85291ef5383458f2dd7081f1e6fef","observation_id":"6d5efac5-3b8e-4541-8b02-dca1f6193b9d","resolution":{"observed_at":"2026-08-11T17:41:04.511402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:41:04.789375Z","title":"Yoshinari Fujinuma and Keisuke Sakaguchi","venue":null,"work_id":"0ac0fe3e-085c-4889-8dcd-dd308867f7ba","year":2026},"citing_paper":{"arxiv_id":"2608.09424","last_updated":"2026-08-10T10:52:20Z","snapshot_observed_at":"2026-08-12T20:19:31.307522Z","submitted_at":"2026-08-10T10:52:20Z","title":"Reducing Pretraining-Generation Mismatch in Diffusion Language Models","version":1},"reference_index":2026,"source":"pdf_text","source_observed_at":"2026-08-11T17:41:04.530637Z"},"links":{"citing_paper":"/paper/2608.09424"},"observation_digest":"sha256:fea9deb455a4d1d207869b9bd6f942f90d96a8a61a4f92d5b9b7375f0b87377c","observation_id":"c6422add-2561-4047-b86a-7e31d7803c4d","resolution":{"observed_at":"2026-08-11T17:41:04.791983Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.09424","last_updated":"2026-08-10T10:52:20Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-12T20:19:31.307522Z","submitted_at":"2026-08-10T10:52:20Z","title":"Reducing Pretraining-Generation Mismatch in Diffusion Language Models"},"reference_resolution":{"displayed":18,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":10,"verified_exact":0,"verified_fuzzy":7},"total_outbound_references":18},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 12 August 2026, this Paper Citation Record lists 18 of 18 outbound references and 0 inbound Pith citation observations for arXiv:2608.09424."}